LM Studio adicionou suporte ao novo modelo GLM-5.3-Flash da Z.ai na sua plataforma de agentes de inteligência artificial Bionic, introduzindo funcionalidades de entrada multimodal, uma janela de contexto de 1 milhão de tokens e uma redução significativa nos preços em comparação com o antecessor GLM-5.2. O Bionic é uma plataforma da LM Studio destinada a tarefas de codificação, pesquisa e processamento de documentos, suportando os sistemas operativos macOS e Windows, e permitindo aos utilizadores escolher entre modelos implantados localmente ou modelos em nuvem hospedados em servidores nos Estados Unidos, sendo que estes últimos têm uma política rigorosa de não retenção de dados.
Desde a sua divulgação oficial a meio de julho, a LM Studio tem vindo a expandir continuamente o número de modelos e o âmbito de funcionalidades disponíveis na plataforma Bionic. Após a adição anterior do suporte ao Kimi K3 da Moonshot AI, agora é a vez de introduzir a nova criação da Z.ai, o GLM-5.3-Flash. A LM Studio afirmou que os custos de operação deste modelo podem ser até 10 vezes inferiores aos do GLM-5.2. O anúncio da LM Studio ocorreu apenas algumas horas antes do lançamento oficial do GLM-5.3-Flash, que já tinha sido testado anonimamente nas plataformas OpenCode e OpenRouter sob o codinome “Ox Alpha”, gerando ampla atenção.
GLM-5.3-Flash adota uma arquitetura de mistura de especialistas com desempenho comparável a modelos de ponta
O GLM-5.3-Flash pertence à arquitetura de mistura de especialistas (Mixture-of-Experts, MoE), com um total de 320 bilhões de parâmetros, ativando 18 bilhões de parâmetros por inferência, suportando entradas de imagem e texto, com uma janela de contexto de 1 milhão de tokens. Os resultados dos testes de referência divulgados pela Z.ai mostram que este modelo supera o GLM-5.2 em várias métricas, apresentando desempenho geral comparável a modelos de ponta como Anthropic, OpenAI, Google e DeepSeek.
Os utilizadores da LM Studio podem aceder a este modelo em nuvem diretamente através da plataforma, e as configurações e métodos de utilização podem ser consultados nas instruções oficiais.
| Item | Especificações |
|---|---|
| Nome do modelo | GLM-5.3-Flash |
| Desenvolvedor | Z.ai |
| Arquitetura | Mistura de especialistas (MoE) |
| Total de parâmetros | 320 bilhões |
| Parâmetros ativados | 18 bilhões |
| Janela de contexto | 1 milhão de tokens |
| Suporte de entrada | Imagem, texto |
| Plataforma de operação | LM Studio Bionic (macOS, Windows) |

