Introdução
A Zhipu AI abriu oficialmente o acesso à API do seu mais recente modelo principal GLM-5.3, direcionado para programação complexa, tarefas de agente de ciclo longo e cargas de trabalho relacionadas à segurança cibernética.
O anúncio de 19 de agosto colocou o modelo diretamente na stack de API de nível de produção da Z.AI e no plano de programação GLM. No atual Índice de Inteligência de Análise Humana, o GLM-5.3 (max) obteve pontuação 60, situando-se na mesma faixa de ponta de vários modelos proprietários líderes, e empatando com o Kimi K3 (max) no índice.

No momento em que este artigo foi escrito, o modelo ainda não tinha pesos abertos. A Zhipu declarou no anúncio de 19 de agosto (republicado por vários veículos de tecnologia e finanças chineses) que os pesos seriam lançados em 28 de agosto de 2026 (sexta-feira).
GLM-5.3 Atinge 60 no Índice de Inteligência de Análise Humana
O número mais notável no relatório da AIBase é a pontuação de 60 no Índice de Inteligência de Análise Humana.
A Artificial Analysis atualmente lista o GLM-5.3 (max) com 60 pontos, a mesma pontuação do Kimi K3 (max). Esse resultado coloca o GLM-5.3 entre os mais fortes do conjunto de modelos atualmente comparados, mas um único índice composto não deve ser interpretado como evidência de que os dois modelos apresentam desempenho idêntico em todas as cargas de trabalho.
Uma visão geral útil é a seguinte:
| Modelo | Índice de Inteligência de Análise Humana |
|---|---|
| GLM-5.3 (max) | 60 |
| Kimi K3 (max) | 60 |
| Claude Fable 5, configuração específica de ponta | Acima de 60 na comparação atual da Artificial Analysis |
| GLM-5.2 (max) | 53 |
A mudança geracional importante é o salto do GLM-5.2 para o GLM-5.3, mantendo ao mesmo tempo o mesmo modelo-base subjacente.
Principais Melhorias Provenientes da Fase de Pós-Treinamento
A Z.AI afirma que o GLM-5.3 usa o mesmo modelo-base do GLM-5.2. Os ganhos de desempenho vêm de pós-treinamento adicional, não de um modelo-base recém-treinado.
A documentação oficial destaca melhorias em três áreas, consistentes com o artigo original da AIBase:
- Engenharia de software complexa
- Segurança cibernética defensiva e análise de vulnerabilidades
- Tarefas de agente de ciclo longo
No Code Bench da própria Z.AI, a empresa relata um aumento de desempenho de cerca de 50% em relação ao GLM-5.2. Resultados de benchmarks públicos também mostram melhorias significativas em tarefas de operação de terminal e engenharia de software de longa duração.
Por exemplo, a Z.AI relata que o GLM-5.3 subiu de 4,6 para 28,3 no Terminal-Bench 3.0, e de 46,2 para 66,9 no DeepSWE v1.1, ambos em comparação com o GLM-5.2.
Esses números são resultados de benchmarks divulgados pelo fornecedor e devem ser entendidos nesse contexto.
Desempenho em Segurança Cibernética Também Aumenta Substancialmente
A Z.AI afirma que o pós-treinamento adicional produziu, inesperadamente, capacidades mais fortes de segurança cibernética à medida que a escala de treinamento aumentava.
No conjunto de avaliação divulgado pela empresa, o GLM-5.3 atinge 84,5% no CyberGym, enquanto o GLM-5.2 fica em 77,2%. A empresa também relata ganhos ainda maiores em benchmarks mais orientados a exploração, como ExploitBench e ExploitGym.
Essa tendência é digna de nota porque, à medida que a dificuldade das tarefas aumenta, a magnitude da melhoria do GLM-5.3 torna-se maior
— passando da identificação de vulnerabilidades para o raciocínio sobre cadeias de exploração mais longas.
Entretanto, a própria tabela de benchmarks da Z.AI mostra que alguns modelos proprietários fechados de ponta ainda lideram nas avaliações de exploração mais difíceis. Portanto, a conclusão correta não é que o GLM-5.3 domine todos os benchmarks de segurança, mas sim que seu pós-treinamento proporcionou ganhos substanciais entre gerações.
GLM-5.3 Impulsiona a Fronteira Inteligência-Custo
O segundo gráfico do relatório original concentra-se em preços, e não na classificação bruta dos benchmarks.

A Artificial Analysis lista atualmente os seguintes preços da API própria da Z.AI:
| Tipo de Token | Preço por milhão de tokens do GLM-5.3 |
|---|---|
| Entrada | $1,40 |
| Entrada em cache | $0,26 |
| Saída | $4,40 |
Esses preços são exatamente os mesmos da tabela oficial atual do GLM-5.2.
A Artificial Analysis calcula um preço misto de aproximadamente $0,90/milhão de tokens, usando sua proporção de 7:2:1 para entrada em cache/entrada/saída. Seu relatório também mostra que o custo de avaliação do GLM-5.3 em seu Índice de Inteligência é de aproximadamente $1.238,50.
Assim, o gráfico de custos apoia o ponto central do artigo original: o GLM-5.3 combina uma pontuação composta de nível avançado com um preço de API relativamente baixo.
Isso não significa que todas as tarefas de produção se tornarão mais baratas. O custo real depende do comprimento da saída, da taxa de cache, do tamanho do prompt, da intensidade de raciocínio, do número de chamadas de ferramentas e do número de rodadas de interação do agente necessárias.
Preço da API Mantém-se Consistente com o GLM-5.2
A página oficial de preços da Z.AI confirma que o GLM-5.3 e o GLM-5.2 usam atualmente as mesmas tarifas por token.
Isso é significativo porque o modelo adiciona uma quantidade considerável de capacidade sem aumentar o preço tabelado da API.
Para equipes que já usam o GLM-5.2, a decisão de migração envolve, portanto, principalmente comportamento e compatibilidade, e não um novo nível de custo por token.
Os desenvolvedores ainda devem executar testes de regressão antes de mudar o tráfego de produção, pois o GLM-5.3 altera vários comportamentos e parâmetros do modelo.
GLM-5.3 Usa Raciocínio Obrigatório
Uma das diferenças é a configuração de raciocínio.
O GLM-5.3 tem o recurso de pensamento sempre ativado e suporta três níveis de intensidade de raciocínio:
lowhighmax
O valor padrão é max.
A Z.AI adverte que aplicações que usam a seguinte configuração antiga falharão na migração direta para o GLM-5.3:
{
"thinking": {
"type": "disabled"
}
}
Para o GLM-5.3, o recurso de pensamento deve permanecer ativado. Para trabalhos de programação complexos, a Z.AI recomenda usar o nível de intensidade de raciocínio mais profundo:
{
"model": "glm-5.3",
"thinking": {
"type": "enabled"
},
"reasoning_effort": "max"
}
Este é um exemplo de configuração oficial, não um trecho da breve fonte da AIBase; está incluído aqui porque afeta diretamente os desenvolvedores que migram do GLM-5.2.
Janela de Contexto e Comprimento de Saída
A documentação oficial do modelo lista:
Crie um site de apresentacao e gere leads em minutos
Descreva sua ideia uma vez e o We0 AI pode gerar um site de apresentacao, paginas e CMS, alem de ajudar a atrair clientes e trafego apos o lancamento.
Uma geração completa de projetos para registro gratuito
Melhor para experimentar um fluxo de geração completo e ver rapidamente um primeiro rascunho do projeto.
| Especificação | GLM-5.3 |
|---|---|
| Modalidade de entrada | Texto |
| Modalidade de saída | Texto |
| Janela de contexto | 1.000.000 tokens |
| Saída máxima | 128K tokens |
| Raciocínio | Sempre ativado |
| Intensidade de raciocínio | low / high / max |
O GLM-5.3 também suporta chamada de funções, saída estruturada, respostas em streaming, cache de contexto e chamada de ferramentas em streaming.
O modelo atualmente suporta apenas texto, portanto, desenvolvedores que precisam de capacidades diretas de compreensão de imagens precisarão usar um modelo de visão separado ou um fluxo de trabalho dedicado.
GLM-5.3 Já Disponível no ZCode e nos Planos de Programação GLM
O artigo da AIBase afirma que o GLM-5.3 foi integrado ao ZCode e aos planos de programação GLM.
Isso é confirmado pela documentação atual do produto da Z.AI.
ZCode
Descreva-o como um ambiente de desenvolvimento de agentes construído sobre o GLM-5.3, usado para planejar, codificar, revisar, depurar, testar e trabalhar em projetos de longo prazo. Seu fluxo de trabalho foi projetado para manter arquivos de projeto, saídas de terminal, contexto do navegador, status de execução e alterações do Git no mesmo tarefa contínua.
O GLM Coding Plan também lista o GLM-5.3 como um modelo suportado. O plano atual usa um sistema de cotas baseado em pontos, e horários fora de pico — incluindo fins de semana — consomem menos pontos.
O Z.AI também suporta o GLM-5.3 por meio de vários protocolos de API, incluindo endpoints compatíveis com OpenAI Chat Completions, OpenAI Responses e Anthropic Messages, sujeitos aos limites de planos e contas listados na documentação do Z.AI.
Uma chamada mínima de API GLM-5.3
Para desenvolvedores que desejam testar diretamente a nova API aberta, o identificador de modelo usado na documentação oficial do Z.AI é:
glm-5.3
Uma solicitação cURL básica segue a mesma estrutura da interface Chat Completions documentada pelo Z.AI:
curl -X POST "https://api.z.ai/api/paas/v4/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer your-api-key" \
-d '{
"model": "glm-5.3",
"messages": [
{
"role": "user",
"content": "Revise esta arquitetura de projeto e identifique os gargalos de engenharia de maior risco."
}
],
"thinking": {
"type": "enabled"
},
"reasoning_effort": "max"
}'
O endpoint e a configuração de modelo acima seguem a documentação oficial atual do Z.AI. Desenvolvedores que usam o Coding Plan devem verificar suas regras de endpoint separadas, pois o tráfego de assinatura e a cobrança padrão da API nem sempre são intercambiáveis.
Pesos programados para lançamento em 28 de agosto
O último ponto do texto original é o lançamento dos pesos abertos.
Em 19 de agosto, um anúncio relacionado à Zhipu afirmou que os pesos do GLM-5.3 serão abertos na próxima sexta-feira, correspondendo a 28 de agosto de 2026.
No momento em que este arquivo Markdown foi escrito, essa data ainda não havia chegado. O Artificial Analysis ainda classifica o GLM-5.3 como um modelo proprietário, pois os pesos do modelo baixáveis ainda não foram disponibilizados publicamente.
Portanto, a declaração mais precisa é:
A Zhipu anunciou planos de lançar os pesos do modelo GLM-5.3 em 28 de agosto de 2026, mas, até o momento da redação deste texto, os pesos ainda não estão disponíveis publicamente.
Assim que os pesos forem realmente lançados, os desenvolvedores devem verificar o repositório oficial, o modelo card, a licença, o número de parâmetros, os frameworks de inferência suportados e os requisitos de implantação antes de considerar esse lançamento como algo que pode ser auto-implantado.
Perguntas frequentes
O que é o GLM-5.3?
O GLM-5.3 é o mais recente modelo de texto principal da Zhipu AI / Z.AI, usado para
engenharia de software complexa, tarefas de agentes, raciocínio e trabalhos relacionados à segurança cibernética. Ele usa o mesmo modelo de base do GLM-5.2, e os principais ganhos de capacidade vêm de pós-treinamento adicional.
Qual é a pontuação do GLM-5.3 no Artificial Analysis?
O Artificial Analysis atualmente dá ao GLM-5.3 (max) uma pontuação de 60 no Intelligence Index. Na comparação atual, o Kimi K3 (max) também obtém 60 pontos, embora haja diferenças significativas no comportamento dos modelos em vários benchmarks e cargas de trabalho.
Qual é o custo da API do GLM-5.3?
O Z.AI atualmente cobra US$ 1,40 por milhão de tokens de entrada, US$ 0,26 por milhão de tokens de entrada em cache e US$ 4,40 por milhão de tokens de saída. Essas tarifas são as mesmas do preço oficial do GLM-5.2.
O GLM-5.3 suporta uma janela de contexto de 1 milhão de tokens?
Sim. A documentação oficial do Z.AI lista o GLM-5.3 com uma janela de contexto de 1.000.000 de tokens e um comprimento máximo de saída de 128 mil tokens.
O raciocínio pode ser desativado no GLM-5.3?
Não. O GLM-5.3 exige que o pensamento permaneça ativado. Os desenvolvedores podem controlar a profundidade do raciocínio por meio do parâmetro reasoning_effort, com valores possíveis de low, high ou max, sendo o padrão max.
O GLM-5.3 é open source ou tem pesos abertos?
Ainda não, até o momento da redação deste texto. A Zhipu anunciou planos de lançar os pesos em 28 de agosto de 2026, mas o pacote de pesos público e a licença final ainda precisam ser confirmados após o lançamento.
O GLM-5.3 pode ser usado para agentes de codificação?
Sim. O Z.AI integrou o modelo ao ZCode e ao GLM Coding Plan, e sua documentação lista compatibilidade com várias ferramentas de agentes de codificação e protocolos de API.
O GLM-5.3 suporta multimodalidade?
A documentação atual da API do GLM-5.3 lista apenas entrada de texto e saída de texto. Em sua forma atual, não é um modelo de entrada de imagem direta.
Ferramentas relacionadas
- ZCode: O ambiente de desenvolvimento de agentes do Z.AI, projetado em torno do GLM-5.3 para fluxos de trabalho de codificação e projetos de longa duração.
- Plataforma de API do Z.AI: A plataforma oficial para acessar os modelos GLM, chaves de API, cobrança e serviços para desenvolvedores.
- GLM Coding Plan: O plano de assinatura do Z.AI para usar modelos GLM em ferramentas de agentes de codificação suportadas.
- Artificial Analysis: Análise independente de modelos cobrindo inteligência, preço, velocidade e tamanho de contexto do GLM-5.3.
- Documentação para desenvolvedores do Z.AI: Documentação oficial de API, modelos, migração, preços e integração.
Links relacionados
- Documentação oficial do modelo GLM-5.3: Especificações oficiais, capacidades, configurações de raciocínio, endpoints, benchmarks e exemplos de início rápido.
- Blog oficial de lançamento do GLM-5.3: Artigo de lançamento do Z.AI sobre codificação, agentes de longa duração e desempenho emergente em segurança cibernética.
- Preços do Z.AI: Preços oficiais de tokens para GLM-5.3, GLM-5.2 e outros modelos do Z.AI.
- Migrar para o GLM-5.3: Checklist oficial de migração cobrindo IDs de modelo, pensamento forçado, esforço de raciocínio, saída em streaming e chamadas de ferramentas.
- [Documentação do ZCode](https://zcode.z.
ai/en/docs/welcome): Guia oficial para usar o GLM-5.3 nos fluxos de trabalho de desenvolvimento de agentes do ZCode.
- FAQ do GLM Coding Plan: Informações oficiais sobre modelos suportados, comportamento de cotas, endpoints e limites do plano.
- Artificial Analysis GLM-5.3: Análise independente atual de benchmarks e preços do GLM-5.3 (max).
Resumo
O GLM-5.3 agora está disponível via Z.
O ecossistema de API e programação de IA fornece. Sua pontuação atual no Índice de Inteligência Artificial é de 60, enquanto a Z.AI afirma que o maior ganho geracional vem de otimizações pós-treinamento focadas em codificação complexa, agentes de longo ciclo e tarefas de segurança cibernética.
O modelo mantém o preço da API do GLM-5.2, ao mesmo tempo em que adiciona uma janela de contexto de 1 milhão de tokens, saída de até 128K e recursos de raciocínio forçado com níveis ajustáveis de intensidade de inferência. Ele já foi integrado aos planos de programação ZCode e GLM.
A Zhipu também anunciou que os pesos do GLM-5.3 estão programados para serem lançados em 28 de agosto de
2026. Antes da publicação real do repositório de código e da licença, ele ainda deve ser descrito como um modelo acessível via API, com lançamento de pesos aberto planejado posteriormente, e não como um modelo aberto já disponível para download direto.
A mudança fundamental é simples: o GLM-5.3 eleva as capacidades sem aumentar o preço principal da API do GLM-5.2, ao mesmo tempo em que planeja a liberação pública dos pesos posteriormente.



