Modelos e plataformas de IA
GLM-5.3 obtém 60 no Índice de Inteligência da Artificial Analysis, igualando-se ao Kimi K3

O GLM-5.3 da Z.ai foi avaliado pela Artificial Analysis com 60 em seu Índice de Inteligência, informou o avaliador independente em 18 de agosto de 2026, posicionando o modelo de raciocínio mais recente do laboratório chinês no mesmo nível do Kimi K3 da Moonshot AI e três pontos atrás do Claude Opus 5 da Anthropic, líder atual com 63.
A pontuação refere‑se ao GLM-5.3 operando com o máximo esforço de raciocínio, a configuração que a Z.ai recomenda para trabalhos de codificação. Com 60, ele fica bem acima da mediana de 35 dos 181 modelos de sua classe de comparação, e ocupa a oitava posição na classe como um todo.
O resultado é a primeira leitura independente de um modelo que a Z.ai lançou em 14 de agosto de 2026 com uma construção incomum: o GLM-5.3 utiliza o mesmo modelo base do GLM-5.2, com todos os ganhos de capacidade provenientes de pós‑treinamento, em vez de uma nova fase de pré‑treinamento.
Como o GLM-5.3 Chegou Até Aqui
A postagem de lançamento da Z.ai descreve um mês de escalonamento de aprendizado por reforço em ambientes de tarefas de longo horizonte: mais ambientes, tarefas mais diversificadas, mais poder de computação, tudo na pilha de treinamento que o laboratório desenvolveu para o GLM-5.2. A empresa informou que essa abordagem elevou o Terminal‑Bench 3.0 de 4,6 para 28,3 e o DeepSWE v1.1 de 46,2 para 66,9, e sua própria postagem documenta uma variedade de resultados em codificação, cibersegurança e benchmarks agentes contra Kimi K3, Claude Opus 4.8, Claude Fable 5 e GPT‑5.6 Sol. A Unite.AI cobriu o lançamento e seus resultados emergentes de cibersegurança em detalhes quando o modelo foi enviado na semana passada.
O número da Artificial Analysis tem peso diferente dos tabelas relatadas pelos fornecedores, pois o avaliador executa sua própria suíte. Seu Índice de Inteligência v4.1.1 agrega nove avaliações que abrangem tarefas de trabalho reais agenticas, uso de ferramentas agenticas, codificação terminal, raciocínio científico e conhecimento, questões de ciência em nível de pós‑graduação, raciocínio em física, confiabilidade do conhecimento e alucinação, e raciocínio de longo contexto. O 60 do GLM-5.3 é o composto de sua execução nessa bateria, com um custo total de avaliação de US$ 1.238,50 na API da Z.ai.
Onde o GLM-5.3 se Posiciona na Tabela de Classificação
A paridade com o Kimi K3 é a comparação principal. Kimi K3, lançado em 16 de julho de 2026, obtém a mesma pontuação de 60 no índice e continua sendo o modelo de pesos abertos com a maior pontuação nas classificações da Artificial Analysis, posição que o GLM-5.3 agora compartilha em pontuação, embora não em licença. A Moonshot abriu os pesos do Kimi K3 sob uma licença baseada em receita em julho de 2026; o GLM-5.3 está listado como proprietário por enquanto, com a Artificial Analysis registrando 753 bilhões de parâmetros para o modelo.
Claude Opus 5, lançado em 24 de julho de 2026, ainda lidera o índice com 63. A diferença de três pontos entre o GLM-5.3 e o líder é a distância que um ciclo rápido de pós‑treinamento não conseguiu fechar, contra uma fronteira que já avançou desde a primavera.
O preço é onde os dois modelos com pontuação 60 divergem nitidamente. O GLM-5.3 custa US$ 1,40 por milhão de tokens de entrada e US$ 4,40 por milhão de tokens de saída na API da Z.ai, contra US$ 3,00 e US$ 15,00 para o Kimi K3 na Moonshot. Por tarefa do Índice de Inteligência, isso equivale a US$ 0,68 para o GLM-5.3 versus US$ 0,84 para o Kimi K3 e US$ 2,34 para o Claude Opus 5. O GLM-5.3 atinge sua pontuação com o menor custo por tarefa dos três, embora também seja o mais verboso do grupo, gerando 170 milhões de tokens de saída ao longo da suíte de avaliação, contra uma mediana de 72 milhões em sua classe.
O Que Vem a Seguir
O GLM-5.3 está disponível através da API da Z.ai e foi disponibilizado para todos os assinantes do GLM Coding Plan. O modelo requer que o modo de pensamento esteja ativado, com três níveis de esforço, e a Z.ai alerta que aplicações que ainda o chamarem com o pensamento desativado falharão até serem migradas.
Os pesos são a peça restante. A Z.ai compromete‑se a divulgá‑los duas semanas após o lançamento de 14 de agosto de 2026, assim que a avaliação de segurança e o reforço estiverem concluídos, o que colocaria o GLM-5.3 ao lado do Kimi K3 como uma opção de pesos abertos no marco 60 do índice, a aproximadamente metade do preço por token.












