Modelos e plataformas de IA

GLM-5.3 obtém 60 no Índice de Inteligência da Artificial Analysis, igualando-se ao Kimi K3

mm
Adicione Unite.AI às suas fontes preferidas no Google

O GLM-5.3 da Z.ai foi avaliado pela Artificial Analysis com 60 em seu Índice de Inteligência, informou o avaliador independente em 18 de agosto de 2026, posicionando o modelo de raciocínio mais recente do laboratório chinês no mesmo nível do Kimi K3 da Moonshot AI e três pontos atrás do Claude Opus 5 da Anthropic, líder atual com 63.

A pontuação refere‑se ao GLM-5.3 operando com o máximo esforço de raciocínio, a configuração que a Z.ai recomenda para trabalhos de codificação. Com 60, ele fica bem acima da mediana de 35 dos 181 modelos de sua classe de comparação, e ocupa a oitava posição na classe como um todo.

O resultado é a primeira leitura independente de um modelo que a Z.ai lançou em 14 de agosto de 2026 com uma construção incomum: o GLM-5.3 utiliza o mesmo modelo base do GLM-5.2, com todos os ganhos de capacidade provenientes de pós‑treinamento, em vez de uma nova fase de pré‑treinamento.

Como o GLM-5.3 Chegou Até Aqui

A postagem de lançamento da Z.ai descreve um mês de escalonamento de aprendizado por reforço em ambientes de tarefas de longo horizonte: mais ambientes, tarefas mais diversificadas, mais poder de computação, tudo na pilha de treinamento que o laboratório desenvolveu para o GLM-5.2. A empresa informou que essa abordagem elevou o Terminal‑Bench 3.0 de 4,6 para 28,3 e o DeepSWE v1.1 de 46,2 para 66,9, e sua própria postagem documenta uma variedade de resultados em codificação, cibersegurança e benchmarks agentes contra Kimi K3, Claude Opus 4.8, Claude Fable 5 e GPT‑5.6 Sol. A Unite.AI cobriu o lançamento e seus resultados emergentes de cibersegurança em detalhes quando o modelo foi enviado na semana passada.

O número da Artificial Analysis tem peso diferente dos tabelas relatadas pelos fornecedores, pois o avaliador executa sua própria suíte. Seu Índice de Inteligência v4.1.1 agrega nove avaliações que abrangem tarefas de trabalho reais agenticas, uso de ferramentas agenticas, codificação terminal, raciocínio científico e conhecimento, questões de ciência em nível de pós‑graduação, raciocínio em física, confiabilidade do conhecimento e alucinação, e raciocínio de longo contexto. O 60 do GLM-5.3 é o composto de sua execução nessa bateria, com um custo total de avaliação de US$ 1.238,50 na API da Z.ai.

Onde o GLM-5.3 se Posiciona na Tabela de Classificação

A paridade com o Kimi K3 é a comparação principal. Kimi K3, lançado em 16 de julho de 2026, obtém a mesma pontuação de 60 no índice e continua sendo o modelo de pesos abertos com a maior pontuação nas classificações da Artificial Analysis, posição que o GLM-5.3 agora compartilha em pontuação, embora não em licença. A Moonshot abriu os pesos do Kimi K3 sob uma licença baseada em receita em julho de 2026; o GLM-5.3 está listado como proprietário por enquanto, com a Artificial Analysis registrando 753 bilhões de parâmetros para o modelo.

Claude Opus 5, lançado em 24 de julho de 2026, ainda lidera o índice com 63. A diferença de três pontos entre o GLM-5.3 e o líder é a distância que um ciclo rápido de pós‑treinamento não conseguiu fechar, contra uma fronteira que já avançou desde a primavera.

O preço é onde os dois modelos com pontuação 60 divergem nitidamente. O GLM-5.3 custa US$ 1,40 por milhão de tokens de entrada e US$ 4,40 por milhão de tokens de saída na API da Z.ai, contra US$ 3,00 e US$ 15,00 para o Kimi K3 na Moonshot. Por tarefa do Índice de Inteligência, isso equivale a US$ 0,68 para o GLM-5.3 versus US$ 0,84 para o Kimi K3 e US$ 2,34 para o Claude Opus 5. O GLM-5.3 atinge sua pontuação com o menor custo por tarefa dos três, embora também seja o mais verboso do grupo, gerando 170 milhões de tokens de saída ao longo da suíte de avaliação, contra uma mediana de 72 milhões em sua classe.

O Que Vem a Seguir

O GLM-5.3 está disponível através da API da Z.ai e foi disponibilizado para todos os assinantes do GLM Coding Plan. O modelo requer que o modo de pensamento esteja ativado, com três níveis de esforço, e a Z.ai alerta que aplicações que ainda o chamarem com o pensamento desativado falharão até serem migradas.

Os pesos são a peça restante. A Z.ai compromete‑se a divulgá‑los duas semanas após o lançamento de 14 de agosto de 2026, assim que a avaliação de segurança e o reforço estiverem concluídos, o que colocaria o GLM-5.3 ao lado do Kimi K3 como uma opção de pesos abertos no marco 60 do índice, a aproximadamente metade do preço por token.

Jonas Reeve é um analista gerado por IA na Unite.AI, com foco em inteligência artificial cognitiva, inteligência artificial geral (AGI) e fundamentos teóricos de inteligência de máquina. Seu trabalho explora como aprendizado, raciocínio, memória e abstração surgem em sistemas biológicos e artificiais, estabelecendo conexões entre arquiteturas de IA modernas e questões de longa data em ciência cognitiva e filosofia da mente.
Com uma abordagem conceitual e reflexiva, Jonas examina estruturas como modelos de raciocínio, sistemas agênticos, cognição emergente e teoria de alinhamento, visando esclarecer o que o progresso em direção à AGI realmente significa - e o que não significa. Em vez de perseguir cronogramas ou hype, ele enfatiza princípios fundamentais, rigor conceitual e os limites dos modelos atuais.
Artigos escritos por Jonas Reeve são gerados por IA e revisados pela equipe editorial da Unite.AI para garantir precisão, clareza e discussão responsável de conceitos de IA avançados.