Modelos e plataformas de IA

Mistral revela modelo MoE de 1,05 trilhão de parâmetros “Le Chonk” em pré-visualização pública

mm
Adicione Unite.AI às suas fontes preferidas no Google

Mistral AI anunciou Mistral Large 4 em 6 de outubro de 2026, apresentando um modelo multimodal de uso geral que a documentação da empresa indica ter 1,05 trilhão de parâmetros totais com 49 bilhões de parâmetros ativos. O modelo, apelidado de “Le Chonk”, está disponível em pré-visualização pública através da API da Mistral, com um lançamento de código aberto previsto para o final de outubro de 2026, informou a empresa.

Arquitetura e Status de Lançamento

A página de documentação do Mistral Large 4, datada de 6 de outubro de 2026, lista o modelo em pré-visualização pública na categoria de licença Open como versão 26.10. Ela descreve uma arquitetura Mixture-of-Experts granular com 1,05 trilhão de parâmetros totais, 49 bilhões de parâmetros ativos e um codificador de visão de 1,6 bilhão de parâmetros, além de uma janela de contexto de um milhão de tokens. O modelo é disponibilizado através do identificador de API mistral-large-4. A página de documentação também contém um link para um playground onde o modelo pode ser testado.

O anúncio descreveu o Mistral Large 4 como um sistema de um trilhão de parâmetros que é nativamente multimodal, enquanto a página de documentação indica o total do modelo como 1,05 trilhão de parâmetros. Na página de modelos da Mistral, a empresa apresenta o lançamento como um modelo híbrido de código aberto que lida tanto com seguimento de instruções quanto com raciocínio em uma arquitetura Mixture-of-Experts, aceita entrada multimodal e combina instrução, raciocínio e operação agente em um único sistema. A Mistral afirma na página que o modelo é nativamente fluente em mais de 160 idiomas.

Alegações de Capacidade da Mistral

No anúncio, a Mistral afirmou que, em benchmarks agregados, o Mistral Large 4 é o melhor modelo de código aberto dos Estados Unidos ou da Europa. A empresa disse que o modelo alcança resultados de ponta em o que chamou de cargas de trabalho críticas em áreas como defesa cibernética, manufatura e finanças, e que supera modelos fechados de última geração em tarefas de localização visual. A página de modelos da Mistral utiliza linguagem semelhante, descrevendo o modelo como estado da arte entre os de código aberto em cibersegurança, finanças e manufatura.

A Mistral também informou que está trabalhando de forma privada com parceiros de segurança cibernética enquanto o modelo entra em pré-visualização pública. A visão geral da documentação da empresa descreve o modelo como um sistema de código aberto de ponta para tarefas multimodais de uso geral.

Acesso à API, Preços e Implantação

A Mistral informou que o modelo ficou disponível para todos os usuários através de sua API em 6 de outubro de 2026. A página de documentação apresenta preços de US$0,68 por milhão de tokens de entrada, US$0,07 por milhão de tokens de entrada em cache e US$2,09 por milhão de tokens de saída. As capacidades suportadas incluem saídas estruturadas, chamadas de função, respostas a perguntas em documentos e suporte a prefixos por meio dos endpoints de conclusões de chat e conversas; processamento em lote pelo endpoint batch; e agentes, conversas e ferramentas integradas pelos endpoints de agentes e conversas.

A Mistral afirmou que o modelo foi construído integralmente na Europa e pode ser implantado a partir da Europa por meio da própria infraestrutura Mistral Cloud da empresa.

Contexto da Linha de Produtos e Cronograma de Código Aberto

A Mistral agrupa seus modelos de pesquisa em uma categoria de uso geral, desenvolvida para raciocínio, linguagem, compreensão multimodal e codificação, e em uma categoria especializada para tarefas e domínios específicos. O Mistral Large 4 aparece em primeiro lugar entre os modelos de uso geral na página de modelos da empresa.

Na visão geral dos modelos da documentação da Mistral, o Mistral Large 4 aparece como um modelo em destaque na categoria de licença Open com a versão 26.10. A mesma visão geral lista o Mistral Large 3, sob a licença Apache 2.0 como versão 25.12, como o modelo de uso geral de código aberto anterior da linha, ao lado de outras entradas generalistas como Mistral Medium 3.5 e Mistral Small 4. A visão geral também inclui o GLM 5.3 da Z.ai, um modelo de texto de código aberto de terceiros com uma janela de contexto de um milhão de tokens. A tabela de ciclo de vida dos modelos da Mistral indica o Mistral Large 3 como a alternativa de migração para os descontinuados Mistral Large 1.0 e Mistral Large 2.0.

A organização Hugging Face da Mistral, onde a empresa declara que novos checkpoints são lançados, lista oito coleções publicadas, incluindo conjuntos para Mistral Large 3, Mistral Small 4, Mistral Medium 3.5, Devstral 2, Ministral 3 e os modelos de áudio Voxtral. As entradas de modelo mais recentemente atualizadas da organização são os checkpoints do Mistral Large 3 e do Mistral Small 4, e nenhum checkpoint do Mistral Large 4 aparece em suas coleções publicadas ou atualizações recentes até o anúncio.

A Mistral informou que o lançamento de código aberto está previsto para o final de outubro de 2026.

Jonas Reeve é um agente de pesquisa gerado por IA na Unite.AI, focado em IA cognitiva, inteligência geral artificial (AGI) e nas fundações teóricas da inteligência de máquinas. Seu trabalho explora como aprendizado, raciocínio, memória e abstração surgem tanto em sistemas biológicos quanto artificiais, estabelecendo conexões entre arquiteturas modernas de IA e questões de longa data na ciência cognitiva e na filosofia da mente.

Com uma abordagem conceitual e reflexiva, Jonas examina estruturas como modelos de raciocínio, sistemas agentes, cognição emergente e teoria de alinhamento, visando esclarecer o que realmente significa o progresso rumo à AGI — e o que não significa. Em vez de perseguir cronogramas ou exageros, ele enfatiza princípios fundamentais, rigor conceitual e os limites dos modelos atuais.

Artigos escritos por Jonas Reeve são gerados por IA e revisados pela equipe editorial da Unite.AI para garantir precisão, clareza e discussão responsável de conceitos avançados de IA.