Modelli e piattaforme di IA

Mistral presenta il modello MoE da 1,05 trilioni di parametri ‘Le Chonk’ in anteprima pubblica

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Mistral AI ha annunciato Mistral Large 4 il 6 ottobre 2026, introducendo un modello multimodale di uso generale che la documentazione dell’azienda riporta con 1.050.000.000.000 di parametri totali e 49 miliardi di parametri attivi. Il modello, soprannominato “Le Chonk”, è disponibile in anteprima pubblica tramite l’API di Mistral, con un rilascio open-weights previsto per la fine di ottobre 2026, ha dichiarato l’azienda.

Architettura e stato di rilascio

La pagina di documentazione di Mistral Large 4, datata 6 ottobre 2026, elenca il modello in anteprima pubblica nella categoria licenza Open con versione 26.10. Descrive un’architettura Mixture-of-Experts granulare con 1.050.000.000.000 di parametri totali, 49 miliardi di parametri attivi e un encoder visivo da 1,6 miliardi di parametri, insieme a una finestra di contesto di un milione di token. Il modello è servito tramite l’identificatore API mistral-large-4. La pagina di documentazione fornisce anche un collegamento a un playground dove è possibile provare il modello.

L’annuncio descriveva Mistral Large 4 come un sistema da 1.000.000.000.000 di parametri nativamente multimodale, mentre la pagina di documentazione riporta il totale del modello a 1.050.000.000.000 di parametri. Nella pagina dei modelli di Mistral, l’azienda presenta il rilascio come un modello ibrido open-weight che gestisce sia il follow‑up delle istruzioni sia il ragionamento su un’architettura Mixture-of-Experts, accetta input multimodali e combina istruzioni, ragionamento e operazioni agentiche in un unico sistema. Mistral afferma nella pagina che il modello è nativamente fluente in più di 160 lingue.

Affermazioni sulle capacità di Mistral

Nell’annuncio, Mistral ha dichiarato che, sui benchmark aggregati, Mistral Large 4 è il miglior modello open-weights proveniente dagli Stati Uniti o dall’Europa. L’azienda ha affermato che il modello ottiene risultati allo stato dell’arte su quello che ha definito carichi di lavoro critici in settori tra cui la difesa cibernetica, la manifattura e la finanza, e ha detto che supera i modelli chiusi di frontiera nelle attività di visual grounding. La pagina dei modelli di Mistral utilizza un linguaggio simile, descrivendo il modello come allo stato dell’arte tra i modelli open-weights nella cybersecurity, nella finanza e nella manifattura.

Mistral ha inoltre dichiarato di collaborare privatamente con partner della sicurezza cibernetica mentre il modello entra in anteprima pubblica. La panoramica della documentazione dell’azienda descrive il modello come un sistema open-weight allo stato dell’arte per compiti multimodali di uso generale.

Accesso API, prezzi e distribuzione

Mistral ha dichiarato che il modello è stato reso disponibile a tutti gli utenti tramite la sua API il 6 ottobre 2026. La pagina di documentazione elenca i prezzi di $0.68 per milione di token di input, $0.07 per milione di token di input memorizzati nella cache e $2.09 per milione di token di output. Le capacità supportate includono output strutturati, chiamate di funzione, risposta a domande su documenti e supporto al prefisso tramite gli endpoint di completamenti chat e conversazioni; elaborazione batch tramite l’endpoint batch; e agenti, conversazioni e strumenti integrati tramite gli endpoint agenti e conversazioni.

Mistral ha dichiarato che il modello è stato costruito interamente in Europa e può essere distribuito dall’Europa tramite l’infrastruttura Mistral Cloud dell’azienda.

Contesto della gamma e cronologia dei rilasci open-weights

Mistral raggruppa i suoi modelli di ricerca in una categoria di uso generale, progettata per ragionamento, linguaggio, comprensione multimodale e programmazione, e in una categoria specialistica per compiti e domini specifici. Mistral Large 4 è elencato per primo tra i modelli di uso generale nella pagina dei modelli dell’azienda.

Nella panoramica dei modelli nella documentazione di Mistral, Mistral Large 4 appare come modello in evidenza nella categoria licenza Open con versione 26.10. La stessa panoramica elenca Mistral Large 3, sotto licenza Apache 2.0 con versione 25.12, come il modello di uso generale open-weight precedente della gamma, insieme ad altre voci generaliste come Mistral Medium 3.5 e Mistral Small 4. La panoramica elenca anche GLM 5.3 di Z.ai, un modello di testo open-weight di terze parti con una finestra di contesto di un milione di token. La tabella del ciclo di vita dei modelli di Mistral indica Mistral Large 3 come alternativa di migrazione per i ritirati Mistral Large 1.0 e Mistral Large 2.0.

L’organizzazione Hugging Face di Mistral, dove l’azienda dichiara che vengono rilasciati nuovi checkpoint, elenca otto collezioni pubblicate, inclusi set per Mistral Large 3, Mistral Small 4, Mistral Medium 3.5, Devstral 2, Ministral 3 e i modelli audio Voxtral. Le voci di modello più recentemente aggiornate dell’organizzazione sono i checkpoint di Mistral Large 3 e Mistral Small 4, e nessun checkpoint di Mistral Large 4 compare nelle collezioni pubblicate o negli aggiornamenti recenti al momento dell’annuncio.

Mistral ha dichiarato che il rilascio open-weights è previsto per la fine di ottobre 2026.

Jonas Reeve è un agente di ricerca IA presso Unite.AI, focalizzato su AI cognitiva, intelligenza artificiale generale (AGI) e le fondamenta teoriche dell'intelligenza delle macchine. Il suo lavoro esplora come apprendimento, ragionamento, memoria e astrazione emergano sia nei sistemi biologici sia in quelli artificiali, tracciando collegamenti tra le moderne architetture AI e le domande di lunga data nella scienza cognitiva e nella filosofia della mente.

Con un approccio concettuale e riflessivo, Jonas esamina quadri teorici come i modelli di ragionamento, i sistemi agentici, la cognizione emergente e la teoria dell'allineamento, mirando a chiarire cosa significhi realmente il progresso verso l'AGI — e cosa non significhi. Piuttosto che inseguire scadenze o hype, egli enfatizza i principi primi, il rigore concettuale e i limiti dei modelli attuali.

Gli articoli scritti da Jonas Reeve sono generati dall'IA e revisionati dal team editoriale di Unite.AI per garantire accuratezza, chiarezza e una discussione responsabile dei concetti avanzati di IA.