Modelli e piattaforme di IA
GLM-5.3 ottiene 60 sull’Intelligence Index di Artificial Analysis, eguagliando Kimi K3

Il GLM-5.3 di Z.ai è stato valutato da Artificial Analysis a 60 sul suo Intelligence Index, l’ente indipendente ha riportato il 18 agosto 2026, collocando il più recente modello di ragionamento del laboratorio cinese allo stesso livello di Kimi K3 di Moonshot AI e a tre punti da Claude Opus 5 di Anthropic, l’attuale leader con 63.
Il punteggio considera il GLM-5.3 in esecuzione con il massimo sforzo di ragionamento, l’impostazione che Z.ai raccomanda per il lavoro di programmazione. Con 60, si colloca ben al di sopra della mediana di 35 dei 181 modelli della sua classe di confronto, ed è l’ottavo nella classe complessiva.
Il risultato è la prima valutazione indipendente su un modello che Z.ai ha rilasciato il 14 agosto 2026 con una costruzione insolita: il GLM-5.3 utilizza lo stesso modello di base del GLM-5.2, con tutti i miglioramenti di capacità derivanti dal post‑training anziché da una nuova fase di pre‑training.
Come è nato GLM-5.3
Il post di rilascio di Z.ai descrive un mese di scaling del reinforcement learning su ambienti di compiti a lungo orizzonte: più ambienti, compiti più diversi, più potenza di calcolo, tutto sulla stack di addestramento che il laboratorio ha costruito per il GLM-5.2. L’azienda ha riferito che questo approccio ha portato Terminal‑Bench 3.0 da 4,6 a 28,3 e DeepSWE v1.1 da 46,2 a 66,9, e il proprio post documenta una serie di risultati su programmazione, cybersecurity e benchmark agentici confrontati con Kimi K3, Claude Opus 4.8, Claude Fable 5 e GPT‑5.6 Sol. Unite.AI ha trattato il lancio e i suoi risultati emergenti in ambito cybersecurity in dettaglio quando il modello è stato lanciato la scorsa settimana.
Il valore di Artificial Analysis ha un peso diverso rispetto a quelle tabelle riportate dai fornitori, poiché il valutatore esegue autonomamente la propria suite. Il suo Intelligence Index v4.1.1 aggrega nove valutazioni che coprono compiti di lavoro reali agentici, uso di strumenti agentici, programmazione terminale, ragionamento scientifico e conoscenza, domande scientifiche a livello di laurea magistrale, ragionamento fisico, affidabilità della conoscenza e allucinazioni, e ragionamento su contesti lunghi. Il 60 del GLM-5.3 è il risultato composito della sua esecuzione su tale batteria, con un costo totale di valutazione di $1.238,50 sull’API di Z.ai.
Dove si posiziona GLM-5.3 nella classifica
La parità con Kimi K3 è il confronto principale. Kimi K3, rilasciato il 16 luglio 2026 ottiene lo stesso 60 sull’indice e rimane il modello open‑weights con il punteggio più alto nelle classifiche di Artificial Analysis, una posizione che GLM-5.3 ora condivide in termini di punteggio, se non di licenza. Moonshot ha aperto i pesi di Kimi K3 con una licenza basata sui ricavi nel luglio 2026; GLM-5.3 è attualmente elencato come proprietario, con Artificial Analysis che registra 753 miliardi di parametri per il modello.
Claude Opus 5, rilasciato il 24 luglio 2026 è ancora in testa all’indice con 63. Il divario di tre punti tra GLM-5.3 e il leader è la distanza che un rapido ciclo di post‑training non è riuscito a colmare, contro una frontiera che si è spostata dallo scorso primavera.
Il prezzo è dove i due modelli con 60 punti divergono nettamente. GLM-5.3 costa $1,40 per milione di token di input e $4,40 per milione di token di output sull’API di Z.ai, contro $3,00 e $15,00 per Kimi K3 su Moonshot. Per compito dell’Intelligence Index, ciò corrisponde a $0,68 per GLM-5.3 rispetto a $0,84 per Kimi K3 e $2,34 per Claude Opus 5. GLM-5.3 raggiunge il suo punteggio al costo per compito più basso dei tre, sebbene sia anche il più prolisso del gruppo, generando 170 milioni di token di output nella suite di valutazione rispetto a una mediana di 72 milioni nella sua classe.
Cosa arriverà dopo
GLM-5.3 è disponibile tramite l’API di Z.ai ed è stato distribuito a tutti gli abbonati al GLM Coding Plan. Il modello richiede l’abilitazione della modalità “thinking”, con tre livelli di sforzo, e Z.ai avverte che le applicazioni che lo chiamano con il “thinking” disabilitato continueranno a fallire finché non verranno migrate.
I pesi sono la parte rimanente. Z.ai si è impegnata a rilasciarli due settimane dopo il lancio del 14 agosto 2026, una volta completate la valutazione di sicurezza e il rafforzamento, il che metterebbe GLM-5.3 accanto a Kimi K3 come opzione open‑weights al punteggio 60 dell’indice, a circa la metà del prezzo per token.












