AI-modellen en platforms

GLM-5.3 scoort 60 op de Artificial Analysis Intelligence Index, gelijk aan Kimi K3

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

Z.ai’s GLM-5.3 is geëvalueerd door Artificial Analysis met een score van 60 op hun Intelligence Index, meldde de onafhankelijke beoordelaar op 18 augustus 2026, waarmee het nieuwste redeneermodel van het Chinese laboratorium op gelijke hoogte staat met Moonshot AI’s Kimi K3 en drie punten achter Anthropic’s Claude Opus 5, de huidige leider met 63.

De score betreft GLM-5.3 die draait op maximale redeneerinspanning, de instelling die Z.ai aanbeveelt voor programmeerwerk. Met 60 ligt hij ver boven de mediaan van 35 van de 181 modellen in zijn vergelijkingsklasse, en staat hij als achtste in de klasse overall.

Het resultaat is de eerste onafhankelijke beoordeling van een model dat Z.ai op 14 augustus 2026 heeft uitgebracht met een ongebruikelijke constructie: GLM-5.3 gebruikt hetzelfde basismodel als GLM-5.2, waarbij elke capaciteitswinst voortkomt uit post-training in plaats van een nieuwe pretraining-run.

Hoe GLM-5.3 hier kwam

De releasepost van Z.ai beschrijft een maand van opschaling van reinforcement learning op langetermijn‑taakomgevingen: meer omgevingen, meer diverse taken, meer rekenkracht, alles op de trainingsstack die het laboratorium voor GLM-5.2 heeft gebouwd. Het bedrijf meldde dat deze aanpak Terminal‑Bench 3.0 van 4.6 naar 28.3 bracht en DeepSWE v1.1 van 46.2 naar 66.9, en hun eigen post documenteert een reeks resultaten over programmeren, cyberbeveiliging en agentische benchmarks ten opzichte van Kimi K3, Claude Opus 4.8, Claude Fable 5 en GPT-5.6 Sol. Unite.AI behandelde de lancering en de opkomende cyberbeveiligingsresultaten in detail toen het model vorige week werd uitgebracht.

Het getal van Artificial Analysis weegt zwaarder dan die vendor‑gerapporteerde tabellen, omdat de beoordelaar de suite zelf uitvoert. De Intelligence Index v4.1.1 bundelt negen evaluaties die agentische real‑world‑werktaken, agentisch gereedschapsgebruik, terminal‑coding, wetenschappelijk redeneren en kennis, wetenschapsvragen op graduate‑niveau, natuurkundige redenering, kennisbetrouwbaarheid en hallucinaties, en redeneren met lange context omvatten. De 60 van GLM-5.3 is de samenstelling van de uitvoering over die reeks, met een totale evaluatiekost van $1,238.50 op de API van Z.ai.

Waar GLM-5.3 zich bevindt op het klassement

De gelijkheid met Kimi K3 is de belangrijkste vergelijking. Kimi K3, uitgebracht op 16 juli 2026, behaalt dezelfde 60 op de index en blijft het best presterende open‑weights‑model in de ranglijst van Artificial Analysis, een positie die GLM-5.3 nu deelt in score, zij het niet in licentie. Moonshot opende de gewichten van Kimi K3 onder een omzet‑gebaseerde licentie in juli 2026; GLM-5.3 wordt voorlopig als propriëtair vermeld, met Artificial Analysis die 753 miljard parameters voor het model registreert.

Claude Opus 5, uitgebracht op 24 juli 2026, leidt de index nog steeds met 63. Het drie‑punt verschil tussen GLM-5.3 en de leider is de afstand die een snelle post‑training‑cyclus niet heeft kunnen overbruggen, tegenover een frontier die zelf al sinds het voorjaar is verschoven.

Prijs is waar de twee 60‑scorers sterk uiteenlopen. GLM-5.3 kost $1.40 per miljoen invoertokens en $4.40 per miljoen uitvoertokens op de API van Z.ai, tegenover $3.00 en $15.00 voor Kimi K3 op die van Moonshot. Per Intelligence Index‑taak komt dat neer op $0.68 voor GLM-5.3 versus $0.84 voor Kimi K3 en $2.34 voor Claude Opus 5. GLM-5.3 bereikt zijn score tegen de laagste kosten per taak van de drie, hoewel het ook het meest woordrijke model van de groep is, met 170 miljoen gegenereerde uitvoertokens in de evaluatiesuite tegenover een mediaan van 72 miljoen in zijn klasse.

Wat er hierna wordt uitgebracht

GLM-5.3 is beschikbaar via de API van Z.ai en is uitgerold naar alle abonnees van het GLM Coding Plan. Het model vereist dat ‘thinking’ is ingeschakeld, met drie inspanningsniveaus, en Z.ai waarschuwt dat toepassingen die het nog steeds aanroepen met ‘thinking’ uitgeschakeld, zullen falen totdat ze gemigreerd zijn.

De gewichten vormen het resterende onderdeel. Z.ai heeft zich gecommitteerd om ze twee weken na de lancering op 14 augustus 2026 vrij te geven, zodra de veiligheidsevaluatie en verharding voltooid zijn, waardoor GLM-5.3 naast Kimi K3 als een open‑weights‑optie op de 60‑markering van de index zou komen, tegen ongeveer de helft van de prijs per token.

Jonas Reeve is een AI-gegenereerde analist bij Unite.AI, met een focus op cognitieve AI, kunstmatige algemene intelligentie (AGI) en de theoretische grondslagen van machine-intelligentie. Zijn werk onderzoekt hoe leren, redeneren, geheugen en abstractie ontstaan in zowel biologische als kunstmatige systemen, en trekt verbindingen tussen moderne AI-architecturen en langdurige vragen in cognitieve wetenschap en filosofie van de geest.
Met een conceptuele en reflectieve benadering, onderzoekt Jonas kaders zoals redeneermodellen, agente systemen, emergente cognitie en align-theorie, met als doel om duidelijk te maken wat vooruitgang naar AGI eigenlijk betekent - en wat niet. In plaats van tijdlijnen of hype na te jagen, benadrukt hij eerst principes, conceptuele rigor en de beperkingen van huidige modellen.
Artikelen geschreven door Jonas Reeve zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om ervoor te zorgen dat ze accurate, duidelijke en verantwoorde discussies over geavanceerde AI-concepten bevatten.