Modely a platformy AI

GLM-5.3 získává 60 v Artificial Analysis Intelligence Index, dosahuje úrovně Kimi K3

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

GLM-5.3 od Z.ai byl hodnocen společností Artificial Analysis na 60 v jejím Intelligence Index, informoval nezávislý hodnotitel 18. srpna 2026, čímž se čínské laboratoři nejnovějšímu modelu pro uvažování postaví na úroveň Kimi K3 od Moonshot AI a o tři body zaostává za Claude Opus 5 od Anthropic, který je aktuálním lídrem s 63 body.

Toto skóre zahrnuje provoz GLM-5.3 při maximálním úsilí o uvažování, což Z.ai doporučuje pro programovací úlohy. S 60 body leží výrazně nad mediánem 35 ze 181 modelů v jeho srovnávací třídě a je osmým v celkové žebříčku.

Jedná se o první nezávislé hodnocení modelu, který Z.ai vydal 14. srpna 2026 a má neobvyklou konstrukci: GLM-5.3 používá stejný základní model jako GLM-5.2, přičemž veškeré zlepšení schopností pochází z post‑trainingu místo nového předtrénovacího běhu.

Jak GLM-5.3 vznikl

Příspěvek o vydání od Z.ai popisuje měsíc škálování posilovaného učení na dlouhodobých úlohách: více prostředí, rozmanitější úkoly, více výpočetního výkonu, vše na tréninkovém stacku, který laboratoř vytvořila pro GLM-5.2. Společnost uvedla, že tento přístup posunul Terminal‑Bench 3.0 z 4,6 na 28,3 a DeepSWE v1.1 z 46,2 na 66,9, a její vlastní příspěvek dokumentuje řadu výsledků napříč programováním, kybernetickou bezpečností a agenturními benchmarky proti Kimi K3, Claude Opus 4.8, Claude Fable 5 a GPT‑5.6 Sol. Unite.AI podrobně pokryl spuštění a jeho vznikající výsledky v oblasti kybernetické bezpečnosti, když model byl minulý týden uveden na trh.

Číslo od Artificial Analysis má jinou váhu než tabulky uváděné dodavateli, protože hodnotitel spouští svůj soubor testů sám. Jeho Intelligence Index v4.1.1 agreguje devět hodnocení zahrnujících agenturní reálné pracovní úkoly, používání agenturních nástrojů, terminální programování, vědecké uvažování a znalosti, otázky ze studia na úrovni postgraduálního vzdělání, fyzikální uvažování, spolehlivost znalostí a halucinace a dlouhý kontextový rozum. Skóre 60 GLM-5.3 je souhrnem jeho výkonu v této sérii, přičemž celkové náklady na hodnocení činily 1 238,50 $ na API Z.ai.

Kde GLM-5.3 stojí v žebříčku

Rovnost s Kimi K3 je hlavní srovnání. Kimi K3, vydaný 16. července 2026, dosahuje stejného skóre 60 v indexu a zůstává nejlépe hodnoceným modelem s otevřenými váhami v žebříčcích Artificial Analysis, pozice, kterou GLM-5.3 nyní sdílí ve skóre, i když ne v licencování. Moonshot otevřel váhy Kimi K3 pod licencí založenou na výnosech v červenci 2026; GLM-5.3 je zatím uveden jako proprietární, přičemž Artificial Analysis zaznamenal pro model 753 miliard parametrů.

Claude Opus 5, vydaný 24. července 2026, stále vede v indexu s 63 body. Tříbodový rozdíl mezi GLM-5.3 a lídrem představuje vzdálenost, kterou rychlý post‑trainingový cyklus nezavřel, proti hranici, která se od jara posunula.

Cena je oblast, kde se oba modely s 60 body výrazně liší. GLM-5.3 stojí 1,40 $ za milion vstupních tokenů a 4,40 $ za milion výstupních tokenů na API Z.ai, oproti 3,00 $ a 15,00 $ u Kimi K3 na Moonshotu. Na úkol v Intelligence Index to vychází na 0,68 $ pro GLM-5.3 versus 0,84 $ pro Kimi K3 a 2,34 $ pro Claude Opus 5. GLM-5.3 dosahuje svého skóre za nejnižší cenu za úkol ze všech tří, ačkoliv je také nejvýraznějším vygenerátorem, generuje 170 milionů výstupních tokenů v celé testovací sadě oproti mediánu 72 milionů ve své třídě.

Co bude dál

GLM-5.3 je dostupný přes API Z.ai a byl nasazen všem předplatitelům GLM Coding Plan. Model vyžaduje zapnutou funkci „thinking“ se třemi úrovněmi úsilí a Z.ai varuje, že aplikace, které jej nadále volají se zakázaným „thinking“, selžou, dokud nebudou migrovány.

Váhy jsou poslední součástí. Z.ai se zavázalo je zveřejnit dva týdny po spuštění 14. srpna 2026, jakmile bude dokončeno hodnocení bezpečnosti a zesílení, což by umístilo GLM-5.3 vedle Kimi K3 jako možnost s otevřenými váhami na úrovni 60 v indexu, přibližně za polovinu ceny za token.

Jonas Reeve je analytikum generovaným pomocí AI ve společnosti Unite.AI, zaměřujícím se na kognitivní AI, umělou obecnou inteligenci (AGI) a teoretické základy strojového učení. Jeho práce zkoumá, jak se učí, reasoning, paměť a abstrakce objevují v biologických i umělých systémech, a to tím, že spojuje moderní architektury AI s dlouholetými otázkami kognitivní vědy a filozofie mysli.
S konceptuálním a reflexivním přístupem Jonas zkoumá rámce, jako jsou modely uvažování, agentic systémy, emergentní kognice a teorie sladění, s cílem objasnit, co skutečně znamená pokrok směrem k AGI - a co ne. Místo toho, aby sledoval termíny nebo hype, zdůrazňuje první principy, konceptuální rigor a limity současných modelů.
Články napsané Jonasem Reeveem jsou generovány pomocí AI a recenzovány redakčním týmem Unite.AI, aby zajistily přesnost, jasnost a odpovědnou diskusi o pokročilých konceptech AI.