Modele i platformy AI
GLM-5.3 uzyskuje 60 punktów w Artificial Analysis Intelligence Index, dorównując Kimi K3

Model GLM-5.3 firmy Z.ai został oceniony przez Artificial Analysis na 60 w jej Intelligence Index, jak podał niezależny ewaluator 18 sierpnia 2026 roku, umieszczając najnowszy model rozumowania chińskiego laboratorium na równi z Kimi K3 od Moonshot AI oraz trzy punkty za Claude Opus 5 od Anthropic, aktualnym liderem z wynikiem 63.
Wynik obejmuje działanie GLM-5.3 przy maksymalnym nakładzie rozumowania, ustawieniu zalecanym przez Z.ai do prac programistycznych. Przy 60 punktach plasuje się znacznie powyżej mediany 35 spośród 181 modeli w swojej klasie porównawczej i zajmuje ósme miejsce w całej klasie.
Wynik jest pierwszą niezależną oceną modelu, który Z.ai wydało 14 sierpnia 2026 z nietypową konstrukcją: GLM-5.3 korzysta z tej samej bazowej wersji co GLM-5.2, a wszystkie zyski w możliwościach pochodzą z post‑trainingu, a nie z nowego procesu wstępnego treningu.
Jak GLM-5.3 dotarł tutaj
Post wydania Z.ai opisuje miesiąc skalowania uczenia ze wzmocnieniem w środowiskach zadań o długim horyzoncie: więcej środowisk, bardziej zróżnicowane zadania, większa moc obliczeniowa, wszystko na stosie treningowym, który laboratorium zbudowało dla GLM-5.2. Firma podała, że podejście podniosło wynik Terminal‑Bench 3.0 z 4,6 do 28,3 oraz DeepSWE v1.1 z 46,2 do 66,9, a własny post dokumentuje szeroki zestaw wyników w dziedzinach kodowania, cyberbezpieczeństwa i benchmarków agentowych w porównaniu z Kimi K3, Claude Opus 4.8, Claude Fable 5 i GPT‑5.6 Sol. Unite.AI szczegółowo omówiło premierę i jej emergentne wyniki w cyberbezpieczeństwie, gdy model został wysłany w zeszłym tygodniu.
Liczba podana przez Artificial Analysis ma inną wagę niż te pochodzące z tabel dostarczanych przez dostawców, ponieważ ewaluator samodzielnie uruchamia swój zestaw testów. Intelligence Index v4.1.1 agreguje dziewięć ocen obejmujących zadania robocze w rzeczywistym świecie agentowe, użycie narzędzi agentowych, kodowanie terminalowe, rozumowanie i wiedzę naukową, pytania naukowe na poziomie studiów magisterskich, rozumowanie fizyczne, wiarygodność wiedzy i halucynacje oraz rozumowanie w długim kontekście. Wynik 60 GLM‑5.3 jest sumą wyników uzyskanych w tej serii, przy łącznym koszcie oceny wynoszącym $1,238.50 na API Z.ai.
Gdzie GLM-5.3 plasuje się w rankingu
Równość z Kimi K3 jest głównym porównaniem. Kimi K3, wydany 16 lipca 2026, uzyskuje taki sam wynik 60 w indeksie i pozostaje najwyżej ocenianym modelem open‑weights w rankingach Artificial Analysis, pozycję, którą GLM‑5.3 teraz dzieli pod względem wyniku, choć nie licencji. Moonshot udostępniło wagi Kimi K3 w ramach licencji opartej na przychodach w lipcu 2026; GLM‑5.3 jest obecnie wymieniony jako własnościowy, a Artificial Analysis rejestruje 753 miliardy parametrów dla tego modelu.
Claude Opus 5, wydany 24 lipca 2026, nadal prowadzi indeks z wynikiem 63. Trzy‑punktowa przewaga GLM‑5.3 nad liderem to odległość, której szybki cykl post‑trainingu nie zdołał zamknąć, wobec frontu, który sam się przemieścił od wiosny.
Cena to obszar, w którym dwa modele z wynikiem 60 różnią się wyraźnie. GLM‑5.3 kosztuje $1.40 za milion tokenów wejściowych i $4.40 za milion tokenów wyjściowych w API Z.ai, w porównaniu z $3.00 i $15.00 dla Kimi K3 w ofercie Moonshot. Na zadanie w Intelligence Index kosztuje to $0.68 dla GLM‑5.3 wobec $0.84 dla Kimi K3 i $2.34 dla Claude Opus 5. GLM‑5.3 osiąga swój wynik przy najniższym koszcie na zadanie spośród trzech, choć jest także najbardziej rozwlekły w grupie, generując 170 milionów tokenów wyjściowych w całym zestawie testów, przy medianie 72 milionów w swojej klasie.
Co będzie dostępne w przyszłości
GLM‑5.3 jest dostępny poprzez API Z.ai i został udostępniony wszystkim subskrybentom GLM Coding Plan. Model wymaga włączenia trybu myślenia, oferując trzy poziomy nakładu, a Z.ai ostrzega, że aplikacje nadal wywołujące go z wyłączonym myśleniem będą się nie powodziły, dopóki nie zostaną przeniesione.
Wagi są pozostałym elementem. Z.ai zobowiązało się do ich udostępnienia dwa tygodnie po premierze 14 sierpnia 2026, po zakończeniu oceny bezpieczeństwa i wzmocnień, co umieści GLM‑5.3 obok Kimi K3 jako opcję open‑weights na poziomie 60 w indeksie, przy mniej więcej połowie ceny za token.












