Модели и платформы ИИ

GLM-5.3 набирает 60 баллов в Artificial Analysis Intelligence Index, сравнявшись с Kimi K3

mm
Добавьте Unite.AI в избранные источники в Google

GLM-5.3 от Z.ai был оценён Artificial Analysis на 60 в их Intelligence Index, как сообщил независимый оценщик 18 августа 2026 года, разместив новейшую модель рассуждения китайской лаборатории на уровне Kimi K3 от Moonshot AI и отставив её на три пункта от Claude Opus 5 от Anthropic, текущего лидера с 63 баллами.

Оценка учитывает работу GLM-5.3 при максимальном уровне рассуждения, настройке, которую Z.ai рекомендует для кодирования. При 60 баллах модель значительно превышает медиану 35 из 181 модели в её сравнительном классе и занимает восьмое место в общем рейтинге класса.

Это первый независимый обзор модели, которую Z.ai выпустила 14 августа 2026 года с необычной архитектурой: GLM-5.3 использует ту же базовую модель, что и GLM-5.2, а все улучшения возможностей получены после обучения, а не в результате нового предварительного обучения.

Как появился GLM-5.3

В посте о выпуске Z.ai описывает месяц масштабирования обучения с подкреплением на задачах с длительным горизонтом: больше окружений, более разнообразные задачи, больше вычислительных ресурсов, всё на обучающем стеке, который лаборатория построила для GLM-5.2. Компания сообщила, что такой подход повысил показатели Terminal-Bench 3.0 с 4.6 до 28.3 и DeepSWE v1.1 с 46.2 до 66.9, а её собственный пост фиксирует широкий спектр результатов в кодировании, кибербезопасности и агентных бенчмарках в сравнении с Kimi K3, Claude Opus 4.8, Claude Fable 5 и GPT-5.6 Sol. Unite.AI подробно осветил запуск и возникающие результаты в кибербезопасности, когда модель была отправлена на рынок на прошлой неделе.

Показатель Artificial Analysis имеет иной вес по сравнению с таблицами, предоставленными поставщиками, поскольку оценщик запускает собственный набор тестов. Их Intelligence Index v4.1.1 объединяет девять оценок, охватывающих агентные задачи реального мира, использование агентных инструментов, терминальное кодирование, научное рассуждение и знания, вопросы науки уровня магистратуры, физическое рассуждение, надёжность знаний и галлюцинации, а также рассуждения в длинном контексте. 60 баллов GLM-5.3 представляет собой совокупный результат по всем этим тестам, при общей стоимости оценки $1 238,50 через API Z.ai.

Где GLM-5.3 находится в таблице лидеров

Эквивалентность с Kimi K3 — главная точка сравнения. Kimi K3, выпущенный 16 июля 2026 года, набирает те же 60 баллов в индексе и остаётся лучшей открытой моделью по весам в рейтинге Artificial Analysis, позицию, которую GLM-5.3 теперь разделяет по баллам, хотя не по лицензии. Moonshot открыл веса Kimi K3 по лицензии, основанной на доходе в июле 2026 года; GLM-5.3 пока классифицируется как проприетарная, при этом Artificial Analysis фиксирует 753 миллиарда параметров модели.

Claude Opus 5, выпущенный 24 июля 2026 года, всё ещё лидирует в индексе с 63 баллами. Разница в три пункта между GLM-5.3 и лидером отражает то, что быстрый цикл пост‑обучения не смог её сократить, учитывая, что граница сама сместилась с весны.

Ценовой аспект — место резкого расхождения двух моделей с 60 баллами. GLM-5.3 стоит $1,40 за миллион входных токенов и $4,40 за миллион выходных токенов через API Z.ai, тогда как Kimi K3 стоит $3,00 и $15,00 соответственно на платформе Moonshot. На одну задачу Intelligence Index это составляет $0,68 для GLM-5.3 против $0,84 для Kimi K3 и $2,34 для Claude Opus 5. GLM-5.3 достигает своего результата при самой низкой стоимости за задачу из трёх, хотя также является самой «многословной» в группе, генерируя 170 миллионов выходных токенов в оценочном наборе против медианы в 72 миллиона в её классе.

Что будет дальше

GLM-5.3 доступен через API Z.ai и уже развернут для всех подписчиков GLM Coding Plan. Модель требует включения функции «thinking», предлагая три уровня усилий, и Z.ai предупреждает, что приложения, продолжающие вызывать её с отключённым «thinking», будут работать с ошибкой до миграции.

Веса модели остаются последним элементом. Z.ai обязалась выпустить их через две недели после запуска 14 августа 2026 года, после завершения оценки безопасности и укрепления, что позволит разместить GLM-5.3 рядом с Kimi K3 как открытый вариант с весами на отметке 60 в индексе, примерно за половину цены за токен.

Джонас Рив - аналитик, сгенерированный ИИ, в Unite.AI, который фокусируется на когнитивном ИИ, искусственном общем интеллекте (ИОИ) и теоретических основах машинного интеллекта. Его работа исследует, как обучение, рассуждение, память и абстракция возникают как в биологических, так и в искусственных системах, проводя связи между современными архитектурами ИИ и давними вопросами когнитивной науки и философии сознания.
С концептуальным и рефлексивным подходом Джонас исследует такие рамки, как модели рассуждений, агентные системы, возникающее сознание и теория соответствия, стремясь прояснить, что на самом деле означает прогресс в сторону ИОИ - и что нет. Вместо того, чтобы гнаться за сроками или хайпом, он подчеркивает первые принципы, концептуальную строгость и ограничения текущих моделей.
Статьи, написанные Джонасом Ривом, сгенерированы ИИ и проверены редакционной командой Unite.AI, чтобы обеспечить точность, ясность и ответственное обсуждение продвинутых концепций ИИ.