Модели и платформы ИИ

SpaceXAI Запускает Grok 4.6 для Долгосрочных Агентов

mm
Добавьте Unite.AI в избранные источники в Google

SpaceXAI, компания искусственного интеллекта, ранее известная как xAI, выпустила Grok 4.6 12 августа 2026 года, новую флагманскую модель, разработанную для долгосрочных агентов и более амбициозной интерактивной и визуальной работы. Модель доступна в тот же день в кодовом редакторе Cursor и собственном инструменте Grok Build, а также через API, по начальной цене 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов, согласно объявлению компании.

Grok 4.6 основана на Grok 4.5 и расширяет стремление компании к агентному кодированию и знаниям.

Что такое Grok 4.6

Компания описывает Grok 4.6 как модель, которая “остаётся с сложными задачами на протяжении многих шагов”, будь то исследование темы, работа над кодовой базой или превращение широкой идеи продукта в рабочую первую версию приложения. На более длинных траекториях компания отмечает больше самотестирования и верификации, когда модель проверяет свою собственную работу, прежде чем перейти к следующему шагу, и более сильные первые проходы на визуальных и интерактивных проектах, чем это было с Grok 4.5.

Прирост возможностей основан на более длинном дополнительном обучающем запуске, чем тот, который получила Grok 4.5. SpaceXAI использовала отобранные данные, сгенерированные моделью, для рассуждений и технических концепций, улучшенный оптимизатор и траектории SFT, сгенерированные Grok 4.5 по усилиям рассуждения, агентским упряжкам и областям, включая STEM, программную инженерию и знания, с проблемными следами, отфильтрованными модельными проверками. Модель затем была обучена на ряде агентских задач обучения с подкреплением, включая доменные среды для оптимизации ядра, веб-разработки и компьютерного проектирования.

Соревнование на Бенчмарке

SpaceXAI сообщает, что Grok 4.6 соответствует OpenAI’s GPT-5.6 Sol на Индексе искусственного аналитического интеллекта, который является композитом из девяти бенчмарков, с обоими моделями, набирающими 61 балл, уступая Anthropic’s Fable 5 Max с 62 баллами и опережая Grok 4.5 High с 56 баллами. Собственная оценочная таблица компании показывает более смешанную картину по отдельным тестам.

На бенчмарке DeepSWE v1.1 по программной инженерии Grok 4.6 набрала 65,9%, что выше, чем 54% у Grok 4.5, но отстает от GPT-5.6 Sol Max с 73%. На Terminal-Bench v3.0 она достигла 26%, что является значительным скачком от 15,7% у Grok 4.5, но намного отстает от примерно 34%, которые показали GPT-5.6 Sol Max и Fable 5 Max. Она лидирует в поле на GDPVal-AA v2, оценке знаний, с 1753 баллами, и показала прирост на CursorBench и FrontierCode. Эти цифры являются собственными данными компании, с результатами третьих моделей, полученными из自орепортов или публично доступных результатов, и пока нет независимой оценки, подтверждающей их.

Запуск происходит в переполненной части рынка. Anthropic продвигает свою линию Opus к передовой интеллекта по агрессивным ценам, а семейство GPT-5.6 от OpenAI является основной целью для агентного кодирования. Стратегия SpaceXAI заключается в конкуренции на цене и распределении, а не на сырой возможностях: по 2 доллара за миллион входных токенов Grok 4.6 обгоняет многих соперников на передовой, и компания предлагает в два раза больше включенного использования внутри Grok Build и Cursor в течение первой недели, чтобы привлечь разработчиков к модели. Помимо Cursor и Grok Build, она также доступна через партнеров, включая OpenRouter, Vercel и Cloudflare.

Новая Компания за Моделью

Grok 4.6 является самым четким заявлением продукта от бизнеса, который был полностью переорганизован за последний год.

Grok 4.6 является первой флагманской моделью, которая несет имя SpaceXAI с нуля, и ее цена, распределение партнеров и агентная направленность показывают, что компания позиционирует Grok как платформу для разработчиков и предприятий, а не как функцию социальной сети X.

Еван Мерсер - корреспондент, сгенерированный с помощью ИИ, в Unite.AI, освещающий стартапы в области ИИ, венчурный капитал и динамику финансирования, формирующую следующее поколение технологических компаний. Его репортажи фокусируются на инновациях на ранней стадии, потоках капитала и стратегических решениях, которые основатели и инвесторы принимают, когда компании по ИИ переходят от концепции к глобальному влиянию.
С стратегическим и аналитическим подходом Еван анализирует раунды финансирования, рыночную позиционировку и новые тенденции в экосистеме стартапов ИИ. Он отслеживает, как венчурный капитал, корпоративные инвестиции и государственные рынки пересекаются с прорывами в области искусственного интеллекта, разделяя устойчивые сигналы и краткосрочную рекламу.
Статьи, написанные Еваном Мерсером, сгенерированы с помощью ИИ и проверены редакционной командой Unite.AI, чтобы гарантировать точность, контекст и ответственное освещение глобального ландшафта инвестиций в ИИ