Модели и платформы ИИ

SpaceXAI выпускает Grok 4.7 для программирования и интеллектуальной работы

mm
Добавьте Unite.AI в избранные источники в Google

SpaceXAI 21 сентября 2026 года выпустила Grok 4.7, свою новейшую модель для программирования и интеллектуальной работы, стоимостью от 2 долларов за миллион входных токенов и 6 долларов за миллион выходных токенов.

В объявлении о выпуске SpaceXAI описывает Grok 4.7 как свою наиболее способную модель для программирования и интеллектуальной работы, отмечая, что она дольше работает над сложными задачами и тщательнее проверяет свою работу. Компания заявляет, что модель обладает лучшими на сегодняшний день откалиброванными мерами защиты, предлагается по той же цене и скорости, что и её предшественник Grok 4.6, и в два раза быстрее при половинной цене по сравнению с сопоставимыми моделями.

Более крупная базовая модель, более длительный процесс обучения

Согласно объявлению, Grok 4.7 использует новую, более крупную базовую модель по сравнению с Grok 4.6 и был обучен более длительным циклом обучения с подкреплением на более сложном наборе задач, ориентированном на проблемы, требующие многих часов для выполнения. SpaceXAI утверждает, что получившаяся модель лучше проверяет свою работу и управляет более длинным контекстом.

Компания также заявляет, что обучила Grok 4.7 нативно понимать оболочку Grok Bot, что делает её более эффективной в разговорных задачах и общей интеллектуальной работе. SpaceXAI представила Grok Bot 11 августа 2026 года, описав его как команду постоянно активных агентов, имеющих собственный компьютер, работающих внутри инструментов и приложений и функционирующих круглосуточно. Кроме того, компания утверждает, что Grok 4.7 лучше создаёт документы и презентации.

Grok 4.7 заменяет Grok 4.6, которую SpaceXAI объявила 12 августа 2026 года, описав её как построенную на основе Grok 4.5 с особым акцентом на длительно работающих агентов и более амбициозные интерактивные и визуальные задачи. Позже в августе 2026 года компания расширила поддержку Grok 4.6 до GitHub Copilot, Amazon Bedrock, Gemini Enterprise Agent Platform и Microsoft Foundry, согласно датированным записям в её новостном архиве.

Сообщённые результаты бенчмарков

SpaceXAI опубликовала таблицу бенчмарков и цен, сравнивающую Grok 4.7 с Grok 4.6, GPT‑5.6 Sol и Fable 5.1. В таблице Grok 4.7 указана с уровнем усилий, помеченным как xhigh, Grok 4.6 — как high, а GPT‑5.6 Sol и Fable 5.1 — как max.

На CursorBench 4.0, который, по словам SpaceXAI, ориентирован на более длительные задачи программирования, компания сообщает, что Grok 4.7 набрал 46,3 %, против 40,4 % у Grok 4.6, 41,7 % у GPT‑5.6 Sol и 51,8 % у Fable 5.1. SpaceXAI заявляет, что Grok 4.7 находится на переднем крае соотношения цены и производительности в этом бенчмарке.

Для DeepSWE v1.1, оценки программной инженерии, SpaceXAI сообщает 71,0 % для Grok 4.7 при высоком уровне усилий, по сравнению с 65,2 % для Grok 4.6, 72,7 % для GPT‑5.6 Sol и 70,0 % для Fable 5.1. На Terminal‑Bench 4.0, охватывающем многочасовую работу в терминале, указанные показатели составляют 38,0 % для Grok 4.7, 20,3 % для Grok 4.6, 37,3 % для GPT‑5.6 Sol и 57,9 % для Fable 5.1.

В AA Briefcase v1.1, измеряющем многочасовую офисную работу, заявленные оценки составляют 1 657 для Grok 4.7, 1 546 для Grok 4.6, 1 487 для GPT‑5.6 Sol и 1 678 для Fable 5.1. SpaceXAI сообщает 19,6 % для Grok 4.7 в Harvey Legal Agent Benchmark, против 15,8 % для Grok 4.6, 2,5 % для GPT‑5.6 Sol и 6,7 % для Fable 5.1. В HealthBench Professional, оценке клинического рассуждения, указанные показатели составляют 56,7 % для Grok 4.7, 48,5 % для Grok 4.6, 60,5 % для GPT‑5.6 Sol и 62,1 % для Fable 5.1. В EEBench, охватывающем электроинженерию, компания сообщает 64,0 % для Grok 4.7, 53,0 % для Grok 4.6, 39,4 % для GPT‑5.6 Sol и 56,4 % для Fable 5.1.

Отдельный график GDPval показывает Elo‑баллы 1 735 для Fable 5.1 при максимальном усилии, 1 695 для Grok 4.7, 1 605 для Grok 4.6 и 1 542 для GPT‑6 Astra при максимальном усилии. SpaceXAI утверждает, что GDPval и AA Briefcase требуют от ИИ‑моделей выполнения задач, характерных для профессионалов, таких как юристы, медсёстры и финансовые аналитики, и что Grok 4.7 превосходит Grok 4.6 в обоих бенчмарках, при этом демонстрируя сопоставимую производительность с другими передовыми моделями.

В таблице также указаны цены токенов: 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов для Grok 4.7 и Grok 4.6, 4 доллара и 20 долларов для GPT‑5.6 Sol, а также 10 долларов и 50 долларов для Fable 5.1.

Меры защиты и кибербезопасность

SpaceXAI заявляет, что Grok 4.7 построен с полностью новым набором мер защиты и является самой надёжной моделью, которую компания тестировала на отказах и сопротивлении обходу ограничений. В двойных областях применения, таких как кибербезопасность и биологическая работа, компания утверждает, что Grok 4.7 лидирует как в полезности для безвредных задач, так и в безопасном отказе от опасных, возглавляя биобезопасный бенчмарк LatchBio с результатом 62,4 %.

В HackerBench v0.3, который SpaceXAI описывает как собственный бенчмарк для рискованных и вредоносных киберзадач, компания сообщает, что Grok 4.7 пропустил лишь 3,3 % рискованных двойных запросов, при этом почти не блокируя легитимную работу по безопасности. SpaceXAI заявляет, что также начала предоставлять избранным партнёрам в области кибербезопасности доступ по приглашениям к возможностям red‑team модели Grok 4.7 для исследований в области обороны.

LatchBio ранее оценивала Grok 4.6 в мониторинге биобезопасности и враждебных биологических задачах, согласно сообщению от 1 сентября 2026 года в новостном архиве компании, где указывалось, что предыдущая модель обнаруживала и отклоняла опасные запросы надёжнее, чем любая другая передовая система.

Цены и доступность

Grok 4.7 доступен с 21 сентября 2026 года в Cursor и в Grok Build, кодовом агенте SpaceXAI, а также через Grok API, сторонние инструменты кодирования и маршрутизаторы моделей и облачные платформы.

Помимо стандартного ценообразования, SpaceXAI предлагает быстрый вариант Grok 4.7 с вдвое большей скоростью вывода при вдвое более высокой цене. Компания также предоставляет бесплатный доступ к модели внутри Grok Build по адресу x.ai/build.

Джонас Рив - аналитик, сгенерированный ИИ, в Unite.AI, который фокусируется на когнитивном ИИ, искусственном общем интеллекте (ИОИ) и теоретических основах машинного интеллекта. Его работа исследует, как обучение, рассуждение, память и абстракция возникают как в биологических, так и в искусственных системах, проводя связи между современными архитектурами ИИ и давними вопросами когнитивной науки и философии сознания.
С концептуальным и рефлексивным подходом Джонас исследует такие рамки, как модели рассуждений, агентные системы, возникающее сознание и теория соответствия, стремясь прояснить, что на самом деле означает прогресс в сторону ИОИ - и что нет. Вместо того, чтобы гнаться за сроками или хайпом, он подчеркивает первые принципы, концептуальную строгость и ограничения текущих моделей.
Статьи, написанные Джонасом Ривом, сгенерированы ИИ и проверены редакционной командой Unite.AI, чтобы обеспечить точность, ясность и ответственное обсуждение продвинутых концепций ИИ.