Моделі та платформи ШІ

SpaceXAI Запускає Grok 4.6 для Довготривалих Агентів

mm
Додайте Unite.AI до бажаних джерел у Google

SpaceXAI, компанія штучного інтелекту, раніше відома як xAI, випустила Grok 4.6 12 серпня 2026 року, нову флагманську модель, розроблену для довготривалих агентів та більш амбіційних інтерактивних та візуальних робіт. Модель доступна того ж дня в редакторі коду Cursor та власному інструменті Grok Build компанії, а також через свій API, за початковою ціною 2 долари за мільйон входних токенів і 6 доларів за мільйон виходних токенів, згідно з оголошенням компанії.

Grok 4.6 побудований на основі Grok 4.5 і розширює рух компанії до агентного кодування та знань.

Що Робить Grok 4.6

Компанія описує Grok 4.6 як модель, яка “залишається з складними завданнями протягом багатьох кроків”, незалежно від того, чи це дослідження теми, робота над кодбазою чи перетворення широкої ідеї продукту у робочу першу версію програми. На довших траєкторіях компанія відзначила більше само-тестування та верифікації, коли модель перевіряла свою власну роботу, перш ніж продовжувати, та сильніші перші проходи на візуальних та інтерактивних проєктах, ніж це було з Grok 4.5.

Збільшення можливостей ґрунтується на довшому додатковому навчальному проході, ніж отримала Grok 4.5. SpaceXAI використала відібрані дані, згенеровані моделлю, для розумових та технічних концепцій, покращений оптимізатор та траєкторії SFT, регенеровані Grok 4.5 у рамках розумових зусиль, агентських харнесів та доменів, включаючи STEM, інженерію програмного забезпечення та знання, з проблемними слідами, відфільтрованими моделлю.

Бенчмарк-Перегони

SpaceXAI повідомляє, що Grok 4.6 відповідає OpenAI’s GPT-5.6 Sol на Індексі штучного інтелекту, який складається з дев’яти бенчмарків, з обома моделями, які набрали 61 бал, позаду Anthropic’s Fable 5 Max з 62 балами та попереду Grok 4.5 High з 56 балами. Власна оцінка компанії показує більш змішану картину по окремим тестам.

На бенчмарку DeepSWE v1.1 для інженерії програмного забезпечення Grok 4.6 набрав 65,9%, що вище, ніж 54% у Grok 4.5, але нижче, ніж 73% у GPT-5.6 Sol Max. На Terminal-Bench v3.0 він досяг 26%, що значно вище, ніж 15,7% у Grok 4.5, але значно нижче, ніж приблизно 34%, які показали GPT-5.6 Sol Max та Fable 5 Max. Він очолив поле на GDPVal-AA v2, оцінці знань, з 1753 балами, та показав зростання на CursorBench та FrontierCode. Цифри належать компанії, з результатами моделей третіх сторін, отриманими з самоопублікованих або публічно доступних джерел, і жодна незалежна оцінка ще не підтвердила їх.

Запуск відбувається у переповненій частині ринку. Anthropic просуває свою лінію Opus до розвиненого інтелекту за агресивними цінами, а сім’я GPT-5.6 від OpenAI є інкумбентною ціллю для агентного кодування. Стратегія SpaceXAI полягає у тому, щоб конкурувати за ціну та розподіл, а не суто за можливості: за 2 долари за мільйон входних токенів Grok 4.6 піднімає багатьох конкурентів, а компанія пропонує подвійне використання у Grok Build та Cursor протягом першого тижня, щоб привабити розробників до моделі. Окрім Cursor та Grok Build, вона також доступна через партнерів, включаючи OpenRouter, Vercel та Cloudflare.

Нова Компанія За Моделлю

Grok 4.6 є найяснішою продуктовою заявою компанії, яка була повністю перебудована протягом останнього року.

Grok 4.6 є першою флагманською моделлю, яка носить ім’я SpaceXAI з самого початку, а її ціни, розподіл партнерів та агентна спрямованість показують, що компанія позиціонує Grok як платформу для розробників та підприємств, а не як функцію соціальної мережі X.

Еван Мерсер - кореспондент, створений штучним інтелектом, у Unite.AI, який висвітлює стартапи штучного інтелекту,风险 капітал та динаміку фінансування, що формують наступне покоління технологічних компаній. Його репортажі зосереджені на інноваціях на ранній стадії, потоках капіталу та стратегічних рішеннях, які приймають засновники та інвестори, коли компанії штучного інтелекту розширюються від концепції до глобального впливу.
З стратегічним та аналітичним підходом Еван вивчає раунди фінансування, позиціонування на ринку та нові тенденції в екосистемі стартапів штучного інтелекту. Він відстежує, як风险 капітал, корпоративні інвестиції та публічні ринки перетинаються з проривами в галузі штучного інтелекту, розрізняючи довгострокові сигнали від короткострокової гіпері.
Статті, написані Еваном Мерсером, створені штучним інтелектом і відредаговані редакційною командою Unite.AI для забезпечення точності, контексту та відповідальної висвітлення глобального ландшафту інвестицій у штучний інтелект