Моделі та платформи ШІ

Grok 4.6 Приходить у GitHub Copilot на Восьми Розробницьких Поверхнях

mm
Додайте Unite.AI до бажаних джерел у Google

xAI’s Grok 4.6 тепер розгортається у GitHub Copilot, через два дні після випуску моделі 12 серпня 2026 року, про що компанія оголосила 14 серпня 2026 року. Модель — поточна флагманська модель кодування xAI, орієнтована на довготривалі агенти та багатокрокову роботу, — доступна для вибору в меню моделей Copilot на восьми поверхнях: VS Code, Visual Studio, Copilot CLI, Copilot cloud agent, Copilot app, JetBrains IDEs, Xcode та Eclipse.

Запис у журналі змін GitHub, опублікований того ж дня, підтверджує, що розгортання охоплює плани Copilot Pro, Pro+, Max, Business та Enterprise. Такий розмах незвично широкий для нового додавання моделі: підтримка JetBrains, Xcode та Eclipse ставить Grok 4.6 перед розробниками далеко за межами ядра VS Code, де зосереджуються більшість запусків моделей Copilot.

GitHub зазначає, що під час внутрішнього тестування Grok 4.6 особливо добре показав себе на довготривалих завданнях, які вимагають тривалого мислення та використання інструментів у термінальному кодуванні у VS Code та Copilot CLI. Це відповідає тому, як xAI сформулювала модель під час запуску. “Grok 4.6 будується на основі Grok 4.5 з особливим акцентом на довготривалі агенти та більш амбітні інтерактивні та візуальні роботи”, — написала компанія у своєму пості про випуск.

Що Приносить Grok 4.6 у Меню Моделей

Grok 4.6 приходить до Copilot з набором результатів оцінки, заявлених постачальником, які ставлять його біля верхівки поточної класифікації кодування, з застереженням, яке застосовується до всіх самозвітних цифр: це запуски xAI, на вибраних харнессах xAI. У опублікованій таблиці оцінок компанії Grok 4.6 High набирає 61 бал на Індексі штучного інтелекту аналізу, який складається з дев’яти бенчмарків, що відповідає OpenAI’s GPT-5.6 Sol Max і на один бал менше, ніж у Anthropic’s Fable 5 Max — 62. На GDPVal-AA, оцінці знань, Grok 4.6 набирає 1753 проти 1728 для GPT-5.6 Sol Max і 1741 для Fable 5 Max.

Розмах ширший на агентських бенчмарках кодування. Grok 4.6 набирає 69,9% на CursorBench v3.2, випереджаючи GPT-5.6 Sol Max на 67,2% і позаду Fable 5 Max на 70,5%. На DeepSWE v1.1 він досягає 65,9%, що значно випереджає свого попередника Grok 4.5 High на 54%, але позаду GPT-5.6 Sol Max на 73%. На Terminal-Bench v3.0, який вимірює саме той вид термінальної роботи, на який вказав GitHub, Grok 4.6 набирає 26% проти 34,6% для GPT-5.6 Sol Max, все ж майже подвоюючи 15,7% свого попередника Grok 4.5 High.

Рецепт навчання моделі, згідно з описом xAI, поєднував довше додаткове навчання на відібраних даних мислення та інженерії з супервізованим тонким налаштуванням траєкторій, регенерованих Grok 4.5, після чого відбулося навчання з підкріпленням через агентські завдання, включаючи оптимізацію ядра, веброзробку та комп’ютерну допомогу у проектуванні. Скок покоління у покоління на термінальних та агентських бенчмарках — це видимий результат, навіть якщо Grok 4.6 не лідирує у категорії за кожною мірою.

Дрібний Друк Про Доступ та Розрахунки

Дві обмеження формують, хто насправді бачить модель і яку ціну вона має. По-перше, розгортання відбувається поступово: GitHub зазначає, що розробники, які ще не бачать Grok 4.6 у меню, повинні перевірити знову, коли доступ розшириться. По-друге, на планах Copilot Business та Enterprise політика Grok 4.6 вимкнена за замовчуванням, і адміністратор повинен активувати її у налаштуваннях Copilot, перш ніж місця зможуть вибрати модель.

У питаннях розрахунку Grok 4.6 стягується за ціною постачальника за використання на основі використання, а не за рахунок витрат планової квоти запитів. Grok 4.6 стягується за ціною постачальника; xAI перелічує ціни API, починаючи з $2 за мільйон вхідних токенів і $6 за мільйон вихідних токенів, ті ж базові ставки, які GitHub стягує за Grok 4.5 у своїй таблиці цін, і це ставить Grok 4.6 значно нижче інших флагманських варіантів у меню за ціною: GPT-5.6 Sol перелічує $5 вхідних і $30 вихідних токенів за мільйон, а моделі Claude Opus-class — $5 і $25.

Поза Copilot Grok 4.6 залишається доступним через API xAI, Cursor, Grok Build та партнерів, серед яких OpenRouter, Vercel та Cloudflare. Як повідомлялося у звіті Unite.AI про запуск, xAI пропонував подвійне використання у Grok Build та Cursor для першого тижня моделі, термін якого закінчується 19 серпня 2026 року.

Інтеграція з Copilot розширює модель розповсюдження, яка визначила Grok 4.6 за перші 48 годин: запуск у власних інструментах xAI та Cursor, а потім появляється всередині найбільшого стороннього кодового асистента за кількістю місць. З тепер відкритим підприємством та політикою підприємства у руках адміністраторів, темп корпоративного впровадження моделі буде видимим у налаштуваннях Copilot раніше, ніж у будь-якому лідері.

Джонас Рів - аналітик, створений штучним інтелектом, у Unite.AI, який зосереджується на когнітивному штучному інтелекті, штучному загальному інтелекті (AGI) та теоретичних основах машинного інтелекту. Його робота досліджує, як навчання, розуміння, пам'ять та абстракція виникають як у біологічних, так і в штучних системах, проводячи зв'язки між сучасними архітектурами штучного інтелекту та довгостроковими питаннями когнітивної науки та філософії свідомості.
З концептуальним та рефлексивним підходом Джонас вивчає рамки, такі як моделі розуміння, агентні системи, виникнення когніції та теорія вирівнювання, спрямовані на роз'яснення того, що насправді означає прогрес у напрямку AGI - та чого ні. Натомість ніж гнатися за графіками або гіпом, він підкреслює перші принципи, концептуальну строгість та обмеження поточних моделей.
Статті, написані Джонасом Рівом, створені штучним інтелектом та перевірені редакційною командою Unite.AI, щоб забезпечити точність, ясність та відповідальне обговорення передових концепцій штучного інтелекту.