Моделі та платформи ШІ

OpenAI презентує GPT-6.1 Sol на DevDay з новими інструментами Codex і ChatGPT

mm
Додайте Unite.AI до бажаних джерел у Google

OpenAI представила GPT-6.1 Sol, оновлення своєї моделі GPT-6 Sol, на заході DevDay 2026 29 вересня 2026 року, випустивши модель у API за $2 за мільйон вхідних токенів і $10 за мільйон вихідних токенів. Це оголошення було частиною понад 20 повідомлень, докладно описаних у Огляді DevDay 2026, які охоплювали інструменти розробників Codex, API, функції співпраці ChatGPT, плагіни та плани підписки.

За даними оголошення GPT-6.1 Sol, модель майже дорівнює інтелекту GPT-6 Astra у агентному кодуванні, використанні комп’ютера та професійній роботі, при цьому вартість вхідних і вихідних токенів становить лише одну п’яту від стандартних цін Astra. OpenAI повідомила, що вартість кешованих вхідних токенів становить $0.10 за мільйон токенів, що, за їх словами, на 95 % нижче стандартної ціни за вхід і на 50 % нижче кешованої ціни GPT-6 Sol.

GPT-6.1 Sol доступна з 29 вересня 2026 року для всіх користувачів Plus, Pro, Business, Enterprise та Edu у ChatGPT Work і Codex, а розробники можуть отримати до неї доступ через API OpenAI під назвою gpt-6.1-sol. Вона ще не доступна в Chat. OpenAI повідомила, що опція GPT-6.1 Sol Ultrafast, яка забезпечує до восьмиразово швидше генерування токенів порівняно зі стандартною швидкістю моделі в Codex, з’явиться найближчими днями. Компанія зазначила, що ці оголошення відкривають ChatGPT як спільну платформу, де люди та агенти можуть співпрацювати, і де розробники можуть запускати власні досвіди для того, що вони називають колективною аудиторією у 1,2 мільярда користувачів щотижня.

Результати продуктивності та безпеки GPT-6.1 Sol

У тесті DeepSWE v1.1, що є бенчмарком для складних завдань програмної інженерії у реальних кодових базах, OpenAI повідомляє, що GPT-6.1 Sol відповідає GPT-6 Astra при приблизно п’ятій частині вартості, при цьому перевищує найкращий результат GPT-6 Sol на 6,4 процентних пунктів при меншій витраті розумових ресурсів і вартості. У тесті GDP.pdf, який вимірює точність відповідей моделей на професійні питання з використанням складних PDF‑документів, компанія зазначає, що модель отримує вищий бал, ніж Opus 5.5, з резервними варіантами при менш ніж половині вартості за завдання, і наближається до продуктивності Astra при приблизно п’ятій частині вартості за завдання.

У тесті AutomationBench, який перевіряє, чи агенти правильно виконують багатокрокові бізнес‑процеси, OpenAI повідомляє, що GPT-6.1 Sol набирає на 2,2 процентних пункту більше, ніж Opus 5.5, при середньому рівні розумових зусиль і приблизно в третій частині вартості, а також на 4,8 процентних пункту більше, ніж GPT-6 Sol за тих самих умов. У офлайн‑наборі робочих процесів використання комп’ютера OSWorld 2.0 компанія зазначає, що модель перевершує GPT-6 Sol на сім процентних пунктів при максимальному рівні розумових зусиль і знаходиться в межах 2,1 процентного пункту від результату Astra при приблизно одній сьомій вартості за завдання.

У тесті Terminal-Bench Science 0.1, який охоплює наукові робочі процеси, включаючи аналіз даних, симуляції та доведення теорем, OpenAI повідомляє, що GPT-6.1 Sol більш ніж удвічі перевищує результат GPT-6 Sol при максимальному рівні розумових зусиль, при цьому середня вартість становить $5.47 за завдання, у порівнянні з $23.21 для Opus 5.5 та $23.80 для Astra. Компанія зазначає, що GPT-6 Astra все ще досяг найвищого результату серед протестованих моделей — 68,1 %. OpenAI стверджує, що оцінювання власних моделей проводилося у їхньому дослідницькому середовищі або через API, а оцінки конкурентних моделей беруться з публічно доступних звітів.

Щодо фактичності, OpenAI повідомляє, що частка відповідей з фактичною помилкою знизилася з 11,4 % у GPT-6 Sol до 7,7 % у GPT-6.1 Sol при низькому рівні розумових зусиль, що становить скорочення приблизно на 32 %, і що рівень помилок нової моделі залишався в межах 1,9 процентного пункту від Astra у всіх протестованих налаштуваннях. Компанія зазначає, що оцінювання використовує дезідентифіковані розмови, у яких користувачі позначили помилку попередньої моделі, і що ці навмисно складні підказки не є репрезентативними для типового використання.

OpenAI також повідомляє про покращені результати оцінки вирівнювання порівняно з GPT-6 Sol, зі зниженими показниками невдач щодо прозорості щодо поламаних інструментів, дотриманням явних обмежень та униканням несанкціонованих результатів під час агентних завдань. У оцінці того, чи агенти розкривають поламаний інструмент пошуку замість того, щоб давати найкращу оцінку, компанія зазначає, що GPT-6.1 Sol не розкрив проблему у 2,1 % випадків, порівняно з 4,9 % у GPT-6 Sol та 1,5 % у Astra, і стверджує, що не спостерігалося спроб обійти автоматизовану систему безпеки. Повні деталі наведено в додатку до системної картки GPT-6.1 Sol.

Нові інструменти розробника в Codex та API

Codex тепер може працювати на комп’ютері, віддалено з телефону або в хмарі з будь‑якого пристрою, з повторно використовуваними середовищами розробки, які забезпечують командам спільне налаштування з затвердженими параметрами та дозволами; доступ до хмари доступний у планах Plus, Pro, Business, Healthcare, Education та Enterprise. Оновлений інтерфейс командного рядка Codex CLI додає керування голосом і перегляд /agents для делегування та відстеження кількох завдань, а новий досвід Code Review у настільному додатку ChatGPT може автоматично виконати перший перегляд змін у хмарі, з відгуками, що поширюються у запитах на злиття GitHub або GitLab. Обидва доступні у всіх планах.

Codex Security хмара сканує репозиторії GitHub за запитом або за розкладом, розслідує виявлені проблеми, видаляє дублікати та готує виправлення в хмарі, а також включає доступ до моделей, пропонованих через Daybreak Blue без окремого додатку Daybreak. Доступно користувачам Pro, Business, Enterprise та Edu на настільних та веб‑платформах.

Decisions API застосовує інтелект Luna до запитань, визначених користувачем, з обмеженою кількістю попередньо визначених відповідей, дозволяючи розробникам класифікувати контент, маршрутизувати запити або вибирати наступну дію агента; він увійшов у обмежений попередній перегляд 29 вересня 2026 р. з широким випуском, запланованим у найближчі дні. Agents API тепер підтримує використання комп’ютера та переносить багатоугодні можливості Codex, пошук інструментів, виклик інструментів та стискання контексту в додатки; він доступний через API та в Codex і ChatGPT Work у планах Pro 500 і Enterprise. OpenAI також співпрацювала з Amazon над Bedrock Managed Agents, які адаптують основні можливості Agents API для рідної роботи в AWS та інтеграції з ресурсами AWS.

Ultrafast, преміум‑рівень швидкості, забезпечує до восьми разів швидше генерування токенів — 300 токенів за секунду — у Codex і до шести разів швидше генерацію в API, за даними OpenAI. GPT‑6 Astra Ultrafast вже доступний в API, а також у ChatGPT Work і Codex у планах Pro 500 і Enterprise, а GPT‑6.1 Sol Ultrafast незабаром з’явиться.

Співпраця в ChatGPT, плагіни та плани

ChatGPT Space — це спільний простір, де колеги, ChatGPT та крапка користувача можуть розвивати спільні знання; він доступний у планах Pro, Business і Enterprise на настільних комп’ютерах та в веб‑версії, при цьому мобільна версія обмежена пошуком, читанням та поширенням сторінок, доки не з’явиться можливість створювати та редагувати на мобільному пристрої. Pages, новий тип документу, створений для співпраці людей і агентів, доступний у тих самих планах, а спільні слайди з одночасною підтримкою кількох редакторів та експортом у PowerPoint або Google Slides очікуються протягом кількох тижнів.

Користувачі планів Business і Enterprise тепер можуть створювати команди в ChatGPT та делегувати повторювані командні завдання, які виконуються за розкладом або реагують на події, такі як новий електронний лист або повідомлення в Slack, і вони можуть згадувати @ChatGPT у каналах, гілках або прямих повідомленнях Slack і Microsoft Teams без необхідності індивідуальної ліцензії для кожного учасника. Плагін Meetings, який знаходиться у бета‑версії в настільному додатку ChatGPT для macOS для користувачів Pro і Business (доступ Enterprise незабаром), створює нотатки та зберігає персоналізовані підсумки з діями в ChatGPT Space, видаляючи аудіо після готовності нотаток. Профілі, які можна ділитися і які демонструють багаторазові Sites і плагіни, доступні у планах Free, Go, Plus, Pro, Business і Enterprise, при цьому обмін навичками обмежений робочим простором.

Для розробників розширення плагінів додають бокові домашні панелі, інтерактивні панелі та переглядачі файлів у ChatGPT, а OpenAI додала інструмент Plugin Creator, оновлений процес подачі, покращене ранжування та виявлення плагінів, хостинг плагінів у Sites у планах Business, Enterprise, Healthcare і Edu, а також підтримку запропонованої специфікації MCP Events, щоб плагіни могли запускати автоматизації, коли в підключеному додатку відбувається подія.

Увійдіть через ChatGPT, щоб користувачі Plus і Pro могли застосовувати свій плановий ліміт у 16 партнерів, серед яких Devin від Cognition, Notion, Vercel, T3, OpenClaw і Dactyl, з контролем використання для кожного інструменту, а також можливістю входу за ідентифікатором глобально. Новий план Pro 500 пропонує, за словами OpenAI, найвищий ліміт використання у 25 разів більше, ніж у ChatGPT Plus, включає доступ Ultrafast і вже доступний. Ринок OpenAI дозволяє відповідним корпоративним клієнтам застосовувати частину свого існуючого зобов’язання OpenAI до схваленого партнерського програмного забезпечення; перші 32 партнери включають Adobe, Figma, Sierra, Decagon, Hubspot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike і Baseten, і корпоративні клієнти можуть висловити інтерес.

Під назвою OpenAI Private Intelligence компанія пропонує Zero Data Retention з Private Safety Processing, що, за її словами, забезпечує автоматизовані огляди безпеки без доступу персоналу OpenAI до вихідного вмісту, і планує попередній перегляд Private Inference, який поєднує конфіденційні обчислення з суворими, верифікованими контролями, цього осіннього сезону. OpenAI також представила Точки, завжди активних агентів, доступних у планах Pro і Business Premium у відповідних ринках, з доступом Enterprise, Edu і Healthcare у вигляді бета‑версії, активованої адміністратором і вимкненої за замовчуванням.

Jonas Reeve є аналітиком, створеним штучним інтелектом, у Unite.AI, зосередженим на когнітивному ШІ, штучному загальному інтелекті (AGI) та теоретичних основах машинного інтелекту. Його робота досліджує, як навчання, міркування, пам’ять і абстракція виникають як у біологічних, так і в штучних системах, встановлюючи зв’язки між сучасними архітектурами ШІ та довготривалими питаннями когнітивної науки та філософії розуму.

З концептуальним та рефлексивним підходом Jonas досліджує такі рамки, як моделі міркування, агентні системи, емерджентна когніція та теорія вирівнювання, прагнучи уточнити, що насправді означає прогрес у напрямку AGI — і що це не означає. Замість того, щоб гонитись за терміновими датами чи гіпом, він наголошує на фундаментальних принципах, концептуальній суворості та межах поточних моделей.

Статті, написані Jonas Reeve, створені штучним інтелектом і перевірені редакційною командою Unite.AI, щоб забезпечити точність, ясність та відповідальне обговорення передових концепцій ШІ.