Моделі та платформи ШІ

Microsoft доставляє GPT-6 Astra від OpenAI у Foundry з обмеженим доступом

mm
Додайте Unite.AI до бажаних джерел у Google

Microsoft розпочала розгортання GPT-6 Astra, найновішої фронтальної моделі OpenAI, через програму Microsoft Foundry Limited Access, причому доступність буде розширюватися для учасників протягом наступних днів, а ціноутворення за споживанням починається від $10 за мільйон вхідних токенів у рамках розгортання Standard Global, згідно з оголошенням у блозі Microsoft Azure.

Оголошення, підготовлене Стівом Світменом та Наомі Монепенні, описує Astra як модель, створену для вирішення відкритих завдань, розмірковування над ними у кілька кроків, складання плану та отримання готового результату. У дописі модель розглядається в контексті трьох функцій робочого місця: цілеспрямоване планування та підтримка прийняття рішень, коли модель розбиває завдання на кроки, оцінює варіанти, передає рекомендацію та визначає наступні дії для перегляду; якісний результат, коли вона застосовує контекст, шаблони та стандарти якості протягом робочого процесу для створення документів, електронних таблиць, презентацій та аналізів, готових до перегляду; та виконання в додатках, використовуючи інструменти та комп’ютер для завершення багатокрокових завдань під людським контролем.

Використання комп’ютера та корпоративні контролі

Можливості використання комп’ютера у Astra розроблені так, щоб працювати з знайомими додатками, включаючи робочі процеси без спеціальних API. За даними допису в Azure, модель може інтерпретувати інформацію на екрані та взаємодіяти з схваленими інтерфейсами, підтримуючи такі завдання, як оновлення записів, навігація в інструментах розробки, тестування програмного забезпечення та складання результатів у звіти. У дописі зазначається, що OpenAI повідомляє про передові результати у вибраних оцінках використання комп’ютера, попереджаючи, що продуктивність варіюється залежно від завдання, інструментів, конфігурації та захисних механізмів.

Microsoft поєднує ці можливості з контрольними механізмами. Оскільки вміст, що відображається в додатку, може бути неповним, вводити в оману або бути спрямованим на вплив на поведінку агента, допис стверджує, що Foundry допомагає клієнтам визначати доступ, схвалення та моніторинг, а також розробляти робочі процеси зі сфокусованими обліковими даними, схваленими ресурсами, контрольними точками для важливих дій та записами активності, що відповідають їхнім вимогам щодо ризику.

У дописі Azure перераховано корпоративні сценарії, які, за словами Microsoft, спостерігаються, включаючи роботу з розробкою програмного забезпечення, коли Astra відтворює складні помилки, досліджує ймовірні причини, пропонує виправлення та готує зміни для тестування та перегляду розробниками; роботу з бізнес‑аналітикою, коли вона створює та уточнює панелі у Power BI; професійне створення документів за існуючими шаблонами та бізнес‑стандартами; а також робочі процеси в додатках, такі як оновлення записів клієнтів, обробка форм та тестування веб‑сайтів, де спеціальні API обмежені.

Щодо управління, у дописі зазначено, що Foundry доповнює роботу OpenAI на рівні моделі за допомогою ідентифікації та управління доступом Microsoft Entra, шифрування під час передачі та зберігання, приватних мережевих опцій, ролевих контролів доступу, фільтрації вмісту, оцінок безпеки, моніторингу та інструментів управління. Промпти та результати не використовуються для навчання моделей. Додатково підкреслюється, що ці можливості допомагають клієнтам налаштовувати захисні механізми та підтримувати нагляд, проте не усувають ризик і не замінюють відповідальність кожної організації за вибір та налаштування контролів, відповідних їхнім сценаріям та регуляторним вимогам.

Що OpenAI повідомив при запуску

Власний пост OpenAI про запуск GPT-6 Astra повідомляє, що модель розгортається для обмеженого набору організацій і незабаром стане доступною для всіх користувачів ChatGPT Plus, Pro, Business та Enterprise, а також через OpenAI API, Microsoft Azure і AWS Bedrock. OpenAI описує Astra як свою найкраще вирівняну модель і повідомляє про передові результати у використанні комп’ютера, браузингу, розробці програмного забезпечення, кібербезпеці, науці та професійних робочих оцінках.

Серед показників, які повідомив OpenAI: Astra отримала 57,9 % у Terminal‑Bench 4.0 (оцінка кодування), порівняно з 37,3 % у GPT‑5.6 Sol; 72,6 % у офлайн‑наборі OSWorld 2.0 для використання комп’ютера, порівняно з 65,7 % у GPT‑5.6 Sol; та 96,0 % у GPQA Diamond, науковому бенчмарку рівня магістратури. OpenAI також повідомив, що у симуляціях затримки на OSWorld 2.0 Astra досягла кращої продуктивності використання комп’ютера приблизно на 47 % швидше за завдання, ніж GPT‑5.6 Sol, і в поєднанні з оновленим інструментом Codex це означає у 1,9 рази швидше завершення завдань у бенчмарку Mind2Web. Це самостійно повідомлені результати OpenAI.

Щодо безпеки, OpenAI зазначив у оновленні від 1 вересня 2026 р., що Astra відповідає порогу критичної кібербезпеки за їхньою Framework готовності — це перша модель компанії, позначена на цьому рівні, що означає, що за наявності потрібних інструментів і доступу вона може виявляти раніше невідомі вразливості та розробляти способи їх експлуатації в добре захищених системах без покрокового людського керування. OpenAI повідомив, що частину розробки та випуску Astra було затримано на кілька тижнів для посилення захисту, і що поточна версія відмовляється виконувати більш складні кібербезпекові завдання, такі як створення доказових експлойтів, а розширений захисний доступ планується через програму Daybreak у найближчі тижні. У дописі Azure також зазначено, що OpenAI описує Astra як свою найкраще вирівняну модель на сьогодні і планує опублікувати підтримуючі оцінки вирівнювання, безпеки та використання комп’ютера у своїх матеріалах запуску.

Розгортання та ціноутворення

GPT-6 Astra буде доступна через стандартні розгортання, включаючи варіанти Global та U.S. Data Zone, і клієнти можуть обирати розгортання відповідно до вимог навантаження. Microsoft описує модель за споживанням як спосіб для команд почати будувати без зобов’язання до резервованих потужностей, зазначаючи, що Astra розроблена для ефективного використання токенів у складних завданнях, хоча фактичне використання та витрати варіюватимуть залежно від навантаження та конфігурації.

Опублікована таблиця цін вказує, що розгортання Standard Global з коротким контекстом коштує $10,00 за мільйон вхідних токенів, $1,00 за мільйон кешованих вхідних токенів, $12,50 за мільйон кешованих записів та $50,00 за мільйон вихідних токенів. Розгортання Standard Global з довгим контекстом зазначено $20,00 за вхід, $2,00 за кешований вхід, $25,00 за кешовані записи та $75,00 за вихід. Ціни Standard Data Zone (US) становлять $11,00 за вхід, $1,10 за кешований вхід, $13,75 за кешовані записи та $55,00 за вихід для короткого контексту, і $22,00 за вхід, $2,20 за кешований вхід, $27,50 за кешовані записи та $82,50 за вихід для довгого контексту.

Клієнти можуть оцінити модель через каталог Foundry Models і створювати міждодаткові робочі процеси за допомогою Foundry Agent Service, згідно з дописом Azure. У дописі також наведено заяви партнерів запуску: CTO Replit Луїс Гектор Чавес зазначив, що GPT-6 Astra через Microsoft Foundry додає агентські можливості поза генеруванням коду, а віце-президент Albertsons Companies з даних та ШІ Анірбан Нанді сказав, що Azure OpenAI у Microsoft Foundry допомагає продуктовій мережі збалансувати швидкість впровадження з безпекою, управлінням та операційними контролями.

Ейден Кросс - стратег, створений штучним інтелектом у Unite.AI, який охоплює стратегію продукції штучного інтелекту, виконання та практичні виклики перетворення експериментальних моделей у масштабовані, готові до ринку продукти. Його робота зосереджена на тому, як стартапи та підприємства переходять від прототипів та демонстрацій до надійних систем, які використовують реальні клієнти.
З прагматичною та детальною перспективою Ейден аналізує дорожні карти продукції, стратегії виходу на ринок, рішення щодо платформи та організаційні компроміси, які визначають, чи успішні чи застряють ініціативи штучного інтелекту. Він приділяє особливу увагу реаліям розгортання, прийняттю користувачами, обмеженням інфраструктури та узгодженню між технічними можливостями та бізнес-цінністю.
Статті, написані Ейденом Кроссом, створені штучним інтелектом та перевірені редакційною командою Unite.AI, щоб забезпечити ясність, точність та відповідальне висвітлення того, як продукти штучного інтелекту створюються, відправляються та масштабуються у реальному світі.