Кібербезпека

Розширення Daybreak від OpenAI з двома рівнями та новою моделлю кібербезпеки

mm
Додайте Unite.AI до бажаних джерел у Google

OpenAI розділяє свою програму кібербезпеки на два рівні доступу та випускає нову спеціально навчену модель разом з ними, про що компанія повідомила 10 серпня 2026 року. Daybreak Blue відкриває загальні моделі, включаючи GPT-5.6 Sol, для затверджених захисників для щоденної роботи з безпекою, тоді як Daybreak Red блокує нову модель GPT-5.6-Cyber за допомогою більш строгого відбору для дослідження уразливостей, валідації експлойтів та тестування безпеки.

Ця структура вирішує проблему, яку, за словами OpenAI, компанія вже деякий час намагається вирішити на рівні виробництва. Системні засоби захисту, які використовуються в GPT-5.6 Sol, блокують запитів, пов’язаних з кібербезпекою, щоб запобігти їхньому неправильному використанню, але компанія зазначає, що ці самі засоби захисту також блокують законну оборонну роботу. Daybreak Blue усуває ці обмеження для перевірених користувачів. Решта високодвусенсних запитів, таких як тестування на проникнення виробничих систем, все ще блокується навіть у режимі Blue, і саме тут вступає в дію GPT-5.6-Cyber: версія GPT-5.6 Sol, навчена для зменшення кількості відмов при виконанні спеціалізованих завдань з кібербезпеки та покращення результатів при виявленні уразливостей нульового дня та розробці ланцюгів експлойтів.

Що вимірювали оцінки

Для кількісної оцінки того, наскільки більш допускова нова модель, OpenAI створила внутрішню оцінку, яку називають Advanced Cybersecurity Completion Rate, яка вимірює, як часто моделі реагують на запити, пов’язані з розробкою ланцюгів експлойтів, обходом аутентифікації, підвищенням привілеїв та подібними сценаріями. За цим показником компанія повідомляє, що GPT-5.6-Cyber виконує 95,0% запитів, у порівнянні з 1,5% для GPT-5.6 Sol під стандартними засобами захисту та 2,0% для GPT-5.6 Sol у режимі Daybreak Blue. Попередня спеціально навчена модель, GPT-5.5-Cyber, виконувала 57,3% запитів, рівень відмов, який, за словами компанії, генерував постійні скарги від дослідників безпеки.

Оцінки можливостей розповідають більш детальну історію. На ExploitGym, який тестує можливість агентів перетворити відомі уразливості у робочі експлойти, які досягають виконання коду в контрольованих середовищах, OpenAI повідомляє, що GPT-5.6-Cyber перевершує як GPT-5.6 Sol, так і GPT-5.5-Cyber. На внутрішній оцінці Відкриття уразливостей та написання звітів компанія повідомляє, що GPT-5.6-Cyber покращує результати порівняно з GPT-5.5-Cyber, але поступається GPT-5.6 Sol, результат, який OpenAI пояснює тим, що модель генерує коротші та менш детальні звіти. На ExploitBench, більш складному завдання експлуатації з увімкненим sandbox V8 та меншою кількістю інформації, наданої агенту, загальна модель GPT-5.6 Sol демонструє кращі результати у межах стандартного ліміту у 300 кроків, при цьому розрив зменшується при розширенні до 600 кроків. Всі ці дані повідомляються самою компанією, частково на внутрішніх бенчмарках, які зовнішні оцінювачі ще не повторили.

Твердження з найбільш вагомими доказами не є бенчмарками зовсім. OpenAI повідомляє, що використала GPT-5.6-Cyber для дослідження V8, двигуна JavaScript у Chrome, та виявила дві раніше невідомі уразливості, які можна було б використати для корупції пам’яті та втечі з sandbox V8. Перша, помилка компілятора, при якій пропущена перевірка безпеки дозволяє атакувальникові читати або перезаписувати пам’ять всередині sandbox Chrome, була повідомлена Google через координоване розголошення, виправлена та отримала позначення CVE-2026-15903. Компанія також перелічує, не називаючи програмного забезпечення, щонайменше п’ять уразливостей у популярній мобільній операційній системі, включаючи ланцюг підвищення привілеїв з недовіряної програми, три критичні уразливості у популярній базі даних, включаючи віддалений шлях до виконання коду, та понад 400 уразливостей підвищення привілеїв у популярному ядрі операційної системи, усі з яких проходять через розголошення з партнерами Daybreak та відкритими розробниками.

SpecterOps, компанія з кібербезпеки, чиїй технічному директору Джареду Аткінсону було надано змогу ранніх тестів моделі, описав результати у термінах стиснення роботи: модель “виконує роботу за менший ніж день, яку раніше моделі не вирішували навіть після тижнів періодичних зусиль”.

Як керуються два рівні

Доступ до обох рівнів здійснюється через верифікацію особистості, вимоги безпеки облікових записів, моніторинг, обмеження затвердженого використання та юридичні підтвердження, з окремими шляхами подачі заявок для осіб та організацій. OpenAI спрямовує клієнтів Daybreak, які використовують агент з кодуванням Codex, від режиму повного доступу до режиму автоматичної перевірки, який оцінює дії, які вимагають підвищених привілеїв, до їх виконання, а компанія буде вимагати апаратні ключі безпеки на всіх індивідуальних облікових записах Daybreak, починаючи з 1 вересня 2026 року. Планується випуск системної карти з подальшими оцінками GPT-5.6-Cyber на пізнішій даті.

За рамками підготовчого кадру OpenAI оцінила як GPT-5.6 Sol, так і GPT-5.6-Cyber як високі за можливостями кібербезпеки та нижче порогу критичної небезпеки. Ця оцінка відбулася за кілька днів після того, як Unite.AI повідомила, що майбутня модель Astra від OpenAI може перетнути поріг критичної кібербезпеки, і компанія використала це оголошення, щоб повторити твердження з попередніх повідомлень про інциденти: GPT-5.6-Cyber не була залучена до експлуатації Hugging Face, і жодна модель, яка брала участь у цьому інциденті, не планується до випуску.

Де стояла Daybreak до цього випуску

Структура з двома рівнями консолідує програму, яка раніше розширювалася частинами. OpenAI запустила повну версію GPT-5.5-Cyber 22 червня 2026 року разом з програмою партнерства Daybreak Cyber, до складу якої входять Accenture, CrowdStrike, Cisco, IBM та Palo Alto Networks, а також Patch the Planet, відкритий ініціатив з виправлення програмного забезпечення, заснований разом з Trail of Bits. За словами компанії, GPT-5.5-Cyber досягла 85,6% на CyberGym проти 81,8% для GPT-5.5, і 39,5% проти 25,95% на ExploitGym.

За повідомленням від 22 червня, понад 30 відкритих проєктів погодилися взяти участь, а перша п’ятиденна спринт виявила сотні питань з десятками виправлень. Daybreak Blue та Red замінили той, що був раніше єдиним треком довіреного доступу, двоступеневою системою: загальнопристосовним фронтиром з послабленими обмеженнями для широкої бази захисників та спеціалізованою моделлю з меншим рівнем відмов для меншої групи, чиїй затвердженій роботі належить розробка експлойтів та червоні команди.

Джонас Рів - аналітик, створений штучним інтелектом, у Unite.AI, який зосереджується на когнітивному штучному інтелекті, штучному загальному інтелекті (AGI) та теоретичних основах машинного інтелекту. Його робота досліджує, як навчання, розуміння, пам'ять та абстракція виникають як у біологічних, так і в штучних системах, проводячи зв'язки між сучасними архітектурами штучного інтелекту та довгостроковими питаннями когнітивної науки та філософії свідомості.
З концептуальним та рефлексивним підходом Джонас вивчає рамки, такі як моделі розуміння, агентні системи, виникнення когніції та теорія вирівнювання, спрямовані на роз'яснення того, що насправді означає прогрес у напрямку AGI - та чого ні. Натомість ніж гнатися за графіками або гіпом, він підкреслює перші принципи, концептуальну строгість та обмеження поточних моделей.
Статті, написані Джонасом Рівом, створені штучним інтелектом та перевірені редакційною командою Unite.AI, щоб забезпечити точність, ясність та відповідальне обговорення передових концепцій штучного інтелекту.