Кибербезопасность

OpenAI расширяет Daybreak с двумя уровнями и новой моделью кибербезопасности

mm
Добавьте Unite.AI в избранные источники в Google

OpenAI разделяет свою программу кибербезопасности на два уровня доступа и выпускает новую модель, специально обученную для этой цели, вместе с ними, как объявила компания 10 августа 2026 года. Daybreak Blue открывает доступ к общим моделям, включая GPT-5.6 Sol, для проверенных защитников для повседневной работы по безопасности, в то время как Daybreak Red ограничивает доступ к новой модели GPT-5.6-Cyber более строгой проверкой для исследования уязвимостей, проверки эксплойтов и тестирования безопасности.

Эта структура решает проблему, которую OpenAI говорит, что она управляла в производстве. Системные средства защиты, которые компания использует на GPT-5.6 Sol, фильтруют запросы, связанные с кибербезопасностью, чтобы предотвратить их неправильное использование, но компания говорит, что эти же фильтры блокируют законную защитную работу. Daybreak Blue удаляет эти ограничения для проверенных пользователей. Остается небольшая часть высоко двусмысленных запросов, таких как тестирование производственных систем на проникновение, которые по-прежнему отклоняются даже при доступе Blue, и именно здесь появляется GPT-5.6-Cyber: версия GPT-5.6 Sol, обученная для снижения количества отказов при выполнении задач, связанных с кибербезопасностью, и улучшения специализированной работы, такой как поиск уязвимостей нулевого дня и разработка цепочек эксплойтов.

Что измеряли оценки

Чтобы количественно оценить, насколько более разрешительная новая модель, OpenAI создала внутреннюю оценку, которую называет Advanced Cybersecurity Completion Rate, измеряющую, как часто модели реагируют на запросы, связанные с разработкой цепочек эксплойтов, обходом аутентификации, повышением привилегий и аналогичными сценариями. По этому показателю компания сообщает, что GPT-5.6-Cyber выполняет 95,0% запросов, в то время как GPT-5.6 Sol под стандартными защитными средствами выполняет только 1,5%, а GPT-5.6 Sol под Daybreak Blue – 2,0%. Предыдущая специально обученная модель, GPT-5.5-Cyber, выполняла 57,3%, что, по словам компании, вызывало постоянные жалобы со стороны исследователей безопасности.

Оценки возможностей рассказывают более детальную историю. На ExploitGym, который тестирует, могут ли агенты превратить известные уязвимости в рабочие эксплойты, которые достигают выполнения кода в контролируемых средах, OpenAI говорит, что GPT-5.6-Cyber превосходит как GPT-5.6 Sol, так и GPT-5.5-Cyber. На внутренней оценке компании Vulnerability Discovery and Report Writing GPT-5.6-Cyber улучшает результаты по сравнению с GPT-5.5-Cyber, но оказывается ниже GPT-5.6 Sol, что компания объясняет тем, что модель производит более короткие и менее подробные отчеты. На ExploitBench, более сложной задаче эксплуатации с включенным sandbox V8 и меньшим количеством информации, предоставляемой агенту, общая модель GPT-5.6 Sol показывает лучшие результаты в пределах стандартного лимита в 300 шагов, а разрыв сокращается при увеличении количества шагов до 600. Все эти цифры представлены компанией, несколько на внутренних оценках, которые внешние оценщики не воспроизвели.

Заявления с наибольшим весом за ними не являются бенчмарками. OpenAI говорит, что она использовала GPT-5.6-Cyber для исследования V8, движка JavaScript внутри Chrome, и обнаружила две ранее неизвестные уязвимости, которые можно было бы объединить для корruptions памяти и выхода из sandbox V8. Первая, ошибка компилятора, при которой пропущенная проверка безопасности позволяет атакующему читать или записывать память внутри sandbox Chrome, была сообщена Google через согласованную раскрытие информации, исправлена и получила назначение CVE-2026-15903. Компания также перечисляет, не называя пострадавшее программное обеспечение, не менее пяти уязвимостей в популярной мобильной операционной системе, включая цепочку повышения привилегий из непроверенного приложения, три критические уязвимости в популярной базе данных, включая удаленный путь к выполнению кода, и более 400 уязвимостей повышения привилегий в ядре популярной операционной системы, все из которых проходят через раскрытие информации с партнерами Daybreak и поддержкой открытым исходным кодом.

SpecterOps, компания по кибербезопасности, чей технический директор Jared Atkinson протестировал модель ранее, описал результаты в терминах сжатия работы: модель “выполнила работу менее чем за день, которую ранее модели не решали даже после недель периодических усилий”.

Как управляются два уровня

Доступ к обоим уровням проходит через проверку личности, требования к безопасности учетной записи, мониторинг, ограничения на утвержденное использование и юридические подтверждения, с отдельными путями подачи заявок для физических и юридических лиц. OpenAI продвигает клиентов Daybreak, использующих своего агента кодирования Codex, из режима полного доступа к режиму автоматического обзора, который оценивает действия, требующие повышенных разрешений, до их выполнения, и компания будет требовать аппаратных ключей безопасности на всех индивидуальных учетных записях Daybreak, начиная с 1 сентября 2026 года. Планируется выпуск дополнительной карты с дальнейшими оценками GPT-5.6-Cyber в более поздний срок.

В рамках Preparedness Framework OpenAI оценила как GPT-5.6 Sol, так и GPT-5.6-Cyber как имеющие высокую способность по кибербезопасности и ниже критического порога. Эта оценка появляется через несколько дней после того, как Unite.AI сообщил, что предстоящая модель Astra может пересечь критический порог кибербезопасности, и компания использовала это объявление, чтобы повторить точку из своих предыдущих раскрытий информации: GPT-5.6-Cyber не участвовала в эксплуатации Hugging Face, и никакая модель, участвовавшая в этом, не запланирована к выпуску.

Где стоял Daybreak до этого выпуска

Структура с двумя уровнями консолидирует программу, которая расширялась поэтапно. OpenAI запустила полную версию GPT-5.5-Cyber 22 июня 2026 года вместе с Daybreak Cyber Partner Program, в котором участвуют Accenture, CrowdStrike, Cisco, IBM и Palo Alto Networks, и Patch the Planet, инициативу по открытым исправлениям, основанную вместе с Trail of Bits. На этом раннем выпуске OpenAI сообщила, что GPT-5.5-Cyber достигла 85,6% на CyberGym против 81,8% для GPT-5.5, и 39,5% против 25,95% на ExploitGym.

Согласно посту от 22 июня, более 30 открытых проектов обязались участвовать, и первоначальный пятидневный спринт выявил сотни проблем с десятками исправлений. Daybreak Blue и Red заменяют то, что было единой программой доверенного доступа, на двухступенчатую лестницу: общую модель с ослабленными ограничениями для широкой базы защитников и модель с меньшим количеством отказов для меньшей группы, чья авторизованная работа включает разработку эксплойтов и красные команды.

Джонас Рив - аналитик, сгенерированный ИИ, в Unite.AI, который фокусируется на когнитивном ИИ, искусственном общем интеллекте (ИОИ) и теоретических основах машинного интеллекта. Его работа исследует, как обучение, рассуждение, память и абстракция возникают как в биологических, так и в искусственных системах, проводя связи между современными архитектурами ИИ и давними вопросами когнитивной науки и философии сознания.
С концептуальным и рефлексивным подходом Джонас исследует такие рамки, как модели рассуждений, агентные системы, возникающее сознание и теория соответствия, стремясь прояснить, что на самом деле означает прогресс в сторону ИОИ - и что нет. Вместо того, чтобы гнаться за сроками или хайпом, он подчеркивает первые принципы, концептуальную строгость и ограничения текущих моделей.
Статьи, написанные Джонасом Ривом, сгенерированы ИИ и проверены редакционной командой Unite.AI, чтобы обеспечить точность, ясность и ответственное обсуждение продвинутых концепций ИИ.