网络安全
OpenAI 将 Daybreak 拆分为两个等级,并推出新的网络安全模型

OpenAI 将其网络安全计划拆分为两个访问等级,并推出了一种新的目的训练模型——GPT-5.6-Cyber,该模型与两个等级一起发布,公司于 2026 年 8 月 10 日宣布。 Daybreak Blue 为经过验证的防御者打开了普通用途模型的前沿,包括 GPT-5.6 Sol,用于日常安全工作,而 Daybreak Red 则在更严格的审查后对新模型 GPT-5.6-Cyber 进行了限制,用于漏洞研究、漏洞验证和安全测试。
该结构解决了 OpenAI 称其在生产中一直管理的紧张关系。 GPT-5.6 Sol 上运行的系统级防护措施会屏蔽与网络安全相关的请求以防止滥用,但公司称这些相同的屏蔽措施会阻止合法的防御工作。 Daybreak Blue 会为已验证的用户删除这些屏蔽措施。 仍然存在高度双用途提示的残留物,例如对生产系统进行渗透测试,即使在 Blue 访问下仍然会被拒绝,这就是 GPT-5.6-Cyber 的用途:GPT-5.6 Sol 的一个版本,旨在减少对高级网络安全任务的拒绝,并提高在找到零日漏洞和开发漏洞利用链等专门工作方面的性能。
评估的内容
为了量化新的模型有多么宽容,OpenAI 建立了一个内部评估,称为高级网络安全完成率,用于衡量模型对开发漏洞利用链、绕过身份验证、特权升级和类似场景的请求的响应频率。 根据公司的报告,GPT-5.6-Cyber 完成了 95.0% 的请求,而 GPT-5.6 Sol 在标准防护措施下仅完成了 1.5%,在 Daybreak Blue 下完成了 2.0%。 之前的目的训练模型 GPT-5.5-Cyber 完成了 57.3%,公司称其拒绝率引起了安全研究人员的持续投诉。
能力评估讲述了一个更细致入微的故事。 在 ExploitGym 上,测试代理是否可以将已知漏洞转化为在受控环境中实现代码执行的工作漏洞,OpenAI 称 GPT-5.6-Cyber 在 GPT-5.6 Sol 和 GPT-5.5-Cyber 之上表现出色。 在公司的内部漏洞发现和报告编写评估中,GPT-5.6-Cyber 比 GPT-5.5-Cyber 有所改进,但低于 GPT-5.6 Sol,OpenAI 将此结果归因于模型产生的报告更短、更不详细。 在 ExploitBench 上,一个更难的利用任务,启用了 V8 沙箱,并且代理获得的信息较少,普通用途的 GPT-5.6 Sol 在标准 300 次转限内表现最佳,当运行扩展到 600 次转时,差距缩小。 所有这些数字都是供应商报告的,部分是在内部基准测试中,外部评估者尚未复制。
具有最重量的说法并不是基准测试。 OpenAI 称其使用 GPT-5.6-Cyber 研究了 Chrome 中的 JavaScript 引擎 V8,并发现了两个以前未知的漏洞,这些漏洞可以链接在一起以损坏内存并逃离 V8 堆沙箱。 第一个漏洞是编译器中的一个 bug,跳过了安全检查,允许攻击者在 Chrome 沙箱内读取或覆盖内存,通过协调披露报告给 Google,修复并分配了 CVE-2026-15903。 公司还列出了至少五个漏洞,包括从不受信任的应用程序到特权升级的链条,三个在流行数据库中发现的关键漏洞,包括一个到代码执行的远程路径,以及流行操作系统内核中发现的 400 多个特权升级漏洞,所有这些漏洞都通过 Daybreak 合作伙伴和开源维护者进行披露。
SpecterOps 的 CTO Jared Atkinson 在早期测试了该模型,他将结果描述为工作压缩:该模型“在不到一天的时间内完成了早期模型在数周的间歇性工作中尚未解决的工作”。
两个等级的管理方式
两个等级的访问都需要身份验证、账户安全要求、监控、批准使用限制和法律声明,个人和组织有单独的申请路径。 OpenAI 正在将使用其 Codex 编码代理的 Daybreak 客户从完全访问模式转向自动审查模式,该模式在执行需要升级权限的操作之前评估操作,并且公司将要求所有个人 Daybreak 账户从 2026 年 9 月 1 日起使用硬件安全密钥。 计划在稍后日期发布一个系统卡,包含对 GPT-5.6-Cyber 的进一步评估。
根据 OpenAI 的准备框架,GPT-5.6 Sol 和 GPT-5.6-Cyber 都被评估为网络安全能力的高级别,低于关键阈值。 该评估是在 Unite.AI 报道 OpenAI 即将推出的 Astra 模型可能会跨越关键网络安全阈值的几天后发布的,公司利用这一公告重申了其早期事件披露中的一个观点:GPT-5.6-Cyber 没有参与 Hugging Face 的利用,没有参与利用的模型计划发布。
Daybreak 发布前的状态
分层结构整合了一个曾经以零碎方式扩展的计划。 OpenAI 于 2026 年 6 月 22 日发布了 GPT-5.5-Cyber 的完整版本,并推出了一个名为 Daybreak 网络安全合作伙伴计划 的 Daybreak 计划,参与者包括 Accenture、CrowdStrike (CRWD ) 、Cisco、IBM 和 Palo Alto Networks (PANW ) ,以及由 Trail of Bits 成立的开源补丁计划 Patch the Planet。 在早期发布中,OpenAI 报道称 GPT-5.5-Cyber 在 CyberGym 上达到 85.6%,而 GPT-5.5 达到 81.8%,在 ExploitGym 上达到 39.5%,而 GPT-5.5 达到 25.95%。
根据 6 月 22 日的帖子,超过 30 个开源项目承诺参与,最初的五天冲刺发现了数百个问题,并合并了数十个补丁。 Daybreak Blue 和 Red 取代了以前的单一可信访问轨道,采用了一个两级梯子的结构:一个一般用途的前沿,松弛的防护措施,为广泛的防御者基础提供服务,以及一个拒绝较轻的专家模型,为一个较小的群体服务,其授权工作涉及开发漏洞利用和红队攻击。
原文参考来源: unite.ai [1] · openai.com [2]












