网络安全
开放AI日出防御模型登陆亚马逊Bedrock

开放AI的两个网络防御模型现已在亚马逊Bedrock上向合格客户开放,AWS于2026年8月11日宣布,这是在开放AI扩展其日出计划的新访问层和特定安全模型的一天后。 日出红和日出蓝 在美国东部(北弗吉尼亚)运行,访问需要在开放AI的Trusted Access for Cyber审查计划中注册。
日出红提供了GPT-5.6 Cyber的访问,这是一个开放AI专门为网络安全任务(如发现零日漏洞和开发利用链)而训练的模型。日出蓝提供了GPT-5.6 Sol,并重新校准了防御安全工作的安全措施:漏洞发现、检测工程、事件响应和补丁验证。开放AI推荐蓝色作为大多数安全团队的起点;红色具有较低的拒绝阈值,配备了更强的身份验证、监控和访问控制,旨在授权漏洞研究、漏洞复制和缓解开发。
“AWS安全团队正在使用这两个模型来分析源代码、发现漏洞和进行红队研究,”AWS安全副总裁约翰·希恩在公告中说。“在Bedrock上,这些工作都在相同的基础设施控制下运行,AWS应用于其他关键工作负载的控制。”
两个层次,两个拒绝姿态
红色和蓝色的区分是关于如何管理双用途能力的赌注。无论来自防御者还是攻击者,复制漏洞或逆向工程利用链的请求在一般用途模型中都是相同的,红色和蓝色模型通过拒绝来解决这一模糊性。 开放AI的日出扩展帖子 使用内部评估来衡量模型完成涉及开发利用链、身份验证绕过和权限升级的请求的频率。开放AI报告称,通过日出红色访问的GPT-5.6 Cyber完成了95.0%的这些请求,而通过日出蓝色访问的GPT-5.6 Sol完成了2.0%的请求,标准安全措施下的Sol完成了1.5%的请求。之前的特定训练模型GPT-5.5-Cyber完成了57.3%的请求。
蓝色通过删除系统级别的防护措施来实现其姿态,这些防护措施会屏蔽与网络安全相关的请求,开放AI表示这可能会阻止合法的防御工作。红色更进一步:GPT-5.6 Cyber直接在网关程序中训练以减少高风险任务的拒绝,而不是在开放API上。这些完成率是开放AI自己的测量结果,而不是独立结果。
模型发现的内容
开放AI表示,其研究人员使用GPT-5.6 Cyber调查了Chrome中的JavaScript引擎V8,并发现了两个以前未知的漏洞,这些漏洞可以被链接以损坏内存并逃避V8堆沙箱。Google修复了初始漏洞作为CVE-2026-15903,这是一个高严重性漏洞,V8的优化编译器在将值转换为整数时跳过了安全检查;AWS将其描述为2026年V8 CTF比赛中仅有的四个成功的零日提交之一。
同一篇文章列出了开放AI归因于该模型的其他发现,所有这些发现仍然处于协调披露过程中:一个流行的移动操作系统中至少有五个漏洞,包括从不受信任的应用程序到本地权限升级的链;一个流行数据库中有三个关键漏洞,包括一个远程代码执行路径;以及一个流行的操作系统内核中有400多个权限升级漏洞。这些目标没有被命名,也没有被修复,因此这些说法将保持在开放AI的披露落地之前。
Bedrock上的数据处理
这种防御工作负载会为模型提供组织最不想泄露的内容:专有源代码、未修补的漏洞详细信息、实时生产遥测数据。AWS的答案是隔离故事。两个模型都在Bedrock的下一代推理引擎上运行,执行零操作员访问,在芯片层面强制执行,这意味着AWS操作员无法在推理期间读取提示或完成。流量使用客户管理的KMS密钥加密,受IAM策略管理,在CloudTrail中记录,并通过VPC端点路由,具有组织级别的数据周界策略以阻止跨账户边界的数据外泄。
推理数据不用于模型训练,两个模型都不需要与开放AI共享数据。对于自动化滥用检测,分类器标记的流量由AWS保留最长30天,并以编程方式处理;客户可以通过AWS账户团队请求零数据保留,按照 AWS文档 中的说明。
审查门槛
要访问任一模型,需要通过 Trusted Access for Cyber ,这是开放AI于2026年2月5日推出的身份和信任框架,随后开放AI承诺为防御工作提供1000万美元的API积分。访问受到身份验证、账户安全、监控、批准使用限制和法律声明的控制;从2026年9月1日开始,所有个人日出账户必须采用硬件安全密钥。一旦开放AI批准,客户将与AWS账户团队合作,请求在Bedrock上访问模型。
Bedrock的到来扩展了于2026年7月24日开放的分发线,当时 GPT-5.6系列在平台上普遍可用 ,通过OpenAI Responses API在bedrock-mantle端点访问。它还着陆在开放AI管理减少拒绝模型的安全政治的同时:日出帖子明确表示,GPT-5.6 Cyber没有参与Hugging Face的开发,并且没有参与此次发布的模型计划,并且该模型被评估为高但低于关键阈值的准备框架。我们在 开放AI扩展日出 于2026年8月10日时报道了层次结构和新模型。
对于防御者来说,实际变化是这种能力现在的位置。已经在AWS上运行工作负载的安全团队可以将GPT-5.6 Cyber指向其自己的代码库,位于与其基础设施其他部分相同的管理周界内,而不是通过单独的提供商关系路由敏感的漏洞工作。两个模型都在一个区域、一个注册表单后面,截至2026年8月11日。












