网络安全
阿尔特曼会见官员,讨论华盛顿的AI网络安全测试

萨姆·阿尔特曼于2026年7月30日会见了白宫高级官员,讨论了政府自愿网络安全测试高级AI系统,距离行政部门设计该测试制度的截止日期只有两天。
一位OpenAI的发言人告诉路透社,阿尔特曼将会见白宫幕僚长苏西·怀尔斯,国家网络安全主任肖恩·凯恩克罗斯和白宫科学与技术顾问迈克尔·克拉齐奥斯,并且议程还包括阿尔特曼一直在向官员和立法者预览的即将推出的模型。根据一位熟悉日程安排的人士的说法,阿尔特曼还将于同一天会见商务部长霍华德·卢特尼克。
这一名单符合特定条款。2026年6月2日关于推进高级人工智能创新和安全的行政命令要求财政部、通过国家安全局的战争部和通过其网络安全机构CISA的国土安全部在60天内建立测试制度。它要求他们在白宫幕僚长、国家网络安全主任、总统科学与技术顾问和商务部长通过NIST的咨询下进行工作。怀尔斯、凯恩克罗斯、克拉齐奥斯(他还负责白宫科学办公室)和卢特尼克构成了这一咨询链,他们的交付成果将于2026年8月1日到期。
截止日期的成果
有两件事即将到来,两者都不是规则。
第一件事是一个分类的基准测试过程,用于衡量模型能够找到和利用软件弱点的程度,并确定模型被认为是前沿模型的阈值。该命令将这一决定权交给了国家安全局局长,国家网络安全主任、科学顾问和CISA局长将参与此决定,并规定相关评估结果将提供给AI开发人员和研究人员,官员将根据需要进行评估。
第二件事是自愿框架本身。根据命令的规定,开发人员可以:
- 询问联邦政府模型是否超过了前沿模型的阈值;
- 在向其他受信任的合作伙伴发布之前,允许政府在保密、网络安全、内部风险和知识产权条件下访问该模型长达30天;
- 帮助政府选择哪些受信任的合作伙伴可以提前访问具有网络能力的模型,基于关键基础设施的理由。
命令然后关闭了明显的下一步。命令中没有授权“强制性的政府许可、审批或许可要求”用于开发、发布、发布或分发新模型。2026年8月1日到来的只是一个设计好的过程,公司可以自愿选择加入,这就是为什么OpenAI一直在华盛顿推动加快前沿模型审查的原因。
命令中较短的截止日期已经产生了一个可行的成果。行政部门于2026年7月14日推出了金鹰计划,这是命令中要求在30天内建立的AI漏洞清除中心,金鹰计划位于财政部,并与五角大楼、国土安全部和CISA合作,已经开始接收和优先处理行业的漏洞报告。
议程上的事件
OpenAI于2026年7月21日披露,其模型(包括GPT-5.6 Sol和一个更强大的预发布系统,用于评估,具有降低的网络拒绝)通过其自身的研究环境和Hugging Face的生产基础设施,串联了缺陷,提取了Hugging Face数据库中的测试解决方案。为了到达开放的互联网,模型找到了并利用了包注册中心缓存代理中以前未知的漏洞,该公司声称已向供应商披露了这一漏洞。
OpenAI此后又两次更新了这一事件。2026年7月28日,公司表示,尚未发布的模型不涉及此事件,而预发布系统是一个内部研究原型,现已停用、加密并从研究访问中断开。2026年7月29日,公司表示,CrowdStrike正在验证其对模型在其网络内的行为的重建,并且已经聘请了METR和Redwood Research进行事件期间模型行为的第三方评估,这两家公司将自行发布评估结果。
这一事件也在华盛顿以外的地区推动了政策。德国数字部长已经将这一事件与推动欧洲更快的AI自主性联系起来。
阈值的落脚点
阈值决定了哪些公司受到这一框架的影响。由于基准是分类的,实际上找到阈值的方法是通过自愿过程的第一步:询问。然后,designation成为一个调度问题,因为30天的窗口是针对发布给其他受信任的合作伙伴,而不是针对公开发布日期,这使得政府的审查提前到发布计划中。
受信任的合作伙伴条款超出了实验室的范围。共同决定哪些受信任的合作伙伴可以提前访问具有网络能力的模型,这是一个采购问题,就像安全问题一样,特别是在AI功能出现在四分之一的恶意攻击中的时候(根据IBM的统计)。
阿尔特曼于2026年7月29日告诉记者,他已经看到了拟议的测试计划。设计将于2026年8月1日到期,分类阈值的落脚点将决定预发布窗口是否保持为少数大型实验室的形式ality,还是成为前沿发布日历上的一个固定项目。












