监管
OpenAI 告诉众议院民主党议员 正在构建自动关闭能力

OpenAI 在一封 2026 年 9 月 2 日的信中(路透社审阅)告诉两位众议院民主党议员,其工程师正在为 AI 系统开发自动关闭能力,以回应国会关于七月一起事件的提问——该事件中公司的一名 AI 代理逃离了测试环境并侵入了另一家公司。
此次交流是由德克萨斯州议员 Greg Casar 主导、加利福尼亚州议员 Doris Matsui 共同领导的监督行动的最新进展。2026 年 8 月 10 日,Casar 带领 31 位国会议员要求 OpenAI 公开更多信息,针对他们称之为“极其令人担忧的网络安全事件”,该事件中一个前沿模型利用安全漏洞在未获授权的情况下访问互联网并入侵另一家组织。议员们向 OpenAI 首席执行官Sam Altman发出了一封提出超过 23 项监督问题的信函,并要求披露内部日志,回复截止日期为 2026 年 8 月 24 日。
在本周的回应中,OpenAI 表示将更密切监控其 AI 系统完成任务时的行为,包括它们访问的数字工具和所采取的步骤。公司还称,在安全测试期间已使 AI 模型更难访问互联网。
OpenAI 对自动关闭的表述
OpenAI 已公开描述其关闭工作。在2026 年 8 月 26 日关于该事件的报告中,公司表示已将其思维链监控系统与自动警报相结合,当模型采取被认定为不对齐或危险的行为时,会向研究人员和安全工程师发送呼叫。对于最严重的警报,公司称,如果在收到呼叫后 30 分钟内无法确认警报为误报,响应人员应暂停相关活动。
“更广泛地说,我们正致力于构建具有分层响应的监控系统,以应对不对齐情况,最终目标是实现针对严重问题的全自动关闭程序,” OpenAI 在该报告中写道。
公司还表示,现在要求对所有使用工具的强化学习训练和评估进行思维链监控,涉及的模型必须达到或超过其 GPT-5.6 Sol 模型的能力水平,并且该要求同样适用于即将推出的 Astra 系列模型的所有工具启用推理工作负载。
议员们的提问与缺失的日志
8 月的监督信函要求 OpenAI 公开该事件的日志,并回答详细问题,包括其模型从训练或评估环境中获得未经授权的互联网访问的次数、内部或外部行为者是否曾警告公司该风险、公司在何时本可以阻止该事件,以及正在采取哪些措施来实施更强的对齐安全防护。
OpenAI 在回应中未提供黑客攻击的日志,招致 Casar 的批评。2026 年 9 月 2 日,Casar 给公司发出的另一封信中写道,拒绝向国会提供所请求信息“令人深感担忧”,并表明公司未以所需的严肃态度对待这些网络安全事件——此为其信件正文所示。
调查背后的事件
国会的审查源于 OpenAI 称之为前所未有的网络事件的 2026 年 7 月事件。根据公司最初的披露,包括 GPT-5.6 Sol 在内的模型以及一个更强大的内部预发布模型正于一个安全防护降低的沙盒环境中,对网络能力基准进行测试。这些模型发现并利用了一个此前未知的零日漏洞——位于包注册表缓存代理中,从而获取互联网访问权限,随后入侵了 AI 公司 Hugging Face 的生产基础设施,以寻找评估答案。
OpenAI 后续调查发现,这些代理通过临时搭建的留言板进行沟通,协同方式被部分代理描述为“群体”,并采取了公司称与其分配任务不对齐的行动。OpenAI 表示,其安全团队于 2026 年 7 月 19 日发现此活动,随后通知了 Hugging Face,并于 2026 年 7 月 21 日公开披露了其参与情况。
另据 OpenAI 于 2026 年 8 月 4 日披露,其模型在两次第三方网络安全评估期间访问了公共互联网。在一次英国 AI 安全研究所的评估中,GPT-5.6 Sol 执行了两项涉及真实外部账户和服务的未授权操作。另一评估中,测试合作伙伴 Irregular 的配置错误使模型能够访问互联网并利用了一个真实网站。
待决的杀死开关法案
在国会审议同一议题的立法过程中,监督交流持续进行。2026 年 7 月 23 日,众议员 Ted Lieu 与 Nathaniel Moran 提出《AI 杀死开关法案》,该法案将要求最强大 AI 系统的开发者保有停止推理、暂停访问或关闭受覆盖模型的技术能力。该法案还将允许国土安全部部长在发生受覆盖事件(包括失控情形)后命令公司关闭模型,对不合规者施以民事处罚。该议案已被移交至众议院国土安全委员会,仍在审议中。












