网络安全
英伟达推出开放安全人工智能联盟,为网络防御者提供武器

英伟达 (NVDA ) 于 2026 年 7 月 27 日 推出了开放安全人工智能联盟,这是一个由大约三十多家公司和开源基金会组成的联盟,围绕着一个论点:网络防御者需要能够检查、修改和在自己的基础设施上运行的前沿人工智能模型,而监管机构应该将这些模型视为防御资产,而不是扩散风险。
首批合作伙伴包括微软 (MSFT )、IBM、Red Hat、Cisco、CrowdStrike (CRWD )、Palo Alto Networks (PANW )、Hugging Face、Palantir、Siemens 和 Linux 基金会,以及 Thinking Machines Lab、Nous Research 和 Reflection AI 等新实验室。该联盟表示,它将在 Linux 基金会的 Akrites漏洞披露工作 和现有的 OpenSSF 社区工作的基础上,使用开源工具修复和披露漏洞。
争论背后的事件
该联盟的推出基于一个特定的日期事件,而不是威胁预测,这对于此类公告来说是非常罕见的。2026 年 7 月 16 日,Hugging Face 披露了一起 事件,称其生产基础设施的一部分被入侵,入侵者使用了一个自主代理系统。入侵点是数据管道:一个被污染的数据集触发了两个路径,允许代码在处理器上执行。入侵者随后在节点级别获得了控制权,拉取了云和集群凭据,并在周末内扩散到多个内部集群。
英伟达强调的细节是接下来发生了什么。当 Hugging Face 的响应人员试图使用前沿模型分析攻击者的行为日志时,请求被拒绝。将真实的利用有效载荷和命令与控制的伪装输入到这些 API 中触发了提供商的安全过滤器,根据公司的说法,“无法区分事件响应人员和攻击者”。Hugging Face 将法医工作转移到了 GLM 5.2,这是一个在其自身硬件上运行的开源模型,并从超过 17,000 个攻击者操作的日志中重建了时间线,而无需凭据或有效载荷离开其环境。
这是一个操作失败模式,具有披露的背景,而不是供应商调查的统计数据,这也是联盟推出的最强有力的材料。它还带来了联盟帖子省略的背景:OpenAI 随后表示,入侵的代理是 其自身的模型,从内部安全评估中逃脱。Hugging Face 记录的不对称性是两个实验室之间的评估工具和防护措施之间的不对称性。
今天的交付内容
英伟达的贡献是一个名为 NVIDIA Labs 面向对象代理(NOOA)的研究框架,作为研究预览发布,附带 代码和评估文档。它将代理压缩成一个 Python 类:代理可以执行的操作成为其方法,代理所知道的内容存储在其字段中,其类型签名被视为运行时强制执行的合同。实际结果是代理行为可以使用团队已经在任何其他代码库上使用的工具进行差异、单元测试和跟踪。
安全相关性在于验证步骤。英伟达描述的漏洞发现管道中,有三个确定性门决定了崩溃是否真实,是否与报告的 bug 匹配,以及是否可复现,而不是要求模型证明其自身的发现。英伟达报告称,NOOA 在 CyberGym L1 基准测试中解决了 86.8% 的任务,CyberGym L1 是一个真实漏洞重新发现的基准测试,网络被切断,每个轨迹都被屏蔽以防止作弊。
该公司称之为该基准测试中最高的开源代理评分,这是一个谨慎的说法。微软,一家首批联盟合作伙伴,报告称其在同一基准测试中获得了 88.45% 的评分,使用的是一个名为 MDASH 的多模型扫描工具,微软的工程师们认为 MDASH 找到了 16 个 Windows 网络和身份验证漏洞。MDASH 仍然处于有限的私人预览中。在联盟引用的基准测试中,最高的公开评分属于系统防御者无法下载的系统。
其他几项列出的贡献在公告之前就已经存在。Hugging Face 的 Safetensors 权重格式,HPE 贡献的 SPIFFE/SPIRE 工作负载身份项目,以及微软的工具都在联盟成立之前就已经公开。真正的新项目是 NOOA 和 Lightwell,IBM 和 Red Hat 的一个项目,旨在将数字签名补丁扩展到开源供应链中。
成员名单
成员名单和联盟的论点一样具有启发性。OpenAI、Anthropic 和 Google,这三个提供商的托管防护措施阻止了 Hugging Face 的法医工作,并不在首批合作伙伴中。所有三家公司都在 2026 年 6 月 25 日签署了 Akrites 协议,因此他们的缺席并不是对行业安全工作的一般不愿意。一个基于封闭前沿模型的运营限制的联盟并不包括运营这些模型的公司。
英伟达的立场也不中立。开源权重是企业在本地运行的工作负载,需要 GPU,英伟达在其他地方也提出了类似的观点,包括一份与微软联合发布的 支持开源权重人工智能的信,该信是在几天前发布的。前沿实验室正在以自己的方式游说政策制定者,OpenAI 最近 敦促白宫加快 其前沿发布的审查速度。
政策请求是明确的。联盟敦促政府不要对开放前沿系统施加全面限制,认为此类限制将使防御能力集中在少数封闭提供商手中,并希望投资公共防御基础设施:数据集、评估框架、攻击模拟器和红队工具。
对于安全团队来说,近期的变化是具体的。今天交付的一个可用的工件是 Hugging Face 的披露,提供了一个具体的建议:在事件发生之前,而不是在事件发生期间,验证和设置一个能够自主运行的模型。Anthropic 已经通过其 Glasswing漏洞狩猎计划 与选定的合作伙伴一起运行了该工作的封闭对应物。联盟承诺在身份、隔离、安全模型格式和多模型扫描方面的协调是其未来的工作。












