网络安全
Anthropic 在安全工具中部署 Claude Mythos 5,3500万美元开源基金

Anthropic 在 2026 年 8 月 21 日表示,Claude Mythos 5——自 2026 年 4 月起仅向经过审查的防御者开放的具备网络能力的模型——现已在面向企业客户的 Claude Security 中运行漏洞扫描。同一公告还阐述了将 Mythos 5 引入安全合作伙伴产品的计划,向新设立的开源防御基金承诺 3500 万美元的积分,并预览了公司网络验证计划向 Mythos 级别访问的扩展。
此举标志着 Anthropic 有意放慢步伐的部署的第三阶段。公司在公告中阐述的理由是,风险集中在用户能够直接访问模型并尝试将其引导至攻击性工作时。当用户只能获取“特定输出,例如漏洞补丁或安全警报”时,Anthropic 认为风险会大幅降低。因此,此次扩展在保持模型本身防护措施的同时,扩大了对防御性结果的访问。
公告包含四项具体变化。企业客户现在可以在 Mythos 5 上运行 Claude Security 扫描;Anthropic 正在与网络安全技术和服务合作伙伴合作,将该模型集成到防御者已有的工具中;全新的 Defender Advantage Fund(0xDAF)将向保护开源软件的组织分配 3500 万美元的 Claude 积分;以及网络验证计划,目前为经过审查的组织在 Claude Opus 和 Sonnet 模型上提供降低的防护措施,未来几周将扩展至覆盖这些模型更广泛的双重用途能力,随后将提供 Mythos 级别的访问。
Claude Security 如何在不开放模型的情况下提供 Mythos 5
Claude Security 对 Claude Enterprise 客户处于公开测试阶段,Anthropic 表示,使用 Mythos 5 的扫描计费方式与现有计划相同,按标准 token 用量计费,无需额外附加费用。管理员可在管理控制台中启用此功能;在 claude.ai/security,用户选择代码库,模型对代码库进行漏洞扫描。每个发现都会返回 CWE(通用弱点枚举)类别、置信度和严重性评级以及建议的修复方案。随后用户在网页上打开 Claude Code 实施补丁,且每个补丁在部署前必须经人工审查和批准。
关键在于范围限定。Mythos 5 扫描返回的是详细的发现,而非原始模型输出,运行该扫描并不会将 Mythos 的访问权限扩展到其他领域;交互式补丁使用的是组织在 Claude Code 中已有的模型。合作伙伴集成遵循相同模式。合作伙伴产品的最终用户永远不会直接调用 Mythos 5;专门构建的界面在后台为定义任务运行模型,仅返回预期的产出,例如建议补丁列表。Anthropic 表示,其与合作伙伴会实施滥用防护措施,以确保模型始终局限于该范围,构建安全产品的供应商可登记对集成计划的兴趣。
合作伙伴渠道建立在 Anthropic 自 2026 年 5 月起构建的生态系统之上,当时它报告称包括 Wiz、Palo Alto Networks (PANW ) 、CrowdStrike (CRWD ) 和 Accenture 在内的公司已在 Claude Opus 上构建网络产品。该帖子中的早期数据为公司自报,未经过独立测量,但描绘了市场格局:Wiz 称其基于 Opus 的攻击性测试代理每周持续运行于超过 150,000 台生产资产,Accenture 表示其安全测试覆盖率从约 10% 提升至 1,600 个应用程序中的 80% 以上,同时将扫描周转时间从 3–5 天缩短至不到一小时。CrowdStrike 的咨询负责人 Mark Manglicmot——其公司提供基于 Opus 的就绪服务——如此描述合作伙伴案例:“像 Anthropic 的 Claude Opus 这样的前沿模型为防御者提供了去年不存在的能力优势,使漏洞管理向左推进至最早阶段。”
Palo Alto Networks 最近邀请 Anthropic、OpenAI 和工业控制供应商参与关键基础设施防御,而诸如 Harness 等供应商已开始推出能够以机器速度扫描、分流并修补漏洞的代理。
从 Project Glasswing 到更广泛的防御者部署
Anthropic 对该模型类别的审慎态度可追溯至Project Glasswing,该项目于 2026 年 4 月 7 日启动,成员包括 Amazon Web Services、Microsoft、Google、CrowdStrike 和 Linux 基金会。项目将 Claude Mythos Preview 交到少数负责关键软件安全的团队手中,并提供最高达 1 亿美元的使用积分和 400 万美元的直接捐赠给开源安全组织。Anthropic 表示,Mythos Preview 已经发现了数千个高危漏洞,涵盖每个主要操作系统和网页浏览器,包括:OpenBSD 中一个可远程触发的 27 年老漏洞、FFmpeg 某行代码中一个 16 年未被发现的错误(自动化测试触发了五百万次仍未捕获),以及一次链式 Linux 内核特权提升。上述三项均已报告给维护者并在公开前完成修补。该计划在夏季持续增加参与者,2026 年 7 月,安全公司Horizon3.ai 加入漏洞狩猎。
2026 年 6 月 9 日,Anthropic 将模型拆分为 Fable 5 与 Mythos 5 两个版本以进行发布。Claude Fable 5 使用相同的底层模型,配备安全分类器,将网络、生物和蒸馏相关查询转至 Claude Opus 4.8;该版本已进入全面可用。Claude Mythos 5 为经过审查的用户解除网络防护限制,以每百万输入 token 10 美元、每百万输出 token 50 美元的价格提供给 Glasswing 合作伙伴,费用不到 Mythos Preview 的一半。Anthropic 表示,外部漏洞赏金在超过 1,000 小时的测试中未产生任何通用破解,并且自此持续调优分类器:2026 年 8 月初,它重新调校了 Fable 5 的生物防护,将被拦截查询降低了 85%。Mythos 级模型的流量需遵守 30 天保留期限,Anthropic 称此用于安全目的,而非用于训练。
Anthropic 的网络防御推进(按数字)
- $35 million 的 Claude 积分承诺给 Defender Advantage Fund(0xDAF),用于修补广泛使用的开源项目中的实时漏洞,自动化扫描和修补,以便其他项目复制,并采用使项目抵御整类攻击的方法
- $100 million 的使用积分在 2026 年 4 月承诺给 Project Glasswing,另加 400 万美元的直接捐赠:250 万美元通过 Linux 基金会捐给 Alpha‑Omega 和 OpenSSF,150 万美元捐给 Apache 软件基金会
- $10 每百万输入 token,$50 每百万输出 token(Mythos 5),而 Mythos Preview 为 $25 和 $125
- 超过 40 家额外维护关键软件基础设施的组织获得了超出 Glasswing 的 12 家首批合作伙伴的访问权限
- 83.1% 对比 66.6%:Mythos Preview 相较于 Opus 4.6 在 CyberGym 漏洞复现上的表现,数据由 Anthropic 自行测量并报告
该基金扩展了 Anthropic 称 Glasswing 已经启动的工作,包括对诸如 Akrites 和白宫 Gold Eagle 计划 等协同漏洞修复工作的支持。基金首先提供少量规模较大的试点资助,Anthropic 在此过程中学习可扩展的方案。
Mythos 级访问的下一步计划
近期的里程碑全部已排期。Anthropic 表示,在接下来的几周内,网络验证计划将扩展:诸如漏洞分流和验证等防御能力将迁移至 Mythos 级模型,已加入的防御者将在 Opus 和 Sonnet 上看到更少的拦截。已获批准的组织无需采取任何行动,Anthropic 将主动提供更新。首批 Defender Advantage Fund 受助者将在未来几周内公布,随着试点资助落地,携带 Mythos 5 的合作伙伴集成进入商业安全产品被描述为公司预期逐步扩展的早期工作。同时,Anthropic 表示正通过与美国政府合作的 Project Glasswing 拓宽 Mythos 访问,面向符合严格安全控制要求的关键基础设施运营商。
Claude Security 仍处于面向企业客户的公开测试阶段,Mythos 5 扫描已于 2026 年 8 月 21 日上线,并按现有计划的标准 token 用量计费。












