合作伙伴
Anthropic 招募 Accenture 的 Faculty 进行嵌入式 AI 模型评估

Anthropic 在 2026 年 9 月 18 日表示,它正 与Accenture合作进行前沿AI的独立评估,双方预计在未来五年内在该领域投入至少 10 亿美元以建设能力。
该合作将由 Faculty(Accenture 的专业 AI 业务)牵头,内容包括评估和红队测试模型、进行对齐评估以及测试模型安全防护。Anthropic 将此工作描述为朝着在 2026 年 9 月的 CEO Dario Amodei的文章 中作出的承诺迈出的一步,即在公司内部嵌入独立评估员。
Anthropic 表示,Accenture 帮助企业和政府在众多行业部署 AI,其对企业实际使用 AI 的理解为其安全方法提供了洞见。公司称,这一视角将被用于评估其模型。
嵌入式评估的运作方式
根据公告,嵌入式评估是一项新举措,关于其运作方式的许多细节仍在制定中。现有的外部评估员在被评估公司之外工作,而嵌入式评估员将在 AI 公司内部工作,拥有相当于员工的访问权限。
Anthropic 表示,这种访问权限使评估员能够观察模型在训练中的形成过程,跟踪决定模型构建和部署的决策,并直接与员工沟通。基于此,评估员可以评估公司的运营方式,验证其是否履行安全承诺,并识别盲点。他们还可以报告事件,并向公众提供更为充分的收益与风险说明。
Anthropic 表示,独立的嵌入式评估员并未改变公司的问责制,却使该问责更具可验证性,且模型的安全仍由公司负责。
访问条款与出版权利
在这篇题为 “我们必须把握前沿的步伐” 的文章中,Amodei 提出了三步计划:嵌入式评估员、民主国家的前沿 AI 公司之间的协调以及全球协作。他写道,Anthropic 单方面承诺实施第一步,并呼吁各国政府要求其他前沿公司予以匹配。”我们必须放慢提升 AI 模型能力的速度,”他写道。”进展仍会显得迅速,我们必须明智地利用所争取的时间。”
该文章称,Anthropic 打算邀请一支嵌入式外部审查团队,该团队将在公司办公室设有办公桌、配备通行证和公司笔记本电脑,并可使用工作空间、工具和权限,基本上与内部风险评估团队相当。若法律或合同有要求,或为保护客户和合作伙伴的私人信息,则会有例外情况。
根据文章中描述的合同方式,外部审查员有权公布有关风险水平、事件、实践以及他们获得或未获得的访问权限的关键发现,且不受 Anthropic 的编辑控制。公司仍保留对安全敏感、法律特权、商业敏感或第三方机密信息进行有限编辑的权利,但不能仅因发现不利而进行编辑;审查员可以公开说明编辑是否删除了对其结论重要的内容。文章指出,银行业已有监管监督者有时会与员工并列嵌入的先例。
资金问题与非排他性结构
Anthropic 表示,目前尚无关于嵌入式评估员应获取何种信息、以及如何报告其发现的标准,也没有确定的独立评估资金机制。长期来看,公司认为资金应来自于池化或政府来源,正如其在六月的《高级 AI 框架》中所呼吁的;由于这些机制尚未出现,公司计划在不同的资金安排下与不同的评估员合作。
Anthropic 将直接为 Accenture 的工作提供资金。公司还在与 METR 及其他非营利评估机构对话,试点使用其自身资金进行嵌入式评估的部分要素,并表示相信前沿 AI 最终需要一个拥有共享标准的评估生态系统。
该合作为非排他性。Anthropic 表示,它将在未来几周宣布与其他评估员合作,预计前沿实验室将同时与多家机构合作,Accenture 也将在类似职能上与其他 AI 开发商合作。公司称将继续训练并发布前沿模型,分享其早期工作以便其他人和 AI 开发者了解其流程,预计其方法将在行业成熟时演进,并将在工作启动及更多评估员加入时分享更多信息。
早期企业合作
该评估工作扩展了两家公司于2025年12月9日宣布的更广泛关系:一项多年合作伙伴关系,该关系组建了Accenture Anthropic Business Group。根据该协议,约30,000名Accenture专业人员将接受Claude培训,Claude Code将向数万名Accenture开发者提供,且双方推出了一项联合产品,旨在帮助CIO衡量价值并推动其工程组织的AI采纳。2025年12月的公告还包括面向受监管行业的初始行业解决方案,其中包括金融服务、生命科学、医疗保健和公共部门。












