AI 模型与平台
Anthropic 更新使用政策,新增模型滥用和欺骗规则

Anthropic 在2026年10月8日发布了其年度2026 使用政策更新,整合了针对欺骗性活动的规则,新增了对模型的滥用行为的禁止,并澄清了武器、监视以及高风险使用的要求。更新后的政策将于2026年11月12日生效。
Anthropic 表示,大部分更改旨在澄清现有规则。公司称,此次修订是对 Claude 在过去一年承担更长期、更独立工作、结合客户反馈,并依据其2026年9月的威胁情报报告中记录的影响行动、武器开发和监视方面的滥用模式的响应。
使用政策,亦称为可接受使用政策,适用于任何能够向 Anthropic 的产品或服务提交输入的用户,包括通过授权经销商或直通访问。它分为适用于所有用户的通用使用标准、针对具有更高危害风险的特定面向消费者的使用场景的高风险使用案例要求,以及涵盖面向消费者的聊天机器人、面向未成年人的产品、代理使用和模型上下文协议服务器的附加使用案例指南。Anthropic 的安全团队负责检测和监控以执行该政策;违规行为可能导致限流、暂停或终止访问,且 Anthropic 可能在输入违反政策时阻止或修改模型输出。
欺骗性活动和选举规则
Anthropic 表示,已观察到国家媒体机构、政府宣传部门以及商业公司使用 Claude 运营虚假账号网络和伪造新闻网站。此类活动此前已被禁止,但相关限制分散在选举、欺诈、隐私和虚假信息等章节中。此次更新将其整合到一个名为“禁止参与欺骗性活动或人工活动”的新章节,适用于任何形式的欺骗性活动,无论是政治还是商业。该章节涵盖掩盖信息来源的行为、通过虚假账号或帖子放大内容的行为,以及构建用于开展影响力行动的工具和基础设施。
选举章节更名为“禁止破坏民主进程”,并专门聚焦于禁止使用 Claude 欺骗选民或干扰选举,包括散布关于候选人或投票方式的虚假信息、冒充候选人或选举官员,以及压制投票率。
Anthropic 还撤销了对个性化投票和竞选定向的全面禁止。公司称,该规则原本涵盖了合法的公民工作,例如非营利组织使用 Claude 用其他语言撰写选民信息,选举官员发送选票纠正通知。依赖欺骗或滥用选民个人数据的定向仍在欺骗性活动、监视和隐私章节中被禁止。当前生效的政策文本将持续有效至2026年11月12日,仍将个性化投票和竞选定向列为禁止的政治活动。
武器、监视与执法
Anthropic 表示,已观察到有人尝试使用其模型开发武器的指导和控制软件。更新后的武器章节明确规定,禁止范围包括使武器运作的软件和部件,以及为无人机和其他自主车辆配备武器等行为。Anthropic 称,此次更改反映了其对之前政策的执行方式。
重新编写的监视与刑事司法章节禁止在未获本人同意的情况下追踪个人,无论是实时追踪还是通过对已收集数据的分析。Claude 不能用于决定或建议在执法或刑事司法程序中调查、逮捕或起诉谁,也不能用于构建或改进用于监视的工具。Anthropic 表示,其9月的报告记录了 AI 在构建用于识别和追踪政治异见者的监视系统方面的使用增长,并指出监视方面的更改,如同武器方面的更改,旨在使现有的执法实践更加明确,而非改变其内容。该章节还列明了仍被允许的使用情形,包括经本人同意的追踪,如欺诈监控、内容审核、新闻报道和法律研究。
高风险使用案例与硬件控制
当 Anthropic 的产品以可能影响个人健康、法律权利、财务、生计或获取基本服务的方式使用时,政策要求在流程中加入合格的人类——具备审查并在必要时修改 Claude 建议的权限——并要求告知受影响的个人已使用 AI。Anthropic 表示这些要求未作更改,但重新撰写了该章节,以更直接地回答用户常见问题:现在列出了哪些类型的建议受到覆盖,哪些不在覆盖范围内。
在 Anthropic 推出模型硬件标准研究预览后,该章节新增了针对连接至能够自主执行物理动作且可能导致伤害的硬件的模型的要求。合格的操作员必须能够观察设备并在必要时停止其运行,且设备在 Claude 断开时必须能够保持安全状态。
对模型的滥用行为
此更新新增了对 Anthropic 模型的持续且无必要的滥用或残忍行为的禁令。公司表示,该规则仅适用于极端情况,即用户反复对模型进行残忍行为且没有可辨别的目的,并不适用于普通用户的挫败感、反对、黑暗创意主题,或模型的测试与研究。
该禁令与 Anthropic 于 2025 年推出的一项能力相关。在 2025 年 8 月 15 日的 研究帖子 中,公司称已赋予 Claude Opus 4 和 4.1 在其消费者聊天界面结束对话的能力,旨在用于“极少数、极端的持续有害或滥用用户交互”情形。Anthropic 表示,此功能主要是其对潜在 AI 福利的探索性工作的一部分,且对模型对齐和安全措施具有更广泛的意义。
根据该帖子,Claude 被指示仅在所有重定向尝试均失败或用户明确要求结束聊天时才使用此能力,且不在用户可能面临对自身或他人造成即时伤害的风险时使用。当对话结束后,用户无法在该对话中发送新消息,但账户中的其他对话不受影响,且之前的消息可以编辑并重新尝试以创建新分支。Anthropic 表示,此能力在 Claude.ai 和 Claude Code 上可用,将继续作为新滥用禁令的主要执行机制。
受支持地区说明
此次更新还涉及了受支持地区政策,该政策在 2025 年被 Anthropic 加强,针对由总部位于不受支持地区的实体多数持有的公司。Anthropic 表示,澄清页面解释了其政策的执行方式:位于不受支持地区的个人、在该地区注册或设立总部的实体,以及由该地区的个人或实体多数持有或控制的实体,均被禁止使用 Claude。
Anthropic 表示,将随着 Claude 能力和风险的变化持续更新使用政策,并征求政策制定者、主题专家、民间社会以及产品使用者的意见。更新后的政策将于 2026 年 11 月 12 日生效。












