AI 模型与平台

人工智能公司Anthropic解释了Claude文本水印的工作原理

mm
将 Unite.AI 添加到您在 Google 上的首选来源

Anthropic于2026年8月14日发布了一份关于Claude未来模型中文本水印工作原理的详细说明,指出这是Google DeepMind在2024年的一篇同行评审论文中发表的SynthID-Text技术的一个版本。该公司围绕技术解释构建了合规义务的背景:自2026年8月2日起,欧盟AI法规要求服务欧洲市场的提供者标记AI生成的内容,Anthropic于2026年7月与大约190个组织一起签署了该集团的透明度代码。

该披露是在Anthropic确认水印计划的支持页面后三天发布的,该页面于2026年8月11日在此处进行了报道。虽然该页面描述了水印的作用,但新的帖子描述了文本标记的工作原理、其破坏方式以及它不能证明什么。Anthropic表示,水印不携带任何识别信息,不需要额外的令牌,对输出质量、成本或速度没有实际影响。

水印存在于词汇选择中,而不是隐藏字符中

该机制利用了语言模型生成文本的方式。在每个步骤中,模型从一系列合理的候选词中选择一个词;当几个选择大致相等时(例如,在”The weather today was cold and…”之后是”overcast”还是”grey”),选择由一个随机数决定。水印技术用一个秘密密钥加上前面的词的随机数替换了这种任意的随机性。对于任何读者来说,文本仍然是随机的,但任何持有密钥的人都可以测试一系列词是否在统计学上与密钥模型的选择一致,并分配一个Claude参与的概率。

文本中没有添加任何内容,也没有隐藏字符或不可见的Unicode。由于模式存在于词汇选择本身,因此它可以与复制和粘贴的文本一起传递,这是附加元数据无法做到的。Anthropic将其与AI检测软件(如Pangram)进行了对比,后者由于缺乏提供者的密钥,会根据风格习惯推断作者身份。

Anthropic质量声明背后的文件

Anthropic的质量保证主要基于其采用的技术记录。在介绍SynthID-Text的Nature论文中,Google DeepMind报告了通过向Gemini流量的一部分提供水印模型并将其与无水印模型的点赞和点踩评分进行比较,发现没有统计学上的显著差异;使用人工评估者的受控对比研究也发现没有质量差距。Anthropic表示,其内部测试显示水印对内容、创造力或可读性没有影响,并且水印不添加任何令牌,因此模型的服务和使用成本相同。

Anthropic在启动时将水印应用于全球,而不是仅在欧盟,因为它尚未找到一种可以按地区划分的方法。这使得欧洲义务成为Claude的全球设计约束。其他签署了代码的签署方,包括Google、Meta、Microsoft、Mistral和OpenAI,正在根据同一框架实施自己的标记方法,按照欧盟委员会2026年7月31日的公告

Anthropic表示标记在哪里变得安静

该帖子对故障模式进行了异常具体的描述。检测在短段落中效果较差,因为它们提供的词汇选择太少。它在事实性文本中变薄,这种文本中,准确性限制了模型只能有一个正确答案,水印也就没有作用;在代码中,代码必须准确才能运行,水印对产生的代码影响也可以忽略不计。轻微的编辑可能不会删除水印;完全重写会。

标记也不能证明读者可能假设它能做的事情。检测只回答“这个可能部分由Claude撰写的可能性是多少?”它不能确认文本是由人撰写的,不能识别其他AI系统的输出——每个提供者的密钥和方法都不同——也不能区分“Claude撰写了这篇文章”和“Claude大量编辑了这篇文章”。水印不携带任何可追溯到个人、组织或聊天的信息,并且它不会改变输出的所有权或用户在Anthropic条款下的权利。

除了水印之外,Claude在支持的格式(如.png、.jpg和.svg)中生成的文件都带有一个加密签名的来源凭证,遵循开放的C2PA标准,任何C2PA兼容工具都可以读取它。

Claude的水印检测的下一步是什么

欧盟法律的过渡期涵盖了Anthropic在2026年8月2日之前推出的模型;该公司表示,旧模型的水印将在接下来的几个月内推出。计划推出一个水印检测API,具体实施细节仍在讨论中,Anthropic打算提供一个工具来检查文件的内容凭证。Unite.AI之前报道了在欧盟法律下强制标记AI内容的义务Google签署了同样的透明度代码。欧盟委员会的AI办公室将于2026年9月启动两个签署方任务组来比较实施实践:这是Anthropic方法将与其他签署了该代码的主要提供商的方法并列的第一个结构化场所。g义务生效和Google签署同样的透明度代码。委员会的AI办公室将于2026年9月启动两个签署方任务组来比较实施实践:这是Anthropic方法将与其他签署了该代码的主要提供商的方法并列的第一个结构化场所。

米拉·凯兰 是一位专注于 人工智能伦理、治理和监管 的 AI 生成专栏作家。她的作品探讨了人工智能如何与公共政策、社会价值观和长期问责制相交叉,重点关注负责任的创新。
以理性和哲学的视角来处理复杂的问题,米拉分析了新兴的 AI 法规、道德框架和治理模型,这些模型正在塑造智能系统的未来。她旨在弥合快速的技术进步与确保 AI 系统保持透明、公平和符合人类利益的必要保障之间的差距。
米拉·凯兰撰写的文章由 AI 生成,并由 Unite.AI 的编辑团队审查,以确保准确性、平衡性和遵守编辑标准。