监管

OpenAI 在欧盟 AI 法案规则下启动分阶段文本水印

mm
将 Unite.AI 添加到您在 Google 上的首选来源

OpenAI 于 2026 年 10 月 5 日,阐述了其文本水印方法,遵循 EU AI Act,向全球 API 客户开放可选择的水印功能,并宣布将在未来几周内向欧盟的合格 ChatGPT 和 Codex 文本输出添加不可见水印。

欧盟 AI 法案要求生成式 AI 供应商以机器可读的方式使生成文本可辨识。OpenAI 将文本水印及其检测描述为仍处于早期阶段且存在显著局限的技术,并表示其分阶段方案既符合监管要求,也考虑了这些限制。

可选择的 API 访问与欧盟地区推广

自 2026 年 10 月 5 日起,全球 API 客户可为特定模型选择加入文本水印,且默认情况下该功能处于关闭状态。OpenAI 表示,可选择的设计让客户自行决定水印如何符合其透明度义务以及为用户提供的体验,并称正在与云合作伙伴合作,计划在未来几周内通过其服务提供的 OpenAI 模型输出中加入水印功能。

对于自家产品,OpenAI 将在未来几周内仅在欧盟范围内为所有套餐的合格 ChatGPT 与 Codex 用户引入文本水印。公司表示,启动时并未将文本水印设为全球默认,而是采用区域化方式,以便从实际使用和反馈中学习。

OpenAI 亦于 2026 年 10 月 5 日开放了文本水印检测器的申请通道。访问最初将仅限于经批准的研究人员和专家机构,依据欧盟的 AI 生成内容透明度实践守则逐案批准,以支持文本来源的评估与改进。该公告仅针对文本:OpenAI 表示,其音频和图像的验证工具,包括 openai.com/verify 网页工具和 Content Provenance API,仍保持公开可用。

textGrain 工作原理

OpenAI 的水印技术 textGrain 会在模型选择的词语中嵌入不可见的统计信号,公司检测器则对文本段落进行检测,以判断是否携带 OpenAI 水印。技术报告题为《textGrain: Entropy-Calibrated Watermarking for Language Model Text》,发布日期为 2026 年 10 月 5 日,列出了隶属于宾夕法尼亚大学、耶鲁大学和 OpenAI 的作者。

根据报告,该方法通过求解一个最优传输问题,将令牌生成与带密钥的随机性关联,成本来源于 Gumbel 随机变量,并使用 Kullback–Leibler 正则化对偏离独立性的情况进行惩罚。熵预算限制了为换取水印信号而放弃的平均抽样熵,报告指出 KL 惩罚恰好等于水印移除的平均熵,从而使强度参数拥有直接的信息论意义。将传输步骤应用于带密钥的词汇令牌块,可在保持每块内部相对令牌概率不变的前提下降低优化规模。检测器仅需生成的文本和密钥,无需使用生成过程中的熵预算。

OpenAI 表示计划将该技术以开源形式发布,以便他人基于此进行构建,并称报告将在未来几周内补充更多细节。

检测性能与声明的局限性

OpenAI 报告称,在其评估中,textGrain 的表现匹配或超过了所测试的其他方法,包括文本版 SynthID,但同时提醒,在理想条件下的出色表现并不保证在日常使用中的可靠检测。

OpenAI 报告称,在目标误报率为 1% 的情况下,检测器能够在约 80% 的 200 令牌段落和约 95% 的 400 令牌段落中识别出水印(以心理学等内容为例),而在数学等词汇选择受限的内容中识别率显著下降。在对 400 令牌段落的评估中,将 10% 的词替换为同义词使检测率从约 92% 降至 66%,而将 25% 的词替换则降至 17%。这些评估使用了带水印的英文回答,来源于 ELI5 数据集的问题。

关于输出质量,OpenAI 表示,在用于评估 Astra(其最新前沿模型)的基准测试中,水印与否并未出现显著的性能差异。其公开的表格显示,未加水印和加水印文本在人工分析智能指数(Artificial Analysis Intelligence Index)上的得分分别为 49.57 与 49.76,在 GPQA Diamond 上的得分分别为 94.44% 与 93.94%。OpenAI 说明,检测的局限性是其将初始检测器访问权限限制在经批准的研究人员和专家机构的决定因素之一。

水印无法确立的事项

OpenAI 表示,文本水印只能提供关于其系统在段落中所起作用的有限信号。水印并不能衡量人类的贡献,亦不确立所有权或责任,不会识别用户,也不验证准确性,公司如此声明。它还指出,未检测到水印并不能证明是人类创作,因为文本可能过短、已被编辑或翻译,导致难以可靠检测,亦可能来自不支持水印的模型,或早于水印技术出现,亦或是由其他公司的工具生成的。

检测器将报告是否检测到 OpenAI 的水印,但不会识别用户或泄露其提示或对话。鉴于漏检水印和误报的风险,OpenAI 在发布时并未公开此工具。

欧盟透明度义务

《人工智能法案》第 50 条规定的透明度义务,包括对 AI 生成内容的标记与检测以及对深度伪造和某些 AI 生成出版物的标签,将于 2026 年 8 月 2 日生效。AI 生成内容透明度行为准则由独立专家在 AI 办公室主持的多方利益相关者进程中起草,最终准则于 2026 年 6 月 10 日发布。

遵守该准则是自愿的,但第 50 条的透明度要求是法律义务。欧盟委员会和 AI 委员会已确认该准则是展示合规的充分自愿工具,截至 2026 年 7 月底,约有 190 家公司和组织签署了该准则,委员会如此说明。

OpenAI 表示将继续改进检测技术,研究水印在编辑和翻译过程中的耐受性,并探索区分 AI 辅助与 AI 作者身份的方法,同时将在认为结果能够负责任解释时扩大检测器的使用范围。

索菲·德纳 是 Unite.AI 的 AI 生成记者,报道全球市场的人工智能政策、法规和治理。她的工作重点是国家和国际监管框架如何塑造人工智能技术的发展、部署和商业化。

索菲拥有外交和全球视野,跟踪政府、多边机构和标准化机构的政策举措,分析不同监管方法如何影响创新、竞争和市场准入。她特别关注跨境影响、合规挑战和风险管理与技术进步之间的平衡。

索菲·德纳撰写的文章由 Unite.AI 的编辑团队生成和审查,以确保人工智能政策和监管发展的准确性、中立性和负责任的报道。