OpenAI 周一在一篇博客文章中表示,公司将在欧盟范围内为 ChatGPT 和 Codex 生成的文本添加一种不可见的水印,以符合欧盟《人工智能法案》的要求。
欧盟《人工智能法案》的透明度规则于 8 月 2 日生效,要求人工智能公司以其他系统可以识别的方式对 AI 生成的内容进行标记。
OpenAI 表示,水印将在未来几周内向所有套餐中符合条件的 ChatGPT 和 Codex 用户推出,但范围仅限于欧盟地区。从今天开始,全球任何地区使用 OpenAI API 的开发者都可以为选定的模型启用该功能;默认情况下它是关闭的。OpenAI 表示,在发布之初并不会将文本水印作为全球默认设置。
这种水印并非实际的符号,而是通过微妙地调整模型的用词来留下一种肉眼无法察觉、但检测器能够捕捉到的模式。由于水印内嵌在文字本身,因此即使文本被复制粘贴也会一并保留。OpenAI 表示,水印不会识别用户身份,并且他们发现启用水印后模型性能并没有出现明显变化。
OpenAI 还在公告中发布了一份关于其水印方法的技术报告,该方法被称为 textGrain。这份报告由 OpenAI 与宾夕法尼亚大学和耶鲁大学的研究人员共同撰写,介绍了如何用一个密钥来对下一个词的预测进行排序,从而完成句子的示例。将数百次这样的微小调整叠加起来,检测器就可以仅凭文本和密钥来识别 AI 生成的内容。
那么水印能否通过编辑来去除?OpenAI 的测试表明是可以的。在一项测试中,将 10% 的词语替换为同义词后,检测率从大约 92% 下降到 66%。公司还指出,较短的段落、数学题答案以及翻译文本更难被检测到。

公司表示:“这些局限性是我们决定仅向经批准的研究人员和专家组织开放初始检测器访问权限的原因之一,他们可以帮助我们评估其可靠性与负责任的使用方式。”
OpenAI 还提醒说,没有检测到水印“并不能证明该文本是由人类撰写的”。文本可能过短或被大量编辑过,也可能来自其他公司的 AI。
公司指出:“[水印]可以表明某段内容由 OpenAI 系统生成或处理过,但不能说明其中投入了多少人类的判断、编辑或创作。”
此次公告发布两个月前,Anthropic 曾表示将为其 Claude 生成的文本添加水印,并在全球范围内推行该措施。这一决定招致了一些 Claude 用户的反对,他们认为自己提供了“指令、上下文和决策”,而 Claude 只是“一个工具”。
OpenAI 此前曾开发过文本水印技术,但一直未予发布,部分原因是担心用户会转向那些不加水印的竞品服务,这是《华尔街日报》在 2024 年的报道中所披露的。
Anthropic、Google、Meta、Microsoft 和 OpenAI 等公司已承诺遵守欧盟关于 AI 生成内容的实践准则。