The Decoder

OpenAI将在欧盟为ChatGPT文本添加水印,但对全球API用户设为可选

OpenAI正在欧盟为ChatGPT添加不可见的textGrain水印,但与Anthropic不同,它将允许全球API客户选择退出。测试显示检测率高达95%,但当四分之一的单词被替换时,检测率降至17%。本文《OpenAI将在欧盟为ChatGPT文本添加水印,但对全球API用户设为可选》最先发表于The Decoder。

Matthias Bastian
配图来源 · The Decoder

OpenAI将在欧盟为ChatGPT文本添加水印,但对全球API用户设为可选

Matthias Bastian Matthias Bastian 查看Matthias Bastian的LinkedIn个人主页 2026年10月5日 Image description 由THE DECODER使用GPT-Image-2生成的图片

OpenAI正在为ChatGPT文本添加不可见水印,以遵守欧盟规定。与Anthropic不同,它将允许全球API客户关闭水印。

据报道,欧盟《人工智能法案》要求AI提供商以机器可读的格式标注生成的文本。OpenAI的答案是textGrain,这是一种在模型的用词选择中嵌入不可见统计信号的技术。它的工作原理与 Claude的SynthID水印非常相似,后者使用了 Google的开源技术.

OpenAI表示,将在未来几周内为欧盟的ChatGPT和Codex用户启用水印功能。与 Anthropic对Claude的强制水印不同,API水印将在全球范围内采用自愿加入模式,Anthropic的水印在全球范围内适用,无论用户如何访问模型。OpenAI的API水印功能也将在未来几周内通过Microsoft Azure等云合作伙伴提供。

文本编辑会大幅降低检测率

OpenAI表示,textGrain在内部测试中的表现达到或超过了其他方法,包括Google的文本版SynthID。该公司还计划将该技术开源,以便他人在此基础上进行开发。广告

检测率在很大程度上取决于文本长度和主题内容。当检测器的目标误报率设为1%时,它在大约95%的关于心理学的400 token段落中识别出了水印。在200 token时,检测率降至约80%。

OpenAI表示,数学内容的检测率要"低得多",因为模型在用词选择上的自由度较小。更长的段落可能会增强统计信号并提高检测率,尽管结果可能仍取决于内容。OpenAI没有提供验证这一假设的数据。

检测在很大程度上取决于文本长度和主题内容。在400 token(约300个单词)时,检测器在心理学段落中识别出约94%的水印,但在数学段落中仅识别出约60%。| 图片来源:OpenAI

对文本进行编辑也会使水印更难被检测。OpenAI表示,只需用同义词替换10%的单词,400 token段落的检测率就会从约92%降至66%。替换四分之一的单词会使检测率降至17%,使水印很容易被规避。这一弱点可能对OpenAI有利。如果不希望自己的ChatGPT使用行为被检测到的用户在其水印变得更难去除时,可能会转而使用开放权重模型。

即使是有限的编辑也会大幅降低检测率。替换25%的单词会使检测率降至20%以下,即使在400 token段落中也是如此。| 图片来源:OpenAI

一份 技术报告 深入解释了textGrain的工作原理。Anthropic尚未公布Claude水印的检测率,不过该公司表示其系统能很好地抵御编辑。广告

OpenAI表示,水印不会损害输出质量,并援引了对其前沿模型Astra的测试。该公司报告称,在包括GPQA Diamond、BrowseComp和DeepSWE在内的八项基准测试中,开启或关闭水印均未出现显著的性能差异。这些结果并不能证明水印是否影响写作质量,而 批评者也曾对Claude的水印提出过同样的质疑.

OpenAI还表示,检测到水印并不能揭示文本中融入了多少人类的创造力或编辑痕迹。它不能确立所有权、分配责任、识别用户,也不能表明文本是否准确;而未能检测到水印也不能证明文本是由人类撰写的。这段文本可能太短、经过编辑或翻译,或者来自检测器不支持的模型。

OpenAI暂将限制检测器的访问权限

只有选定的研究人员和专业机构最初才能获得textGrain检测器的访问权限。他们可以通过一个 申请表进行申请。OpenAI将根据欧盟的 行为准则逐案授予访问权限。Anthropic对其 检测API采取了类似的做法.

该工具只会报告是否检测到OpenAI水印。它不会识别用户,也不会泄露他们的提示词或对话内容。

OpenAI表示,之所以限制访问,是因为该检测器可能会误报未加水印的文本,或漏检水印。该公司计划在“我们认为结果能够被负责任地解读时”扩大访问范围。它尚未说明这可能何时发生。

现有的图像和音频验证工具仍然向公众开放,包括 openai.com/verify 和 Content Provenance API.

没有炒作的AI新闻——由人工精选

订阅THE DECODER,享受无广告阅读、每周AI新闻通讯、每年六期独家“AI Radar”前沿报告、完整档案访问权限以及评论区的访问权限。

来源: OpenAI
原始出处

The Decoder

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准