OpenAI 将在欧盟为 ChatGPT 文本加水印,但全球 API 用户可选择关闭
OpenAI 为遵守欧盟规则,将在欧盟为 ChatGPT 和 Codex 加入不可见水印 textGrain;全球 API 水印可选关闭,Anthropic 则强制。检测率受长度和主题影响,编辑可规避,检测器初期仅限部分研究者。
原贴
查看原文原文
中文翻译
OpenAI 正在为 ChatGPT 文本添加不可见水印,以遵守欧盟规则。
与 Anthropic 不同,它将允许全球 API 客户将其关闭。
据报道,欧盟《人工智能法案》要求 AI 提供商以机器可读格式标记生成的文本。
OpenAI 的答案是 textGrain,一种在模型的用词选择中嵌入不可见统计信号的技术。
它的工作原理很像 Claude 的 SynthID 水印,后者使用了谷歌的开源技术。
OpenAI 表示,将在未来几周内为欧盟的 ChatGPT 和 Codex 用户开启水印。
API 水印将在全球范围内采用选择加入制,不同于 Anthropic 对 Claude 的强制水印,后者无论用户如何访问模型都在全球适用。
OpenAI 的 API 水印也将在未来几周内通过 Microsoft Azure 等云合作伙伴提供。
OpenAI 表示,textGrain 在内部测试中匹配或超过了其他方法,包括谷歌用于文本的 SynthID。
该公司还计划将该技术作为开源发布,以便其他人可以在其基础上构建。
检测率在很大程度上取决于文本长度和主题内容。
在检测器将目标假阳性率设为 1% 的情况下,它在约 95% 的关于心理学的 400 词元段落中识别出了水印。
在 200 词元时,这一比例降至约 80%。
OpenAI 表示,数学内容的检测率“显著更低”,因为模型在选词上的自由度较小。
更长的段落可能会增强统计信号并提高检测率,不过结果仍可能取决于内容。
OpenAI 没有提供数据来检验这一假设。
编辑文本也会使水印更难被检测到。
OpenAI 表示,仅将 10% 的词语替换为同义词,就会使 400 词元段落的检测率从约 92% 降至 66%。
替换四分之一的词语会使检测率降至 17%,使水印容易被规避。
这一弱点可能对 OpenAI 有利。
如果 OpenAI 的水印变得更难去除,不想让 ChatGPT 使用被检测到的用户可能会转向开放权重模型。
一份技术报告深入解释了 textGrain 的工作原理。
Anthropic 尚未公布 Claude 水印的检测率,不过它表示其系统在应对编辑方面表现良好。
OpenAI 表示,水印不会损害输出质量,并引用了其前沿模型 Astra 的测试。
该公司报告称,在包括 GPQA Diamond、BrowseComp 和 DeepSWE 在内的八项基准测试中,开启或关闭水印没有显著性能差异。
这些结果并未确定水印是否影响写作质量,批评者也对 Claude 的水印提出了这一问题。
OpenAI 还表示,检测到水印并不能揭示文本中有多少人类创造力或编辑。
它不能确立所有权、分配责任、识别用户,也不能表明文本是否准确;而未能检测到水印也不能证明文本是人类写的。
该段落可能太短、经过编辑或翻译,或者来自检测器不支持的模型。
最初只有选定的研究人员和专业组织才能使用 textGrain 的检测器。
他们可以通过申请表进行申请。
OpenAI 将根据欧盟的《实践准则》逐案授予访问权限。
Anthropic 对其检测 API 采取了类似做法。
该工具只会报告是否检测到 OpenAI 水印。
它不会识别用户或透露他们的提示或对话。
核心信息
OpenAI 为遵守欧盟规则,将在欧盟为 ChatGPT 和 Codex 加入不可见水印 textGrain;全球 API 水印可选关闭,Anthropic 则强制。检测率受长度和主题影响,编辑可规避,检测器初期仅限部分研究者。
- OpenAI 为遵守欧盟规则,将在欧盟为 ChatGPT 和 Codex 加入不可见水印 textGrain;全球 API 水印可选关闭,Anthropic 则强制。检测率受长度和主题影响,编辑可规避,检测器初期仅限部分研究者。
- 原贴提到:OpenAI is adding invisible watermarks to ChatGPT text to comply with EU
- 来源:the-decoder.com
详细解读
这是什么信号
OpenAI 正在把“AI 生成文本标记”从原则讨论推进到产品合规层。为遵守欧盟规则,它将在未来几周为欧盟的 ChatGPT 和 Codex 用户开启不可见水印,技术名为 textGrain,原理是在模型选词中嵌入统计信号,类似 Claude 使用的 SynthID。不同点是:ChatGPT 端在欧盟默认开启,而全球 API 水印采用选择加入,客户可关闭;Anthropic 对 Claude 的水印则是全球强制。这释放出两个信号:一是欧盟 AI 法案的机器可读标记要求正在落地;二是 OpenAI 试图在合规与开发者体验之间做平衡。
为什么重要
水印不是简单的技术附加项,而是 AI 内容溯源、平台治理和模型商业化的交叉点。对 OpenAI 而言,欧盟合规是硬约束,但 API 全球可选意味着它不愿因强制水印失去开发者客户。对行业而言,textGrain 计划开源、检测器初期只向选定研究人员和专业组织开放,说明“生成端标记”和“检测端验证”被分开管理。更重要的是,原文数据表明水印检测并不稳定:400 词元心理学段落检测率约 95%,200 词元降至约 80%,数学内容显著更低;替换 10% 同义词可把 400 词元段落检测率从约 92% 降到 66%,替换四分之一降到 17%。这意味着水印更适合做合规声明和辅助信号,而不是强证明。
对谁有价值
第一,欧盟的 ChatGPT 和 Codex 用户会直接遇到默认水印;第二,全球 API 开发者、企业客户和 Azure 等云伙伴需要判断是否开启,以及是否面向欧盟客户做合规说明;第三,内容平台、审核团队和学术研究者可把水印作为多信号之一,但不能单独依赖;第四,开源社区和 AI 治理研究者会关注 textGrain 开源计划与检测器申请机制;第五,竞品与合规团队可对比 Anthropic 强制水印与 OpenAI opt-in 策略的差异。
可以怎么行动
API 用户应先梳理自身内容流向:是否服务欧盟用户、是否涉及受监管场景、是否愿意接受可被检测的生成文本。企业合规团队可跟踪欧盟 Code of Practice 下的访问与申请机制,并准备“水印可关闭/可规避”的说明,避免把水印当成唯一证据。内容平台应结合来源元数据、编辑历史、模型指纹和人工审核,而不是只看水印。开发者可关注 textGrain 开源后的实现与检测器接口,提前测试自身内容类型在短文本、翻译、改写后的检测率。研究者可按原文所述通过申请表申请检测器访问。
风险或限制
最大限制是水印既不能证明文本由人类所写,也不能在未检测到时排除 AI 生成;它不确立所有权、不分配责任、不识别用户,也不判断文本准确性。检测率受文本长度、主题和编辑影响,数学等选词自由度低的内容检测更差。水印可被同义词替换、翻译或改写规避,短文本和检测器不支持的模型也会造成漏检。OpenAI 虽称水印不影响输出质量,并引用 Astra 在八项基准上的测试,但原文也指出这些结果没有证明写作质量是否受影响。此外,检测器初期只对选定对象开放,且只报告是否检测到 OpenAI 水印,不透露提示或对话,这既保护隐私,也限制外部独立验证。
信息差价值
这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 the-decoder.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。
如果把《OpenAI 将在欧盟为 ChatGPT 文本加水印,但全球 API 用户可选择关闭》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。
参考来源
TOPIC HUBS
延伸专题
AI SUMMARY
这篇文章回答了什么
OpenAI 将在欧盟为 ChatGPT 文本加水印,但全球 API 用户可选择关闭主要讲什么?
OpenAI 为遵守欧盟规则,将在欧盟为 ChatGPT 和 Codex 加入不可见水印 textGrain;全球 API 水印可选关闭,Anthropic 则强制。检测率受长度和主题影响,编辑可规避,检测器初期仅限部分研究者。
这篇文章最值得关注的要点是什么?
OpenAI 为遵守欧盟规则,将在欧盟为 ChatGPT 和 Codex 加入不可见水印 textGrain;全球 API 水印可选关闭,Anthropic 则强制。检测率受长度和主题影响,编辑可规避,检测器初期仅限部分研究者。;原贴提到:OpenAI is adding invisible watermarks to ChatGPT text to comply with EU;来源:the-decoder.com
这篇文章和哪些AI专题相关?
它适合放在AI副业、AI内容增长专题里阅读。 关联原因:这篇内容命中「项目、小生意、变现」等主题信号。;这篇内容命中「内容」等主题信号。
阅读这篇文章建议先理解哪些关键词?
建议先理解工具、模型、Claude、副业、创业这些关键词,再结合正文判断工具、机会或风险是否值得进入自己的工作流。