Anthropic宣布水印检测API,第三方可检测Claude的AI文本
Anthropic将推出水印检测API,使第三方开发者能够集成AI文本检测。该水印基于Google Deepmind的SynthID Text方法,通过调整随机源生成可追踪模式。水印在短文本、代码和改写后效果有限,只能标记Claude可能参与生成。此举旨在遵守欧盟AI法案,全球同步上线,旧模型将逐步支持。
原贴
查看原文原文
中文翻译
Anthropic即将推出一款水印检测API,允许第三方开发者将AI文本检测集成到自己的应用中。该公司为其Claude AI模型使用了Google Deepmind在2024年发表于《自然》的SynthID Text方法的一个变体。水印通过调整单词选择过程中的随机源,形成可追踪的模式。据Anthropic称,这对“Claude文本的内容、创造力水平或可读性”没有影响。Google Deepmind在2024年用以下动画展示了这一过程。
水印在短文本或事实密集的段落中效果较差,因为这些内容没有太多替代措辞。代码也是如此。纯人工逐字修改的内容不会带有水印。翻译则不同,因为所有单词都由Claude选择。Anthropic在已发布的FAQ中表示,大量改写可能去除水印。
水印只能标记Claude可能参与了文本创作。它无法判断Claude是撰写了全部内容还是仅进行了大量编辑,也无法确定文本是来自人类还是其他AI模型。
Anthropic添加水印是为了遵守欧盟AI法案。该公司与大约190个其他签署方一起,于2026年7月签署了关于AI生成内容透明度的欧盟实践准则。由于目前没有技术方法按区域限制该功能,水印功能将在全球推出。据Anthropic称,公司正在不断探索更多选项,后续将发布更新。所有在2025年8月2日之后发布的模型都默认支持水印。较旧的Claude模型将在未来几个月内获得该功能。对于文件,Anthropic使用开放的C2PA标准,该标准在不改变文件本身的情况下附加元数据。
Anthropic的水印技术不同于像Pangram那样的外部AI检测工具。那些服务无法访问Anthropic的密钥。相反,它们扫描AI文本中的典型模式,比如特征性的措辞或过度使用的词汇。水印检查是一种根本不同的方法,在实践中应该更可靠。
核心信息
Anthropic将推出水印检测API,使第三方开发者能够集成AI文本检测。该水印基于Google Deepmind的SynthID Text方法,通过调整随机源生成可追踪模式。水印在短文本、代码和改写后效果有限,只能标记Claude可能参与生成。此举旨在遵守欧盟AI法案,全球同步上线,旧模型将逐步支持。
- Anthropic将推出水印检测API,使第三方开发者能够集成AI文本检测。该水印基于Google Deepmind的SynthID Text方法,通过调整随机源生成可追踪模式。水印在短文本、代码和改写后效果有限,只能标记Claude可能参与生成。此举旨在遵守欧盟AI法案,全球同步上线,旧模型将逐步支持。
- 原贴提到:Anthropic will soon offer a watermark detection API that lets third-part
- 来源:the-decoder.com
成为会员查看完整内容
你已经看到了这篇内容的前置整理,剩余深度部分仅对会员开放。