Anthropic将在全球范围内为Claude生成内容添加水印,包括经人类编辑的文本
要点速览
- •8月2日起在欧盟发布的Claude模型将自发布之日起包含机器可读水印,并计划将该技术扩展到旧模型。
- •水印将全球适用于所有支持的Claude产品,而非仅限于欧盟用户。
- •经Claude编辑、翻译或校对的人类原创内容也可能携带水印,即使原始作品是独立创作的。
- •Anthropic警告说,大量改写、短文本段落或文件转换可能使水印和元数据无法被检测到,限制了其作为AI创作证据的可靠性。
- •在欧盟运营的所有主要AI提供商,包括OpenAI、Google和Meta,都面临《AI法案》透明度条款下类似的标记义务。

Anthropic宣布将开始在其Claude AI模型生成的文本中嵌入不可见水印,以回应《欧盟AI法案》——全球首部综合性AI法规——中新的透明度要求。这些水印旨在使AI生成的内容更容易被识别,但该系统也会标记最初由人类撰写、随后经Claude编辑或处理的文本——这一范围可能会使判断内容是否真正由AI创作变得更加复杂。
这家总部位于旧金山的AI公司于周二表示,8月2日起在欧盟发布的Claude模型将自发布之日起包含机器可读水印。Anthropic还正在将该技术扩展到旧模型上。
尽管引入水印是为了 comply with《欧盟AI法案》,Anthropic确认这些标记将全球适用于所有支持Claude模型的地区,覆盖Claude、Claude Code及其开发者平台。
模型生成的文本将携带嵌入式水印,Anthropic表示该水印应能在复制粘贴操作后保留,并可能经受一定程度的编辑。图片和其他支持的文件类型将携带已签名的元数据,表明它们已经过Claude处理。
Anthropic计划发布工具,使用户和第三方能够检测其水印,但技术细节尚未披露。
此次公告发布之际,监管机构和出版方正加大对AI公司的压力,要求其使合成内容更易于识别,此前机器生成内容在互联网上激增。根据《欧盟AI法案》的透明度条款,在欧盟运营的所有主要AI提供商——包括OpenAI、Google和Meta——都面临类似的标记AI生成输出的义务,欧盟以外的多个司法管辖区,包括英国和美国部分州,也在推进各自的AI标注要求。City AM此前曾报道过AI生成的"垃圾内容"在新闻编辑室的蔓延,包括伪装成高管和其他撰稿人作品的评论文章和投稿。
人类撰写的文本也可能被标记
Anthropic承认,检测到其水印并不一定意味着内容由Claude原创。用户可以独立撰写一篇文章,然后请Claude校对、翻译或编辑——而最终文本仍可能携带Claude的水印,尽管底层的原始内容和创意源自人类作者。
《欧盟AI法案》第50条规定,当AI系统执行"标准编辑的辅助功能"或未实质性改变内容或其含义时,标记要求不适用。Anthropic已签署欧盟的自愿《行为准则》,该准则概述了企业如何 comply with 透明度义务,但其决定在所有支持的Claude输出中应用水印,这意味着该系统可能会涵盖超出法律严格要求的范围。
该公司还提醒不要将水印视为AI创作的确定性证据。大量编辑或改写可能使水印无法被检测到,短段落可能包含的文本量不足以产生可靠信号。附加在图片和其他文件上的元数据也可能在文件被转换或截屏时丢失。
检测技术仍不完善
AI检测公司GPTZero的首席技术官Alex Cui在X上的发文中解释说,文本水印通常通过微妙地改变模型中词语选择的概率来工作,从而创建一个可随后被检测到的统计模式。
然而,Cui指出该技术仍不完善,他认为水印可能难以经受"大量改写"。他还警告说,公开发布检测工具可能使用户更容易找到绕过它们的方法。
"就我所知,我尝试过的免费改写工具已经很快绕过了Google DeepMind的SynthId,"他写道。
一项涉及1,682名成年人的近期研究发表在《Judgment and Decision Making》期刊上,研究发现参与者认为ChatGPT生成的故事比人类撰写的故事更具吸引力和更高质量。然而,受访者对他们被告知由人类撰写的故事给出了更高的评分。在另外两项实验中,研究人员没有发现普遍证据表明参与者能够可靠地分辨人类原创和AI撰写的故事。
Anthropic表示,其水印不会明显改变Claude的输出,也不会影响其含义或可读性。该公司承认,该系统提供的是一种信号,而非内容来源的确凿证据,由企业和出版商决定赋予这些新标记多大的权重。