Anthropic开始在全球范围内为Claude生成的文本添加隐形水印
要点速览
- •自8月2日起发布的Claude模型将在模型层面包含不可察觉的文本水印。
- •Anthropic表示该水印不会改变文本含义或可读性,并能在复制粘贴和部分编辑后保留。
- •水印的推出适用于全球范围的Claude应用、API以及AWS、Google Cloud和Microsoft Foundry上的支持服务。
- •文件输出将使用基于C2PA标准的签名来源元数据,而非嵌入式文本水印。
- •Anthropic表示旧版Claude模型将在欧盟《人工智能法案》过渡期内后续获得该功能。

Anthropic已开始为其新一代Claude模型生成的文本嵌入隐形水印,并将在全球范围内推行该措施,以配合遵守欧盟《人工智能法案》——该法案要求生成合成内容的人工智能系统提供商确保其输出内容可被检测。
自8月2日起发布的Claude模型将在模型层面携带一种不可察觉的信号。据Anthropic介绍,该水印不会改变文本的含义或可读性,并在内容被复制粘贴时仍然保留。公司指出,该标记"可能在某些编辑后依然存在"。Anthropic已签署欧盟《人工智能生成内容行为准则》,并表示水印将适用于全球范围,而不仅限于欧盟用户。
水印系统的工作原理
该信号将应用于多个平台,包括Claude应用、API、Claude Code、Claude Cowork和Claude Tag。通过Amazon Web Services (AWS)、Google Cloud和Microsoft Foundry访问支持模型的客户也将获得带水印的输出。
文件输出采用不同的机制。支持的文件格式(包括常见图像类型)将携带基于内容来源与真实性联盟(C2PA)标准的签名来源元数据,而非嵌入式文本水印。C2PA是一项由Adobe、Microsoft、BBC等联合开发的跨行业规范,正日益被广泛采纳为验证数字媒体来源和编辑历史的通用框架。
较旧的Claude模型暂时不会获得该水印系统。Anthropic表示,公司正在欧盟《人工智能法案》过渡期内努力将该功能扩展至这些模型。
公司提醒,大量编辑、改写、翻译或将Claude的输出与其他文本混合可能使水印无法被检测到。公司还指出,检测到水印并不能确凿证明某段文本最初由Claude撰写,因为使用Claude对已有内容进行校对或翻译等活动也可能留下标记。
Anthropic计划公布技术细节,以帮助用户和第三方检测其水印,并预计随着标记和检测系统的持续发展,将发布更多文档。
Anthropic是第二家引入文本水印技术的主要人工智能实验室。Google DeepMind于2024年宣布使用其SynthID技术对通过Gemini应用和网络体验生成的文本和视频添加水印,此前已于2023年发布了该工具的图像水印版本。包括OpenAI和Meta在内的其他主要提供商尚未部署类似的文本级水印技术,不过欧盟《人工智能法案》的透明度要求将广泛适用于在该地区运营的所有通用人工智能模型提供商。