新聞宏觀經濟Anthropic 開始在全球為 Claude 生成文本添加隱形浮水印

Anthropic 開始在全球為 Claude 生成文本添加隱形浮水印

作者: TechNext24·

重點速覽

  • 自 8 月 2 日起發布的 Claude 模型將在模型層級包含難以察覺的文本浮水印。
  • Anthropic 表示浮水印不會改變含義或可讀性,且能在複製和部分編輯後保留。
  • 浮水印推行範圍涵蓋全球的 Claude 應用程式、API 以及 AWS、Google Cloud 和 Microsoft Foundry 上的支援服務。
  • 檔案輸出將使用基於 C2PA 標準的簽署來源元資料,而非嵌入式文本浮水印。
  • Anthropic 表示舊版 Claude 模型將在《歐盟 AI 法案》過渡期間稍後獲得此功能。
Anthropic 開始在全球為 Claude 生成文本添加隱形浮水印

Anthropic 已開始為其較新的 Claude 模型所生成的文本嵌入隱形浮水印,並將此措施全球推行,以配合《歐盟 AI 法案》的合規要求。該法案要求生成合成內容的 AI 系統提供商確保其輸出內容可被偵測識別。

自 8 月 2 日起發布的 Claude 模型將在模型層級帶有難以察覺的信號。根據 Anthropic 的說法,浮水印不會改變文本的含義或可讀性,且在內容被複製貼上時仍然保留。該公司指出,此標記「可能在某些編輯後仍然保留」。Anthropic 已簽署《歐盟 AI 生成內容實務守則》,並表示浮水印措施將在全球範圍內適用,而非僅限於歐盟境內的使用者。

浮水印系統的運作方式

該信號將應用於多個平台,包括 Claude 應用程式、API、Claude Code、Claude Cowork 及 Claude Tag。透過 Amazon Web Services (AWS)、Google Cloud 及 Microsoft Foundry 存取支援模型的客戶也將收到帶有浮水印的輸出內容。

檔案輸出則採用不同的機制處理。支援的檔案格式(包括常見的圖片類型)將帶有基於內容來源與真實性聯盟 (C2PA) 標準的簽署來源元資料,而非嵌入式的文本浮水印。C2PA 是一項由 Adobe、Microsoft、BBC 等機構聯合開發的跨產業規範,正日益被廣泛採用作為驗證數位媒體來源和編輯歷史的通用框架。

舊版 Claude 模型不會立即獲得浮水印系統。Anthropic 表示,正在《歐盟 AI 法案》過渡期間努力將此功能擴展至這些模型。

該公司提醒,大幅編輯、改寫、翻譯或將 Claude 的輸出與其他文本混合,可能會使浮水印無法被偵測到。該公司還指出,偵測到浮水印並不能確切證明某段文本最初是由 Claude 所撰寫,因為透過 Claude 對現有作品進行校對或翻譯等活動也可能留下標記。

Anthropic 計劃公布技術細節,以協助使用者和第三方偵測其浮水印,隨著標記和偵測系統持續發展,預計將有更多相關文件陸續發布。

Anthropic 是第二家引入文本浮水印技術的大型 AI 實驗室。Google DeepMind 於 2024 年宣布,其正在透過 Gemini 應用程式和網頁體驗使用 SynthID 技術為生成的文本和影片添加浮水印,並且此前已於 2023 年發布了該工具的圖片浮水印版本。其他主要提供商(包括 OpenAI 和 Meta)尚未部署類似的文本級別浮水印技術,但《歐盟 AI 法案》的透明度要求將廣泛適用於在該地區營運的所有通用 AI 模型提供商。