Anthropic 將在全球為 Claude 生成內容加入浮水印,包括經人工編輯的文字
重點速覽
- •自 8 月 2 日起在歐盟推出的 Claude 模型將從發布之日起內建機器可讀浮水印,並計劃將該技術擴展至舊版模型。
- •浮水印將全球適用於所有支援的 Claude 產品,而非僅限於歐盟用戶。
- •由人類撰寫但經 Claude 編輯、翻譯或校對的內容也可能帶有浮水印,即使原作是獨立完成的。
- •Anthropic 警告,大量改寫、短文字段落或檔案格式轉換可能使浮水印和元資料無法被偵測,限制其作為 AI 創作證據的可靠性。
- •所有在歐盟營運的主要 AI 供應商,包括 OpenAI、Google 和 Meta,都面臨《人工智慧法案》透明度條款下類似的標記義務。

Anthropic 宣布將在其 Claude AI 模型生成的文字中嵌入隱形浮水印,以回應歐盟《人工智慧法案》——全球首部全面性 AI 法規——中的新透明度要求。這些浮水印旨在使 AI 生成的內容更易於辨識,但該系統也會標記由人類撰寫、隨後經 Claude 編輯或處理的文字——這一範圍可能使判斷內容是否真正由 AI 創作變得更加複雜。
這家總部位於舊金山的 AI 公司於週二表示,自 8 月 2 日起在歐盟推出的 Claude 模型將從發布之日起內建機器可讀浮水印。Anthropic 同時正致力於將該技術擴展至舊版模型。
儘管浮水印是為了符合歐盟《人工智慧法案》而引入,Anthropic 確認這些標記將在全球所有支援 Claude 模式的地區適用,涵蓋 Claude、Claude Code 及其開發者平台。
模型生成的文字將帶有嵌入式浮水印,Anthropic 表示該浮水印在複製貼上後應能保留,並可能承受一定程度的編輯。圖像及其他支援的檔案類型則將帶有簽署元資料,標示它們已經過 Claude 處理。
Anthropic 計劃發布工具,讓用戶及第三方能夠偵測其浮水印,但技術規格尚未公開。
此項宣布正值 AI 公司面臨來自監管機構和出版商日益增加的壓力,要求其使合成內容更容易被辨識,因為網路上機器生成的內容大幅增加。根據歐盟《人工智慧法案》的透明度條款,所有在歐盟營運的主要 AI 供應商——包括 OpenAI、Google 和 Meta——都面臨類似的標記 AI 生成內容的義務,而歐盟以外的多個司法管轄區,包括英國和美國部分州,也在推進各自的 AI 標籤要求。City AM 先前曾報導 AI 生成的「垃圾內容」在編輯室中蔓延的情況,包括假冒高階主管及其他撰稿人之名的評論文章和投稿。
人工撰寫的文字也可能被標記
Anthropic 承認,偵測到其浮水印不一定意味著該內容是由 Claude 原創。用戶可以自行撰寫文章,然後請 Claude 進行校對、翻譯或編輯——最終的文字仍可能帶有 Claude 的浮水印,即使底層內容和想法源自人類作者。
歐盟《人工智慧法案》第 50 條規定,當 AI 系統執行「標準編輯的輔助功能」或未實質改變內容或其含義時,標記要求不適用。Anthropic 已簽署歐盟自願性《實務守則》,該守則概述了企業如何遵守透明度義務,但其決定在所有支援的 Claude 輸出中全面套用浮水印,意味著該系統可能涵蓋超出法規嚴格要求的內容。
該公司還警告,不應將浮水印視為 AI 創作的確鑿證據。大量編輯或改寫可能使浮水印無法被偵測,而短段落可能包含的文字量不足以產生可靠信號。附加於圖像和其他檔案的元資料也可能在檔案轉換或截圖時遺失。
偵測技術尚未完善
AI 偵測公司 GPTZero 的技術長 Alex Cui 在 X 上發文解釋,文字浮水印通常透過微妙地改變模型選詞的機率來運作,從而建立一個日後可被識別的統計模式。
然而,Cui 指出該技術仍有不足之處,並表示浮水印可能難以承受「密集改寫」。他同時警告,公開發布偵測工具可能讓用戶更容易找出如何繞過浮水印的方法。
「就我所嘗試過的免費改寫工具而言,它們很快就繞過了 Google DeepMind 的 SynthId,」他寫道。
一項發表於《Judgment and Decision Making》期刊、涉及 1,682 名成年人的近期研究發現,參與者認為 ChatGPT 生成的故事比人類撰寫的故事更引人入勝且品質更高。然而,當參與者被告知故事是由人類撰寫時,他們給予了更高的評分。在另外兩項實驗中,研究人員未發現普遍證據表明參與者能可靠地區分人類撰寫和 AI 生成的故事。
Anthropic 表示,其浮水印不會明顯改變 Claude 的輸出,也不會影響其含義或可讀性。該公司承認,此系統提供的是一種信號,而非內容來源的確鑿證據,由企業和出版商自行決定如何權衡這些新標記的重要性。