Anthropic、Claude生成コンテンツに世界中で透かしを導入、人間が編集したテキストも対象に
重要ポイント
- •8月2日以降にEUで公開されるClaudeモデルにはリリース時から機械判読可能な透かしが含まれ、旧モデルへの技術拡張も計画されている。
- •透かしはEUユーザーに限定されず、すべての対応Claude製品で世界的に適用される。
- •人間が独自に執筆したコンテンツであっても、Claudeによる編集、翻訳、校正を受けた場合には透かしが付く可能性がある。
- •Anthropicは、激しい言い換え、短いテキスト、ファイル変換により透かしやメタデータが検出不能になる可能性があり、AI著作権の証拠としての信頼性が限定的であると警告している。
- •EUで事業を展開するOpenAI、Google、Metaを含むすべての主要AIプロバイダーは、AI法の透明性条項の下で同等のマーキング義務を負っている。

Anthropicは、世界初の包括的なAI規制であるEU AI法の新たな透明性要件に対応するため、Claude AIモデルが生成するテキストに目に見えない透かしの埋め込みを開始すると発表した。透かしはAI生成コンテンツの識別を容易にすることを目的としているが、人間が元々書いたテキストであっても、その後Claudeによって編集または処理された場合にはフラグが付けられる。この適用範囲は、コンテンツが実際にAIによって作成されたかどうかを判断する作業を複雑化させる可能性がある。
サンフランシスコに拠点を置く同AI企業は火曜日、8月2日以降にEUで公開されるClaudeモデルにはリリース時から機械判読可能な透かしが含まれると発表した。Anthropicはさらに、この技術を旧モデルにも拡張するための開発を進めている。
透かしはEU AI法への対応として導入されたものの、Anthropicは、対応するClaudeモデルが利用可能な場所であれば世界中でマーキングが適用されると確認した。これにはClaude、Claude Code、および開発者プラットフォームが含まれる。
モデルが生成したテキストには埋め込み透かしが付与され、Anthropicによれば、コピー&ペースト操作後も保持され、ある程度の編集にも耐えうるという。画像その他の対応ファイルタイプには、Claudeによって処理されたことを示す署名付きメタデータが付与される。
Anthropicはユーザーや第三者が透かしを検出できるツールの提供を計画しているが、技術的な詳細はまだ公表されていない。
この発表は、インターネット上で機械生成コンテンツが急増する中、AI企業に対して合成コンテンツをより識別しやすくするよう求める規制当局や出版社からの圧力が高まっている状況で行われた。EU AI法の透明性条項の下では、EU圏内で事業を展開するすべての主要AIプロバイダー(OpenAI、Google、Metaなど)に対して、AI生成コンテンツのマーキングに関する同等の義務が課されており、EU以外の複数の管轄区域(英国や米国の各州など)も独自のAIラベル付け要件を推進している。City AMは以前、ニュースルームに蔓延するAI生成の「スロップ」について、役員や他の寄稿者の作品として欺瞞的に提示された意見記事やピッチを含めて報じている。
人間が書いたテキストにもフラグが付く可能性
Anthropicは、同社の透かしが検出されたからといって、必ずしもClaudeが元のコンテンツを執筆したことを意味しないと認めた。ユーザーが独自に記事を執筆した後、Claudeに校正、翻訳、または編集を依頼した場合、元のコンテンツとアイデアは人間の著者に由来しているにもかかわらず、結果として生成されたテキストにClaudeの透かしが残る可能性がある。
EU AI法第50条は、AIシステムが「標準的な編集の補助機能」を実行する場合、または素材やその意味を実質的に変更しない場合には、マーキング要件は適用されないと規定している。Anthropicは、企業が透明性義務を遵守する方法を示すEUの自主的な実践規範に署名しているが、対応するすべてのClaude出力に透かしを適用するという決定により、制度は法律が厳密に義務付ける範囲を超える素材を捕捉する可能性がある。
同社はまた、透かしをAI著作権の決定的な証拠として扱うべきではないと警告した。激しい編集や言い換えにより透かしが検出不能になる可能性があり、短い文章では信頼できるシグナルを生成するのに十分なテキスト量がない場合がある。画像やその他のファイルに付与されたメタデータも、ファイルの変換やスクリーンショットによって失われる可能性がある。
検出技術はまだ不完全
AI検出企業GPTZeroの最高技術責任者であるAlex Cuiは、Xへの投稿で、テキストの透かし付けは一般に、モデル内の単語選択の確率を微妙に変更することで機能し、後で検出可能な統計的パターンを作成すると説明した。
しかしCuiは、この技術はまだ不完全であると指摘し、透かしは「激しい言い換え」に耐えられない可能性があると述べた。また、検出ツールを一般公開することで、ユーザーがそれを回避する方法を特定しやすくなる可能性があると警告した。
「試した無料の言い換えツールは、Google DeepMindのSynthIdをすぐに回避できました」と彼は書いた。
学術誌『Judgment and Decision Making』に掲載された1,682人の成人を対象とした最近の研究では、参加者はChatGPTが生成した物語を人間が書いた物語よりも魅力的で品質が高いと評価した。しかし、回答者は人間が書いたと伝えられた物語により高い評価を与えた。さらに2つの実験では、参加者が人間が執筆した物語とAIが執筆した物語を確実に見分けられるという一般的な証拠は見つからなかった。
Anthropicは、透かしによってClaudeの出力が視覚的に変わったり、意味や可読性に影響が出たりすることはないと述べた。同社は、このシステムはコンテンツの起源に関する決定的な証拠ではなく一つのシグナルを提供するにすぎず、新しいマーキングにどの程度の重みを置くかは企業や出版社が判断すべきであると認めた。