ニュースマクロOpenAI、EU AI法への対応で欧州のChatGPT出力に不可視の「textGrain」透かしを埋め込み

OpenAI、EU AI法への対応で欧州のChatGPT出力に不可視の「textGrain」透かしを埋め込み

著者: Blockonomi·

重要ポイント

  • •OpenAIのtextGrain透かしは、EU域内のChatGPT出力にはデフォルトで必須となる一方、世界中のAPI利用者はオプトインでき、EU域外の一般ユーザーにはデフォルトで無効のまま。
  • •このシステムは、隠し文字や不可視のスペースではなく、語彙選択そのものに統計的シグネチャを直接埋め込むため、不可視要素の除去といった一般的な回避戦術では透かしを取り除けない。
  • •OpenAIの社内評価では、未改変の150語の応答で約66%、300語で約92%の検出率が示されたが、4語に1語を同義語に置き換えると精度はわずか17%に低下した。
  • •検出器へのアクセスは審査を経た研究者および専門組織に限定されており、OpenAIは一般公開されるかどうか、また時期についても明らかにしていない。
  • •陰性の検出結果は人間の執筆を証明するものではない。短いテキスト、編集・翻訳されたテキスト、競合AIプラットフォームが生成したコンテンツはシステムを回避できる可能性がある。
OpenAI、EU AI法への対応で欧州のChatGPT出力に不可視の「textGrain」透かしを埋め込み

OpenAIは、不可視の統計的透かし「textGrain」を欧州連合域内のChatGPTおよびCodexの出力に展開を開始した。10月5日に発表されたこの展開は、EU AI法が課す透明性義務への直接的な対応として同社が位置づけている。この動きは、画像や音声ファイルが同社のツールで作成されたかどうかをユーザーが検証できる既存のコンテンツ来歴の取り組みを、テキストへと拡張するものでもある。同社は公式発表およびXへの投稿でこの取り組みを詳述した:

EUの規制要件に対応するため、コンテンツ来歴へのアプローチをテキストにまで拡大します。その際、現在のテキスト透かし技術には大きな限界があることも認識しています。当社のツールは、画像や音声ファイルが当社のツールで作成されたかどうかの検証にすでに役立っています…

— OpenAI (@OpenAI) 2026年10月5日

textGrainの仕組み

この技術は、言語モデルの語彙選択に微妙な影響を与えることで、隠された統計的シグネチャを生成する。その後、専用の検出アプリケーションがテキストを分析し、このシグネチャを識別する。OpenAIによると、この手法は隠し文字、不可視のスペース、通常でない句読点に依存していない。そのため、コピーしたテキストから隠し文字を削除するといった典型的な回避戦術では透かしを除去できず、シグネチャは言語パターンそのものに直接織り込まれている。

透かしは改変に対してどの程度耐性があるのか?

検出の有効性はコンテンツの長さによって大きく異なる。OpenAIはテキストをトークン(言語モデルが解釈単語の断片)で測定しており、1トークンは標準的な英語の単語の約4分の3に相当する。社内評価では、検出システムは約150語の未改変の応答のうち約66%を正しく識別した。コンテンツが約300語に達すると、成功率は約92%に上昇した。

コンテンツの改変は、透かしの有効性を急速に損なう。300語の文章では、10語に1語を同義語に置き換えるだけで、検出精度は92%から66%に低下した。4語に1語を置き換えた場合、検出率はわずか17%まで急落した。OpenAIの社内調査結果は、テキストが編集・要約・言い換えされると、システムが深刻な課題に直面することを示している。これは、同社自身が開始時に認めた「現在のテキスト透かし技術の大きな限界」と整合する制約である。

さらに同社は、透かしの実装が最新モデル「GPT-6 Astra」のパフォーマンス指標に与える影響は最小限であったと述べた。

検出ツールが非公開のままである理由

OpenAIは、検出ツールを直ちに広く公開することを選択しなかった。代わりに、審査を経た研究者および専門組織に限ってアクセスが許可される。同社は、陽性の検出結果がユーザーの身元、入力プロンプト、会話の詳細を開示するものではないと明確にしている。

陰性の結果についても確実性は低い。短いテキスト、改変されたテキスト、翻訳されたテキストは、アラートを発生させることなく検出器を回避できる可能性がある。競合AIプラットフォームが生成したコンテンツも同様にシステムを作動させない。システムはOpenAI独自のシグネチャのみを検索するためである。OpenAIは、透かしが検出されないことが人間の執筆を証明するものではないと明確に述べている。

映像および音声コンテンツは別の検証プロセスに従う。ユーザーはすでに、これらのファイル形式をOpenAIの公開検証プラットフォームにアップロードし、SynthID透かしをスキャンすることができる。テキスト出力には現時点で同等の公開チェックはなく、検出器へのアクセスは審査を経た組織に限定されたままである。

地域的な適用範囲と規制の背景

欧州連合域外では、ChatGPTの透かしは一般ユーザー向けにデフォルトで無効のままとなる。ただし、世界中のAPIクライアントは、プロジェクトまたは組織の設定を通じて特定のモデルに対して有効化できる。実際には、この透かしはEU域内のChatGPT出力には必須であり、世界中のAPI利用者は設定を通じて任意で効化できる。つまり、EUユーザーにはデフォルトでオン、その他の地域ではオプトインとなる。

この展開は、8月に開始されたEUのAI法透明性条項の施行に続くものだ。OpenAIはこの透かしを、規制要件への継続的な対応の一環として位置づけている。同社は声明の中で、より広範な業界データにも言及した。TRM Labsの調査によると、AIツールの犯罪的悪用は前年比で40%増加している。

OpenAIは、検出ツールが一般公開されるかどうか、またいつになるかについては明らかにしていない。現時点では、EUでの実装と審査を経た研究グループ・専門機関への限定アクセスが、この取り組みの既存の範囲となっている。

出典:Blockonomi