OpenAI 為歐洲 ChatGPT 輸出植入隱形「textGrain」浮水印 以符合歐盟 AI 法案
重點速覽
- •OpenAI 的 textGrain 浮水印在歐盟境內對 ChatGPT 輸出預設強制啟用,全球 API 用戶可自行選擇啟用,而歐盟以外的一般用戶則預設關閉。
- •該系統是將統計特徵直接嵌入選詞之中,而非使用隱藏字元或空格,因此剝除隱藏元素等常見規避手段無法將其移除。
- •OpenAI 的內部評估顯示,未經修改的 150 字回應偵測率約為 66%,300 字時約為 92%,但每 4 個字替換 1 個同義詞即會使準確率降至僅 17%。
- •偵測器的使用權限僅限經審核的研究人員與專門機構,OpenAI 並未透露它是否或何時會公開提供。
- •陰性偵測結果並不能確認內容出自人類之手,因為簡短、經編輯或翻譯的文字,以及來自競爭對手 AI 平台的內容,都可能避開該系統。

OpenAI 已開始在歐盟境內的 ChatGPT 與 Codex 輸出中部署名為 textGrain 的隱形統計浮水印。此舉於 10 月 5 日宣布,公司將其定位為對歐盟 AI 法案所施加透明度義務的直接回應。此舉也延伸了 OpenAI 既有的內容溯源工作,該機制已可讓用戶驗證圖像與音訊檔案是否由其工具產生。公司在官方公告以及 X 上的一則貼文中說明了這項計畫:
我們正在擴展內容溯源的方法,將文字納入其中,以回應歐盟的監管要求,同時也認知到現行文字浮水印技術的重大限制。我們的工具已能協助驗證圖像或音訊檔案是否由我們的工具產生…
— OpenAI (@OpenAI) 2026 年 10 月 5 日
textGrain 的運作方式
這項技術的原理是細微地影響語言模型的選詞,以創造隱藏的統計特徵,再由配套的偵測應用程式分析文字以辨識該特徵。據 OpenAI 表示,此方法並不依賴隱藏字元、不可見的空格或特殊的標點符號。因此,常見的規避手段——例如從複製的文字中移除隱藏字元——無法消除浮水印,因為這個特徵是直接編織在語言模式本身之中。
浮水印對修改的抵抗力有多強?
偵測效果會因內容長度而顯著不同。OpenAI 以 token(語言模型解讀的文字片段)來量化文字,約一個 token 相當於四分之三個標準英文單字。在內部評估中,偵測系統成功辨識出約 66%約 150 字的未經修改回應;當內容達到約 300 字時,成功率提升至約 92%。
修改內容會迅速削弱浮水印的效果。在 300 字的段落中,只要每 10 個字有 1 個被替換為同義詞,偵測準確率就會從 92% 降至 66%;當每 4 個字有 1 個被替換時,偵測率驟降至僅 17%。OpenAI 的內部研究顯示,一旦文字經過編輯、精簡或改寫,系統便會面臨重大挑戰——這與該公司在發布時自己承認的「現行文字浮水印技術的重大限制」一致。
公司另外指出,浮水印的實施對其最新模型 GPT-6 Astra 的效能指標影響極小。
偵測工具為何保持非公開
OpenAI 選擇不立即廣泛開放偵測器,而是僅提供給經審核的研究人員與專門機構使用。公司澄清,偵測結果為陽性並不會揭露用戶身分、輸入提示或對話內容。
陰性結果的可信度也不高。簡短、經修改或翻譯過的內容可以避開偵測器而不觸發警報。由競爭對手 AI 平台產生的內容同樣不會啟動系統,因為它只搜尋 OpenAI 專屬的特徵。OpenAI 明確表示,未偵測到浮水印並不代表內容確實出自人類之手。
視覺與音訊內容採用另外的驗證流程。用戶已可將這類檔案上傳至 OpenAI 公開可用的驗證平台,以掃描其 SynthID 浮水印。至於文字輸出,目前尚無同等的公開查驗機制,因為偵測器的使用權限仍限於經審核的機構。
區域適用範圍與監管背景
在歐盟以外的地區,ChatGPT 浮水印對一般用戶預設為關閉。不過,全球的 API 用戶可透過專案或組織偏好設定,針對特定模型啟用它。實際上,該浮水印在歐盟境內的 ChatGPT 輸出中為強制啟用,而全球的 API 用戶則可透過設定自願開啟——歐盟用戶預設開啟,其他地區則為選擇性啟用。
此次部署適逢歐盟自 8 月起開始執行 AI 法案的透明度條款。OpenAI 將浮水印定位為其持續回應監管要求的一環。公司也在聲明中引用了更廣泛的產業數據:TRM Labs 的研究顯示,AI 工具遭犯罪利用的案例增 40%。
OpenAI 並未透露偵測工具是否或何時會公開提供。隨著部署推進,系統在實際編輯、精簡與翻譯情境下的表現,以及歐盟以外 API 營運商的採用程度,仍是未知數。目前,歐盟的實施以及對獲核准研究團體與專家機構的受限開放,即是這項計畫現有的範圍。
資料來源:Blockonomi