OpenAI 在欧洲的 ChatGPT 输出中嵌入不可见 'textGrain' 水印,以遵守欧盟《人工智能法案》
要点速览
- •OpenAI 的 textGrain 水印对欧盟内的 ChatGPT 输出默认强制启用,全球 API 用户可自愿加入,而欧盟以外的普通用户默认关闭。
- •该系统将统计签名直接嵌入选词之中,而非使用隐藏字符或空格,因此删除不可见元素等常见规避手段无法将其移除。
- •OpenAI 的内部评估显示,未经修改的 150 词回复的检出率约为 66%,300 词约为 92%,但每四个词中替换一个同义词即令准确率降至仅 17%。
- •检测器的访问权限仅限于经审核的研究人员和专业机构,OpenAI 尚未披露其是否会以及何时向公众开放。
- •阴性检测结果并不能证实内容为人类撰写,因为简短、经过编辑或翻译的文本以及来自竞争性 AI 平台的内容都可能避开该系统。

OpenAI 已开始在欧盟领土范围内的 ChatGPT 和 Codex 输出中部署名为 textGrain 的不可见统计水印。此举于 10 月 5 日公布,公司将其定位为对欧盟《人工智能法案》所施加透明度义务的直接回应。此举还扩展了 OpenAI 现有的内容溯源工作,此前用户已可验证图像和音频文件是否由其工具生成。公司在一份官方公告和一条 X 帖子中详细介绍了这一举措:
我们正在扩展内容溯源方法,将文本纳入其中,以回应欧盟监管要求,同时也认识到当前文本水印技术的重大局限性。我们的工具已能帮助验证图像或音频文件是否由我们的工具创建……
— OpenAI (@OpenAI) 2026年10月5日
textGrain 的工作原理
该技术通过微妙地影响语言模型的选词来创建隐蔽的统计签名,随后由配套的检测应用分析文本以识别该签名。据 OpenAI 介绍,这种方法不依赖隐藏字符、不可见空格或异常标点符号。因此,常见的规避手段——例如从复制文本中删除隐藏字符——无法消除该水印,因为签名直接编织在语言模式本身之中。
水印对修改的抵御能力如何?
检测效果因内容长度而显著不同。OpenAI 使用 token(语言模型解析的词片段)来量化文本,约一个 token 相当于四分之三个标准英语单词。在内部评估中,检测系统对约 150 词的未修改回复的识别率约为 66%。当内容达到约 300 词时,成功率上升至约 92%。
修改内容会迅速削弱水印的有效性。对于 300 词的段落,每 10 个词中用同义词替换 1 个,检测准确率就会从 92% 降至 66%。当每 4 个词中有 1 个被替换时,检测率骤降至仅 17%。OpenAI 的内部研究结果表明,一旦文本经过编辑、压缩或改写,该系统将面临重大挑战——这与公司自己在发布时承认的“当前文本水印技术的重大局限性”相一致。
公司还指出,水印的实现对最新模型 GPT-6 Astra 的性能指标影响极小。
检测工具为何保持非公开状态
OpenAI 选择暂不向公众广泛开放检测工具,而是仅向经审核的研究人员和专业机构提供访问权限。公司澄清,阳性检测结果不会泄露用户身份、输入提示词或对话详情。
阴性结果同样不确定性很高。简短、经过修改或翻译的内容可以在不触发警报的情况下避开检测器。由竞争性 AI 平台生成的内容同样不会触发该系统,因为它只搜索 OpenAI 专有的签名。OpenAI 明确表示,未检测到水印证实内容为人类撰写。
视觉和音频内容遵循单独的验证流程。用户现已可将这些文件类型上传至 OpenAI 的公开验证平台,扫描其 SynthID 水印。文本输出目前尚无等效的公开验证方式,因为检测器的访问仍仅限于经审核的机构。
区域范围与监管背景
对于欧盟以外的地区,ChatGPT 水印对普通用户默认处于关闭状态。不过,全球的 API 客户端可通过其项目或组织偏好为特定模型启用该功能。实际上,该水印在欧盟内的 ChatGPT 输出中是强制性的,而全球的 API 用户可通过设置自愿开启——欧盟用户默认启用,其他地区则需主动选择。
此次部署紧随欧盟自 8 月开始执行的《人工智能法案》透明度条款。OpenAI 将该水印定位为其持续回应监管要求的组成部分。公司还在声明中引用了更广泛的行业数据:TRM Labs 的研究表明,犯罪分子对 AI 工具的利用同比增长了 40%。
OpenAI 尚未披露检测工具是否会以及何时向公众开放。随着推出的推进,该系统在应对真实场景中的编辑、压缩和翻译方面的表现,以及欧盟以外 API 运营者的自愿启用程度,仍是悬而未决的问题。目前,欧盟的实施以及经批准的研究团体和专家机构的受限访问代表了该举措的现有范围。
来源:Blockonomi