OpenAI 将在欧盟为 ChatGPT 和 Codex 生成的文本添加水印,这是《人工智能法案》透明度要求落地后,头部模型厂商首次在文本模态上做出系统性合规动作。

发生了什么

据 TechCrunch 报道,OpenAI 计划在欧盟地区为 ChatGPT 及 Codex 输出的文本嵌入水印,以符合欧盟《人工智能法案》对 AI 生成内容透明度的要求。水印以不可见方式存在,旨在帮助识别文本是否由 AI 生成。OpenAI 同时指出,用户对文本进行编辑后,这些隐形标记会变得更难被检测到。

为什么重要

欧盟《人工智能法案》按风险分级监管,其中透明度义务要求生成式 AI 的输出必须能被识别为 AI 生成。对文本模态而言,这比图片、音频更难:图像和音频水印已有相对成熟的行业方案,而文本水印需要在 token 采样阶段介入,且任何改写、翻译、摘要都可能破坏标记。

OpenAI 选择在欧盟先行,而非全球统一,说明合规成本与检测可靠性仍是现实约束。水印不是防伪,它更像一种“溯源提示”:在理想情况下,平台和检测工具能读出标记;在文本被复制、润色、跨模型改写后,标记大概率失效。这也意味着,水印能覆盖的是“原样传播”的场景,而非恶意规避的场景。

对行业而言,这是继 C2PA 内容凭证、AI 生成图片元数据之后,监管压力向文本模态延伸的明确信号。其他在欧盟运营的模型厂商——包括 Google、Anthropic、Meta 以及多家开源模型提供方——将面临同样的合规路径选择:是嵌入水印、提供检测 API,还是以其他方式满足透明度要求。

影响与看点

对开发者,最直接的问题是水印是否会影响下游任务。如果标记嵌入在 token 分布中,理论上不改变文本可读性,但可能对微调、蒸馏、代码补全等场景产生细微影响,目前公开信息不足以判断。对使用 API 构建产品的团队,需要关注 OpenAI 是否会在响应中提供检测接口或元数据字段。

对普通用户,水印不可见,日常使用体验基本不变,但“AI 生成内容可被识别”会逐渐成为默认预期。真正的看点在于检测端:谁来读水印、以什么标准判定、误报率如何控制。如果只有 OpenAI 自己能检测,透明度义务的实际效果会打折扣。

一个独立判断:文本水印的技术天花板不高,它的价值不在于“抓住”规避者,而在于为合规提供一个可审计的基线。欧盟开了这个头,全球其他市场的监管大概率会跟进,但落地节奏和检测标准仍会长期拉扯。