OpenAI 在欧洲为 ChatGPT 和 Codex 添加不可见文本水印
OpenAI 于周一宣布,已针对欧盟地区的用户开始对其 AI 系统 ChatGPT 和 Codex 生成的文本进行标注,这是为了遵守于8月2日生效的《欧盟人工智能法案》所规定的透明度要求。
这些规则要求人工智能公司以其他系统可读取的形式标注机器生成的内容,违反第50条的规定将面临高达1500万欧元或全球年营业额3%的罚款。该功能将在未来几周内逐步向所有计划中的符合条件的账户开放,但仅限欧盟范围内。
据TechCrunch报道,从即日起,任何位置的开发者均可通过API为特定模型启用此功能,尽管在客户主动激活之前,该功能将保持未激活状态。
我们正在扩展内容溯源方法,以响应欧盟监管要求,涵盖文本生成内容,同时承认当前文本水印技术存在显著局限性。
我们的工具已帮助验证图片或音频文件是否由我们……
— OpenAI (@OpenAI) 10月5日,2026
textGrain 将水印隐藏在模型的用词选择中
OpenAI 的 textGrain 系统的工作原理是:当 ChatGPT 面临多个同样合适的词语选项时,会对其选择进行轻微引导。在足够长的文本中,这些微小决策会累积形成一种统计模式,肉眼无法察觉,但可通过专用软件检测出来。
由于水印直接嵌入在文字本身中,而非存储在文件元数据里,因此即使文本被复制粘贴到其他位置,水印仍可被检测到。
OpenAI 与宾夕法尼亚大学和耶鲁大学的研究人员共同开发了该系统。其技术论文指出,TextGrain 使用密钥对可能的下一个词进行排序,并微妙地偏向某些选择。当这些选择足够多时,拥有相同密钥的软件可以识别出该模式,从而判断该文本可能由 OpenAI 模型生成或处理过。
OpenAI 表示,该水印不包含任何可识别生成文本用户的信息。该公司还称,在其测试中,启用 textGrain 后并未导致 GPT-6 Astra 的性能出现明显下降。
轻度编辑会显著削弱水印检测效果
OpenAI 也公布了该系统的局限性。在其测试中,仅将 10% 的词汇替换为同义词,就使检测率从约 92% 降至 66%。此外,在短段落、数学答案和翻译文本中,水印更难被检测出来。
鉴于这些局限性,OpenAI 目前将限制其检测工具的使用范围,仅限授权研究人员和专业机构使用。该公司还指出,无法检测到水印并不能证明文本是由人类撰写的。这可能是因为文本过短、经过大量编辑,甚至是由其他公司的模型生成的。
水印可以表明某段文字的部分内容是由 OpenAI 系统生成或处理的,但无法反映其中投入了多少人类判断、编辑或创意。
– OpenAI
Anthropic 选择全球范围的水印策略,而 OpenAI 则先从欧洲开始实施
今年8月,Anthropic 开始在全球范围内对 Claude 的输出内容进行水印标记。起初,这似乎比仅在欧洲实施水印的 OpenAI 政策更为广泛,但背后的原因是技术性的:Anthropic 当时尚未具备限制区域水印的技术系统。
两家公司均已与包括 Google、Meta、Microsoft 和 Mistral 在内的约190家其他组织一道,于今年7月签署了欧盟《关于人工智能生成内容透明度准则》。因此,它们的水印举措是对自8月2日起生效的同一项欧盟透明度要求的响应。
Anthropic 的这一推广计划仍遭到部分用户的批评,他们认为用户提供了想法、指令和判断,而 Claude 主要只是协助写作。
据《华尔街日报》报道,OpenAI 早在多年前就创建了一种文本水印系统,但出于担心用户可能转向不使用水印的其他 AI 系统的顾虑,他们选择不公开该系统。
如果您正在阅读这篇文章,说明您已经领先一步。请继续通过我们的通讯保持关注。










