OpenAI 欧盟强制水印:ChatGPT 文本隐形标记详解

OpenAI 为遵守欧盟新规,将在欧盟对 ChatGPT 生成文本添加隐形水印。该技术基于词频调整,虽能辅助识别 AI 内容,但存在被编辑绕过的风险。
OpenAI 欧盟强制水印:ChatGPT 文本隐形标记详解
OpenAI 周一宣布了一项重大举措,为了符合欧盟最新的《人工智能法案》,该公司将在欧盟地区强制为 ChatGPT 和 Codex 生成的文本添加隐形水印。
这一决定源于欧盟 AI 法案中关于透明度规则的要求,该规则已于 8 月 2 日正式生效。法案规定,AI 公司必须以一种其他系统可以识别的方式标记 AI 生成的内容。OpenAI 的这一动作,标志着生成式 AI 在监管合规方面迈出了实质性的一步。
技术原理:看不见的“指纹”
很多人可能误以为水印是文本中显眼的 Logo 或符号,但实际上,OpenAI 的技术方案要隐蔽得多。这种名为“textGrain”的技术,通过微妙地调整模型选择下一个词的倾向来工作。
它不改变文本的语义,只是通过特定的算法(使用秘密密钥对词序进行微调),在成百上千个微小的“推力”中留下一种模式。这种模式人类肉眼无法察觉,但专门的检测器可以轻易捕捉到。这种水印是**“活在词里”**的,因此当你复制粘贴文本时,水印也会随之移动。
部署现状:仅限欧盟,默认关闭
OpenAI 表示,这项水印功能将在未来几周内向所有计划(包括免费和付费用户)的 ChatGPT 和 Codex 用户开放,且仅限欧盟地区。
对于全球的开发者来说,情况有所不同。使用 OpenAI API 的开发者可以在今天(10 月 5 日)开始为特定模型开启此功能,但默认是关闭状态。OpenAI 暂时没有将其设为全球默认,这主要是出于对用户流失的担忧——此前曾有报道指出,OpenAI 曾因担心用户转投未加水印的竞争对手而推迟发布类似技术。
局限性:并非绝对安全
尽管技术先进,但 OpenAI 并未宣称这是“绝对防篡改”的方案。根据 OpenAI 发布的技术报告,这种水印可以被移除。
实验数据显示,如果用户对生成的文本进行编辑,比如用同义词替换掉 10% 的词汇,检测率可能会从约 92% 下降到 66%。此外,短段落、数学答案以及翻译文本也是水印技术的“盲区”,检测难度较大。
OpenAI 也发出了明确警告:“缺失水印并不等于证明了人类作者身份。” 文本可能太短、被过度编辑,或者来自其他公司的 AI 系统。水印只能表明某段文字由 OpenAI 系统生成或处理,但无法衡量其中包含多少人类的创造力或编辑工作。
行业趋势:合规成为新常态
OpenAI 的这一举措并非孤例。两个月前,竞争对手 Anthropic 就已宣布对其 Claude 模型生成的文本进行全球水印。目前,Google、Meta、Microsoft 以及 OpenAI 本身都已承诺遵循欧盟关于 AI 生成内容的实践指南。
对于普通用户和内容创作者而言,这意味着在欧盟地区,AI 生成内容的“身份”将变得更加透明。虽然目前存在被编辑绕过的可能性,但这无疑是 AI 监管走向规范化的重要一步。


本文基于 TechCrunch AI 的公开内容,由 AI 辅助整理改写后发布。
原标题:OpenAI will start watermarking ChatGPT’s text in the EU
阅读原文