OpenAI推出textGrain文本水印,响应欧盟AI法案为ChatGPT生成内容溯源
10月5日,OpenAI发布名为textGrain的隐形文本水印方案,以履行欧盟《人工智能法案》的透明度义务。按照时间表,未来数周内欧盟境内所有订阅档位的ChatGPT与Codex用户将默认启用水印;面向全球,使用OpenAI API的开发者即日起可为特定模型开启水印,默认状态下保持关闭。

textGrain并非在文本中插入可见符号,而是通过微调模型的用词分布,在文字内部形成一种读者无法察觉、检测器却能识别的统计模式。当多个词同样合适时,一个密钥决定最终选用哪一个;在足够长的段落中,这种偏好会累积成可被密钥识别的信号。由于水印内嵌于文字本身,文本在被复制粘贴时同样会随之转移。OpenAI联合宾夕法尼亚大学与耶鲁大学研究人员发布技术报告,称水印不识别用户身份,且启用后模型性能未出现显著变化。
OpenAI公布的测试显示,在1%误报率下,检测器可识别约80%的200词片段与约95%的400词片段;但将约10%的词语替换为同义词后,检测率从约92%降至66%,替换25%则降至17%。短文本、数学解答与翻译文本的识别难度更高。基于这些限制,公司仅向经审核的研究人员和专家组织开放检测器初步访问权限。OpenAI明确提醒:缺乏水印并不能证明文本由人类创作。
直接动因是欧盟《人工智能法案》第50条透明度条款于8月2日生效,要求生成式AI以机器可识别方式标记产出。在OpenAI之前,Anthropic已于8月2日起对Claude文本在全球范围添加水印,谷歌的SynthID-Text自2024年起用于Gemini,xAI则拒绝签署欧盟透明准则。各厂商对同一条款给出不同解读:Anthropic选择全球默认开启,OpenAI则仅在欧盟默认开启、API侧保持可选。

对开发者而言,textGrain是一个可自主开关的合规旋钮:服务欧盟用户的产品可借此满足Article 50的标记义务。但水印也引发公平性质疑——以第二语言借助AI润色文字的用户可能被误标。长远看,随着更多前沿实验室在监管压力下推出可检测文本方案,机器可识别的AI内容溯源或逐步成为行业基线,但其可靠性仍高度依赖文本长度与是否被编辑。
读者评论 (1)
想参与讨论?请 登录 后发表评论。
水印再隐形也挡不住人改两个词,这玩意儿现在更多是给监管交作业,真正防住AI造假还得靠人眼。