OpenAI 推 textGrain 隐形水印 应对欧盟 AI 法案
OpenAI 宣布,为配合欧盟《人工智能法案》的内容透明要求,将在未来几周为欧盟地区符合条件的 ChatGPT 与 Codex 文本输出加入机器可识别的隐形水印。该技术名为 textGrain(文本粒水印),会在模型生成文字的选词过程中嵌入一层人类不可见的统计信号,专门的检测器可据此判断一段文本是否由 OpenAI 模型生成。

根据 OpenAI 10 月 5 日发布的说明,全球 API 客户自即日起可以为部分选定模型选择开启水印输出,默认关闭;欧盟地区符合条件的 ChatGPT 与 Codex 文本则会在数周内自动加上这一标记。公司称,在理想条件下 textGrain 的表现“达到或超过”包括文本版 SynthID 在内的其他方案。OpenAI 还计划将相关技术开源,并仅向“经批准的研究人员和专家组织”开放检测器,以避免被轻易破解。
不过 OpenAI 自己也坦承局限:文本越短、检测越难,约 200 词段落检出率仅约 80%,400 词约 95%;数学类内容的检出率明显更低。对文本做编辑也会削弱信号——替换约 10% 同义词后检出率从约 92% 降至 66%,替换 25% 则只剩 17%。官方强调,水印既不能识别用户身份,也不能验证内容真伪,未检出水印更不代表文本出自人类。

对输出质量的影响方面,OpenAI 在前沿模型的多项基准测试中未见明显差异,例如一项测试开启水印前后成绩分别为 94.44% 与 93.94%。这意味着普通用户在日常使用中基本察觉不到变化。对开发者和企业而言,这相当于多了一个“机器可验证的来源”开关:开启后可为客户提供更强的透明度合规能力。
这一动作的法律背景是欧盟《人工智能法案》第 50 条,该条款要求生成式 AI 系统的文本输出必须可被机器识别。新规对刚进场的企业立即生效,而对 OpenAI、Anthropic 等存量玩家,合规截止日为今年 12 月 2 日。Anthropic 今年早些时候已采取类似举措,微软、谷歌、Meta 等也在需遵守之列。OpenAI 此次跟进,意味着头部厂商在欧盟合规这条线上开始对齐。
读者评论 (1)
想参与讨论?请 登录 后发表评论。
替换10%的同义词检出率就掉到66%,这水印基本等于摆设。