OpenAI 宣布,将在欧盟境内为 ChatGPT 和 Codex 生成的文本加入不可见水印,以回应欧盟《人工智能法案》的透明度要求。这项功能未来数周内会覆盖欧盟所有订阅档位用户,全球 API 开发者即日起也可主动开启,但默认不会在全球范围启用。
这套水印技术叫 textGrain,由 OpenAI 联合宾夕法尼亚大学、耶鲁大学研究人员共同开发。它不在文字里塞隐藏字符或特殊符号,而是在模型选词时微调概率分布,让整段文本形成一种人眼看不见、检测器却能识别的统计模式。水印随文本本身走,复制粘贴也不会丢失。官方称开启后模型性能没有明显下降。
但 OpenAI 把局限摊得很清楚:200 词文本检出率约 80%,400 词约 95%;替换 10% 同义词后检出率从 92% 掉到 66%,替换 25% 只剩 17%;短文本、数学解答和翻译内容更难识别。检测器初期只向获批的研究机构开放,普通人拿不到。
更关键的是边界:检测到水印只能说明 OpenAI 的模型参与过生成,无法判定用户身份、版权归属或人类贡献占比;没检测到也不等于人类原创。
在 Anthropic 两个月前已全球推行 Claude 水印的背景下,OpenAI 这次只限欧盟、全球默认关闭,态度很明确——监管够得着的地方合规,够不着的地方不替用户做主。水印技术本身还远不成熟,但 AI 内容溯源这件事,已经没法再拖了。OpenAI将添加隐形水印
