8 月起,欧盟用户从 Claude 读到的每段文字,生成那一刻都被悄悄塞进了一枚带密钥的硬币。Anthropic 上线的 SynthID-Text 水印,会在模型挑下一个词之前,根据密钥临时给候选词概率做一次“掷硬币”式的微调;持有密钥者去数一数文本里的统计偏向,就能判定这是不是 AI 写的,普通人肉眼读不出来。
理由很直白:欧盟 AI 法案要求 AI 生成内容可识别,Anthropic 是首批签了同一份 Code of Practice 的厂商,谷歌等其他大厂也在跟进。
硬币藏在哪儿,决定了谁能摸到它。机制是:模型先算出一批候选词,温度、top-k、top-p 过滤完,再用密钥驱动做一次跟上下文挂钩的概率更新,然后采样写出这一个词。密钥捏在谁手里,谁就能做检测。Anthropic 在 FAQ 里强调“不影响输出质量、不增加成本、也追不到具体某个人或某段对话”,这话听上去两全其美,却也把识别 AI 内容的能力集中到了少数密钥持有者手上。
厂商说不影响质量,那是自评,缺少第三方对照;密钥归谁管、监管或第三方在什么条件下能调用检测接口,Anthropic 也没有说死。长文、多语种下统计特征是否依旧稳得住,目前也没有公开数据打包票。
我的判断是:技术上的“无感”未必等于权力上的“无感”。硬币藏得越隐蔽,越要看清它到底押在谁手里。你觉得水印检测权更该留在平台、监管,还是任何拿到密钥的人那里?

