众力资讯网

研究扒出AI写作13000个语言马脚:越是训练掉标记,新措辞越补位——AI越"洗

研究扒出AI写作13000个语言马脚:越是训练掉标记,新措辞越补位——AI越"洗",反而越容易被认出来?
又一项研究给AI写作"拆台"了。
据最新发表的研究,科研人员从大量AI生成文本中扒出了约13000个语言层面的"马脚"——也就是AI在遣词造句时反复出现的规律性特征。更耐人寻味的是,研究还发现一个悖论式现象:模型越是训练着"去掉AI标记",就越会用新的措辞去补位,而这些新措辞本身,又成了新一轮的识别线索。
说白了就是:AI想"洗掉"自己的机器味儿,结果换个姿势还是露馅。
这13000个马脚具体指什么?
研究者关注的不是内容真假,而是语言"指纹"——比如某些过渡词的过度使用、句式结构的高度规整、罕见的标点偏好、用词分布的统计学偏移等等。这些特征在人类写作里高度随机,但在AI输出里却呈现明显的聚集性。
为什么"补位"反而更糟?
因为每一次针对检测器的对抗训练,AI都会发展出新的、可被统计捕捉的语言习惯。就像猫鼠游戏:堵住一个漏洞,新漏洞又以更隐蔽的方式暴露。
这对普通人意味着什么?
一方面,AI检测工具的精度正在快速提升,"一键生成 + 一键洗稿"的套路越来越难蒙混过关;
另一方面,也提醒我们:真正的内容价值,终究来自人的真实思考,而非措辞的精巧包装。
你平时能一眼看出哪些内容是AI写的吗?欢迎留言聊聊你见过的"AI味儿"👇