一个字证明你不是 AI
大模型时代下的人机验证
“如果用一个字证明你不是 AI,你会选哪一个?”“爆火全网”的语文课,靠一个命题打动了网友,打动了央视网新华网,也打动了武汉外国语学校高二语文组。54 份回信,写下了 54 首令人潸然泪下的小诗,用定义的游戏想象着人与 AI 的不同。不知道上下文为何物的人们评论着 AI 的记忆,不了解深度学习的人们指点着 AI 的训练,不懂 Transformer 原理的人们意会着 AI 的情感,没听说过图灵测试的人们研究如何用一个字证明自己不是 AI……但当我们抛开文科生的矫情与傲慢,现实中,我们究竟该如何分辨 AI 生成的文本?
现状

自 2017 年《Attention Is All You Need》横空出世,到 2018 年预训练模型的首次亮相,到后来竞品的不断出现和成本的降低,再到如今生态百花齐放和多模态的兴起,现代意义上的 AI(大型语言模型 LLM)已经在社会生活和商业活动中占有重要地位。当单次广告点击收入已经超过生成一篇文章所需 token 成本,AI 生成的文章在互联网上的泛滥便已是必然。在信息密度尤其低下的中文互联网,百度上随意搜索技术文章,来自 CSDN 等低质内容平台的 AI 灌水文便喷涌而出。由于 AI 生成的文本质量问题和 AI 幻觉挥之不去的阴影,正确辨别 AI 文本成了每个人的必修课。
句式判断
AI 采用一个特定的模型,默认情况下使用相同的提示词,因此 AI 倾向于在回答中采用一种较为固定的语言风格。由于训练时大量使用维基百科等网页文本和各类技术文档作为语料,AI 的回答通常具有中性的语气、较为固化的句式和大量的分点、条列,呈现强烈的“AI 味”。对于未经处理的 AI 文本,经常使用 AI 的人能够轻易地识别这些特征。
词汇统计
Transformer 的核心逻辑是判断“下一个 token 的概率”,因而在语料中高频出现的词语也会在 AI 文本中泛滥。如上文所述,AI 使用的语料大多为书面、正式的文本,其中大量使用关联词来使全文逻辑清晰。在人类反馈强化学习中,包含丰富关联词的输出也会因为符合“智能助手”的要求而得到青睐。如此一来,通过统计这些关联词以及其他 AI 常用词汇的出现频率,能够初步判断文本由 AI 生成的可能。
用 AI 击败 AI
随着 AI 的发展,检测 AI 的软件也用上了 AI 技术。通过利用大量 AI 生成的和真人书写文本进行训练,人们期望得到能够分辨 AI 文本的方法。然而,尽管经过了大量的训练,结果仍然不尽人意,并且很容易被绕过。研究显示,绝大部分软件的检测准确率都达不到 80%,并存在大量误判人类创作作品的情况。
绕过措施
由于文字本身不存在区别,所有 AI 检查都基于文本的语言特征。最初人们通过人工改写的方式降低 AI 嫌疑。通过重新排列句子、替换同义词等方式,AI 的痕迹很容易被抹除。研究人员甚至发明了“同形词替换攻击”,将部分字母替换为字形几乎一模一样的其他字符来破坏模型的分词,从而规避检测。随着技术的发展,已经出现了专门用来消除 AI 痕迹的 AI 模型,能够令 AI 检测准确率从 70% 下降至 4.6%,使得 AI 去痕实现了完全自动化。
排异…或是接纳?
时代日新月异,AI 检测和反检测的博弈一步步升级。AI 的设计原理就是模仿人类的语言方式,因此想在生成的文本上识别 AI 的痕迹,本身就是一种与技术发展的对抗。我们似乎踏入了历史早已上演过无数次的又一个循环。犯罪与治安的你逃我追、审查与隐私的军备竞赛、漏洞与法治的层层迭代,世界仿佛就是这样,在协同进化中永恒地碰撞。但这一场战争,似乎真的有尽头。
当人们反对 AI 造物的时候,究竟是因为质量上的缺陷,还是本能地维持一种先来者的优越?当人们纯凭空想断定 AI 的感性和理性的时候,到底有多少人理解了它们的运行逻辑?新兴生产方式被无脑地质疑,是历史的必然。然而随着时间的推移,决定技术走向的话语权终将落回真正了解技术的人手中。随着大模型的不断更新换代和底层架构的升级,AI 生成的文本将与真人所写差别越来越小,到了 AI 真正能够完全模仿人类的那天,所有的检测技术将全部失效。但与此同时,我们又凭什么仅仅因为“AI 生成”的标签拒绝这些在质量上丝毫不落下风的字句呢?
人工智能是未来的趋势,差异不应成为排异的借口。取代人类工作岗位的理由不能解释蒸汽机的应用,计算产生的文本不应被人类定义的“情感”排挤,训练材料侵犯知识产权的指责更是无稽之谈。只有当社会消除了无根据的成见,当政府看清了长远的利弊,资本为社会责任放下了短期的小利,AI,以及更多新兴的技术,才能得到健康的土壤,自由地盛放,结出人类进步的果实。
但对于当下而言,由于 AI 发展程度的有限,识别 AI 文本仍然是个人必要的能力。考虑到目前的检测措施都鲜有成效,个人能做的可能仅仅是选择权威的信息来源,排除拙劣的 AI 灌水文,以及积极地多方求证。至于“AI 检测”,恐怕只有唯一真神能够过过招了:

那么,这篇文章是 AI 生成的吗?😏