cd ~

如何以及为什么要分辨 LLM(AI) 污染过的文本

是的,我又来发表关于人工智能的暴论了。

在微信公众号上刷到的文章也好,订阅的博客中的文章也好,你是否在某个瞬间,觉得它们完全同质化了,感到厌烦,毫无阅读兴趣?有一部分人开始用大语言(LLM)模型来「润色」他们的文章。模型就那么点,全球全国却有这么多人,风格几乎统一。如果你也有同样的感觉,那么 你的直觉极其敏锐!

作者怎样基于自己所理解的创作而创作,是作者的自由;读者怎样基于自己所理解的创作而选择,是读者的自由,本篇文章会举一些例子,也许能帮助你辨别疑似非人工撰写的文字。注意,这不是判定文章是否为人工撰写的唯一标准,仅供参考。也算谈谈那些让我不愿意读下去的行文风格。

先从标题说起。举一例子,如果一篇文章的标题是这类格式,应怀疑是非人工撰写的:

  • 《从 AA 到 BB:CC 里的 DD》

  • 《AA 的 BB:一<量词><形容词>的 CC》

这个例子比较直观。一个很让人无奈的事实是,LLM 非常喜欢用冒号副标题,因此副标题可以算作特征之一。其次,名词和概念堆砌非常明显,这点会在下文中继续提及。从这个标题中可以窥见名词堆砌之严重,足足挤上了三四个名词。这并非我一拍脑门写出来的标题,而是在真实运营中的某个网站里找到的,大模型会极力概括文章的内容并套到标题上。如果本文的标题是《从公众号到博客:探寻鉴别 AIGC 里的「门道」》,你还愿意点进来吗?我自己都觉得味冲。

而行文方面的特点,也与标题有些共同之处,可以说是目前大语言模型的局限性或通病之一:热衷于不恰当的比喻与生造抽象词汇,并用引号包裹。例:

  • 滥用比喻与生造概念是人工智能写文章的「通病」。

  • 会议纪要里未被记录的沉默,才是决策真正落地的「承重墙」。

  • 考核指标永远追不上的那部分产出,被管理者称为「溢出价值」,却鲜少被量化。

听起来很高级吧,代价是需要读者自己在大脑里展开这些硬生生捏造出来的定义,而不同的编译器行为又不同,某些情况下,鬼知道会理解成什么意思。

再举例子,估计要开始感到不适了,不过为了帮助理解,例子是必不可少的,请好好忍耐一下吧。接下来是为大众所熟知的短语和副词的滥用,比如「不是……而是……」「极其……」,结合以上的特点,可以写出这样的例子:

  • 推荐算法给你推重复内容, 不是 它笨, 而是 它在用 安全距离 守护你的浏览舒适区。

另一个被滥用的句式是:「当xxx」的假设句。例:

当AI写作不再逐字“蹦词”,而是像水波一样从混沌中浮现思想,我们离真正的智能或许又近了一步。1

虽不敢说有此特征的文章一定是 AI 生成,但也要加以辨别。根据我的经验,人工智能(尤其是豆包)产出的文章所流露出的语气,经常给人一种娓娓道来之感,且反复说车轱辘话、毫无个性,又爱预设对立矛盾:

  • 初衷很好,实施却成现实难题。

  • 福利未落地,政策需贴合民生。

从以上例子中不难看出,大模型喜欢用四至五个字的短句抛砖引粪,而下半句中又转折矛盾。在句式结构上,即便真人带有一定的习惯,也不至于如此重复。大模型惯用这类转折句式:「看似……可 / 但……背后的……不过是……」。由于这东西根本不是人,未经特殊调教,文章的个人风味就不用提了,连个人经历都难以写出半个字,即便写出来了,也缺乏具体的叙述。2

堆砌辞藻也是人工智能的一大通病,在这些概率和数学结果的不可名状之物的眼中,所谓的「美文」,即为堆砌华丽又闪耀的辞藻。在与人生、心灵、成长有关的鸡汤文中,也许因为人类曾经在此主题的文章中的习惯,容易出现以下风格的词汇:

  • 晨雾、溪水、虚无、朝露、晨昏、璀璨

  • 奋斗、青春、韶华、时光、白天、黑夜、星光

  • 岁月静好、人间皆温柔

恕我直言,这样的笔法如同小学生的作文。这些大模型试图模仿人类的描写或比喻,而又没有感官上的体验,就只能从语料中挑选些或抽象或通俗的词汇铺设,僵硬不堪,毫无真实感,又笨拙地努力营造真实感。不可名状的随机黑盒,何谈体验与感悟?

人类撰写的文章通常带有个人偏执,不追求完全客观、面面俱到,也不一定追求结尾升华强行拔高。之所以我对这类文章有如此负面的印象,在于过度的模板化、同质化。

公众号为追求内容产出速度与流量,或文字工作者为了应付上级无理取闹的需求而使用 AI 就没有什么可说的。个人博客这四个字当中,人字排第二个。看到这么多 AI 生成内容,我想请问:人呢?

有一些地方给我一种诡异的感觉,作者用人工智能生成(或「润色」)内容,读者在评论区有名有姓地挂上自己的网站链接提交经手人工智能的评论,作者再用同样的手法回复。大家都沉浸在这一美其名曰「互动」的行为中,乐此不疲。

日本机器人专家森政弘于 1970 年提出了著名的恐怖谷理论(Uncanny Valley;不気味の谷現象),他的假设指出,由于机器人与人类在外表、动作上相似,所以人类亦会对机器人产生正面的情感;直到一个特定程度,他们的反应便会突然变得极为负面。哪怕机器人与人类只有一点点的差别,都会显得非常显眼刺眼,显得非常僵硬恐怖,使人有面对僵尸的感觉。可是,死机器人和人类的相似度继续上升,相当于普通人之间的相似度的时候,人类对他们的情感反应会再度回到正面,产生人类与人类之间的移情作用。3

(图摘自维基百科)

说人话即为,似人非人的样子导致恐怖诡异感飙升。我举双手赞同森政弘的理论,并认为这一现象在文字中也有所体现。即没有真诚的情感,也没有真实的情绪,甚至没有真正的人,这就是不适感的来源。

使用人工智能生成文章,无疑不尊重读者,又在思维和行动上懒惰。如上文所述,作者怎样基于自己所理解的创作而创作,是作者的自由;读者怎样基于自己所理解的创作而选择,是读者的自由。作者已经不再付出真实的努力写作,读者又有什么必要在这些内容上花费时间呢?

阅读个人博客,其乐趣在于了解人,以及了解人的故事。阅读最美妙的体验莫过于能感受到每个人不同的看法。没有人味的文章却在大谈人生,没有情感的内容竟在教人们走出困境,充斥着对人类最珍贵且独一无二的情绪的拙劣模仿。如果长期使用人工智能的深度思考来代替自己大脑的思考的话,请努力让脑子转起来想想,这是否诡异又讽刺呢?

允许我做出大胆又阴暗的揣测,在 AI 瘾君子们的眼里,经营网站与互动的乐趣要大于写作本身的乐趣,因此又投入经历建设某些社交工程,但实际上并没有什么东西想写,更享受「拥有一个网站」的乐趣。

互联网上充斥着到处传播 AI 生成内容的人,俗话说:富不过三代。但烂可不一定。且不说用这些被污染过的垃圾数据训练模型,如果用这些垃圾数据组织回复,到时候有人再把这些内容发到自己的网站上,饶了本来就行将就木的互联网吧!

如果你读到了这里,感觉自己被冒犯了、被攻击了,那么恭喜你,对号入座了。如果希望改变现状,可以读下去,在此基于我个人经验,给出一些小小的建议。互联网需要你独特的视角和声音。

零、保持愤怒。

愤怒通常是我个人写作的动力来源,看什么不爽,当然要开始抨击。用四个字来讲:有感而发。这是比愤怒更通用的形容。如果暂时没有什么想写的,不更新也没关系,毕竟没有 KPI 指标。也许有人适合或已经通过刻意地练习获得了不错的写作能力,但属于非常有毅力的少数人。除去技术写作与学术写作以外,有感而发、有话可说的写作更快乐。

一、保持简单。

俗话又说,步子迈大了容易扯着蛋。即使用自己的母语写作,在最开始也是使用简单的句型和词汇为妙,减少堆砌甚至生造辞藻,否则容易显得力度过猛,在情感类散文中尤为明显。我已经想起我那些成吨的公开未公开的黑历史了。这可是血泪的教训……我给我自己的要求是:说人话就好。

二、请停止让 AI 污染文本。

没有任何一个人天生就掌握写作能力,懒惰永远是进步最大的阻碍,多加阅读与练习,进步将肉眼可见。使用人工智能污染文本,本身就是一种懒惰的体现,懒于思考、懒于动手修改。那可是自己的文章,就像自己的孩子一样!

三、提升文字品味。

既然提到了多加阅读,就不得不提一下文字品味。尝试运用本文所提出的 AI 废话特征来辨别自己的阅读材料吧,找到优秀的作者,抛弃 AI 生成的文章,学习其写作手法和用词,学习就是模仿,模仿就是学习。

四、没有第四条建议。

最后,没有结尾的点明中心、升华主旨、深化主题、呼应标题和开头。


  1. 很讽刺的事。这个句子来源于知乎问题:「如何分辨ai写的文章?」的回答:https://www.zhihu.com/question/594485288/answer/2060016246117213365 ↩︎

  2. 我实在很想在这段中举出更为具体的例子,但我能力有限,也是照着答案出题,描述文本特征。如果举真实存在的例子,怕是针对性过强,有引导鼓动做什么的嫌疑了。 ↩︎

  3. https://zh.wikipedia.org/zh-cn/%E6%81%90%E6%80%96%E8%B0%B7%E7%90%86%E8%AE%BA ↩︎