夜雨聆风学习资料网

ARTICLE · 1125888

AI生成的文章,读起来让人生理不适

AI生成的文章,读起来让人生理不适

我的公众号和小红书首页,每天都会随机推一些不认识的作者。

碰到感兴趣的题目,我一般会点进去看看。碰上写得好的,就点赞关注。

但有一类文章,只要发现我必然退出来,然后手动点"减少推荐此类内容"——AI 代写的。

这事儿我做得非常决绝。倒不是说 AI 写的东西一定差,而是我知道自己接下来读的每一句话,都不是人说的。既然如此,我为什么不直接自己去问模型呢?我每周token limit只用到20%,我差那点token吗?

—————————

有意思的地方在于,我判断中文 AI 味的速度,非常快。快到什么程度?有时候只需要一个词,一句话。那种感觉很难描述,硬要说,就是一种语感,不妨称之为AI语感。

但英文我就完全不行。承认这点让我挺羞耻——要说我也是每天工作都在用英文,读邮件、读规范、读报告,量不算小。可是拿一段英文放我面前,问我这是不是 AI 写的,我拿不准。不光是别人的英文,就连我自己让 AI 生成的英文,事后再看,我也只能说——比小懒獭那个英语二把刀写得好多了,大概率是AI。

(咱们的作者小懒獭,英语是个二把刀)

为什么捏?出于好奇,去查了查资料。

—————————

先说一个让我心里好受点的结论:非母语者识别 AI 英文的能力,很差。

有一项针对德国高校六十多位讲师的实验,人和检测器的正确率都只比随机猜高一点点,其中写得比较专业的 AI 文本最难认,能正确分类的受访者不到两成。

看到没,我作为华人固然不行,人家德国人英语也一般(叉腰)。

但有一个例外群体。另一项研究里,很少用 AI 的标注者判断力接近随机,而几位天天用 AI 做写作类工作的标注者,投票结果在三百篇文章里只错了一篇——比几乎所有商用检测器都准。

看到这儿我大概明白了。认出 AI 靠的不是"这像 AI",而是"这不像人"。你脑子里得先有一个足够密的"真人写作"参照系,才能感觉到偏差。中文上我几十年阅读量、加上自己天天跟 AI 打交道,语感够了。英文上差很多。

而且英文的 AI ,本身就写得更像人——中文语料在训练数据里占比很低,所以模型写中文更依赖那几个高频模板,总分总、排比三段、公众号腔,容易露馅。英文数据多,输出的花样自然多一些。

还有一条我看完非常憋屈的:非母语者写的英文,本身就长得像 AI。

斯坦福那项研究测了几个检测器,托福作文里被所有检测器一致判成 AI 的接近两成,而美国本土学生的作文几乎不会误判。原因是这些作文的用词和句式太可预测。检测器实际上是在惩罚"表达方式有限"的人(啊啊啊!扎心了各位留学生老铁)。

也就是说,我认认真真、一个语法错误都不敢有地写出来的英文,反而最像机器。

—————————

顺着这个,我心里冒出一个很实际的担忧——

我平时会让 AI 帮我 proofread 英文邮件。那receive的那位母语者,是不是其实早就看出来了?

我担心得有理。

举个自己的例子。我虽然不是母语者,但我会学习啊。比如我洋人同事,他经常邮件说什么 we will hold our fire on that, 这其实是个军事术语,用在这里意思就是我们先暂停这个项目,直到进一步通知。

人家问他今天咋样?他会说not bad, 没听清的时候,他很自然说say again. 

就这种很日常的话,我也有样学样,但是ai倾向于不用——除非你特别要求他写得casual一点。

比如我跟他学的,写邮件也会来一句 "Can we hold fire on the shop drawings till Thursday?"

AI 一改,就成了 "Could we please postpone the shop drawings until Thursday?"

语法上确实"更挑不出毛病"了,但没了个人特点。

同事不会拿检测器扫我的邮件。他们是拿我平时的样子比较。他们知道我写邮件什么德行。突然有一天收到一封段落工整、每句话都完整、一个缩写都没有的邮件,那个落差是会被察觉的,哪怕对方说不上来哪儿不对。

所以你的英文越有个人风格,AI 润色越容易被看出来。 因为对比度更高。

反过来,一个英文本来就四平八稳的人,润色完只会让人觉得他今天写得挺认真。

我大概属于前一种。这些年我英文水平没什么长进,但从洋人同事那儿偷学的那点东西——随手的省略,keen、sweet as——恰恰是 AI 最不爱用的。

AI 被训练成明确、正面、无歧义的样子。你问它今天怎么样,它写 "going well",不会写 "not bad"。你没听清,它写 "Could you please repeat that?",不会写 "say again"。

我的那点松弛感,一次润色就没了。

—————————

说回开头那个"减少推荐"。

我不是反对创作者用 AI——现在要求一个写东西的人完全不碰 AI,既不合理也不现实。查资料、理逻辑、找角度、甚至先出个草稿再改——这些我都完全能接受。

我不能接受的只有一种:原封不动扔出来。

就是那种从头到尾没有一个人过过一遍的东西。开头是标准开头,中间是标准展开,结尾必然要升华一下,告诉你这件事说到底其实是关于什么什么的。

我要求的,也无非是一个人坐在那儿,把不像人说的话一句句改掉。

这一步之所以不能省,是因为读者点进一篇文章,花的是自己的时间。他愿意花,是因为他想看看另一个人是怎么想这件事的。

如果对面根本不是人,那我就觉得没有被尊重。

相关学习资料