夜雨聆风学习资料网

ARTICLE · 1069512

天天用AI,脑子真的会退化吗?

天天用AI,脑子真的会退化吗?

现在碰到不懂的东西,我的第一反应是问AI。查论文靠它,想找某一篇具体的文献也靠它,有些想不明白的问题,也会跟它聊一聊。偶尔还让它帮我写个小程序、画张图。

网上也有另一种说法,AI用多了,人会变懒,脑子会退化。去年MIT有一项研究传得很广,标题就叫《Your Brain on ChatGPT》[2]。

我本来就离不开闹钟和备忘录

从有脑雾开始,我就陆陆续续在用各种外部工具。清单、备忘录、闹钟、便签都在用,电脑上还装了一个桌面版日历,可以写清单、记备忘。桌面日历是好几年前装的,具体哪一年已经不记得了。

怕忘的事都会写进备忘。闹钟每天至少五六个,提醒的都是各种待办,比如十二点吃补剂,下午三点提交报表,四点去税务局等等。有些事情没有闹钟,忘记做的概率非常大。

AI出现之前,我已经这样很多年了。

心理学里有个说法,叫认知卸载,指的就是把本来要靠脑子完成的事,交给外部的东西去做。设闹钟、写备忘、在门口放一样东西提醒自己出门要带,都算。

靠提醒记事,效果怎么样?

2022年,伦敦大学学院的Sam Gilbert团队发表了一篇综述[1],专门讲「意图卸载」,也就是把「待会儿要做什么」交给外部提醒。

他们用的实验任务大致是这样的:屏幕上有一串编了号的圆圈,按顺序拖到底部。中间会插进一些特殊指令,比如「3号拖到顶上去」,要记住,等轮到那个圆圈时照做。受试者可以只靠脑子记,也可以一开始就把那个圆圈挪到目标位置旁边,给自己留个提醒。

在他们设计得比较难的版本里,只依靠脑子记的,正确率一般在50%到60%;允许设提醒的,正确率一般在90%到100%。

综述里还引了一项2022年的研究,我觉得跟脑雾的人关系更大。不许设提醒的时候,一个人任务做得好不好,跟他的工作记忆能力有关。一旦允许设提醒,这种关联就没有了。

这篇综述还发现,一个人设不设提醒,很大程度上取决于他对自己记忆有多少信心。信心不足的人设得多,而且这跟他的实际记忆好不好关系不大。

作者也提醒了一个风险。重要的事都交给外部,外部一旦出问题,脑子里剩下的可能只是那些不重要的。

不过这些大多是实验室任务,作者自己也说,实验室里测到的卸载策略,跟人们在日常生活里怎么用提醒,中间还有距离。

至少在「记住待会儿要做什么」这件事上,用提醒是有效的。

让AI把事情做完,我还记得多少?

闹钟只管提醒我三点要交报表,报表还是我自己做。但PPT不一样了。2024年4月我开始研究脑雾,在那之前,脑雾一直比较重,那段时间工作上经常要做PPT,如果没有AI协助,我根本做不完,也做不好,而AI做出来的效果,让我很惊艳。

当时做过很多PPT,都是工作需要。但现在已经不记得具体做过什么了。我说不清这跟用了AI有没有关系。如果当时是我自己一页一页做的,现在会不会记得多一些,我也不知道。

开头说的MIT那项研究测的,正好就是类似的问题。

研究者找了54个人,年龄在18到39岁之间,都来自波士顿地区的5所大学,分成三组写作文。一组只能用ChatGPT,一组可以用搜索引擎但不能用AI,一组什么工具都不用。每个人写三轮,写的时候戴着脑电帽。

第一轮写完,研究者请每个人说出自己文章里的一句话。用ChatGPT的那组,18个人里有15个说不出来,能准确引用的一个都没有。另外两组,各只有2个人说不出来。

到第三轮,用ChatGPT的那组情况好了一些,18个人里有13个表示能引用。论文原文的说法是,这个问题一直存在,但有所减轻。

脑电的结果也是类似的情况。写作文的过程中,用ChatGPT的那组脑区之间的功能连接整体比另外两组弱。这测的是写作那段时间里的脑电活动,不是大脑结构。

但这项研究实际发现的东西,没有标题说得那么夸张。我读到的还是预印本,标着「审稿中」,前三轮54个人,第四轮是自愿参加的,来了18个,任务只有写作文,工具也只用了ChatGPT,这些作者自己在局限里都写了。

在这项写作任务里,用ChatGPT的人确实更难准确引用自己刚写完的文章。至于用AI会不会让人变笨,它回答不了,长期用下去会怎样,它也没有测。

撤掉AI以后,还会做吗?

2025年PNAS上有一项随机试验[3],讨论的就是这个问题。研究是在土耳其的一所高中做的,近一千名学生按班级随机分组,上了四次数学复习课,每次90分钟。每节课结束后学生都要参加一次闭卷考试,考的题跟课上的练习题一一对应。

三组学生的区别主要在于练习时使用的工具。一组只用课本和笔记,一组使用普通的GPT-4聊天窗口,和ChatGPT差不多。第三组使用的也是GPT-4,但研究者提前输入了老师准备的正确解法和学生常犯的错误,让它只给提示,不直接给答案。

练习时,AI确实把成绩拉上去了,普通GPT-4组比对照组高48%,只给提示的那组高127%。可一到闭卷考试,普通GPT-4组反而比对照组低了17%。只给提示的那组,跟对照组没有统计学差异。

研究者查看了学生发给AI的消息,发现普通GPT-4组里最常见的做法,就是直接要答案。他们也分析了这组学生为什么考得较差:是AI给的答案有错、把学生带偏了,还是学生拿到了答案自己没弄懂,数据更支持后一种解释。

学生自己却没有察觉到这种差别。普通GPT-4组考得更差,却不觉得自己学得更少;只给提示的那组没有考得更好,却觉得自己考得明显更好。

这项研究针对的是高中生学数学,不能直接套用到成年人的工作上。不过,同样使用GPT-4,直接给答案和只给提示,等到不能再用AI时结果确实不一样。

直接要答案和先自己想,有什么不同?

今年,《Frontiers in Psychology》发表了一项研究[4],调查了589名中国大学生和刚工作不久的年轻人,平均年龄23.7岁。研究中提到的AI工具,包括文心一言、Kimi和豆包。研究者区分了两种使用AI的方式。一种是让AI直接给出完整答案,拿来就用,叫依赖型卸载;另一种是把AI的建议当成思考的起点,再跟自己的想法对照,叫自主型卸载。

问卷隔两周一次,做了三次。更多采用依赖型用法的人,后来更常说自己「越来越依靠AI来决定哪些信息重要」,做事的兴趣也更低;更多采用自主型用法的人,则表示兴趣更高,对自己能力的评价也更好。两种用法都与「省时、省力」的感受有关,关联程度也差不多。但这种当下的感受,与两周后测量的能力自我评价几乎没有关联。

这些结果都来自参与者自己的问卷回答,研究没有直接测量他们的实际能力。论文作者也指出,这些结果只能说明相关性,无法证明AI让人的能力变差或变好。

写小程序的时候,这两种分法就不太好套了。我看不懂代码,只能看它做出来的东西。不满意的地方,就用自然语言告诉它,让它继续改。最近在做一个脑雾状态自测的小工具,还在测试。我一个不懂代码的人,以前有了想法也只能想想。现在借助AI,居然能自己做出一个小工具,还挺奇妙的。代码全是AI写的,但做出来的东西是不是我想要的,哪里还需要改,还是得由我自己判断。

AI给的东西,能直接信吗?

AI给出的文献和结论,有时候会对不上,这种情况我也遇到过很多次。所以现在查医学资料时,我通常会用几个模型互相核对。比如把GPT给的答案拿去问Claude,或者反过来,看看它们的说法是否一致。

写这篇之前,我查了一些最近发表的研究。其中有一项长新冠的研究,AI告诉我,两家媒体报道这项研究时,写的期刊名称不一样,ScienceDaily写的是eBioMedicine,Fortune写的是eLife Medicine。

我本来打算拿这个当例子,说明AI能帮我查出媒体报道里的错误。

后来问它能不能这么用的时候,它重新查了一遍Fortune的原网页,发现全文根本没有出现eLife这个词。文章里「study」这个词,直接链接到了eBioMedicine的那篇论文。两家媒体说的其实是同一本期刊,根本没有矛盾。

还好又核对了一遍,不然差点把它编的东西也写进文章里。

问题出在AI抓取网页后的内容总结环节。负责总结网页的模型,把不存在的期刊名称编了出来。而且,这次发现错误,靠的还是重新核对原网页。

Frontiers那项研究里还有一个发现。有些人在使用AI时,会主动问自己:我是真的理解了,还是只接受了AI给出的答案?

研究发现,在更经常这样检查自己理解程度的人群中,依赖型卸载与「依靠AI判断哪些信息重要」之间的关联更弱。但在内在兴趣这一项上,没有看到类似的作用。

哪些事交给AI,哪些留给自己?

我没找到专门研究脑雾人群使用AI的试验。上面这几项研究,研究对象是大学生和高中生,任务是写作文、做数学题、填问卷,跟有脑雾的人平时怎么生活、怎么用AI,不是一回事。下面只是我看完这些研究以后,对自己怎么用AI的一些想法,不是研究结论。

吃补剂、交报表、去税务局这类事,我要的只是按时办完,闹钟和日历还会继续用。几项研究里,支持用提醒的证据也是最直接的。

问AI之前先自己想一下,这个习惯是我最近才慢慢养成的。看完那项数学试验,我觉得它值得坚持。有AI帮忙时能把题做出来,不代表没有AI时,自己也能做出来。不过,应该先想多久、怎么问更合适,那项研究没有给出答案。

核对AI给的信息,我平时会换一个模型再问一遍。但期刊名那次,还是回到原网页,才发现所谓的矛盾是AI编出来的。光靠换模型,未必能查出来。

清单、闹钟、日历,我已经用了很多年。现在有了AI,很多以前做不了的事,也能试着做了。

至于原来自己会做的事,以后如果都交给AI,时间久了会怎么样,我不知道。至少现在,我会留意自己有没有真的弄懂它给出的答案,也会尽量回到原始资料核对。

本文为个人查阅文献的记录和理解,不构成医学诊断或治疗建议。


参考资料[1] Gilbert 等,Psychonomic Bulletin & Review,2022。https://pmc.ncbi.nlm.nih.gov/articles/PMC9971128/[2] Kosmyna 等,arXiv 预印本,2025。https://arxiv.org/abs/2506.08872[3] Bastani 等,PNAS,2025。https://doi.org/10.1073/pnas.2422633122[4] Zhu 等,Frontiers in Psychology,2026。https://pmc.ncbi.nlm.nih.gov/articles/PMC13420724/

相关学习资料