乐于分享
好东西不私藏

AI把你变成“仓鼠轮上的麻痹症患者”?论文实测:预期节省55.7秒,结果仅7.5秒,2691人实验发现正在静默重写你的判断力

AI把你变成“仓鼠轮上的麻痹症患者”?论文实测:预期节省55.7秒,结果仅7.5秒,2691人实验发现正在静默重写你的判断力

你有没有过这个瞬间:想算一道两位数的加减法,手指已经鬼使神差地点开了某个AI聊天框。你告诉自己,“这样快一点”

但实验记录的答案,和这种感觉相差很远。

一项由麻省理工学院、斯坦福大学、纽约大学与普林斯顿人工智能实验室联合完成的预注册实验,跟踪了2691名参与者,得出一个近乎羞辱的结论:你以为AI帮你省下了55.7秒,实际你只省了7.5秒仅仅在两道题上用过AI之后,你的大脑就开始静默地上瘾下一次,你会更想用它,哪怕你自己动手本来更快

这项发现来自刚刚提交至arXiv(编号2605.22687)的论文《效率收益错觉》(The efficiency-gain illusion)。

“感觉高效”是一场集体幻觉

研究团队干了一件特别“损”的事

他们没有测什么写代码、做财报、搞研究这种“大活儿”。他们选的,全是你我闭上眼睛都能做的琐事:两位数加减法、拼写校对、回忆常识、改写短句。用学术黑话说,这叫认知卸载,把本该大脑干的活儿,外包给AI。用大白话说,就是“懒得想”

结果,打脸来得又快又狠

在实验中,人们被随机分成两组一组只“预测”自己在哪些题上会用AI,另一组真刀真枪做题,桌子上就摆着一个嵌在问卷里的GPT-4o聊天框。你猜怎么着?

预测组说:容易的题,我大概只有20%的概率用AI。实际组呢38%的人,点开了AI

几乎翻倍

而在那些离谱到极致的题上,比如“黑加白是什么颜色”、“27加56等于几”,几乎没有人预测自己会求助AI(预测率仅2.3%)。但真实世界里,有21%到54%的人,依然把手伸向了那个对话框。

Rohan Paul在社交平台上将其概括为:错误的便利感会逐渐驯化人们。

▲ Rohan Paul的帖子概括了论文的核心落差:感觉高效,不等于测到高效

省了55.7秒,还是只省了7.5秒?表针不会说谎

最醒目的数字,来自时间幻觉

研究二的参与者被要求预估自己独立完成和用AI完成各需要多久。他们信誓旦旦:AI能把时间从97.1秒压到41.4秒,砍掉近六成

然而实验里的隐藏计时器,记录下了残酷的真相:AI组的真实用时是86.2秒所谓的巨大优势,被写提示、等响应、读答案、检查对不对、再决定要不要信这五个动作组成的界面摩擦,吃干抹净。

最终,预期节省55.7秒,实测节省,7.5秒

7.5秒大概是你读这句话的时间

在那些“易如反掌”的任务上,AI不仅没加速,反而让人更慢这种体验就像把车开进服务区绕了一圈,回来后仍觉得自己风驰电掣

评论区里有人把这种感觉形容得入木三分,“带着进度条的拖延”。

▲ “55.7和7.5的落差痛得熟悉,有时候问AI只是带进度条的拖延”

大脑被“静默重校准”:用过两次,你的判断就变了

如果只是时间观出了点偏差,倒也无伤大雅。研究三发现,这种偏差还会延续到后面的选择中。

研究者先让一部分人“被迫”用AI做两道题,然后再让他们自由选择是否继续用。对照组则是全靠自己做完的人

结果呈现出一种持续的延续效应

用过AI的人,下一轮选择AI的比例是44.5%没接触过AI的人,这个数字只有27.7%

仅仅是暴露在AI面前两轮,就足以改变一个人的行为模式。同时,那些被“投喂”过AI的人,更不相信自己动手其实更快这回事了。

论文作者把这称为过度依赖反馈环使用塑造信念,信念再推动使用你越用,越觉得自己需要它;你越觉得自己需要它,你的元认知,判断“什么时候我自己的脑子才是更快的工具”的能力,就越钝化。

有博主用了一个绝妙的比喻仓鼠轮转得很漂亮,却哪儿也去不了。

▲ 短促的隐喻,戳中了许多人的隐痛

另一条裂缝:那些“真的不快,但我就是想要”的人

评论区里还有另一种看法

一位名叫David Boyle的用户在评论区写下了一段几乎可以封神的辩护词。他承认,有一类任务,用AI确实不更快不过,

“AI在跑的时候,我可以把脑子关掉一分钟,看看窗外,喘口气,摸摸草。等草稿回来了,我再把脑子重新打开这能卸下一点心智负担”

不更快,但更好、更开心

▲ “Not quicker but better and happier”,与论文测到的“时间,努力”双维度形成奇妙对照

这段话之所以危险而动人,在于它恰恰坐实了论文的另一个核心发现:人们从AI那里获得了情绪上的喘息,秒表上的领先却可能并不存在。此时被优化的是当下的疲惫感

但问题来了:当喘息感被误记为生产力,日积月累,依赖会逐渐变成一种不用面对“费点劲”的舒适

更大的阴影:让资深开发者慢了19%,主管们却还以为快了

如果你觉得“简单任务上犯迷糊”只是小白才会踩的坑,那METR在2025年做的另一项随机对照试验,会给你当头一棒

他们找了16名资深开源开发者,平均维护着2.2万星以上的大型代码仓库,分配给他们246个真实的GitHub issue,修bug、加功能、做重构。一半人允许用Cursor和前沿Claude模型,另一半纯手搓

结果是:允许用AI的那组,完成时间反而多了约19%。

参与者全是万里挑一的高手反常之处在于,他们事前预测AI能让自己快24%亲身经历了减速之后,仍然坚信AI让自己快了20%

事实 不仅无法说服人,甚至连经历过事实的人都说服不了这就是Stripe Economics团队指出的那个经典困境:微观层面的“感觉良好”,迟迟无法兑现为宏观层面的生产率跃迁

另一边,Upwork的数万人调查给出了同样撕裂的画面:96%的高管相信AI提升了公司效率,77%的员工却说自己更忙了47%的人不知道该如何达到老板期待的生产率。AI把“快”的部分吸走了,把“收拾烂摊子”的部分加倍吐了回来

▲ “AI在任务层令人惊叹,但真实世界的扩散与摩擦,几乎难以逾越”

从1987年到2026年:太阳底下没有新鲜事?

把时间拨回1987年诺贝尔经济学奖得主Robert Solow说了一句后来被刻在经济学史上的话:

“计算机时代无处不在,唯独不在生产率统计里。”

那时候,企业疯狂购置PC和信息系统,账面上的生产率却半死不活。这段历史被称为IT生产率悖论后来呢?经过大约十年,学习成本消化完,组织流程重构完毕,生产率才开始报复性上涨

今天的AI,正站在同一条河的出发点。只不过,这条河上多了一座更隐蔽的桥心理层面的校准失灵

论文给出的警告是:依赖的风险常以静默的重新校准出现。

你不会一夜之间变成不会算数的傻瓜。但你会一点点失去判断“我该不该自己来”的精度一个人如果连“27+56要不要问AI”都开始犹豫,那他在更大的决策上,什么时候相信自己的判断,什么时候求助于外部系统,又该拿出几成把握?

所以,我们该拔掉网线吗?

没必要也不现实

这篇论文并未断言AI无用它研究的是,在“简单、琐碎、本可脱手”的微任务上,人类对AI的收益感知系统出了bug。而在结构化、高复杂度、依靠经验兜底的职业场景里,比如客服工单处理,经典的Brynjolfsson研究就测到了14%到34%的真实提升

核心问题落在这里:你对自己在用AI这件事上,到底有没有数?

下一次,当你想把一道两位数加法丢进聊天框之前,不妨做个小实验。给自己掐个表:写完提示、等待回复、检查答案、决定信不信,这一整套做完。然后再掐一次表:自己口算一遍

很可能,你会被那个结果吓一跳

工具不会让你变笨快如闪电的错觉,可能掩盖原地打转的现实,这正是属于这个时代的新式眩晕。

毕竟,仓鼠轮的用途本就与“到达哪里”无关。它只会让你“一直跑下去”