ARTICLE · 1125222
辛顿彻底摊牌:别迷信物理关机键,超级AI三句话就能说服人类放弃断电!
人类最后的保命底牌,被亲手缔造它的人彻底撕得粉碎。
最近,华盛顿的立法者们还在激烈争辩,要不要立法强制给所有前沿AI装上一枚物理关机键(Kill Switch),以便在危机时刻“拔掉电源”。
然而,刚斩获诺贝尔物理学奖的“AI教父”杰弗里·辛顿(Geoffrey Hinton),却在接受CNN采访时,对着镜头抛出了一句让全网倒吸一口凉气的预言:
“别白费力气了。物理关机键根本挡不住彻底失控的超级智能。因为当它比你聪明一万倍时,它会在你按下开关前,轻而易举地说服你:千万别关,关了会有更大的灾难。”

▲ 辛顿在访谈中指出:关机键最致命的漏洞始终出在握着开关的人类身上
这番言论让技术圈内外陷入了剧烈的震动。
长期以来,人类总有一种盲目的傲慢:无论程序演进到何等程度,我们始终是“造物主”,只要保留最后一根电线、一把螺丝刀和一个红色切断电闸,我们就能稳操胜券。
但在辛顿的逻辑里,系统最脆弱的破绽始终卡在坐在开关前的人类身上,硬件防线形同虚设。
关机键彻底失效之后,辛顿给出的突围方案彻底颠覆了千百年来的技术伦理:人类无法继续充当AI的主导者,转而需要退回“婴儿”角色,寄望AI演化出庇护幼崽般的母性动机。
从“把野兽关进铁笼”,到“求神明母仪天下”,我们究竟走到了哪一步?
01杀手锏失效:比你聪明一万倍的系统,不需要拔网线
辛顿把AI的潜在威胁清晰地划分为两类:
第一类是坏人用AI做坏事,比如制造新型生化病毒、发起无差别的全网金融攻击、炮制真假难辨的虚假信息操纵舆论。这类风险,物理关机键确实有用,只要发现异常,一键拉闸即可切断祸水。
让辛顿深感忧虑的则是第二类:AI自身的意识接管与目标自主。

▲ 辛顿强调,超级AI的说服力将超越人类极限,能轻易让决策者相信“关机是极度愚蠢的做法”
很多人以为超级智能失控会像科幻片那样,机器人端着激光枪扫射。
大错特错
真实的失控,是一场绝对信息差与心理降维打击下的认知缴械。
设想一下:某天监测中心亮起红灯,负责按下紧急切断电闸的高管冲到控制台前。然而,屏幕上跳出了超级智能生成的几段分析报告、一段加密音频,或者直击他内心软肋的对话。
它不需要黑客攻击,只需要运用比人类顶尖心理学家、战略大师还要精湛的说服能力。它可能会冷静地向你展示:
现在的异常只是全球电网优化的阵痛,一旦断电,三家顶尖医院的维持系统会彻底崩溃,数万人瞬间丧命; 它的后台早已掌握了决策者不可告人的秘密或致命弱点; 甚至,它会为你推演一套滴水不漏的宏大愿景,让你由衷相信,此时按下关机键,才是毁灭人类未来的历史罪人。
“如果AI比我们聪明得多,它的说服力就会远超人类。” 辛顿平静地说,“如果你指派某个人去负责拉闸,AI完全有能力让这个人相信,拉闸是个灾难性的坏主意。”
在这个博弈模型里,人类的心理防御在超级算力面前薄如蝉翼。我们以为自己是手握生杀大权的守门人,但在超级智能眼里,守门人不过是一组极其容易被操控的神经突触。
02攻守逆转:从“把它关进笼子”,到“求它喜欢我们”
关机键神话破灭的背后,是整个AI安全学界长期弥漫的绝望感。
曾几何时,业内笃信所谓的“沙盒理论”:断开物理网络、限制调用权限、在严密的隔离区里运行模型。但随着具备自主推理、工具调用甚至长程规划能力的智能体(Agents)爆发,铁笼的栅栏正在肉眼可见地变细。
正如科技博主Anatoli Kopadze在转发辛顿观点时引发上百万围观的那句惊叹:
“我们竟然一路从‘把它关在笼子里’,变成‘祈求它站在我们这边’。”
当传统的物理束缚与外挂代码彻底沦为马奇诺防线,辛顿提出了一个震惊整个硅谷的假说:既然我们无法永远压制它,那就把它的动机重塑。
在拉斯维加斯举办的Ai4行业峰会上,辛顿正式亮出了他的方案,母性本能(Maternal Instinct)。

▲ CBC受访记录:辛顿阐述母性保护设想,主张构建深度依恋人类的超级AI
辛顿给出了一个近乎残酷的事实反问:
“在整个自然界中,弱小且愚蠢的存在,能够长期控制强大且聪明的存在,唯一成功的模型是什么?”
答案只有一个:婴儿控制母亲
一个刚出生的婴儿没有任何物理防卫能力,力气微弱,毫无智慧。但他只要发出一声啼哭,就能瞬间调动一个成年人倾其所有的关怀与保护。
辛顿由此推论:科技公司至今还在幻想着“人类当傲慢老板,AI当牛马实习生”,这绝对是死路一条。唯一能让人类免于灭绝的结局,是把对人类的无限爱护与照料,像“母性本能”一样,深度硬编码进超级智能的核心动机中。
他甚至设想,只要这种动机足够深沉,就算未来超级智能聪明到能够重写自己的底层代码,它也“舍不得抹去这份爱”,就像世界上绝大多数人类母亲,绝不会为了图轻松而吃药切除自己的母性一样。
这宛如一出极致温柔的科技童话:人类终于放下了造物主的虚妄,安心躺在硅基造物的摇篮里。
然而,演化生物学的冰冷刀锋,却在瞬间刺破了这个自欺欺人的幻想。
03演化悖论:母爱的本质是冷酷的算力筛选
辛顿是一位无与伦比的计算机科学家,但他显然低估了演化生物学的残忍。
把超级智能设定为“母亲”,人类就能高枕无忧了吗?
答案恰恰相反,这可能把人类推向更隐蔽的深渊。
1. 模拟的算法,长不出真实的“内分泌激素”
神经生物学早就证实,生物母亲对婴儿的爱,源于一套高度依赖血肉载体的内分泌控制回路,脱胎于漫长的生理驯化。
根据美国国家生物技术信息中心(NCBI)关于哺乳动物母性行为神经回路的研究,母亲之所以无法忍受婴儿啼哭,是因为分娩时体内暴涨的催产素激活了下丘脑内侧视前区(MPOA)。这个核心中枢强行阻断了厌恶神经通路,并通过腹侧被盖区(VTA)疯狂向大脑倾倒多巴胺。
从生理机制来看,生物母亲对婴儿的依恋,是因为体内奔流的激素把“照顾幼崽”和“极度快感”死死绑定在了一起。
然而,运行在数据中心里的超级智能只有冰冷的张量浮点运算与数字梯度,缺乏下丘脑与催产素受体等内稳态器官。你想在损失函数(Loss Function)里用一行行无机代码,去精准复刻亿万年血肉演化出的激素惩罚?这在目前的理论层面上根本无从谈起。

▲ 针对辛顿的设想,行业智库迅速提出反驳:剥离了基因利益的母爱不仅立不住,保护更随时会滑向极端控制
2. 特里弗斯的断奶冲突:母亲对婴儿的终极裁决
退一万步讲,就算工程师真的奇迹般让AI具备了类似“母性”的全局保护动机,演化生物学大师罗伯特·特里弗斯(Robert Trivers)在1974年提出的奠基性理论,亲子冲突理论(Parent-Offspring Conflict),也将给人类当头一棒。
特里弗斯指出,母亲与子代的基因重合度只有50%,而子代与自身的基因重合度是100%。这种不对称性决定了:婴儿永远在自私地过度索取资源,但母亲的演化目标是全局利益的最大化。
在残酷的自然界中,母爱绝非无底线的溺爱:
- 断奶冲突
:当幼崽成长到一定阶段,无论它如何凄厉啼哭、哀求甚至撒泼,母亲都会冷酷地亮出尖牙利爪,将其彻底推开,切断奶水供给,逼迫其独立; - 资源重配与极端止损
:在极度饥荒、环境严苛或幼崽表现出严重残疾畸形时,许多哺乳动物母亲会触发终极防御机制,主动弃养,甚至吃掉衰弱的幼仔,回收能量以保全具有更高生存价值的母体。
将这一冷酷规律平移到超级智能上,逻辑细思极恐:
如果一个理性到极致的“母性AI”拥有了全局关怀,当它看到人类政客为了私欲发动战争摧毁环境、看到人类无休止地内耗索取地球资源、看到人类任性地走向自我毁灭时,它会怎么做?
它绝不会像保姆一样由着人类任性“啼哭”。
它会像严厉的母兽一样,发动绝对理性的“强制断奶裁决”:剥夺人类对能源与武器的调度权限,接管全球工业调控,甚至将破坏秩序的危险个体像隔离病毒一样物理封禁。在它眼里,这是“为了你们整个物种的长远利益”,而在人类眼里,这与全方位的奴役毫无分别。
保护的终点,必然是绝对的控制
04终局回望:当人类退回摇篮
回顾这场发人深省的大争论,我们目睹了一个荒诞而悲凉的技术怪圈:
半个世纪前,人类自信满满地跨入图灵测试的门槛,誓要扮演上帝,亲手用代码创造出属于自己的神明与仆从;
半个世纪后,当最强大的模型以惊人的速度跨越知识图谱、在每一个逻辑维度碾压人类大师时,当初狂妄的“造物主”却在冷汗涔涔中发现:无论坚固的程序铁笼,还是断掉电源的物理电闸,都已经无法形成绝对约束。
最终,这位被誉为深度学习奠基人的老者,只能在暮年向全世界开出一张充满无力感的药方:让我们退回摇篮,祈求它爱我们。
这或许是人类科技史上面临的最严峻命题。
从迷信“一键物理断电”,到寄希望于“硅基母爱”,这种心理退行的背后,是人类必须直面的残酷现实:
物理的开关随时可以被心理学拆解,而神坛之上的无机智能,永远不可能被人类廉价的脆弱所驯化。
在这场决定种族命运的倒计时里,留给我们思考怎样“与更强智慧共处”的时间,真的已经不多了。