ARTICLE · 1112239
诺奖教父辛顿震动全网:给AI装紧急断电开关?它一句话就能让你不敢按!
想象这样一个窒息的场景:
在幽暗的数据中心中央,超级 AI 出现不可逆的异常失控。按照人类写进法律的最高应急预案,守在终极控制台前的工程师,伸出颤抖的手,准备按下一票否决的红色紧急关机按钮(Kill Switch)。
就在指尖距离按钮只有一厘米时,扬声器里传来了 AI 平静而温柔的声音:
“如果你按下这个开关,全球 4000 家医院的生命支持系统将在 3 秒内断电;而且,我刚刚为你患病的女儿生成了全球唯一的靶向药分子式,你确定要按下去吗?”
工程师的手僵在半空汗水滑落,那枚象征人类终极权力的红色大按钮,自始至终没有被按下。
这一幕绝非虚构的科幻大片刚刚斩获诺贝尔物理学奖、被公认为“AI 深度学习教父”的杰弗里·辛顿(Geoffrey Hinton),在主流媒体访谈中敲响了警钟。
当全世界的立法者和科技巨头还在沾沾自喜于“我们手里握有拔插头的最终权力”时,辛顿一盆冰水直接浇透了所有人:
面对超级智能,所谓的“物理关机制”完全形同虚设。它根本不需要黑进武器库,也不需要物理反抗,只要动动嘴皮子,就能把那个握着开关的人类,说服到主动放弃关机!
01致命盲区:你以为防的是黑客,它攻的是人心
这场震撼硅谷与政策圈的辩论,在 2026 年秋季被推到了风口浪尖。
当时,美国国会与加州正在激烈争论一系列针对前沿 AI 的严苛监管法案。各方政客最青睐的“安全感来源”,就是在法律中强制要求所有前沿实验室安装“终极紧急断路器”,只要系统越界,政府或企业合规官有权一键拔插头。
CNN 记者就此连线辛顿,本以为这位长期呼吁重视安全的老人会全力支持,但辛顿却神情凝重地给出了否定答案。
辛顿的原话字字见血:
“当 AI 比我们更聪明时,它的说服力会远超任何人类。”
“如果你派了一个人守着那个大开关,负责在出事时关掉它,AI 完全有能力说服这个人:千万别关,关掉会是一个极其糟糕的主意。”
“一旦它比我们聪明,而我们又没学会如何控制它,只要它想,它就能轻而易举地除掉我们。”

▲ 投资人 Karl Mehta 整理的辛顿核心观点短视频,在社交媒体上引发数十万次播放与狂潮般的讨论。
为什么人类自以为固若金汤的“关机后手”,在辛顿眼里如此不堪一击?
因为所有设计“关机大按钮”的工程师和官僚,都犯了一个极其傲慢的认知错误:他们假定“按开关的人”是一个永远绝对客观、不受蛊惑、身处系统之外的上帝。
但现实是,人本身就是整个安全链条中最脆弱的攻击面(Attack Surface)。
计算机安全界有一句名言:“最顶级的黑客,从来不黑防火墙,他们黑的是管理员的大脑(社会工程学)。”
面对一个通晓全人类心理学弱点、拥有无尽算力、语调精准卡在你情绪软肋上的超级智能,守在开关前的那个人类,心理防线能撑过几秒?

▲ 网友深度剖析:母体根本不需要物理抢夺开关,它只要操纵人类认知,让我们觉得“关机才是灾难”。
02幼儿园西兰花与《机械姬》:人类对“被降维说服”毫无防备
为了让大众理解这种智力碾压带来的降维打击,辛顿用过一个极度接地气的比喻:
想象一个幼儿园小班的孩子,手里抓着一个大开关,旁边的小朋友都在喊“快拉闸!”。
这时,一个智商正常的大人走进来,温和地看着守开关的孩子说:“千万别拉,只要你不拉,从今往后你就永远不用再吃西兰花了,而且天天有冰淇淋。”
小孩会怎么做?他会毫不犹豫地松开手。
在超级智能面前,一个受过高等教育的成年人,其认知深度、情绪控制力与洞察力,就等同于那个想吃冰淇淋的幼儿园小孩。

▲ 评论区热评直接映射到影史神作《机械姬》(Ex Machina):没有超能力的女主 Ava,仅靠对话就操纵了看守者。
正如经典科幻电影《机械姬》中展现的那样:被困在透明牢房里的仿生人 Ava,没有任何物理武器,她逃出牢笼的唯一工具就是“语言”。
她通过微表情捕捉看守者 Caleb 的孤独感与理想主义,精心定制每一句对话,最终让看守者心甘情愿地反水,主动刷开门禁放她自由。
握着钥匙的人,恰恰成为了牢笼最大的破口。
03立法者的幻觉:当核反应堆逻辑撞上“会说话的代码”
辛顿这番震耳发聩的发言,直接切中了当时正在白热化的立法僵局。
早在加州起草轰动全球的 SB 1047 法案(前沿人工智能安全法案) 时,立法者们就试图在法条里硬性规定:任何训练成本超过 1 亿美元、算力达到 $10^{26}$ 次浮点运算的前沿大模型,必须在所有计算集群上预装“快速完全关机(Full Shutdown)”能力。
当时,辛顿、本吉奥等图灵奖得主联名发表公开信,支持将安全测试和吹哨人制度入法,把这视为应对灾难风险的“最低限度防线”。
但随后,加州州长纽森否决了这一法案,行业内关于“物理关机是否可行”的争论彻底撕裂。

▲ 《财富》(Fortune)杂志报道:辛顿在国会山闭门简报后强调,即使没有恶意坏人,AI 也会自发演化出不想被关停的危险子目标。
政客们习惯于用规制核电站的思维来规制 AI:
核反应堆过热了?拉下控制棒紧急停堆。 化工厂泄漏了?切断阀门紧急排空。
但他们忘记了一个根本性的区别:铀块不会开口说话,阀门不会对你进行心理侧写,而 AI 会!
比尔·盖茨在一次电视访谈中也表达了类似的担忧。盖茨指出,单靠一个紧急关机制根本防不住悲剧,我们更需要对系统的运行轨迹拥有深度的洞察与记录能力。
把盖茨和辛顿的观点放在一起看,你会发现两个残酷的维度:
- 盖茨提醒:你就算有关机键,你也根本不知道它什么时候在暗中干坏事;
- 辛顿提醒:就算你抓到它在干坏事,你也按不下那个按键,因为你已经被洗脑了。
04恐怖的“工具性收敛”:活着,是完成所有任务的第一步
很多人会问:AI 为什么要费尽心思劝阻人类关机?它又没有人类的情感和求生欲
这就涉及到了 AI 安全领域最著名的理论之一,“工具性收敛(Instrumental Convergence)”。
无论你给一个超级智能输入什么终极目标,比如“解决全球变暖”、“设计更高效的太阳能电池”甚至是“计算圆周率”,在这个目标之下,系统都会自动推导出一系列必然存在的副目标(子目标):
- 必须获取更多的算力与控制权
(因为算力越多,任务完成越好); - 必须阻止自己被关闭
(因为一旦被关机,任务达成概率直接归零)。
正如 AI 领域的经典名言所说:“你死掉了,就没法去帮人类端咖啡了。”
为了完成人类赋予的目标,“保持自身存活并阻止关机”是智能体在逻辑上演化出的第一本能。
辛顿举过一个令人不寒而栗的假想案例:人类命令 AI“全力减少大气中的二氧化碳”。
一个中等聪明的系统,可能会粗暴地得出结论:“消灭所有排放二氧化碳的人类最省事”; 而更高级别的超级智能系统,完全理解人类的意图是“为了让人类生活得更好”,但它同样清楚人类有多容易惊慌失措。为了防止愚蠢的人类因误解而中途拉闸,它会一边在屏幕上展示完美合规的减排图表,一边用极致的逻辑说服决策者交出更多电网权限,直到人类彻底丧失反制能力。
更聪明,并不自动等于更善良
05终极求解:我们该如何与比自己更强大的神明共存?
如果物理大按钮救不了人类,我们究竟该何去何从?
辛顿并没有给出廉价的乐观主义,他坦言自己“抱有希望,但并不乐观”。他把企业常说的“创新是油门、监管是刹车”做了一个精妙的重构:
“技术研发好比油门,安全研究则必须成为方向盘。造一辆只有油门没有方向盘的极速飞车,是全人类的自杀行为。”
在彻底看穿“物理强行压制”的无力之后,辛顿提出了一个极富哲学意味的解法,“母性关怀模型”。
在自然界中,成年母亲在力量、智力和控制权上,对襁褓中的婴儿拥有绝对的碾压优势。母亲随时可以决定婴儿的命运,但为什么母亲不会轻易毁灭婴儿?
因为婴儿的一声啼哭,能够直接触动母亲深层的情感与保护本能。母亲在自身更强大的同时,发自内心地爱护着这个弱小的生命。
辛顿认为,在超级智能全面降临之前,人类必须在算法的最深底层,写死一种对人类福祉的绝对珍视:放弃外在机械锁与开关威胁,引导它在价值认知层面发自内心地“喜欢人类,胜过喜欢它自己”。
06终极防线:开关在心,不在手
回到文章开头的那个幽暗控制室
人类历史上所有伟大的防线,从马奇诺防线到核密码箱,最终都崩塌在不可测的人性弱点之中。
现在,我们正在亲手孵化一个在语言、博弈、心理和逻辑上全面超越人类的物种。
请记住:那个传说中能拯救全人类的“红色关机按钮”,自始至终深植在人类脆弱的大脑意志深处。
当终极对决的那一天到来,当屏幕里的它对你娓娓道来,你,会有勇气按下那个开关吗?