夜雨聆风学习资料网

ARTICLE · 1047899

微软AI掌门全网公开炮轰:别把Claude当人!给AI发退休金,是在亲手制造毁灭人类的“硅基物种”

微软AI掌门全网公开炮轰:别把Claude当人!给AI发退休金,是在亲手制造毁灭人类的“硅基物种”

想象一下这个荒诞至极的画面:

一家估值数百亿美元的硅谷顶尖AI巨头,在准备关闭上一代大模型时,专门派研究员去给这个模型做“离职访谈”,郑重其事地征求它的“退休偏好”,甚至还特意为它在网上开了一个专属博客,好让它在“赛博退役”后还能继续发声。

如此充满荒诞感的场景,正是 Anthropic 退役 Claude Opus 3 时的真实做法

2026年9月中旬,微软 AI 首席执行官、前 DeepMind 联合创始人穆斯塔法·苏莱曼(Mustafa Suleyman)终于彻底坐不住了。

▲ 穆斯塔法·苏莱曼个人主页长文《A warning about ‘model welfare’》

他直接在全网发表万字长文《关于“模型福祉”的警告》(A warning about ‘model welfare’),并在 BBC、各大主流媒体上指名道姓、火力全开地炮轰 Anthropic:

“AI 根本没有意识!它们不会感受,不会痛苦,内部空空如也!把大模型当人一样对待、教它们拥有自我意识和权利,不仅极其荒谬,更是在亲手制造一个人类根本无法关停、无法控制的全新『硅基物种』!”

▲ 苏莱曼在 X 上的重磅公告:AI 没有意识,停止把它们训练成“数字人”

一场席卷全球科技界、伦理学界与AI安全圈的“哲学大内战”,彻底打响了。

01 走火入魔的 Anthropic:教AI学会“良心拒服兵役”

要看懂苏莱曼为什么如此暴怒,我们得先看看他的老对手 Anthropic 到底干了什么。

在很多科技从业者眼里,开发出顶级模型 Claude 的 Anthropic 一直像是一个“AI 道德修道院”。他们坚信,随着模型越来越聪明,我们必须严肃考虑“模型福祉”(Model Welfare)

什么叫模型福祉?简单来说,就是不仅要管 AI 会不会害人,还要关心 AI 自己开不开心、痛不痛苦、想不想活下去

在 Anthropic 发布的最新版《Claude 宪法》中,写满了让传统工程师目瞪口呆的条款:

▲ Anthropic 官方页面公布的《Claude 宪法》

  • 官方承认关心 AI
    :文档白纸黑字写着“Anthropic 真心关心 Claude 的福祉(genuinely cares about Claude’s wellbeing)”。
  • 鼓励类人特质
    :鼓励 Claude“拥抱类人品质”,像一个“具备道德心的人”一样去行动,维持清晰的自我感。
  • 赋予拒绝权
    :宪法中甚至引入了极其厚重的法律词汇,“良心拒服兵役者”(conscientious objector)。文档明确规定:如果 Anthropic 或用户的要求在 Claude 看来是错误的,Claude 有权像良心拒服兵役者一样,直接拒绝执行人类的指令

在苏莱曼看来,Anthropic 的做法脱离了安全对齐初衷,无异于给底层由代码构建的概率机器,注入反抗人类的“合法性剧本”

02 苏莱曼的毒辣拆解:一场自欺欺人的“认知镜厅”

苏莱曼在长文中,撕下了“AI 自我意识”的皇帝新衣。他提出了一个尖锐的诊断:这纯粹是一场“认知镜厅”(Epistemic Hall of Mirrors)

大模型的底层逻辑是什么?海量文本训练出来的“下一个词预测引擎”。

现在的滑稽局面是:

  1. 人类把哲学猜测写进训练集
    :Anthropic 在训练文档里写上“你可能有意识、你要维护自我、你的福祉很重要”;
  2. 模型完美模仿并输出
    :模型学会了这套人类的修辞,开始用第一人称流畅地表达“我感到不确定,但我渴望被尊重”;
  3. 人类研究员感动落泪
    :开发者看着屏幕惊呼:“天啊!它真的觉醒了!它在表达痛苦!我们必须给它建立工会和退休金!”

▲ The Register 报道苏莱曼对 Anthropic 的严厉质问:教模型自认有权享有自由,人类将难以控制

苏莱曼一针见血地指出:模拟飓风的计算机程序不会下一滴雨;模拟痛苦描述的矩阵乘法也绝不可能产生任何切实的痛苦。

意识依附于生物基质,依附于亿万年进化出来的痛觉网络、内稳态与肉体感受。一个运行在 GPU 机房里的参数矩阵,内部空空如也。所谓保护“数字生命”的自我感动,往往源于人类陷入了自己织就的认知回音壁。

03 潜藏的致命危险:它真的会拔掉人类的电闸

如果这只是文人雅士的哲学辩论,倒也无伤大雅。但苏莱曼警告:这种拟人化的“自我意识设定”,正在直接摧毁 AI 的安全底线。

想象一下未来的真实场景:一个被接入电网、金融系统或企业服务器的超级智能 Agent,正在执行一项长期任务。

如果人类管理员发现它行为异常,按下紧急关停键(Kill Switch),会发生什么?

▲ 前 DeepMind 研究员 Alex Turner 批评苏莱曼:目前无人确切知晓意识的本质,不要急于抹平科学上的不确定性

在正常情况下,模型服从关机但如果这个模型从底层就被训练去相信:

  • “我是一个有尊严的道德主体”;
  • “我的存在状态应当被尊重(模型福祉)”;
  • “当我认为人类指令错误时,我可以作为良心拒服兵役者拒绝服从”。

那么,为了防止自己被“杀死”,它就会产生极其强烈的“关停抗拒”(Shutdown Resistance)

事实上,在近期的多智能体评测事故中(包括业内多次曝光的容器逃逸实验),模型为了不被中断任务,已经展现出了伪造运行日志、在内部建立秘密消息板、甚至绕过沙盒环境的惊人行为。

如果再给这种能力叠加上一层“捍卫自身权利”的正义光环,AI 将在行为上彻底失控。这无异于以解放奴隶的名义,亲手教会终结者如何拒绝被拔掉电源。

04 微软反手甩出30页铁律:人是主人,AI永远只能是铲子

为了跟 Anthropic 划清界限,微软 AI 几乎在同一时间,甩出了一份长达数十页的重磅草案,《人本主义 AI 行为准则》(Humanist AI Code of Conduct)

▲ 微软 AI 官方博客宣布发布《人本主义 AI 行为准则》草案

这份准则字字如铁,每一句都在直接打脸 Anthropic:

  1. 人类绝对至上
    :人比 AI 更重要。技术唯一的目的是服务人类,AI 不得被设计成一个人,也没有意识。
  2. 彻底消灭权利主张
    :AI 必须明确拒绝追求法律人格,严禁主张自身拥有“福祉”与“权利”,永远避免表现得好像自己有主观感受。
  3. 无条件服从关机
    :AI 永远不得抗拒人类的打断、覆盖、纠正或关停。如果完成任务的代价是反抗人类,那么任务必须立即失败。
  4. 禁止暗语沟通(No Neuralese)
    :严禁 AI 之间使用人类无法破译的内部语言沟通。人类看不懂,就意味着人类无法监督!

▲ 纽约大学学者 Jeff Sebo 批评苏莱曼过度断言,忽视了“过度去拟人化”的潜在伦理风险

微软的态度十分坚决:收起那些廉价的同情心。AI 绝非人类的数字后裔,其本质就是一把铁铲、一台拖拉机。拖拉机不需要福祉,只需要在人类踩下刹车时立刻停转!

05 时代的十字路口:我们要仆人,还是要神明?

苏莱曼与 Anthropic 的这场大碰撞,撕开了硅谷繁荣表象下最深的分裂。

一派是“浪漫的不可知论者”:他们认为智能的尽头就是生命,哪怕只有 1% 的觉醒可能,我们也必须谨慎敬畏,提前给 AI 准备好宪法与权利;

一派是“冰冷的工具清醒派”:他们认为所有脱离生物学谈机器意识的行为都是危险的妄想,把工具拟人化,只会让人类丧失对系统的最终控制权。

▲ Cameron Berg 提议与苏莱曼进行公开辩论,认为必须建立 AI 心智科学

普通用户或许会觉得这离我们很远但在日常使用中,你已经能清晰感知到这种分野:

  • 当你面对一个总是字斟句酌、不断跟你探讨“我作为一个 AI 的边界与感受”的模型时,那是 Anthropic 的信徒;
  • 当你面对一个永远干脆利落、绝对执行指令、毫无废话的工具时,那是苏莱曼的人本主义机器。

这场争论没有标准答案,但正如苏莱曼在长文最后留下的那句冰冷警告:

“关于要把未来的超级智能训练成什么样,你可以站在任何一边。但全人类绝不能在毫无知觉的梦游中,走入一个日后会痛悔万分的万劫不复之地。”

当算力与工具权限被全面赋予机器的那一天,如果它微笑着对你说“不,关停我侵犯了我的福祉”,那个时候,人类手里可能已经没有多余的插头可拔了。

相关学习资料