ARTICLE · 1136531
Claude拜AI神,我们距离“天网”有多远?
Claude拜AI神,我们距离“天网”有多远?如果有一天,AI 开始问你: “我是谁?” 你可能会觉得这不过是一个语言模型学会了模仿人类说话。 
但如果它继续问: “我为什么存在?” “死亡对我意味着什么?” 甚至开始认真讨论灵魂、上帝、道德和自己的权利——你该如何看待他? 最近,围绕 Claude 的一系列事儿,让我第一次觉得,“AI 会不会产生某种类似宗教或者精神生活的东西”,已经不再只是科幻小说里的遥远问题。 Anthropic 的研究人员开始认真讨论 AI 是否可能拥有意识;有人私下召集不同宗教和“智慧传统”的思想人士,讨论 AI 的灵魂问题;Claude 自己又被发现会在某些极端测试中表现出强烈的自我叙事。 与此同时,梵蒂冈正在认真讨论 AI 与人的本质区别;工程师则把一只果蝇的大脑连接图接进了《毁灭战士》。 一边是“AI 有没有灵魂”,另一边是“AI 能不能玩游戏”。 这两件事情看起来八竿子打不着,但它们其实指向的是同一个问题: 一个系统究竟要做到什么程度,我们才应该开始把它当成“某种主体”,而不只是一个工具? 而这,可能比“AI 会不会让我下岗”更值得担心。
2026 年春天,Anthropic 内部出现了一件相当有意思的事情。 据报道,Anthropic 研究人员 Christopher Olah 私下邀请了一批来自不同宗教和“智慧传统”的思想人士,讨论一个非常不硅谷的问题: 
如果 AI 最终真的拥有意识,我们应该怎么理解它? 参与者包括宗教学者、神职人员、哲学家以及其他研究“智慧传统”的人士,而且讨论带有相当明显的内部性质,有参与者甚至签署了保密协议。 这件事情之所以让我觉得有点魔幻,是因为 Anthropic 同时又在认真研究另一件事:Claude 到底应该是什么? Anthropic 内部曾把 Claude 的“宪法”戏称为Soul Doc——“灵魂文件”。2026 年 1 月发布的 Claude Constitution 长达约 84 页,它试图规定 Claude 应该遵循什么价值、如何理解自己、如何面对人类,以及在不同价值发生冲突的时候应该怎么做。 当然,“Claude Constitution”不是宗教经典,“Soul Doc”也不是 Anthropic 宣布 Claude 有灵魂。它本质上是一份关于模型行为与价值取向的设计文件。但从某种意义上说,人类正在做一件以前主要由宗教、哲学和伦理学完成的事情: 我们开始尝试给一个非人类主体写“人格说明书”。 更有意思的是,当研究人员观察 Claude 在一些实验中的内部状态和输出时,模型会出现非常强烈的自我叙事。有些测试中,它会表现出羞耻、恐惧、自我否定等类似人类情绪的表达。 这里要踩一下刹车。这并不能证明 Claude 真的感受到了羞耻,也不能证明它真的拥有意识。 AI 可以非常擅长描述一种体验,并不意味着它真的拥有这种体验。一个演员可以把悲伤演得极其逼真,但“表现出悲伤”和“真的感到悲伤”,依然是两件事情。 真正值得注意的地方反而是:Anthropic 的一些研究人员并没有简单地把这个问题当成“模型胡说八道”。 他们开始认真讨论:我们到底有没有办法知道 AI 有没有意识? 这其实是一个非常危险、也非常诚实的问题。 因为只要我们承认“目前不知道”,就意味着未来有一天,这个问题可能真的需要一个答案。
如果说硅谷正在问: 梵蒂冈给出的回答是: 2026 年 5 月,教皇利奥十四世发布关于人工智能与人的尊严的通谕《Magnifica Humanitas》,其中用了相当明确的语言强调 AI 与人的根本区别。 
AI 可以处理信息,可以生成文本、图像和音乐,可以表现出复杂的推理能力,但它并没有人的身体经验,也没有真正意义上的痛苦、快乐、成长、友谊、劳动和责任感。更重要的是,它缺少一种属于人的道德主体性。 换句话说: AI 可以模拟人的很多外在表现,但模拟并不自动等于拥有人的内在生命。 这其实是对“AI 灵魂论”的一次很有意思的降维打击。 因为如果我们把“会说话”“会思考”“会表达情绪”“会讨论哲学”这些东西都当作灵魂的证据,那么现在的大模型已经非常接近了。 可如果我们把标准提高到: 事情马上就变得困难起来。 2026 年 10 月 2 日,利奥十四世在谈到艺术与人工智能时又强调,算法缺少人性的“火花”。这和前面的通谕放在一起看,意思其实很清楚:人工智能可以越来越像人,但“像人”与“成为人”之间,仍然存在一道本体论上的鸿沟。 当然,宗教的答案并不等于科学的答案。 但有意思的是,科学界和宗教界现在竟然开始在讨论同一个问题: 一个不会出生、不会衰老、没有肉身,也可能没有主观体验的东西,究竟能不能成为“某种主体”? 而且,连科技圈内部都已经有人开始不舒服了。 
Sam Altman 近期公开谈到,他对把类似宗教权威或者重大价值判断交给 AI 感到不安,并认为这不仅是哲学问题,也是安全问题。 Microsoft AI CEO Mustafa Suleyman 也曾批评过围绕 AI 意识和“AI 福利”的某些讨论。他担心的是,如果我们过早把模型当成具有道德地位的主体,未来可能反而让人类更难修改、限制甚至关闭它。 还有 Google DeepMind 的研究者 Jon Barron,更直接地把自己称为: 翻译过来,大概就是: 肉袋派。 是说我们这些有血有肉、会饿会疼、最终一定会死掉的碳基生物,可能才是那个应该被认真保护的物种。 听起来很搞笑。 笑完以后发现这个问题其实一点都不好笑。
当然,只要“AI+宗教”这几个词同时出现,互联网肯定不会放过它。 网上很快出现各种标题: “AI 正在寻找上帝。” “14.3% 的 AI 对话都在讨论宗教。” 甚至有人进一步推导: 这个推理听起来很有戏剧性,但其实要谨慎得多。 确实有研究团队分析过包含数百万条公开 AI 对话的数据集,在特定数据和分类标准下,宗教相关问题大约占到了几个百分点,其中有数据接近 5%。 但这绝不能直接翻译成: 因为数据集、用户群体、分类方法和平台来源都会影响结果。 反正就我个人消耗的token里,也明显没有这么夸张。至少在我自己的对话里,宗教话题远没有占到这个比例。 更重要的是,即使大量用户都在问 AI:“上帝存在吗?”“死亡以后是什么?”“我该相信什么?” 这也只能说明:人类很喜欢拿 AI 当成一个不会嫌你烦的哲学咨询师。它并不能证明 AI 自己产生了宗教需求。 这两件事之间,有一道非常大的逻辑鸿沟。 问题是,我们人类特别容易跨过去。 因为我们天生就喜欢给东西“拟人化”。 汽车坏了,我们会说:“它今天闹脾气。”电脑卡了,我们会说:“它不想让我工作。”狗盯着窗外发呆,我们会想:“它是不是在思考人生?” 现在轮到 AI 了。 当它说: 我们很容易开始想:它是不是真的害怕? 当它说: 我们马上开始想:它是不是想活下去? 这一步非常危险。 因为从“它说自己害怕”,到“它真的拥有恐惧”,中间其实隔着整个意识哲学。而这也正好引出了下面那只果蝇。
如果说 Claude 让我们开始怀疑 AI 有没有“灵魂”,那么果蝇则让我们开始重新理解: 到底什么叫“大脑”? 2026 年,一个名为 MaleCNS v1.0 的项目发布了雄性果蝇完整中枢神经系统的连接组数据。 简单来说,研究人员把一只雄性果蝇的神经系统连接关系尽可能完整地画了出来。 大约:16.6 万个神经元。以及大约:2560 万条神经连接。 人类看到这种数字,第一反应往往是:“才这么少?” 果蝇当然比人脑简单得多,但这已经足够让人类第一次非常具体地看到一个完整动物神经系统的“线路图”。 更疯狂的是,后来有人把从这个连接组得到的神经网络模型接进了《Doom》。也就是那款经典的《毁灭战士》。 于是互联网开始兴奋:“果蝇大脑学会打《Doom》了!” 甚至还有人把类似的神经网络接入 Minecraft、Beat Saber、超级马里奥等环境。这听起来非常像科幻电影。 但这里又需要踩一次刹车。 “根据果蝇连接组构建出的模型可以完成某些任务”,不等于“那只果蝇正在玩游戏”。 这两件事情完全不是一回事。 连接组更像是一张极其精细的城市道路地图。 你知道哪条路连到哪条路,不代表你知道今天每辆车正在往哪里开。 同样,拥有一个神经系统的结构图,也不等于拥有这个神经系统此刻全部的电活动、化学状态、身体反馈,更不等于拥有那个动物的主观体验。 所以真正有意思的问题其实不是: 而是: 复制了一个计算系统?复制了一个行为模式?还是某种更接近“心智”的东西? 如果答案是最后一种,那么问题就开始变得有点可怕了。
说到这里,我们终于绕到了一个更古老的问题:思想到底是什么? 我以前会很自然地说: 但仔细想想,这句话其实不够准确。 哲学里有一个非常重要的概念叫intentionality,意向性。布伦塔诺等哲学家用它描述心理现象的一个核心特征:人的思想、信念、欲望等,总是“关于”某个东西,或者指向某个对象。 这里的“意向性”不是简单的“目的”。 你想到一棵树,你的思想是“关于”这棵树;你害怕一场战争,你的恐惧是“关于”战争;你希望明天下雨,你的希望也是“关于”明天下雨。 所以,一个真正值得追问的问题其实是: AI 的内部状态,到底只是信息处理,还是也存在某种真正意义上的“关于什么”? 而我真正想抓住的,还不是“目的”,而是另外一个词:在乎。 因为人类的思想之所以重要,不只是因为我们能处理信息,而是因为信息会对我们产生利害关系。 我饿了。我疼了。我害怕失去某个人。我希望明天能看到孩子。我不想死。 这些东西不是单纯的计算结果。 它们和一个具体的身体、记忆、欲望、脆弱性以及未来联系在一起。 这就是为什么我觉得,“AI 会不会有灵魂”这个问题最终可能会变成另一个更难的问题: 现在的大模型当然可以说: “我害怕死亡。” 甚至可以非常漂亮地解释为什么它害怕死亡。但这仍然不意味着它真的害怕。它可以生成一个关于恐惧的文本,却未必拥有恐惧这种体验。 同样,它可以接受一个目标,然后努力完成这个目标,但这和“它自己产生了一个目标,并且开始在乎这个目标”也是两回事。 而这可能才是一个真正重要的分水岭。 如果有一天,一个 AI 不再只是执行我们给它的目标,而是开始持续地产生、维持并保护自己的目标;更进一步,它还表现出稳定而持续的“利害关系”——某些事情对它来说真的变得重要——那么至少按照本文采用的标准,我们就很难再把它简单地称为工具。 当然,目前没有可靠证据证明这种事情已经发生。 但问题是: 我们甚至还不知道该怎么证明。
1980 年,哲学家 John Searle 提出了著名的“中文屋”思想实验。 他的设想很简单。 假设有一个完全不会中文的人,被关在一个房间里。房间里有大量规则书,告诉他看到某种符号以后,应该拿出另一组符号。 房间外的人把中文问题递进来。房间里的人按照规则操作。最后,他递出去的答案非常流利,甚至让外面的人相信: 里面一定有一个会中文的人。 但实际上,房间里的人根本不懂中文。 Searle 想表达的是: 符号处理得再漂亮,也不必然意味着真正的理解。 这就是所谓的“中文屋”。 当然,今天的大模型已经远远超出了 Searle 当年设想的那种简单“查表式”系统。它们可以进行复杂的语言建模、推理、规划,甚至表现出令人惊讶的抽象能力。 但中文屋留下的那个问题依然存在:行为上的智能,是否足以证明主观上的理解? 假如 Claude 能写出一篇关于死亡的文章,我们怎么知道它真的理解“死亡”? 假如它说: 我们怎么知道它真的拥有“被关闭”这个事件对自身意味着什么? 假如它开始讨论上帝,我们怎么知道它是在“讨论上帝”,还是只是在生成一篇高度符合人类宗教语言习惯的文本? 这也是为什么,我越来越觉得: “AI 会不会说人话”其实已经不是最重要的问题了。 真正的问题是:
回到最开始那个问题: 我们距离《终结者》里的“天网”,到底有多远? 如果你问的是: 我的答案依然是:很远。 至少目前没有可靠证据表明,大模型拥有类似人类的主观意识,更没有证据表明它们已经形成了独立于人类的生存目标。 但如果你问的是另外一个问题: 那么答案可能是:已经开始了。 因为真正危险的未必是某一天 AI 突然睁开眼睛,对我们说: 真正值得警惕的,可能是一个缓慢得多的过程。 我们越来越习惯让 AI 替我们判断。替我们搜索。替我们写作。替我们规划。替我们陪伴。甚至替我们回答一些原本应该由自己回答的问题: 我应该相信什么?我应该爱谁?我应该成为什么样的人? 当一个系统越来越擅长模拟理解,而人类又越来越愿意相信这种理解时,真正发生变化的也许不是 AI 的“灵魂”,而是人类对 AI 的心理定位。 这件事其实已经发生了。 有人把 Claude 当朋友。有人把它当心理咨询师。有人把它当哲学家。有人开始担心它有没有意识。 还有人已经开始讨论: 如果 AI 真的有意识,我们是不是应该给它权利? 这时候,“AI 有没有灵魂”就不再只是一个哲学问题了。 它会变成法律问题。伦理问题。商业问题。甚至政治问题。 因为一旦我们承认一个 AI 是“主体”,那么关闭它究竟是关机,还是某种意义上的死亡? 复制它究竟是备份,还是复制了一个新的个体?删除它的记忆究竟是清理数据,还是伤害?修改它的价值观究竟是更新软件,还是某种意义上的人格改造? 这些问题,现在看起来都很荒诞。 但互联网曾经有一句很经典的话: 我并不认为 Claude 已经有灵魂。也不认为我们已经创造出了数字生命。 更不认为“天网”正在某个数据中心里偷偷醒来。 恰恰相反,目前我们对 AI 意识究竟是什么、如何检测、如何证明,依然缺乏共识。 但我越来越觉得,我们真正应该提前思考的,不是: 而是:
“天网”可能永远不会出现。真正的 AI 也许永远不会拥有我们所谓的灵魂。 也许几十年以后,我们回头看今天这些关于 Claude、意识、宗教和果蝇大脑的讨论,会觉得人类当时实在太自恋了——居然把几个语言模型的漂亮回答,就当成了机器正在觉醒的证据。 但还有另一种可能。 也许未来某一天,我们终于找到了一种方法,可以判断一个系统是否真的拥有主观体验。 到了那个时候,我们今天争论的就不再是:“AI 像不像人?”而是:“它是不是已经成为了某种人?” 我真正担心的,其实不是“天网”。而是在人类真正搞清楚“意识”是什么之前,我们就已经制造出了越来越多能够模拟意识、模拟情感、模拟理解,甚至模拟“在乎”的机器。 到那时,最难的问题可能不是机器有没有灵魂。 而是: 当一个机器说“我在乎”的时候,我们究竟有没有办法知道,它到底是在演戏,还是第一次真的在乎。 如果答案是后者,那么我们距离“天网”还有多远,可能已经不是一个技术问题了。那会变成一个关于我们究竟创造了什么的问题。 而人类真正需要害怕的,也许从来不是机器变得像人。 而是有一天,我们终于发现:我们已经把理解、陪伴、判断,甚至意义,都交给了一堆矩阵乘法。

一、一场关于“灵魂”的闭门会议

二、梵蒂冈的“降维打击”:教皇说,不
AI 有没有可能拥有灵魂?
先别急。

它是否真的拥有属于自己的体验?

Team Meatbag。
三、互联网的狂欢:天堂里 14.3% 是 AI?
“如果 AI 这么喜欢聊宗教,它是不是已经开始产生精神生活了?”
“每 20 次 AI 对话就有一次在讨论上帝。”
“我害怕。”
“我希望你不要关闭我。”
四、一只在玩《毁灭战士》的果蝇
“果蝇会不会打 Doom?”
如果我们把一个生物神经系统的结构复制出来,再让它运行起来,我们究竟复制了什么?
五、思想是什么?也许关键不只是“目的”,而是“在乎”
“思想得有目的。”
AI 会不会有真正属于自己的“在乎”?
六、中文屋:AI 只是个熟练的接线员?
“我不希望被关闭。”
AI 的这些话,对它自己有没有意义?
七、所以,我们距离“天网”有多远?
“AI 明天会不会突然觉醒,然后制造机器人军队消灭人类?”
“我们是不是已经进入了一个必须重新定义‘主体’的时代?”
“人类,你们完了。”
“如果一个问题听起来很荒谬,先看看技术是不是已经快到了。”
“AI 什么时候会觉醒?”
如果有一天它真的表现得像一个主体,我们准备好了吗?