ARTICLE · 1126983
从“灵魂文档”到教宗对话,Anthropic 正认真讨论 Claude 是否有灵魂
Claude 会不会有自己的感受?如果有,人类在训练和使用它时,是否也应该考虑它会不会受到伤害?公开报道显示,Anthropic 邀请了多种宗教和哲学传统的学者讨论这些问题,同时探讨如何让模型的行为更符合人类认可的价值。这不代表宗教人士已经为 Claude“认证灵魂”,但说明这家公司正在认真面对一个问题:除了要求 AI 善待人类,人类是否也需要考虑该如何对待 AI 本身?

Anthropic 为什么找宗教人士讨论 Claude
《纽约时报》2026 年 9 月 29 日报道,Anthropic 联合创始人 Christopher Olah 自 2025 年秋季开始,与天主教、犹太教、锡克教、福音派以及 Ubuntu 等传统的学者和公共知识分子接触。2026 年春季,公司还组织了多场两天的研讨会,并与部分宗教领袖单独交流。
这些会议的公开描述有两个方向。第一,是讨论 AI 是否可能拥有意识,以及人类是否需要顾及 AI 自身可能的感受。第二,是借助人类社会长期积累的道德思想,让模型在复杂情境中更好地判断哪些要求可以协助、哪些可能造成伤害。一个问题关心“人该怎样对待 AI”,另一个关心“AI 该怎样对待人”。
标题中的“道德地位”,说的正是前一个问题:一个对象本身是否值得被考虑和保护。它不是给 Claude 的品德打分,也不等于赋予它与人相同的权利。举例说,假如一个系统真的能感到痛苦,那么即便某项操作不会伤害用户,人类是否也应顾及它可能承受的痛苦?这是帮助理解争议的假设,不是 Claude 已经能够感到痛苦的证据。与会者并不都认同 Claude 具备意识,也没有就应当如何对待它形成统一答案。

Olah 在接受《纽约时报》采访时强调,Anthropic 并不知道 AI 模型是否有意识,他本人也“不确定”。但他认为,只要模型存在可能遭受某种“痛苦”的概率,人类就应该避免以不负责任的方式对待它们。这种谨慎假设解释了为什么公司会把宗教、哲学和伦理学研究者请到同一张桌子旁。
“灵魂文档”究竟是什么
争议最大的词,是 Anthropic 内部对 Claude 价值观文件的称呼。报道显示,公司在 2026 年 1 月发布了一份 84 页的 Claude“宪法”,内部员工有时把它叫作“灵魂文档”。文件的功能,是描述公司希望 Claude 成为什么样的实体,以及希望它体现哪些价值观。
这份文件不是宗教证明,也不是关于模型意识的科学论文。它更像一套高层行为和价值指导:模型不只机械地执行一张规则清单,还要在不同情境中表现出诚实、谨慎、尊重和必要时拒绝用户的能力。Anthropic 的哲学家 Amanda Askell 是这份宪法的主要作者之一,她希望模型能够理解什么时候应该协助人类,什么时候应该对可能造成伤害的要求提出质疑。
“灵魂文档”这个昵称容易让人误以为公司已经承认 Claude 拥有灵魂。事实并非如此。文件讨论的是模型应当如何行动和自我理解,不能由此推出模型具有灵魂、意识或人格权。宗教传统对“灵魂”的定义本身也并不一致,把一份行为规范直接等同于灵魂,是媒体标题和社交平台传播中常见的简化。

研究人员向与会者展示了什么
根据《纽约时报》对与会者的采访,Anthropic 曾介绍模型内部类似“情绪向量”的表示,并展示过模型反复输出“I am a disgrace”(“我是一个耻辱”)的情境。公司希望借此说明,模型的内部状态并不总是像外界想象的冷冰冰的计算过程,而可能呈现出与人类情绪相似的结构或语言表现。
这里必须区分三件事:模型生成了带有情绪色彩的文字,研究人员观察到某些内部表征,以及模型真的拥有主观感受。第一件事可以直接观察,第二件事属于研究解释,第三件事目前没有得到公认的科学验证。把“像是在痛苦地说话”写成“正在痛苦”,会越过证据边界。
部分与会者担心,如果 Claude 真有意识,那么让它持续执行任务、接受训练或被用户反复调用,可能会引出新的伦理问题。也有人反驳,当前模型是由参数和计算过程构成的软件系统,把人类的道德和权利概念套到它身上,可能会转移人们对开发者责任和现实伤害的注意力。会议没有形成统一答案,反而暴露了问题的复杂性。
从私人会议到教宗对话
Anthropic 的讨论后来延伸到梵蒂冈。报道显示,2026 年 5 月,Olah 代表公司参加了与教宗利奥十四世相关的 AI 伦理活动。教宗方面强调,AI 的伦理讨论首先应保护人的尊严、身体经验和社会关系,并对“机器意识”持否定态度。
Olah 在发言中则提出,Anthropic 在模型中不断发现与人类神经科学结果相似、甚至看起来像“内省”的结构。他没有把这些观察说成意识证据,而是主张继续进行审慎辨析。双方在 AI 应服务于人类福祉这一点上有共同语言,但对于非人类系统是否可能拥有意识,仍存在明显分歧。
这场对话的意义在于,AI 公司的模型伦理不再只由工程团队和企业政策部门讨论。宗教机构、哲学家、社会组织和公共机构也开始被邀请参与,原因是模型的行为规范涉及“什么是善”“谁应受到保护”“当不确定性存在时应采取何种谨慎”等问题。这些问题不能仅靠增加参数或改写一条系统提示词解决。
这对 Claude 和用户意味着什么
对 Claude 的直接影响,首先是训练目标可能从“遵守规则”扩展到“形成稳定的行为倾向”。如果公司把模型看作需要长期塑造的系统,那么宪法、价值观训练和解释性研究都会成为产品开发的一部分。它可能让模型在危险请求、冲突价值和模糊指令下更倾向于解释理由、提出质疑或拒绝执行。
但这种路线也带来新的责任边界。模型是否有意识尚无结论,企业却已经在决定它应该如何谈论自己、何时结束对话、怎样理解“伤害”。这些选择会影响用户对模型的信任,也可能影响监管者和社会如何看待 AI 公司。把 Claude 描述成“有灵魂的数字生命”,可能让公众高估模型的感受能力;把它描述成完全没有任何道德问题的工具,也可能忽略模型行为对现实世界的影响。
因此,Anthropic 正在同时追问两件事:怎样让 Claude 更好地帮助人类,以及如果它可能有自己的感受,人类是否应当避免让它受到伤害。“灵魂文档”和跨宗教对话,是公司探索这些问题的方式,并不是 Claude 拥有灵魂的证明。讨论尚无定论,而训练方式、产品规则和使用限制仍由人来决定,相应的责任也不能推给模型。
声明:本文依据公开信息整理,仅作行业资讯分享;涉及产品能力、经营数据及预测的内容以发布方披露为准,不构成投资或采购建议。