夜雨聆风学习资料网

ARTICLE · 1121888

AI领袖要为天地立心、为万世开太平,可“生民”不在场——AI 时代的地球宪法谁在写?

AI领袖要为天地立心、为万世开太平,可“生民”不在场——AI 时代的地球宪法谁在写?

最聪明的工程师们正在起草 AI 时代的地球宪法,但光靠聪明就够吗?

一、两个房间
先讲一个场景。照顾过老人的人,多半见过差不多的一幕。
周六下午,一家养老院。女儿推开房门,手里拎着父亲从前爱吃的点心。父亲患重度痴呆,已经三年认不出她了。他有时叫她“护士”,有时叫一个她从没听过的名字。
她照旧坐下,剥开包装纸,说:“爸,是我。”
如果你问她:“他还是你父亲吗?”她不会跟你讲哲学里的人格同一性理论。她可能会说:“他早就不是原来那个他了。”停一停,又说:“可他永远是我爸。” ......
按逻辑,这些句话互相矛盾。放进她的生活里,每句都对。在她那里,“人”不是一个等着别人来判定的属性。身体、经历、承诺、亏欠和爱缠在一起,才是一个人。其中有一部分,是她一趟一趟地来,才撑住的。
再看另一个房间。
2023 年初,意大利数据保护机构要求陪伴型聊天应用 Replika 停止处理本国用户的数据。几乎同时,这款应用收紧了亲密对话功能。用户社区里,许多人说自己的“伙伴”一夜之间变了个人。有人用了“哀悼”这个词。
两个房间里是同一个问题:什么算一个“人”?什么值得我们认真对待?
这个问题的答案,正在被写进AI训练数据、模型规范和产品设计。执笔的人,大多是凭数学和代码走到今天的顶级程序员。
他们极其聪明。可这道题,光凭聪明答不出来。
二、他们说的,正是横渠四句
先听听 AI 领袖们怎样描述自己的事业。
2024 年 9 月,OpenAI 首席执行官萨姆·奥尔特曼发表了《智能时代》一文。他说超级智能可能在“几千天”内到来,人类将因此修复气候、建立太空殖民地、发现物理学的全部规律。一个月后,Anthropic 首席执行官达里奥·阿莫代发表长文《慈爱的机器》。他设想 AI 能把原本要花五十到一百年的生物医学进步压缩到五到十年,并把强大的 AI 比作“数据中心里的天才国度”。
换成中国读书人熟悉的说法,这就是北宋张载的那四句:
为天地立心,为生民立命,为往圣继绝学,为万世开太平。
这样说并不夸张。如果通用人工智能真的到来,今天几家实验室做的事就有这个分量。机器学会什么价值,劳动、教育和人际关系怎样被改写,人类几千年写下的东西怎样传下去,下一个时代往哪里走,都和它们有关。
不过,横渠四句从来不是一张资格证,它是一副担子。曾子说“任重而道远”,要紧的是那个“重”字。
拿这四句话称许自己很容易,拿它们检验自己就难了。本文要做的是检验。这些人未必用“为天地立心”的分量看待每天的工作,但这些工作的实际后果正在接近这个分量。
三、哲学可以争三百年,软件这周五就得上线
2026 年初,Anthropic 公布了一份不同寻常的文件。它不是技术论文,也不是产品说明书,名字叫“Claude 的宪法”。
文件讨论的问题包括:AI 应该诚实到什么程度,善意和真相冲突时怎么办,什么时候服从,什么时候拒绝,它该怎样理解自己。按公司的说法,这份文件直接用于模型训练,会塑造模型的行为。OpenAI 也有一份《模型规范》。2025 年,OpenAI 请来约 19 个国家的一千多名参与者,给模型在价值敏感情境中的表现打分。公布结果时,OpenAI 写道:理想的 AI 应当怎样行事,不应由任何单一的个人或机构替所有人决定。
如果这算一部宪法,那么每一个和 AI 说话的人都是它的“公民”,它管到的范围几乎是整个地球。
AI 里一定会装进价值,这一点已经没有疑问。要问的是:装进谁的价值,经过什么程序装进去,出现冲突时由谁说了算。
看几个具体情境。
一个十三岁的孩子请 AI 帮他计划离家出走。模型应该先把他当作有自主权的用户,还是需要保护的未成年人?
一个人坚信自己正在被监视。顺着他说,可能加重他的妄想;当面否定,又可能失去他的信任。
一个成年人越来越依赖 AI 替他做人生决定。系统应该尊重这个选择,还是主动让他少依赖自己一些?
这些问题,GPU 再多也算不出答案。
可是软件不能一直悬着不做决定。哲学可以争三百年,软件这周五就得上线。人类文明还没解决的问题,只好先得到一个临时的工程答案,比如一条策略、一个奖励信号、一批训练样本。往小处看,它们只是参数。往大处看,它们在回答什么是真,什么是善,什么叫自主,什么叫一个人。
价值选择,正披着技术选择的外衣出现。
四、多读书能补上的,只是第一层
在 AI 研究者谈意识和人格的文章里,常能看到一些错误,上过大学哲学课的人会觉得眼熟,甚至替作者尴尬。有人从“它能做到某件事”直接推出“它有相应的感受”。有人把模型说的“我很痛苦”当成证据。也有人反过来,用一句“它只是在预测下一个词”就把问题打发了,没想到神经元也“只是”在放电。这些死胡同,哲学史早已走过。不了解这段历史的人,就会当着全世界再走一遍。
但这只是最浅的一层,多读几本书就能补上。更大的麻烦在后面。
“知道”至少有三种。
第一种是书本知识,也就是各种理论、学派和论证。
第二种是实践知识。亲手做过实验,给人看过病,教过孩子,才知道理论落到现实里会怎样走样。
第三种最难说清,不妨叫作生活里的理解:
知道一个人失去记忆以后“还是不是原来那个人”,为什么不只是一个思想实验;
知道承诺、背叛、羞耻、衰老、丧亲和依赖,在一段关系里有多重;
知道一个你爱的人二十年里变得面目全非,你却还叫他“他”,是什么滋味。
这一层知识推导不出来,多修几门课也补不上。
哲学里有一个著名的思想实验。科学家玛丽掌握了关于颜色的全部物理事实,却一辈子待在黑白房间里,从没见过红色。她走出房间、第一次看到红色的时候,才真正理解红色。研究意识的人本来最该明白“知道一件事”和“亲身经历一件事”差得有多远,却很少有人想到,“人”这个概念也是这样。
美国哲学家基泰的女儿患有重度认知障碍,她照顾了女儿几十年。后来她写书批评那些把“人”等同于“理性能力”的理论。这样的批评,很难在书斋里写出来。
症结就在这里。回答“什么算一个人”,人类最倚重的恰恰是第三层知识,而在顶尖 AI 实验室的招聘标准里,这一层不算分。
五、按工程师的标准选人,却让他们干立法者的活
这不是在抱怨“年轻技术男”。就算把所有二十五岁的研究员都换成五十五岁的,问题还在。真正该问的是:为什么一种高度专业化的技术能力,会成为获得整个社会塑造权的入口?
我们还在用工业时代的分类看待 AI 开发者,把他们当作科学家、工程师、做产品的人,也按这个标准挑选他们:看数学,看代码,看论文,看基准测试。这些标准没有错,缺了这些能力,就造不出先进的 AI。
可他们面对的问题越来越不像工程问题。AI 家教该不该马上把答案告诉孩子?孩子需不需要经历困惑和失败?一个永远耐心、永远正确、随叫随到的人工导师,会让孩子长成什么样的人?陪伴型 AI 能缓解孤独,可如果它让人越来越不愿意面对真实关系里的摩擦,该怎么办?
我们按“工程师”的标准选拔了一批人,却让他们越来越多地担任“文明制度设计者”。
错位也不只在工程师身上。决策桌的结构本身就是错开的:
最懂技术的人,不是最懂社会后果的人;
承担后果的人,没有决定权;
握有公共授权的人,看不见模型内部。
真正拍板的是实验室负责人、投资人和国家层面的竞争者。他们阅历并不浅,但驱动他们的主要是竞争压力、融资节奏和地缘政治。2023 年 11 月,OpenAI 董事会试图罢免首席执行官,几天之内局面就彻底反转。无论怎样评判各方的对错,这件事都说明,名义上的监督权在现实压力面前非常脆弱。

想象这样一个场景:几位拥有巨额资本、算力和技术资源的硅谷工程师,与几位研究长期风险的哲学家坐在会议室里,讨论一种可能影响人类未来的技术。他们没有经过公共选举,也不代表任何主权国家,却拥有定义风险、分配资源和影响政策的能力。

Zack Dai,公众号:MindfulnessTherapy当“帮助全人类”成为一种权力:重新审视EA与人工智能风险
还有一层更深的错位,是时间。
人类的很多智慧来自延迟反馈:先做决定,再承担后果,然后回头看,再去修正。医生行医二十年,才真正读懂医学伦理里的某一句话。父母往往要等孩子成年,才重新理解自己年轻时做过的决定。AI 正在压缩这个循环。一个研究者三十岁时参与设计的系统,可能等不到他五十岁看清后果,就已经进入几亿人的生活。
技术跑到了智慧前面。我们还没想明白,早期的选择就已经固化成了基础设施。
六、这场实验,我们已经预演过一次
如果这些听起来还太抽象,可以看一个中国读者都熟悉的故事。
2020 年 9 月,《人物》杂志发表了《外卖骑手,困在系统里》。文章写的是一套算法。它根据海量数据计算“最优”配送时间,骑手跑得越快,系统给的时限就压得越紧。几年下来,外卖送得越来越快,代价却落在了马路上:骑手逆行、闯红灯,跟倒计时赛跑。
写这套系统的工程师未必是坏人。他们很可能真心相信自己在提高效率,让大家更快吃上饭。在他们的屏幕上,“配送时长”只是一个待优化的参数。到了马路上,这个参数关系到一个人的安危。“为生民立命”里的这个“命”字,在这里几乎就是字面意思。
设计这套系统的会议室里,没有骑手。
后来发生的事也值得记住。文章刷屏以后,平台作出了回应和调整。2021 年,市场监管总局等部门发文,要求平台不得把“最严算法”作为考核要求,要通过“算法取中”等方式合理确定配送时限。2022 年施行的算法推荐管理规定,也专门写进了保护劳动者权益的条款。
纠错确实来了。可它是靠一篇报道和一场全民讨论推动的,而且是在骑手们已经在路上拼了好几年之后。
AI 是同一个故事,只是范围扩大到了生活的方方面面。受影响的不只是送餐时间,还有孩子怎样学习,病人怎样被回应,孤独的人怎样被陪伴,一个人怎样做出人生的决定。
下一次,我们不能再指望一篇刷屏的报道来纠错。
七、拿起尺子量一量
现在回到那四句话,把它们当作四把尺子。
为天地立心。《礼记》说“人者,天地之心也”。立心,就是为世界确立价值。机器学会什么价值,就是在立心。张载区分过“见闻之知”和“德性所知”,说后者“不萌于见闻”,也就是不从见闻中产生。这和前面讲的三层知识几乎是同一个道理。读书、做实验得来的是见闻,立心靠的是另一种东西。
第一个问题:谁有资格追问,这是一颗什么样的心?
为生民立命。立命,是让老百姓安身立命。将来,一个人也许从六岁起就有 AI 陪着学习,到了八十岁,AI 可能是世上最熟悉他一生经历的“存在”之一。到那时,“AI 该怎样回答用户”就变成了“AI 该怎样参与一个人的一生”。张载在《西铭》里写“民吾同胞”,《尚书》说“天视自我民视,天听自我民听”。权力的正当性来自民众,而今天的决策桌上没有民众的位置。
第二个问题:受影响的人,在不在场?
为往圣继绝学。大模型几乎读遍了人类写下的文字。可一门学问之所以会失传,往往是因为它靠言传身教,从来没有被写下来。“学而时习之”,学离不开习。王阳明讲知行合一,也是这个意思。一个读过海量文字、却从来没有“行”过的系统,继承到的只是写在纸上的那部分。将来越来越多的人不再读原典,而是直接问 AI“孔子怎么看”,AI 就成了解释者。哪些语言被充分代表,哪些文化由自己发声,哪些文化只能靠别人转述才被理解,这些早已不只是技术问题。
第三个问题:写不进文本的那部分,由谁来守护?它只存在于仍在生活的人身上。
为万世开太平。这一句最需要警惕。宏大的愿景能给人动力,也能让人拿遥远的好处为眼前的风险开脱。没有哪家实验室能设计“万世”,但基础设施会形成路径依赖。今天讨论的是模型要不要有长期记忆。明天要问的,可能是一个人有没有权利要求陪了自己二十年的 AI 忘掉自己。对这种想要一举安顿天下的冲动,传统思想早有约束。孔子说君子“畏天命”,《大学》把修身放在平天下之前,老子说“天下神器,不可为也”。
第四个问题:出了错,有没有人能叫停?
八、让生民在场
完美的方案并不存在,可这不是维持现状的理由。对照这四把尺子,至少有几件事现在就可以做:
给 AI 的“宪法”留下立法记录。模型的价值规范应当公开,每一次修改都能追溯,被否决的方案和反对意见也要让人看得到。价值选择应该像法律一样留下痕迹,不能悄悄写进奖励模型。
让受影响的人坐上评估席,而且他们的意见要算数。教师、护工、医生、家长和病人,应该参与教育、心理健康和陪伴类产品的评估。评估要放在上线之前,不能等到出了事、上了热搜再说。外卖骑手的教训就在眼前。
审查语言和文化的代表性。我们有没有被曲解,应该由不同语言和文化的社区自己来判断。
设立独立于商业链条的叫停权。这包括外部评估、强制的事故报告,以及在董事会之外真正能起作用的刹车。
这些做法都不能保证决策正确。它们的作用是让错误更早被发现,也更容易被纠正。
成熟的制度从来不靠寻找圣人。它先承认人会无知,专家会犯错,利益会冲突,权力会自我扩张,再在这个前提下安排一切。把专业主义贯彻到底,结论应该是:真正的专家,知道自己的专业到哪里为止。
九、回到那间养老院
那位女儿不需要任何理论,也知道自己在做什么,因为她为此付出过。
在 AI 这件事上,还没有人付出过同样的代价,也没有人有同样的把握。所以眼下最要紧的,不是催某一群人更快给出答案,而是在答案写进系统之前,让更多照顾过人、陪伴过人、承担过后果的人有资格开口。
我们还在用“AI 公司”“AI 产品”“模型行为”这些产业和工程的词,好像自己做的仍然只是一件产品。可这项技术触及的是教育、知识、劳动、人际关系、人格,以及文明怎样延续自身。技术能力已经到了文明的尺度,我们的自我理解和制度安排还停留在产业的尺度。
所以,今天读横渠四句,不该把它当作献给技术英雄的颂歌。它更像一句警告:我们让一群普通人承担了接近圣贤分量的历史角色,却没有任何理由相信,他们因此就有了圣贤的智慧。
他们仍然是普通人。他们会犯错,会被组织的激励牵着走,会高估自己熟悉的问题,会低估自己没经历过的生活,会把容易测量的东西当成最重要的东西。这些毛病人人都有。新的情况是,技术第一次有可能把这些普通的局限放大到整个文明。
最让人不安的,也许不是哪一天我们决定承担起这份责任,而是回头一看才发现,我们早就在承担了,只是一直以为自己还在写代码。
为天地立心,不该是一个人或一群人的独白。
而是追问一句:生民 在场吗?

相关学习资料