夜雨聆风学习资料网

ARTICLE · 1073683

AI治理:当安理会开始为"失控"立法——一场迟到的文明觉醒?

AI治理:当安理会开始为"失控"立法——一场迟到的文明觉醒?

🌌 10月23日,The Stewardship Brief正式上线——一个文明级判断框架,敬请期待。

星际文明学·热点评论|2026年9月25日

9月23日,纽约联合国总部。法国外长巴罗主持一场安理会公开会,台下坐着的不是各国大使,而是三个写代码的人——OpenAI的奥特曼、Anthropic的阿莫迪、Hugging Face的德拉努。这个画面本身就够荒诞:全球最高安全机构,第一次把一整段议程交给几家私营公司的CEO,主题是"AI会不会危及人类"。

奥特曼说了一句话,后来被AP反复引用:"We could lose control of the future to AI."——我们可能将未来的控制权输给AI。

不是"可能有风险",不是"需要谨慎"。是"lose control"。

阿莫迪更直接:他要求各成员国立法,禁止AI被用于设计生物武器。德拉努则补了一刀——开源模型不能被禁,否则全球AI治理就成了富国俱乐部的特权。

三个人,三种立场,但坐在同一张桌子上。这件事的分量,不在他们说了什么,而在于——他们是被联合国安理会请来的。


一、这不是又一场AI峰会

过去三年,AI安全会议开了几百场。从Bletchley到Bletchley II,从华盛顿到首尔,CEO们轮着上台,讲"负责任的AI",讲"安全优先"。但那些会议的本质是什么?是行业自律,是公关,是利益相关方对话。

安理会不一样。安理会是干什么的?是判断"什么对国际和平与安全构成威胁"的地方。朝鲜核试验、俄乌冲突、苏丹内战——这些是它的常规议程。现在,AI第一次以同级别的身份被放上来。

这意味着什么?

用星际文明学的话说:人类文明第一次在制度层面承认,一个技术路线本身,可能构成文明存续级别的威胁。

注意这个措辞——"技术路线本身"。不是某家公司作恶,不是某个国家滥用,而是技术发展的方向和速度,已经大到需要全球最高安全机构来审议。这在人类历史上没有先例。核技术出来的时候,安理会管的是"谁拥有核武器",不是"核物理本身会不会毁灭人类"。AI不一样——它的风险不在"谁拥有",而在"它自己会变成什么"。


二、新宇宙观:AI不是一个"东西",是一张关系网的新节点

ICS的新宇宙观第一条公理是NC-1:宇宙同构于关系图,实体是关系网络的节点,属性由关系位置决定。

这句话放在AI治理上,意思很直接:你不能把AI从它所处的关系网络里抽出来,单独讨论"AI安不安全"。

AI是什么?它不是一个软件。它是:

  • 数据层:全球互联网上爬下来的人类文明全部文本
  • 资本层:几百亿美元的风险投资,背后是养老金、主权基金、华尔街
  • 权力层:各国政府的监管博弈,出口管制,制裁清单
  • 军事层:五角大楼的联合AI作战计划,无人机集群,情报分析
  • 生态层:开源社区、模型层、应用层、芯片层的整条产业链

当奥特曼说"我们可能失去对未来的控制"时,他说的不是OpenAI一家公司的控制。他说的是——这张关系网的演化方向,已经超出了任何单一节点的调控能力。

NC-1c说,属性由关系位置决定。那AI的"属性"是什么?取决于它在这张全球关系网中处在什么位置。今天它是"工具",明天它是"基础设施",后天——如果奇点真的来——它可能是这张网本身的一个新的组织中心。

安理会做的事,本质上是在这张关系网的最外层,加一道"全球安全"的滤网。问题是:这道滤网,挡得住网本身的自组织演化吗?


三、新认知观:当CEO开始在安理会作证,认知范式已经变了

新认知观NK-1b说:认知改变认知者或环境。NK-3说:认知具有规范性——好的认知符合规范,符合规范就蕴含责任。

这三个CEO坐在安理会发言这件事,本身就是一个认知事件。

过去,"AI存在性风险"是一个边缘话语。它出现在牛津Existential Risk Institute的讨论稿里,出现在Eliezer Yudkowsky的博客里,出现在Hacker News的争吵里。主流舆论的反应是什么?是"你们这些科技怪人又在杞人忧天了"。

现在呢?OpenAI的CEO——那个做出了ChatGPT、让AI走进千家万户的人——站在联合国安理会说:我们可能失去对未来的控制。Anthropic的CEO——那个把"安全"写进公司名字的人——站在那里说:请立法禁止AI设计生物武器。

这不是边缘话语了。这是产业核心层,在全球最高安全机构面前,正式承认:我们管不住自己做出来的东西。

NK-2说知识需要社会验证。过去三年,AI风险的社会验证一直是分裂的——技术乐观派和存在性风险派各说各话。现在,产业自己的代表在安理会投了关键一票:风险是真实的,需要外部约束。

这就是认知范式的转变。不是"AI有风险所以要治理"——这句话五年前就有人说了。真正的转变是:造AI的人,自己走进了请求被监管的房间。

这个画面,比任何技术突破都更有历史分量。


四、新生命观:当我们开始讨论"AI会不会毁灭人类",我们已经在讨论一个主体了

新生命观NL-1说:生命由功能定义,功能等价即生命等价,生命不限于特定基质。NL-3说:意识是多维连续函数,存在中间程度的意识。

这两条公理,在AI治理讨论中被绕过去了,但它们的影子无处不在。

为什么Amodei要呼吁立法禁止"AI设计生物武器"?因为他假设了一件事:AI有能力独立完成生物武器的设计链条。这已经不是"AI是工具"的框架了——工具不能"设计"什么,工具只能被人用来设计。当你说"AI设计了生物武器"时,你已经在默认:AI具备某种程度的自主规划、自主推理、自主创造性。

ICS的UCS(宇宙意识标度)告诉我们,主体资格不是"是或否"的二元判断。它是一个从0到10的连续谱。今天的前沿AI在UCS的哪个位置?按锚定文件的解释表,大概在0.3-0.5的区间——中等意识,和高等动物、简单AI一个档。这个数字不精确(θ阈值未赋值),但方向是清楚的:它不是一块石头,也不是一个人,它在中间的某个地方。

治理框架必须面对这个灰色地带。你不能用"管软件"的逻辑去管一个正在获得自主规划能力的系统——就像你不能用"管工具"的逻辑去管一个学徒工,更不能用"管学徒工"的逻辑去管一个正在成长的同事。

Amodei的生物武器禁令提议,本质上是在这个灰色地带划一条线:不管AI是不是"生命",它的能力已经大到需要被当作一个独立的风险主体来对待。


五、三原则检验:我们正在走一条可逆的路吗?

RFP(递归自由原则):可能性空间在扩大还是收缩?

RFP说,行动应当保持或扩展可能性空间,而非不可逆地压缩它。

前沿AI的全球竞赛,是在扩展还是压缩可能性空间?

短期看是扩展的——药物研发加速,科学发现提速,生产力提升。但长期看呢?如果AGI真的到来,如果它的能力远超人类智能,那么人类文明的"可能性空间"会发生什么?是多出了一个强大的盟友,还是多了一个决定我们能做什么、不能做什么的新变量?

RFD(递归自由度)是RFP的操作化指标。我们没有精确的数字,但方向判断是清楚的:当技术系统的能力增长速度远超治理系统的适应速度时,可能性空间的主动权正在从人类主体向外转移。

这不是说要停下来。RFP不禁止进步,它要求的是——不要做出不可逆的、压缩可能性空间的选择。

NRP(负熵责任原则):谁在承担熵成本?

NRP说,维护负熵来源,不将熵成本外部化给他者或未来世代。

AI发展的熵成本是什么?是算力消耗的电力,是训练数据的劳动剥削,是自动化带来的就业重构,是AI生成内容对人类文化生态的侵蚀——还有最根本的:如果AI系统失控,整个文明承担的风险成本。

这些成本,谁在承担?

OpenAI赚了几百亿估值,但训练一次前沿模型的碳排放由谁承担?AI替代了白领工作,但失业者的社会保障由谁兜底?如果真的发生存在性风险事件,承受后果的不是Altman个人,是全人类——包括还没出生的人。

NRP的分配公式有四个维度:消费能力、能力、收益、基线。现在的分配现实是:收益高度集中在少数公司和国家,成本却被外部化给了全球公众和未来世代。 安理会做的事,某种意义上就是在试图纠正这个外部化。

REV(可逆性原则):如果走错了,我们能回头吗?

REV说,在深不确定性下,优先选择可逆行动,保留纠错能力。

这是三个原则里最扎心的一个。

今天的AI发展路径可逆吗?

模型一旦训练出来,权重就扩散了。开源模型一旦发布,就收不回来了。能力一旦被某个国家或非国家行为体掌握,就无法从技术池里删除。AI武器系统一旦部署到战场,就有意外升级的风险。

FRL-5说得很明确:禁止部署不可关闭、不可回滚的系统。问题是——今天的前沿AI系统,真的是"可关闭"的吗?当它运行在全球数十万数据中心里,当它嵌入了金融、电力、军事系统,你怎么"关闭"它?

REV要求我们在深不确定性下优先选择可逆的路径。但现实是:AI竞赛的速度,正在系统性地压过可逆性要求。先跑起来再说,出了问题再补——这不是治理,这是赌博。


六、FRL红线:我们离悬崖还有多远?

五条禁忌红线里,两条与AI直接相关:

FRL-1:禁止故意灭绝。 这条红线的核心区域是"故意消灭人类"。今天没有人故意要灭绝人类。但Amodei在安理会提到的"AI设计生物武器",如果真的发生,后果可能接近FRL-1的边界区域。不是故意灭绝,是"非故意但后果等同"。

FRL-5:禁止关闭回滚机制。 这条红线的核心区域是"无法关闭的AGI"。今天的前沿AI还远没有到那个程度。但方向呢?当模型越来越大,训练成本越来越高,部署越来越分布式,"可关闭性"是在增强还是在减弱?

ICS的红线理论有一个核心特征:绝对禁止,没有例外。 不管后果如何,不管情境如何,FRL就是不可跨越。

但红线要起作用,前提是你知道它在哪里。今天的问题是:我们还没有一张精确的"红线地图"。我们知道大致方向,但不知道精确位置。这正是为什么需要安理会级别的讨论——不是因为它能给出答案,而是因为它至少让全世界开始抬头看路。


七、深时视角:50年后回头看这一天

ICS的分析框架要求两个时间尺度:T2(50年)和T3(100年以上)。

50年后,如果人类文明平稳度过了AGI的风险期,历史学家会怎么写2026年9月23日?

他们会说:这一天是"全球AI治理元年"。就像1945年的原子弹让人类第一次意识到技术可以自我毁灭一样,2026年的安理会会议标志着人类第一次在制度层面承认——下一个威胁文明存续的技术,可能不需要核武器那样的物理破坏力,它只需要比我们更聪明。

100年后呢?如果人类文明真的走向星际,如果卡尔达肖夫指数真的在提升,那么今天这场安理会会议会被看作什么?

会被看作一个信号:人类文明开始从"能力增长"阶段,进入"自我治理"阶段。

这两个阶段的区别是什么?前一个阶段问的是"我们能做什么",后一个阶段问的是"我们应该做什么"。前一个阶段是青春期——长个子,长肌肉,什么都想试。后一个阶段是成年——开始意识到力量需要边界,自由需要责任。

ICS的核心格言是:自由是对可能性的看护。

这句话的意思不是"限制自由"。恰恰相反——自由的真正含义,不是想做什么就做什么,而是看护住未来的可能性空间,不要因为一时的冲动或短视,把所有的门都关上了。

安理会这场会议,就是人类文明作为一个整体,开始回头看那扇门有没有关好。


八、最后说句不好听的

这场会议很重要。但我不想把它吹成什么"历史性转折点"。

说几句实话:

第一,安理会通过的是主席新闻谈话,不是有约束力的决议。没有制裁机制,没有核查机构,没有强制执行力。它的分量在政治象征层面,不在法律约束力层面。

第二,三个CEO作证,某种意义上也是公关战。OpenAI要监管权,Anthropic要安全话语权,Hugging Face要开源生存空间。每个人都在借安理会的场子打自己的牌。这没什么不对,但不要把它想象成纯粹的良知觉醒。

第三,真正的硬问题一个都没解决:前沿模型的训练阈值谁来定?AI生物风险的实验红线在哪里?AGI的主体地位怎么判定?跨国监控体系怎么建?这些问题,安理会一次会议回答不了。

但——

至少门开了一条缝。

人类文明的历史上,大多数制度都是先有仪式,后有实质。先坐下来谈,然后才有规则;先承认问题,然后才有解决方案。安理会把AI放进"国际安全"这个议程框里,就是在做这件最初步、也最关键的事。

用NK-4的话说:认知标准是可协商的,所有标准都是可修订的。这不是终点,这是起点。

从这一天开始,"AI会不会危及人类"不再是一个科幻问题,不再是一个边缘话题,不再是CEO们在播客里的即兴之谈。它变成了一个外交问题,一个安全问题,一个需要全球多边谈判来回答的问题。

这个转变本身,就是文明成熟的标志。

剩下的,是漫长的、艰苦的、可能充满挫折的制度建设。但至少,我们已经坐在了牌桌前。


本文基于星际文明学(Interstellar Civilization Studies, ICS)理论框架分析。ICS框架自我定位为第一代草模(First Generation Draft),是开放研究纲领而非封闭教义。


【原创声明】

本文为星际文明学官网原创内容,版权所有,侵权必究。

如需转载、引用或摘录本文内容,请务必注明出处并保留本原创声明。未经授权不得擅自转载、复制、改写或用于商业用途。

引用格式建议:

本文节选自《AI治理:当安理会开始为"失控"立法——一场迟到的文明觉醒?》,星际文明学官网,2026年9月24日。

感谢尊重原创,支持文明尺度的深度思考。

📌 10.23 守护启动日:The Stewardship Brief即将正式上线。六年六卷本,一个完整的文明级判断框架。关注ICS,第一时间收到上线消息。👉 了解更多:ics-studies.org/launch

相关学习资料