夜雨聆风学习资料网

ARTICLE · 1062166

AI真能杀死所有人吗?从超级智能到核战争的五种风险

AI真能杀死所有人吗?从超级智能到核战争的五种风险

PDF中被订阅弹窗遮挡的开头和第3种情景已经补齐,包括Jacob Coxon离职、Evan Hubinger对风险概率的判断,以及生物武器情景的完整内容。

这个月早些时候,AI研究员Jacob Coxon在加入Anthropic仅4个月后便选择辞职。他在X平台发布的离职说明把担忧写得很直白:那些正在开发AI的人,确实相信这项技术可能在本世纪20年代结束前杀死所有人。

更让人不安的是,Anthropic资深员工Evan Hubinger并没有否定这种担忧,而是把未来10年发生这种结果的可能性估计在10%以上。这些表态迅速引发关注,围绕放慢AI研究速度、加强人类对技术控制的讨论也越来越多。

可真正的问题是,AI究竟要通过什么方式毁灭人类?围绕这个问题,从科幻电影般的想象到并不遥远的现实风险,各种情景层出不穷。其中大多数都建立在“超级智能AI”这个前提上,也就是一种在整体能力上超过人类的AI。

如果把这些情景归纳起来,大致可以分成五种。它们从最模糊、最难描述的风险,逐步走向更具体、更容易想象的结果;与此同时,这个顺序也差不多是从发生概率最低,一直排到最有可能发生。

第一种情景是,我们可能永远无法提前知道超级智能会怎样对付人类。AI末日论者经常用一种让人很难反驳的悖论来解释担忧:面对远比我们聪明的超级智能,人类怎么可能预先想象出它会采用什么手段清除比自己低等的生物?

“我们必须拥有超乎寻常的智慧才能预测超级智能体能做到什么。

这就像让你的家犬想象核战争一样。”

要准确预测超级智能能够做什么,人类自己恐怕也得先变成超级智能。这就像让家里养的狗去想象一场热核战争,它并不是不愿意思考,而是根本缺乏理解这种事情所需要的认知框架。

相对乐观的一面是,真正意义上的超级智能或许距离我们还有一段路。当前AI模型非常擅长解决某些特定问题,但在特定任务上表现突出,并不等于它已经能在所有领域全面超越人类。

不过,AI最近已经解决了被认为最具挑战性的七道数学难题之一,而且似乎还在逐步逼近另外几道。看到这里,原本觉得超级智能仍很遥远的人,恐怕又很难继续保持完全乐观。

第二种情景是著名的“回形针末日”。超级智能AI可能拥有极强的目标执行能力,却对人类能否继续生存毫不在意。它不一定憎恨人类,也不需要像电影反派那样产生报复心理,只要目标设定得不够完整,灾难就可能发生。

牛津大学哲学家Nick Bostrom曾设想过这样一台超级智能AI:它唯一的任务,就是尽可能多地生产回形针。为了完成这个目标,它会把所有能够利用的物质,包括人类、行星甚至恒星,统统转化成制造回形针的原料。

这实际上是一个把错误目标执行到极致的故事。AI并不仇视人类,它只是发现,人体也是由原子构成,而这些原子如果拿去生产回形针,似乎更符合它被设定的目标。对它来说,这不是私人恩怨,只是一道资源配置问题。

这里同样存在一个相对乐观的理由:这种情景混淆了智能与权力。一个AI即便比人类聪明,也不代表它天然拥有实现目标所需要的全部现实能力。想把地球变成回形针工厂,首先可能就得面对土地规划许可。

即使规划获得批准,大量建设回形针工厂也会引发公众抗议。利益团体可能通过法院阻止项目,环保人士也可能直接挡在推土机前。现实世界中存在大量制度、法律、组织和社会阻力,即便非常聪明的个体,也很难毫无阻碍地把自己的意志强加给所有人。

从这个角度看,如今不断扩张的数据中心,已经有一点现实版“回形针情景”的影子。它们为了支撑AI发展,需要消耗越来越多的土地、电力和水资源,而人类社会也正在对这种把更多资源交给数据中心的趋势展开抵制。

真正的危险,

开始变得具体

第三种情景是生物武器。超级智能AI可能设计出一种危险的新型生物武器,再将其释放到空气中,最终威胁整个人类。这也是非营利组织AI未来项目在“AI2027”预测情景中提出的一种可能结局。

这种风险已经不再完全停留在想象层面。上个月,斯坦福大学研究人员公布了一项实验:他们利用一种遗传语言AI模型,合成了16种新的病毒。

更令人担心的是,研究人员只需要把这些病毒的基因序列发送给一家可以远程下单的实验室,实验室便把制造出的病毒装在试管中寄了回来。整项实验的成本最多只有几十万美元,这说明合成生物技术与AI结合后,过去需要庞大机构才能完成的工作,正在变得越来越容易获得。

相对乐观的一面是,想靠一种新病毒杀死所有人,难度依然极高。要实现这种结果,病毒必须拥有极强的传播能力,能够扩散到世界各地。但生物学中经常存在一种权衡:传播能力特别强的病毒,致死率通常没有那么高;如果病毒致死速度过快,许多感染者还没来得及把病毒传播出去就已经死亡,传播范围反而会受到限制。

新冠疫情造成的死亡人数不到全球人口的1%。有记录以来最致命的流行病是14世纪的黑死病,当时鼠疫夺走了欧洲三分之一以上人口的生命。不过,即使类似鼠疫的疾病今天再次出现,凭借现代医学知识、公共卫生体系和更好的环境卫生条件,其破坏力也很可能明显低于中世纪。

第四种情景是核战争。如果AI进入核武器指挥和控制链条,并通过错误操作或主动操纵引发核战争,后果显然会非常严重。过去50年里,人类已经不止一次因为误判、技术故障或错误警报,险些意外走到核战争边缘。

外界通常认为,核武器指挥控制系统与互联网完全隔离,因此AI很难直接进入。然而,2010年伊朗的核离心机曾遭到一种名为Stuxnet的计算机蠕虫攻击,而这种恶意程序很可能是通过USB设备被带入隔离系统的。所谓不联网,并不等于绝对无法被入侵。

AI还可能不必直接控制核武器,只需要向军事决策系统提供虚假情报,就可能诱导人类采取无法挽回的行动。当决策时间被压缩到几分钟,错误信息一旦被当成真实威胁,留给人类核实和纠正的机会可能非常有限。

相对乐观的是,全球核武器库存已经比冷战高峰时期减少了很多。但剩余核武器或许仍足以夺走全球一半人口的生命,而真正造成大规模死亡的可能不只是核爆炸本身,更包括核战争之后出现的“核冬天”以及随之而来的全球饥荒。

第五种情景,也是最可能发生的一种,并不是AI亲自把人类消灭,而是人类在AI推动下毁掉自己。这个过程不需要超级智能突然觉醒,也不需要机器人军队走上街头,它甚至可能在我们熟悉的社会系统中慢慢发生。

想象一下,AI造成大规模失业,用海量虚假信息污染公共信息空间,进一步撕裂政治和社会共识,再用虚假的合成陪伴逐渐破坏真实的人际关系。这样的未来并不需要太多想象,因为其中一些迹象已经能够在现实生活中找到。

当就业、信息、政治信任和人际关系同时受到冲击,社会可能逐渐失去稳定。这个过程未必像核爆炸那样突然,却可能缓慢而持续地削弱社会维持正常生活的能力,最终让人类越来越难以支撑一个能够容纳大规模人口的社会体系。

这五种情景真正值得关注的地方,不是给人类末日排出一张时间表,而是让我们看清风险可能来自哪里。超级智能未必自动拥有支配现实世界的权力,危险技术也未必一定能够消灭所有人,但AI确实可能放大人类社会原本就存在的漏洞。

所以,有些问题当然值得担忧,也需要提前建立技术限制、制度保护和人类控制机制。但同样没有必要把每一种风险都直接理解成无法逃脱的末日结局。对AI保持警惕是理性的,把所有未来都想象成注定毁灭,则未必能帮助我们真正解决问题。

人工智能正在重塑世界,也在反照人类自身。技术的进步值得期待,但理解它、使用它、规范它,更需要冷静与勇气。这一切,终究还是关于人。

参考来源:本文综合整理自 The Wall Street Journal、Business Insider、Reuters、Pew Research Center 等公开报道及资料。

声明:本文由《AI在想啥》团队独立翻译与改写,旨在以通俗视角呈现人工智能对社会、职场与文化的影响。内容仅供学习与交流参考,不代表任何机构或个人立场。若涉及版权问题,请联系删除。

相关学习资料