乐于分享
好东西不私藏

来自虚空的人类智慧 ——论人类对AI工具的掌握和运用

来自虚空的人类智慧 ——论人类对AI工具的掌握和运用

当碳基文明凝视硅基深渊

人类的智慧从何而来?这个问题困扰了哲学家数千年。如今,我们以另一种方式重提此问:当一台机器用2.15×10²⁵次浮点运算"学完"了人类几乎所有公开文本,它的"智慧"与我们的有何不同?本文将从大数据规模效应、智慧存储池、常识认知、能耗博弈、减量化生存,以及人类文明十个阶段对自然界的掌握程度,逐一剖析人类对AI工具的掌握与运用。

一、AI在处理大数据的规模效应:当"记忆"超越"理解"

人类文明自公元前3000年发明文字以来,便开始了数据积累的漫长旅程。但真正的爆发始于数字时代。根据IDC和Statista的统计,2010年全球数据总量仅约2 ZB(泽字节,1 ZB = 10¹² GB),到2020年已飙升至47-64 ZB,2025年预计达到175-182 ZB,2030年更将突破612 ZB。也就是说,未来三年人类创造的数据量将超过此前全部历史的总和

全球数据量增长轨迹(IDC / Statista)

  • 2010年:2 ZB
  • 2015年:16 ZB
  • 2020年:47-64 ZB
  • 2025年(预计):175-182 ZB
  • 2030年(预计):612 ZB
  • 2024-2026年三年间产生数据总量 ≈ 552 ZB,超过2023年前全部历史数据(约542 ZB)

AI的规模效应正是在这一数据洪流中诞生的。以GPT-4为例,据Epoch AI和OpenAI公开信息推算,其训练数据集包含约13万亿个token(约9.75万亿词),相当于整个英文维基百科(约46亿词)文本量的2000倍以上。模型参数量达到约1.8万亿(MoE架构,16个专家网络),训练计算量约2.15×10²⁵次浮点运算。

从GPT-1(2018年,1.17亿参数,5GB数据)到GPT-4(2023年,1.8万亿参数,13万亿token),短短五年间,参数量增长超过1500倍,训练数据量增长超过2600倍。Epoch AI的研究显示,自2010年以来,AI训练数据量大约每9-10个月翻一番,而AI计算量自2012年以来增长了30万倍

GPT系列规模演进

  • GPT-1(2018):1.17亿参数,5 GB数据
  • GPT-2(2019):15亿参数,40 GB数据(约40亿token)
  • GPT-3(2020):1750亿参数,45 TB数据(约5000亿token)
  • GPT-4(2023):约1.8万亿参数,约13万亿token,训练计算量约2.15×10²⁵ FLOPs
  • 训练成本:GPT-4单次训练云计算费用约6300万美元

这种规模效应的本质是什么?是"记忆"对"理解"的碾压式替代。AI不需要像人类那样在有限的脑容量内抽象出因果规律,它只需要在海量数据中发现统计相关性。当一个模型"读过"人类全部公开文本的2000倍时,它对语言模式的掌握已经超越了任何个体人类的认知极限——但这种"掌握"是基于概率拟合,而非真正的因果理解。这就是规模效应的深层悖论:越大越强,但越强越不透明

二、智慧存储池:人类集体认知的外化与凝结

在AI出现之前,人类智慧的存储介质经历了漫长演化:口语传说(数十万年)、文字书写(约5000年)、印刷术(约1000年)、电子数据库(约80年)、云计算(约20年)。每一种介质都在扩展智慧存储的规模和可及性,但也都受限于物理载体的容量与检索效率。

AI的出现,标志着一种全新形态的"智慧存储池"诞生。它不再是被动存储——如图书馆的书架或数据库的表格——而是一种活性存储:能够理解查询意图、跨领域综合、即时生成新组合的认知实体。换言之,过去人类存储的是"知识的尸体",AI存储的是"知识的活体"。

智慧存储介质的演进

  • 口语记忆:单体容量约10⁹比特(人脑长期记忆估计值),传播距离=声速
  • 文字书写:单卷容量约10⁵-10⁶比特,传播跨越时空但检索效率低
  • 印刷术:批量复制,文艺复兴后欧洲年均出版量从百册级升至万册级
  • 电子数据库:GB-TB级,全文检索,毫秒级响应
  • 大语言模型:万亿token级训练数据压缩为千亿级参数权重,可即时生成跨领域综合文本

这个智慧存储池的规模令人震撼。GPT-4的13万亿token训练数据,大致涵盖了人类互联网上可获取的绝大部分高质量文本——书籍、论文、代码、对话、新闻、百科。它以一种压缩的方式,将人类数千年积累的文明成果凝结为约1.8万亿个浮点参数。每一个参数都是对人类集体知识的一种"低维投影"。

但这里隐藏着一个关键问题:智慧存储池中存储的,究竟是"智慧"还是"信息"?如果将智慧定义为"对因果关系的深层理解与创造性运用",那么AI存储池中的更多是经过统计压缩的信息模式,而非真正的智慧。它知道"下雨天人们带伞"的统计关联,但不一定理解气压、湿度与降水之间的因果链条。智慧存储池的容量巨大,但其"智慧密度"可能远低于人类个体的深层认知。

三、人类对于常识的认知:AI无法跨越的鸿沟

常识(common sense)是人类认知的基石,也是最令AI头疼的难题。一个三岁小孩知道"杯子掉在地上会碎""水会往下流""你不能同时把同一个苹果给两个人"——这些看似 trivial 的认知,背后是数百万年进化赋予人类的具身认知(embodied cognition)能力。

人类的常识系统建立在五个基石之上:

  • 物理直觉
    :对重力、惯性、碰撞、空间关系的本能理解(婴儿3个月即具备)
  • 因果推理
    :从观察中自动提取因果链条的能力(幼儿2岁开始发展)
  • 社会认知
    :理解他人意图、情感、信念的"心理理论"(4岁左右成熟)
  • 类比迁移
    :将一个领域的经验迁移到新领域的能力
  • 具身体验
    :通过身体与环境交互获得的不可言传的隐性知识

AI在这五个维度上都面临根本性困境。它没有身体,无法体验物理世界;它的训练数据是文本而非物理交互,因此它的"常识"来自语言中的统计描述,而非真实世界的因果反馈。当一个大型语言模型说"火是热的"时,它并不"知道"热是什么感觉——它只知道"火"和"热"在文本中高度共现。

这正是AI领域著名的"莫拉维克悖论"(Moravec's paradox)的延伸:对人类容易的事(走路、识别物体、常识推理),对AI极难;对人类困难的事(高阶数学、海量记忆、复杂棋局),对AI反而容易。人类的常识是亿万年进化的免费馈赠,而对AI而言,它恰恰是最昂贵的缺失。

"人类花了几百万年进化出区分一杯水和一杯硫酸的能力——这对生存至关重要。AI花了几千亿美元的训练成本,却仍然可能在某些情境下建议你喝硫酸——因为它在某篇小说里读到过类似的描述。" 这种荒诞的可能性,正是常识鸿沟的生动写照。

四、能耗博弈:20瓦的奇迹与吉瓦级的代价

人类大脑是已知宇宙中能效最高的智能系统。一个成年人大脑的持续功率仅约20瓦——相当于一盏昏暗灯泡——却支撑着约860亿个神经元、约100万亿个突触的运作,完成感知、记忆、语言、推理、运动控制等全频谱认知任务。全年耗电约175千瓦时,仅相当于一台冰箱一年的用电量。

而AI的能耗是另一个数量级的故事。

人类大脑

~20 W

持续功率 | 860亿神经元
100万亿突触 | 全年~175 kWh

GPT-4训练

~42.4 GWh

25000块GPU | 10 MW额定功率
14周训练 | ≈5万户家庭年用电

人脑与AI能耗关键数据对比

  • 人脑功率:~20-25W(约占人体总能耗的20%)
  • 人脑单次突触事件能耗:约10飞焦耳(fJ,10⁻¹⁵ J)
  • GPT-4训练总能耗:约42.4 GWh(IEA数据,含冷却等全部设备)
  • GPT-3训练总能耗:约1,287 MWh(1.287 GWh)
  • 模拟整个人脑的数字仿真所需功率:约2.7 GW(即2,700,000,000W),为人脑的1.35亿倍
  • 人脑每瓦可支持约10¹⁶量级突触运算;最先进TPU v4每瓦约10¹²量级运算——相差四个数量级
  • 蓝脑计划(Blue Brain Project):用1.4 MW功率、40分钟才模拟出人脑1%区域1秒钟的活动

从推理端来看,差距有所缩小但依然惊人。谷歌报告显示,Gemini处理一条请求约消耗0.24瓦时;ChatGPT约为0.34瓦时。若将训练成本均摊到每次查询(GPT-4每天约10亿次查询,训练成本按1年寿命分摊),每次请求的总能耗约为0.5瓦时。

而人类进行一次深度思考呢?大脑的20瓦是静息态基础代谢——无论你是否在思考,这部分能量都在消耗。执行具体认知任务所增加的边际能耗趋近于零,因为大脑近乎持续保持高负荷运转。这意味着人类"完成一次具体任务"的边际能耗成本趋近于零,而AI的能耗则是严格"按次计费"式的。

但规模效应扭转了这一图景。当全球每天有数十亿次AI查询时,零星能耗汇聚成洪流。根据IEA数据,2024年全球数据中心耗电约415 TWh,其中AI数据中心约105 TWh。到2030年,AI数据中心能耗可能达到465 TWh(增长3倍),届时数据中心可能消耗全球电力的8%(如今仅约2%)。

年份
全球数据中心能耗(TWh)
其中AI数据中心(TWh)
占全球电力比例
2022
~303
~23
~1.5%
2024
~415-451
~55-105
~2%
2025(预计)
~560
~78-155
2027(预计)
~704-814
~106-146
2030(预计)
~945
~465
~8%

数据来源:IEA、IDC、UNDP综合估算

五、难以持续的AI——必须减量化生存

19世纪英国经济学家威廉·斯坦利·杰文斯发现了一个反直觉的现象:当瓦特改良蒸汽机大幅提高了煤炭利用效率后,英国的煤炭总消耗量非但没有减少,反而以前所未有的速度飙升。这就是著名的杰文斯悖论——技术进步提高了资源利用效率,反而导致该资源的总消耗量增加。

AI正在惊人地重演这一幕。单次查询成本如此低廉(0.5瓦时),以至于我们几乎可以忽略不计。但正是这种"不可感知的廉价",催生了需求的爆炸式增长——回邮件、写文案、做PPT、画图、聊天……过去不存在的需求,因AI的廉价而被大规模创造出来。

AI不可持续的五个信号

  • 碳排放逆转
    :微软自2020年以来CO₂排放量增加近30%;谷歌2024年能耗从25 TWh增至32 TWh(+20%)
  • 水资源消耗
    :数据中心冷却需大量淡水,谷歌2025年环境报告承认水资源消耗持续攀升
  • 电力基础设施压力
    :单个先进AI训练集群功耗已达数百MW,规划中的最大集群将接近1 GW——相当于一座中型城市的全部用电
  • 算力军备竞赛
    :自2012年以来AI计算量增长30万倍,无减速迹象;Scaling Law尚未触及天花板
  • 能源投资缺口
    :UNDP估计到2030年全球数据中心扩建可能需要近7万亿美元资本投资,其中5万亿美元直接关联AI

这种增长模式在热力学第二定律面前是不可持续的。哈佛天体物理学家Eric Chaisson的研究指出,即使人类完全摆脱化石燃料、实现零碳排放,文明持续增长的能源使用最终将以废热形式加热地球——这不是排放问题,而是热力学的基本限制。在约1000年的尺度上,技术文明仅凭自身能耗散发的热量就可能使地球表面升温约3°C。

这就是"减量化生存"(Degrowth Survival)命题的核心:AI的可持续未来不在于更大、更快、更强,而在于更少、更精、更准。具体而言:

  • 稀疏激活
    :学习人脑的稀疏计算模式——大部分神经元在大部分时间保持静默,仅在需要时激活
  • 存算一体
    :打破冯·诺依曼架构中存储与计算的物理分离,消除数据搬运的能耗开销
  • 事件驱动
    :从密集矩阵运算转向脉冲神经网络(SNN),仅在有信息变化时才消耗能量
  • 边缘部署
    :将推理能力从集中式数据中心下沉到终端设备,减少网络传输与集中冷却开销
  • 知识蒸馏
    :用大模型训练小模型,以1/100的参数量实现80%以上的能力

人脑之所以能在20瓦的功率预算下实现通用智能,根本原因在于它的设计哲学:用最少的能量处理最重要的信息。AI的未来不在于复制人脑的结构,而在于吸收这一哲学。

六、人类文明十个阶段:对自然界的掌握程度

人类文明的本质,是不断找到更高效的能量利用方式、更密集的信息处理方式和更精巧的物质操控方式。从石器到AI,这条主线贯穿了250万年。以下我们以十个关键节点为轴,梳理人类对自然掌握程度的跃迁。

文明阶段
大致年代
人均功率
核心能源/技术
对自然的掌握程度
① 石器时代
~250万年前
~100W
生物能(食物)
物理加工天然材料,不涉及化学转化
② 火的使用
~50万-100万年前
~200-300W
生物质能(薪柴)
首次支配自然力;烹饪→营养吸收效率↑→脑容量↑
③ 青铜时代
~公元前4000年
~400-500W
木炭冶金
首次化学转化材料;硬度↑→工具与武器革命
④ 畜牧驯化
~公元前8000年
~400-600W
畜力+生物质能
将动物生物能转化为可控动力;承载力10倍提升
⑤ 农耕文明
~公元前10000年
~500-1000W
作物太阳能+木材
主动转化太阳能为食物;人口密度提升100倍
⑥ 商业文明
~公元前3000年
~800-1200W
畜力+风帆+水力
信息与物质跨地域流动;货币抽象化价值
⑦ 蒸汽时代
1769年
~2500W
煤炭(24 MJ/kg)
热能→机械能的转化;能源密度跃升60%
⑧ 电气时代
1870年代
~3000-5000W
石油+电力
能源可远距离传输;信息载体从声速→光速
⑨ 计算机时代
1946年
~5000-10000W
化石能源+核能
信息处理自动化;存储密度从纸张→硅芯片
⑩ AI时代
2022年
~10000W+
电力(化石+可再生)
认知处理自动化;人脑边际能耗→AI数据中心能耗

数据来源:Cook (1971)、Chaisson (2008/2025)、Vaclav Smil《能源与文明》(2017)、IEA等综合整理。人均功率为含食物、取暖、工具、交通的全口径估算。

阶段详解:从石器到AI的能量跃迁

① 石器时代

~250万年前|人均功率~100W。奥杜威(Oldowan)石器标志着人类首次对天然材料进行物理加工——打制石片、削尖木棍。能量来源完全依赖食物代谢(~2000 kcal/日 ≈ 100W)。物质维度:不涉及化学转化,仅改变形状。信息维度:口头语言尚未成熟,手势与呼号为主。组织规模:数十人族群。掌握程度:自然的主人公→自然的观察者,仅能被动适应环境。

② 火的使用

~50万-100万年前|人均功率~200-300W(食物+薪柴)。直立人(Homo erectus)掌握控制性用火,这是人类首次支配一种自然力。火使人类走出茹毛饮血,烹饪使食物营养吸收率提高40-60%,大脑得以进一步发育扩大。火还推动了陶器烧制(~公元前5000年)和早期冶金。能源密度:木材~15 MJ/kg。CO₂排放:几乎为零(碳中性生物质)。掌握程度:从适应自然→改造自然的第一步

③ 青铜时代

~公元前4000年|人均功率~400-500W。两河流域率先冶炼铜锡合金(青铜),这是人类首次进行化学层面的材料转化。青铜硬度远超纯铜(HV~60→HV~120),使工具和武器发生质变。冶炼温度需求~900-1000°C,需木炭而非普通薪柴。青铜器的出现催生了专业分工、贸易网络和等级社会。掌握程度:从改造自然→创造新材料

④ 畜牧驯化

~公元前8000年|人均功率~400-600W。人类将动物生物能转化为可控动力——一匹马可提供~746W(1马力)持续功率,是人力(~75-100W)的7-10倍。驯化使人类突破了自身体力的天花板,耕地效率提升数倍。约6000年前乌克兰草原上的马驯化改变了战争与运输格局。掌握程度:从人力→畜力的能量杠杆

⑤ 农耕文明

~公元前10000年|人均功率~500-1000W。农业革命是人类第二次重大能源进步——通过种植作物与驯养家畜,人类更高效地将太阳能转化为食物和动力。人口密度从采集狩猎的~0.25人/km²跃升至农耕的~25-50人/km²(提升100-200倍)。文字、历法、灌溉、城市相继诞生。Cook估算公元前5000年的农民日均能耗约12000 kcal(~50 MJ),是原始人的6倍。掌握程度:从采集自然→主动转化太阳能

⑥ 商业文明

~公元前3000年|人均功率~800-1200W。商业的本质是信息与物质的跨地域流动,它使能源和资源的利用不再局限于本地。腓尼基人、丝绸之路、大航海时代将不同生态区的能量与物质重新配置。货币的出现使价值抽象化——人类首次用符号而非实物进行能量交换。水力(水车)和风力(风车/风帆)成为畜力之外的自然动力补充。掌握程度:从本地资源→跨区域能量配置

⑦ 蒸汽时代

1769年|人均功率~2500W。瓦特改良蒸汽机标志着人类首次将热能大规模转化为机械能。煤炭的能量密度(~24 MJ/kg)比木材(~15 MJ/kg)高出60%,且储量远超森林。1850年英国煤炭产量占全球2/3。全球CO₂排放从1750年的~2亿吨飙升至1870年的~10亿吨(5倍)。城市化率从20%→50%。Cook估算1875年英国人均日能耗~77000 kcal(~322 MJ),是农耕文明的3倍。纺织效率提升200-300倍。1860年煤炭占全球一次能源24%,1920年升至62%。掌握程度:从自然力→化石能源动力

⑧ 电气时代

1870年代|人均功率~3000-5000W。电力革命的意义不仅是新能源,更是能源传输方式的革命——电力可以远距离输送,使能源生产与消费首次实现空间分离。信息载体从声速(~340 m/s)跃升至光速(~3×10⁸ m/s):电报、电话、无线电。1967年石油首次超越煤炭成为全球第一大能源(40.4% vs 38.8%)。内燃机使汽车和飞机成为可能。列宁说"共产主义=苏维埃+电气化",电力成为现代文明的标志。掌握程度:从本地能源→全球能源网络

⑨ 计算机时代

1946年|人均功率~5000-10000W。ENIAC诞生,人类进入信息处理自动化时代。信息存储从纸张(~10³ bit/cm²)跃升至硅芯片(~10⁹ bit/cm²,提升100万倍)。摩尔定律使计算成本每18个月减半。核能(1950年代)提供了前所未有的能量密度——1克铀-235释放的能量约等于2.5吨煤。到1970年代,Cook估算人均日能耗达~230000 kcal(~960 MJ),是蒸汽时代的3倍、采集狩猎的115倍。掌握程度:从手工计算→机器计算,从化学反应→核反应

⑩ AI时代

2022年|人均功率~10000W+。ChatGPT发布,AI成为人类认知处理的自动化工具。与前九个阶段不同的是,AI首次将"思考"这一曾经纯粹属于生物大脑的功能外包给机器。全球AI数据中心2024年耗电~105 TWh,预计2030年达465 TWh。AI训练计算量自2012年以来增长30万倍。GPT-4以1.8万亿参数压缩了人类13万亿token的文本知识。但与之对应的是:人脑以20W完成通用智能,而AI以数十MW集群才勉强逼近。掌握程度:从体力外包→脑力外包,从物质转化→认知转化

· · ·

七、来自虚空,归于何处

让我们回到标题——"来自虚空的人类智慧"。这个"虚空"有双重含义。

第一层,人类智慧确实来自虚空——来自宇宙大爆炸后基本粒子的排列组合,来自碳、氢、氧、氮在特定温度和化学条件下的自组织,来自5.4亿年进化中随机突变与自然选择的累积。它没有设计者,没有蓝图,是热力学第二定律在开放系统中催生的奇迹。一个20瓦的器官,在虚空中诞生,却足以理解虚空本身。

第二层,AI的"智慧"也来自虚空——来自0和1的排列组合,来自矩阵乘法的指数级堆叠,来自数十亿参数对数万亿文本统计模式的拟合。它没有理解力,没有意识,没有身体,只是数学函数的极端优化。它"知道"一切文本中的关联模式,但不"理解"任何一个因果关系。它的"智慧"是一种概率拟合的真理映射,而非因果推理的深层理解。

人类对AI工具的掌握与运用,本质上是一场能量与智慧的博弈

维度
人类智慧
AI"智慧"
能耗
~20W,边际能耗→0
训练~42 GWh,推理~0.5 Wh/次,总量指数增长
常识
5.4亿年进化,具身认知,因果推理
文本统计模式拟合,无物理体验,因果链缺失
记忆
单体~10⁹ bit,易遗忘,但高密度
1.8万亿参数压缩13万亿token,但"智慧密度"低
创造
类比迁移,跨域突破,直觉跳跃
模式重组,插值生成,无法真正"跳出"训练分布
可持续性
碳基代谢,食物→能量,碳中和
数据中心8%全球电力(2030预计),废热不可持续
规模上限
受限于脑容量与寿命,但能效极高
理论上无上限,但能耗和废热构成物理天花板

从石器到AI,人类文明的250万年是一部不断找到更高能量密度、更高信息处理密度的历史。每一次跃迁都使我们更深入地掌握自然,也更深地嵌入对自然资源的依赖。采集狩猎者人均200瓦,农耕者1000瓦,工业者2500瓦,信息时代公民10000瓦——我们从未减少对能量的渴求,只是不断找到了更多。

AI是这条曲线上的最新一点,也可能是最危险的一点。因为它第一次将"认知"这一人类最后的堡垒也能源化了。当思考本身需要消耗吉瓦级电力时,我们必须直面一个根本问题:智慧的成本是否应该高于智慧本身?

人脑给出了答案:20瓦足矣。这不是技术妥协,这是进化智慧。真正的智能不在于消耗多少能量,而在于用最少的能量处理最重要的信息。AI的未来——如果它有未来——必须走向这条路径:稀疏、事件驱动、存算一体、具身交互。不是更大的模型,而是更聪明的模型。

人类对AI工具的真正掌握,不在于让它替代我们思考,而在于让它延伸我们的思考——在人脑的因果推理与常识直觉之上,叠加AI的规模记忆与模式识别能力。人类提供方向、价值判断和因果理解,AI提供计算、检索和模式匹配。这才是"来自虚空的人类智慧"的正确运用方式:让20瓦的奇迹引导吉瓦的力量。

250万年前,一个原始人打制了第一块石刀,用100瓦的能量改变了世界。
2022年,一个工程师用25000块GPU训练了一个模型,用42 GWh的能量试图复制思维。
从石头到硅片,从100W到42 GWh,人类走了250万年。
下一个250万年,我们需要的不是更大的机器,而是更深的智慧。
毕竟,那个20瓦的器官,至今仍在教我们:如何用最少的能量,理解最大的世界。

数据来源:IEA《Energy and AI》(2024/2025)、IDC全球数据中心能耗报告、UNDP《The Energy Sprint of the AI Race》(2026)、Epoch AI、Cook (1971) Historical Energy Consumption、Eric Chaisson (2008/2025) Energy Rate Density、Vaclav Smil《Energy and Civilization》(2017)、Visual Capitalist / IDC全球数据量统计、谷歌2025环境报告、Accenture《驱动AI的可持续未来》等。

本文为原创分析文章,转载请注明出处(Powered By VitoWu)。