乐于分享
好东西不私藏

AI 算力撞碎 “热墙”:液冷不是风口,是必答题

AI 算力撞碎 “热墙”:液冷不是风口,是必答题

当单颗 GPU 功耗冲破 2000W、单机柜功率直奔 200kW,传统风冷已走到物理尽头。英伟达 Rubin 平台官宣100% 全液冷 + 45℃高温供液,头部云厂商新建智算中心强制标配高密度液冷机柜。一夜之间,液冷从 “加分项” 变成 AI 算力的 “入场券”。

一、算力危机:AI 大模型被 “热” 卡住脖子

大模型竞赛白热化,万卡集群、AI 工厂遍地开花,全行业却被同一个难题困住:散热

风冷的天花板清晰可见:空气换热能力有限,行业公认单机柜风冷极限仅 30–40kW。而当下 AI 训练集群早已突破阈值:新一代 GPU 功耗飙升,单机柜密度普遍 80–120kW,远期目标直指 200kW+;GPU、HBM、800G 光模块多重热源叠加,局部热流密度直接击穿风冷极限。

高温带来的代价肉眼可见:芯片降频、算力波动、硬件寿命缩短,大规模集群下算力损失成本难以估量。

政策红线也在收紧:国内新建大型数据中心 PUE 要求不高于 1.25,智算枢纽目标 1.2 以下。传统风冷机房 PUE 普遍 1.4 以上,制冷能耗吃掉近 40% 总电量。

液冷的优势就此凸显:液体导热效率是空气的 25 倍以上,换热系数高出风冷上千倍。同等规模算力,液冷可将 PUE 压至 1.05–1.10,制冷能耗降低 30%–40%,余热还能回收利用。

一句话总结:没有液冷,超高密度 AI 算力集群根本跑不长久、跑不稳定

二、路线终局:冷板当下称王,浸没式瞄准极限

商业化落地已形成两大主流路线,并非谁淘汰谁,而是场景分层、长期共存

1. 冷板式液冷:现阶段首选,市场绝对主力

原理:在 GPU、CPU 等高发热芯片表面贴合微通道冷板,冷却液在封闭管路循环带走热量,低功耗器件保留少量风扇,由 CDU 完成冷热交换。

✅ 优势:兼容性强,存量机房可改造;技术成熟、供应链完善;支持 60–150kW 机柜,适配绝大多数训练与推理场景。

⚠️ 短板:定点散热,整机上限低于浸没式,无法完全消除局部热点。现状:占据国内液冷市场近 90% 份额,字节、腾讯、阿里新建智算项目优先采用,也是英伟达 Rubin 平台初期主推方案。

2. 浸没液冷:极致高密度的终极答案

原理:服务器整机浸泡在绝缘冷却液中,液体直接接触所有元器件,彻底取消风扇,分单相浸没与两相相变浸没。

✅ 优势:散热天花板,单机柜轻松支撑 200–900kW;温度均匀无热点,PUE 最低可达 1.03–1.05;低噪音、硬件寿命更长,适合长期大模型训练。

⚠️ 短板:初期投入高,机房承重、防水门槛高,冷却液与运维成本更高。

行业共识

  • 短期(1–2 年):冷板式持续主导,风液混合大量存在;
  • 中长期(3–5 年):超大规模万卡训练集群向浸没式渗透;推理、中小型集群仍以冷板为主;
  • 未来:大型算力园区大概率冷板 + 浸没混合部署

三、英伟达引爆新标准:45℃高温供液,全液冷时代开启

2026 年行业最大催化剂,来自英伟达 Rubin 平台的架构革新。

Rubin 首次实现整机柜 100% 全液冷,彻底移除风扇,并推出45℃高温供液规范。为什么温度反而更高?核心在温差与自然冷却:传统低温供液需要冷水机组持续做功,能耗极高;45℃高温回水可最大化利用自然冷却,大幅减少压缩机运行时长。

测算显示:50MW 规模 AI 工厂,这套方案每年可省数百万美元电费,同时减少水资源消耗。

Rubin 还配套 800V 高压直流机柜,800V 供电 + 全液冷定义下一代 AI 工厂两大基础设施门槛。这意味着:液冷从服务器选配模块,升级为机架级顶层标准,倒逼供应链全面重构。

产业链价值清晰:CDU、冷板合计占液冷系统价值约 60%,其次为管路、快接头、泵阀、冷却液、监控系统。市场正从 “卖整套方案” 转向核心零部件专业化分工,具备自研能力的厂商议价权持续提升。

四、热潮之下:四大 “拦路虎” 不容忽视

资本市场火热,但工程落地仍有四大难题,也是区分概念与真实机会的标尺。

  1. 标准不统一,生态碎片

    冷板接口、快接头、冷却液、管路协议互不兼容,定制化抬高成本,不利于大规模复制。

  2. 漏液风险是最大运维焦虑

    风冷怕停电,液冷怕渗漏。管路、密封、冷板任何一处失效都可能宕机,需要泄漏监测、快速断流、预警系统;运维团队经验与规范仍在完善。

  3. 初始投入高,TCO 争论持续

    冷板式初期投资约为风冷 1.5–2 倍,浸没式达 2.5 倍以上。但行业共识:机柜功率越高,液冷 TCO 优势越明显。低于 30kW 风冷划算;超过 60kW 长期运行,液冷 2–3 年即可收回额外投入。

  4. 供应链成熟度参差不齐

    高端冷板、高精度屏蔽泵、特种密封、绝缘冷却液仍有海外优势;订单爆发易出现产能紧张、交付拉长。国产替代是未来 2–3 年核心主线。

五、产业预判:2026–2028,液冷渗透率快速爬坡

结合头部云厂商与服务器大厂路线,五大趋势确定:

  1. 渗透率加速分化:训练服务器液冷渗透率已破 70%,推理逐步跟进,通用数据中心偏慢;新建智算中心液冷机柜占比持续走高。

  2. 45℃高温供液主流:跟随 Rubin 示范效应,全行业迭代适配高温供液架构,传统低温制冷竞争力下滑。

  3. 零部件专业化分工:集成商主导转向独立部件厂商机遇,标准化量产企业盈利弹性更强。
  4. 余热回收从概念走向商用45–60℃热水可用于园区供暖、工业利用,散热系统从 “成本中心” 变为 “能源资产”。
  5. 国产供应链加速出海北美、东南亚 AI 工厂建设提速,国内厂商凭成本与交付优势切入海外市场,打开第二增长曲线。

液冷不是题材,是 AI 算力的基础设施革命

很多人把液冷当成短期炒作,但它解决的是 AI 产业最底层的物理约束 ——热量

算力竞争最终比拼的是万卡集群稳定、低成本持续运行的能力。没有高效散热,再先进的 GPU 也无法释放全部性能。

短期行业仍要经历标准统一、成本下探、运维成熟的阵痛;长期看,高密度 AI 算力普及不可逆,液冷的渗透曲线只会持续向上。

这不是选择题,是必答题。

本文内容整合自公开行业信息,仅作交流分享使用;相关内容版权归原作者所有,若涉及侵权请联系删除。

点击图片,了解会议详情

2026全国液冷技术与热管理创新论坛

会议时间:2026年12月16-17日

会议地点:中国·苏州

部分会议主题:

解读液冷行业标准、能耗红线与补贴政策

政策与战略:液冷成为算力基础设施的必由之路

AI算力液冷与冷却液市场趋势

液冷技术的创新实践与未来展望

算力+能源融合:算电协同对液冷热管理的战略新要求

光伏/风电/充电桩大功率电力电子设备液冷热管理技术与标准进展

冷板式液冷规模化落地

浸没式/相变液冷技术突破与高端应用

液冷跨界应用与算电协同

会务费:7月31日前报名参会享受早鸟价

大会组委会:施经理 182 2175 2581

往期精彩

1、OpenRouter 榜单震动硅谷!国产大模型 Token 调用量 4.3 倍领先,算力基础设施竞赛已经开打

2、一期 3000P 算力落地济南!数字政通云智算中心正式签约天桥区

3、AI 液冷渗透率快速攀升,10 家产业链标的获融资资金大额净买入

扫一扫进群

全国液冷&热管理全产业群

大会组委会

182 2175 6169