夜雨聆风学习资料网

ARTICLE · 1090987

曙光8000十万卡国产AI超算集群落地:核心采用浸没式相变液冷方案

曙光8000十万卡国产AI超算集群落地:核心采用浸没式相变液冷方案

点击蓝字,关注我们

9月27日消息,中科曙光曙光8000(登峰)作为国内首个全国产十万卡AI超算集群,核心采用浸没式相变液冷方案,直面超大算力集群最突出的散热难题。

随着AI加速卡规模拉至十万卡级别,芯片功率密度大幅抬升,传统风冷、冷板散热已接近物理上限,高温会造成芯片降频、集群稳定性下滑,液冷成为释放国产高算力芯片性能的关键支撑。

这套浸没式相变液冷方案,将计算卡、主板等元器件整体浸泡在绝缘冷却液中,依靠介质受热沸腾相变快速带走热量,形成闭环循环换热。

和传统风冷相比,散热密度显著提升,同时可压缩机房占地,整机能耗降低约40%,集群PUE可低至1.04,解决十万卡高密度部署下的持续温控压力,保障大模型长时训练不因为过热降速。

曙光8000实现芯片、计算、存储、高速网络全链路国产自主可控,采用超智融合架构,兼顾AI大模型训练推理与高精度科学计算。

集群搭载自研scaleFabric高速网络与高性能分布式存储,支撑十万卡规模下的大规模并行通信,适配新材料、生物医药、气象仿真等AI for Science场景,目前已接入国家超算互联网。

这套集群落地,不仅验证国产算力硬件的大规模协同能力,也证明自研浸没相变液冷可以支撑十万卡级超大规模智算工程。

在算力需求持续暴涨的背景下,液冷不再是可选优化,而是国产超大规模AI集群规模化落地的基础设施底座,为后续更大规模国产算力集群建设提供可复制的工程样本。

信息来源:快科技

1.本微信公众平台所发表内容均会注明来源,版权归原出处所有(无法查证版权的或未注明出处的均来源于网络搜集)。转载内容(视频、音频、文章等)只以信息传播为目的,仅供参考,不代表本平台认同其观点和立场。如涉及版权/内容真实问题,请与本公众号联系,我们将在第一时间删除内容,不承担任何法律责任。

2.本号注明原创的文章中涉及公司和行业均为作者个人观点或AI搜索,不作为投资依据,欢迎业内外人士理性讨论。

3.本号文章中部分图片均为网络搜索,如有侵权,请联系删。

分享、收藏、点赞、在看安排一下?

今天因为你的分享,让我元气满满

相关学习资料