夜雨聆风学习资料网

ARTICLE · 1097699

国产AI服务器搭载自研GPU集群 算力密度跻身国际先进行列

国产AI服务器搭载自研GPU集群 算力密度跻身国际先进行列

整机柜突破16卡液冷方案 单柜AI算力密度达国际领先水平

发布时间:2026年9月18日    报道来源:科技日报 · 中国算力观察

【摘要】国内主流服务器厂商于近期密集发布搭载自研GPU的AI整机柜服务器产品,通过16卡全液冷、高密度NVLink互连、浸没式散热等关键技术,实现单机柜AI算力密度跻身国际先进行列,在智能算力供给侧展现出强劲的自主创新能力。

【本报讯】随着生成式AI对智能算力的需求持续攀升,国内AI服务器整机柜产品近期密集发布。以华为、中科曙光、浪潮信息、新华三为代表的服务器厂商,集中推出了搭载自研GPU芯片的全液冷AI整机柜产品,在算力密度、互连带宽、能效比等关键指标上达到国际先进水平,标志着国产AI基础设施实现新的跨越。

整机柜形态是本轮AI服务器升级的核心方向。传统8卡GPU服务器受限于PCIe带宽、供电能力与散热能力,已难以满足万亿参数大模型训练对算力与互连的需求。新一代AI整机柜产品采用『16卡+全液冷』设计:机柜顶部部署CDU(冷量分配单元),通过二次侧冷媒循环,将每颗AI加速器的工作温度稳定控制在65℃以下,确保高负载下的稳定运行。整机柜功率密度达到60kW以上,部分旗舰产品突破80kW。

互连架构是国产AI服务器的另一关键突破。以华为CloudMatrix系列为代表的整机柜产品,在内部部署自研的高带宽互连网络,卡间互连带宽达到1.8TB/s,接近英伟达NVLink水平。中科曙光发布的scaleX640整机柜则采用浸没式液冷方案,将整柜电子部件完全浸没于绝缘冷却液中,散热效率较传统风冷提升约5倍,单柜可容纳20张AI加速卡,FP16算力密度达到6.4 EFLOPS,在国内同类产品中处于领先位置。

在核心算力芯片层面,国产AI GPU性能快速追赶。华为昇腾910C、寒武纪思元590、海光DCU系列等自研芯片已实现规模化量产。其中,昇腾910C采用7nm制程,FP16算力达到780 TFLOPS,搭载HBM2e高带宽显存;思元590面向推理场景优化,在主流INT8推理基准下性能对标国际中端产品。这些芯片与国产整机柜方案深度耦合,形成端到端的自主算力供给体系。

应用层面,国产AI服务器已在多个领域实现规模化落地。在金融领域,某国有大型银行采用国产AI整机柜部署千亿参数级风险预测模型,日均处理交易笔数提升至亿级;在能源领域,国家电网采用国产AI服务器用于电网负荷预测与新能源出力预测,模型精度提升15%以上;在轨道交通领域,具备车载环境适应性的国产AI算力平台已被多个城市的地铁线路采用,用于列车智能调度、弓网状态监测等关键业务。

产业生态层面,整机柜形态的兴起带动了上下游协同发展。液冷散热环节,英维克、维谛技术、绿能等国内厂商已具备全栈液冷交付能力;电源环节,UPS与高压直流(HVDC)方案满足单机柜60kW以上功率密度需求;整机集成环节,服务器厂商与芯片厂商深度协同,在BIOS、驱动、固件等底层进行联合优化。这一系列产业链协同,正在构建具有自主知识产权的AI算力底座。

业内人士指出,国产AI服务器整机柜产品的密集发布,既是大模型时代算力供给侧升级的必然结果,也是国产替代进入深水区的集中体现。随着芯片、互连、散热、应用等环节的协同成熟,国产AI算力供给将在更多关键行业承担主力角色,为数字经济高质量发展提供坚实支撑。

从标准与生态建设看,行业协会与领军企业正携手推进国产AI服务器标准化进程。中国电子工业标准化技术协会、开放数据中心委员会(ODCC)等组织近期发布了AI整机柜参考设计白皮书,统一了机柜尺寸、电源接口、液冷管路、管理接口等关键规范,有助于不同厂商产品之间的兼容与互换。在应用生态方面,主流AI框架(如PyTorch、MindSpore、PaddlePaddle)已完成对国产GPU的深度适配,超过300个行业模型在国产AI服务器上完成迁移验证,为规模化落地奠定基础。

区域布局方面,国产AI算力供给正在京津冀、长三角、粤港澳、成渝等区域形成集聚效应。位于贵州、宁夏、内蒙古等可再生能源富集地区的国家级算力枢纽节点,已大规模部署国产AI整机柜产品,配套风电、光伏直供与高效制冷系统,整体PUE低至1.15以下,绿色算力供给能力全球领先。这种『东数西算』+国产算力的双重布局,正在构建具有中国特色的AI基础设施体系。

从面向客户的视角,国产AI整机柜产品的成本优势正在显现。同等算力条件下,国产整机柜采购成本较国际同类产品低15%-25%,并具备更完整的本地化技术支持与售后服务体系,备件响应时间、定制化适配能力也明显优于进口产品。这使得国产AI服务器在政府、金融、电信、能源、交通等关键行业获得越来越多的青睐。同时,围绕国产AI算力的『一站式交付』能力也在持续提升,从机房设计、设备部署、网络配置到运维管理,可提供端到端解决方案,进一步降低客户的部署复杂度。

【行业展望】展望下一阶段,国产AI服务器将进一步向『高密度、高能效、高可用』方向演进,光互连、Chiplet芯粒、浸没式液冷等前沿技术有望加速导入,推动中国AI基础设施在全球竞争中占据更加主动的位置。同时,行业标准化与生态开放将持续推进,吸引更多中小厂商与开发者加入,共同壮大国产AI算力生态。

相关学习资料