本文观点基于工信部《算力基础设施高质量发展行动计划》、中国信通院《央国企智算创新实践报告》及公开政策文件;Blackwell B200/B300 具体成交价随汇率、配额及渠道波动,请以当日原厂/总代询价为准。
01
先说结论:Blackwell时代,多数企业更应先租后建
除非同时满足以下四个条件,否则优先租用智能算力(公有云/国资智算中心裸金属),跑通业务模型、用量稳定后再评估自建:
① 数据严禁出域
② GPU年利用率>70%
③ 有专职AI基础设施运维团队
④ 资金充裕可接受2~3年技术迭代贬值
租用(OPEX,运营支出模式)的好处:
无前期硬件投入,按量/包月;弹性伸缩,含网络+基础运维;多数省市可申请算力券补贴降低实际支出。
自建(CAPEX,资本支出模式)的代价:
Blackwell 8卡整机需全液冷机柜(¥15万~¥40万/柜);电力增容、专职运维;3~5年折旧快,Blackwell→Vera Rubin迭代周期压缩至2~3年。
02
2026年 Blackwell 自建成本:TCO远超想象
2.1 核心硬件规格
基于NVIDIA官方及行业核实数据:
NVIDIA B200 8卡节点:
单卡显存:192 GB HBM3e|单卡TDP:1000W(NVIDIA官方数据)
系统峰值功耗:约10 kW|FP4算力(8卡合计):72 PFLOPS(dense)
FP64算力:37 TFLOPS|网络:ConnectX-7(400G)|推荐液冷
NVIDIA B300(Blackwell Ultra)8卡节点:
单卡显存:288 GB HBM3e|单卡TDP:约1400W(行业共识,NVIDIA官方未直接标注单卡TDP)
系统峰值功耗:约14 kW(NVIDIA官方标注)|FP4算力(8卡合计):108 PFLOPS(dense)/ 144 PFLOPS(sparse)
FP64算力:据第三方评测约1.25 TFLOPS(推理优化设计,双精度性能极低)
网络:ConnectX-8(800G)|强制液冷(行业共识)
⚠️ B300单卡TDP 1400W、FP64性能1.25 TFLOPS等参数,NVIDIA官方未在公开产品页直接标注,但多个独立技术来源(Spheron、iFactory、Glenn Klockwood等)一致确认,可视为行业共识。下单前务必以NVIDIA原厂授权代理商或品牌服务器厂商正式报价单为准。
2.2 隐形成本别漏算
电力增容:高密度液冷机柜要求单机柜供电≥35kW(装机至少2台B300 8卡服务器,单柜功率约32kW以上),老IDC普遍无此余量,需专项改造。
PUE合规:新建大型数据中心PUE≤1.25,国家枢纽节点≤1.20,不达标面临差别电价或不予审批。
液冷机柜:冷板式液冷机柜+CDU ≈¥15万~¥30万/柜;老机房改造需¥25万~¥40万/柜。
高速网络:200G/400G RoCE或IB胖树 ≈¥30万~¥60万/集群节点。
专职运维:液冷CDU巡检、漏液监测、光模块维护需至少1名专职AI基础设施工程师(年薪¥30万+)。
迭代贬值:Blackwell→Vera Rubin约2~3年,3年后残值约15%~25%(行业估算,实际因使用情况而异)。
2.3 TCO对比:自建 vs 租用(以单台B300 8卡为例,3年)
【自建采购】
初期投入:硬件按当日询价 + 液冷机柜 + 网络(数百万起)
机房/电力:机柜租金+工业电费(按当地)
运维人力:≥1名专职工程师(年薪¥30万+)
硬件贬值:3年后残值约15%~25%
付款方式:预付占用大量现金流
技术迭代风险:自行承担旧设备淘汰
【租用算力】
初期投入:无或少量押金
机房/电力:含在租金内
运维人力:服务商承担
硬件贬值:不承担
付款方式:月付/按量(OPEX)
技术迭代风险:可随时切新机型
权威测算:据中国信通院《央国企智算创新实践报告》测算,GPU集群利用率低于60%~70%时,自建TCO高于租用;仅当长期满载(每天≥18h训练)、且有现成高密液冷IDC资源的大型企业,自建才可能在3年左右显现成本优势。
03
决策象限——对号入座
场景一:数据安全要求低 + 算力使用波动大(试验/POC)→ 推荐:公有云按需租用
场景二:数据安全要求低 + 长期稳定高频训练推理 → 推荐:长周期预留实例 或 托管裸金属
场景三:数据安全要求高(金融/政务/医疗核心)+ 偶发/小规模 → 推荐:小型私有集群 或 专线私有云
场景四:数据安全要求高 + 常年高负载核心业务 + 现成液冷IDC → 推荐:自建/共建智算节点(需满足前述四条件)
04
政策红利关键分水岭——算力券只补"租用"
目前上海、深圳、浙江、湖南、苏州、青岛、广州等地2026年算力券政策明确规定:
补贴对象:企业/高校/科研院所租用非关联方智能算力(训练/推理),用于大模型或智能体研发。
不包含:服务器/存储/网络设备购置费、软件许可费、自建机房建设费。
典型力度:按实际支付费用10%~50%后补助,单体年度上限100万~1000万元不等(深圳2026年训力券最高1000万元)。
通用要求:本地独立法人 + 无关联算力供给方 + 合同 + 发票 + 算力使用日志(须体现卡型/规模)+ 信用报告。
⚠️ 若核心诉求是"拿政府补贴降成本",现阶段租用算力是唯一可申报算力券路径,自建采购无对应算力券支持。部分地方另有"算力建设补贴"或"智算中心投资补贴",与"算力券"(使用侧补贴)是两类政策,本文讨论的是后者。具体政策文号以当地工信部门最新发布为准。
05
务实建议路径(可直接照做)
第一阶段——验证期(0~6个月)
租用公有云或国资智算中心GPU裸金属,跑POC/微调/推理验证商业价值,同步申请算力券降低开支。
第二阶段——增长期(用量初步稳定)
若月租持续>¥20万~¥30万且GPU利用率>60%,评估长周期预留实例或托管裸金属(降本10%~30%)。
第三阶段——成熟期(超大模型常驻训练+数据不出域+现成液冷IDC)
经TCO测算后考虑自建或与地方共建智算节点,按信通院ODS规范选型(全液冷+异构+国产NPU备选),所有硬件价格以签约当日正式询价单为准。
06
常见踩坑提醒
❌ 业务未验证就豪掷重金买Blackwell机柜——GPU长期闲置,3年后残值<25%。
❌ 忽略隐形成本——没算液冷改造(¥20万+/柜)、没配运维、老机房供电不够带不动。
❌ 误以为买服务器能报算力券——各地申报指南明确"硬件购置费"除外。
✅ 租用时确认供给方具IDC牌照且与己方无关联关系——否则取消补贴资格。
✅ B300现货紧张,租用时问清卡型——B200 vs B300 vs H20(中国市场特供版)vs 国产NPU,避免以H20价格签B200 SLA。
✅ Blackwell系列报价波动大,决策前索取当日原厂/总代书面询价——勿依赖网络文章固定标价。
07
一句话总结
2026年AI算力策略:先租后建,拿满算力券,用量稳定再议自建。
只有数据主权+常年高负载双满足,才是自建起点。否则,租就是最优选。
硬件价格以签约当日原厂授权渠道正式报价为准。
留言区聊聊你的判断和理由 👇
— — —
梁子
智能化体系全栈从业者,专注AI算力与智能建筑交叉领域
公众号:梁子智算圈
点击菜单栏获取往期文章汇总
以上为个人观点,仅供参考,不构成投资与采购建议。
【参考信源】
工信部《算力基础设施高质量发展行动计划》
中国信通院《央国企智算创新实践报告》
NVIDIA DGX B300 官方产品页(nvidia.com),2026年4月30日
各地2026年算力券政策文件(具体文号以当地工信部门最新发布为准)
Spheron/iFactory/Glenn Klockwood等第三方技术评测(B300单卡TDP及FP64性能参数)
夜雨聆风