ARTICLE · 1036318
黄仁勋说明年芯片翻倍,华为同一天发了51.2万卡超节点
云极投研 · 科技×投资深度观察


华为全联接大会2026官方主视觉(9月17-19日·上海)|图源:huawei.com
9月17日,黄仁勋在苏格兰峰会上对英国国王查尔斯三世说,2027年英伟达芯片销量将达到今年的两倍。
同一天,华为副董事长汪涛在上海全联接大会上发布全球首个采用NPO技术的超节点——昇腾960,最大可扩展到51.2万卡,叠加多轨道拓扑能跑到100万卡。
一个卖芯片,一个卖系统。一个靠单卡性能称王,一个靠系统工程把单卡算力榨干。两条路径在同一天撞到了一起。
一、黄仁勋的"翻倍"到底翻的是什么
黄仁勋的原话是"2027年芯片销量将是当前年度水平的约两倍"。瓶颈不是需求,是把芯片造出来的能力。
把这话拆开看。
3月GTC,黄仁勋说Blackwell和Rubin两代芯片到2027年底累计收入至少1万亿美元。去年10月他说的是2025-2026年间订单超5000亿。两次表态相隔5个月,市场规模预期进一步上调。
但仔细看,1万亿是累计收入,时间窗是从2025到2027,跨度三年。所谓"翻倍"主要是把计数窗口从"2026年底"拉到"2027年底",多算一年。Bloomberg当时的报道说,这个上调是"时间线延伸,不是销售增长加速"。
财报数据更直接。截至7月26日的2027财年Q2,英伟达营收962.21亿美元(6469亿元人民币),同比+106%。净利润596.88亿美元(4013亿元),同比+126%。最新一季已经再创季度营收新高。
按这个季度增速外推到2027年底,1万亿美元累计收入在账面上已经够得着。这是已经报告过的数字相加的结果。
Vera Rubin已经全面量产,2026年秋季开始出货。CoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud、Nebius已有Vera Rubin机架运营。MLPerf预览结果,Vera Rubin NVL72跑Qwen3-VL推理吞吐是GB300的3.7倍,跑DeepSeek-R1是2.5倍。
华尔街的解读也很直接。9月17日美股开盘,英伟达涨2.1%。费城半导体指数涨3.14%,Ciena涨8%,迈威尔涨7%,SK海力士、Coherent、闪迪、康宁涨超6%,三倍做多半导体ETF-Direxion大涨10%。

英伟达创始人兼CEO黄仁勋|图源:百度百科
二、华为走的是另一条路
汪涛在发布会上说:"只做好一个芯片是远远不够的,只做一个整机、做一台服务器也是不够的,最终需要的是复杂、多学科的系统工程能力,给客户交付一个高可用的计算系统。"
这话直接说出了华为的路径选择。不跟英伟达拼单颗芯片性能,拼的是把单卡算力榨干的系统能力。
昇腾960超节点是这套思路的产物。单超节点4096卡,8 EFLOPS FP8算力,16 EFLOPS FP4,1PB HBM容量。多个超节点用灵衢网络或RoCE连接,最大51.2万卡。再叠加多轨道拓扑技术,最大100万卡昇腾超节点集群。
这个规模的突破点不在芯片本身,在两个互联技术。
第一个是Hi-ONE光引擎。这是业内首个具备量产能力的NPO产品。NPO就是近封装光学,把光电转换从机柜挪到计算芯片边上几厘米处,突破铜缆在传输距离和带宽上的物理限制。单引擎传输容量7.2T,是行业目前最大传输能力的NPO产品,也是唯一实现内置光源的。
汪涛说,华为把30年积累的光技术用到了超节点系统里。这套技术把传统方案需要的4.8万颗800G光模块压缩到5500个Hi-ONE。功耗降低超550千瓦,系统无故障运行时间提升一倍,系统可用度达到99.8%。
第二个是灵衢协议。华为自研的面向超节点的互联协议。整合多台物理机器的计算资源,在逻辑上形成统一的超节点架构,支持跨物理服务器的内存访问。
华为马尔科夫实验室的仿真结果:在10万卡同等规模下,4K超节点集群相比传统8卡服务器集群,模型浮点算力利用率提升2.75倍。
三、量产节奏和生态底座
昇腾960芯片研发进度比原计划快。960DT预计2027年第一季度就绪,960PR 2027年第三季度就绪。后续保持一年一代,2028年970,2029年980。
昇腾910C超节点已部署超1000套,950超节点已规模商用。
生态这边,鲲鹏全球开发者超416万,生态合作伙伴超7200家,支持560多个全球开源项目。openEuler装机量超2000万套,是中国服务器操作系统第一份额。CANN全面开源开放,进入常态化开源社区运营。
汪涛的原话:"我很高兴看到中国涌现出一批十分优秀的大模型企业。华为的使命是为这些优秀企业构建坚实的算力底座。"

英伟达中国官网,GTC 2026黄仁勋主题演讲|图源:nvidia.cn
四、四个视角看这场算力对决
普通用户视角:这场对决离你比想象中近。英伟达单卡贵,华为系统便宜的是互联。最终决定你用的GPT、Claude、Qwen每月多少钱订阅的,就是这两条路径谁更省电、谁更省卡。
开发者视角:灵衢协议+CANN开源是华为的真正底牌。模型能不能原生跑在昇腾上,决定开发者迁移成本。Vera Rubin跑Qwen3-VL是GB300的3.7倍吞吐,英伟达也在反过来优化对中国开源模型的适配。两家都在抢开发者。
供应链视角:Hi-ONE内置光源,把激光器等核心光器件纳入整机厂商自研体系。可插拔光模块在超大规模AI集群里的角色要变。光模块厂商的应用场景会更多转向边缘节点和中短距互联,高密度AI集群核心互联向NPO/CPO迁移。这是光器件供应链分工模式的深远变化。
投资者视角:英伟达8月底财报透露,下一财年营收增速约70%,规模约6730亿美元。分析师平均目标价324.30美元,仍有约48%上涨空间。华为这边没上市,但昇腾超节点的部署进度、灵衢生态伙伴数量、openEuler装机量是三个可观察的替代指标。半导体设备零部件紧缺也在加速国产替代,韩国沉积设备零部件交期从4个月延到10个月,日本激光件最长40个月。
五、为什么是同一天
黄仁勋在苏格兰跟英国国王、DeepMind、OpenAI、Anthropic代表讨论AI安全。汪涛在上海发布算力底座。一个谈安全的边界,一个谈算力的天花板。
这两件事在同一天发生,背后是同一个产业阶段的特征。AI竞赛已经过了"谁模型更聪明"的单点比拼,进入"算力+互联+存储+生态+治理"的系统工程对决。
黄仁勋说瓶颈不是需求是供给。汪涛说单芯片不够要交付系统。这两句话指向同一个事实,AI基础设施正在变成越来越接近一项系统工程。
谁先在系统层跑通,谁就先让十万亿参数模型从论文走进产线。
盯三个信号
一、Vera Rubin 2026年秋季实际出货量,以及英伟达下一财年70%营收增速能否兑现。
二、昇腾960DT 2027年Q1是否如期就绪,以及超节点集群的客户落地数量。
三、灵衢协议是否被中国大模型厂商原生采用,决定华为算力底座的生态粘性。
黄仁勋在赌需求永远跑在供给前面。华为在赌系统工程能压住单卡性能差距。两条路都通向百万卡集群,但谁先把账算明白,谁就先让万亿参数训练从论文走进产线。
—— 云极投研
关注云极投研,看懂科技与投资的交叉点