
先说结论:短期反超不了,长期不好说,但被卡得没想象的那么死。
这个话题网上吵得凶,一边是"中国AI要完"的悲观派,一边是"弯道超车"的乐观派。两边都没说全。
真要把这事讲清楚,得从三个层面看:卡的是什么、卡住了多少、有没有解。
卡的到底是什么?
很多人以为美国禁的是"芯片",其实禁的是"算力高端供给"。
具体说,从2022年10月开始,美国商务部工业与安全局(BIS)把英伟达A100、H100这两款高端GPU列入出口管制清单。后来中国厂商改买"阉割版"H800、A800,美国又把阉割版也禁了。2025年到2026年这一轮更狠——H200对华出口从"推定拒绝"改成"个案审查",但审查条件苛刻到英伟达至今只拿到少量许可;2026年6月又把管制半径扩到海外注册的中资企业、海外算力租用、第三地转运。
不光禁卖芯片。2025年5月,美国BIS还宣布,全球任何地方使用华为昇腾AI芯片都算违反出口管制。这是反向操作——不光不卖给你,还不让别人用你的。
一句话:美国想从供给端和需求端两头堵。

卡住了多少
这是关键问题。分两块看。
训练端:影响大,但没堵死。
训练大模型是吃算力的大头。GPT-4级别的模型,业界估算训练成本上亿美元,用的GPU以万计。英伟达H100单卡售价3万美元左右,训一个顶级模型动辄需要两三万张。这个量级,被禁之后确实难受。
但有个反常识的事实:2025年初DeepSeek-V3用2048张H800,花了557.6万美元,训出了接近GPT-4o水平的模型。这说明算力效率还有很大压缩空间,不是非得堆到几万张卡才能出好模型。
不过别误会,这不是说卡脖子没用。DeepSeek是特例,靠的是算法架构创新(MoE混合专家+多token预测)和工程优化。绝大多数厂商没这个能力,还是得靠堆卡。卡住高端芯片,等于卡住了大部分厂商的上限。
推理端:影响小,国产基本能顶。
模型训练完之后,跑起来服务用户叫推理。推理对单卡性能要求没那么极致,国产昇腾910B、寒武纪思元、摩尔线程这些,性能够用,生态也在补。国内大部分to B的AI应用,推理算力已经能用国产替代。
所以现实是:训练卡脖子疼,推理基本不疼。

有没有解
三条路,各有各的问题。
第一条,国产替代。
华为昇腾910B单卡算力已经接近英伟达A100,910C据说进一步追平H100。但硬件追上只是一半,更难的是软件生态——英伟达的CUDA生态积累了十几年,开发者习惯、工具链、优化库全是基于CUDA的。国产芯片要让人用得顺手,得把这套生态搬过来或者重建,这是三五年的活,不是一两年能搞定的事。
而且国产芯片本身也受制于先进制程。7纳米以下的制造依赖ASML的EUV光刻机,这台机器也被禁了。中芯国际能用DUV做出7纳米,但良率和成本都是问题,量产高端AI芯片依然吃力。
第二条,算力效率优化。
DeepSeek走的这条路。既然卡少,那就把每张卡的效率榨干。MoE架构、稀疏化、混合精度训练、流水线并行——这些技术国内厂商都在跟进,确实能部分抵消算力劣势。
但这条路有天花板。算法优化能省一倍两倍,省不了十倍。真要训GPT-5、GPT-6那个级别的模型,还是得靠算力规模硬撑。
第三条,绕道海外。
在海外租算力、建数据中心、通过第三地采购。这是2026年6月美国新一轮管制重点堵的口子。能不能完全堵住不好说,但成本和风险都在飙升,已经不是正经解法,更像是灰色地带。

把话说实在点。
短期(1-2年):反不了超。
算力差距摆在那,CUDA生态差距更大。GPT-5、Claude 4这个级别的模型,国内短期内出不来同水平的。美国研究者Nathan Lambert2026年7月的判断是中美模型差距已缩至3-5个月——这个数字比一年前的12-18个月好很多,但依然是落后,不是反超。
中期(3-5年):有可能在某些方向追平。
开源模型是个变量。DeepSeek、Qwen、Kimi这几家走开源路线,靠算法创新弥补算力劣势,已经在部分基准测试上接近闭源顶级模型。如果国产芯片生态起来,加上算法持续优化,3-5年内在大部分应用场景追平是有可能的。
但"追平"和"反超"是两回事。反超意味着在前沿能力上领先,这需要算力、算法、数据、人才全面领先,短期内看不到。
长期(5年以上):真不好说。
AI这个领域变化太快,五年前没人能预测到今天这个局面。下一个范式革命——不管是世界模型、具身智能还是别的什么——可能重新洗牌。到那时候比的就不光是算力,而是谁能先找到新方向。这个层面,谁都说不准。

几个常见的误读
误读一:"DeepSeek证明算力不重要了"。
不对。DeepSeek证明的是算力效率可以被优化,不是算力不重要。它用2048张H800做出好模型,前提是这2048张卡它有。如果连2048张都没有,再好的算法也跑不起来。
误读二:"国产芯片马上能替代英伟达"。
乐观了。硬件性能追得上,软件生态追不上。CUDA不是一天建成的,国产替代生态也不是一天能建成的。三五年是保守估计。
误读三:"中国AI要完"。
悲观过头了。中国有全球最多的AI论文产出、最大的应用市场、最完整的产业链。算力被卡是阵痛,不是绝症。DeepSeek、Qwen这些模型已经证明,在被卡的情况下依然能做出有竞争力的产品。
一句实在话
卡芯片这事,疼是真疼,但没到要命的程度。
短期内中国AI反超不了美国,这个事实得认。但"认落后"和"认输"是两回事。差距在缩小,从18个月缩到3-5个月,这就是进步。
真正的较量不在嘴上,在实验室里、在芯片产线上、在每一个工程师的代码里。急不得,也丧不得。
这仗才刚开始打。
夜雨聆风