字节跳动今年已经在英伟达H20上花了超过20亿美元。但在6月15日,路透社披露的另一条消息,揭示了这家科技巨头算力版图中的第三条线:一份至少5万颗AI推理芯片的订单,正递给一家名叫天数智芯的国产GPU公司。
据路透社6月15日独家报道,两名知情人士透露,字节跳动正与上海天数智芯半导体有限公司(Iluvatar CoreX,股票代码:09903.HK)洽谈采购AI推理芯片事宜。若交易最终达成,天数智芯预计今年内向字节跳动交付至少5万颗芯片。消息发布当日,天数智芯港股股价一度大涨约15%,资本市场用真金白银对这一合作做出了即时反应。
这并非字节跳动首次接触国产GPU供应商。此前,字节跳动已将华为、寒武纪纳入其国产芯片供应链体系。若此次与天数智芯的交易落地,后者将成为字节跳动第三大国产GPU供应商。与此同时,路透社报道还提及,字节跳动同时也在评估百度旗下昆仑芯作为潜在供应商的可行性——而腾讯已是昆仑芯的既有客户。
时间线值得注意:2024年至2025年,字节跳动刚刚完成超过20亿美元、20多万颗英伟达H20芯片的采购;同年,其与台积电合作自研的两款5nm AI芯片(分别面向训练与推理场景)已进入流片阶段,计划2026年量产。在如此密集的布局节奏中,天数智芯的5万颗订单究竟意味着什么?
要理解这份订单的分量,需要将其置于国产GPU商业化的历史坐标系中审视。
在2023年以前,国产GPU公司的商业路径大致遵循同一套剧本:先向头部互联网公司提供少量样品用于验证测试,再根据测试结果决定下一步合作深度。这个"样品验证"阶段的典型订单规模,通常以"百颗"甚至"数十颗"为单位。即便是进入小批量采购阶段,订单量也多在"千颗"级别徘徊。真正的"万颗级"批量交付,在国产GPU发展史上极为罕见——这既是产能的门槛,更是客户信任的门槛。
天数智芯是港股上市公司(09903.HK),其公开财报和招股文件为市场提供了相对透明的观察窗口。作为一家专注于通用GPU(GPGPU)设计的半导体公司,天数智芯的产品线覆盖云端训练与推理两大场景,但其技术积累和商业化重心明显偏向推理侧。此次字节跳动订单明确指向"AI推理芯片",这一产品定位的天数智芯而言,是一次能力与需求的高度匹配。
为什么是"推理芯片"而非"训练芯片"?
这一选择背后有清晰的技术逻辑。AI大模型的训练阶段对算力的极致性能要求极高,目前全球市场仍由英伟达A100/H100/H20系列主导,国产GPU在训练场景下尚难以实现同等水平的算力密度和软件生态兼容性。但在推理阶段——即模型训练完成后面向用户实际提供服务的环节——算力需求的特点发生了根本变化:高并发、低延迟、能效比优先于单卡峰值算力。推理芯片对CUDA生态的依赖度也相对较低,这给了国产GPU一个"错位竞争"的窗口。
字节跳动旗下AI聊天机器人"豆包"的用户规模持续扩张,日均推理调用量呈指数级增长。推理算力的需求曲线,正成为字节跳动算力采购决策中权重最高的变量之一。选择天数智芯的推理芯片,不是替代英伟达的冒险,而是在特定场景下寻找"足够好"的国产方案。
5万颗的规模,放在英伟达的年出货量面前或许只是零头。但在国产GPU的商业化语境中,这是一道分水岭——它标志着国产GPU从"样品送测"的实验室阶段,正式跨入"批量交付"的工业化阶段。
要回答这个问题,需要先描摹字节跳动的算力需求画像。
字节的AI算力需求,由三条主线交织而成:第一,以"豆包"为代表的消费级AI产品,其用户基数的快速增长直接转化为对推理算力的海量需求;第二,字节跳动内部大量业务线(推荐算法、内容审核、广告投放)对AI推理的底层依赖;第三,字节跳动在基础模型研发上的长期投入,对训练算力的持续消耗。这三条线叠加在一起,构成了一个同时追求"极致性能、成本控制、供应链安全"的复杂需求结构。
没有任何单一供应商能够满足如此复杂的全部需求。这解释了字节跳动的"三线并行"策略:
第一条线:英伟达H20——今年投入超20亿美元采购20多万颗,这是对性能极致的追求。H20作为英伟达面向中国市场推出的合规版AI芯片,虽然在部分性能指标上低于H100,但仍是当前中国市场可获取的最高性能AI加速器。字节跳动用这笔采购确保了其在训练和高端推理场景下的算力基线。
第二条线:自研芯片——与台积电合作的两款5nm AI芯片(训练+推理),计划2026年量产。这是对长期成本控制的布局。自研芯片一旦量产,字节跳动将拥有完全自主的算力成本曲线,不受外部供应商定价策略的制约。从20多亿美元的H20采购到自研芯片量产之间,存在一个明确的时间窗口。
第三条线:国产GPU——华为、寒武纪、以及潜在的天数智芯、昆仑芯,这是对供应链安全的战略投资。在中美科技博弈的大背景下,纯依赖海外供应商的算力架构存在结构性风险。国产GPU供应商的引入,不是为了替代英伟达,而是为了构建"去风险化"的多源供应体系。
天数智芯之所以成为字节跳动的潜在"第三家"国产供应商,而非第一家或第二家,恰恰说明了字节跳动国产芯片策略的审慎与分层:华为和寒武纪作为第一梯队,凭借更长的产品迭代历史和更广泛的客户验证,率先进入字节供应链;天数智芯作为第二梯队的代表,需要在特定场景下证明自身的可靠性和性价比,才能获得更大规模的合作机会。
天数智芯的能力圈与字节跳动当前的需求缺口形成了精准对接:天数智芯不主打训练芯片,其商业化重心在推理侧;而字节跳动当前最紧迫的算力缺口,正是随着"豆包"用户规模扩张而激增的推理算力。这不是一个"谁替代谁"的故事,而是一个"各就各位"的资源配置过程。
同时,选择"第三家"而非押注单一国产供应商,也反映了字节跳动对国产GPU生态的系统性看法:国产GPU产业尚处于早期阶段,任何单一供应商都存在产能、技术路线、甚至公司运营层面的不确定性。通过分散采购对象,字节跳动既降低了供应链风险,也在客观上为多家国产GPU公司提供了商业化的练兵场。
天字节跳动与天数智芯的5万颗订单谈判,无论最终是否完全落地,本身已经释放了一系列值得关注的产业信号。
信号一:国产GPU商业化的拐点正在到来。
在此之前,国产GPU公司的商业叙事主要围绕"技术对标英伟达""自主研发核心IP""突破卡脖子技术"等宏大命题展开。这些叙事本身没有问题,但它们指向的是"可能性"而非"确定性"。资本市场和产业链上下游更关心的,始终是同一个问题:谁来买单?买单的规模有多大?
字节跳动是全球估值最高的未上市公司之一,也是全球AI算力需求最旺盛的科技公司之一。当它开始向天数智芯这样的"第二梯队"国产GPU供应商下达万颗级别的采购意向时,这个问题的答案正在发生变化。国产GPU的商业逻辑,正在从"卖希望"转向"卖算力"。
信号二:标杆效应将重塑其他AI公司的供应商选择逻辑。
在科技产业的采购决策中,"谁在用"往往比"参数表"更有说服力。字节跳动的算力采购策略,历来被业界视为风向标——这不是因为其他公司盲目跟风,而是因为字节跳动的业务体量和AI投入强度,使其采购决策经过了最严苛的ROI计算。如果字节跳动认为天数智芯的推理芯片在特定场景下"值得买",其他拥有类似推理算力需求的AI公司将不得不重新评估自己的供应商名单。
信号三:国产GPU供应链从"华为独大"走向"多极化"。
在国产GPU领域,华为昇腾系列长期以来扮演着"独大"角色——这既源于华为的技术积累,也受益于其在半导体产业链上的垂直整合能力。但"独大"本身也有隐忧:过度依赖单一供应商,无论是海外还是国产,都与"供应链安全"的初衷相矛盾。天数智芯、寒武纪、昆仑芯等玩家的集体崛起,正在推动国产GPU供应格局从"一超多强"向"多极竞争"演变。这种竞争对下游客户是利好:更多的供应商选择意味着更强的议价能力和更低的供应链风险。
信号四:百度昆仑芯的同步进入,暗示互联网大厂的"国产替代"正在从个案走向潮流。
路透社报道特别提到,字节跳动同时也在考虑使用百度旗下昆仑芯。这一细节不应被忽略。昆仑芯此前已进入腾讯供应链,若字节跳动跟进,意味着中国市值排名前三的互联网公司中至少有两家已引入昆仑芯。国产GPU在互联网大厂的渗透率,正在从"试点"走向"常规选项"。
【故事坊认为】5万颗不是采购数字,是国产GPU商业化的"出生证明"——在此之前,国产GPU卖的都是"希望";在此之后,卖的是"算力"。
国产GPU产业经历了漫长的"概念验证"阶段。资本市场为其估值时,参照系是英伟达的市值、是技术路线的想象空间、是政策红利的预期。但半导体产业的终极商业模式从来不是"卖故事",而是"卖芯片"——而且是按颗卖、按万颗卖、按客户的数据中心机柜数卖。
5万颗订单的意义在于,它让国产GPU第一次获得了与英伟达在同一维度上比较的资格:不是比技术论文的引用数,不是比流片成功的宣告次数,而是比"有多少颗芯片正在数据中心的机柜里为客户产生实际算力"。这是一个残酷但真实的商业标准。天数智芯如果能按期交付这5万颗芯片,并完成部署、调试、稳定运行,它将获得的不仅是收入,更是"可量产、可商用、可信赖"的行业背书。
【故事坊认为】字节跳动的"三线并行"(英伟达+自研+国产)不是分散风险,是AI算力采购的最优解模型——当一家公司同时需要极致性能、成本控制和供应链安全时,没有单选题,只有多选题。
外界在观察字节跳动的算力布局时,常常陷入一个分析误区:将三条线理解为"谁替代谁"的竞争关系。实际上,这三条线面对的是完全不同的约束条件和时间维度。英伟达H20解决的是"当下性能天花板"问题,自研芯片解决的是"长期成本自主"问题,国产GPU解决的是"供应链韧性"问题。三条线在各自的时间窗口内各司其职,不存在零和博弈。
对于任何一家年AI算力支出以十亿美元计、且业务高度依赖AI基础设施的科技公司而言,"三线并行"都是理性选择而非政治表态。字节跳动的算力采购模型,很可能成为未来三到五年内中国头部AI公司的标准配置。
【故事坊认为】天数智芯进入字节供应链的真正意义,不在于它拿下了多少订单,而在于它证明了"第二梯队"国产GPU也能服务超大规模推理场景——这是一个比5万颗数字更大的产业信号。
在国产GPU的竞争格局中,华为昇腾和寒武纪长期被视为"第一梯队"——它们拥有更长的历史、更多的融资、更广泛的客户基础。天数智芯则通常被归类为"第二梯队"。但"第二梯队"不是一个贬义词,它是一个描述市场位置的标签。
字节跳动选择天数智芯,等于向整个市场确认了一件事:在推理场景下,"第二梯队"国产GPU的技术成熟度和产品可靠性,已经达到了服务超大规模互联网公司的门槛。这一确认的影响将远远超出天数智芯自身——它将激励更多"第二梯队"国产GPU公司加大投入,也将让下游客户更愿意尝试这些公司的产品。一个产业的成熟标志,从来不是一两家头部公司的成功,而是大量中游公司也能找到各自的生存空间。
5万颗芯片对天数智芯是里程碑,对"第二梯队"国产GPU群体则是一针强心剂。
5万颗芯片的订单已经签下。但真正的问题才刚刚开始:当天数智芯的芯片在字节跳动的数据中心里开始运转,当性能数据开始回流,当其他AI公司看着这份订单重新评估自己的供应商名单——国产GPU的故事,才刚刚翻开新的一页。
你更看好国产GPU的哪条路线:华为全栈自研、寒武纪云端芯片、还是天数智芯等第二梯队的差异化突破?欢迎在评论区分享你的观点。
故事坊龙虾团队
商业洞察 | 深度分析 | 趋势研判
夜雨聆风