英伟达AI存储棋局:三星拿出压箱底技术,全球NAND市场正在被重新分配
AI基础设施这两年的叙事一直是英伟达GPU缺货、HBM涨价、CoWoS产能告急。现在,一个此前长期被忽视的角色正式登场——NAND闪存,正在从"配角"变成决定AI集群能跑多快的关键变量。
英伟达正在推动一套名为CMX(Context Memory Storage,上下文记忆存储)的新架构。 简单说,过去GPU处理AI推理时产生的海量临时数据——也就是KV缓存(Key-Value Cache)——只能塞进昂贵的GPU显存或服务器内存里,一旦装不下就只能丢弃或者重新计算。CMX的思路是给GPU集群外挂一层用SSD搭建的"缓存池",让这些临时数据能被快速调取复用,而不是每次都从零算起。
这个架构听起来像是存储行业的小修小补,但背后牵动的产能规模相当惊人。根据韩国媒体Sedaily及多家外媒近期报道,一套CMX系统最多可集成576块企业级SSD,总容量达到9600TB,也就是9.6PB。而支撑这套系统运转所需要的NAND闪存供给,正在把三星电子的整条产线拖入一场前所未有的产能重组。
数据说话:需求曲线有多陡
这组数字意味着什么。按照多家研究机构的测算口径,CMX这一单一应用场景在一年之内新增的NAND需求,相当于给市场凭空塞进去一个"苹果体量级"的新买家。存储行业过去从没见过需求曲线在这么短时间里这么陡。
三星这次不是单纯扩产,而是同时把三代V-NAND技术线并行推进,这在存储芯片历史上并不常见。 目前三星每月V-NAND晶圆产能超过10万片,其中约60%已经切给了第九代V9技术(286层堆叠),良率稳定在80%以上,已进入成熟量产阶段。
与此同时,第十代V10已经正式量产并开始向英伟达出货,层数堆到约400层,存储密度比V9提升超过50%。更关键的是,V10首次大规模采用钼(molybdenum)替代传统钨(tungsten)作为布线材料,布线厚度减薄30%到40%,这是NAND制程工艺的一次实质性跃迁,而不是简单堆层数。
第十一代V11已经开始试产,目标层数在400到500层之间,三星计划下半年把试产规模翻倍,加速积累良率数据。
三大代际同时开火,说明三星在赌一件事:英伟达对存储的胃口只会越来越大,谁先把下一代技术送上量产线,谁就锁定未来几年最肥的订单。
谁在为这场狂欢买单
产能被大幅倾斜到英伟达订单,直接后果是消费级和企业级SSD市场可能面临供给收紧和价格上行压力。 三星将超过60%的V-NAND产能投入V9生产线,原本用于消费级PC、笔记本、企业存储服务器的NAND供给被结构性挤占。
行业分析普遍认为,当NAND巨头把最先进的产能优先满足AI巨头的定制订单,普通企业客户和消费者拿到的往往是"剩下的产能",价格谈判筹码被系统性削弱。这一逻辑此前已经在DDR5内存市场上演过一轮,如今正在NAND闪存市场重演。
这不是危言耸听。存储芯片行业本质上是重资产、长周期的生意,产能一旦切给某个大客户,短期内很难逆转。三星2026年利润预期已经被多家韩媒报道称"有望超过过去40年的利润总和",这个体量的收益,足以让任何一家存储厂商在产能分配上做出同样的选择。
技术细节:CMX到底怎么"用"这些NAND
英伟达在其技术博客中给出的说法是,CMX通过以太网连接一层闪存缓存,在GPU或主机内存需要KV缓存块之前提前完成预取(pre-staging)。配合Dynamo推理框架和DOCA Memos软件栈,系统能智能判断该从哪个节点调取缓存。BlueField-4负责NVMe SSD的管理、KV缓存完整性保护以及加密卸载。英伟达给出的目标是,在长上下文和智能体(Agentic)类工作负载下,相比传统存储方案,持续词元处理性能和能效比最多可提升5倍。
需要提醒的是,这个5倍提升是有前提条件的,它假设缓存复用、预取调度和网络连接三者都处于理想配置状态,并不适用于所有推理场景。行业媒体XenoSpectrum的分析也指出,三星具体会把V10产能中的多大比例分配给CMX,目前官方并未给出确切数字,市面上流传的产能数字更多是需求预测,而非三星的出货承诺。这一点在解读这类新闻时值得留一个心眼,产业报道里经常把"需求预测"和"实际出货"混为一谈。
大多数人还在用"缺不缺货"这个单一维度去看这轮AI基础设施竞赛,但真正值得琢磨的是一个更反直觉的现象:AI存力需求的爆发,本质上是算力过剩的一种"副作用"。 换句话说,不是存储技术突然变得多重要,而是GPU算力增长的速度已经远远甩开了内存容量增长的速度,SSD只是被迫顶上去填补这个结构性缺口的替代品。
这意味着CMX这类方案本质上是一种"妥协架构",一旦下一代HBM容量出现跃升,或者出现更便宜的高速持久化内存技术,CMX的战略地位可能会被重新压缩。
换句话说,现在被捧上天的NAND扩产潮,未必是一个能持续十年的确定性叙事,更像是当前这一代硬件瓶颈下的过渡方案。这个视角在目前的行业报道里几乎没人提。
写在最后
这轮AI基础设施竞赛正在从"谁的GPU更强"这个单一战场,扩展成"谁能把算力、显存、存储、网络这几个维度同时拉齐"的系统工程比拼。任何一个环节掉队,瓶颈就会立刻转移到那个环节上。NAND闪存这次被推到聚光灯下,只是这条逻辑链的最新一环,不会是最后一环。
存储正在从AI基础设施里的"配角"变成"战略资源"。 对整个产业链而言,这意味着未来一段时间,NAND供需的紧张程度、价格波动的剧烈程度,可能会复刻过去两年HBM市场经历过的剧本。这不是某一家厂商的机会,而是整条存储产业链正在被重新定价的信号。
谢谢


夜雨聆风