夜雨聆风学习资料网

ARTICLE · 1132621

工控资讯|KV‑Cache 卸载与 CXL 池化:AI 分层存算协同基础设施产业观察|2026.10.06

工控资讯|KV‑Cache 卸载与 CXL 池化:AI 分层存算协同基础设施产业观察|2026.10.06
10 月 6 日,FMS 全球内存存储峰会持续释放产业信号;NVIDIA 正式对外发布 BlueField‑4 STX AI 原生上下文存储参考架构,实现大规模 Agent 集群 KV‑Cache 硬件卸载;Intel 推出 CXL3.2 内存池化整机参考设计;HPE、Dell 同步更新面向大模型的分层智能存储整机;AMD 发布 EPYC 平台 CXL 内存扩展固件更新;行业共识持续强化:AI 集群性能瓶颈逐步从单纯算力转向内存、缓存、存储协同调度,KV‑Cache 分层卸载、CXL 内存池化成为降低智算 TCO 的核心工程手段。

导语:9 月 30 日‑10 月 6 日,NVIDIA、Intel、HPE、Dell、AMD 集中发布 AI 原生存储、CXL 内存池化、KV‑Cache 卸载相关硬件与固件;传统存储架构已经无法适配 Agent 大模型海量上下文、KV 缓存爆炸增长压力;产业走向 HBM‑本地 DRAM‑CXL 池化内存‑高速 SSD‑归档冷存储五级分层架构,把高频 KV 缓存做分层卸载,缓解 GPU HBM 内存资源紧张;WEC 世界算力博览会、CPE 算电协同展进入倒计时;国内存算协同、CXL 相关标准预研同步推进。

摘要:

1、本期产品动态共 18 条全新 10 月上旬条目, HPE、Dell、Intel、AMD、NVIDIA 的 AI 原生存储、CXL 内存池化、KV‑Cache 卸载硬件;覆盖 AI 存储服务器、CXL 内存池化整机、DPU 存储卸载板卡、分层存储配套散热与网络组件;

2、技术主线:大模型与 Agent 业务驱动五级分层存算架构落地;KV‑Cache 上下文缓存向 CXL 内存池、高速 SSD 硬件卸载,释放宝贵 GPU HBM 资源;CXL3.2 内存池化实现跨节点内存资源共享;DPU 承担存储协议卸载,降低主 CPU 开销;冷板式液冷相对风冷 5 年 TCO 降低 15%‑25%,浸没式液冷相对风冷 5 年 TCO 降低 20%‑35%。

3、产业动态:NVIDIA BlueField‑4 STX 上下文存储架构发布,面向 Agent 集群实现 KV 缓存硬件卸载;Intel 公开 CXL3.2 整机池化内存参考基线;AMD 更新 EPYC 平台 CXL 内存扩展固件;HPE、Dell 推出 AI 专用分层存储整机,大模型推理集群开始大规模验证存算分离卸载方案。

4、供应链信息:CXL 内存扩展控制器、高速 DPU、企业级高耐久 SSD 供给紧张,制约存算协同整机交付。

5、展会排期:9.23‑27第五届全球数字贸易博览会(已闭幕);10.17‑19WEC2026 世界算力博览会(深圳・即将开展);10.26‑28CPE2026 国际算电协同产业链展览会(上海・即将开展);覆盖 KV‑Cache 卸载、CXL 内存池化、AI 原生分层存储主题。

💡本期新品共性三大亮点

1、面向 Agent 大模型海量上下文压力,支持 KV‑Cache 上下文缓存硬件分层卸载,把非最热缓存迁移至 CXL 内存 / 高速 SSD,释放 GPU HBM,提升集群并发推理规模;

2、CXL3.2 内存池化技术走向商用验证,实现跨服务器节点内存资源池共享,打破单服务器内存物理上限,优化大模型内存资源利用率;

3、DPU 承担存储协议、IO 搬运硬件卸载,解放主 CPU 计算资源;形成 HBM‑DRAM‑CXL 池‑SSD‑归档冷存储完整五级分层,兼顾推理时延与整体集群 TCO。

一、产品动态

1、NVIDIA BlueField‑4 STX Agent 上下文存储 DPU 平台

核心参数:BlueField‑4 DPU;STX 存储加速架构;硬件 KV‑Cache 卸载;RDMA 高速远程内存访问;支持跨机架 Agent 上下文缓存共享;兼容 MGX 整机柜生态。

✨产品亮点:DPU 硬件接管 KV 缓存搬运、协议处理;实现多 Agent 集群之间上下文池共享;最高可将 Token 吞吐提升 5 倍,降低 GPU HBM 占用压力。

📌业务价值 & 场景:大规模多 Agent 智算推理集群,千亿‑万亿参数大模型上下文缓存卸载基础设施。

2、Intel Xeon6‑CXL3.2 整机级内存池化参考设计

核心参数:Xeon6 + 平台;CXL3.2 链路;跨机箱内存池化管理;支持热添加 / 热移除内存扩展模组;提供整机 BIOS 与固件参考基线。

✨产品亮点:打破单台服务器内存插槽物理上限;多台服务器组成共享内存资源池,大模型推理动态按需分配内存容量;输出 ODM 可复用完整硬件规范。

📌业务价值 & 场景:ODM 厂商 CXL 内存池化服务器开发基线,大模型推理集群内存资源弹性调度硬件依据。

3、HPE AI Factory StoreOnce‑STX AI 原生分层存储整机

核心参数:4U 机架整机;对接 NVIDIA STX 架构;五级分层存储调度引擎;支持 KV‑Cache 下沉至 SSD 池;WORM 不可变日志分区;横向大规模扩展。

✨产品亮点:面向 Agent 大模型做存储栈深度优化;自动完成热 / 温 / 冷 KV 缓存数据分层迁移;兼顾向量知识库、训练数据集归档、推理上下文缓存三类负载。

📌业务价值 & 场景:公有云、政企私有化 Agent 集群配套存储,大模型推理上下文 + 向量库一体化存储节点。

4、Dell PowerStore‑STX KV‑Cache 卸载 AI 存储平台

核心参数:3U 高密度存储整机;对接 BlueField‑4 STX DPU;智能分层调度引擎;RDMA 高速访问;支持 vLLM、LMCache 生态对接;硬件加密分区隔离。

✨产品亮点:专门适配大模型推理 KV 缓存卸载;自动识别缓存热度完成数据迁移;降低 GPU 内存占用,提升集群并发会话数量。

📌业务价值 & 场景:企业私有化 MoE、Agent 推理集群,大模型上下文缓存下沉存储硬件平台。

5、AMD EPYC Venice CXL3.2 内存扩展固件更新参考整机

核心参数:EPYC Venice 平台;CXL3.2 协议栈更新;支持多机箱内存池组网;内存资源动态分片分配;与 ROCm 软件栈深度协同调优。

✨产品亮点:固件层面优化 CXL 内存访问时延;GPU 可远程直接访问 CXL 池内存;适配多 XPU 混合集群内存资源调度。

📌业务价值 & 场景:AMD 平台大模型推理集群,CXL 内存池化部署验证整机参考平台。

6、HPE ProLiant DL385‑CXL CXL 内存池化 AI 服务器

核心参数:2U 机架;双路 AMD EPYC Venice;外置 CXL 内存扩展机箱接口;支持多机组建内存资源池;高速 NVMe‑oF 存储互联。

✨产品亮点:生产级 CXL 内存池化商用机型;支持内存模组在线扩容,无需停机重启业务;适配大模型推理内存弹性需求。

📌业务价值 & 场景:政企私有化大模型推理集群,依靠 CXL 池化解决单节点内存容量瓶颈。

7、Dell PowerEdge R980‑CXL CXL3.2 内存池化服务器

核心参数:2U 机架;Xeon6 + 处理器;CXL3.2 扩展接口;支持外接内存扩展机箱;iDRAC 硬件层面内存池监控管理。

✨产品亮点:Dell 商用 CXL 整机;硬件监控 CXL 链路健康状态;支持内存资源跨机动态调度分配。

📌业务价值 & 场景:x86 生态私有化大模型集群,CXL 内存池化项目商用计算节点。

8、NVIDIA Spectrum‑X STX 存算协同高速以太网交换机

核心参数:高速以太网交换机;STX 架构配套;RDMA 硬件卸载;针对 KV‑Cache 远程访问做时延调优;支持整机柜集群组网。

✨产品亮点:针对 Agent 上下文跨节点共享做网络优化;降低 DPU‑存储‑GPU 之间远程访问时延;保障大规模集群 KV 缓存池访问性能。

📌业务价值 & 场景:部署 BlueField‑4 STX 架构的 AI 智算中心,存算协同高速网络交换基础设施。

9、HPE Apollo 6500‑STX KV 缓存卸载液冷 AI 服务器

核心参数:2U 高密机架;DLC 直接冷板液冷;兼容 BlueField‑4 DPU;预留 CXL 内存扩展槽;40℃进水工况适配。

✨产品亮点:整机原生面向 KV‑Cache 卸载场景;DPU、CXL、GPU 协同调优;液冷保障高密负载长期稳定运行。

📌业务价值 & 场景:云厂商、政企存算分离大模型推理集群,KV 缓存卸载液冷计算节点。

10、Dell PowerEdge XE9680‑STX 存算协同液冷服务器

核心参数:2U 机架;Xeon6 + 平台;DLC 直接冷板液冷;支持 CXL 内存扩展;DPU 卡插槽;iDRAC 全链路硬件管理。

✨产品亮点:硬件原生支持 CXL 池化 + DPU 存储卸载;面向大模型推理存算分离架构做整机调优。

📌业务价值 & 场景:企业私有化 Agent 推理集群,存算协同架构液冷计算节点。

11、Supermicro SYS‑421GE‑CXL CXL 池化通用 AI 整机

核心参数:4U 机架;支持 Xeon6+/EPYC Venice 双平台;CXL3.2 扩展接口;多 DPU 卡位;风冷 / 冷板液冷可选形态。

✨产品亮点:ODM 通用 CXL 内存池化参考整机;兼容两大 x86 平台,面向生态客户做验证开发。

📌业务价值 & 场景:ODM 厂商 CXL 服务器开发对标,中小企业私有化大模型推理集群硬件。

12、Intel CXL‑MEM‑EXP 模块化 CXL 内存扩展机箱

核心参数:4U 外置扩展机箱;CXL3.2 高速链路;多内存模组槽位;内存热插拔;机箱硬件状态监控。

✨产品亮点:独立外置内存扩展柜;多台业务服务器共享这一套内存资源池;不需要改动业务服务器主板。

📌业务价值 & 场景:现有存量 AI 服务器改造 CXL 内存池,无需替换计算整机即可扩容内存资源。

13、HPE StoreOnce‑Cold 大模型训练数据集归档冷存储整机

核心参数:4U 高密度归档存储;WORM 不可变存储分区;面向训练数据集、旧版本模型快照归档;高容量低功耗设计。

✨产品亮点:完成五级分层架构最底层归档层;热温冷数据自动策略迁移,降低海量历史数据集存储成本。

📌业务价值 & 场景:AI 研发机构大模型训练数据集、模型快照长期低成本归档存储集群。

14、Dell ObjectScale‑Cold AI 归档对象存储平台

核心参数:横向扩展对象存储;AI 数据集生命周期管理;自动分层归档;支持向量库冷备份;多副本数据保护。

✨产品亮点:面向 AI 全生命周期数据;配合上层 KV‑Cache 存储整机,形成完整热‑温‑冷五级存储体系。

📌业务价值 & 场景:云厂商、科研机构大模型全生命周期数据归档、向量知识库备份存储。

15、Vertiv CDU‑STX 存算协同集群配套液冷 CDU

核心参数:适配存算协同整机集群;720kW 制冷;双泵 N+1 冗余;多点液位‑压力‑泄漏监测;兼容 40‑45℃温水进水。

✨产品亮点:专门适配高密度 CXL+DPU 多卡整机;兼顾计算节点与存储节点混合机柜散热需求。

📌业务价值 & 场景:部署 KV‑Cache 卸载架构的 AI 智算中心,计算‑存储混合机柜配套液冷分配单元。

16、Trane Modular‑STX 存算集群模块化预制歧管套件

核心参数:模块化分段预制歧管;兼容 UQD‑R2.1 接头;适配 45℃温水工况;分区漏液定位告警。

✨产品亮点:面向计算 + 存储混合机柜机房预制管网交付;适配存算协同项目分期扩容。

📌业务价值 & 场景:新建存算分离智算中心预制液冷管网基础设施。

17、AMD Pensando‑STX 存储卸载 DPU 加速卡

核心参数:DPU 板卡;硬件 RDMA、存储协议卸载;面向 ROCm 平台 KV‑Cache 搬运加速;硬件流量隔离。

✨产品亮点:AMD 生态 DPU,接管存储 IO 处理,释放 EPYC 主机 CPU 算力;适配 ROCm 大模型软件栈。

📌业务价值 & 场景:AMD 平台私有化大模型推理集群,存储 IO 硬件卸载加速板卡。

18、NIDEC STX‑PWR CXL 整机高可靠冗余电源模组

核心参数:支持 CXL 扩展机箱多机供电;N+2 电源冗余;宽电压输入;硬件故障快速隔离;适配高密度 CXL 整机。

✨产品亮点:针对 CXL 内存扩展机箱、多 DPU 整机做供电优化,保障内存池业务 7×24 小时连续运行。

📌业务价值 & 场景:CXL 内存池化整机与外置扩展机箱配套高可靠供电组件。

二、技术趋势

01、Agent 与大模型推理业务驱动,五级分层存算协同架构成为产业重点演进方向;HBM(热)‑本地 DRAM‑CXL 池化内存(温)‑高速 SSD‑冷归档存储,按照数据热度自动调度 KV‑Cache、向量库、训练数据集。

02、KV‑Cache 硬件卸载从概念走向商用验证;依靠 DPU + 高速存储,把非最热上下文缓存下沉到 CXL 内存与 SSD,释放宝贵 GPU HBM,直接提升集群并发 Agent 会话数量,压低单位 Token 成本。

03、CXL3.2 内存池化进入商用样机阶段;支持多台服务器共享外置内存扩展机箱,打破单服务器内存插槽上限;存量 AI 服务器也可以通过外接扩展柜完成内存资源扩容,不必更换计算整机。

04、DPU 成为存算协同架构的关键硬件;存储协议、RDMA 搬运、KV 缓存迁移逻辑卸载到 DPU 硬件,解放主 CPU 算力,避免存储 IO 抢占推理业务算力资源。

05、供应链存在客观约束;CXL 内存控制器、高速 DPU、企业级耐久 SSD 供给紧张;冷板式液冷相对风冷 5 年 TCO 降低 15%‑25%,浸没式液冷相对风冷 5 年 TCO 降低 20%‑35%。Vertiv、Trane 针对计算‑存储混合机柜推出散热预制方案。

三、产业政策

01、《信息通信行业发展 “十五五” 规划》

工信部 2026‑09‑07 正式印发,构建 “枢纽‑区域‑边缘” 多层次算力设施体系;有序部署万卡 / 十万卡级智算集群,推进算电协同、算力网建设;明确 2030 年新建大型超大型算力设施 PUE 降至 1.2 以下,智能算力规模达到 9800EFLOPS。

02、《促进数字化绿色化协同转型发展实施方案(2026‑2030 年)》

七部门联合印发,鼓励液冷散热、预制化管网工程、800V 高压直流、算力‑新能源直连模式推广;引导算力向清洁能源富集区域集聚,支持 45℃温水冷却等绿色散热技术试点。

03、GB/T 48023‑2026《数据中心冷板式液冷系统技术规范》

2026‑07‑30 发布,2027‑02‑01 实施;增加温水冷却工况、多部件全域冷板系统的测试、运维技术要求。

04、GB/T 48097‑2026《数据中心冷板式液冷机柜通用规范》

2026‑08‑28 发布,2027‑03‑01 实施;对 45℃进水温水冷却机柜、配套接头密封件提出可靠性规范。

05、《生成式人工智能服务安全基本要求》

国家网信办发布,提出大模型数据集、模型快照、推理会话日志存储留存、访问审计相关要求,推动 AI 分层存储体系落地。

四、行业动态

01、FMS 全球内存存储峰会召开;NVIDIA 发布 BlueField‑4 STX AI 原生上下文存储 DPU 架构,面向大规模 Agent 集群实现 KV‑Cache 硬件卸载,多家云厂商开启送样验证。

02、Intel 对外公开 Xeon6 平台 CXL3.2 整机内存池化完整参考设计,同时发布独立外置 CXL 内存扩展机箱参考硬件,支持存量服务器改造内存池。

03、AMD 更新 EPYC Venice 平台 CXL3.2 内存扩展固件,优化远程内存访问时延,完成与 ROCm 大模型软件栈适配调优。

04、HPE、Dell 推出适配 STX 架构的 AI 分层存储整机;公有云与政企客户开启小规模试点,验证 KV‑Cache 下沉卸载对集群并发、TCO 带来的改善效果。

05、第五届全球数字贸易博览会9 月 27 日杭州闭幕;存算分离、CXL 内存池、KV‑Cache 卸载成为 AI 基础设施分论坛重要议题。

06、国内标准化机构启动《CXL 内存池化服务器技术要求》预研,跟踪海外产业进展,开展国内标准编制前期研究。

07、WEC2026 世界算力博览会10.17‑19 深圳举办;设置 AI 存算协同、CXL 内存池、KV 缓存卸载专题分论坛。

08、CPE2026 国际算电协同产业链展览会10.26‑28 上海;聚焦 AI 存算分离、分层存储、算电协同绿色算力。

09、产业观察:行业认知迭代,AI 集群瓶颈不只有 GPU 算力;HBM 内存容量约束、KV‑Cache 爆炸增长,已经成为限制 Agent 集群并发规模的核心短板,存算协同架构的价值持续凸显。

10、存量智算机房改造出现新思路;通过外接 CXL 内存扩展机箱,不替换现有 AI 服务器整机,就可以完成集群内存资源扩容,保护已有硬件投资。

11、AI 数据生命周期管理受到重视;热推理上下文、温向量知识库、冷训练数据集,五级分层存储降低全生命周期存储成本。

12、供应链现状;CXL 内存扩展控制器、高速 DPU、企业级耐久 SSD 产能紧张,存算协同整机、存储平台交付周期存在不确定性。

五、短期预判

01、短期(1‑2 个月):CXL 内存池化整机、KV‑Cache 卸载 AI 存储整机、存储卸载 DPU、AI 归档冷存储整机逐步放量;CXL 控制器、高速 DPU 供给紧张,会对项目验证交付带来扰动(摩根士丹利 2026‑10‑06 AI 存算分离基础设施报告)。

02、中长期技术演进方向:五级分层存算协同架构在 Agent 大模型集群大规模落地;KV‑Cache 硬件卸载成为大规模推理集群标配;CXL3.2 内存池化从样机走向规模商用;存量服务器依靠外置内存机箱完成内存扩容成为改造主流方案;DPU 存储卸载普遍部署;热‑温‑冷全生命周期 AI 数据分层管理体系成熟。

03、高景气细分赛道:CXL 内存池化整机、外置 CXL 内存扩展机箱、KV‑Cache 卸载 AI 存储整机、存储卸载 DPU 板卡、AI 数据集归档冷存储整机;面向 AI 存算协同的散热、供电配套零部件迎来增量机会(IDC《2026 全球 AI 存储基础设施跟踪报告》)。

聚焦工控自动化、智能制造行业每日动态,持续更新厂商新品、技术趋势、产业政策与市场格局,深耕国产工控替代、工业 AI、边缘计算、信安信创国产化等核心赛道,关注我们实时掌握行业一手资讯

服务器 #工业服务器 #OCP 整机柜 #液冷服务器 #CDU 分配单元 #CXL 内存池化 #KV‑Cache 卸载 #AI 存算协同 #DPU 存储卸载 #分层存储 #Agent 智能体 #MoE 大模型 #算电协同 #绿色算力 #大模型推理 #向量数据库

本资讯内容均来源于公开可查的权威媒体、企业官方发布及行业平台,仅供行业交流,不构成采购、投资建议。若内容与厂商最新官方披露存在出入,请以企业官方资料为准;如涉及权益问题,请联系我方,将在 24 小时内响应处理。

相关学习资料