

2026 年 7 月 25 日,由华为与临平CIO协会、浙江图灵软件联合主办的“AI 启新程·存耀未来」AI 存储交流会”成功举办。活动聚焦大模型推理瓶颈、企业 AI 底座搭建、存算融合落地实践等核心方向,汇聚浙江众多行业龙头数字化负责人,共探 AI 时代数据基础设施建设路径,以创新技术赋能实体经济智能化升级。
本次交流会汇聚浙江各赛道标杆企业数字化核心负责人,覆盖新材料、新能源装备、汽车零部件、生物医药、化工、光电、零售、基建综合投资等重点产业。
交流分享环节正式开启后,临平CIO协会主理人王孝全首先带来集团企业 AI 行业化落地、算力与数据挑战思考相关分享。嘉宾结合产业一线实践,剖析当前企业 AI 落地面临的现实难题:算力供给难以支撑大模型规模化投产,造成对 AI 价值存疑;伴随技术迭代,从早期 NLP 模型、大语言模型到多模态模型持续演进,算力需求持续暴涨,数据治理短板进一步制约落地成效。分享提出,AI 转型不能单纯依靠算力、算法叠加,应当从存储底座切入寻找破局路径,推行轻量化 AI 加速方案,避免大规模业务重构,聚焦局部数智化能力提升。同时嘉宾结合走访舍弗勒(Schaeffler)灯塔工厂的调研感悟展开分享,介绍企业从汽车领域迁移至机器人赛道的历程,以及其在工艺学习、生产规划、金融服务等全链条数字化落地经验,为在场企业提供可借鉴的实践样本,也为后续存算融合方案分享做了铺垫。
随后,华为浙江政企数据存储产品经理马骁 带来《让大模型推理告别卡顿:华为AI存储怎么做》主题分享,围绕突破推理瓶颈,加速 AI 行业化落地——让大模型推理告别卡顿展开深度解读。他表示,随着智能体快速发展,大模型支持序列长度四年暴涨 5000 倍,显存容量成为推理核心瓶颈,长序列场景普遍存在首 Token 时延高、重复计算、推理幻觉等难题,行业正加速走向外置共享存储的存算融合架构。
依托华为 OceanStor 专业 AI 存储,通过多级 KV Cache 资源池实现 “以存代算”,依靠全局上下文缓存、历史交互记忆复用两大核心能力提升长序列推理效率,搭配多模知识库减少模型幻觉。在 AI Coding 场景中,方案可承载长时间任务缓存,实测多轮连续编码推理时长缩短 42%,任务重启响应由 45 秒降至 5 秒;6 节点部署下推理并发提升一倍,整体投入节约 10%~50%。基于 A800/A600 算力测试,时延降低 90%左右,推理吞吐提升约 15 倍。马骁同时分享标杆实践,华为助力多家企业搭建智能办公助手与代码生成平台,有效提升研发与办公效率。
分享结束后进入圆桌自由交流环节。参会企业 CIO、信息化负责人结合自身业务现状抛出建设难题,围绕 AI +药研、AI Coding、算力存储规划、AI 项目降本增效等议题与技术专家深入交流。
多个行业的头部企业CIO,现场分享了他们在生物制药、药物研发、流程工业、重工、汽车零部件、大宗铜缆、医疗诊断领域的AI数智化工作,包括开展垂类模型训推、自研AI自动化工具的落地成果、实践经验与建设痛点。企业通过体系化 AI 建设赋能生产与管理全流程升级,助力争创未来工厂,全面推动 AI 深度落地研发、办公、财务、营销、客服等各类业务场景,加速企业数字化转型升级。
本次交流会是华为联合浙江本地服务商面向浙江实体企业打造的专项交流平台,精准匹配新材料、新能源、高端装备、精细化工、生物医药等本土优势产业数字化升级需求,直观展现 OceanStor AI 存储存算融合技术价值,用量化数据与落地案例解答企业规模化部署 AI 的顾虑。
下一步,华为将持续深化与浙江本地伙伴生态协同,依托昇腾算力与 OceanStor AI 存储全栈数据基础设施能力,面向浙江企业输出轻量化、高性价比大模型推理解决方案。同时携手行业龙头打造本地 AI 基础设施标杆项目,突破 AI 推理瓶颈,助力企业低成本落地行业智能体,推动数字经济与实体经济深度融合,夯实新质生产力发展底座。

夜雨聆风