7月20日,2026世界人工智能大会在上海落幕。如果你去年还记住的是"百模大战"的喧嚣,今年走进会场的感觉完全不同了——展台上不再比谁参数大、跑分高,所有人都在回答同一个问题:你的AI到底能干什么活?
这不是温和的转向,是断崖式的切换。
从"卷参数"到"卷业绩":一个评价体系的颠覆
据甲子光年在现场统计,本届WAIC上,130家大模型与生成式AI参展企业中,63.8%选择以AI Agent作为核心展示标签。一年前,这个数字还不到20%。
IDC在大会现场发布的数据更直观:全球日活智能体数将从2025年的2860万个跃升至2026年的7940万个,到2030年预计达到22.16亿个。
翻译一下就是:行业已经正式进入"智能体应用元年"。
这个转折的核心不在于技术突破,而在于评价体系的彻底颠覆。亿欧在会上发布的报告直接提出一个新指标——VPT(单位Token商业产出),取代参数规模和算力消耗成为核心衡量标准。
行业不再为"Token消耗量"这个过程指标买单,而是为"业务结果"这个结果指标付费。
容联云的副总在论坛上给了一组让人冷汗直冒的数据:全球88%的企业已部署运行中的Agent,但真正发挥业务价值的不足10%。有些不加管控的AI编程场景,Token成本甚至达到人力成本的10倍。
听起来像不像当年云计算早期的"为了上云而上云"?历史不会重复,但它会押韵。
四大玩家,四条路:谁在抢占"能干活"的制高点?
今年WAIC上,头部玩家的打法已经完全分化,各自凭借自己的"牌面"选了不同的战场。
阿里云选了"重构基础设施"路线。发布Agent Native Cloud(智能体原生的云),把Agent能力从外部工具变成企业原生能力。内部实践数据显示:AgentTeams虚拟团队承担了85%的开发者答疑,版本发布周期压缩到1天。CTO李飞飞明确说:客户只为业务落地成果付费,不为算力消耗付费。
腾讯云押注"超级入口"。WorkBuddy已成为国内DAU最高的办公效率智能体,企业微信Agent支持在任意工作界面唤起处理任务。嵌入高频工作流的能力,别人很难复制。
华为云和百度各自划定"根据地"。华为的AgentArts专注高合规行业,依托昇腾算力和国产化交付能力;百度的DuMate瞄准知识密集型企业的桌面入口。
有意思的是,真正跑出成绩的反而是垂直玩家。容联云的Voice Agent在某银行信贷催收场景中日均通话超2万通,任务完成率94%。西门子的Eigen工程智能体拿下本届SAIL之星奖,已在全球逾百家企业规模化部署。
三重鸿沟:能干活的背后,问题不少
别急着乐观。企业级Agent规模化落地,面前还有三堵墙:
第一,数据孤岛。 很多企业的数据散落在不同系统中,Agent接不上真实业务数据,就成了游离在业务之外的"摆设"。
第二,人机协同没范式。 有些企业上了Agent,员工反而多了额外工作——要检查Agent的输出、修正错误、手动补录数据。不仅没减负,反而增负。
第三,业务闭环缺失。 Agent无法对KPI负责。你能说清楚Agent到底帮你省了多少钱、赚了多少收入吗?大多数企业答不上来。
当行业开始算清这笔账,商业化的核心命题就从"能做吗"变成了"值得吗"。
两条路,两个未来
站在2026年中,这个行业正面临一个关键分水岭。两条路径,结果截然不同:
路径A:快速跨越鸿沟。 如果跨厂商Agent互通协议(如大会发布的ASL协议)能大规模落地,"按效果付费"模式从少数先行者扩散到更多行业,那么金融、零售、制造等"创收类"场景将率先规模化复制。头部玩家将在3-6个月的窗口期内建立场景与数据的双重壁垒,行业进入"赢家通吃"的加速整合期。
路径B:关卡未能突破。 如果Token成本与业务回报的倒挂问题短期无法解决,企业客户对Agent投入趋于谨慎,行业可能再次进入"技术等待期",回归到对底层模型效率和人机协同范式的耐心打磨。
无论走哪条路,一个趋势是确定的:2026年,AI评价体系的"锚点"已经从"技术峰值"永久性地转向了"商业价值"。
智能体不再只是"能聊"了,它开始"能干了"。接下来整个行业必须回答的那个终极问题只有三个字:能赚钱吗?
夜雨聆风