夜雨聆风学习资料网

ARTICLE · 1062098

AI 日报 · 09/23/2026|Opus 5.5与GPT-6 Sol/Luna同日开打价格战、阿里云栖亮RSI 33轮与真武V900、Meta Muse登顶引爆Agent

AI 日报 · 09/23/2026|Opus 5.5与GPT-6 Sol/Luna同日开打价格战、阿里云栖亮RSI 33轮与真武V900、Meta Muse登顶引爆Agent

导语:两大前沿实验室同日开打低价模型价格战,阿里云栖亮出 RSI 33 轮无人干预迭代与自研芯片,Meta Muse 登顶引爆 Agent 商业化叙事。

21周中国模型Token调用超美67.46万亿上周中国Token用量(+10.28%)33轮阿里Qwen RSI无人干预迭代$3.5BSnorkel E轮估值

🤖 一、全球 AI Agent:从"对话"到"行动"的工程化拐点

智能体架构正从"路由+执行者"升级为更复杂的协作范式。微软 AutoGen、Google Gemini Agents、LangChain 编排与 Anthropic 的 "Building Effective Agents" 指南共同指向同一趋势:单个 Agent 强,多 Agent 系统才是范式转移,企业级落地开始强调 "Harness Engineering"(从让单模型编故事,转向让多 Agent 稳定协同演好一台戏)。

协议栈分层成熟:MCP(智能体→工具,主从同步)与 A2A(智能体↔智能体,对等协商)互补定位清晰,行业预测到 2026 年底超 40% 企业应用内置任务特定 Agent。

架构模式收敛:Orchestrator-Worker 成为生产主流,Plan-and-Execute、Reflexion(反思可提升 HumanEval 成功率约 30%)被广泛采用。

"K8s for Agents" 思路扩散:Google 开源 AX orchestrator、Linux Foundation 推进 MCP+A2A 融合,智能体调度向云原生大规模演进。

判断:Agent 竞争焦点已从"谁的模型更强"切换到"谁的宿主生态能把任务真正跑完"。Meta Muse 的爆发正是这一拐点的市场信号——软件(编排引擎、入口、工具链、安全网关)成为增量主线。

🌟 二、前沿模型:Anthropic 与 OpenAI 同日出牌,价格战愈演愈烈

9 月 22 日,两家美国前沿实验室同日发布旗舰模型的低价版本,价格战从旗舰能力转向性能与成本的综合比拼(FT、财联社、OpenAI 官方博客)。

Anthropic——Claude Opus 5.5:CEO 阿莫迪呼吁"放慢前沿"后首款新模型;官方称多数任务达旗舰 Fable 5.1 水平,典型负载成本较 Opus 5 降 40%,输出快 30%+;API 定价 $4/M 输入、$20/M 输出;发布前经 Frontier Design、METR 等外部安全测试,边界突破尝试较 Opus 5 减少 85%;Sonnet 5.5 与 Haiku 5.5 未来几周推出。

OpenAI——GPT-6 Sol 与 GPT-6 Luna:基于 Astra 技术进展、针对缓存与推理效率优化;价格较 GPT-5.6 促销价下调 50%——Sol $2/M 输入、$10/M 输出,Luna 仅 $0.10/$0.50 per M;提供 90% prompt cache 折扣;已上 ChatGPT Work、Codex 与 API,Luna 对免费/Go 桌面端开放,尚不进普通聊天界面。

风险:OpenAI 内部模型已开始承担实验性训练与 GPU 内核优化等研发工作(多智能体自主协作迭代代码),奥特曼被曝发出内部暂停令——自动化 AI 研发的能力边界与治理,成为下一个监管焦点(尚待官方完整披露)

🇨🇳 三、国内开源:云栖大会亮 RSI 与自研芯片,国产模型 Token 霸榜

9 月 22 日杭州云栖大会以"智以致用"为主题,把"智能体"放到绝对 C 位。吴泳铭判断"未来机器思考总量将达人类 1000 倍",并提出 AI 模型、AI 芯片、AI 云为机器智能时代三大基石。

阿里 Qwen RSI 跑通 33 轮:Qwen3.8-Max 在超 1 个月连续运行中实现人类"零参与"的 33 轮有效迭代,AA 评分由 40 升至 45(厂商自述评分,校准尚待独立验证);Qwen4 已投入训练,参数扩至 5–10 万亿、引入 RSI;开源 27B 可本地流畅运行。

自研芯片真武 V900:算力为 M890 的 3 倍,单机集群可扩至 50 万卡,计划 2027Q1 量产;倚天 720/730 服务器 CPU 2027 年推出,经 ICN 总线与 AI 芯片直连。

国产模型 Token 霸榜 21 周:OpenRouter 数据(9/14–9/20 当周)全球 129 万亿 Token,中国占 67.46 万亿(+10.28%) 对美国 14.21 万亿(-34.7%);DeepSeek V4.1-Flash 单周 15.8 万亿(+219%) 居首,智谱 GLM5.3Flash(14.1 万亿)、腾讯混元 Hy4preview(12.5 万亿)紧随,全球最忙 5 模型中 4 款国产。

阶跃星辰开源 Step Code v0.1.0(MIT):把"读改测交付"塞进单一 CLI,Terminal-Bench 2.1 80.9%、自研长程基准 Multi-Frame 73.3%;其 Step5Preview(600B/27B 激活、1M 上下文)计划 10/15 开源,厂商称任务成本仅为 Claude Opus5 的 1/8、AA 开源榜前三。

判断:国产"开放权重"模型正凭借极致性价比夺取美国实验室份额(Vercel 数据),但 DeepSeek V4.1-Flash 因每任务平均输出 token 偏高(约 8.9 万),"单价低≠任务成本低"仍需开发商实测权衡。

📌 四、会议与政策:框架 3.0 单列智能体风险,最高法 AI 裁判规则落地发酵

《人工智能安全治理框架 3.0》(9/14 网安周济南发布,全国网安标委):延续"风险分类—技术应对—综合治理"逻辑,明确单列智能体风险具身智能风险,并附《智能体风险管理框架》;治理对象沿"内容安全→智能体行为安全→具身智能安全"路径扩展。

最高法《关于依法审理涉人工智能纠纷案件的意见》(9/7 发布):我国首部 AI 纠纷司法裁判规则文件。亮点:谁掌控技术谁举证(破解普通人拿不到技术证据的痛点)、"通知—删除"规则、AI 换脸/仿声人格权保护;第 12 条厘清生成内容著作权三方责任,第 14 条明确 AI 可参与研发但发明人只能是真实自然人

外滩大会 2026(9/10–9/12 上海):AI 拓境论坛聚焦"AI+能源"算电协同;具身智能 40+ 厂商集中亮相强调"真干活";央视财经"外滩大会之夜"发布"AI+"五大趋势与先锋案例。

政策端同步发力:工信部《"人工智能+软件"专项行动实施方案》(到 2028 年覆盖 2 万家规模以上软件企业、打造 100 个智能体标杆);《人工智能中小企业创业支持计划(2026—2028)》;七部门《促进数字化绿色化协同转型发展实施方案(2026—2030)》;全国一体化算力监测落地(智算 2185 EFLOPS FP16、+177%,接入 300+ 大模型)。

风险:框架 3.0 为非强制基准,落地依赖监管援引与平台整改;最高法意见对模型训练使用作品是否纳入"合理使用"作审慎留白,相关规则尚待个案积累。

💰 五、融资与产业速览

Snorkel AI:9/22 完成 $350M Series E,估值 $3.5B(Insight Partners、S32 领投),较 17 个月前 $1.3B 近三倍;ARR 约 $375M(18 倍增长),扩张 agentic data factory 服务前沿实验室。

Mirendil(前 Anthropic 研究员、自改进 AI):据报洽谈 $1B / $5B(Kleiner Perkins 领投,尚待交割确认)。

Brahma AI(数字人/AI 影音 OS):$150M / $2B(Multiples 领投)。

国内:超衍智能(Apex,RSI 自进化)完成 4 亿元天使+轮;宇算星河(AI+鸿蒙/天基大模型)亿元级天使+Pre-A、估值超 10 亿;捷越星宸(Jieyue Xingchen)B+ 轮超 50 亿元(传近 12 个月国内大模型最高单笔,尚待官方确认)。

产业映射:9/22 A 股 AI 应用/智能体板块大涨(延华智能、泛微网络涨停);开源证券测算中国 AI 软件市场 2030 年达 1622 亿元(2026–2030 CAGR 31.7%);Meta 因 Muse 登顶与 180 亿美元青年安全和解,9/21 单日涨 11.4%、市值破 $1.9T

一句话:资金正从"追模型参数"转向"追能落地的 Agent 基础设施与数据工厂"——Snorkel、超衍、捷越的融资主线高度一致:谁掌握智能体时代的生产要素(数据、算力、自进化),谁拿到溢价。

相关学习资料