ARTICLE · 1091128
AI工具资讯推荐|20260928期
聚焦周期: 2026年9月27日 — 9月28日视角: Agent从"聊"到"做"的范式跃迁 / 国产AI芯片双雄对决 / Flash模型的速度战争
核心总结
前几期我们追踪的是"模型降价"和"Agent SaaS开卖",那么9月27-28日最值得深读的信号是——AI正在从"回合制对话"跃迁到"7×24小时自主执行"。
OpenAI代号Aeon的「o」助手预告9月29日发布,这是OpenAI第一次明确把产品形态从"聊天窗口"推向"后台常驻进程";
而就在同一周,Meta的Muse智能体因零日漏洞被安全研究员公开"开膛",证明Agent获得持久化权限之后,安全风险不是降低了一个量级,而是指数级放大。
阿里真武V900与华为昇腾960的"2027年Q1量产对决"浮出水面,国产AI芯片的竞争正式从"PPT参数"进入"路线之争"。
大模型价格战的下半场,不再是"谁的Token更便宜",而是"谁的Agent跑得更久、更稳、更安全"。
一、OpenAI Aeon「o」:AI产品史上第一次"从聊到做"的范式断裂
1.1 为什么这不是又一次ChatGPT升级
9月27日,开发者从ChatGPT代码中挖出代号Aeon的全新助手「o」,预计9月29日DevDay正式发布。表面上看,这不过是OpenAI又加了一个产品线。但仔细拆解其架构后,「o」代表的是AI产品形态的一次根本性断裂——从"回合制"到"常驻制"。
| 交互模式 | |||
| 运行状态 | Always-on | ||
| 身份系统 | |||
| 内部协作 | |||
| 性能模式 | Fast Mode |
最关键的信号不是功能本身,而是OpenAI刻意将「o」与Codex切割为两条独立产品线。 Codex Plus用户被明确排除在「o」之外——这意味着OpenAI内部已经将"写代码的AI"和"替你干活的AI"视为两个完全不同的物种。回顾AI产品演化史:
- 2023年
:ChatGPT = AI聊天 - 2024年
:Copilot/Cursor = AI辅助编码 - 2025年
:Codex/Claude Code = AI自主编码 - 2026年9月
:Aeon「o」= AI自主执行任意任务
这是AI产品从"垂直助手"走向"通用执行者"的第一步。
1.3 竞争格局:24小时Agent赛道瞬间拥挤
OpenAI的「o」并非横空出世。过去两周内:
- Meta
扎克伯格亲自站台Muse,称其为"理解你目标、24/7替你干活的个人Agent - xAI
已发布Grok Bot(9月21日Grok 4.7配套) - 微软
推出Copilot Autopilot模块(9月25日GA),具备持久化身份和独立工作区 - 腾讯
LightVela将Hermes Agent嵌入微信,打造7×24在线的个人AI
二、阿里真武V900 vs 华为昇腾960:国产AI芯片的"路线之争"正式摊牌
2.1 不只是芯片发布,而是中国算力主权的"两条腿"
9月27日阿里云栖大会上,CEO吴泳明将真武V900定义为**"中国迄今最强的AI芯片"。同一天,华为昇腾960的技术细节被广泛对比讨论。两款芯片均计划2027年Q1量产,面向十万亿级参数大模型——这意味着中国将在18个月内拥有两条完全独立的AI芯片供应链。
核心参数正面对比:
| 算力基准 | ||
| 显存 | 216GB | |
| 片间互联 | 1200GB/s | NPO近封装光学 |
| 计算精度 | ||
| 集群规模 | ||
| 互联路线 | 电互联 | 光互联 |
| 量产时间 | ||
| 已部署规模 |
2.2 电互联 vs 光互联:技术路线分歧的本质
两款芯片最深层的差异不在算力数字,而在互联架构的路线选择:
真武V900走的是"电互联+芯片级创新"路线。
昇腾960走的是"光互联+系统级重构"路线。
三、MiniMax M3.1 Flash:速度战争中"延迟"成为新的护城河
3.1 不只是"更快",而是重新定义了Flash模型的评价标准
9月27日MiniMax上线的M3.1-Flash-Preview,在功能层面支持五档推理强度和多子代理并行,但真正值得关注的是其延迟数据对行业的冲击:
| API平均延迟 | 298ms | ||
| 本地推理延迟 | 246ms | ||
| 1M上下文首字延迟 | 180±22ms | ||
| 首字延迟(TTFT) | 120-180ms |
M3的延迟只有GPT-4o的1/6、Claude Opus 4.7的1/7。 这不是"快了一点",而是量级差异。当Agent需要连续调用数十次API来完成一个复杂任务时,298ms vs 1712ms的差距意味着一个任务跑完需要1分钟 vs 6分钟——在Always-on Agent时代,这个差距会被进一步放大。
3.2 性能数据:编码与智能体能力进入第一梯队
MiniMax M3在关键基准测试中的表现已经不是"够用",而是行业领先
六:其他值得关注的动态
6.1 开源科研Agent OpenScience:垂直Agent的"长尾爆发"
Synthetic Sciences发布开源科研Agent OpenScience(Apache 2.0),在Terminal-Bench-Science基准上解决75.7% 的任务,超越Codex和Claude Code。这是AI Agent向科研垂直领域渗透的标志性事件——当通用Agent框架(如Aeon、Muse)还在解决"什么都能做"的问题时,垂直Agent已经在特定领域做到了"比人类研究员更快"。
6.2 券商密集接入智能体:金融AI从"看报告"到"跑流程"
券商行业密集接入Kimi、腾讯WorkBuddy等智能体生态,2026年被称为"金融智能体元年"。这不是简单的"券商用AI写研报",而是智能体开始介入交易执行、合规审查、客户服务等核心业务流程。金融行业的监管密度远高于一般场景,如果智能体能在券商跑通,其他行业的落地门槛将大幅降低。
6.3 智元第2万台机器人交付:具身智能进入"量产运营"阶段
智元交付第2万台具身智能机器人A3 Ultra,其中300台进驻长隆乐园。从"Demo展示"到"乐园驻场运营"——具身智能的商业化路径正在从"卖设备"转向"卖服务"。乐园场景天然适合机器人运营:环境可控、任务重复、人力成本高、游客愿意为新鲜体验付费。
6.4 中国AI公司IPO/融资热潮
| 月之暗面 | ||
| DeepSeek | ||
| 智谱AI |
大模型价格战正在倒逼融资节奏。 智谱上半年收入9.54亿元(同比+399.7%),但归母净亏损20.71亿元——收入高速增长但亏损扩大,这是"烧钱换规模"的典型特征。DeepSeek 5000亿元估值目标的背后,是ARR 10亿美元的营收支撑。