夜雨聆风学习资料网

ARTICLE · 1091128

AI工具资讯推荐|20260928期

AI工具资讯推荐|20260928期

聚焦周期: 2026年9月27日 — 9月28日视角: Agent从"聊"到"做"的范式跃迁 / 国产AI芯片双雄对决 / Flash模型的速度战争 


核心总结

前几期我们追踪的是"模型降价"和"Agent SaaS开卖",那么9月27-28日最值得深读的信号是——AI正在从"回合制对话"跃迁到"7×24小时自主执行"。 

OpenAI代号Aeon的「o」助手预告9月29日发布,这是OpenAI第一次明确把产品形态从"聊天窗口"推向"后台常驻进程";

而就在同一周,Meta的Muse智能体因零日漏洞被安全研究员公开"开膛",证明Agent获得持久化权限之后,安全风险不是降低了一个量级,而是指数级放大。

阿里真武V900与华为昇腾960的"2027年Q1量产对决"浮出水面,国产AI芯片的竞争正式从"PPT参数"进入"路线之争"。

大模型价格战的下半场,不再是"谁的Token更便宜",而是"谁的Agent跑得更久、更稳、更安全"。


一、OpenAI Aeon「o」:AI产品史上第一次"从聊到做"的范式断裂

1.1 为什么这不是又一次ChatGPT升级

9月27日,开发者从ChatGPT代码中挖出代号Aeon的全新助手「o」,预计9月29日DevDay正式发布。表面上看,这不过是OpenAI又加了一个产品线。但仔细拆解其架构后,「o」代表的是AI产品形态的一次根本性断裂——从"回合制"到"常驻制"。

维度
ChatGPT(现有形态)
「o」(Aeon)
差异本质
交互模式
用户发消息→AI回复→等待下一条消息
用户设定目标→AI自主执行数小时至数周
从"对话"到"委托"
运行状态
用户不发消息即休眠
Always-on
,持久化云端沙盒持续运行
从"工具"到"员工"
身份系统
依附于用户账号
拥有独立「-o」邮箱后缀,可自主收发邮件
从"功能"到"实体"
内部协作
单一模型响应
多Agent共享留言板(主控/搜索/代码/质检分工)
从"个人"到"团队"
性能模式
标准推理速度
Fast Mode
极速模式,专用高并发芯片集群
从"通用"到"专用"

最关键的信号不是功能本身,而是OpenAI刻意将「o」与Codex切割为两条独立产品线。 Codex Plus用户被明确排除在「o」之外——这意味着OpenAI内部已经将"写代码的AI"和"替你干活的AI"视为两个完全不同的物种。回顾AI产品演化史:

  • 2023年
    :ChatGPT = AI聊天
  • 2024年
    :Copilot/Cursor = AI辅助编码
  • 2025年
    :Codex/Claude Code = AI自主编码
  • 2026年9月
    :Aeon「o」= AI自主执行任意任务

这是AI产品从"垂直助手"走向"通用执行者"的第一步。

1.3 竞争格局:24小时Agent赛道瞬间拥挤

OpenAI的「o」并非横空出世。过去两周内:

  • Meta
     扎克伯格亲自站台Muse,称其为"理解你目标、24/7替你干活的个人Agent
  • xAI
     已发布Grok Bot(9月21日Grok 4.7配套)
  • 微软
     推出Copilot Autopilot模块(9月25日GA),具备持久化身份和独立工作区
  • 腾讯
     LightVela将Hermes Agent嵌入微信,打造7×24在线的个人AI

二、阿里真武V900 vs 华为昇腾960:国产AI芯片的"路线之争"正式摊牌

2.1 不只是芯片发布,而是中国算力主权的"两条腿"

9月27日阿里云栖大会上,CEO吴泳明将真武V900定义为**"中国迄今最强的AI芯片"。同一天,华为昇腾960的技术细节被广泛对比讨论。两款芯片均计划2027年Q1量产,面向十万亿级参数大模型——这意味着中国将在18个月内拥有两条完全独立的AI芯片供应链。

核心参数正面对比:

参数
阿里真武V900
华为昇腾960
算力基准
单卡为前代M890的3倍
单节点8 EFLOPS(FP8)
显存216GB
HBM
HBM高达1PB(节点级)
片间互联1200GB/s
(自研ICN协议)
NPO近封装光学
(5500个光引擎)
计算精度
原生FP32/BF16/FP8/FP4
FP8 2 PFLOPS,FP4 4 PFLOPS
集群规模
单集群50万卡
单节点4096卡互联
互联路线电互联
(ICN Switch芯片)
光互联
(替代48000个800G光模块)
量产时间
2027年Q1
2027年Q1
已部署规模
650+企业客户
超节点1000+套

2.2 电互联 vs 光互联:技术路线分歧的本质

两款芯片最深层的差异不在算力数字,而在互联架构的路线选择:

真武V900走的是"电互联+芯片级创新"路线。

昇腾960走的是"光互联+系统级重构"路线。

三、MiniMax M3.1 Flash:速度战争中"延迟"成为新的护城河

3.1 不只是"更快",而是重新定义了Flash模型的评价标准

9月27日MiniMax上线的M3.1-Flash-Preview,在功能层面支持五档推理强度和多子代理并行,但真正值得关注的是其延迟数据对行业的冲击:

指标
MiniMax M3
GPT-4o
Claude Opus 4.7
API平均延迟298ms
1712ms
2105ms
本地推理延迟246ms
1683ms
2041ms
1M上下文首字延迟180±22ms
(无丢帧)
3.1s(50万token时丢帧)
未披露
首字延迟(TTFT)120-180ms
200-400ms
150-300ms

M3的延迟只有GPT-4o的1/6、Claude Opus 4.7的1/7。 这不是"快了一点",而是量级差异。当Agent需要连续调用数十次API来完成一个复杂任务时,298ms vs 1712ms的差距意味着一个任务跑完需要1分钟 vs 6分钟——在Always-on Agent时代,这个差距会被进一步放大。

3.2 性能数据:编码与智能体能力进入第一梯队

MiniMax M3在关键基准测试中的表现已经不是"够用",而是行业领先

六:其他值得关注的动态

6.1 开源科研Agent OpenScience:垂直Agent的"长尾爆发"

Synthetic Sciences发布开源科研Agent OpenScience(Apache 2.0),在Terminal-Bench-Science基准上解决75.7% 的任务,超越Codex和Claude Code。这是AI Agent向科研垂直领域渗透的标志性事件——当通用Agent框架(如Aeon、Muse)还在解决"什么都能做"的问题时,垂直Agent已经在特定领域做到了"比人类研究员更快"。

6.2 券商密集接入智能体:金融AI从"看报告"到"跑流程"

券商行业密集接入Kimi、腾讯WorkBuddy等智能体生态,2026年被称为"金融智能体元年"。这不是简单的"券商用AI写研报",而是智能体开始介入交易执行、合规审查、客户服务等核心业务流程。金融行业的监管密度远高于一般场景,如果智能体能在券商跑通,其他行业的落地门槛将大幅降低。

6.3 智元第2万台机器人交付:具身智能进入"量产运营"阶段

智元交付第2万台具身智能机器人A3 Ultra,其中300台进驻长隆乐园。从"Demo展示"到"乐园驻场运营"——具身智能的商业化路径正在从"卖设备"转向"卖服务"。乐园场景天然适合机器人运营:环境可控、任务重复、人力成本高、游客愿意为新鲜体验付费。

6.4 中国AI公司IPO/融资热潮

公司
动态
估值/市值
月之暗面
已向港交所递交A1上市申请
投后估值350亿美元,ARR达10亿美元
DeepSeek
推进第二轮融资,目标500亿元人民币
估值目标5000亿元人民币
智谱AI
港股市值回落,年内两轮融资超700亿港元
约3000亿港元

大模型价格战正在倒逼融资节奏。 智谱上半年收入9.54亿元(同比+399.7%),但归母净亏损20.71亿元——收入高速增长但亏损扩大,这是"烧钱换规模"的典型特征。DeepSeek 5000亿元估值目标的背后,是ARR 10亿美元的营收支撑。

相关学习资料