ARTICLE · 1089890
爆料:OpenAI DevDay 将发布「O」,一个 24 小时在线的 AI 助手
QUOTE
AI 竞争的焦点,正从回答问题转向持续交付任务。
这里是秋月白,大家又见面了。
OpenAI DevDay 将于 9 月 29 日举行,距离活动还有一天。
最近几天,关于 GPT-6、Astra 6.1、超高速模式和 ProMax 的传闻接连出现。还有一个名字格外显眼:
这次活动最值得追问的,是 ChatGPT 能否从“等你提问”走向“你离开后仍替你做事”。
若这条路线落地,DevDay 展示的将是 ChatGPT 工作方式的一次变化。
标题里的擂台感需要先说清:“OpenAI 扬言干翻 Opus 5.5”目前只是吸睛说法,公开资料里暂无 OpenAI 官方挑战。Anthropic 已在 9 月 22 日发布 Claude Opus 5.5;OpenAI DevDay 将于 9 月 29 日在旧金山举行,主旨演讲安排在太平洋时间上午 10 点。
本文看点
01
「o」的泄露线索
02
长期 Agent 的难点
03
速度与算力成本
01
LEAKS
一张泄露截图,让「o」进入视野
据底本整理,部分用户称 ChatGPT 升级页面短暂出现过一句话:
“o, your always-on assistant”
也就是“o,你的全天候助手”。底本还列出内部配置字段:display_name: "o" 与 email_suffix: "-o"。
这些痕迹让「o」看起来像正在测试的产品名或身份名。邮件后缀只能说明内部命名线索,无法证明它已经能自主收发邮件。“全天候”指后台运行、长期任务,还是常驻助手,目前也缺少官方解释。
关键仍在于:o 的定位是什么?它会以什么方式持续工作?


02
LONG-RUNNING TASKS
常驻 Agent 的关键:持续完成任务
现在的 ChatGPT 多数围绕单轮交互运转:用户提问,模型回答,交互随之结束。
常驻 Agent 则要接手一段持续进行的工作。你交代它持续关注一家公司、修复代码问题,或整理客户线索并继续跟进;你离开页面后,任务仍在后台推进。
AI 的任务周期也会随之延长:从回答一次提问,扩展到持续数小时甚至更久的工作。
用户交付的内容也会从单条 Prompt 扩展为完整 Task。能否保存进度、调用工具并在合适节点交付结果,将比单次回答更关键。
03
AGENT RELIABILITY
“Coding Agents That Don’t Quit”点出长期任务的难点
底本提到一条疑似 DevDay 分会标题:
Coding Agents That Don’t Quit。
“Don’t Quit”点出了关键。复杂任务会遇到工具报错、环境异常、上下文断裂和超时。Agent 能启动任务,不代表它能稳定推进到交付。
长期 Agent 得能在中断后续跑、失败后重试、保留进度,并稳定调用工具。
这条议程目前仍属传闻。它无法单独证明「o」会在 DevDay 亮相,也无法证实任务能连续运行数天或数周。
04
INTERNAL SYSTEMS
Aeon 或许在后台,「o」或许在前台
围绕「o」还出现另一个名字:Aeon。
一种说法称它是 Astra 的长任务变体;另一种说法则称它是 ChatGPT Workspace 自定义 Agent 的内部名称。两种解释尚未统一,因此目前无法确认 o 与 Aeon 的关系。
目前较稳妥的判断是:「o」可能面向用户,Aeon 可能关联内部系统、模型变体或长期 Agent 基础设施。
若线索属实,OpenAI 可能正为长期任务搭建专门能力,支撑方式会超出普通聊天流程。
05
INFERENCE SPEED
750 tokens/s,为什么可能比 Benchmark 更关键
另一条高频传闻围绕 Ultrafast 展开,具体说法包括 Cerebras 和约 750 tokens/s 的推理速度。
这组数字尚未获官方确认,开放范围也不清楚。它牵出一个实际问题:Agent 执行复杂任务时,常要多轮推理、搜索、读结果、调用工具、运行代码,再检查错误。
每轮多等几秒,几十轮累积下来就会拉长总耗时。高速推理的价值,可能体现在缩短整条执行链的等待时间。
实际体验还取决于工具响应、任务规划和错误恢复;tokens/s 只是其中一项。
06
PRICING
ProMax 月费 500 美元,可能对应“工作时长”
底本还收录了 ChatGPT ProMax 的传闻,月费约 500 美元,具体数字与权益尚待确认。
若这个价位属实,套餐或许会覆盖长期 Agent、超高速推理、更高 Codex 配额与更多后台计算资源。
此类套餐也可能按算力和任务时长定价,以上仍属推测。
「o」、Ultrafast 与 ProMax 经常同时出现在传闻里,或许来自同一套高算力产品设想。价格和权益仍须等官方信息确认。
07
PRODUCT ENTRY
Chat、Work、Codex 可能逐步汇到同一个入口
另一个传闻方向,是 Chat、Work 与 Coding 能力逐渐衔接。
如果 OpenAI 弱化模式切换,用户只需说明目标,系统再决定是否搜索、写代码、使用浏览器、启动云环境或创建后台任务。
模型、工具与 Agent 在后台配合,用户关注任务结果。
这是一种产品方向推测,目前还不能列作 DevDay 确认功能。
08
MODEL ROUTING
GPT-6 之外,更该关注 Agent 系统
传闻清单里有 GPT-6、Sol、Luna、Terra 和 Astra 6.1。这些名称可能对应模型版本、内部代号、路由或测试分支,彼此关系尚不清楚。
逐个名字猜发布清单,容易误将内部标签视作新品。更该观察这些模型是否会进入同一套 Agent 系统,再由系统按任务调用。
如果用户只面对「o」这样的统一入口,底层模型名的重要性会降低。用户最终关心的还是任务能否完成、结果是否可靠。
09
DELIVERY
行业矛盾正在从“能力”转向“可靠交付”
模型竞争过去常看谁更聪明、谁的 Benchmark 更高。Agent 普及后,稳定交付也成了考验:会做某件事,和稳定做完之间还有距离。
推理能力强,不保证长时间运行顺利;代码写得好,也不代表工具出错后能自行恢复。
若 OpenAI 推出「o」,外界要看的关键问题是:AI 能否从回答问题的软件,成长为可交付工作的系统?
这场竞争的指标包括模型分数、持续执行能力、过程恢复和成本。
10
WHAT TO WATCH
DevDay 最值得盯的,是五个具体问题
判断这次发布的分量,可以看五项能力:
「o」能否在后台持续运行?
用户离开页面后,任务是否继续?
出错后能否恢复、重试并保留进度?
它能否串联搜索、代码、文件和通信工具?
ProMax 是否真的按长期 Agent 算力设计?
若最终只有轻量功能升级,「o」带来的变化有限;若这些能力落地,ChatGPT 会成为用户交付任务的入口。
DevDay 能否给出答案,值得等到 9 月 29 日看清。