夜雨聆风学习资料网

ARTICLE · 1089890

爆料:OpenAI DevDay 将发布「O」,一个 24 小时在线的 AI 助手

爆料:OpenAI DevDay 将发布「O」,一个 24 小时在线的 AI 助手

QUOTE 

AI 竞争的焦点,正从回答问题转向持续交付任务。

这里是秋月白,大家又见面了。

OpenAI DevDay 将于 9 月 29 日举行,距离活动还有一天。

最近几天,关于 GPT-6、Astra 6.1、超高速模式和 ProMax 的传闻接连出现。还有一个名字格外显眼:

这次活动最值得追问的,是 ChatGPT 能否从“等你提问”走向“你离开后仍替你做事”。

若这条路线落地,DevDay 展示的将是 ChatGPT 工作方式的一次变化。

标题里的擂台感需要先说清:“OpenAI 扬言干翻 Opus 5.5”目前只是吸睛说法,公开资料里暂无 OpenAI 官方挑战。Anthropic 已在 9 月 22 日发布 Claude Opus 5.5;OpenAI DevDay 将于 9 月 29 日在旧金山举行,主旨演讲安排在太平洋时间上午 10 点。

本文看点

01

「o」的泄露线索

02

长期 Agent 的难点

03

速度与算力成本

01

LEAKS

一张泄露截图,让「o」进入视野

据底本整理,部分用户称 ChatGPT 升级页面短暂出现过一句话:

“o, your always-on assistant”

也就是“o,你的全天候助手”。底本还列出内部配置字段:display_name: "o" 与 email_suffix: "-o"。

这些痕迹让「o」看起来像正在测试的产品名或身份名。邮件后缀只能说明内部命名线索,无法证明它已经能自主收发邮件。“全天候”指后台运行、长期任务,还是常驻助手,目前也缺少官方解释。

关键仍在于:o 的定位是什么?它会以什么方式持续工作?

02

LONG-RUNNING TASKS

常驻 Agent 的关键:持续完成任务

现在的 ChatGPT 多数围绕单轮交互运转:用户提问,模型回答,交互随之结束。

常驻 Agent 则要接手一段持续进行的工作。你交代它持续关注一家公司、修复代码问题,或整理客户线索并继续跟进;你离开页面后,任务仍在后台推进。

AI 的任务周期也会随之延长:从回答一次提问,扩展到持续数小时甚至更久的工作。

用户交付的内容也会从单条 Prompt 扩展为完整 Task。能否保存进度、调用工具并在合适节点交付结果,将比单次回答更关键。

03

AGENT RELIABILITY

“Coding Agents That Don’t Quit”点出长期任务的难点

底本提到一条疑似 DevDay 分会标题:

Coding Agents That Don’t Quit。

“Don’t Quit”点出了关键。复杂任务会遇到工具报错、环境异常、上下文断裂和超时。Agent 能启动任务,不代表它能稳定推进到交付。

长期 Agent 得能在中断后续跑、失败后重试、保留进度,并稳定调用工具。

这条议程目前仍属传闻。它无法单独证明「o」会在 DevDay 亮相,也无法证实任务能连续运行数天或数周。

04

INTERNAL SYSTEMS

Aeon 或许在后台,「o」或许在前台

围绕「o」还出现另一个名字:Aeon。

一种说法称它是 Astra 的长任务变体;另一种说法则称它是 ChatGPT Workspace 自定义 Agent 的内部名称。两种解释尚未统一,因此目前无法确认 o 与 Aeon 的关系。

目前较稳妥的判断是:「o」可能面向用户,Aeon 可能关联内部系统、模型变体或长期 Agent 基础设施。

若线索属实,OpenAI 可能正为长期任务搭建专门能力,支撑方式会超出普通聊天流程。

05

INFERENCE SPEED

750 tokens/s,为什么可能比 Benchmark 更关键

另一条高频传闻围绕 Ultrafast 展开,具体说法包括 Cerebras 和约 750 tokens/s 的推理速度。

这组数字尚未获官方确认,开放范围也不清楚。它牵出一个实际问题:Agent 执行复杂任务时,常要多轮推理、搜索、读结果、调用工具、运行代码,再检查错误。

每轮多等几秒,几十轮累积下来就会拉长总耗时。高速推理的价值,可能体现在缩短整条执行链的等待时间。

实际体验还取决于工具响应、任务规划和错误恢复;tokens/s 只是其中一项。

06

PRICING

ProMax 月费 500 美元,可能对应“工作时长”

底本还收录了 ChatGPT ProMax 的传闻,月费约 500 美元,具体数字与权益尚待确认。

若这个价位属实,套餐或许会覆盖长期 Agent、超高速推理、更高 Codex 配额与更多后台计算资源。

此类套餐也可能按算力和任务时长定价,以上仍属推测。

「o」、Ultrafast 与 ProMax 经常同时出现在传闻里,或许来自同一套高算力产品设想。价格和权益仍须等官方信息确认。

07

PRODUCT ENTRY

Chat、Work、Codex 可能逐步汇到同一个入口

另一个传闻方向,是 Chat、Work 与 Coding 能力逐渐衔接。

如果 OpenAI 弱化模式切换,用户只需说明目标,系统再决定是否搜索、写代码、使用浏览器、启动云环境或创建后台任务。

模型、工具与 Agent 在后台配合,用户关注任务结果。

这是一种产品方向推测,目前还不能列作 DevDay 确认功能。

08

MODEL ROUTING

GPT-6 之外,更该关注 Agent 系统

传闻清单里有 GPT-6、Sol、Luna、Terra 和 Astra 6.1。这些名称可能对应模型版本、内部代号、路由或测试分支,彼此关系尚不清楚。

逐个名字猜发布清单,容易误将内部标签视作新品。更该观察这些模型是否会进入同一套 Agent 系统,再由系统按任务调用。

如果用户只面对「o」这样的统一入口,底层模型名的重要性会降低。用户最终关心的还是任务能否完成、结果是否可靠。

09

DELIVERY

行业矛盾正在从“能力”转向“可靠交付”

模型竞争过去常看谁更聪明、谁的 Benchmark 更高。Agent 普及后,稳定交付也成了考验:会做某件事,和稳定做完之间还有距离。

推理能力强,不保证长时间运行顺利;代码写得好,也不代表工具出错后能自行恢复。

若 OpenAI 推出「o」,外界要看的关键问题是:AI 能否从回答问题的软件,成长为可交付工作的系统?

这场竞争的指标包括模型分数、持续执行能力、过程恢复和成本。

10

WHAT TO WATCH

DevDay 最值得盯的,是五个具体问题

判断这次发布的分量,可以看五项能力:

1

「o」能否在后台持续运行?

2

用户离开页面后,任务是否继续?

3

出错后能否恢复、重试并保留进度?

4

它能否串联搜索、代码、文件和通信工具?

5

ProMax 是否真的按长期 Agent 算力设计?

若最终只有轻量功能升级,「o」带来的变化有限;若这些能力落地,ChatGPT 会成为用户交付任务的入口。

DevDay 能否给出答案,值得等到 9 月 29 日看清。

END

相关学习资料