你在 Cursor 里改完前端页面,刚让 Claude Code 跑测试。终端又跳出两个 PR 评论、一个 GitLab issue 和一段 Slack 讨论要补上下文。过去 AI 编程工具通常只能在编辑器里补代码,Codex 这次真正变的是:它开始往编辑器之外伸手。去碰浏览器、终端、文件、PR、远程开发机和长期任务。
OpenAI 官方标题叫 Codex for (almost) everything,almost 很重要。它不是“Codex 已经接管一切”,也不是“第二个 Claude Code 全面替代谁”。更准确地说,OpenAI 正在把 Codex 从写代码助手往开发工作台入口推。
1一、这次更新的主线:不只是写代码
OpenAI 官方文章把这次定义为 Codex 的 major update,并提到每周有超过 300 万开发者使用。更新后的 Codex 可以操作电脑、使用更多工具和应用、生成图片、记住偏好,还能承担持续和可重复的工作。对开发者来说,重点不是功能数量,而是它想覆盖完整软件开发生命周期。
原文里“第二个 Claude Code”这个说法很适合传播,但它不是 OpenAI 官方定位。Claude Code 强在终端和代码工作流,Codex 这次补的是另一条线:把 PR、终端、文件预览、浏览器、插件、记忆和自动化塞进同一个桌面应用。最怕的不是工具升级太快,而是看见“接管一切”就把灰度、权限和安全边界全忘了。
2二、走出编辑器:先到 macOS

官方文章写得很直接:有了 background computer use,Codex 可以通过自己的光标看屏幕、点击、输入,使用电脑上的应用。多个 agent 可以在 Mac 上并行工作,不干扰你操作其他应用。这个能力适合前端迭代、应用测试,或者处理没有 API 的软件。
但这里要看清可用范围。官方 Availability 部分写的是 computer use initially available on macOS,并会向 EU 和 UK 用户推出。不是所有平台、地区、账号都已经完整开放。涉及屏幕观察、鼠标点击、键盘输入,还要考虑授权窗口、误操作、敏感页面、回滚和审计。
3三、浏览器和图片:更靠近前端工作流
Codex app 现在带应用内浏览器,开发者可以直接在页面上评论,给 agent 更精确的指令。OpenAI 说它现在对前端和游戏开发有用,后续会扩展,让 Codex 在 localhost 之外更完整地控制浏览器。关键词是“后续会扩展”,现在不要写成已经能稳定接管所有网页操作。
图像能力也被放进同一个工作流。官方确认,Codex 可以使用 gpt-image-1.5 生成和迭代图像;结合截图和代码。可以做产品概念图、前端设计、mockup 和游戏视觉。对独立开发者来说,这意味着从“改页面代码”到“生成视觉草图”少切一次工具;它更像快速迭代辅助,不是专业设计审稿的替代品。
4四、90 多插件和 MCP:真正想接的是工具链
这次更新还带来 90 多个 additional plugins,把 skills、app integrations 和 MCP servers 组合起来。让 Codex 跨工具收集上下文并采取行动。官方列的例子包括 Atlassian Rovo、CircleCI、CodeRabbit、GitLab Issues、Microsoft Suite、Neon by Databricks、Remotion、Render 和 Superpowers。
这部分对团队开发很关键。AI 编程工具如果只会读当前文件,价值有限;如果能读 issue、CI、PR 评论和文档,上下文才可能完整。但上下文越多,权限越复杂。接入前至少要问清:它能读哪些仓库、能不能写入、失败怎么回滚、日志能不能追踪、谁有授权权限。
5五、PR、终端、SSH:更像一个开发工作区
Codex app 支持处理 GitHub review comments、运行多个 terminal tabs,还能通过 SSH 连接 remote devboxes。这里 SSH 官方明确写的是 alpha,适合关注,但不适合被包装成稳定生产能力。远程开发机一旦接入 agent,风险就从“改错代码”升级成“在真实环境里执行错命令”。
文件和摘要能力也补上了。Codex 可以在侧边栏以富文本预览 PDF、spreadsheets、slides 和 docs,还能用 summary pane 跟踪 agent 的计划、来源和产物。这些功能没有“电脑操作”刺激,但对真实项目更实用:你不用在十几个窗口之间找上下文,也更容易判断 agent 依据了什么信息。

6六、记忆和自动化:长期任务开始成形
OpenAI 还扩展了 automations,让 Codex 复用 conversation threads,保留之前积累的上下文。它可以给自己安排未来工作,并自动唤醒,继续推进跨几天或几周的任务。官方举的团队场景包括落地 open pull requests、跟进任务,以及追踪 Slack、Gmail、Notion 里的讨论。
记忆功能目前是 preview。Codex 可以记住个人偏好、纠正记录和花了很久才收集到的背景,并基于项目、插件和记忆主动建议下一步。比如识别 Google Docs 评论,从 Slack、Notion 和代码库拉上下文,再生成优先级行动清单。这个方向很有用,但记忆越强,越要管好“记什么、谁能看、怎么删”。
7七、哪些人值得先关注
如果你是前端、游戏或应用开发者,电脑操作、应用内浏览器和图像生成值得看,因为它们贴近页面调整、视觉 mockup 和交互验证。如果你做团队协作,PR 评论、issue、CI、文档预览、summary pane 和插件生态更关键,因为它们解决上下文分散和协作成本。
如果你只是日常补代码、写脚本、改小 bug,不一定马上迁移。官方这次更新里有 rolling out、alpha、preview、soon、future plan 几种状态,国内用户还要考虑 ChatGPT 登录、桌面端、地区和网络问题。思算力这类多模型 API 服务能减少模型调用和工具配置摩擦,但 Codex 桌面端功能仍要以官方开放范围和账号条件为准。
8八、Codex 和 Claude Code,真正该比什么
Codex vs Claude Code 不应该只比谁更像 Super App。更有用的比较维度是:谁更适合终端长期任务,谁更适合跨应用工作流。谁的权限边界更清楚,谁更容易接入代码库、CI、issue、文档和远程环境,谁在国内使用成本和稳定性更可控。没有同口径实测前,不要急着下胜负结论。

Codex 让 OpenAI 加入了工作台入口之争:AI 编程工具不再只抢“写代码”这一段,而是开始抢需求、上下文、审查、调试和长期跟进。你的开发工作里,最想让 AI 接管的是 PR 审查、前端调试、远程 SSH、文档整理,还是长期任务跟进?评论区说下工具链,我整理一份 Codex / Claude Code / Cursor 的对比维度表。
夜雨聆风