hi,我是南哥。
昨晚临睡前刷了一眼 X,看到 OpenAI 一条新动态。
时间是太平洋时间 5 月 14 号下午,国内这边差不多就是 5 月 15 号凌晨。
Codex 上手机了。
不是又出了一个独立的手机 App,是直接塞进了 ChatGPT 那个 App 里。你打开 ChatGPT,左边菜单里多了一个 Codex 入口,点进去就能远程操控你家电脑上的 Codex 干活。
我当时人已经躺床上了,想着明天再说。
结果躺了 5 分钟,又爬起来了。。。
这玩意对我来说有点刚需。
我前阵子飞了三趟外地,每次坐高铁都恨不得把家里那台电脑远程支起来。Claude Code 其实早在 2 月份就出了远程功能,但我日常用 Codex 比较多,一直在等。
等了 3 个月,终于等到了。
OpenAI 在公告里给了一个数字——Codex 周活已经突破 400 万。这么大用户基数,"在手机上控制 Codex"这个 feature 一直是开发者社区呼声最高的之一。
今天用了一整天,再翻了翻 OpenAI 的官方说明和老外的几篇上手测评,跟我自己的踩坑放一起,写一篇全的下来。
一、为啥这事让我有点激动
先说背景。
之前用 Codex 桌面端的时候,工作流是这样的:
打开 Codex → 输一句话提示词 → 看着进度条 → 等结果 → 继续下一句。
提示词敲得很快,几秒钟的事。但 Codex 跑任务可能要十几秒到几分钟,这段时间你就只能干瞪眼。
写提示词的时间,远远小于盯屏幕的时间。
我那会儿就在想,要是 Codex 能上一个手机端,可以让我把屏幕一锁、去倒杯水、上个厕所、刷会儿短视频,任务完了手机推个通知就好了。
更进一步——出差也能干活。
我经常出门,重要的几个项目、配置、文档、密钥全在家里那台电脑上,24 小时不关机。出门路上要是能掏出手机给电脑发条指令,比啥都香。
这就是为啥 Codex 上手机这件事,对我来说不是一个锦上添花的功能,是个真·刚需。
OpenAI 的官方说法是这么定位的:
这个版本不是为了让你在手机上写代码,而是让你在离开电脑时,还能审阅、批准任务,或者发起新的提示。
翻译一下:手机不是用来敲代码的,是用来当远程控制器的。
这个定位我觉得挺准的。
二、配置过程:比想象中无脑
整个连接过程其实就三件事——桌面端 Codex 更新到最新版、手机端 ChatGPT 更新到最新版、扫一下二维码。
第一步,把桌面端 Codex 更新到最新版。
更新完打开,会自动弹一个新功能提示,告诉你现在可以从 ChatGPT 手机端远程连了。
点【Get Started】,进入连接设置。
接下来会弹一个权限确认窗口,问你允不允许 ChatGPT 手机端连这台电脑上的 Codex 实例。
点允许,电脑这边就等着手机过来配对。
第二步,把手机端 ChatGPT 更新到最新版。
iOS 和安卓都行。iOS 用户直接去 App Store 更新,安卓去 Play Store 或者你的渠道商店。
更新完打开 ChatGPT,首页就能看到一个 Codex 入口。
点进去,会让你授权这台手机。
授权一下、登录一下、等它完成安全设置——整个过程是全自动的,不需要扫码、不需要输入什么配对码,只要你两端登录的是同一个 OpenAI 账号就行。
第三步,确认状态。
连完之后,桌面端 Codex 设置里能看到刚连上的手机型号,手机端 ChatGPT 里能看到你电脑的名字。两边都显示绿色"已连接"。
整套流程两分钟不到。
我自己之前折腾过各种远程方案——什么 NAT 穿透、DDNS、Tailscale、ZeroTier——每次都得搭半小时起步。这次基本没让我做任何复杂的事情。
体验是真的顺。
三、第一次实测:差点翻车
连完我做的第一件事,是想让手机版 Codex 去改一个本地文件试试。
我电脑上有一个 markdown 草稿,记着前段时间看的几个 Agent 框架对比。我想让 Codex 把里面一大段文字改成 bullet point 列表的形式。
我直接在手机上敲:"找到那个叫 framework-compare 的文件,把里面整段内容改成 bullet point。"
然后我把手机一锁,去倒了杯水。
回来一看,傻了。
它确实在干活,但它在另一个项目目录里改了一个根本不存在的文件——它新建了一个,然后开始往里写 bullet point。
为什么?
因为我没指定项目。它默认拿了我最近打开过的那个 Codex 项目当工作目录。
这就是我犯的第一个错。手机版 Codex 不像桌面版你能左边瞄一眼当前在哪个项目,手机屏幕小,项目名容易看漏。
赶紧停掉,重新来。这次我先在手机上切到正确的项目,再发指令。
这次就对了。
发完指令几秒钟之后,手机这边能看到 Codex 开始读文件、跑命令、写 diff。我盯着手机看了一会儿,就跑去打开桌面 macOS 那台电脑确认——文件确实在本地被修改了,跟我手机上看到的 diff 一模一样。
体验是真的有点意思的。
你在手机上敲一条指令,桌面端那台机器立刻开始动。手机这边能实时看到 Codex 在干啥——读哪个文件、跑了哪条命令、改了哪几行——全部同步过来。
而且不只是文件操作,Computer Use 和 Chrome 浏览器控制也能在手机上触发。
我后来试了一下让 Codex 在桌面端打开浏览器去某个网站查个东西,整个浏览过程在手机这边能看到截图序列,每一步它点了啥都能看清楚。
这一点比 Claude Code 那个远程要爽不少。
Claude Code 的手机端是把一长串对话流给你滚动着看,时间长了找起来挺累的。Codex 这边像是把整个桌面版的工作台压扁了塞进手机,左侧能看到所有项目,点哪个项目就进哪个工作流,每一步都能看清楚。
四、Apple Watch 通知,挺香
我前面说让 Codex 改文件之后我去倒了杯水。
水还没倒完,手腕嗡了一下。
低头看手表,弹了个通知:Codex finished。
它做完任务会自动给你的 ChatGPT App 推一条通知,如果你戴着 Apple Watch,手表也会震。
这个细节看起来不起眼,但对远程编程这件事来说挺关键的。
之前用桌面版 Codex,提示词发出去之后,要么盯着屏幕等,要么干别的然后时不时回来看一眼。两种都挺累的。
现在直接把屏幕一锁,去厕所、去吃饭、去坐地铁,任务一完成手表立刻提醒。
我突然意识到一件事:**真正能让人解放出来的远程编程,靠的不只是"远程连接",还得有靠谱的"完成提醒"**。不然你还是得不停地刷新页面看进度。
OpenAI 这一刀切的位置挺准的。
五、藏在三个点里的多机连接
我用 MacBook Pro 配完之后,想着家里那台 Mac mini 也连一下。
结果打开 Mac mini 上的 Codex,根本没弹"设置移动版"那个提示。手机上倒是显示在等待桌面端配对,但桌面端没任何反应。
后来我去开发者社区翻了一下,发现不止我一个人遇到这个问题。有些机器上不弹那个引导,估计是灰度铺得不均匀,或者跟 macOS 版本有关。
不过我后来发现一个隐藏菜单——这玩意是可以连多台电脑的。
在 ChatGPT 手机端的 Codex 页面右上角,点那三个点,进【连接】,会看到当前已连接的设备列表。这里可以继续加新设备。
我大概试出来至少能加 3 台,应该还能更多。
这个对我来说才是真正的杀手锏。
因为我家里那台 Mac mini 才是真正的"工作主力"——开了 Computer Use 权限,能直接操控电脑里其他应用,还装了 Chrome 扩展能控浏览器。
MacBook Pro 是我出门带着的轻装版,里面没啥重活。
如果能把 Mac mini 连上手机,意味着我出差路上甚至可以让 Codex 去操作家里电脑上那些没有原生集成的应用——剪映、Figma、各种网页后台、内部系统,理论上都能远程指挥它干。
只是目前 Mac mini 死活不弹那个引导。
估计是个灰度的锅,再等一两个版本应该就好了。
六、聊聊背后的技术原理
我知道很多朋友看到这种"手机控制远程电脑"的功能,第一反应是问:
到底安不安全?我电脑端口要不要开放?数据会不会被截?
OpenAI 的官方说法是:底层走了一层 secure relay(安全中继),让运行 Codex 的机器能跨设备保持可达,同时又不直接暴露在公网上。
翻译成人话就是——OpenAI 在中间架了一层代理服务器。
你的手机端 ChatGPT 发出一条指令,先到 OpenAI 的中继服务器,中继服务器再转发到你桌面端的 Codex。响应也是反过来走同一条路。
文件、凭证、权限、本地配置这些敏感数据始终留在你的主机上,只有更新信息流向手机。
这个设计有几个挺讲究的好处。
第一个好处是安全。
你的 Codex 不需要开放任何端口到公网,也不需要 NAT 穿透或者 DDNS 这些花活。所有通信都经过 OpenAI 的加密中继,CLI 和 MCP OAuth 登录强制走 ChatGPT 认证。
第二个好处是会话状态跟账号走。
你在哪台设备登录 ChatGPT,上下文就跟到哪里。在手机上开了一个编程任务,回到电脑前打开 Codex,上下文还在。
这个体验跟 iCloud 同步笔记是一个意思,但同步的是整个编程会话——截图、终端输出、diff、测试结果,全部实时推到手机端。
第三个好处是架构讨巧。
OpenAI 没给 Codex 单独做一个手机 App,而是直接塞进了 ChatGPT 主 App 里。
这其实是一个超级 App 战略的延续。
桌面端走独立 App 整合(Codex 桌面版),手机端走 ChatGPT 内嵌。一个账号串起两端,配置成本低、获客成本也低——本来就有几亿月活的 ChatGPT 用户,让他们顺手点一下 Codex 入口就行。
这一手挺鸡贼的。
七、几个小坑
体验到现在还是发现了一些不完美的地方。
第一,连接会掉。
手机端 ChatGPT 和桌面端 Codex 之间会偶尔掉线,而且没有一键重连按钮。
我自己摸出的办法是:杀掉 ChatGPT 后台重新启动,就能重连上。
怎么判断有没有掉线?看 Codex 设置里那个连接状态小圆点——绿点是好的,黄点是掉了。
网络波动这种事情,总搞得人提心吊胆的。
第二,手机端没办法直接截图丢给 Codex。
桌面版有个我超爱的功能,是可以截一段屏幕区域,直接让 Codex 看。
很多时候代码没报错,但 UI 上有问题——按钮位置不对、字号偏小、颜色不协调——光靠 Codex 自己发现不了,得截图丢给它指着说"这里宽度不对"。
手机端目前做不到这个事。
这也合理,毕竟手机屏幕上看的是 Codex 的工作流,不是你要改的那个网页。但这就意味着,纯靠手机你做不了最后那一公里的视觉验证。还是得有桌面端在那儿兜着。
第三,电脑得一直保持唤醒。
Codex 不是云上跑的,是跑在你那台连了网的电脑上。
所以你电脑要么得一直开着,要么得设置成永不睡眠。OpenAI 官方文档说得很清楚:如果那台 Mac 睡眠了、断网了、或者关了 Codex,远程访问就停了。
这点对台式机用户没影响,对笔记本党就有点烦——出门得把笔记本搁那儿不能合上盖子。
第四,手机屏幕真的小。
我一开始想得挺美——以后可以在地铁上敲代码了。
实际用了两次之后发现——在地铁上敲一段两百字的提示词,比电脑上敲累十倍。手指容易点错、自动联想词跳乱、屏幕又只能看到 5-6 行 diff。
折叠屏未来真不是鸡肋。
八、Codex 最近的更新,是真的猛
聊了这么多手机端,再聊一下 Codex 这段时间整体的更新节奏。
实话说,Codex 这几个月更新得有点离谱,我列几个我觉得最重要的。
1. Computer Use
一句话概括:Codex 现在可以在后台操控你的电脑了。
它会用自己的光标,在你的电脑上看、点、打字,操控你电脑里的各种应用。配合 GPT-5.5,速度和准确性都挺猛的,我个人感觉比 Claude 那边的 Computer Use 要丝滑不少。
2. 内置浏览器
这个功能我现在用得最多。
你可以直接在 Codex 内置浏览器上点选页面元素做注释——比如想把某个标题字号改大一号,点击一下、写句话,就完事了。不需要再额外截图标注,也不需要硬生生用嘴描述。
真正实现了 Vibe Coding 里的"指哪改哪"。
3. Codex for Chrome
这是个 Chrome 扩展,让 Codex 可以直接在你已登录的 Chrome 浏览器里干活。
OpenAI 有个很有意思的观察——他们发现即使上了 Computer Use 功能,用户绝大多数的工作场景其实都发生在浏览器里。
所以他们就专门做了个 Chrome 扩展来优化这个体验。
安装之后,Codex 可以借用你已登录的浏览器状态,去操作那些需要登录才能用的网站——比如知乎、Gmail、公司内部后台。
而且它在 Chrome 里是用 Tab Group 来工作的,它的工作页面和你正在浏览的页面是分开的——你该刷 B 站刷 B 站、该看文档看文档,它在后台里非常安静的帮你干活。
4. 在 Codex 里直接生图(gpt-image-2)
用过 Vibe Coding 的人应该都有这个痛点——AI 写代码飞快,逻辑也干干净净,但是到了要放图片的时候,它就只能给你生成一些简陋到让人想哭的 SVG。
你得自己去 ChatGPT 里生图、下载、拖到项目目录、改路径引用,再回 Codex 跟它说"图我放好了你帮我引用一下"。
倒不是不能这么干,就是很碎、很烦。
现在 Codex 直接集成了 gpt-image-2——你在 coding 过程中跟它说"给这页配张科技感的 banner 图",它直接就生成好、保存到你项目目录、把代码里的引用路径改对。
一气呵成。从代码到视觉资产,全链路打通。
5. Hooks
让你能在 Codex 的特定事件触发时跑自定义脚本——任务开始前、文件改动后、提交前等等。
跟 Claude Code 那边的 Hooks 类似,给高阶用户多了一层自定义空间。
6. Remote SSH 正式版 + Programmatic Access Tokens
这次手机端这波更新的同时,OpenAI 还顺手发了两个偏开发者的功能:
Remote SSH GA:Codex 可以连接远程开发环境,比如公司服务器或者云端 GPU 实例 Programmatic Access Tokens:让 Codex 可以接入 CI/CD 流水线,自动化程度又上了一个台阶
把这几个东西连起来看就明白了——OpenAI 是在把 Codex 从一个本地工具,变成一个"在哪都能用"的全局 Agent。
手机控制、远程 SSH、CI/CD 接入、Computer Use、浏览器扩展——任何场景都能塞 Codex 进去。
九、关于 Codex vs Claude Code
我知道很多人会问这个对比。
我个人的体感,最近 2-3 个月,我用 Codex 的比例在快速上升。
年初的时候我的比例大概是 Claude Code 80% + Codex 20%。
到上周,差不多 55 开了。
倒不是 Claude Code 不好用,我现在还在用,以后也会继续用。两者各有优点。
但 Codex 这段时间的更新节奏,肉眼可见的猛——Computer Use、内置浏览器、Chrome 扩展、内置生图、手机控制、Hooks、Remote SSH、PAT,一个接一个。
Claude Code 这边反而最近沉寂了点,没什么让人眼前一亮的新东西。
而且 GPT-5.5 + Codex 的组合,社区里口碑爆棚。Opus 4.7 出来之后反倒有点拉,不少人反馈写代码容易犯低级错。
我自己也踩到过——前几天让 Opus 4.7 把一个组件的 layout 从 flex 改成 grid,它直接回我一段话解释为什么 flex 在这个场景下更好。
兄弟,我让你改你就改,我不需要你教我做事 = =
还有一个挺朴素的理由——不封号。
之前我们公司小伙伴经常鬼哭狼嚎,说不知道咋了 Claude 账号又被封了,今天活儿干不下去了。自从大家陆续切到 ChatGPT 生态之后,就再没听到这块的声音了。
这次 OpenAI 还有一个让我觉得挺良心的点——这个手机远程功能,所有套餐都能用,包括免费版和最便宜的 Go。
不像有些功能就给 Pro/Team 用户限定。
十、我的判断
说几句我自己的判断,纯个人观点,不一定对。
第一,手机操控 Agent 这件事,短期内不会取代桌面端。
手机屏幕太小、键盘输入慢、截图反馈缺失——这些硬伤靠软件优化解决不了。
第二,但手机端有自己不可替代的价值——远程。
出差路上、地铁里、躺床上、蹲马桶、等外卖——所有那些"不能正经坐电脑前但能掏手机"的场景,远程编程的价值才显出来。
这也是 Claude Code 当时这个功能爆发的主要原因。
第三,OpenAI 的超级 App 战略越来越明显。
ChatGPT + Codex + Atlas 浏览器整合成一个入口——以后一个 App 搞定聊天、编程、上网。
一个账号、一个入口、所有工作。
这个野心是真的大。
第四,作为用户,这场军备竞赛对我们是好事。
Codex 和 Claude Code 你追我赶,让人想起来当年 iOS 和安卓互相抄作业的黄金时代。
我们只需要享受红利——两边都用,谁好用用谁,不被任何一个生态绑死。
哪天 Anthropic 算力到位了,又开始猛更新的时候,你也不会被落下。
好啦,今天就聊到这里。
还没装上的可以打开 ChatGPT 看看入口出来没有,灰度的,没出来也别急,再等等。
最近这一波 AI 工具更新真是有点跟不上的感觉。。。挺累的,但也挺爽的。
我们下篇见。
Sources(写作时参考的官方信息):
OpenAI 官方公告:Work with Codex from anywhere OpenAI 开发者文档:Remote Connections 9to5Mac:OpenAI brings Codex control to ChatGPT for iPhone and Android TechCrunch:OpenAI says Codex is coming to your phone eWeek:OpenAI Launches Codex in ChatGPT Mobile for Its 4M Weekly Users
夜雨聆风