Codex目前终于成为了我主要的开发工具之一。相较于之前最火的Claude Code,Codex有可视化界面,有更好的IDE偏向,而且在处理本地电脑事务上更加靠谱。先叠个甲,这里只做一个个人感受的闲聊,不考虑token消耗、能力上限、prompt改造、插件分析等等,而且就是根据本人喜好来写的,所以如果与实际有偏差,或者有不同意的观点,那就按照自己的想法去做。
本文是纯手工古法打字,就不遵从三步走的原则了。
1 定位分析
Codex的定位处于一个中间态。它既不是一个类似Claude Code的纯Vibe Coding的工具,也不是一个和VSCode、Trae相似的强IDE工具,而是一个处于两者之间的、有些模棱两可的产品。照理来说,这种又不是很专业、但又不是很亲民中间态的产品,应该是两头都顾不上的,但是Codex对于中间态处理的比较好,它更加偏向于VibeCoding的状态,但是会给用户浏览页面,有IDE的可观察和可调试状态,而且因为缺少专业IDE工具的页面和很多功能,反而让它看起来比较轻。虽然在中间态这块我更加推荐Cursor,但是Codex的劣势反而成了自己的独特优势——不需要让用户太过贴近代码,专注自己的业务逻辑。
有了对比那必然有竞品,这里只做几个用过的产品的感受分析:
1.1 国外Claude Code
Codex最大的竞品是Claude Code,但是两者的专注方向不太一致。Claude Code更加贴合需要自我成长和加强沟通的助手,所以过程会很啰嗦,需要人经常参与,虽然也有goal模式,但是一般Claude Code的使用者很少这么去干。由于Claude Code缺少WEBUI的界面,所以会给不会代码的人一种不适感,虽然现在很多开发者也做了专门针对Claude Code的页面,但是基于与Claude Code本身的适配性和原生态问题,对于专业人员依然会有一些不舒服。此外Anthropic这两年连续加码,对模型的使用上对国内用户越来越不友好,而搭配其他的模型总会遇到一些适配性的问题,所以Claude Code用户也在逐步流向Codex。
1.2 国外Cursor
Cursor我从去年开始弃用,所以这里的对比只能局限于2025年的Cursor产品。Codex最为强有力的竞争对手应该是Cursor。从交互页面到生态,对于较为专业的开发者来说Cursor我认为是适配性更强的。但是Cursor有一点较为致命,因为Cursor是封闭商业产品,所以在调整模型等问题上需要一定的技术手段调整,这个也是把很多初学者和没有代码能力的人拒之门外的首要问题。Cursor估计也意识到它面对的对象都是轻代码或者无代码人群,也和Codex一样走向了agent中间体。
1.3 国内Trae与国外VScode、Visual Studio
Codex和Trae、VSCode不能完全算作竞品,Trae、VSCode主要方向还是专业IDE。Codex在之前的版本是默认使用GPT模型的,如果要用本地模型需要用CCswitch或者Codex++等插件,这点上不如国内的方便,而且国外的模型使用封锁越来越严重,所以一定要把国内的产品也列上对比。
从专业性上来看,Trae、VSCode明显更加适合专业的程序员,而且模型调整也更加灵活。Trae有免费的模型额度,但是现在需要排队,从这几个月的排队来看,Trae明显是有意放慢了排队的速度,以前2000人的排队大概10~15分钟,现在都在半小时以上,对于断断续续的开发而言问题不大,但是对于连续开发者而言这个是不能忍受的。不过Trae还能愿意放出免费模型,至少不是强制收费,优先付费人员也可以理解,毕竟要恰饭嘛。但是如果不想排队,而且不在乎AI,我觉得还是Cursor更好用。
对于极限单兵,Codex的作战能力不错,goal模式基本上能让你完全脱手,而Trae的SOLO模式也相当不错。然而Trae由于安全级别提的比较高,所以很多操作依然需要手动确认,有时候会卡在一个地方很久直到你的注意力重新回到Trae上。
对于老牌大哥Visual Studio,其实还是最强的IDE。从2024年开始,Visual Studio就搭载了微软自己的co-pilot,基于Github上的代码,co-pilot理论上很强,但是我没有用VS的co-pilot完全生成过整套代码,但是作为代码补全它是很不错的。但是VS最大的问题就是太重,对于新手用户或者不会代码的人来说完全没有必要,而大佬级的程序员也不需要VS去做打包等工作。但是对于团队、企业等,VS依然是我认为的最好选择。
1.4 国内CodeBuddy和其他
说实话,CodeBuddy因为有一段时间免费LLM,并给出了很多免费额度,所以我也很有兴趣地去测试了一下——然后就没然后了,因为能力上还是差一个大档次。就IDE界面来说,CodeBuddy中规中矩,但是其他方面还是不如Trae或者Cursor,如果说都能直接国内下载使用,除了免费的额度之外CodeBuddy对我没有其他的吸引力。
至于其他的产品,可能有人会说OpenClaw、Hermes agent、WorkBuddy之类的东西,我只能说广告打的很响,但是玩具只是玩具,适合不会编程的人做小型和微型开发,以及本机的一些联动,用这东西作为代码的生产力实在是不够看。以workbuddy为例,作为同类型的agent产品,token消耗和迷一样,容易卡死、走循环,而且速度很慢,一个很简单的任务可以跑上半小时,这就完全没法看了。反而对于kimi code、minimax agent等,虽然能力上有些欠缺,我觉得效果还可以,就是有点费钱。不过Workbuddy这类的产品现在明显在向codex靠拢,试图从纯agent走向中间体,但是就目前的表现而言,我觉得workbuddy需要整体重做。
2 Codex的优点
Codex的优点很明确,和上述的内容一样,它是一个中间态,不需要过分操心,使用了对话式的生成式代码,同时Codex也支持cli(虽然很多其他的IDE也有)、支持直接的接口调用,说直白点,就是很强的agent能力。这里拿较强的Trae的SOLO模式做对比,都使用Minimax-M3模型,Codex明显“聪明”一些,自主程度更高,对token的损耗也低不少,由于Trae是完全封装的,所以只能推测是Trae内置的机制有所不同导致了一些性能损耗。而且在给足权限和判断权限的前提下,Codex可以完全自主发挥,可以一口气跑到最后,而Trae因为安全机制还是会中间打断要求人工确认。
3 Codex的缺点
先说一个致命伤——Codex需要搭配GPT模型才是最强的,但是GPT模型的使用门槛相对较高。我个人使用的是国内的模型,因为说不定哪天GPT就技术性锁死了,但是用Codex框架+国内的LLM模型,能力下滑的很严重。相比之下Trae针对国内模型做了不少优化,“本土化”能力更强,虽然在agent能力上不如codex,但是模型可以排队免费,还要什么自行车?
界面中文化不够。本身Codex就是国外的产品,所以在界面优化、中文化上还是不足,就算语言选择了中文,但是依然存在一些英文无法翻译。
界面优化还不够。现在的Codex对话模式和项目文件夹模式我觉得很乱,
插件、skill的问题。很多插件和skill等在国内不支持或者有时候刷不出来,这导致Codex在很多方面反而不如Trae,甚至在一些小任务上不如workbuddy等agent产品。
4 总结
先来个一句话总结:有能力用国外模型的直接上Codex、不能用国外模型的想用agent做vibecoding的也优先Codex、专业用户国内的用Trae、有想法的骨灰大佬用Codex+Claude Code。
最近我一直在适应国内的模型。之前用Anthropic的opus真的是直接起飞的感觉,然后因为众所周知的原因opus就很难搞到了,那种由奢入俭的感觉非常难受。换成国产模型之后最大的问题就是一次指令的完成度比较差,这倒不是背刺国产模型,这是个确确实实存在的差距,不过相比去年,2026年这个差距越拉越小,虽然依然存在一些鸿沟,但是和去年相比进步巨大。不管怎么说,先适应好国内的模型,以后用起来和做企业级合作的时候会更加顺畅。
总体来说,国内目前最夯的应该就是Trae了,横扫一圈目前没看到能与之匹敌的,但是token plan订阅的价格实在让人爱不起来,最低的入门级价格足够去买一套多的GLM的新手token plan了,那为什么我不用GLM+Codex呢?
夜雨聆风