乐于分享
好东西不私藏

我劝你清醒点,AI写代码工具真不是越贵越好

我劝你清醒点,AI写代码工具真不是越贵越好
说实话,上个月我差点被Codex忽悠瘸了。
那天下午,我蹲在杭州滨江的出租屋里,对着两台显示器发呆。左屏开着ChatGPT的Codex界面,右屏是Claude Code的黑底终端。窗外下着雨,耳机里放着李宗盛,像个傻子一样来回切了两个小时。
为啥?因为我发现一个扎心的事实:这俩玩意儿在演示视频里都牛逼轰轰,可真到自己上手,完全不是那么回事。
我跟你说,这事儿得掰开了聊。
---
**别被“能读仓库”糊弄住了**
很多博主吹这俩工具,张口就是“能读仓库、能改代码、能跑命令”,听着挺唬人。但你知道真相是啥吗?我家楼下卖煎饼的大爷都知道,光会摊饼皮不叫本事,得能加俩鸡蛋还不破皮才算手艺。
我在2023年11月,深圳南山科技园那间没窗户的办公室里,第一次用Codex跑一个旧版Spring项目。它确实能定位到Controller层,但改完代码直接给我丢出17个编译错误。我当时就差点把键盘摔了。这他妈的也叫“理解仓库规范”?
讲真,工具的“理解”和人的“理解”是两码事。它能扫到文件结构,但它读不懂你同事在注释里写的“此处勿动,改了会炸”的潜台词。
---
**长期用,拼的不是炫技,是这三个死磕的点**
我在第二周换了思路,把Codex和Claude Code分别扔进同一个真实项目,用满七天,然后记录返工次数。
先说结论,你们再往下看细节:
**第一,它能不能摸清你的规矩?**
每个团队都有自己的烂摊子规矩。比如我们这有个规矩,所有日志必须带traceId,不然运维大哥会拿着刀来找你。
Claude Code在这个点上,说实话,比我预期好。它好像能更快地从你给的PR描述和commit记录里,反推出一些潜在的约定。我给它喂了上周的五个commit信息,它改新代码时,居然知道沿用我们那个丑到爆的`ResultBean`封装。
而Codex呢?它更喜欢按照它脑子里那套“最佳实践”来。有一次我让它加个接口,它直接给我返回一个`ResponseEntity<Map<String,Object>>`。我跟你说,我当时血压就上来了,这种写法在我们组是要被review时候喷死的。
**第二,权限边界清不清楚?**
这玩意儿最要命。我见过太多人吹“AI帮你跑命令”有多爽。爽个屁。
上周三下午,我让Claude Code帮我清理一个分支上的构建缓存。它倒好,直接给我执行了一个`rm -rf`,还好我眼疾手快,在它第二个确认弹窗那里按了Ctrl+C。虽然它后来解释了是误判,但这个心理阴影是真留下了。
相比之下,Codex在需要执行高权限命令时,确认步骤更啰嗦,但那种“啰嗦”反而让我觉得安全。嗯,就是那种烦人的老妈盯着你穿秋裤的感觉,虽然烦,但踏实。
**第三,团队那点破流程,能不能沉淀下来?**
这点我得站Claude Code。它的终端交互方式,特别适合把一些常用的“碎活儿”变成自动化脚本。
比如我们每次发版前要做的“检查配置中心、确认数据库脚本、跑冒烟测试”这三板斧,我用Claude Code的CLI模式写成了一个小指令集。现在新来的实习生,打个`/release-check`就完事了。这效率提升,说实话,比我手动教他三遍强多了。
Codex在这方面更像一个“个人助理”,它在ChatGPT那个网页生态里很强,但你要把逻辑沉淀到团队的共享知识库里,得额外做很多整合工作,很蛋疼。
---
**我最后怎么选的?给你交个底**
我知道你们想听个爽快的结论。但抱歉,这事儿真没有标准答案。
我现在的状态是:**ChatGPT重度用户,但主力写代码用的是Claude Code。**
原因很简单。我是那种喜欢在终端里折腾的人,黑底白字让我觉得踏实。而且我们团队用Claude的生态稍微多点,交接起来方便。
但如果你是个平时全靠浏览器吃饭,习惯在ChatGPT里查资料、写邮件、偶尔改改脚本的普通开发者,那你闭眼入Codex就行。它的多端衔接,从网页到桌面端到API,那种顺滑感,Claude Code目前还比不了。
---
**给你一个能落地的“七天测试法”**
别管什么参数对比了,都是虚的。你就按我这个法子来:
挑一个你最近正在做、且至少还能改一周的小需求。
周一和周二用Codex做,周三和周四用Claude Code做,周五统一复盘。
记录三个数字:**返工次数**(改完又要改的次数)、**人工确认量**(你打断它自己动手的次数)、**交付速度**(从提需求到能跑通的总时长)。
我测试那周的数据如下,仅供参考:
Codex:返工5次,人工确认8次,单个模块耗时约2.5小时。
Claude Code:返工3次,人工确认5次,单个模块耗时约1.8小时。
但这不代表Claude Code就赢了。因为它生成的代码风格更“野”,有时候会用一些冷门的API,导致我后续review时间变长。
害,说白了,就是看哪种“摩擦感”你更能忍受。
---
**别把工具当信仰,把时间当成本**
我见过太多人,为了谁家模型分数高0.5%吵得不可开交,好像用了那个工具自己就成架构师了似得。醒醒吧,工具只是铲子,你才是挖坑的人。
我刚才又看了一眼屏幕右下角,晚上十一点二十三分。我还有两个接口没写完,明天上午还要跟产品过需求。你看,工具再牛逼,活儿还是得自己干。
碎碎念1:我觉得这波AI浪潮,最大的副作用是把大家的焦虑感都拉满了。
碎碎念2:其实有时候用回最原始的Vim,反而觉得脑子更清楚。
碎碎念3:不知道你们有没有这种感觉,AI写代码越多,我越怀念刚入行时那种手搓栈的快感。
---
最后留个问题给你们:你们在项目里用这些工具,遇到最离谱的“自作主张”是什么?我挺好看看有没有比我的`rm -rf`更刺激的。
评论区等你们的故事,我来点赞。
—— 一个在深夜跟AI斗智斗勇的普通开发者