
3个AI终端工具我用了2个月,最终只留1个
Gemini CLI免费1000次/天的日子,在6月18日戛然而止。我之前白嫖了整整两个月,突然被断供,只能重新选型。Claude Code、Gemini CLI、Codex CLI,三个终端AI Agent我各用了至少20天,最终只留了一个。这篇是我这两个月选型过程的真实记录,不藏私。
先说结论:我留了Claude Code
不卖关子。三个工具测完,我最终选了Claude Code。
不是因为便宜——它恰恰是最贵的。也不是因为它功能最多——论免费额度,Gemini CLI曾经碾压另外两个。我选它,是因为在我最需要的场景下,它是最靠谱的。
上个月我帮表弟改一个毕设的Python爬虫项目,代码不算复杂,但涉及登录态管理和反爬逻辑。用Claude Code跑了一遍,它自己读代码、定位问题、改了三个文件,最后还帮我跑了一遍测试。整个过程我就在旁边看着,没动手。换成Gemini CLI,同样的任务它改对了主逻辑,但漏了一个配置文件的联动修改。Codex CLI更差,它给我的补丁压根跑不起来。
这就是差距。92%的首过正确率(Claude Code)和85%左右(Gemini CLI)听起来只差7个百分点,但在真实项目里,这7个百分点意味着你要不要手动收尾。
Gemini CLI:免费的时候确实香,但断了就是断了
我必须承认,Gemini CLI免费的时候是真香。用个人Google账号登录,每天1000次请求,用的是Gemini 2.5 Pro——这个模型单买API要花不少钱。100万token的上下文窗口,一口气扔进去整个项目都没问题。
那两个月里我用它干了不少活。改公众号推送脚本的编码问题、写了一个自动备份的小工具、帮室友调试过一段JavaScript。大部分时候它够用,尤其是处理单个文件的任务,响应速度和代码质量都不差。
但6月18日,Google切断了面向个人用户的免费通道,引导大家转向Antigravity CLI。我之前积累的使用习惯和prompt模板,一夜之间失效了。
这是我第三次遇到"免费工具突然收费"的情况。第一次是某API从免费变成按量计费,第二次是一个AI写作工具砍掉了免费额度。每次都很被动。所以这次我决定,与其等下一个免费工具出现,不如认真选一个付费但稳定的。
Gemini CLI现在仍有API Key付费通道,企业用户也能继续用。但对个人开发者来说,免费时代的红利已经结束了。如果你之前在白嫖,是时候做打算了。
Codex CLI:ChatGPT Plus用户的附赠品
Codex CLI的定位比较尴尬。它是OpenAI的产品,绑在ChatGPT订阅体系里。你要用它,要么有ChatGPT Plus(每月20美元),要么用OpenAI API Key按量付费。
如果你已经是ChatGPT Plus用户,Codex CLI算是"附赠品",不额外花钱就能用。底层是o3和o4-mini模型,在算法题和数学推导上确实有优势。它还有一个特点:默认在沙箱里执行代码,不会直接动你的系统环境。对新手来说这是保护,对老手来说有时候觉得多此一举。
但问题在于,它的代码质量在多文件任务上明显落后。Terminal Bench排名里,Codex CLI排第19,Claude Code排第3。这个差距不是小数目。
我测Codex CLI的那三周,最典型的场景是:让它重构一个Express项目的路由层。它改了主文件,但忘了更新对应的测试文件。我提醒它之后,它补了测试,但测试逻辑是错的。来回三次才搞定。同样的任务Claude Code一次过。
如果你主要写算法题或者做单文件的小工具,Codex CLI够用。但凡涉及多文件项目,它目前的水平还不够稳。
Claude Code:贵但值,关键时候不掉链子
Claude Code没有免费层。最低入门是API Key按量计费,重度用户会上Max套餐(100到200美元/月)。我目前用的是按量计费,一个月下来大概花了40美元。
这个价格在三个工具里最高。但我的判断是:如果你靠写代码吃饭,或者你的项目有交付压力,这个钱值得花。
Claude Code的核心优势有三个:
第一,多文件改得准。 上面那个Express重构的例子,它一次搞定,包括测试文件。它的CLAUDE.md机制能记住你的项目规范——比如你规定用Tabs不用Spaces,规定函数命名用驼峰,它在后续所有修改里都遵守。
第二,Git工作流集成最深。 它能自动commit、创建分支、甚至帮你写PR描述。我上个月给一个开源项目提PR,从改代码到写PR描述全是Claude Code干的,我只做了最后review。
第三,遇到不确定会主动问。 这点很多人忽略,但实际用下来体验差距很大。Codex CLI有时候会自作主张改一个不该改的地方,Claude Code会停下来问你:"这个文件里有两个同名函数,你指的是哪个?"
当然它也有缺点。最大的问题是贵。如果你只是偶尔写写代码,或者预算有限,Claude Code的门槛确实高。另外它的上下文窗口是20万token(最近升级到100万但需要额外配置),不如Gemini CLI默认的100万那么宽裕。
三者对比一览
我的选型建议
如果你问我怎么选,我的建议很简单:
预算为零 → 等Gemini CLI的企业付费通道降价,或者转向Cline+本地模型这条路。白嫖的时代不会回来了,与其等,不如提前适应付费模式。
预算有限但需要稳定 → ChatGPT Plus + Codex CLI。每月20美元,虽然多文件能力弱一些,但单文件任务够用,沙箱执行也更安全。
靠代码吃饭 → Claude Code按量计费。别心疼那几十美元,它帮你省下的调试时间远超这个数。我这两个月算了一笔账:用Claude Code之前,我平均每个项目花6小时调试;用了之后降到3.5小时。省下的2.5小时按时薪算,早就回本了。
选工具这件事,我三年前就明白一个道理:没有最好的工具,只有最适合你当前阶段的工具。但"适合"不等于"凑合"——如果你明明需要更好的,却因为省钱选了差的,最后浪费的时间比省下的钱多得多。
你现在在用哪个AI编程工具?有没有踩过类似的坑?评论区聊聊。
夜雨聆风