乐于分享
好东西不私藏

3个AI终端工具我用了2个月,最终只留1个

3个AI终端工具我用了2个月,最终只留1个

3个AI终端工具我用了2个月,最终只留1个

Gemini CLI免费1000次/天的日子,在6月18日戛然而止。我之前白嫖了整整两个月,突然被断供,只能重新选型。Claude Code、Gemini CLI、Codex CLI,三个终端AI Agent我各用了至少20天,最终只留了一个。这篇是我这两个月选型过程的真实记录,不藏私。

先说结论:我留了Claude Code

不卖关子。三个工具测完,我最终选了Claude Code。

不是因为便宜——它恰恰是最贵的。也不是因为它功能最多——论免费额度,Gemini CLI曾经碾压另外两个。我选它,是因为在我最需要的场景下,它是最靠谱的。

上个月我帮表弟改一个毕设的Python爬虫项目,代码不算复杂,但涉及登录态管理和反爬逻辑。用Claude Code跑了一遍,它自己读代码、定位问题、改了三个文件,最后还帮我跑了一遍测试。整个过程我就在旁边看着,没动手。换成Gemini CLI,同样的任务它改对了主逻辑,但漏了一个配置文件的联动修改。Codex CLI更差,它给我的补丁压根跑不起来。

这就是差距。92%的首过正确率(Claude Code)和85%左右(Gemini CLI)听起来只差7个百分点,但在真实项目里,这7个百分点意味着你要不要手动收尾。

Gemini CLI:免费的时候确实香,但断了就是断了

我必须承认,Gemini CLI免费的时候是真香。用个人Google账号登录,每天1000次请求,用的是Gemini 2.5 Pro——这个模型单买API要花不少钱。100万token的上下文窗口,一口气扔进去整个项目都没问题。

那两个月里我用它干了不少活。改公众号推送脚本的编码问题、写了一个自动备份的小工具、帮室友调试过一段JavaScript。大部分时候它够用,尤其是处理单个文件的任务,响应速度和代码质量都不差。

但6月18日,Google切断了面向个人用户的免费通道,引导大家转向Antigravity CLI。我之前积累的使用习惯和prompt模板,一夜之间失效了。

这是我第三次遇到"免费工具突然收费"的情况。第一次是某API从免费变成按量计费,第二次是一个AI写作工具砍掉了免费额度。每次都很被动。所以这次我决定,与其等下一个免费工具出现,不如认真选一个付费但稳定的。

Gemini CLI现在仍有API Key付费通道,企业用户也能继续用。但对个人开发者来说,免费时代的红利已经结束了。如果你之前在白嫖,是时候做打算了。

Codex CLI:ChatGPT Plus用户的附赠品

Codex CLI的定位比较尴尬。它是OpenAI的产品,绑在ChatGPT订阅体系里。你要用它,要么有ChatGPT Plus(每月20美元),要么用OpenAI API Key按量付费。

如果你已经是ChatGPT Plus用户,Codex CLI算是"附赠品",不额外花钱就能用。底层是o3和o4-mini模型,在算法题和数学推导上确实有优势。它还有一个特点:默认在沙箱里执行代码,不会直接动你的系统环境。对新手来说这是保护,对老手来说有时候觉得多此一举。

但问题在于,它的代码质量在多文件任务上明显落后。Terminal Bench排名里,Codex CLI排第19,Claude Code排第3。这个差距不是小数目。

我测Codex CLI的那三周,最典型的场景是:让它重构一个Express项目的路由层。它改了主文件,但忘了更新对应的测试文件。我提醒它之后,它补了测试,但测试逻辑是错的。来回三次才搞定。同样的任务Claude Code一次过。

如果你主要写算法题或者做单文件的小工具,Codex CLI够用。但凡涉及多文件项目,它目前的水平还不够稳。

Claude Code:贵但值,关键时候不掉链子

Claude Code没有免费层。最低入门是API Key按量计费,重度用户会上Max套餐(100到200美元/月)。我目前用的是按量计费,一个月下来大概花了40美元。

这个价格在三个工具里最高。但我的判断是:如果你靠写代码吃饭,或者你的项目有交付压力,这个钱值得花。

Claude Code的核心优势有三个:

第一,多文件改得准。 上面那个Express重构的例子,它一次搞定,包括测试文件。它的CLAUDE.md机制能记住你的项目规范——比如你规定用Tabs不用Spaces,规定函数命名用驼峰,它在后续所有修改里都遵守。

第二,Git工作流集成最深。 它能自动commit、创建分支、甚至帮你写PR描述。我上个月给一个开源项目提PR,从改代码到写PR描述全是Claude Code干的,我只做了最后review。

第三,遇到不确定会主动问。 这点很多人忽略,但实际用下来体验差距很大。Codex CLI有时候会自作主张改一个不该改的地方,Claude Code会停下来问你:"这个文件里有两个同名函数,你指的是哪个?"

当然它也有缺点。最大的问题是贵。如果你只是偶尔写写代码,或者预算有限,Claude Code的门槛确实高。另外它的上下文窗口是20万token(最近升级到100万但需要额外配置),不如Gemini CLI默认的100万那么宽裕。

三者对比一览

维度
Gemini CLI
Claude Code
Codex CLI
免费额度
已取消(6月18日)
需ChatGPT Plus
最低月费
API按量
API按量(约$40/月)
$20(ChatGPT Plus)
核心模型
Gemini 2.5 Pro
Claude Opus
o3 / o4-mini
上下文窗口
100万token
20万-100万token
12.8万-100万token
多文件任务
中等
最强
较弱
Git集成
基础
最完善
基础
沙箱执行
适合人群
预算敏感型
专业开发者
ChatGPT订阅用户

我的选型建议

如果你问我怎么选,我的建议很简单:

预算为零 → 等Gemini CLI的企业付费通道降价,或者转向Cline+本地模型这条路。白嫖的时代不会回来了,与其等,不如提前适应付费模式。

预算有限但需要稳定 → ChatGPT Plus + Codex CLI。每月20美元,虽然多文件能力弱一些,但单文件任务够用,沙箱执行也更安全。

靠代码吃饭 → Claude Code按量计费。别心疼那几十美元,它帮你省下的调试时间远超这个数。我这两个月算了一笔账:用Claude Code之前,我平均每个项目花6小时调试;用了之后降到3.5小时。省下的2.5小时按时薪算,早就回本了。

选工具这件事,我三年前就明白一个道理:没有最好的工具,只有最适合你当前阶段的工具。但"适合"不等于"凑合"——如果你明明需要更好的,却因为省钱选了差的,最后浪费的时间比省下的钱多得多。

你现在在用哪个AI编程工具?有没有踩过类似的坑?评论区聊聊。