最近半年,AI编程工具市场折腾得厉害。
GitHub Copilot 6月份改了计费规则,一群开发者跑到社区骂街;Cursor 5月发了自研模型Composer 2.5,跑分直接怼到了Claude Opus 4.7脸上;腾讯的CodeBuddy悄没声地把价格打到了个人免费,企业版还搞了个SPEC规范驱动模式。
三款工具我都用过,身边同事也分成了三派。今天就掰扯掰扯,2026年7月这个节点,到底该选谁。
// 先说Copilot:老大哥翻车了
GitHub Copilot的优势不用多讲——全球1800万开发者用户,VS Code生态原生集成,开源项目兼容性最好。如果你之前一直用它做代码补全,体验确实丝滑。
但今年6月1日是个分水岭。
这天Copilot正式从"每次请求计费"切到了"按Token用量计费"。听着好像差不多,实际天差地别。以前你让Agent跑一个重构任务,不管它磨了15分钟还是消耗了几百万Token,都只算1次请求。Pro套餐每月300次,月费10美元,重度用户等于白嫖。
现在呢?Pro套餐每月10美元,对应10美元的AI Credits。用Claude Opus 4.7跑一次中等规模的Agent任务,社区有人算过大概烧掉3到5美元。一个月跑两三次,额度就见底了。
更要命的是免费模型兜底没了。以前月底额度快用完,还能切到GPT-4.1 mini凑合。现在除了代码补全和Next Edit Suggestions这两个功能还免费,所有对话和Agent功能都得花Credits。而且Credits月底清零,不退不积累。年付套餐也停售了。

我看了下GitHub社区讨论帖,4月27日公告出来后,一个帖子几天就炸了310多条评论,"bait-and-switch"(钓鱼式营销)和"rug pull"(撤毯坑人)成了高频词。有人晒账单说官方文档写的Opus 4.7消耗倍率是3x,实际扣的是7.5x,GitHub随后悄悄改了文档,更炸了。
不过话说回来,如果你的使用场景就是Tab补全和轻量代码审查,不碰Agent任务,那10美元的Pro套餐还是能用的。代码补全功能在新模式下依然免费,这部分不受影响。
还有一点:4月20日起GitHub暂停了Pro、Pro+、Student三档的新用户注册,目前没有恢复时间表。想新注册的朋友暂时只能等。
// 再说Cursor:性价比突然就起来了
Cursor之前一直被吐槽贵——Pro版每月20美元,比Copilot贵一倍。但Copilot这一波涨价操作,硬生生把Cursor衬成了性价比之选。
5月18日,Cursor发布了第三代自研模型Composer 2.5。底座还是月之暗面的Kimi K2.5,但后训练投入拉到了上一代的25倍,85%的算力花在了自研强化学习和微调上。
跑分怎么说呢,直接上数据:
CursorBench v3.1(Cursor自家的高难度基准),Composer 2.5拿了63.2%。作为对比,Opus 4.7最高设置是64.8%,默认xhigh设置降到61.6%;GPT-5.5默认59.2%。也就是说在IDE内长任务编程这个最核心的场景,Composer 2.5默认配置下已经不输那两位大佬了。

SWE-Bench Multilingual(多语言软件工程基准),Composer 2.5是79.8%,Opus 4.7是80.5%,GPT-5.5是77.8%,差距不到一个百分点。
但价格差距就大了。Composer 2.5每百万输入Token收费0.5美元,输出2.5美元。Cursor官方发了一张effort curve图,显示在CursorBench上平均每个任务成本不到1美元就能达到约63%的水平。Opus 4.7和GPT-5.5要达到类似甚至更低的成绩,每个任务得花好几美元。
一个任务省几美元,一天跑几十个任务,一个月下来差距就很明显了。
Cursor的定价结构也简单粗暴:Hobby免费版有有限的智能体请求和Tab补全;Pro版20美元/月,智能体额度更高,能访问前沿模型;Ultra是更高端的个人版;团队版40美元/人/月。
7月1日Cursor还出了iOS应用,可以在手机上监控AI编程智能体的运行状态。我自己试了几天,出门在外盯一下Agent跑得怎么样,确实方便。不过移动端目前只能监控和轻量交互,不能直接写代码。
Cursor的短板也明显:企业级管控几乎没有,安全合规这块跟Copilot和CodeBuddy没法比。如果你的代码有保密要求,或者团队需要统一的策略管理,Cursor现阶段还差点意思。另外它在后端语言(Java、Go、Rust)上的表现不如前端和Python。
// 最后说CodeBuddy:国产选手的差异化打法
CodeBuddy是腾讯云的代码助手,之前存在感不太强,但今年动作不小。
先说价格,这个可能是三家里最友好的。个人版有四个档次:体验版免费(500积分/月),标准版99元/月(连续包月70元),高级版199元/月(连续包月140元),旗舰版999元/月(连续包月700元)。国际版Pro是9.95美元/月。企业版SaaS 198元/人/月,专有云316元/人/月。
对比一下:Copilot Pro是10美元/月(约72元),Cursor Pro是20美元/月(约145元)。CodeBuddy标准版70元连续包月,价格确实压了一头。而且体验版免费,代码补全无限次,对个人开发者来说够入门了。
功能上CodeBuddy最大的差异化是SPEC模式。这个模式走的是"Doc→Tasks→Changes→Preview"的白盒化流程:先自动生成需求文档并拆解任务,再做可视化变更对比,最后实时扫描硬编码风险。说白了就是强制AI按工程规范走,减少幻觉。
IDC的《中国市场代码生成产品评估》给了CodeBuddy 9.7分(工程规范优先),Copilot是9.5分(开源生态强),Cursor是9.4分(流畅度最佳)。喜马拉雅实测SPEC模式后,代码采纳率提升到44%,日均生成代码占比33%。

CodeBuddy还有几个企业级特性值得一提:数据不落盘、企业级安全扫描、支持私有化部署。深度集成腾讯云原生构建和TAPD项目管理,覆盖微信小程序、Android、iOS全端,还支持Figma设计稿直转代码。Craft智能体支持多文件协同开发,可自主完成20+文件的系统重构。
200+语言的支持也够用,包括Rust和Swift这种相对小众的。
CodeBuddy的短板在哪?生态和社区。Copilot背靠GitHub,1800万用户的社区和插件生态太厚了;Cursor在海外开发者圈子里的口碑和迭代速度也快。CodeBuddy目前更多是在国内企业和腾讯生态内打转,如果你主要做开源项目或者海外业务,它的生态兼容性不如前两位。另外,跑分数据方面CodeBuddy没有像Cursor那样公开参与CursorBench或SWE-Bench的测试,很难直接跟Composer 2.5对比代码生成质量。
// 三款工具怎么选
说了这么多,落到实际选择上,我的建议是分场景看。
你是个人开发者,主要写前端和Python,预算20美元以内,追求最好的AI编程体验——选Cursor。Composer 2.5的性价比目前确实是三家里最高的,跑分够用,成本最低。Pro版20美元/月,比Copilot贵一倍,但Copilot现在按Token收费后重度用户可能远不止10美元了。
你是企业团队,代码有安全合规要求,需要私有化部署,团队主要在国内——选CodeBuddy。企业版198元/人/月的价格只有Copilot企业版(39美元/人/月,约280元)的七成,数据不落盘和SPEC模式对企业级开发很实在。个人开发者也可以先用免费体验版试试水。
你已经在用Copilot,使用场景以代码补全和轻量代码审查为主,不怎么碰Agent任务——暂时可以不动。代码补全和NES在新模式下仍然免费,10美元的Pro套餐对你还有价值。但如果你重度依赖Agent工作流,建议认真考虑迁移,月底清零的Credits机制对重度用户不友好。
还有一类人:年付用户。如果你买了Copilot年付套餐,5月20日是退款申请截止日期(已过)。没赶上退款的朋友,合同期内规则已经改了,只能按新的Credits模式走。这种情况下,与其等着额度月底清零,不如趁早评估替代方案。
// 写在最后
2026年AI编程工具的竞争格局跟去年完全不一样了。Copilot从"最便宜的选择"变成了"可能最贵的选择",Cursor从"贵但好用"变成了"又便宜又好用",CodeBuddy从"国产备胎"变成了"企业级的有力竞争者"。
跑分这东西能参考但不能全信。CursorBench是Cursor自家出的基准,SWE-Bench也有自己的局限性。真正选工具的时候,还是得拿自己的项目跑一周,看实际体验和成本。别人的横评都只是参考,包括这篇。
不过有一点是确定的:AI编程工具的价格战和功能战才刚开始。Copilot这一波涨价,说不定反而是Cursor和CodeBuddy的机会。

夜雨聆风