先别急着排座次:Agent不是模型
如果把大模型比作“大脑”,Agent就是带着手脚、工具箱和工作规章的执行者:它不仅回答问题,还能读写文件、运行命令、调用浏览器、提交代码,甚至把任务拆给多个子Agent。因此,同一个模型装进不同Agent,体验可能完全不同。
这16款产品并不在同一赛道:有终端、AI编辑器、云端工程师,也有办公助手。别只问“谁最强”,先问交付物、上云边界、权限和预算。
第一组:终端与开源编程Agent
1. Claude Code|Anthropic,2025年2月预览。擅长长任务、改代码及MCP扩展;短板是依赖Claude,高权限也有误改风险。Pro月付20美元起或按API计费,适合终端型专业开发者。
2. Codex|OpenAI。新一代CLI于2025年4月开源、云端Agent于5月公开,现覆盖桌面、IDE和网页;它不是2021年的同名模型。沙箱、Skills和并行任务完整,但额度规则较复杂。有免费层,Go每月8美元、Plus每月20美元起,也可按API付费,适合长期综合任务。
3. OpenCode|Anomaly团队,仓库可追溯至2025年4月。开源、多模型、可自带API Key,迁移自由;但密钥、模型和权限要自己管。软件免费、调用另付费,适合重视开放性的开发者。
4. Pi Agent Harness / Pi Coding Agent|Earendil Works,仓库可追溯至2025年8月。它轻量、易扩展,适合自定义Agent;但默认没有完整权限隔离,宜配沙箱。软件免费,API与算力自理,面向高级用户。
5. Kimi Code|月之暗面,CLI记录可追溯至2025年10月。中文友好,能改文件、跑Shell、联网和调度子Agent;效果受模型与额度影响。CLI开源,会员、Code套餐或API可能收费,适合中文开发与教学。
6. Qwen Code|通义千问团队,2025年6月公开仓库。开源终端Agent,中文和国产模型生态适配好;复杂工程效果仍取决于模型与配置。软件免费、API可能收费,适合学生和企业二次开发。
7. Gemini CLI|Google,2025年6月公开。开源,连接Gemini、搜索和Google生态,个人用户有免费额度;不足是配额、地区政策会变。超额或企业使用另计费,适合Google Cloud用户和低成本尝鲜。
第二组:AI IDE、云端工程与代码托管Agent
8. TRAE / TraeWork|字节跳动旗下TRAE团队。TRAE于2025年初以AI IDE亮相,TraeWork在2026年扩到文档和网页。中文、Windows友好,但功能与套餐变化快。有免费体验及付费额度,适合中文用户。
9. GitHub Copilot coding agent|GitHub/Microsoft,2025年5月公开。可从Issue接任务,在云端改代码、测试并发PR;审阅链顺,但依赖GitHub且消耗高级请求。免费层可试,Pro每月10美元起,适合团队。
10. Cursor Agent|Anysphere。Cursor于2023年公开,Agent在2024至2025年成熟。编辑器、代码索引和多文件修改连贯;云端模型与自动执行需留意隐私和额度。免费层可试,Pro每月20美元,适合高频编码者。
11. Windsurf Cascade|Windsurf(原Codeium团队),2024年11月公开。它能在编辑器内规划、修改、运行并继续行动,交互流畅;不足是套餐调整较频繁。提供免费层和付费订阅,适合前端、全栈及偏可视化的开发者。
12. Devin|Cognition,2024年3月公开。它在云环境中规划、编码、测试和交付,适合边界清楚的长任务;缺点是成本、等待和稳定性。按量或团队收费,入门消费通常从20美元起,适合能做代码评审的团队。
第三组:桌面办公、自托管Agent与开发框架
13. Tencent WorkBuddy|腾讯云CodeBuddy团队,2026年公开。它用多Agent处理文档、表格、PPT和调研;中文办公强,但桌面权限大。现以免费体验、额度或企业方案为主,适合行政、科研和内容工作者。
14. QoderWork|Qoder团队,2026年官方文档可追溯。它覆盖文件、数据、浏览器和桌面;法律主体为Bright Zenith,仍以QoderWork命名,不宜直接等同“千问办公”。与Qoder共享Credits,适合Office自动化。
15. DeepSeek Harness|DeepSeek,2026年8月13日公开仓库。它是插件化Agent开发框架,不是开箱办公助手;开源可扩展,但仍处developer preview。软件免费,模型与部署另计,适合开发者。
16. Hermes Agent|Nous Research,仓库可追溯至2025年7月。它开源、自托管,强调持久记忆与工具扩展;但部署、安全和记忆治理要自理。软件免费,API或GPU另计,适合自建长期助手。

真正有用的比较,不只是跑分
选Agent重点看八项:代码还是办公;本地还是云端;能否换模型;是否支持Skills、MCP和子Agent;有没有沙箱;中文与Windows适配;订阅还是按量;失败后能否看日志并回滚。
怎么选:终端开发看Claude Code、Codex;开源可控看OpenCode、Pi、Qwen Code、Gemini CLI;编辑器看Cursor、Windsurf、TRAE;GitHub协作看Copilot;云端长任务看Devin;办公交付看WorkBuddy、QoderWork、TraeWork;自建看DeepSeek Harness、Hermes Agent。
Agent越能干,权限越大。别开放硬盘、密钥或敏感资料;先用副本、小目录、低权限测试。好Agent不是宣传页上最聪明的,而是过程可看、成本可控、出错能叫停。
夜雨聆风