ARTICLE · 1063976
AI Agent排行榜,除了Claude Code和Codex还有哪些平台
如果只看社交媒体上的讨论热度,写代码的 AI Agent 好像只剩两家:Claude Code 和 Codex。
把真实用量摊开,格局是另一回事。OpenRouter 最新的 App & Agent 榜单上,排在第一的是 Nous Research 的开源自进化 Agent Hermes Agent;Claude Code 落在第二;Codex 排到第七。
前 20 个席位里,11 个是编程与终端类工具,3 个是个人 / 通用型 Agent,剩下 6 个来自游戏、角色扮演、建站、视频剪辑和营销——跟"写代码"这件事毫无关系。
先把这份榜单的性质说清楚:它统计的是公开 App 和 Agent 在 OpenRouter 上消耗掉的 token 量,谁被用掉的多,谁就靠前。它不做能力测试,也不回答"哪个模型更聪明"。
一、前 20 名完整名单
- Hermes Agent
(个人 Agent / 命令行)—— Nous Research 的开源自进化 Agent。跨会话记忆、把使用经验沉淀成可复用的 Skills,自带 40 多种工具(联网搜索、浏览器自动化、视觉识别),还有定时任务和子 Agent。 - Claude Code
(命令行)—— Anthropic 官方出品。先把整个代码库读一遍,再规划并跨文件动手改,跑测试、失败了自己重试,全程用自然语言指挥。 - Kilo Code
(命令行 / IDE 插件)—— 开源。同一套 Agent 工作流,在 VS Code、JetBrains 和命令行三种环境里都能跑。 - Cline
(IDE 插件 / 命令行)—— 开源。常驻编辑器内部,自己读代码、改文件、执行终端命令,还会调用浏览器自动化。 - pi
(命令行)—— 定位很直接:编程 Agent 已经很多了,而"这一个属于你自己",强调按个人习惯深度定制工作流。 - omp
(命令行)—— 终端路线的代表之一,把模型、命令行和手上的开发工具接到一起(本期新上榜)。 - Codex
(命令行)—— OpenAI 的编程 Agent。读代码、改代码、跑测试都在它的工作范围内。 - OpenClaw
(个人 Agent / 命令行)—— 开源通用 Agent。挂到聊天软件里就能替你动手:跑命令、上网、整理文件、发邮件。 - DeepSeek Harness
(开源底座)—— DeepSeek 开源的 Agent Harness,管的是模型、上下文、工具调用与任务执行之间怎么配合(本期新上榜)。 - OpenHands
(命令行)—— 开源软件开发 Agent,能执行命令、浏览网页、调用 API。 - ISEKAI ZERO
(游戏)—— AI 角色冒险游戏,用户可以带着自己喜欢的角色一起旅行、探索。 - Hello Minds
(角色扮演 / 个人 Agent)—— 由 Ethoswarm 驱动的角色扮演与创作平台,主打虚拟角色的互动与创意写作。 - CodeGPT
(IDE 插件 / 命令行 / 云端)—— 覆盖代码问答、生成到 Agent 执行的开发工具,插件、终端、云端三种形态都有。 - HighLevel
(营销)—— 给营销团队用的 SaaS,把 CRM、获客和营销自动化装在一起。 - Framer
(建站)—— 用自然语言建站的无代码平台,设计、CMS、SEO 到发布一条线走完。 - Freebuff
(编程服务)—— 用广告补贴压低模型使用成本的编程服务。 - Cursor
(编辑器 / 命令行)—— 把编辑器本身做成 AI 原生:代码理解、生成和 Agent 执行都在同一个界面里完成。 - Descript
(音视频)—— 视频与播客编辑器。先把声音转成文字,然后像改文档一样剪片。 - Lemonade
(编程工具)—— 面向 Roblox 开发者的 AI 工具,辅助游戏内容制作。 - Janitor AI
(角色扮演)—— 自定义 AI 角色的聊天平台,主打长对话和沉浸式互动。
二、这 20 个席位,其实是三拨人
第一拨:编程与终端 Agent,11 席。
从 Claude Code、Codex 到 Kilo Code、Cline、pi、omp、OpenHands、CodeGPT、Cursor,命令行和编辑器是主战场。其中 Kilo Code、Cline、CodeGPT 三家同时提供 IDE 插件形态,属于"编辑器里直接干活"的一类;其余多以终端为主。
值得注意的是这一拨里的开源占比:Kilo Code、Cline、pi、OpenHands 都开源,加上后面的 OpenClaw 和 DeepSeek Harness,前 10 名里有 6 个是开源项目。
第二拨:个人 / 通用型 Agent 与开源底座,3 席。
Hermes Agent、OpenClaw、DeepSeek Harness。它们的共同点是不把自己限定在编辑器里:Hermes 和 OpenClaw 面向"替我处理日常任务"的通用场景,DeepSeek Harness 则更像一层底座,负责把模型、上下文和工具调用织起来。这三者的位置说明,Agent 的竞争已经不止于"谁更会写代码"。
第三拨:与编程无关的跨界选手,6 席。
游戏与角色扮演占了其中三席(ISEKAI ZERO、Hello Minds、Janitor AI)。这类产品的共同点是对话轮次多、上下文长,token 消耗天然不低——它们进榜说明"Agent"这个容器已经不专属于开发者了。
三、三个可以带走的判断
一、写代码和跑终端,仍然是 Agent 消耗 token 最多的地方。 前 10 名无一例外,全部与软件开发或终端操作相关。
二、开源与"自建工作流"拿下了前 10 的大半。 从 Hermes Agent 到 Kilo Code、Cline、pi、OpenClaw,这些项目的卖点都是"把工作流攥在自己手里"。企业在选型时,对可控性的在意程度,可能比想象中更高。
三、官方出品不等于用量第一。 Claude Code 和 Codex 确实都在榜上,但榜一是别人的,而且按 9 月 21 日的口径,Hermes Agent 的消耗量约是第二名 Claude Code 的两倍多。