AI编程Agent真实战斗力榜单出炉
现在 AI 编程工具的竞争已经不只是 Claude Code 和 Codex 两家的事了。
OpenRouter 最新 App & Agent 榜单里,除了 Hermes Agent、Claude Code、Kilo Code、Cline、Codex、OpenClaw,DeepSeek Harness 也已经冲进头部位置。
大家卷的已经不只是哪个模型最强,而是哪个 Agent 真正在干活。
最近看了一下 OpenRouter 的 App & Agent Rankings,它不是 SWE-bench、WebDev Arena 这种能力测试,而是根据公开 App 和 Agent 在 OpenRouter 上产生的 Token 使用量来观察真实使用情况。

Hermes Agent、Claude Code、Kilo Code、Cline、pi、Codex、OpenClaw、DeepSeek Harness……基本都是 Agent。
而且绝大部分和编程、终端、IDE、自动执行任务高度相关。
AI 应用 Tokens 消耗榜
按 tokens 消耗量排序。
TOP 1 - 10 :

-
Hermes Agent:Nous Research 开源自进化 Agent,支持跨会话记忆、Skills 与 40+ 工具调用
-
Claude Code:Anthropic 官方编程 Agent,可理解整个代码库并完成修改、测试与命令执行
-
Kilo Code:开源 AI 编程 Agent,覆盖 VS Code、JetBrains 与 CLI 开发环境
-
Cline:IDE 内的开源编程 Agent,可自主修改文件、运行命令和调用开发工具
-
Freebuff:广告补贴模式的 AI 编程服务,以降低开发者使用模型的成本
-
pi:高度可定制的个人编程 Agent,强调构建属于自己的开发工作流
-
omp:面向终端开发流程的 CLI Agent,将模型、命令行和开发工具连接起来
-
DeepSeek Harness:DeepSeek 开源 Agent Harness,负责模型、上下文、工具调用与任务执行协同
-
OpenClaw:通用个人 AI Agent,可接入聊天应用、浏览器和终端执行真实任务
-
Codex:OpenAI 软件工程 Agent,可理解代码库、修改代码、运行测试并完成开发任务
TOP 11 – 20:

-
Framer:AI 无代码建站平台,可通过自然语言辅助设计和生成网站
-
ZCode:智谱推出的一体化编程 Agent,覆盖规划、编码、评审和部署流程
-
HighLevel:面向营销团队的 SaaS 平台,整合 CRM、获客和营销自动化能力
-
Nous Research API:Nous Research 模型 API 平台,为开发者提供旗下模型调用服务
-
ISEKAI ZERO:AI 角色冒险游戏平台,可与虚拟角色一起旅行、互动和探索世界
-
Hello Minds:Ethoswarm 驱动的 AI 角色扮演与创作平台,主打虚拟角色互动
-
Portkey AI:AI Gateway 与控制平台,提供模型路由、监控、治理和可观测性能力
-
Descript:AI 音视频编辑平台,支持视频、播客、转录和文本式剪辑
-
Lemonade:面向 Roblox 创作者的 AI 工具,辅助游戏内容和开发流程
-
Cursor:AI 原生代码编辑器,将代码理解、生成和 Agent 能力直接集成到 IDE
TOP 21 – 30:

-
Janitor AI:AI 角色扮演聊天平台,主打自定义角色和沉浸式长对话
-
OpenHands:开源软件开发 Agent,可运行命令、修改代码、浏览网页和调用 API
-
Open WebUI:开源自托管 LLM 交互界面,可连接 Ollama 和多种模型 API
-
Zed Editor:主打高性能与多人协作的 AI 代码编辑器,强调原生开发体验
-
Strix:面向开发者的 AI 编程工具,辅助代码生成、分析和工程任务处理
-
HackerAI:面向网络安全场景的 AI Agent,用于辅助漏洞发现和渗透测试
-
Command Code:AI 编程工具,面向代码生成、项目修改和软件开发自动化
-
LangChain:主流 LLM 应用开发框架,用于构建 Agent、RAG 和工具调用系统
-
Sahasra:面向创作者的一站式数字产品商店,支持内容销售和商业化
-
Craft:AI RPG 创作与游玩平台,可生成角色、世界观和互动游戏内容
TOP 31-40:

-
Zoo Code:GitHub 开源 AI 编程 Agent,面向代码理解、生成和自动化开发
-
Mira:Telegram 原生 AI 助手,可直接在聊天环境中调用 AI 完成任务
-
Ito:Agentic QA 自动化测试平台,可真正运行和操作应用并自动发现问题
-
GDevelop:低代码游戏开发引擎,加入 AI 能力辅助游戏设计和制作
-
SillyTavern:面向高级用户的开源 LLM 前端,主打角色扮演和多角色对话
-
claude-mem:Claude Code 记忆插件,可自动保存上下文并延续跨会话项目记忆
-
Cheaper Inference:低成本模型推理 API 服务,面向开发者提供模型调用能力
-
websim:AI 网页生成与模拟平台,可用自然语言快速创建可交互网站和应用
-
Peezy Gateway:面向 Agent 的网关服务,用于连接模型、工具和后端能力
-
OceanAPI:面向开发者的 API 服务平台,为应用提供模型或数据接口能力
TOP 41-50:

-
CodeGPT:AI 编程开发工具,提供代码问答、生成、辅助开发和 Agent 能力
-
Proto Agent:通用型 AI Agent,可组合模型与工具完成多步骤复杂任务
-
Roo Code:VS Code 开源多模式编程 Agent,支持编码、调试和自动化开发
-
ale-evol:面向前沿模型应用与演化研究的实验项目,探索新型 AI 工作流
-
Studs.gg:AI Roblox 游戏生成平台,帮助用户快速创建和迭代游戏内容
-
Halluna:AI 角色扮演聊天平台,主打自定义角色和沉浸式虚拟互动
-
pre.dev-agent:面向软件开发的 AI Agent,可参与代码分析、生成和工程任务执行
-
Sophia's LoreBary:AI 角色扮演创作整理工具,用于管理角色、世界观和 Lore 内容
-
goose:开源通用 AI Agent,可调用工具和模型完成开发及自动化任务
-
HammerAI:免费 AI 角色聊天平台,支持创建不同虚拟角色进行互动
TOP 51-60:

-
Qwen Code:阿里 Qwen 推出的命令行 AI 编程工具,面向终端开发和代码任务
-
MavenBio:面向生命科学的数据与 AI 平台,辅助专业生物数据处理和分析
-
HeyDitto:AI 助手与效率工具,面向信息处理和日常任务自动化
-
mimocode:小米 MiMo 推出的 AI 编程工具,面向代码生成和软件开发场景
-
extra.email:AI 原生邮箱工具,围绕邮件整理、处理和个人生活工作流设计
-
Shapes Sandbox Gateway:社交 Agent 平台的沙箱网关,用于连接和测试 AI 角色与服务
-
ChainPatrol:Web3 安全平台,用于监测恶意链接、钓鱼网站和诈骗风险
-
Pocket AI:轻量 AI 助手与效率工具,覆盖问答、内容处理和日常 AI 使用场景
-
LOVE:Natura Umana 实验室旗下 AI 实验项目,探索新型人与 AI 交互方式
-
Chub AI:AI 角色扮演聊天平台,支持角色卡、世界观和长篇沉浸式对话
本文排名统计的是 Agent 在 OpenRouter 上 token 调用量排名,并不代表大模型本身的能力排名,也不等同于大模型 API 或模型调用量排名。
如果想看哪个大模型真正被用户使用得最多,还需要参考模型调用量、API 使用量等数据,如果想看哪个模型能力最强,则应该参考 Arena、Artificial Analysis 等专业模型评测榜单:

参考数据:
https://arena.ai/leaderboard/text/expert
https://artificialanalysis.ai/leaderboards/models
更多推荐


所有评论(0)