面向仍用几个月前印象选模型的开发者与技术决策者:OpenRouter 截至 2026年7月25日 的排行榜不测跑分,只看开发者真金白银把请求发到了谁家。小米 Mimo V2.51.4万亿 Token/天 登顶日用量榜,中国厂商合计约46%份额(一年前不到2%),而闭源旗舰仍守着难任务的定价权。本文覆盖模型/厂商/应用三层排行用量vs质量哑铃型市场编程Agent与角色扮演隐藏市场8月五项趋势预测六步分层路由实操指南。背景阅读 6月OpenRouter排行榜分析OpenRouter API接入教程
01

OpenRouter 7月排行榜:小米登顶,中国模型份额突破46%

OpenRouter 是全球最大的中立模型路由平台,每天路由数十万开发者的真实付费请求。它的排行榜反映的不是「谁最聪明」,而是开发者用脚投票的真实流量——这个「用量≠质量」的反差,正是本文的核心视角。

截至 2026年7月25日,单日 Token 用量 Top 12:

排名模型厂商单日Token近30天累计
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3腾讯590B23.4T
4Nemotron 3 Ultra 550B(免费)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智谱 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash阶跃星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash蚂蚁 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

前十名中,中国厂商模型占据七席。拉长到厂商总份额维度:中国厂商(DeepSeek、小米、腾讯、智谱、MiniMax、月之暗面、阿里)合计约46%,一年前这个数字还不到2%;美国三巨头(OpenAI、Anthropic、Google)合计从年中约70%滑落到30%–36%。

厂商Token份额(约)备注
DeepSeek16%–18%单一厂商份额最稳定的第一
小米8%–18%Mimo V2.5暴涨,波动最大
Anthropic10%–15%7/24发布Opus 5
腾讯8%–13%Hy3强势
Google8%–13%Gemini 3 Flash

价差是核心驱动力:DeepSeek V4 Flash 输入价约 $0.05–0.14/M,OpenAI GPT-5.5 约 $5/M——价差高达35倍。值得注意的是,「月度冠军模型」频繁易主:2月 MiniMax M2.5、4月 MiMo-V2-Pro、7月 Mimo V2.5——看排行榜不能只看瞬时快照,更要看谁能持续留在前排

01

仍用MMLU跑分选型:实验室分数与生产钱包投票常呈反比,月底账单与预期完全背离。

02

忽视榜单波动:同一模型隔天名次都会变(Mimo V2.5 7/24到7/25顺序即有变化),必须标注数据截止日。

03

混淆用量与质量:廉价开源模型霸屏总量榜,不代表适合复杂推理与高风险Agent决策。

04

单模型宗教:硬编码单一Provider,月度冠军轮换后将迅速变成技术债。

05

API在线、宿主离线:笔记本合盖后Agent流水线中断,排行榜再准也救不了运行时。

02

用量高≠质量高:闭源旗舰仍握「难任务」定价权

OpenRouter 排的是 Token 用量,不是模型质量。便宜又快的模型挂在高流量应用背后,就能轻松刷到榜单前列——哪怕在复杂推理上表现平平。

按任务类型的消费金额占比(而非Token量)呈现完全不同的图景:

任务类型消费金额占比
通用对话35.7%
Agent工作流30.4%
代码26.5%
数据处理7.5%

但在分类/复杂推理这类难任务上,画风立刻反转——Claude Sonnet 4.6 和 Claude Opus 4.7 以各13.5%的消费份额并列第一,GPT-5.5 以11.6%排第三,总量榜上霸屏的廉价开源模型几乎「查无此模型」。

市场正在自然分层:便宜的中国开源模型吃下海量、低门槛、可容错的「跑量」任务闭源旗舰模型把持高价值、低容错的「难任务」定价权

7月24日 Anthropic 发布的 Claude Opus 5 是最佳例证:FrontierBench v0.1 拿下 43.3%(反超 GPT-5.6 Sol 的37.5%),价格维持 Opus 系列 $5/$25 per M(是 Fable 5 输入价的一半)——「我贵,但我值这个价」的典型打法。详见 Opus 5与Kimi K3蒸馏门解读

模型输入价/M输出价/M定位
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28性价比之王,Agentic Coding首选
Nemotron 3 Ultra$0.42(另有免费版)$2.61美系全开源,NVIDIA生态
GLM 5.2$0.45$3.31开源里「类Opus」规划质量
Kimi K3~$3~$15开源权重最大(1.4TB)
Claude Opus 5$5(快速档$10)$25(快速档$50)闭源旗舰,7月最强基准分
03

应用层秘密:编程Agent称王,角色扮演是看不见的半壁江山

模型层排行榜反映「哪个大脑更受欢迎」,应用层排行榜(openrouter.ai/apps)反映「这些大脑真正被用来做什么」:

排名应用类型份额(约)
1Hermes Agent个人智能体/CLI Agent~45%
2Kilo Code编程Agent~13%
3OpenClaw通用Agent~9%
4Claude Code编程Agent~6%
5Descript内容生产~4.5%
6piAgent~3.3%
7Lemonade陪伴/游戏~2.1%(新进榜)
8ISEKAI ZERO角色扮演~2.0%(新进榜)
9Janitor AI角色扮演~1.8%(新进榜)
10Cline编程Agent(IDE插件)~1.7%

Hermes Agent(Nous Research 开源自我迭代智能体)以约45% Token份额一骑绝尘。编程类 Agent 占据榜单大半壁江山。一个有趣的家族现象:Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉,如今「孙子辈」Kilo Code 流量已反超祖辈 Cline——开源编程Agent生态迭代极快,先发优势并不牢固。

同样值得关注的是几乎不出现在企业AI报道里的角色扮演/陪伴类应用——Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI 合计占据开源模型流量相当可观的一部分。OpenRouter × a16z《State of AI》报告显示,创意角色扮演场景贡献了开源模型总用量的一半以上。如果你只从企业级AI报道判断市场,你会完全看不到这半壁江山。

04

8月趋势预测与六步分层路由实操指南

8月五项趋势判断:

01

中国开源模型合计份额大概率继续爬升,年内有望突破50%,除非美国厂商在定价上做出重大让步。

02

「月度冠军模型」宝座还会继续易主——小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面价格战不会放缓。

03

Anthropic 可能在8月推出更平价型号(对标Haiku定位)抢占用量份额——Opus 5已是两个月内第四款旗舰。

04

Kimi K3 的1.4TB权重将在2–4周内出现社区量化压缩版本,届时才是中小团队真正能用上的时间点。

05

安全与合规将成为新的选型变量——OpenAI未发布模型沙盒逃逸事件持续发酵,企业采购中「厂商安全声誉」权重将明显上升。

六步分层路由实操指南:

01

按任务类型分层路由:闲聊/创意/角色扮演走低价开源模型(DeepSeek V4 Flash、Mimo V2.5);分类/复杂推理/高风险Agent决策走闭源旗舰(Claude Opus 5、GPT-5.5)。

02

接入 OpenRouter 统一网关:单一Key横跨数百模型,用 openrouter.ai/rankings 每周追踪榜单变化。参考 OpenRouter API教程

03

编程类任务优先测试 DeepSeek V4 Flash 和 GLM 5.2:前者性价比最优,后者是开源里最接近 Opus 规划质量的选项;把 Claude Opus 5 留给真正卡住的复杂步骤。

04

设账单熔断与日封顶:按百万Token单价 × 日调用量设阈值;Agent批处理默认低价路由,复杂重构再回退旗舰。

05

把「模型供应商安全记录」纳入选型评分卡:自主Agent场景须更谨慎做权限收敛,优先选择安全记录较好的厂商。

06

Provision 7×24 Agent宿主:将 Hermes Agent、Kilo Code、OpenClaw 从笔记本迁到独占云Mac:launchd 常驻、Keychain 存多路API Key。对照 定价页帮助中心 选型。

05

三条硬核数据与不同角色的选型结论

A

46% / 2%:中国厂商合计Token份额约46%,一年前不到2%——过去12个月AI行业最陡峭的份额迁移曲线之一。

B

35× / 13.5%:DeepSeek V4 Flash 与 GPT-5.5 价差约35倍;但在复杂推理消费份额上,Claude Sonnet 4.6 与 Opus 4.7 各以13.5%并列第一。

C

45% / 50%+:Hermes Agent 占应用层约45%;角色扮演场景贡献开源模型总用量一半以上——企业报道看不到的隐藏市场。

7月这份榜单最值得记住的一句话:capability(能力)和 popularity(用量)正在分道扬镳。中国开源模型靠价格拿下流量半壁江山,美国闭源旗舰守着难任务定价权和安全声誉护城河。独立开发者用 OpenRouter 做技术预研沙盒完全没问题,但国内访问平均延迟约180–250ms且不支持国内发票,正式生产环境建议评估国内合规中转方案。

纯API路由无法替代Agent宿主:笔记本合盖断线、多模型Key管理混乱、本地开放权重部署又需要96GB+统一内存——三条路径各有隐性成本。对于需要 7×24稳定运行多模型Agent流水线 的生产环境,KVMNODE独占Mac Mini云端租赁通常是更优解:Apple Silicon原生工具链、按天/周/月弹性下单。详见 定价页,下单走 订购入口

数据截至:2026年7月25日 · 来源:OpenRouter官方排行榜及公开镜像站点 · 具体数字请以发布时 openrouter.ai/rankings 实时数据为准