OpenRouter 7月排行榜:小米登顶,中国模型份额突破46%
OpenRouter 是全球最大的中立模型路由平台,每天路由数十万开发者的真实付费请求。它的排行榜反映的不是「谁最聪明」,而是开发者用脚投票的真实流量——这个「用量≠质量」的反差,正是本文的核心视角。
截至 2026年7月25日,单日 Token 用量 Top 12:
| 排名 | 模型 | 厂商 | 单日Token | 近30天累计 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 腾讯 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免费) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智谱 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 阶跃星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 蚂蚁 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
前十名中,中国厂商模型占据七席。拉长到厂商总份额维度:中国厂商(DeepSeek、小米、腾讯、智谱、MiniMax、月之暗面、阿里)合计约46%,一年前这个数字还不到2%;美国三巨头(OpenAI、Anthropic、Google)合计从年中约70%滑落到30%–36%。
| 厂商 | Token份额(约) | 备注 |
|---|---|---|
| DeepSeek | 16%–18% | 单一厂商份额最稳定的第一 |
| 小米 | 8%–18% | Mimo V2.5暴涨,波动最大 |
| Anthropic | 10%–15% | 7/24发布Opus 5 |
| 腾讯 | 8%–13% | Hy3强势 |
| 8%–13% | Gemini 3 Flash |
价差是核心驱动力:DeepSeek V4 Flash 输入价约 $0.05–0.14/M,OpenAI GPT-5.5 约 $5/M——价差高达35倍。值得注意的是,「月度冠军模型」频繁易主:2月 MiniMax M2.5、4月 MiMo-V2-Pro、7月 Mimo V2.5——看排行榜不能只看瞬时快照,更要看谁能持续留在前排。
仍用MMLU跑分选型:实验室分数与生产钱包投票常呈反比,月底账单与预期完全背离。
忽视榜单波动:同一模型隔天名次都会变(Mimo V2.5 7/24到7/25顺序即有变化),必须标注数据截止日。
混淆用量与质量:廉价开源模型霸屏总量榜,不代表适合复杂推理与高风险Agent决策。
单模型宗教:硬编码单一Provider,月度冠军轮换后将迅速变成技术债。
API在线、宿主离线:笔记本合盖后Agent流水线中断,排行榜再准也救不了运行时。
用量高≠质量高:闭源旗舰仍握「难任务」定价权
OpenRouter 排的是 Token 用量,不是模型质量。便宜又快的模型挂在高流量应用背后,就能轻松刷到榜单前列——哪怕在复杂推理上表现平平。
按任务类型的消费金额占比(而非Token量)呈现完全不同的图景:
| 任务类型 | 消费金额占比 |
|---|---|
| 通用对话 | 35.7% |
| Agent工作流 | 30.4% |
| 代码 | 26.5% |
| 数据处理 | 7.5% |
但在分类/复杂推理这类难任务上,画风立刻反转——Claude Sonnet 4.6 和 Claude Opus 4.7 以各13.5%的消费份额并列第一,GPT-5.5 以11.6%排第三,总量榜上霸屏的廉价开源模型几乎「查无此模型」。
市场正在自然分层:便宜的中国开源模型吃下海量、低门槛、可容错的「跑量」任务;闭源旗舰模型把持高价值、低容错的「难任务」定价权。
7月24日 Anthropic 发布的 Claude Opus 5 是最佳例证:FrontierBench v0.1 拿下 43.3%(反超 GPT-5.6 Sol 的37.5%),价格维持 Opus 系列 $5/$25 per M(是 Fable 5 输入价的一半)——「我贵,但我值这个价」的典型打法。详见 Opus 5与Kimi K3蒸馏门解读。
| 模型 | 输入价/M | 输出价/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 性价比之王,Agentic Coding首选 |
| Nemotron 3 Ultra | $0.42(另有免费版) | $2.61 | 美系全开源,NVIDIA生态 |
| GLM 5.2 | $0.45 | $3.31 | 开源里「类Opus」规划质量 |
| Kimi K3 | ~$3 | ~$15 | 开源权重最大(1.4TB) |
| Claude Opus 5 | $5(快速档$10) | $25(快速档$50) | 闭源旗舰,7月最强基准分 |
应用层秘密:编程Agent称王,角色扮演是看不见的半壁江山
模型层排行榜反映「哪个大脑更受欢迎」,应用层排行榜(openrouter.ai/apps)反映「这些大脑真正被用来做什么」:
| 排名 | 应用 | 类型 | 份额(约) |
|---|---|---|---|
| 1 | Hermes Agent | 个人智能体/CLI Agent | ~45% |
| 2 | Kilo Code | 编程Agent | ~13% |
| 3 | OpenClaw | 通用Agent | ~9% |
| 4 | Claude Code | 编程Agent | ~6% |
| 5 | Descript | 内容生产 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | 陪伴/游戏 | ~2.1%(新进榜) |
| 8 | ISEKAI ZERO | 角色扮演 | ~2.0%(新进榜) |
| 9 | Janitor AI | 角色扮演 | ~1.8%(新进榜) |
| 10 | Cline | 编程Agent(IDE插件) | ~1.7% |
Hermes Agent(Nous Research 开源自我迭代智能体)以约45% Token份额一骑绝尘。编程类 Agent 占据榜单大半壁江山。一个有趣的家族现象:Cline → Roo Code → Kilo Code 是同一代码血统的三次分叉,如今「孙子辈」Kilo Code 流量已反超祖辈 Cline——开源编程Agent生态迭代极快,先发优势并不牢固。
同样值得关注的是几乎不出现在企业AI报道里的角色扮演/陪伴类应用——Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI 合计占据开源模型流量相当可观的一部分。OpenRouter × a16z《State of AI》报告显示,创意角色扮演场景贡献了开源模型总用量的一半以上。如果你只从企业级AI报道判断市场,你会完全看不到这半壁江山。
8月趋势预测与六步分层路由实操指南
8月五项趋势判断:
中国开源模型合计份额大概率继续爬升,年内有望突破50%,除非美国厂商在定价上做出重大让步。
「月度冠军模型」宝座还会继续易主——小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面价格战不会放缓。
Anthropic 可能在8月推出更平价型号(对标Haiku定位)抢占用量份额——Opus 5已是两个月内第四款旗舰。
Kimi K3 的1.4TB权重将在2–4周内出现社区量化压缩版本,届时才是中小团队真正能用上的时间点。
安全与合规将成为新的选型变量——OpenAI未发布模型沙盒逃逸事件持续发酵,企业采购中「厂商安全声誉」权重将明显上升。
六步分层路由实操指南:
按任务类型分层路由:闲聊/创意/角色扮演走低价开源模型(DeepSeek V4 Flash、Mimo V2.5);分类/复杂推理/高风险Agent决策走闭源旗舰(Claude Opus 5、GPT-5.5)。
接入 OpenRouter 统一网关:单一Key横跨数百模型,用 openrouter.ai/rankings 每周追踪榜单变化。参考 OpenRouter API教程。
编程类任务优先测试 DeepSeek V4 Flash 和 GLM 5.2:前者性价比最优,后者是开源里最接近 Opus 规划质量的选项;把 Claude Opus 5 留给真正卡住的复杂步骤。
设账单熔断与日封顶:按百万Token单价 × 日调用量设阈值;Agent批处理默认低价路由,复杂重构再回退旗舰。
把「模型供应商安全记录」纳入选型评分卡:自主Agent场景须更谨慎做权限收敛,优先选择安全记录较好的厂商。
三条硬核数据与不同角色的选型结论
46% / 2%:中国厂商合计Token份额约46%,一年前不到2%——过去12个月AI行业最陡峭的份额迁移曲线之一。
35× / 13.5%:DeepSeek V4 Flash 与 GPT-5.5 价差约35倍;但在复杂推理消费份额上,Claude Sonnet 4.6 与 Opus 4.7 各以13.5%并列第一。
45% / 50%+:Hermes Agent 占应用层约45%;角色扮演场景贡献开源模型总用量一半以上——企业报道看不到的隐藏市场。
7月这份榜单最值得记住的一句话:capability(能力)和 popularity(用量)正在分道扬镳。中国开源模型靠价格拿下流量半壁江山,美国闭源旗舰守着难任务定价权和安全声誉护城河。独立开发者用 OpenRouter 做技术预研沙盒完全没问题,但国内访问平均延迟约180–250ms且不支持国内发票,正式生产环境建议评估国内合规中转方案。
纯API路由无法替代Agent宿主:笔记本合盖断线、多模型Key管理混乱、本地开放权重部署又需要96GB+统一内存——三条路径各有隐性成本。对于需要 7×24稳定运行多模型Agent流水线 的生产环境,KVMNODE独占Mac Mini云端租赁通常是更优解:Apple Silicon原生工具链、按天/周/月弹性下单。详见 定价页,下单走 订购入口。
数据截至:2026年7月25日 · 来源:OpenRouter官方排行榜及公开镜像站点 · 具体数字请以发布时 openrouter.ai/rankings 实时数据为准