OpenRouter 7 月排行榜:小米登頂,中國模型份額突破 46%
OpenRouter 是全球最大的中立模型路由平台,每天路由數十萬開發者的真實付費請求。它的排行榜反映的不是「誰最聰明」,而是開發者用腳投票的真實流量——這個「用量≠品質」的反差,正是本文的核心視角。
截至 2026 年 7 月 25 日,單日 Token 用量 Top 12:
| 排名 | 模型 | 廠商 | 單日 Token | 近 30 天累計 |
|---|---|---|---|---|
| 1 | Mimo V2.5 | 小米 | 1.4T | 31.2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 23.6T |
| 3 | Hy3 | 騰訊 | 590B | 23.4T |
| 4 | Nemotron 3 Ultra 550B(免費) | NVIDIA | 428.6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413.7B | 11.6T |
| 6 | GLM 5.2 | 智譜 Z.ai | 316.7B | 13.3T |
| 7 | MiniMax M3 | MiniMax | 262.5B | 15.1T |
| 8 | Step 3.7 Flash | 階躍星辰 | 204.8B | 5.9T |
| 9 | Kimi K3 | 月之暗面 | 157.6B | 1.6T(新上榜) |
| 10 | Ling 3.0 Flash | 螞蟻 InclusionAI | 128.3B | 417.3B |
| 11 | Gemini 3 Flash Preview | 106.3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99.5B | 3.6T |
前十名中,中國廠商模型佔據七席。拉長到廠商總份額維度:中國廠商(DeepSeek、小米、騰訊、智譜、MiniMax、月之暗面、阿里)合計約 46%,一年前這個數字還不到 2%;美國三巨頭(OpenAI、Anthropic、Google)合計從年中約 70% 滑落到 30%–36%。
| 廠商 | Token 份額(約) | 備註 |
|---|---|---|
| DeepSeek | 16%–18% | 單一廠商份額最穩定的第一 |
| 小米 | 8%–18% | Mimo V2.5 暴漲,波動最大 |
| Anthropic | 10%–15% | 7/24 發佈 Opus 5 |
| 騰訊 | 8%–13% | Hy3 強勢 |
| 8%–13% | Gemini 3 Flash |
價差是核心驅動力:DeepSeek V4 Flash 輸入價約 $0.05–0.14/M,OpenAI GPT-5.5 約 $5/M——價差高達 35 倍。值得注意的是,「月度冠軍模型」頻繁易主:2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5——看排行榜不能只看瞬時快照,更要看誰能持續留在前排。
仍用 MMLU 跑分選型:實驗室分數與生產錢包投票常呈反比,月底帳單與預期完全背離。
忽視榜單波動:同一模型隔天名次都會變(Mimo V2.5 7/24 到 7/25 順序即有變化),必須標註資料截止日。
混淆用量與品質:廉價開源模型霸屏總量榜,不代表適合複雜推理與高風險 Agent 決策。
單模型宗教:硬編碼單一 Provider,月度冠軍輪換後將迅速變成技術債。
API 在線、宿主離線:筆電合蓋後 Agent 流水線中斷,排行榜再準也救不了執行環境。
用量高≠品質高:閉源旗艦仍握「難任務」定價權
OpenRouter 排的是 Token 用量,不是模型品質。便宜又快的模型掛在高流量應用背後,就能輕鬆刷到榜單前列——哪怕在複雜推理上表現平平。
按任務類型的消費金額佔比(而非 Token 量)呈現完全不同的圖景:
| 任務類型 | 消費金額佔比 |
|---|---|
| 通用對話 | 35.7% |
| Agent 工作流 | 30.4% |
| 程式碼 | 26.5% |
| 資料處理 | 7.5% |
但在分類/複雜推理這類難任務上,畫風立刻反轉——Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 的消費份額並列第一,GPT-5.5 以 11.6% 排第三,總量榜上霸屏的廉價開源模型幾乎「查無此模型」。
市場正在自然分層:便宜的中國開源模型吃下海量、低門檻、可容錯的「跑量」任務;閉源旗艦模型把持高價值、低容錯的「難任務」定價權。
7 月 24 日 Anthropic 發佈的 Claude Opus 5 是最佳例證:FrontierBench v0.1 拿下 43.3%(反超 GPT-5.6 Sol 的 37.5%),價格維持 Opus 系列 $5/$25 per M(是 Fable 5 輸入價的一半)——「我貴,但我值這個價」的典型打法。詳見 Opus 5 與 Kimi K3 蒸餾門解讀。
| 模型 | 輸入價/M | 輸出價/M | 定位 |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0.05–0.14 | ~$0.24–0.28 | 性價比之王,Agentic Coding 首選 |
| Nemotron 3 Ultra | $0.42(另有免費版) | $2.61 | 美系全開源,NVIDIA 生態 |
| GLM 5.2 | $0.45 | $3.31 | 開源裡「類 Opus」規劃品質 |
| Kimi K3 | ~$3 | ~$15 | 開源權重最大(1.4TB) |
| Claude Opus 5 | $5(快速檔 $10) | $25(快速檔 $50) | 閉源旗艦,7 月最強基準分 |
應用層秘密:程式設計 Agent 稱王,角色扮演是看不見的半壁江山
模型層排行榜反映「哪個大腦更受歡迎」,應用層排行榜(openrouter.ai/apps)反映「這些大腦真正被用來做什麼」:
| 排名 | 應用 | 類型 | 份額(約) |
|---|---|---|---|
| 1 | Hermes Agent | 個人智慧體/CLI Agent | ~45% |
| 2 | Kilo Code | 程式設計 Agent | ~13% |
| 3 | OpenClaw | 通用 Agent | ~9% |
| 4 | Claude Code | 程式設計 Agent | ~6% |
| 5 | Descript | 內容生產 | ~4.5% |
| 6 | pi | Agent | ~3.3% |
| 7 | Lemonade | 陪伴/遊戲 | ~2.1%(新進榜) |
| 8 | ISEKAI ZERO | 角色扮演 | ~2.0%(新進榜) |
| 9 | Janitor AI | 角色扮演 | ~1.8%(新進榜) |
| 10 | Cline | 程式設計 Agent(IDE 外掛) | ~1.7% |
Hermes Agent(Nous Research 開源自我迭代智慧體)以約 45% Token 份額一騎絕塵。程式設計類 Agent 佔據榜單大半壁江山。一個有趣的家族現象:Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,如今「孫子輩」Kilo Code 流量已反超祖輩 Cline——開源程式設計 Agent 生態迭代極快,先發優勢並不牢固。
同樣值得關注的是幾乎不出現在企業 AI 報導裡的角色扮演/陪伴類應用——Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI 合計佔據開源模型流量相當可觀的一部分。OpenRouter × a16z《State of AI》報告顯示,創意角色扮演場景貢獻了開源模型總用量的一半以上。如果你只從企業級 AI 報導判斷市場,你會完全看不到這半壁江山。
8 月趨勢預測與六步分層路由實操指南
8 月五項趨勢判斷:
中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商在定價上做出重大讓步。
「月度冠軍模型」寶座還會繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰不會放緩。
Anthropic 可能在 8 月推出更平價型號(對標 Haiku 定位)搶占用量份額——Opus 5 已是兩個月內第四款旗艦。
Kimi K3 的 1.4TB 權重將在 2–4 週內出現社群量化壓縮版本,屆時才是中小團隊真正能用上的時間點。
安全與合規將成為新的選型變數——OpenAI 未發佈模型沙盒逃逸事件持續發酵,企業採購中「廠商安全聲譽」權重將明顯上升。
六步分層路由實操指南:
按任務類型分層路由:閒聊/創意/角色扮演走低價開源模型(DeepSeek V4 Flash、Mimo V2.5);分類/複雜推理/高風險 Agent 決策走閉源旗艦(Claude Opus 5、GPT-5.5)。
接入 OpenRouter 統一閘道:單一 Key 橫跨數百模型,用 openrouter.ai/rankings 每週追蹤榜單變化。參考 OpenRouter API 教學。
程式設計類任務優先測試 DeepSeek V4 Flash 和 GLM 5.2:前者性價比最優,後者是開源裡最接近 Opus 規劃品質的選項;把 Claude Opus 5 留給真正卡住的複雜步驟。
設帳單熔斷與日封頂:按百萬 Token 單價 × 日呼叫量設閾值;Agent 批次處理預設低價路由,複雜重構再回退旗艦。
把「模型供應商安全紀錄」納入選型評分卡:自主 Agent 場景須更謹慎做權限收斂,優先選擇安全紀錄較好的廠商。
三條硬核資料與不同角色的選型結論
46% / 2%:中國廠商合計 Token 份額約 46%,一年前不到 2%——過去 12 個月 AI 產業最陡峭的份額遷移曲線之一。
35× / 13.5%:DeepSeek V4 Flash 與 GPT-5.5 價差約 35 倍;但在複雜推理消費份額上,Claude Sonnet 4.6 與 Opus 4.7 各以 13.5% 並列第一。
45% / 50%+:Hermes Agent 佔應用層約 45%;角色扮演場景貢獻開源模型總用量一半以上——企業報導看不到的隱藏市場。
7 月這份榜單最值得記住的一句話:capability(能力)和 popularity(用量)正在分道揚鑣。中國開源模型靠價格拿下流量半壁江山,美國閉源旗艦守著難任務定價權和安全聲譽護城河。獨立開發者用 OpenRouter 做技術預研沙盒完全沒問題,但跨境存取平均延遲約 180–250ms 且頻寬與發票合規需自行評估,正式生產環境建議評估合規中轉方案。
純 API 路由無法替代 Agent 宿主:筆電合蓋斷線、多模型 Key 管理混亂、本地開放權重部署又需要 96GB+ 統一記憶體——三條路徑各有隱性成本。對於需要 7×24 穩定運行多模型 Agent 流水線 的生產環境,KVMNODE 獨佔 Mac Mini 雲端租用通常是更優解:Apple Silicon 原生工具鏈、按天/週/月彈性下單。詳見 定價頁,下單走 訂購入口。
資料截至:2026 年 7 月 25 日 · 來源:OpenRouter 官方排行榜及公開鏡像站點 · 具體數字請以發佈時 openrouter.ai/rankings 即時資料為準