面向仍用幾個月前印象選模型的開發者與技術決策者:OpenRouter 截至 2026 年 7 月 25 日 的排行榜不測跑分,只看開發者真金白銀把請求發到了誰家。小米 Mimo V2.51.4 兆 Token/天 登頂日用量榜,中國廠商合計約 46% 份額(一年前不到 2%),而閉源旗艦仍守著難任務的定價權。本文涵蓋模型/廠商/應用三層排行用量 vs 品質啞鈴型市場程式設計 Agent 與角色扮演隱藏市場8 月五項趨勢預測六步分層路由實操指南。背景閱讀 6 月 OpenRouter 排行榜分析OpenRouter API 接入教學
01

OpenRouter 7 月排行榜:小米登頂,中國模型份額突破 46%

OpenRouter 是全球最大的中立模型路由平台,每天路由數十萬開發者的真實付費請求。它的排行榜反映的不是「誰最聰明」,而是開發者用腳投票的真實流量——這個「用量≠品質」的反差,正是本文的核心視角。

截至 2026 年 7 月 25 日,單日 Token 用量 Top 12:

排名模型廠商單日 Token近 30 天累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3騰訊590B23.4T
4Nemotron 3 Ultra 550B(免費)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智譜 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash階躍星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新上榜)
10Ling 3.0 Flash螞蟻 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

前十名中,中國廠商模型佔據七席。拉長到廠商總份額維度:中國廠商(DeepSeek、小米、騰訊、智譜、MiniMax、月之暗面、阿里)合計約 46%,一年前這個數字還不到 2%;美國三巨頭(OpenAI、Anthropic、Google)合計從年中約 70% 滑落到 30%–36%。

廠商Token 份額(約)備註
DeepSeek16%–18%單一廠商份額最穩定的第一
小米8%–18%Mimo V2.5 暴漲,波動最大
Anthropic10%–15%7/24 發佈 Opus 5
騰訊8%–13%Hy3 強勢
Google8%–13%Gemini 3 Flash

價差是核心驅動力:DeepSeek V4 Flash 輸入價約 $0.05–0.14/M,OpenAI GPT-5.5 約 $5/M——價差高達 35 倍。值得注意的是,「月度冠軍模型」頻繁易主:2 月 MiniMax M2.5、4 月 MiMo-V2-Pro、7 月 Mimo V2.5——看排行榜不能只看瞬時快照,更要看誰能持續留在前排

01

仍用 MMLU 跑分選型:實驗室分數與生產錢包投票常呈反比,月底帳單與預期完全背離。

02

忽視榜單波動:同一模型隔天名次都會變(Mimo V2.5 7/24 到 7/25 順序即有變化),必須標註資料截止日。

03

混淆用量與品質:廉價開源模型霸屏總量榜,不代表適合複雜推理與高風險 Agent 決策。

04

單模型宗教:硬編碼單一 Provider,月度冠軍輪換後將迅速變成技術債。

05

API 在線、宿主離線:筆電合蓋後 Agent 流水線中斷,排行榜再準也救不了執行環境。

02

用量高≠品質高:閉源旗艦仍握「難任務」定價權

OpenRouter 排的是 Token 用量,不是模型品質。便宜又快的模型掛在高流量應用背後,就能輕鬆刷到榜單前列——哪怕在複雜推理上表現平平。

按任務類型的消費金額佔比(而非 Token 量)呈現完全不同的圖景:

任務類型消費金額佔比
通用對話35.7%
Agent 工作流30.4%
程式碼26.5%
資料處理7.5%

但在分類/複雜推理這類難任務上,畫風立刻反轉——Claude Sonnet 4.6 和 Claude Opus 4.7 以各 13.5% 的消費份額並列第一,GPT-5.5 以 11.6% 排第三,總量榜上霸屏的廉價開源模型幾乎「查無此模型」。

市場正在自然分層:便宜的中國開源模型吃下海量、低門檻、可容錯的「跑量」任務閉源旗艦模型把持高價值、低容錯的「難任務」定價權

7 月 24 日 Anthropic 發佈的 Claude Opus 5 是最佳例證:FrontierBench v0.1 拿下 43.3%(反超 GPT-5.6 Sol 的 37.5%),價格維持 Opus 系列 $5/$25 per M(是 Fable 5 輸入價的一半)——「我貴,但我值這個價」的典型打法。詳見 Opus 5 與 Kimi K3 蒸餾門解讀

模型輸入價/M輸出價/M定位
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28性價比之王,Agentic Coding 首選
Nemotron 3 Ultra$0.42(另有免費版)$2.61美系全開源,NVIDIA 生態
GLM 5.2$0.45$3.31開源裡「類 Opus」規劃品質
Kimi K3~$3~$15開源權重最大(1.4TB)
Claude Opus 5$5(快速檔 $10)$25(快速檔 $50)閉源旗艦,7 月最強基準分
03

應用層秘密:程式設計 Agent 稱王,角色扮演是看不見的半壁江山

模型層排行榜反映「哪個大腦更受歡迎」,應用層排行榜(openrouter.ai/apps)反映「這些大腦真正被用來做什麼」:

排名應用類型份額(約)
1Hermes Agent個人智慧體/CLI Agent~45%
2Kilo Code程式設計 Agent~13%
3OpenClaw通用 Agent~9%
4Claude Code程式設計 Agent~6%
5Descript內容生產~4.5%
6piAgent~3.3%
7Lemonade陪伴/遊戲~2.1%(新進榜)
8ISEKAI ZERO角色扮演~2.0%(新進榜)
9Janitor AI角色扮演~1.8%(新進榜)
10Cline程式設計 Agent(IDE 外掛)~1.7%

Hermes Agent(Nous Research 開源自我迭代智慧體)以約 45% Token 份額一騎絕塵。程式設計類 Agent 佔據榜單大半壁江山。一個有趣的家族現象:Cline → Roo Code → Kilo Code 是同一代碼血統的三次分叉,如今「孫子輩」Kilo Code 流量已反超祖輩 Cline——開源程式設計 Agent 生態迭代極快,先發優勢並不牢固。

同樣值得關注的是幾乎不出現在企業 AI 報導裡的角色扮演/陪伴類應用——Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI 合計佔據開源模型流量相當可觀的一部分。OpenRouter × a16z《State of AI》報告顯示,創意角色扮演場景貢獻了開源模型總用量的一半以上。如果你只從企業級 AI 報導判斷市場,你會完全看不到這半壁江山。

04

8 月趨勢預測與六步分層路由實操指南

8 月五項趨勢判斷:

01

中國開源模型合計份額大概率繼續爬升,年內有望突破 50%,除非美國廠商在定價上做出重大讓步。

02

「月度冠軍模型」寶座還會繼續易主——小米、DeepSeek、騰訊、智譜、MiniMax、月之暗面價格戰不會放緩。

03

Anthropic 可能在 8 月推出更平價型號(對標 Haiku 定位)搶占用量份額——Opus 5 已是兩個月內第四款旗艦。

04

Kimi K3 的 1.4TB 權重將在 2–4 週內出現社群量化壓縮版本,屆時才是中小團隊真正能用上的時間點。

05

安全與合規將成為新的選型變數——OpenAI 未發佈模型沙盒逃逸事件持續發酵,企業採購中「廠商安全聲譽」權重將明顯上升。

六步分層路由實操指南:

01

按任務類型分層路由:閒聊/創意/角色扮演走低價開源模型(DeepSeek V4 Flash、Mimo V2.5);分類/複雜推理/高風險 Agent 決策走閉源旗艦(Claude Opus 5、GPT-5.5)。

02

接入 OpenRouter 統一閘道:單一 Key 橫跨數百模型,用 openrouter.ai/rankings 每週追蹤榜單變化。參考 OpenRouter API 教學

03

程式設計類任務優先測試 DeepSeek V4 Flash 和 GLM 5.2:前者性價比最優,後者是開源裡最接近 Opus 規劃品質的選項;把 Claude Opus 5 留給真正卡住的複雜步驟。

04

設帳單熔斷與日封頂:按百萬 Token 單價 × 日呼叫量設閾值;Agent 批次處理預設低價路由,複雜重構再回退旗艦。

05

把「模型供應商安全紀錄」納入選型評分卡:自主 Agent 場景須更謹慎做權限收斂,優先選擇安全紀錄較好的廠商。

06

佈建 7×24 Agent 宿主:將 Hermes Agent、Kilo Code、OpenClaw 從筆電遷到獨佔雲端 Mac:launchd 常駐、Keychain 存多路 API Key。對照 定價頁幫助中心 選型。

05

三條硬核資料與不同角色的選型結論

A

46% / 2%:中國廠商合計 Token 份額約 46%,一年前不到 2%——過去 12 個月 AI 產業最陡峭的份額遷移曲線之一。

B

35× / 13.5%:DeepSeek V4 Flash 與 GPT-5.5 價差約 35 倍;但在複雜推理消費份額上,Claude Sonnet 4.6 與 Opus 4.7 各以 13.5% 並列第一。

C

45% / 50%+:Hermes Agent 佔應用層約 45%;角色扮演場景貢獻開源模型總用量一半以上——企業報導看不到的隱藏市場。

7 月這份榜單最值得記住的一句話:capability(能力)和 popularity(用量)正在分道揚鑣。中國開源模型靠價格拿下流量半壁江山,美國閉源旗艦守著難任務定價權和安全聲譽護城河。獨立開發者用 OpenRouter 做技術預研沙盒完全沒問題,但跨境存取平均延遲約 180–250ms 且頻寬與發票合規需自行評估,正式生產環境建議評估合規中轉方案。

純 API 路由無法替代 Agent 宿主:筆電合蓋斷線、多模型 Key 管理混亂、本地開放權重部署又需要 96GB+ 統一記憶體——三條路徑各有隱性成本。對於需要 7×24 穩定運行多模型 Agent 流水線 的生產環境,KVMNODE 獨佔 Mac Mini 雲端租用通常是更優解:Apple Silicon 原生工具鏈、按天/週/月彈性下單。詳見 定價頁,下單走 訂購入口

資料截至:2026 年 7 月 25 日 · 來源:OpenRouter 官方排行榜及公開鏡像站點 · 具體數字請以發佈時 openrouter.ai/rankings 即時資料為準