数ヶ月前の印象でモデルを選び続けている開発者・技術意思決定者へ:OpenRouter2026年7月25日 時点ランキングはベンチマークではなく、開発者が実際に課金して送ったリクエストの集計です。小米 Mimo V2.51.4兆 Token/日 で日次首位、中国ベンダー合計約46%(1年前は2%未満)に達し、閉源旗艦は難タスクの価格設定権を維持しています。本文ではモデル・ベンダー・アプリの三層ランキング用量と品質の二層市場编程Agentと角色扮演の隠れた市場8月五つのトレンド予測六段階の層別ルーティング実践ガイドを解説します。背景資料は 6月OpenRouterランキング分析OpenRouter API接続ガイド を参照してください。
01

OpenRouter 7月ランキング:小米が首位、中国モデルシェア46%突破

OpenRouter は世界最大級の中立モデルルーティング基盤で、毎日数十万の開発者の実課金リクエストを中継しています。ランキングが示すのは「最も賢いモデル」ではなく、開発者がウォレットで選んだ実トラフィックです。用量と品質が一致しない点が、本稿の出発点です。

2026年7月25日 時点の日次 Token 用量 Top 12:

順位モデルベンダー日次Token直近30日累計
1Mimo V2.5小米1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3腾讯590B23.4T
4Nemotron 3 Ultra 550B(無料)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智谱 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash阶跃星辰204.8B5.9T
9Kimi K3月之暗面157.6B1.6T(新規)
10Ling 3.0 Flash蚂蚁 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

Top 12 のうち中国ベンダー製モデルが7席を占めます。ベンダー別 Token シェアでは、中国ベンダー(DeepSeek、小米、腾讯、智谱、MiniMax、月之暗面、阿里)の合計が約46%。1年前は2%未満でした。米国三強(OpenAI、Anthropic、Google)の合計は年中の約70%から30%–36%へと急落しています。

ベンダーTokenシェア(概算)備考
DeepSeek16%–18%単独ベンダーとして最も安定した首位
小米8%–18%Mimo V2.5急伸、変動幅最大
Anthropic10%–15%7/24にOpus 5リリース
腾讯8%–13%Hy3が強勢
Google8%–13%Gemini 3 Flash

価格差が主因です:DeepSeek V4 Flash の入力単価は約 $0.05–0.14/M、OpenAI GPT-5.5 は約 $5/M最大35倍の差。「月間チャンピオンモデル」は頻繁に交代し、2月 MiniMax M2.5、4月 MiMo-V2-Pro、7月 Mimo V2.5 と続いています。瞬間のスナップショットだけでなく、前列に留まれるモデルを見る必要があります

01

MMLUスコアだけで選定:ラボ点数と本番ウォレット投票はしばしば逆相関し、月末請求が想定と真逆になります。

02

ランキング変動を無視:同一モデルでも日々順位が変わります(Mimo V2.5 は7/24から7/25で順位変動)。必ずデータ基準日を明記してください。

03

用量と品質の混同:安価なオープンソースが総量榜を占めても、複雑推論や高リスクAgent判断には向かない場合があります。

04

単一モデル固執:単一Providerをハードコードすると、月間首位の交代後すぐ技術的負債になります。

05

APIはオンライン、ホストはオフライン:ノートPCを閉じるとAgentパイプラインが止まり、ランキングが正確でもランタイムは救えません。

02

用量が高い=品質が高いではない:閉源旗艦は難タスクの価格権を握る

OpenRouter が並べるのは Token 用量であり、モデル品質ではありません。安く速いモデルが高流量アプリの背後にあれば、複雑推論で平凡でも榜单前列に入りやすいです。

タスク種別ごとの消費金額比率(Token量ではなく)を見ると、全く異なる絵が浮かび上がります:

タスク種別消費金額比率
汎用対話35.7%
Agentワークフロー30.4%
コード26.5%
データ処理7.5%

しかし分類・複雑推論といった難タスクでは様相が一変します。Claude Sonnet 4.6 と Claude Opus 4.7 が各13.5%の消費シェアで並列首位、GPT-5.5 が11.6%で第三位。総量榜を席巙する安価オープンソースはほぼ姿を消します。

市場は自然に二層化しています:安価な中国オープンソースが大量・低ハードル・許容可能な「走量」タスクを吸収し、閉源旗艦が高価値・低許容の「難タスク」価格設定権を維持しています。

7月24日に Anthropic がリリースした Claude Opus 5 が好例です。FrontierBench v0.1 で 43.3%(GPT-5.6 Sol の37.5%を上回る)、価格は Opus 系列の $5/$25 per M(Fable 5 入力価格の半分)—「高いが、その価値がある」という典型です。詳しくは Opus 5とKimi K3蒸留論争の解説 をご覧ください。

モデル入力/M出力/Mポジション
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28コスパ最強、Agentic Coding向け
Nemotron 3 Ultra$0.42(無料版あり)$2.61米系フルオープン、NVIDIAエコシステム
GLM 5.2$0.45$3.31オープン内でOpus級の計画品質
Kimi K3~$3~$15最大級オープンウェイト(1.4TB)
Claude Opus 5$5(高速$10)$25(高速$50)閉源旗艦、7月最強ベンチ
03

アプリ層の秘密:编程Agentが王者、角色扮演は見えない半分

モデル層ランキングは「どの頭脳が人気か」を示し、アプリ層ランキング(openrouter.ai/apps)は「その頭脳が実際に何に使われているか」を示します:

順位アプリ種別シェア(概算)
1Hermes Agent個人Agent/CLI Agent~45%
2Kilo Code编程Agent~13%
3OpenClaw汎用Agent~9%
4Claude Code编程Agent~6%
5Descriptコンテンツ制作~4.5%
6piAgent~3.3%
7Lemonade陪伴/ゲーム~2.1%(新規)
8ISEKAI ZERO角色扮演~2.0%(新規)
9Janitor AI角色扮演~1.8%(新規)
10Cline编程Agent(IDE拡張)~1.7%

Hermes Agent(Nous Research の自己反復型オープンAgent)が約45%の Token シェアで独走しています。编程系 Agent が榜单の大半を占めます。興味深い系譜:Cline → Roo Code → Kilo Code は同一コード血統の三度の分岐で、孫世代の Kilo Code の流量が祖先 Cline を上回っています — オープン编程Agentエコシステムの迭代は極めて速く、先行者優位は固くありません。

企業AI報道にほとんど出ない角色扮演・陪伴系アプリも注目です — Janitor AI、ISEKAI ZERO、SillyTavern、HammerAI の合計がオープンモデル流量の相当部分を占めます。OpenRouter × a16z《State of AI》レポートによれば、創意角色扮演シーンがオープンモデル総用量の半分以上を占めるとされています。企業向けAI報道だけで市場を判断すると、この半分は見えません。

04

8月トレンド予測と六段階層別ルーティング実践ガイド

8月の五つのトレンド判断:

01

中国オープンソースモデルの合計シェアは引き続き上昇し、年内50%突破の可能性が高い — 米国ベンダーが価格で大幅譲歩しない限り。

02

「月間チャンピオンモデル」の座は引き続き交代する — 小米、DeepSeek、腾讯、智谱、MiniMax、月之暗面の価格戦は緩まない。

03

Anthropic は8月にHaiku級の廉価モデルを投入する可能性 — Opus 5は2ヶ月で第四の旗艦。

04

Kimi K3 の1.4TBウェイトは2–4週でコミュニティ量化版が出る見込み — 中小チームが実用できる時点はその後。

05

セキュリティとコンプライアンスが新たな選定変数になる — OpenAI未公開モデルのサンドボックス脱出事件が続き、企業調達で「ベンダーの安全実績」の比重が上がる。

六段階層別ルーティング実践ガイド:

01

タスク種別で層別ルーティング:雑談・創作・角色扮演は廉価オープン(DeepSeek V4 Flash、Mimo V2.5);分類・複雑推論・高リスクAgent判断は閉源旗艦(Claude Opus 5、GPT-5.5)。

02

OpenRouter統一ゲートウェイを接続:単一Keyで数百モデルにアクセスし、openrouter.ai/rankings で週次追跡。参考 OpenRouter APIガイド

03

编程タスクは DeepSeek V4 Flash と GLM 5.2 を優先検証:前者はコスパ最優、後者はオープン内でOpus級計画品質;Claude Opus 5 は本当に詰まった複雑ステップに限定。

04

請求サーキットブレーカーと日次上限を設定:百万Token単価×日次呼び出し量で閾値設定;Agentバッチはデフォルト廉価ルート、複雑リファクタ時のみ旗艦へフォールバック。

05

「モデルベンダーの安全実績」を選定スコアカードに組み込む:自律Agentでは権限をより厳格に絞り、安全実績が良いベンダーを優先。

06

7×24 Agentホストをプロビジョン:Hermes Agent、Kilo Code、OpenClaw をノートから専用クラウドMacへ:launchd 常駐、Keychain で複数API Key管理。料金ページヘルプセンター で構成を選定。

05

三つの核心データと役割別の選定結論

A

46% / 2%:中国ベンダー合計Tokenシェア約46%、1年前は2%未満 — 過去12ヶ月で最も急峻なシェア移行の一つ。

B

35倍 / 13.5%:DeepSeek V4 Flash と GPT-5.5 の価格差約35倍;複雑推論の消費シェアでは Claude Sonnet 4.6 と Opus 4.7 が各13.5%で並列首位。

C

45% / 50%+:Hermes Agent がアプリ層約45%;角色扮演シーンがオープンモデル総用量の半分以上 — 企業報道では見えない隠れ市場。

7月の榜单で覚えるべき一言:capability(能力)と popularity(用量)は乖離し始めている。中国オープンソースは価格で流量の半分を獲得し、米国閉源旗艦は難タスクの価格設定権と安全評判の堀を守っています。独立開発者が OpenRouter で技術検証サンドボックスとして使うのは問題ありませんが、国内アクセスの平均遅延は約180–250msで国内インボイスも非対応 — 本番環境では国内準拠の中継案を検討してください。

純APIルーティングはAgentホストを代替できません:ノート閉蓋で断線、多モデルKey管理の混乱、ローカルオープンウェイト展開には96GB+統合メモリが必要 — 各経路に隠れコストがあります。7×24で多モデルAgentパイプラインを安定稼働させる本番環境では、KVMNODE専用Mac Miniクラウドレンタルが通常は最適解です:Apple Siliconネイティブツールチェーン、日/週/月の柔軟注文。詳細は 料金ページ、注文は 注文入口 から。

データ基準日:2026年7月25日 · 出典:OpenRouter公式ランキングおよび公開ミラーサイト · 具体数値は公開時点の openrouter.ai/rankings リアルタイムデータをご確認ください