OpenRouter июль: Xiaomi на пике, китайские модели — 46%
OpenRouter — крупнейшая нейтральная routing-платформа: каждый день через неё проходят сотни тысяч реальных платных запросов разработчиков. Рейтинг не отвечает на «кто умнее», а показывает где реально стоят деньги разработчиков. Разрыв между usage и quality — центральная тема.
На 25 июля 2026, дневной Token usage Top 12:
| Ранг | Модель | Вендор | Token/день | 30 дней |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (free) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot | 157,6B | 1,6T (новый) |
| 10 | Ling 3.0 Flash | InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
В Top 12 — 7 моделей китайских вендоров. На уровне вендоров: китайские компании (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba) — ~46% Token share, год назад <2%. Тройка US (OpenAI, Anthropic, Google) упала с ~70% в середине года до 30%–36%.
| Вендор | Token share (≈) | Заметка |
|---|---|---|
| DeepSeek | 16%–18% | Стабильный №1 среди одиночных вендоров |
| Xiaomi | 8%–18% | Взрыв Mimo V2.5, макс. волатильность |
| Anthropic | 10%–15% | Opus 5 24.07 |
| Tencent | 8%–13% | Hy3 на подъёме |
| 8%–13% | Gemini 3 Flash |
Драйвер — цена: DeepSeek V4 Flash input ~$0,05–0,14/M, OpenAI GPT-5.5 ~$5/M — разрыв до 35×. «Чемпион месяца» меняется часто: февраль MiniMax M2.5, апрель MiMo-V2-Pro, июль Mimo V2.5. Снимок на один день не считается — смотрите, кто держится в топе.
Выбор по MMLU: лабораторные скоры и wallet-voting в проде часто в антикорреляции — счёт на конец месяца бьёт в другую сторону.
Игнор волатильности: позиции скачут день ото дня (Mimo V2.5 24.07 vs 25.07). Всегда ставьте cutoff date.
Смешение usage и quality: дешёвый open source на вершине volume-чарта ≠ годится для complex reasoning и high-risk agent decisions.
Single-model cult: hardcode одного provider после ротации чемпиона месяца = мгновенный tech debt.
API online, host offline: закрыл ноут — agent pipeline умер, точный рейтинг runtime не спасёт.
Высокий usage ≠ высокое quality: закрытые flagship держат прайсинг на hard tasks
OpenRouter ранжирует Token volume, не model quality. Дешёвая и быстрая модель за high-traffic приложением легко залезает в топ — даже если на complex reasoning она посредственна.
Доли расходов по типу задачи (не Token count) рисуют другую картину:
| Тип задачи | Доля расходов |
|---|---|
| Общий диалог | 35,7% |
| Agent workflows | 30,4% |
| Код | 26,5% |
| Обработка данных | 7,5% |
На classification и complex reasoning расклад переворачивается: Claude Sonnet 4.6 и Claude Opus 4.7 делят первое место с 13,5% spend share каждый, GPT-5.5 — 11,6%. Дешёвый open source с volume-вершины почти не виден.
Рынок сам расслаивается: дешёвый китайский open source жрёт массовые, низкопороговые, fault-tolerant volume-задачи; закрытые flagship удерживают pricing power на high-value, low-tolerance hard tasks.
Claude Opus 5 (Anthropic, 24 июля) — textbook case: FrontierBench v0.1 43,3% (выше GPT-5.6 Sol 37,5%), цена $5/$25 per M (input вдвое дешевле Fable 5) — «дорого, но оправдано». Детали: Opus 5 и дистилляция Kimi K3.
| Модель | Input/M | Output/M | Позиция |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05–0,14 | ~$0,24–0,28 | Price/perf king, agentic coding |
| Nemotron 3 Ultra | $0,42 (free tier) | $2,61 | US full open, NVIDIA stack |
| GLM 5.2 | $0,45 | $3,31 | Opus-grade planning в open weights |
| Kimi K3 | ~$3 | ~$15 | Крупнейшие open weights (1,4TB) |
| Claude Opus 5 | $5 (fast $10) | $25 (fast $50) | Закрытый flagship, топ бенч июля |
App layer: coding-агенты правят, roleplay — невидимая половина
Model rankings = «какой мозг популярен»; app rankings (openrouter.ai/apps) = «на что его реально гоняют»:
| Ранг | Приложение | Тип | Share (≈) |
|---|---|---|---|
| 1 | Hermes Agent | Personal/CLI agent | ~45% |
| 2 | Kilo Code | Coding agent | ~13% |
| 3 | OpenClaw | General agent | ~9% |
| 4 | Claude Code | Coding agent | ~6% |
| 5 | Descript | Content production | ~4,5% |
| 6 | pi | Agent | ~3,3% |
| 7 | Lemonade | Companion/gaming | ~2,1% (новый) |
| 8 | ISEKAI ZERO | Roleplay | ~2,0% (новый) |
| 9 | Janitor AI | Roleplay | ~1,8% (новый) |
| 10 | Cline | Coding agent (IDE) | ~1,7% |
Hermes Agent (self-iterating open agent от Nous Research) — ~45% Token share, один на поле. Coding-агенты забили большую часть чарта. Гenealogия: Cline → Roo Code → Kilo Code — три fork одной codebase; «внук» Kilo Code уже обгоняет «деда» Cline. Open coding-agent ecosystem крутится быстро — first-mover advantage не бетон.
Почти не в enterprise-новостях: roleplay и companion apps — Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI вместе тащат ощутимую долю open-model трафика. OpenRouter × a16z «State of AI»: creative roleplay — больше половины total usage open models. Читать только enterprise AI coverage — и половину рынка не видеть.
Тренды августа и шестишаговый routing playbook
Пять прогнозов на август:
Китайский open source продолжит рост, 50% внутри года вероятно — если US-вендоры не сдают по цене.
Трон «чемпиона месяца» снова сменится — Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot: price war без паузы.
Anthropic может выкатить бюджетный Haiku-tier в августе — Opus 5 уже четвёртый flagship за два месяца.
1,4TB weights Kimi K3 — community quant через 2–4 недели — малые команды реально подхватят позже.
Security и compliance — новые selection variables — sandbox escape неопубликованной OpenAI-модели не уходит из новостей; «security track record вендора» весит больше в enterprise procurement.
Шесть шагов layered routing:
Layer по task type: smalltalk/creative/roleplay → cheap open (DeepSeek V4 Flash, Mimo V2.5); classification/complex reasoning/high-risk agent → closed flagship (Claude Opus 5, GPT-5.5).
OpenRouter unified gateway: один key, сотни моделей; трекать openrouter.ai/rankings weekly. См. API guide.
Coding: сначала DeepSeek V4 Flash и GLM 5.2: первый — price/perf, второй — Opus-grade planning в open; Claude Opus 5 только на реально застрявших шагах.
Billing circuit breaker и daily caps: threshold = $/M × daily calls; agent batch default cheap route, flagship fallback на complex refactor.
Vendor security scorecard: для autonomous agents — tighter permission scope, приоритет вендоров с чистым track record.
Provision 7×24 agent host: Hermes Agent, Kilo Code, OpenClaw с ноута на dedicated cloud Mac: launchd always-on, Keychain для multi-key. Цены и центр помощи для выбора конфига.
Три hard numbers и выбор по роли
46% / 2%: китайские вендоры ~46% Token share, год назад <2% — одна из крутых migration curves за 12 месяцев.
35× / 13,5%: price gap DeepSeek V4 Flash vs GPT-5.5 ~35×; на complex reasoning spend share — Claude Sonnet 4.6 и Opus 4.7 делят 13,5% каждый.
45% / 50%+: Hermes Agent ~45% на app layer; roleplay — больше половины open-model usage — hidden market вне enterprise coverage.
One-liner июля: capability и popularity расходятся. Китайский open source берёт половину трафика ценой; US closed flagship держит pricing на hard tasks и security reputation moat. OpenRouter как tech sandbox для indie devs — ок; средняя latency ~180–250ms, domestic invoice нет — в проде оцените compliant relay.
Pure API routing не заменяет agent host: sleep ноута, multi-key chaos, local open weights требуют 96GB+ unified memory — каждый путь со скрытым cost. Для 7×24 stable multi-model agent pipelines в проде KVMNODE dedicated Mac Mini cloud rental обычно optimal: native Apple Silicon toolchain, flexible day/week/month billing. Цены, заказ — оформить заказ.
Данные на: 25 июля 2026 · Источники: официальный рейтинг OpenRouter и публичные mirror-сайты · Актуальные числа — openrouter.ai/rankings в момент публикации