Для разработчиков и техлидов, которые ещё выбирают модель по картинке из прошлого квартала: рейтинг OpenRouter на 25 июля 2026 — не бенчмарки, а агрегат реальных оплаченных запросов. Xiaomi Mimo V2.51,4 трлн Token/день, китайские вендоры ~46% (год назад <2%), закрытые flagship держат прайсинг на сложных задачах. Внутри: трёхуровневые ранкинги (модели, вендоры, приложения), рынок usage ≠ quality, coding-агенты и скрытый roleplay-сегмент, пять трендов на август и шестишаговый routing playbook. Контекст: анализ OpenRouter за июнь, гайд по API OpenRouter.
01

OpenRouter июль: Xiaomi на пике, китайские модели — 46%

OpenRouter — крупнейшая нейтральная routing-платформа: каждый день через неё проходят сотни тысяч реальных платных запросов разработчиков. Рейтинг не отвечает на «кто умнее», а показывает где реально стоят деньги разработчиков. Разрыв между usage и quality — центральная тема.

На 25 июля 2026, дневной Token usage Top 12:

РангМодельВендорToken/день30 дней
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (free)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (новый)
10Ling 3.0 FlashInclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

В Top 12 — 7 моделей китайских вендоров. На уровне вендоров: китайские компании (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba) — ~46% Token share, год назад <2%. Тройка US (OpenAI, Anthropic, Google) упала с ~70% в середине года до 30%–36%.

ВендорToken share (≈)Заметка
DeepSeek16%–18%Стабильный №1 среди одиночных вендоров
Xiaomi8%–18%Взрыв Mimo V2.5, макс. волатильность
Anthropic10%–15%Opus 5 24.07
Tencent8%–13%Hy3 на подъёме
Google8%–13%Gemini 3 Flash

Драйвер — цена: DeepSeek V4 Flash input ~$0,05–0,14/M, OpenAI GPT-5.5 ~$5/Mразрыв до 35×. «Чемпион месяца» меняется часто: февраль MiniMax M2.5, апрель MiMo-V2-Pro, июль Mimo V2.5. Снимок на один день не считается — смотрите, кто держится в топе.

01

Выбор по MMLU: лабораторные скоры и wallet-voting в проде часто в антикорреляции — счёт на конец месяца бьёт в другую сторону.

02

Игнор волатильности: позиции скачут день ото дня (Mimo V2.5 24.07 vs 25.07). Всегда ставьте cutoff date.

03

Смешение usage и quality: дешёвый open source на вершине volume-чарта ≠ годится для complex reasoning и high-risk agent decisions.

04

Single-model cult: hardcode одного provider после ротации чемпиона месяца = мгновенный tech debt.

05

API online, host offline: закрыл ноут — agent pipeline умер, точный рейтинг runtime не спасёт.

02

Высокий usage ≠ высокое quality: закрытые flagship держат прайсинг на hard tasks

OpenRouter ранжирует Token volume, не model quality. Дешёвая и быстрая модель за high-traffic приложением легко залезает в топ — даже если на complex reasoning она посредственна.

Доли расходов по типу задачи (не Token count) рисуют другую картину:

Тип задачиДоля расходов
Общий диалог35,7%
Agent workflows30,4%
Код26,5%
Обработка данных7,5%

На classification и complex reasoning расклад переворачивается: Claude Sonnet 4.6 и Claude Opus 4.7 делят первое место с 13,5% spend share каждый, GPT-5.5 — 11,6%. Дешёвый open source с volume-вершины почти не виден.

Рынок сам расслаивается: дешёвый китайский open source жрёт массовые, низкопороговые, fault-tolerant volume-задачи; закрытые flagship удерживают pricing power на high-value, low-tolerance hard tasks.

Claude Opus 5 (Anthropic, 24 июля) — textbook case: FrontierBench v0.1 43,3% (выше GPT-5.6 Sol 37,5%), цена $5/$25 per M (input вдвое дешевле Fable 5) — «дорого, но оправдано». Детали: Opus 5 и дистилляция Kimi K3.

МодельInput/MOutput/MПозиция
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,28Price/perf king, agentic coding
Nemotron 3 Ultra$0,42 (free tier)$2,61US full open, NVIDIA stack
GLM 5.2$0,45$3,31Opus-grade planning в open weights
Kimi K3~$3~$15Крупнейшие open weights (1,4TB)
Claude Opus 5$5 (fast $10)$25 (fast $50)Закрытый flagship, топ бенч июля
03

App layer: coding-агенты правят, roleplay — невидимая половина

Model rankings = «какой мозг популярен»; app rankings (openrouter.ai/apps) = «на что его реально гоняют»:

РангПриложениеТипShare (≈)
1Hermes AgentPersonal/CLI agent~45%
2Kilo CodeCoding agent~13%
3OpenClawGeneral agent~9%
4Claude CodeCoding agent~6%
5DescriptContent production~4,5%
6piAgent~3,3%
7LemonadeCompanion/gaming~2,1% (новый)
8ISEKAI ZERORoleplay~2,0% (новый)
9Janitor AIRoleplay~1,8% (новый)
10ClineCoding agent (IDE)~1,7%

Hermes Agent (self-iterating open agent от Nous Research) — ~45% Token share, один на поле. Coding-агенты забили большую часть чарта. Гenealogия: Cline → Roo Code → Kilo Code — три fork одной codebase; «внук» Kilo Code уже обгоняет «деда» Cline. Open coding-agent ecosystem крутится быстро — first-mover advantage не бетон.

Почти не в enterprise-новостях: roleplay и companion apps — Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI вместе тащат ощутимую долю open-model трафика. OpenRouter × a16z «State of AI»: creative roleplay — больше половины total usage open models. Читать только enterprise AI coverage — и половину рынка не видеть.

04

Тренды августа и шестишаговый routing playbook

Пять прогнозов на август:

01

Китайский open source продолжит рост, 50% внутри года вероятно — если US-вендоры не сдают по цене.

02

Трон «чемпиона месяца» снова сменится — Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot: price war без паузы.

03

Anthropic может выкатить бюджетный Haiku-tier в августе — Opus 5 уже четвёртый flagship за два месяца.

04

1,4TB weights Kimi K3 — community quant через 2–4 недели — малые команды реально подхватят позже.

05

Security и compliance — новые selection variables — sandbox escape неопубликованной OpenAI-модели не уходит из новостей; «security track record вендора» весит больше в enterprise procurement.

Шесть шагов layered routing:

01

Layer по task type: smalltalk/creative/roleplay → cheap open (DeepSeek V4 Flash, Mimo V2.5); classification/complex reasoning/high-risk agent → closed flagship (Claude Opus 5, GPT-5.5).

02

OpenRouter unified gateway: один key, сотни моделей; трекать openrouter.ai/rankings weekly. См. API guide.

03

Coding: сначала DeepSeek V4 Flash и GLM 5.2: первый — price/perf, второй — Opus-grade planning в open; Claude Opus 5 только на реально застрявших шагах.

04

Billing circuit breaker и daily caps: threshold = $/M × daily calls; agent batch default cheap route, flagship fallback на complex refactor.

05

Vendor security scorecard: для autonomous agents — tighter permission scope, приоритет вендоров с чистым track record.

06

Provision 7×24 agent host: Hermes Agent, Kilo Code, OpenClaw с ноута на dedicated cloud Mac: launchd always-on, Keychain для multi-key. Цены и центр помощи для выбора конфига.

05

Три hard numbers и выбор по роли

A

46% / 2%: китайские вендоры ~46% Token share, год назад <2% — одна из крутых migration curves за 12 месяцев.

B

35× / 13,5%: price gap DeepSeek V4 Flash vs GPT-5.5 ~35×; на complex reasoning spend share — Claude Sonnet 4.6 и Opus 4.7 делят 13,5% каждый.

C

45% / 50%+: Hermes Agent ~45% на app layer; roleplay — больше половины open-model usage — hidden market вне enterprise coverage.

One-liner июля: capability и popularity расходятся. Китайский open source берёт половину трафика ценой; US closed flagship держит pricing на hard tasks и security reputation moat. OpenRouter как tech sandbox для indie devs — ок; средняя latency ~180–250ms, domestic invoice нет — в проде оцените compliant relay.

Pure API routing не заменяет agent host: sleep ноута, multi-key chaos, local open weights требуют 96GB+ unified memory — каждый путь со скрытым cost. Для 7×24 stable multi-model agent pipelines в проде KVMNODE dedicated Mac Mini cloud rental обычно optimal: native Apple Silicon toolchain, flexible day/week/month billing. Цены, заказ — оформить заказ.

Данные на: 25 июля 2026 · Источники: официальный рейтинг OpenRouter и публичные mirror-сайты · Актуальные числа — openrouter.ai/rankings в момент публикации