OpenRouter Juli: Xiaomi an der Spitze, chinesische Modelle ueber 46%
OpenRouter ist die groesste neutrale Modell-Routing-Plattform und leitet jeden Tag hunderttausend echte, bezahlte Entwickler-Anfragen. Die Rangliste zeigt nicht «wer am intelligentesten ist», sondern wo Entwickler mit ihrem Geldbeutel wirklich hin routen — die Diskrepanz zwischen Nutzung und Qualitaet ist der Kern dieser Analyse.
Stand 25. Juli 2026, taegliche Token-Nutzung Top 12:
| Rang | Modell | Anbieter | Token/Tag | 30-Tage-Summe |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (kostenlos) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot | 157,6B | 1,6T (neu) |
| 10 | Ling 3.0 Flash | InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
Unter den Top 12 belegen chinesische Anbieter sieben Plaetze. Auf Anbieter-Ebene: chinesische Firmen (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba) zusammen ca. 46% — vor einem Jahr unter 2%. Die US-Dreiergruppe (OpenAI, Anthropic, Google) faellt von etwa 70% Mitte Jahr auf 30%–36%.
| Anbieter | Token-Anteil (ca.) | Hinweis |
|---|---|---|
| DeepSeek | 16%–18% | Stabiler Einzelanbieter-Spitzenreiter |
| Xiaomi | 8%–18% | Mimo V2.5-Sprung, hoechste Volatilitaet |
| Anthropic | 10%–15% | Opus 5 am 24.07. |
| Tencent | 8%–13% | Hy3 stark |
| 8%–13% | Gemini 3 Flash |
Preis ist der Haupttreiber: DeepSeek V4 Flash Eingabe ca. $0,05–0,14/M, OpenAI GPT-5.5 ca. $5/M — Faktor 35. Der «Monats-Champion» wechselt haeufig: Februar MiniMax M2.5, April MiMo-V2-Pro, Juli Mimo V2.5. Ein Snapshot reicht nicht — wer dauerhaft oben bleibt, zaehlt.
Nur MMLU-Scores: Lab-Benchmarks und Wallet-Voting in Produktion korrelieren oft negativ — Monatsrechnung widerspricht der Erwartung.
Ranking-Schwankungen ignorieren: Plaetze wechseln tagelich (Mimo V2.5 24.07. vs. 25.07.). Stichtag immer nennen.
Nutzung mit Qualitaet verwechseln: Guenstige Open-Source-Modelle dominieren Volumen, sind aber nicht automatisch fuer komplexe Reasoning- oder High-Risk-Agent-Entscheidungen geeignet.
Single-Model-Dogma: Hardcodiertes Provider-Lock-in wird nach dem naechsten Monats-Champion schnell technische Schuld.
API online, Host offline: Laptop zuklappen beendet Agent-Pipelines — kein Ranking rettet die Laufzeit.
Hohe Nutzung bedeutet nicht hohe Qualitaet: Flaggschiffe halten Preissetzung bei schweren Tasks
OpenRouter sortiert nach Token-Volumen, nicht nach Modellqualitaet. Guenstige, schnelle Modelle hinter High-Traffic-Apps erreichen leicht Spitzenplaetze — auch wenn komplexes Reasoning mittelmassig bleibt.
Die Ausgabenanteile nach Task-Typ (nicht Token-Menge) zeigen ein voellig anderes Bild:
| Task-Typ | Ausgabenanteil |
|---|---|
| Allgemeiner Dialog | 35,7% |
| Agent-Workflows | 30,4% |
| Code | 26,5% |
| Datenverarbeitung | 7,5% |
Bei Klassifikation und komplexem Reasoning dreht sich das: Claude Sonnet 4.6 und Claude Opus 4.7 teilen mit je 13,5% den Spitzenplatz, GPT-5.5 folgt mit 11,6%. Die guenstigen Open-Source-Modelle der Volumen-Spitze sind praktisch unsichtbar.
Der Markt teilt sich natuerlich: guenstige chinesische Open-Source-Modelle fressen massenhafte, niedrigschwellige, fehlertolerante Volumen-Tasks; geschlossene Flaggschiffe behalten die Preissetzung bei wertvollen, fehlerintoleranten schweren Tasks.
Claude Opus 5 (Anthropic, 24. Juli) ist das Paradebeispiel: FrontierBench v0.1 43,3% (ueber GPT-5.6 Sol mit 37,5%), Preis weiter $5/$25 per M (Eingabe halb so teuer wie Fable 5) — «teuer, aber gerechtfertigt». Details: Opus 5 und Kimi K3-Distillation.
| Modell | Eingabe/M | Ausgabe/M | Positionierung |
|---|---|---|---|
| DeepSeek V4 Flash | ~$0,05–0,14 | ~$0,24–0,28 | Preis-Leistung, Agentic Coding |
| Nemotron 3 Ultra | $0,42 (kostenlose Variante) | $2,61 | US-Open-Source, NVIDIA-Oekosystem |
| GLM 5.2 | $0,45 | $3,31 | Opus-aehnliche Planungsqualitaet unter Open Source |
| Kimi K3 | ~$3 | ~$15 | Groesste Open Weights (1,4TB) |
| Claude Opus 5 | $5 (Fast $10) | $25 (Fast $50) | Geschlossenes Flaggschiff, Juli-Benchmark-Spitze |
App-Ebene: Coding-Agenten dominieren, Rollenspiel ist die unsichtbare Haelfte
Modell-Rankings zeigen «welches Gehirn beliebt ist»; die App-Rankings (openrouter.ai/apps) zeigen «wofuer es wirklich genutzt wird»:
| Rang | App | Typ | Anteil (ca.) |
|---|---|---|---|
| 1 | Hermes Agent | Persoenlicher Agent/CLI Agent | ~45% |
| 2 | Kilo Code | Coding-Agent | ~13% |
| 3 | OpenClaw | Allgemeiner Agent | ~9% |
| 4 | Claude Code | Coding-Agent | ~6% |
| 5 | Descript | Content-Produktion | ~4,5% |
| 6 | pi | Agent | ~3,3% |
| 7 | Lemonade | Begleitung/Gaming | ~2,1% (neu) |
| 8 | ISEKAI ZERO | Rollenspiel | ~2,0% (neu) |
| 9 | Janitor AI | Rollenspiel | ~1,8% (neu) |
| 10 | Cline | Coding-Agent (IDE-Erweiterung) | ~1,7% |
Hermes Agent (Nous Research, selbstiterierender Open Agent) fuehrt mit ca. 45% Token-Anteil. Coding-Agenten fuellen den Grossteil der Liste. Eine Familienlinie: Cline → Roo Code → Kilo Code — drei Forks derselben Codebasis; die Enkel-Generation Kilo Code ueberholt inzwischen den Vorfahren Cline. Open-Coding-Agent-Oekosysteme iterieren extrem schnell; First-Mover-Vorteil ist fragil.
Kaum in Enterprise-AI-Berichten: Rollenspiel- und Begleitungs-Apps — Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI zusammen einen betraechtlichen Teil des Open-Model-Traffics. OpenRouter × a16z «State of AI»: kreatives Rollenspiel traegt ueber die Haelfte der Open-Model-Gesamtnutzung. Wer nur Enterprise-Berichte liest, verpasst diese Haelfte.
August-Trends und sechsstufige Routing-Anleitung
Fuenf August-Trendprognosen:
Chinesische Open-Source-Modelle klettern weiter, 50% innerhalb des Jahres wahrscheinlich — sofern US-Anbieter nicht massiv am Preis nachgeben.
Der Monats-Champion wechselt weiter — Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot: Preiskampf ohne Pause.
Anthropic koennte im August ein guenstigeres Haiku-aehnliches Modell bringen — Opus 5 ist bereits das vierte Flaggschiff in zwei Monaten.
Kimi K3 1,4TB-Gewichte: Community-Quantisierung in 2–4 Wochen erwartet — dann werden kleine Teams es wirklich nutzen koennen.
Sicherheit und Compliance werden neue Auswahlfaktoren — OpenAI-Sandbox-Escape bleibt im Gespraech; «Sicherheitsbilanz des Anbieters» gewinnt in Enterprise-Einkauf an Gewicht.
Sechs Routing-Schritte:
Nach Task-Typ schichten: Smalltalk/Kreativ/Rollenspiel auf guenstige Open Source (DeepSeek V4 Flash, Mimo V2.5); Klassifikation/komplexes Reasoning/High-Risk-Agent auf Flaggschiffe (Claude Opus 5, GPT-5.5).
OpenRouter als einheitliches Gateway: Ein Key, hunderte Modelle; openrouter.ai/rankings woechentlich verfolgen. Siehe OpenRouter-API-Leitfaden.
Coding: zuerst DeepSeek V4 Flash und GLM 5.2 testen: erstes fuer Preis-Leistung, zweites fuer Opus-aehnliche Planung unter Open Source; Claude Opus 5 nur fuer wirklich blockierte Schritte.
Abrechnungs-Circuit-Breaker und Tageslimits: Schwellen aus Preis pro Million Token mal taeglichen Aufrufen; Agent-Batch standardmaessig guenstig, Flaggschiff nur bei komplexem Refactoring.
Anbieter-Sicherheitsbilanz in Scorecard: Bei autonomen Agenten Rechte enger fassen; Anbieter mit sauberer Bilanz bevorzugen. Fuer EU-Teams: DSGVO-konforme Datenverarbeitung und Auftragsverarbeitung (AVV) mit US-Anbietern pruefen, bevor Prompts mit personenbezogenen Daten routen.
7x24-Agent-Host bereitstellen: Hermes Agent, Kilo Code, OpenClaw vom Laptop auf dedizierten Cloud-Mac: launchd dauerhaft, Keychain fuer mehrere API Keys. Mietpreise und Hilfezentrum fuer die Auswahl.
Drei Kernzahlen und Auswahl nach Rolle
46% / 2%: Chinesische Anbieter zusammen ca. 46% Token-Anteil, vor einem Jahr unter 2% — eine der steilsten Verschiebungen der letzten 12 Monate.
35x / 13,5%: Preisfaktor DeepSeek V4 Flash vs. GPT-5.5 ca. 35; bei komplexem Reasoning teilen Claude Sonnet 4.6 und Opus 4.7 je 13,5% Ausgabenanteil.
45% / 50%+: Hermes Agent ca. 45% auf App-Ebene; Rollenspiel traegt ueber die Haelfte der Open-Model-Nutzung — versteckter Markt ausserhalb Enterprise-Berichte.
Die Juli-Liste in einem Satz: Capability und Popularity divergieren. Chinesische Open Source gewinnt Volumen ueber Preis; US-Flaggschiffe halten Preissetzung bei schweren Tasks und Sicherheits-Reputation. OpenRouter als Sandbox fuer Tech-Evals ist sinnvoll; fuer Produktion in der EU Latenz (ca. 180–250ms aus manchen Regionen) und Datenresidenz pruefen — DSGVO und Vertragslage vor dem Routing sensibler Inhalte.
Pure API-Routing ersetzt keinen Agent-Host: Laptop-Sleep, chaotisches Multi-Key-Management, lokale Open Weights brauchen 96GB+ Unified Memory — jeder Pfad hat versteckte Kosten. Fuer 7x24-stabile Multi-Model-Agent-Pipelines in Produktion ist KVMNODE dedizierter Mac Mini Cloud-Miete meist die bessere Basis: Apple Silicon native Toolchain, flexible Tages-/Wochen-/Monats-Tarife. Mietpreise, Bestellung ueber Bestellseite.
Datenstand: 25. Juli 2026 · Quellen: OpenRouter offizielles Ranking und oeffentliche Mirror-Sites · Live-Werte unter openrouter.ai/rankings zum Veroeffentlichungszeitpunkt pruefen