Fuer Entwickler und technische Entscheider, die noch mit Modellbildern von Monaten zurueck auswaehlen: Das OpenRouter-Ranking am 25. Juli 2026 misst keine Benchmarks, sondern wo Entwickler tatsaechlich bezahlen. Xiaomi Mimo V2.5 fuehrt mit 1,4 Trillion Token/Tag, chinesische Anbieter zusammen ca. 46% (vor einem Jahr unter 2%), waehrend geschlossene Flaggschiffe die Preissetzung bei schweren Tasks halten. Dieser Artikel deckt Modell-, Anbieter- und App-Rankings, die Nutzung-vs.-Qualitaet-Zweiteilung, Coding-Agenten und das versteckte Rollenspiel-Marktsegment, fuenf August-Trends und eine sechsstufige Routing-Anleitung ab. Hintergrund: OpenRouter-Ranking Juni 2026, OpenRouter-API-Leitfaden.
01

OpenRouter Juli: Xiaomi an der Spitze, chinesische Modelle ueber 46%

OpenRouter ist die groesste neutrale Modell-Routing-Plattform und leitet jeden Tag hunderttausend echte, bezahlte Entwickler-Anfragen. Die Rangliste zeigt nicht «wer am intelligentesten ist», sondern wo Entwickler mit ihrem Geldbeutel wirklich hin routen — die Diskrepanz zwischen Nutzung und Qualitaet ist der Kern dieser Analyse.

Stand 25. Juli 2026, taegliche Token-Nutzung Top 12:

RangModellAnbieterToken/Tag30-Tage-Summe
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (kostenlos)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (neu)
10Ling 3.0 FlashInclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Unter den Top 12 belegen chinesische Anbieter sieben Plaetze. Auf Anbieter-Ebene: chinesische Firmen (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba) zusammen ca. 46% — vor einem Jahr unter 2%. Die US-Dreiergruppe (OpenAI, Anthropic, Google) faellt von etwa 70% Mitte Jahr auf 30%–36%.

AnbieterToken-Anteil (ca.)Hinweis
DeepSeek16%–18%Stabiler Einzelanbieter-Spitzenreiter
Xiaomi8%–18%Mimo V2.5-Sprung, hoechste Volatilitaet
Anthropic10%–15%Opus 5 am 24.07.
Tencent8%–13%Hy3 stark
Google8%–13%Gemini 3 Flash

Preis ist der Haupttreiber: DeepSeek V4 Flash Eingabe ca. $0,05–0,14/M, OpenAI GPT-5.5 ca. $5/MFaktor 35. Der «Monats-Champion» wechselt haeufig: Februar MiniMax M2.5, April MiMo-V2-Pro, Juli Mimo V2.5. Ein Snapshot reicht nicht — wer dauerhaft oben bleibt, zaehlt.

01

Nur MMLU-Scores: Lab-Benchmarks und Wallet-Voting in Produktion korrelieren oft negativ — Monatsrechnung widerspricht der Erwartung.

02

Ranking-Schwankungen ignorieren: Plaetze wechseln tagelich (Mimo V2.5 24.07. vs. 25.07.). Stichtag immer nennen.

03

Nutzung mit Qualitaet verwechseln: Guenstige Open-Source-Modelle dominieren Volumen, sind aber nicht automatisch fuer komplexe Reasoning- oder High-Risk-Agent-Entscheidungen geeignet.

04

Single-Model-Dogma: Hardcodiertes Provider-Lock-in wird nach dem naechsten Monats-Champion schnell technische Schuld.

05

API online, Host offline: Laptop zuklappen beendet Agent-Pipelines — kein Ranking rettet die Laufzeit.

02

Hohe Nutzung bedeutet nicht hohe Qualitaet: Flaggschiffe halten Preissetzung bei schweren Tasks

OpenRouter sortiert nach Token-Volumen, nicht nach Modellqualitaet. Guenstige, schnelle Modelle hinter High-Traffic-Apps erreichen leicht Spitzenplaetze — auch wenn komplexes Reasoning mittelmassig bleibt.

Die Ausgabenanteile nach Task-Typ (nicht Token-Menge) zeigen ein voellig anderes Bild:

Task-TypAusgabenanteil
Allgemeiner Dialog35,7%
Agent-Workflows30,4%
Code26,5%
Datenverarbeitung7,5%

Bei Klassifikation und komplexem Reasoning dreht sich das: Claude Sonnet 4.6 und Claude Opus 4.7 teilen mit je 13,5% den Spitzenplatz, GPT-5.5 folgt mit 11,6%. Die guenstigen Open-Source-Modelle der Volumen-Spitze sind praktisch unsichtbar.

Der Markt teilt sich natuerlich: guenstige chinesische Open-Source-Modelle fressen massenhafte, niedrigschwellige, fehlertolerante Volumen-Tasks; geschlossene Flaggschiffe behalten die Preissetzung bei wertvollen, fehlerintoleranten schweren Tasks.

Claude Opus 5 (Anthropic, 24. Juli) ist das Paradebeispiel: FrontierBench v0.1 43,3% (ueber GPT-5.6 Sol mit 37,5%), Preis weiter $5/$25 per M (Eingabe halb so teuer wie Fable 5) — «teuer, aber gerechtfertigt». Details: Opus 5 und Kimi K3-Distillation.

ModellEingabe/MAusgabe/MPositionierung
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,28Preis-Leistung, Agentic Coding
Nemotron 3 Ultra$0,42 (kostenlose Variante)$2,61US-Open-Source, NVIDIA-Oekosystem
GLM 5.2$0,45$3,31Opus-aehnliche Planungsqualitaet unter Open Source
Kimi K3~$3~$15Groesste Open Weights (1,4TB)
Claude Opus 5$5 (Fast $10)$25 (Fast $50)Geschlossenes Flaggschiff, Juli-Benchmark-Spitze
03

App-Ebene: Coding-Agenten dominieren, Rollenspiel ist die unsichtbare Haelfte

Modell-Rankings zeigen «welches Gehirn beliebt ist»; die App-Rankings (openrouter.ai/apps) zeigen «wofuer es wirklich genutzt wird»:

RangAppTypAnteil (ca.)
1Hermes AgentPersoenlicher Agent/CLI Agent~45%
2Kilo CodeCoding-Agent~13%
3OpenClawAllgemeiner Agent~9%
4Claude CodeCoding-Agent~6%
5DescriptContent-Produktion~4,5%
6piAgent~3,3%
7LemonadeBegleitung/Gaming~2,1% (neu)
8ISEKAI ZERORollenspiel~2,0% (neu)
9Janitor AIRollenspiel~1,8% (neu)
10ClineCoding-Agent (IDE-Erweiterung)~1,7%

Hermes Agent (Nous Research, selbstiterierender Open Agent) fuehrt mit ca. 45% Token-Anteil. Coding-Agenten fuellen den Grossteil der Liste. Eine Familienlinie: Cline → Roo Code → Kilo Code — drei Forks derselben Codebasis; die Enkel-Generation Kilo Code ueberholt inzwischen den Vorfahren Cline. Open-Coding-Agent-Oekosysteme iterieren extrem schnell; First-Mover-Vorteil ist fragil.

Kaum in Enterprise-AI-Berichten: Rollenspiel- und Begleitungs-Apps — Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI zusammen einen betraechtlichen Teil des Open-Model-Traffics. OpenRouter × a16z «State of AI»: kreatives Rollenspiel traegt ueber die Haelfte der Open-Model-Gesamtnutzung. Wer nur Enterprise-Berichte liest, verpasst diese Haelfte.

04

August-Trends und sechsstufige Routing-Anleitung

Fuenf August-Trendprognosen:

01

Chinesische Open-Source-Modelle klettern weiter, 50% innerhalb des Jahres wahrscheinlich — sofern US-Anbieter nicht massiv am Preis nachgeben.

02

Der Monats-Champion wechselt weiter — Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot: Preiskampf ohne Pause.

03

Anthropic koennte im August ein guenstigeres Haiku-aehnliches Modell bringen — Opus 5 ist bereits das vierte Flaggschiff in zwei Monaten.

04

Kimi K3 1,4TB-Gewichte: Community-Quantisierung in 2–4 Wochen erwartet — dann werden kleine Teams es wirklich nutzen koennen.

05

Sicherheit und Compliance werden neue Auswahlfaktoren — OpenAI-Sandbox-Escape bleibt im Gespraech; «Sicherheitsbilanz des Anbieters» gewinnt in Enterprise-Einkauf an Gewicht.

Sechs Routing-Schritte:

01

Nach Task-Typ schichten: Smalltalk/Kreativ/Rollenspiel auf guenstige Open Source (DeepSeek V4 Flash, Mimo V2.5); Klassifikation/komplexes Reasoning/High-Risk-Agent auf Flaggschiffe (Claude Opus 5, GPT-5.5).

02

OpenRouter als einheitliches Gateway: Ein Key, hunderte Modelle; openrouter.ai/rankings woechentlich verfolgen. Siehe OpenRouter-API-Leitfaden.

03

Coding: zuerst DeepSeek V4 Flash und GLM 5.2 testen: erstes fuer Preis-Leistung, zweites fuer Opus-aehnliche Planung unter Open Source; Claude Opus 5 nur fuer wirklich blockierte Schritte.

04

Abrechnungs-Circuit-Breaker und Tageslimits: Schwellen aus Preis pro Million Token mal taeglichen Aufrufen; Agent-Batch standardmaessig guenstig, Flaggschiff nur bei komplexem Refactoring.

05

Anbieter-Sicherheitsbilanz in Scorecard: Bei autonomen Agenten Rechte enger fassen; Anbieter mit sauberer Bilanz bevorzugen. Fuer EU-Teams: DSGVO-konforme Datenverarbeitung und Auftragsverarbeitung (AVV) mit US-Anbietern pruefen, bevor Prompts mit personenbezogenen Daten routen.

06

7x24-Agent-Host bereitstellen: Hermes Agent, Kilo Code, OpenClaw vom Laptop auf dedizierten Cloud-Mac: launchd dauerhaft, Keychain fuer mehrere API Keys. Mietpreise und Hilfezentrum fuer die Auswahl.

05

Drei Kernzahlen und Auswahl nach Rolle

A

46% / 2%: Chinesische Anbieter zusammen ca. 46% Token-Anteil, vor einem Jahr unter 2% — eine der steilsten Verschiebungen der letzten 12 Monate.

B

35x / 13,5%: Preisfaktor DeepSeek V4 Flash vs. GPT-5.5 ca. 35; bei komplexem Reasoning teilen Claude Sonnet 4.6 und Opus 4.7 je 13,5% Ausgabenanteil.

C

45% / 50%+: Hermes Agent ca. 45% auf App-Ebene; Rollenspiel traegt ueber die Haelfte der Open-Model-Nutzung — versteckter Markt ausserhalb Enterprise-Berichte.

Die Juli-Liste in einem Satz: Capability und Popularity divergieren. Chinesische Open Source gewinnt Volumen ueber Preis; US-Flaggschiffe halten Preissetzung bei schweren Tasks und Sicherheits-Reputation. OpenRouter als Sandbox fuer Tech-Evals ist sinnvoll; fuer Produktion in der EU Latenz (ca. 180–250ms aus manchen Regionen) und Datenresidenz pruefen — DSGVO und Vertragslage vor dem Routing sensibler Inhalte.

Pure API-Routing ersetzt keinen Agent-Host: Laptop-Sleep, chaotisches Multi-Key-Management, lokale Open Weights brauchen 96GB+ Unified Memory — jeder Pfad hat versteckte Kosten. Fuer 7x24-stabile Multi-Model-Agent-Pipelines in Produktion ist KVMNODE dedizierter Mac Mini Cloud-Miete meist die bessere Basis: Apple Silicon native Toolchain, flexible Tages-/Wochen-/Monats-Tarife. Mietpreise, Bestellung ueber Bestellseite.

Datenstand: 25. Juli 2026 · Quellen: OpenRouter offizielles Ranking und oeffentliche Mirror-Sites · Live-Werte unter openrouter.ai/rankings zum Veroeffentlichungszeitpunkt pruefen