Pour les développeurs et décideurs techniques qui choisissent encore un modèle selon une image datée de plusieurs mois : le classement OpenRouter au 25 juillet 2026 ne mesure pas les benchmarks, mais l’endroit où les développeurs envoient réellement leurs requêtes payantes. Xiaomi Mimo V2.5 domine avec 1,4 trillion de Token/jour, les fournisseurs chinois totalisent ~46% (moins de 2% un an auparavant), tandis que les flagship fermés conservent le pouvoir de prix sur les tâches difficiles. Cet article couvre les classements modèle, fournisseur et application, le marché bicouche usage vs qualité, les agents de code et le marché caché du roleplay, cinq tendances pour août et un guide pratique de routage en six étapes. Contexte : analyse OpenRouter juin 2026, guide API OpenRouter.
01

Classement OpenRouter juillet : Xiaomi en tête, part chinoise au-delà de 46%

OpenRouter est la plus grande plateforme neutre de routage de modèles : chaque jour, elle achemine des requêtes réelles et payantes de dizaines de milliers de développeurs. Son classement ne répond pas à « qui est le plus intelligent », mais à où le portefeuille des développeurs se positionne réellement — l’écart entre usage et qualité est le fil conducteur de cette analyse.

Au 25 juillet 2026, Top 12 par usage quotidien de Token :

RangModèleFournisseurToken/jour30 jours cumulés
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (gratuit)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (nouveau)
10Ling 3.0 FlashInclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Sur les douze premiers, sept modèles de fournisseurs chinois figurent en tête. À l’échelle fournisseur : les acteurs chinois (DeepSeek, Xiaomi, Tencent, Z.ai, MiniMax, Moonshot, Alibaba) totalisent ~46%, contre moins de 2% un an auparavant. Le trio américain (OpenAI, Anthropic, Google) chute de ~70% mi-année à 30%–36%.

FournisseurPart Token (approx.)Remarque
DeepSeek16%–18%Premier fournisseur individuel le plus stable
Xiaomi8%–18%Explosion Mimo V2.5, volatilité maximale
Anthropic10%–15%Opus 5 sorti le 24/07
Tencent8%–13%Hy3 en forte position
Google8%–13%Gemini 3 Flash

L’écart de prix est le moteur principal : DeepSeek V4 Flash à ~$0,05–0,14/M en entrée, OpenAI GPT-5.5 à ~$5/Mun facteur 35. Le « champion du mois » change souvent : février MiniMax M2.5, avril MiMo-V2-Pro, juillet Mimo V2.5. Un instantané ne suffit pas : il faut suivre qui reste durablement en tête.

01

Sélection par MMLU seul : les scores de laboratoire et le vote du portefeuille en production divergent souvent — la facture de fin de mois surprend.

02

Ignorer la volatilité : un même modèle change de rang d’un jour à l’autre (Mimo V2.5 entre 24/07 et 25/07). Toujours dater les données.

03

Confondre usage et qualité : l’open source bon marché domine le volume total, pas forcément le raisonnement complexe ni les décisions Agent à haut risque.

04

Dogme du modèle unique : verrouiller un seul fournisseur devient vite dette technique après la rotation du champion mensuel.

05

API en ligne, hôte hors ligne : fermer le laptop coupe les pipelines Agent — un classement précis ne sauve pas le runtime.

02

Usage élevé ≠ qualité élevée : les flagship fermés tiennent le prix des tâches difficiles

OpenRouter classe par volume de Token, pas par qualité de modèle. Un modèle rapide et peu coûté derrière une application à fort trafic atteint facilement le haut du tableau, même avec un raisonnement complexe médiocre.

Les parts de dépenses par type de tâche (pas le volume de Token) dessinent un tableau différent :

Type de tâchePart des dépenses
Dialogue général35,7%
Workflows Agent30,4%
Code26,5%
Traitement de données7,5%

Sur classification et raisonnement complexe, la donne change : Claude Sonnet 4.6 et Claude Opus 4.7 partagent la première place avec 13,5% chacun, GPT-5.5 troisième à 11,6%. Les modèles open source bon marché du haut du volume deviennent quasi invisibles.

Le marché se structure naturellement : l’open source chinois bon marché absorbe les tâches volumineuses, à faible seuil et tolérantes à l’erreur ; les flagship fermés conservent le pouvoir de prix sur les tâches difficiles, à faible tolérance.

Claude Opus 5 (Anthropic, 24 juillet) illustre parfaitement ce schéma : FrontierBench v0.1 à 43,3% (devant GPT-5.6 Sol à 37,5%), prix maintenu à $5/$25 per M (moitié du prix d’entrée de Fable 5) — « cher, mais justifié ». Voir Opus 5 et la controverse Kimi K3.

ModèleEntrée/MSortie/MPositionnement
DeepSeek V4 Flash~$0,05–0,14~$0,24–0,28Meilleur rapport prix-performance, Agentic Coding
Nemotron 3 Ultra$0,42 (version gratuite)$2,61Open source US, écosystème NVIDIA
GLM 5.2$0,45$3,31Qualité de planification proche Opus en open source
Kimi K3~$3~$15Plus grands poids ouverts (1,4TB)
Claude Opus 5$5 (rapide $10)$25 (rapide $50)Flagship fermé, meilleur benchmark de juillet
03

Couche application : les agents de code règnent, le roleplay est la moitié invisible

Le classement modèles indique « quel cerveau est populaire » ; le classement applications (openrouter.ai/apps) indique « ce pour quoi il est réellement utilisé » :

RangApplicationTypePart (approx.)
1Hermes AgentAgent personnel/CLI Agent~45%
2Kilo CodeAgent de code~13%
3OpenClawAgent généraliste~9%
4Claude CodeAgent de code~6%
5DescriptProduction de contenu~4,5%
6piAgent~3,3%
7LemonadeAccompagnement/jeu~2,1% (nouveau)
8ISEKAI ZERORoleplay~2,0% (nouveau)
9Janitor AIRoleplay~1,8% (nouveau)
10ClineAgent de code (extension IDE)~1,7%

Hermes Agent (agent open source auto-itérant de Nous Research) mène avec ~45% des Token. Les agents de code occupent la majeure partie du tableau. Une lignée notable : Cline → Roo Code → Kilo Code — trois forks du même code ; la génération « petit-enfant » Kilo Code surpasse désormais l’aïeul Cline. L’écosystème open source de coding agents évolue très vite ; l’avantage du premier arrivé n’est pas solide.

Peu visible dans la presse enterprise : les applications de roleplay et d’accompagnement — Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI totalisent une part substantielle du trafic open source. Le rapport OpenRouter × a16z « State of AI » estime que le roleplay créatif représente plus de la moitié de l’usage total des modèles open source. Ne lire que la presse enterprise IA masque cette moitié du marché.

04

Tendances août et guide pratique de routage en six étapes

Cinq tendances pour août :

01

La part cumulée de l’open source chinois continuera probablement de grimper, avec 50% d’ici fin d’année — sauf concessions majeures de prix des fournisseurs américains.

02

Le trône du « champion du mois » continuera de tourner — Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot : la guerre des prix ne ralentit pas.

03

Anthropic pourrait lancer en août un modèle plus abordable (type Haiku) — Opus 5 est déjà le quatrième flagship en deux mois.

04

Les poids 1,4TB de Kimi K3 devraient produire des versions quantifiées communautaires sous 2–4 semaines — moment où les petites équipes pourront vraiment les exploiter.

05

Sécurité et conformité deviennent des critères de choix — l’évasion de sandbox d’un modèle OpenAI non publié alimente le débat ; la « réputation sécurité du fournisseur » pèse plus dans les achats enterprise.

Guide de routage en six étapes :

01

Routage par type de tâche : bavardage/créatif/roleplay sur open source bon marché (DeepSeek V4 Flash, Mimo V2.5) ; classification/raisonnement complexe/décisions Agent à haut risque sur flagship fermés (Claude Opus 5, GPT-5.5).

02

Passerelle OpenRouter unifiée : une clé pour des centaines de modèles ; suivre openrouter.ai/rankings chaque semaine. Voir guide API OpenRouter.

03

Code : tester en priorité DeepSeek V4 Flash et GLM 5.2 : premier pour le prix, second pour une planification proche Opus en open source ; Claude Opus 5 uniquement pour les étapes vraiment bloquées.

04

Circuit-breaker de facturation et plafonds journaliers : seuils = prix par million de Token × appels quotidiens ; batch Agent sur routage bon marché par défaut, retour flagship pour refactoring complexe.

05

Intégrer la « fiche sécurité du fournisseur » au scorecard : pour les Agents autonomes, réduire les permissions ; privilégier les fournisseurs au bilan propre.

06

Provisionner un hôte Agent 7×24 : migrer Hermes Agent, Kilo Code, OpenClaw du laptop vers Mac cloud dédié : launchd permanent, Keychain pour plusieurs clés API. Tarifs et centre d’aide pour choisir la configuration.

05

Trois données clés et conclusions par profil

A

46% / 2% : fournisseurs chinois ~46% des Token, moins de 2% un an auparavant — l’une des migrations de parts les plus abruptes des douze derniers mois.

B

35x / 13,5% : écart de prix DeepSeek V4 Flash vs GPT-5.5 ~35x ; sur le raisonnement complexe, Claude Sonnet 4.6 et Opus 4.7 partagent 13,5% des dépenses chacun.

C

45% / 50%+ : Hermes Agent ~45% à la couche application ; le roleplay représente plus de la moitié de l’usage open source — marché caché hors couverture enterprise.

La phrase à retenir de juillet : capability (capacité) et popularity (usage) divergent. L’open source chinois gagne la moitié du trafic par le prix ; les flagship US fermés défendent le pouvoir de prix sur les tâches difficiles et la réputation sécurité. OpenRouter comme bac à sable technique pour indépendants est pertinent ; latence moyenne ~180–250ms depuis certaines régions, pas de facturation locale — en production, évaluer un relais conforme au marché cible.

Le routage API seul ne remplace pas l’hôte Agent : fermeture du laptop, gestion chaotique des clés multi-modèles, déploiement local des poids ouverts nécessitant 96GB+ de mémoire unifiée — chaque voie a un coût caché. Pour des pipelines Agent multi-modèles stables 7×24 en production, la location cloud Mac Mini dédiée KVMNODE est généralement la meilleure option : toolchain native Apple Silicon, commande flexible jour/semaine/mois. Détails sur la page tarifs, commande via page de commande.

Données au : 25 juillet 2026 · Sources : classement officiel OpenRouter et sites miroirs publics · Vérifier les chiffres en direct sur openrouter.ai/rankings au moment de la publication