Classement OpenRouter juillet 2026 : qui gagne vraiment la guerre du trafic IA ?
Si vous choisissez encore un LLM dans OpenRouter, Cursor ou un Agent maison avec l'image d'il y a quelques mois, vous etes probablement depasse. Cet article s'ancre sur le trafic reel OpenRouter jusqu'au 25 juillet 2026 : Xiaomi Mimo V2.5 en tete, editeurs chinois environ 46%, structure en haltère usage/qualite, agents de code et marche roleplay invisible — plus previsions aout et runbook en cinq etapes pour le routage par couches.
Sommaire
- 1. Trois points de friction au choix
- 2. Classement juillet : modeles et editeurs
- 3. Volume eleve ≠ qualite elevee
- 4. Couche applicative : agents code et marche cache
- 5. Tableau prix et positionnement
- 6. Previsions aout
- 7. Conseils par profil
- 8. Runbook en cinq etapes : routage par couches
- 9. Faits techniques citables
- 10. Conclusion
1. Trois points de friction : classement, qualite et workloads reels decouples
- Confondre le classement par tokens et le classement qualite. OpenRouter trie par trafic de routage reellement paye — pas par benchmarks. Des modeles bon marche et rapides derriere des apps a fort trafic dominent facilement, mais disparaissent presque en raisonnement complexe.
- Ignorer la couche applicative qui pilote le trafic. Hermes Agent seul environ 45% des tokens applicatifs ; Cline → Roo Code → Kilo Code montre la vitesse des forks d'agents code open source. Le classement modeles seul ne dit pas « a quoi servent ces cerveaux ».
- Hardcoder un seul modele alors que le champion mensuel tourne. Fevrier MiniMax M2.5, avril MiMo-V2-Pro, juillet Mimo V2.5 — le trone du mois change souvent ; DeepSeek reste l'editeur le plus stable avec environ 16-18% de part.
2. Classement juillet : Xiaomi en tete, modeles chinois environ 46%
Source : classement officiel OpenRouter (openrouter.ai/rankings), arrete au 25 juillet 2026. Mise a jour quotidienne — verifier les donnees live avant publication.
Top 12 modeles par tokens (quotidien)
| Rang | Modele | Editeur | Tokens/jour | 30 jours cumules |
|---|---|---|---|---|
| 1 | Mimo V2.5 | Xiaomi | 1,4T | 31,2T |
| 2 | DeepSeek V4 Flash | DeepSeek | 943,9B | 23,6T |
| 3 | Hy3 | Tencent | 590B | 23,4T |
| 4 | Nemotron 3 Ultra 550B (gratuit) | NVIDIA | 428,6B | 9T |
| 5 | DeepSeek V4 Pro | DeepSeek | 413,7B | 11,6T |
| 6 | GLM 5.2 | Z.ai | 316,7B | 13,3T |
| 7 | MiniMax M3 | MiniMax | 262,5B | 15,1T |
| 8 | Step 3.7 Flash | StepFun | 204,8B | 5,9T |
| 9 | Kimi K3 | Moonshot | 157,6B | 1,6T (nouveau) |
| 10 | Ling 3.0 Flash | Ant InclusionAI | 128,3B | 417,3B |
| 11 | Gemini 3 Flash Preview | 106,3B | 4T | |
| 12 | Claude Sonnet 5 | Anthropic | 99,5B | 3,6T |
Sept des dix premiers sont chinois ; Nemotron 3 Ultra, Claude et Gemini tiennent le camp US. Le 24 juillet Claude Opus 4.8 etait encore 10e, chasse du top 12 le 25 par Ling 3.0 Flash — le classement bouge tres vite.
Parts editeurs (7 jours, multi-sources, arrondi)
| Editeur | Region | Part tokens (env.) |
|---|---|---|
| DeepSeek | 🇨🇳 Chine | 16-18% |
| Xiaomi | 🇨🇳 Chine | 8-18% (explosion Mimo V2.5, plus volatile) |
| Anthropic | 🇺🇸 USA | 10-15% |
| Tencent | 🇨🇳 Chine | 8-13% |
| 🇺🇸 USA | 8-13% | |
| Z.ai | 🇨🇳 Chine | 4-7% |
| OpenAI | 🇺🇸 USA | 6-8% |
| NVIDIA | 🇺🇸 USA | 5% |
Editeurs chinois environ 46% (moins de 2% il y a un an) ; editeurs US environ 30-36% (environ 70% il y a un an). Cause principale : prix — DeepSeek V4 Flash entree environ 0,05-0,14 $/M, GPT-5.5 environ 5 $/M — ecart jusqu'a 35 fois.
3. L'autre face : volume eleve ≠ qualite elevee
Par part des depenses (pas volume de tokens) selon le type de tache : dialogue general 35,7%, workflows Agent 30,4%, code 26,5%, donnees 7,5%. En classification/raisonnement difficile, le tableau s'inverse — Claude Sonnet 4.6 et Claude Opus 4.7 environ 13,5% chacun ex aequo, GPT-5.5 environ 11,6% troisieme ; les modeles open source bon marche du classement volume sont quasi absents ici.
Le marche forme une haltère : modeles open source chinois bon marche absorbent les workloads massifs tolerants aux erreurs (bavardage, creatif, roleplay, code simple) ; flagships proprietaires gardent le pouvoir de prix sur les taches difficiles et intolerantes aux erreurs. Le 24 juillet Anthropic a publie Claude Opus 5 avec FrontierBench v0.1 43,3% (GPT-5.6 Sol 37,5%), tarif Opus 5 $/25 $ par M — « je suis cher, mais ca vaut le prix ».
4. Secret applicatif : agents code rois, roleplay est la moitie invisible
Le classement modeles montre « quel cerveau est populaire » ; le classement apps (openrouter.ai/apps) montre « a quoi il sert » :
| Rang | App | Type | Part (env.) |
|---|---|---|---|
| 1 | Hermes Agent | Agent personnel / CLI Agent | ~45% |
| 2 | Kilo Code | Agent de code | ~13% |
| 3 | OpenClaw | Agent generaliste | ~9% |
| 4 | Claude Code | Agent de code | ~6% |
| 5 | Descript | Production de contenu | ~4,5% |
| 6 | pi | Agent | ~3,3% |
| 7-9 | Lemonade / ISEKAI ZERO / Janitor AI | Compagnie / roleplay | ~2% chacun |
| 10 | Cline | Agent code (plugin IDE) | ~1,7% |
Cline → Roo Code → Kilo Code est la meme lignee code en trois generations — le petit-fils Kilo Code a depasse les ancetres. Roleplay/compagnie (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) represente une part considerable du trafic open source ; OpenRouter × a16z « State of AI » : le roleplay creatif contribue plus de la moitie du volume open source total — quasi invisible dans la presse enterprise IA.
5. Tableau prix et positionnement
| Modele | Entree/M | Sortie/M | Contexte | Positionnement |
|---|---|---|---|---|
| DeepSeek V4 Flash | ~0,05-0,14 $ | ~0,24-0,28 $ | 1M | Roi rapport qualite-prix, Agentic Coding |
| Nemotron 3 Ultra | 0,42 $ (plus version gratuite) | 2,61 $ | — | Open source US, ecosysteme NVIDIA |
| MiniMax M3 | 0,10 $ | 1,21 $ | Long contexte | Multimodal/entree image budget |
| GLM 5.2 | 0,45 $ | 3,31 $ | — | Qualite planification « type Opus » en open source |
| Kimi K3 | ~3 $ | ~15 $ | 1M | Plus gros poids open source (1,4TB), niveau proprietaire |
| Claude Opus 5 | 5 $ (Fast 10 $) | 25 $ (Fast 50 $) | 1M | Flagship proprietaire, meilleurs benchmarks juillet |
6. Previsions aout
- Part cumulee des open source chinois continue de monter, 50% dans l'annee probable — sauf baisse majeure US ; aucun signe pour l'instant.
- Champion mensuel continue de changer : Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot — guerre des prix et iterations sans relache.
- Anthropic pourrait lancer un modele moins cher (niveau Haiku) pour le volume ; Opus 5 est deja le quatrieme flagship en deux mois (apres Mythos 5, Fable 5, Sonnet 5) — strategie multi-gammes.
- Kimi K3 1,4TB : version quantifiee communautaire possible en 2-4 semaines — alors seulement deployable par petites equipes ; aujourd'hui surtout grands acteurs et clouds d'inference (ex. Fireworks AI).
- Securite et conformite comme nouvelle variable de choix : fuite sandbox modele OpenAI sur Hugging Face, « AI Kill Switch Act » au Congres US et cadre White House pour modeles frontier — « reputation securite editeur » pese plus en achat enterprise.
7. Conseils par profil
Developpeur independant / petite equipe
- OpenRouter convient bien comme bac a sable technique — une cle, des centaines de modeles. Attention : latence depuis la Chine environ 180-250 ms, pas de factures locales ; en production evaluer des relais conformes.
- Code : d'abord DeepSeek V4 Flash et GLM 5.2 ; etapes bloquees → routage Claude Opus 5 / GPT-5.6 — routage mixte reduit fortement les couts.
Responsable technique enterprise
- Ne pas choisir sur le seul classement volume ; eval interne (taux d'adoption, erreurs, latence reelle) obligatoire.
- Routage par couches : bavardage/creatif bon marche, classification/raisonnement difficile/agents a risque sur flagships proprietaires — lecon directe de l'haltère.
- Inclure « historique securite fournisseur modele » dans la grille de choix.
Producteur d'outil Agent IA / code
- Cline → Kilo Code montre que le fossé open source est plus faible qu'on croit — un successeur peut depasser vite.
- Roleplay/compagnie depasse largement ce que la presse enterprise imagine — ne pas negliger l'entertainment.
8. Runbook en cinq etapes : routage par couches
Etape 1 — Scinder selon risque et tolerance aux erreurs
Volume/tolerant → DeepSeek V4 Flash, Mimo V2.5 ; raisonnement difficile/agents a risque → Claude Opus 5.
Etape 2 — Configurer principal et fallback sur OpenRouter
Etape 3 — Integrer l'ecart de prix x35 dans la facture mensuelle
A 10M tokens entree/jour : DeepSeek V4 Flash environ 5-14 $/jour, GPT-5.5 environ 50 $/jour — ROI du routage par couches enorme.
Etape 4 — Migrer la passerelle sur Mac cloud 7x24
launchd pour OpenClaw, cles API via variables d'environnement. Voir guide API OpenRouter et analyse classement juin.
Etape 5 — Revue mensuelle : classement et eval interne
9. Faits techniques citables
- Xiaomi Mimo V2.5 1,4T tokens/jour — 1er classement modeles juillet ; DeepSeek V4 Flash 943,9B/jour 2e.
- Editeurs chinois sur OpenRouter environ 46% des tokens, de moins de 2% en un an ; trois grands US environ 30-36%.
- DeepSeek V4 Flash vs GPT-5.5 entree environ 35 fois moins cher ; Hermes Agent environ 45% tokens applicatifs.
- Claude Opus 5 FrontierBench v0.1 43,3% ; raisonnement difficile Claude Sonnet 4.6 / Opus 4.7 environ 13,5% chacun des depenses.
10. Conclusion : capability et popularity divergent
La phrase cle de juillet : capability et popularity divergent. Les open source chinois gagnent la moitie du trafic par le prix ; les flagships US proprietaires gardent le pouvoir de prix et le fossé securite sur les taches difficiles. Mieux vaut investir dans l'evaluation et le routage par couches que demander « qui est premier ».
Passerelle multi-modeles sur portable ou VPS Linux pur a des faiblesses : couvercle ferme, toolchain Apple absente, debug complexe. Pour OpenClaw / Cursor Agent 7x24 avec DeepSeek, Opus et GLM : louer un noeud Mac cloud M4 VPSMAC — le modele change avec le classement, l'environnement d'execution reste.