Classement OpenRouter juillet 2026 : qui gagne vraiment la guerre du trafic IA ?

Si vous choisissez encore un LLM dans OpenRouter, Cursor ou un Agent maison avec l'image d'il y a quelques mois, vous etes probablement depasse. Cet article s'ancre sur le trafic reel OpenRouter jusqu'au 25 juillet 2026 : Xiaomi Mimo V2.5 en tete, editeurs chinois environ 46%, structure en haltère usage/qualite, agents de code et marche roleplay invisible — plus previsions aout et runbook en cinq etapes pour le routage par couches.

Visualisation abstraite de flux de donnees et reseaux neuronaux — statistiques d'appels modeles OpenRouter des developpeurs mondiaux

Sommaire

1. Trois points de friction : classement, qualite et workloads reels decouples

  1. Confondre le classement par tokens et le classement qualite. OpenRouter trie par trafic de routage reellement paye — pas par benchmarks. Des modeles bon marche et rapides derriere des apps a fort trafic dominent facilement, mais disparaissent presque en raisonnement complexe.
  2. Ignorer la couche applicative qui pilote le trafic. Hermes Agent seul environ 45% des tokens applicatifs ; Cline → Roo Code → Kilo Code montre la vitesse des forks d'agents code open source. Le classement modeles seul ne dit pas « a quoi servent ces cerveaux ».
  3. Hardcoder un seul modele alors que le champion mensuel tourne. Fevrier MiniMax M2.5, avril MiMo-V2-Pro, juillet Mimo V2.5 — le trone du mois change souvent ; DeepSeek reste l'editeur le plus stable avec environ 16-18% de part.

2. Classement juillet : Xiaomi en tete, modeles chinois environ 46%

Source : classement officiel OpenRouter (openrouter.ai/rankings), arrete au 25 juillet 2026. Mise a jour quotidienne — verifier les donnees live avant publication.

Top 12 modeles par tokens (quotidien)

RangModeleEditeurTokens/jour30 jours cumules
1Mimo V2.5Xiaomi1,4T31,2T
2DeepSeek V4 FlashDeepSeek943,9B23,6T
3Hy3Tencent590B23,4T
4Nemotron 3 Ultra 550B (gratuit)NVIDIA428,6B9T
5DeepSeek V4 ProDeepSeek413,7B11,6T
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot157,6B1,6T (nouveau)
10Ling 3.0 FlashAnt InclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4T
12Claude Sonnet 5Anthropic99,5B3,6T

Sept des dix premiers sont chinois ; Nemotron 3 Ultra, Claude et Gemini tiennent le camp US. Le 24 juillet Claude Opus 4.8 etait encore 10e, chasse du top 12 le 25 par Ling 3.0 Flash — le classement bouge tres vite.

Parts editeurs (7 jours, multi-sources, arrondi)

EditeurRegionPart tokens (env.)
DeepSeek🇨🇳 Chine16-18%
Xiaomi🇨🇳 Chine8-18% (explosion Mimo V2.5, plus volatile)
Anthropic🇺🇸 USA10-15%
Tencent🇨🇳 Chine8-13%
Google🇺🇸 USA8-13%
Z.ai🇨🇳 Chine4-7%
OpenAI🇺🇸 USA6-8%
NVIDIA🇺🇸 USA5%

Editeurs chinois environ 46% (moins de 2% il y a un an) ; editeurs US environ 30-36% (environ 70% il y a un an). Cause principale : prix — DeepSeek V4 Flash entree environ 0,05-0,14 $/M, GPT-5.5 environ 5 $/M — ecart jusqu'a 35 fois.

3. L'autre face : volume eleve ≠ qualite elevee

Par part des depenses (pas volume de tokens) selon le type de tache : dialogue general 35,7%, workflows Agent 30,4%, code 26,5%, donnees 7,5%. En classification/raisonnement difficile, le tableau s'inverse — Claude Sonnet 4.6 et Claude Opus 4.7 environ 13,5% chacun ex aequo, GPT-5.5 environ 11,6% troisieme ; les modeles open source bon marche du classement volume sont quasi absents ici.

Le marche forme une haltère : modeles open source chinois bon marche absorbent les workloads massifs tolerants aux erreurs (bavardage, creatif, roleplay, code simple) ; flagships proprietaires gardent le pouvoir de prix sur les taches difficiles et intolerantes aux erreurs. Le 24 juillet Anthropic a publie Claude Opus 5 avec FrontierBench v0.1 43,3% (GPT-5.6 Sol 37,5%), tarif Opus 5 $/25 $ par M — « je suis cher, mais ca vaut le prix ».

4. Secret applicatif : agents code rois, roleplay est la moitie invisible

Le classement modeles montre « quel cerveau est populaire » ; le classement apps (openrouter.ai/apps) montre « a quoi il sert » :

RangAppTypePart (env.)
1Hermes AgentAgent personnel / CLI Agent~45%
2Kilo CodeAgent de code~13%
3OpenClawAgent generaliste~9%
4Claude CodeAgent de code~6%
5DescriptProduction de contenu~4,5%
6piAgent~3,3%
7-9Lemonade / ISEKAI ZERO / Janitor AICompagnie / roleplay~2% chacun
10ClineAgent code (plugin IDE)~1,7%

Cline → Roo Code → Kilo Code est la meme lignee code en trois generations — le petit-fils Kilo Code a depasse les ancetres. Roleplay/compagnie (Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI) represente une part considerable du trafic open source ; OpenRouter × a16z « State of AI » : le roleplay creatif contribue plus de la moitie du volume open source total — quasi invisible dans la presse enterprise IA.

5. Tableau prix et positionnement

ModeleEntree/MSortie/MContextePositionnement
DeepSeek V4 Flash~0,05-0,14 $~0,24-0,28 $1MRoi rapport qualite-prix, Agentic Coding
Nemotron 3 Ultra0,42 $ (plus version gratuite)2,61 $Open source US, ecosysteme NVIDIA
MiniMax M30,10 $1,21 $Long contexteMultimodal/entree image budget
GLM 5.20,45 $3,31 $Qualite planification « type Opus » en open source
Kimi K3~3 $~15 $1MPlus gros poids open source (1,4TB), niveau proprietaire
Claude Opus 55 $ (Fast 10 $)25 $ (Fast 50 $)1MFlagship proprietaire, meilleurs benchmarks juillet

6. Previsions aout

  1. Part cumulee des open source chinois continue de monter, 50% dans l'annee probable — sauf baisse majeure US ; aucun signe pour l'instant.
  2. Champion mensuel continue de changer : Xiaomi, DeepSeek, Tencent, Z.ai, MiniMax, Moonshot — guerre des prix et iterations sans relache.
  3. Anthropic pourrait lancer un modele moins cher (niveau Haiku) pour le volume ; Opus 5 est deja le quatrieme flagship en deux mois (apres Mythos 5, Fable 5, Sonnet 5) — strategie multi-gammes.
  4. Kimi K3 1,4TB : version quantifiee communautaire possible en 2-4 semaines — alors seulement deployable par petites equipes ; aujourd'hui surtout grands acteurs et clouds d'inference (ex. Fireworks AI).
  5. Securite et conformite comme nouvelle variable de choix : fuite sandbox modele OpenAI sur Hugging Face, « AI Kill Switch Act » au Congres US et cadre White House pour modeles frontier — « reputation securite editeur » pese plus en achat enterprise.

7. Conseils par profil

Developpeur independant / petite equipe

Responsable technique enterprise

Producteur d'outil Agent IA / code

8. Runbook en cinq etapes : routage par couches

Etape 1 — Scinder selon risque et tolerance aux erreurs

Volume/tolerant → DeepSeek V4 Flash, Mimo V2.5 ; raisonnement difficile/agents a risque → Claude Opus 5.

Etape 2 — Configurer principal et fallback sur OpenRouter

{ "agents": { "defaults": { "model": { "primary": "openrouter/deepseek/deepseek-v4-flash", "fallbacks": [ "openrouter/anthropic/claude-opus-5", "openrouter/z-ai/glm-5.2" ] } } } }

Etape 3 — Integrer l'ecart de prix x35 dans la facture mensuelle

A 10M tokens entree/jour : DeepSeek V4 Flash environ 5-14 $/jour, GPT-5.5 environ 50 $/jour — ROI du routage par couches enorme.

Etape 4 — Migrer la passerelle sur Mac cloud 7x24

launchd pour OpenClaw, cles API via variables d'environnement. Voir guide API OpenRouter et analyse classement juin.

Etape 5 — Revue mensuelle : classement et eval interne

openclaw doctor && openclaw channels status --probe # Mettre a jour la route via openrouter.ai/rankings

9. Faits techniques citables

10. Conclusion : capability et popularity divergent

La phrase cle de juillet : capability et popularity divergent. Les open source chinois gagnent la moitie du trafic par le prix ; les flagships US proprietaires gardent le pouvoir de prix et le fossé securite sur les taches difficiles. Mieux vaut investir dans l'evaluation et le routage par couches que demander « qui est premier ».

Passerelle multi-modeles sur portable ou VPS Linux pur a des faiblesses : couvercle ferme, toolchain Apple absente, debug complexe. Pour OpenClaw / Cursor Agent 7x24 avec DeepSeek, Opus et GLM : louer un noeud Mac cloud M4 VPSMAC — le modele change avec le classement, l'environnement d'execution reste.