Classement OpenRouter juillet 2026 : MiMo V2.5 en tête et structure de marché en haltère

2026 Classement OpenRouter juillet : MiMo V2.5 mène à 1,4T — marché en haltère & guide de routage

Au 25 juillet 2026, OpenRouter affiche une rupture nette : MiMo V2.5 (Xiaomi) dépasse DeepSeek V4 Flash avec 1,4 billion de tokens/jour — non parce que c'est le modèle le plus puissant, mais parce que subvention et débit batch d'agents dominent la vérité de facturation. Ce guide data-driven analyse le classement de juillet (Top 12, parts fournisseurs, couche applicative, tarifs) et fournit une matrice de routage pour les équipes créatives et studios qui exploitent des gateways OpenClaw.

1. Top 12 modèles par volume quotidien (au 25.07.2026)

OpenRouter agrège des millions d'appels API en production — pas des slides marketing, mais des votes par le code. Données live sur openrouter.ai/rankings.

Rang Modèle Fournisseur Origine Tokens/jour
1MiMo V2.5XiaomiChine1,40T
2DeepSeek V4 FlashDeepSeekChine943,9B
3Hy3 PreviewTencentChine590B
4MiniMax M3MiniMaxChine512B
5DeepSeek V4 ProDeepSeekChine445B
6Kimi K3Moonshot AIChine398B
7Claude Opus 5AnthropicUSA362B
8Claude Sonnet 4.6AnthropicUSA295B
9Gemini 3.5 FlashGoogleUSA271B
10Claude Opus 4.8AnthropicUSA248B
11Qwen 3.7 MaxAlibabaChine223B
12Grok 4.3xAIUSA198B

Le bond de MiMo V2.5 en juillet n'est pas un signal qualité — Xiaomi subventionne agressivement les prix API pour capter les pipelines d'agents de DeepSeek. En juin, DeepSeek V4 Flash menait à 619B ; MiMo était à 327B. En quatre semaines, Xiaomi a doublé son volume.

2. Parts fournisseurs : Chine ~46 %, USA 30–36 %

Volume hebdomadaire par entreprise (semaine 29 juillet, au 25.07.2026) :

Rang Entreprise Origine Tokens/semaine Part
1DeepSeekChine5,42T16,1 %
2AnthropicUSA4,78T14,2 %
3XiaomiChine3,71T11,0 %
4GoogleUSA3,55T10,5 %
5TencentChine3,01T8,9 %
6OpenAIUSA2,74T8,1 %
7MiniMaxChine2,49T7,4 %
8Moonshot AIChine1,74T5,2 %

Les fournisseurs chinois dans le Top 8 totalisent environ 46 % ; les USA (Anthropic + Google + OpenAI) se situent à 32,8 % — dans le corridor 30–36 % observé depuis juin. L'économie l'emporte sur la qualité frontier pour les workloads standards.

« MiMo coûte moins de 20 centimes l'heure en batch agent. Opus 5 reste pour les 5 % qui en ont vraiment besoin — mais la facture des 95 % de volume est chinoise. » — Ingénieur plateforme, Paris

3. Marché en haltère : usage ≠ capacité

Le marché de juillet présente une structure en haltère — deux extrémités lourdes, milieu mince :

  • Extrémité volume (gauche) : MiMo V2.5, DeepSeek V4 Flash, Hy3 — prix commodity subventionnés, 80–90 % du niveau frontier pour l'aide au code, la traduction, la synthèse. Batch agents et cron jobs dominent.
  • Extrémité premium (droite) : Claude Opus 5, GPT-5.6, Gemini 3.1 Pro — benchmarks les plus élevés, coûteux, pour les 5 % de tâches les plus difficiles. Index Artificial Analysis : Opus 5 ~62,1 (#1 depuis le 24.07.).
  • Milieu mince : Sonnet 4.6, Qwen 3.7 Max perdent des deux côtés — ni assez bon marché pour le batch, ni assez fort pour le frontier.

Lire uniquement le tableau tokens pousse vers MiMo. Lire uniquement les benchmarks pousse vers Opus 5. La production exige les deux plus une couche de routage qui assigne la complexité automatiquement.

4. Couche applicative : Hermes 45 %, agents de code dominent

Le classement modèles ne raconte que la moitié de l'histoire. OpenRouter mesure aussi le volume par application :

Rang App / Outil Part volume app Type
1Hermes Agent45 %Automatisation / cron
2Open WebUI18 %Interface chat
3Kilo Code13 %Agent CLI code
4Claude Code9 %Agent CLI code
5Cline / Roo Code6 %Agent IDE
6Aider4 %CLI Git
7Autres5 %

Les agents de code (Hermes + Kilo + Claude Code + Cline + Aider) dépassent 77 % du volume applicatif mesurable. Ce qui manque : le roleplay et le chat grand public passent souvent par des instances Open WebUI génériques ou des proxies custom — OpenRouter les compte sous « Autres » ou Open WebUI, pas comme catégorie distincte. Cela fausse le classement modèles vers le haut pour les modèles chinois bon marché.

Pour les studios créatifs : si votre pipeline utilise Hermes en cron, la facture explose quel que soit le modèle. La stratégie de routage doit croiser couche app + couche modèle.

5. Comparatif tarifaire des modèles de juillet

Modèle Input $/M Output $/M Coût agent 1h* Note
MiMo V2.5$0,08$0,32~$0,18Subventionné, leader juillet
DeepSeek V4 Flash$0,14$0,28~$0,24Tarifs heures pleines/creuses
Hy3 Preview$0,45$1,80~$1,10Enterprise Tencent
MiniMax M3$0,60$2,40~$1,45Open weights, self-host possible
Kimi K3$3,00$15,00~$8,50Contexte 1M, 2,8T paramètres
Claude Opus 5$5,00$25,00~$14,00Premium, index #1
Claude Sonnet 4.6$3,00$15,00~$8,50Mid-premium
GPT-5.6$2,50$10,00~$5,80Intégration écosystème

*Hypothèse : 500K input + 200K output par heure de batch agent. MiMo vs Opus 5 : écart de coût d'environ ×78 pour un débit comparable sur du code standard.

6. Quatre erreurs de routage typiques

  1. Champion tokens = champion qualité : MiMo V2.5 à 1,4T/jour signifie succès de subvention, pas leadership benchmark. Opus 5 mène la qualité ; MiMo mène l'économie.
  2. Modèle unique sans chaîne de fallback : un 429 ou une hausse de prix après fin de subvention paralyse le pipeline. OpenClaw exige primaire + deux fallbacks par palier.
  3. Ignorer la couche applicative : un cron Hermes sur Opus 5 au lieu de MiMo peut décupler la facture mensuelle — choix d'outil et choix de modèle sont couplés.
  4. Routing sans matrice de décision : adopter MiMo parce qu'il est #1 sans segmenter batch / code quotidien / tâches frontier est l'erreur la plus coûteuse en juillet 2026.

7. Cinq prévisions pour août 2026

  1. Fermeture de la fenêtre de subvention MiMo : Xiaomi devrait relever les prix de 30–50 % après août — les équipes MiMo-only ont besoin d'un fallback DeepSeek avant le 15 août.
  2. Opus 5 absorbe le coding premium d'Opus 4.8 : dans les 30 jours suivant le release (24.07.), Opus 5 devrait dépasser 60 % du volume Anthropic.
  3. OpenRouter scinde le leaderboard applicatif : code vs roleplay vs automatisation — le volume RP caché devient plus visible.
  4. DeepSeek V4 Flash reste #2, marges en baisse : la concurrence MiMo force de nouvelles baisses ; la marge commodity tend vers zéro.
  5. Routes preview GPT-6 mi-août : premières IDs openrouter/openai/gpt-6-preview en zone grise — couche de routage agnostique au modèle obligatoire.

8. Cinq étapes : routage multi-modèles par paliers

  1. Archiver la baseline juillet : Top 12, parts fournisseurs, couche app — comparer avec le classement de juin si disponible.
  2. Définir les paliers de complexité : Palier 0 (batch/cron) → MiMo V2.5 / DeepSeek V4 Flash ; Palier 1 (code quotidien) → Kimi K3 / MiniMax M3 ; Palier 2 (agents complexes) → Claude Opus 5 ; Palier 3 (long contexte) → Kimi K3 1M.
  3. Chaîne primaire/fallback dans openclaw.json : IDs OpenRouter avec préfixe, SecretRef, fallback 429 — triage 429.
  4. Mac distant 24/7 : openclaw gateway install + launchd ; workspace SFTP/rsync avec piste d'audit.
  5. Revue mensuelle : après channels status --probe, tester les nouveaux modèles ; évaluer la zone grise août (prix MiMo, preview GPT-6) sous 48 h.

9. FAQ

Q : Champion tokens en juillet — MiMo ou DeepSeek ? Par volume MiMo V2.5 (1,4T) ; par index qualité Opus 5 (~62,1). La production exige une matrice par paliers, pas un seul gagnant.

Q : Kimi K3 vaut-il son prix plus élevé ? Pour le long contexte (1M) et le reasoning complexe, oui — 398B/jour montrent l'adoption. Pour le cron batch : MiMo ou DeepSeek.

Q : Pourquoi Hermes continue-t-il de monter ? Gratuit + open source + compatible cron. Chaque nouveau job d'automatisation ajoute des milliards de tokens — indépendamment du modèle.

Q : Faut-il tout router vers les modèles chinois ? Non pour le frontier. Routez par palier : volume chinois pour le batch, Opus 5 pour les 5 % critiques.

10. Conclusion : l'haltère bat le modèle unique — l'infrastructure bat tout

L'histoire de juillet n'est pas « Xiaomi gagne », mais compression de la marge commodity. MiMo a prouvé : le volume s'achète ; la qualité se route. Les fournisseurs US tiennent le sommet premium — Anthropic avec Opus 5, Google avec Gemini 3.5 Flash.

Ce qui a de la valeur, c'est la capacité de changer de palier à tout moment. Août densifie encore ce risque.

Les équipes qui exploitent OpenClaw en production butent sur la disponibilité du gateway et des workspaces auditables. Veille du laptop et VPS surchargés annulent le ROI. SFTPMAC location Mac distant fournit des nœuds Apple Silicon pour OpenClaw : garde launchd, faible latence OpenRouter, baseline SFTP/rsync — plus stable qu'un « PC maison comme gateway IA » pour les studios qui veulent les données de juillet 2026 en production.