2026 Classement OpenRouter juillet : MiMo V2.5 mène à 1,4T — marché en haltère & guide de routage
Au 25 juillet 2026, OpenRouter affiche une rupture nette : MiMo V2.5 (Xiaomi) dépasse DeepSeek V4 Flash avec 1,4 billion de tokens/jour — non parce que c'est le modèle le plus puissant, mais parce que subvention et débit batch d'agents dominent la vérité de facturation. Ce guide data-driven analyse le classement de juillet (Top 12, parts fournisseurs, couche applicative, tarifs) et fournit une matrice de routage pour les équipes créatives et studios qui exploitent des gateways OpenClaw.
1. Top 12 modèles par volume quotidien (au 25.07.2026)
OpenRouter agrège des millions d'appels API en production — pas des slides marketing, mais des votes par le code. Données live sur openrouter.ai/rankings.
| Rang | Modèle | Fournisseur | Origine | Tokens/jour |
|---|---|---|---|---|
| 1 | MiMo V2.5 | Xiaomi | Chine | 1,40T |
| 2 | DeepSeek V4 Flash | DeepSeek | Chine | 943,9B |
| 3 | Hy3 Preview | Tencent | Chine | 590B |
| 4 | MiniMax M3 | MiniMax | Chine | 512B |
| 5 | DeepSeek V4 Pro | DeepSeek | Chine | 445B |
| 6 | Kimi K3 | Moonshot AI | Chine | 398B |
| 7 | Claude Opus 5 | Anthropic | USA | 362B |
| 8 | Claude Sonnet 4.6 | Anthropic | USA | 295B |
| 9 | Gemini 3.5 Flash | USA | 271B | |
| 10 | Claude Opus 4.8 | Anthropic | USA | 248B |
| 11 | Qwen 3.7 Max | Alibaba | Chine | 223B |
| 12 | Grok 4.3 | xAI | USA | 198B |
Le bond de MiMo V2.5 en juillet n'est pas un signal qualité — Xiaomi subventionne agressivement les prix API pour capter les pipelines d'agents de DeepSeek. En juin, DeepSeek V4 Flash menait à 619B ; MiMo était à 327B. En quatre semaines, Xiaomi a doublé son volume.
2. Parts fournisseurs : Chine ~46 %, USA 30–36 %
Volume hebdomadaire par entreprise (semaine 29 juillet, au 25.07.2026) :
| Rang | Entreprise | Origine | Tokens/semaine | Part |
|---|---|---|---|---|
| 1 | DeepSeek | Chine | 5,42T | 16,1 % |
| 2 | Anthropic | USA | 4,78T | 14,2 % |
| 3 | Xiaomi | Chine | 3,71T | 11,0 % |
| 4 | USA | 3,55T | 10,5 % | |
| 5 | Tencent | Chine | 3,01T | 8,9 % |
| 6 | OpenAI | USA | 2,74T | 8,1 % |
| 7 | MiniMax | Chine | 2,49T | 7,4 % |
| 8 | Moonshot AI | Chine | 1,74T | 5,2 % |
Les fournisseurs chinois dans le Top 8 totalisent environ 46 % ; les USA (Anthropic + Google + OpenAI) se situent à 32,8 % — dans le corridor 30–36 % observé depuis juin. L'économie l'emporte sur la qualité frontier pour les workloads standards.
« MiMo coûte moins de 20 centimes l'heure en batch agent. Opus 5 reste pour les 5 % qui en ont vraiment besoin — mais la facture des 95 % de volume est chinoise. » — Ingénieur plateforme, Paris
3. Marché en haltère : usage ≠ capacité
Le marché de juillet présente une structure en haltère — deux extrémités lourdes, milieu mince :
- Extrémité volume (gauche) : MiMo V2.5, DeepSeek V4 Flash, Hy3 — prix commodity subventionnés, 80–90 % du niveau frontier pour l'aide au code, la traduction, la synthèse. Batch agents et cron jobs dominent.
- Extrémité premium (droite) : Claude Opus 5, GPT-5.6, Gemini 3.1 Pro — benchmarks les plus élevés, coûteux, pour les 5 % de tâches les plus difficiles. Index Artificial Analysis : Opus 5 ~62,1 (#1 depuis le 24.07.).
- Milieu mince : Sonnet 4.6, Qwen 3.7 Max perdent des deux côtés — ni assez bon marché pour le batch, ni assez fort pour le frontier.
Lire uniquement le tableau tokens pousse vers MiMo. Lire uniquement les benchmarks pousse vers Opus 5. La production exige les deux plus une couche de routage qui assigne la complexité automatiquement.
4. Couche applicative : Hermes 45 %, agents de code dominent
Le classement modèles ne raconte que la moitié de l'histoire. OpenRouter mesure aussi le volume par application :
| Rang | App / Outil | Part volume app | Type |
|---|---|---|---|
| 1 | Hermes Agent | 45 % | Automatisation / cron |
| 2 | Open WebUI | 18 % | Interface chat |
| 3 | Kilo Code | 13 % | Agent CLI code |
| 4 | Claude Code | 9 % | Agent CLI code |
| 5 | Cline / Roo Code | 6 % | Agent IDE |
| 6 | Aider | 4 % | CLI Git |
| 7 | Autres | 5 % | — |
Les agents de code (Hermes + Kilo + Claude Code + Cline + Aider) dépassent 77 % du volume applicatif mesurable. Ce qui manque : le roleplay et le chat grand public passent souvent par des instances Open WebUI génériques ou des proxies custom — OpenRouter les compte sous « Autres » ou Open WebUI, pas comme catégorie distincte. Cela fausse le classement modèles vers le haut pour les modèles chinois bon marché.
Pour les studios créatifs : si votre pipeline utilise Hermes en cron, la facture explose quel que soit le modèle. La stratégie de routage doit croiser couche app + couche modèle.
5. Comparatif tarifaire des modèles de juillet
| Modèle | Input $/M | Output $/M | Coût agent 1h* | Note |
|---|---|---|---|---|
| MiMo V2.5 | $0,08 | $0,32 | ~$0,18 | Subventionné, leader juillet |
| DeepSeek V4 Flash | $0,14 | $0,28 | ~$0,24 | Tarifs heures pleines/creuses |
| Hy3 Preview | $0,45 | $1,80 | ~$1,10 | Enterprise Tencent |
| MiniMax M3 | $0,60 | $2,40 | ~$1,45 | Open weights, self-host possible |
| Kimi K3 | $3,00 | $15,00 | ~$8,50 | Contexte 1M, 2,8T paramètres |
| Claude Opus 5 | $5,00 | $25,00 | ~$14,00 | Premium, index #1 |
| Claude Sonnet 4.6 | $3,00 | $15,00 | ~$8,50 | Mid-premium |
| GPT-5.6 | $2,50 | $10,00 | ~$5,80 | Intégration écosystème |
*Hypothèse : 500K input + 200K output par heure de batch agent. MiMo vs Opus 5 : écart de coût d'environ ×78 pour un débit comparable sur du code standard.
6. Quatre erreurs de routage typiques
- Champion tokens = champion qualité : MiMo V2.5 à 1,4T/jour signifie succès de subvention, pas leadership benchmark. Opus 5 mène la qualité ; MiMo mène l'économie.
- Modèle unique sans chaîne de fallback : un 429 ou une hausse de prix après fin de subvention paralyse le pipeline. OpenClaw exige primaire + deux fallbacks par palier.
- Ignorer la couche applicative : un cron Hermes sur Opus 5 au lieu de MiMo peut décupler la facture mensuelle — choix d'outil et choix de modèle sont couplés.
- Routing sans matrice de décision : adopter MiMo parce qu'il est #1 sans segmenter batch / code quotidien / tâches frontier est l'erreur la plus coûteuse en juillet 2026.
7. Cinq prévisions pour août 2026
- Fermeture de la fenêtre de subvention MiMo : Xiaomi devrait relever les prix de 30–50 % après août — les équipes MiMo-only ont besoin d'un fallback DeepSeek avant le 15 août.
- Opus 5 absorbe le coding premium d'Opus 4.8 : dans les 30 jours suivant le release (24.07.), Opus 5 devrait dépasser 60 % du volume Anthropic.
- OpenRouter scinde le leaderboard applicatif : code vs roleplay vs automatisation — le volume RP caché devient plus visible.
- DeepSeek V4 Flash reste #2, marges en baisse : la concurrence MiMo force de nouvelles baisses ; la marge commodity tend vers zéro.
- Routes preview GPT-6 mi-août : premières IDs
openrouter/openai/gpt-6-previewen zone grise — couche de routage agnostique au modèle obligatoire.
8. Cinq étapes : routage multi-modèles par paliers
- Archiver la baseline juillet : Top 12, parts fournisseurs, couche app — comparer avec le classement de juin si disponible.
- Définir les paliers de complexité : Palier 0 (batch/cron) → MiMo V2.5 / DeepSeek V4 Flash ; Palier 1 (code quotidien) → Kimi K3 / MiniMax M3 ; Palier 2 (agents complexes) → Claude Opus 5 ; Palier 3 (long contexte) → Kimi K3 1M.
- Chaîne primaire/fallback dans openclaw.json : IDs OpenRouter avec préfixe, SecretRef, fallback 429 — triage 429.
- Mac distant 24/7 :
openclaw gateway install+ launchd ; workspace SFTP/rsync avec piste d'audit. - Revue mensuelle : après
channels status --probe, tester les nouveaux modèles ; évaluer la zone grise août (prix MiMo, preview GPT-6) sous 48 h.
9. FAQ
Q : Champion tokens en juillet — MiMo ou DeepSeek ? Par volume MiMo V2.5 (1,4T) ; par index qualité Opus 5 (~62,1). La production exige une matrice par paliers, pas un seul gagnant.
Q : Kimi K3 vaut-il son prix plus élevé ? Pour le long contexte (1M) et le reasoning complexe, oui — 398B/jour montrent l'adoption. Pour le cron batch : MiMo ou DeepSeek.
Q : Pourquoi Hermes continue-t-il de monter ? Gratuit + open source + compatible cron. Chaque nouveau job d'automatisation ajoute des milliards de tokens — indépendamment du modèle.
Q : Faut-il tout router vers les modèles chinois ? Non pour le frontier. Routez par palier : volume chinois pour le batch, Opus 5 pour les 5 % critiques.
10. Conclusion : l'haltère bat le modèle unique — l'infrastructure bat tout
L'histoire de juillet n'est pas « Xiaomi gagne », mais compression de la marge commodity. MiMo a prouvé : le volume s'achète ; la qualité se route. Les fournisseurs US tiennent le sommet premium — Anthropic avec Opus 5, Google avec Gemini 3.5 Flash.
Ce qui a de la valeur, c'est la capacité de changer de palier à tout moment. Août densifie encore ce risque.
Les équipes qui exploitent OpenClaw en production butent sur la disponibilité du gateway et des workspaces auditables. Veille du laptop et VPS surchargés annulent le ROI. SFTPMAC location Mac distant fournit des nœuds Apple Silicon pour OpenClaw : garde launchd, faible latence OpenRouter, baseline SFTP/rsync — plus stable qu'un « PC maison comme gateway IA » pour les studios qui veulent les données de juillet 2026 en production.