Рейтинг OpenRouter июль 2026: MiMo V2.5 — 1,4T токенов/день, штанговая структура рынка и маршрутизация
На 25 июля 2026 OpenRouter фиксирует перелом: MiMo V2.5 (Xiaomi) обгоняет DeepSeek V4 Flash с 1,4T токенов/день — не потому что это сильнейшая модель, а потому что субсидия и agent batch throughput доминируют в billing truth. Этот hardcore-разбор июльских рейтингов (Top-12, vendor share, app-слой, pricing) даёт tiered routing matrix для OpenClaw-шлюзов на удалённых Mac-нодах с Apple Silicon и Metal.
1. Top-12 моделей по дневному объёму токенов (срез 25.07.2026)
OpenRouter агрегирует production API calls глобально — не marketing deck, а голосование кодом. Live data: openrouter.ai/rankings.
| # | Модель | Вендор | Страна | Токенов/день | OpenRouter ID (пример) |
|---|---|---|---|---|---|
| 1 | MiMo V2.5 | Xiaomi | CN | 1,40T | xiaomi/mimo-v2.5 |
| 2 | DeepSeek V4 Flash | DeepSeek | CN | 943,9B | deepseek/deepseek-v4-flash |
| 3 | Hy3 Preview | Tencent | CN | 590B | tencent/hy3-preview |
| 4 | MiniMax M3 | MiniMax | CN | 512B | minimax/minimax-m3 |
| 5 | DeepSeek V4 Pro | DeepSeek | CN | 445B | deepseek/deepseek-v4-pro |
| 6 | Kimi K3 | Moonshot AI | CN | 398B | moonshot/kimi-k3 |
| 7 | Claude Opus 5 | Anthropic | US | 362B | anthropic/claude-opus-5 |
| 8 | Claude Sonnet 4.6 | Anthropic | US | 295B | anthropic/claude-sonnet-4.6 |
| 9 | Gemini 3.5 Flash | US | 271B | google/gemini-3.5-flash | |
| 10 | Claude Opus 4.8 | Anthropic | US | 248B | anthropic/claude-opus-4.8 |
| 11 | Qwen 3.7 Max | Alibaba | CN | 223B | alibaba/qwen-3.7-max |
| 12 | Grok 4.3 | xAI | US | 198B | x-ai/grok-4.3 |
Июльский скачок MiMo V2.5 — не quality signal. Xiaomi агрессивно субсидирует API pricing, чтобы перетянуть agent pipelines с DeepSeek. Сравнение с июнем: DeepSeek V4 Flash лидировал с 619B; MiMo был на 327B. За четыре недели Xiaomi удвоил объём.
Техническая деталь: MiMo V2.5 использует mixture-of-experts с ~180B активных параметров на forward pass при полном размере ~400B — это объясняет низкую latency при высоком throughput, критичном для cron-driven agent loops.
2. Доли вендоров: Китай ~46%, США 30–36%
Недельный объём токенов по компаниям (неделя 29 июля, 25.07.2026):
| # | Компания | Страна | Токенов/нед | Доля | Δ к июню |
|---|---|---|---|---|---|
| 1 | DeepSeek | CN | 5,42T | 16,1% | −1,5 п.п. |
| 2 | Anthropic | US | 4,78T | 14,2% | −0,6 п.п. |
| 3 | Xiaomi | CN | 3,71T | 11,0% | +2,7 п.п. |
| 4 | US | 3,55T | 10,5% | −2,0 п.п. | |
| 5 | Tencent | CN | 3,01T | 8,9% | +0,8 п.п. |
| 6 | OpenAI | US | 2,74T | 8,1% | −0,3 п.п. |
| 7 | MiniMax | CN | 2,49T | 7,4% | −0,7 п.п. |
| 8 | Moonshot AI | CN | 1,74T | 5,2% | +3,2 п.п. |
Китайские вендоры в Top-8 суммарно ~46%; US (Anthropic + Google + OpenAI) — 32,8%, в коридоре 30–36%, который Bloomberg и Exponential View отслеживают с июня. Ключевой инсайт: Xiaomi и Moonshot — fastest growers, не DeepSeek.
3. Штанговая структура: usage ≠ capability
Июльский рынок имеет чёткую barbell structure — два тяжёлых конца, тонкая середина:
- Левый конец (volume tier): MiMo V2.5, DeepSeek V4 Flash, Hy3 — субсидированные commodity prices, 80–90% frontier quality на coding assistance, translation, summarization. Agent batch и cron jobs доминируют.
- Правый конец (premium tier): Claude Opus 5, GPT-5.6, Gemini 3.1 Pro — highest benchmarks, дорого, для тяжелейших 5% tasks. Artificial Analysis Index: Opus 5 ~62,1 (#1 с 24.07.), SWE-bench Verified ~71,4%.
- Тонкая середина: Sonnet 4.6, Qwen 3.7 Max теряют с обеих сторон — недостаточно дёшевы для batch, недостаточно сильны для frontier.
Читать только token table → выбирают MiMo. Читать только benchmarks → выбирают Opus 5. Production нужны обе плюс routing layer, который автоматически assign complexity.
// Пример tiered routing в openclaw.json (упрощённо)
{
"models": {
"default": "openrouter/xiaomi/mimo-v2.5",
"fallbacks": [
"openrouter/deepseek/deepseek-v4-flash",
"openrouter/anthropic/claude-opus-5"
],
"tierRules": {
"contextTokens > 200000": "openrouter/moonshot/kimi-k3",
"taskComplexity > 0.85": "openrouter/anthropic/claude-opus-5"
}
}
}
4. App-слой: Hermes 45%, coding-агенты доминируют
Model ranking — половина истории. OpenRouter измеряет app volume — какой tool сжигает токены:
| # | App / Tool | Доля app volume | Тип | Типичный RTT impact |
|---|---|---|---|---|
| 1 | Hermes Agent | 45% | Automation / cron | Низкий (batch) |
| 2 | Open WebUI | 18% | Chat UI | Средний |
| 3 | Kilo Code | 13% | CLI coding agent | Высокий (interactive) |
| 4 | Claude Code | 9% | CLI coding agent | Высокий |
| 5 | Cline / Roo Code | 6% | IDE agent | Средний |
| 6 | Aider | 4% | Git CLI | Низкий |
| 7 | Прочие | 5% | — | — |
Coding agents (Hermes + Kilo + Claude Code + Cline + Aider) — 77%+ измеряемого app volume. Скрытый volume: roleplay и consumer chat часто идут через generic Open WebUI instances или custom proxies — OpenRouter считает их под «Прочие» или Open WebUI, не как отдельную категорию. Это смещает model ranking вверх к дешёвым китайским моделям.
Platform implication: Hermes в cron с Opus 5 вместо MiMo может умножить monthly bill на ×10–×78. Routing strategy должна учитывать app layer + model layer jointly — см. CLI рейтинг июня.
5. Сравнение цен июльских топ-моделей
| Модель | Input $/M | Output $/M | 1h agent cost* | TCO vs Opus 5 |
|---|---|---|---|---|
| MiMo V2.5 | $0,08 | $0,32 | ~$0,18 | ×0,013 |
| DeepSeek V4 Flash | $0,14 | $0,28 | ~$0,24 | ×0,017 |
| Hy3 Preview | $0,45 | $1,80 | ~$1,10 | ×0,079 |
| MiniMax M3 | $0,60 | $2,40 | ~$1,45 | ×0,104 (self-host → ~$0) |
| Kimi K3 | $3,00 | $15,00 | ~$8,50 | ×0,607 |
| Claude Opus 5 | $5,00 | $25,00 | ~$14,00 | ×1,000 (baseline) |
| Claude Sonnet 4.6 | $3,00 | $15,00 | ~$8,50 | ×0,607 |
| GPT-5.6 | $2,50 | $10,00 | ~$5,80 | ×0,414 |
*Assumption: 500K input + 200K output per hour agent batch. MiMo vs Opus 5: cost gap ~×78 при comparable throughput на standard coding tasks. Для 10M tokens/day agent fleet: MiMo ~$1,400/mo vs Opus 5 ~$109,000/mo.
6. Четыре типичные ошибки маршрутизации
- Token champion = quality champion: MiMo V2.5 с 1,4T/день — subsidy success, не benchmark leadership. Opus 5 лидирует quality; MiMo — economics.
- Single-model routing без fallback chain: один 429 или price hike после subsidy end кладёт pipeline. OpenClaw нужен primary + два fallbacks per tier.
- Игнорирование app layer: Hermes cron на Opus 5 вместо MiMo — monthly bill ×10. Tool choice и model choice coupled.
- Отсутствие hybrid local/cloud split: sensitive data через OpenRouter без data residency audit; MiniMax M3 / Kimi K3 open weights (HF 27.07.) позволяют local Ollama на Apple Silicon remote Mac — но только с documented self-hosting.
7. Пять прогнозов на август 2026
- MiMo subsidy window закрывается: Xiaomi, вероятно, поднимет цены на 30–50% после августа — MiMo-only teams нужен DeepSeek fallback до 15.08.
- Opus 5 поглощает premium coding от Opus 4.8: за 30 дней после release (24.07.) Opus 5 должен держать >60% Anthropic volume.
- OpenRouter split app leaderboard: coding vs roleplay vs automation — hidden RP volume станет visible.
- DeepSeek V4 Flash остаётся #2, margins падают: конкуренция с MiMo форсирует price cuts; commodity margin → zero.
- GPT-6 preview routes mid-August: первые
openrouter/openai/gpt-6-previewIDs в grey zone — model-agnostic routing layer mandatory.
8. Пять шагов: tiered model routing
- Зафиксировать июльскую baseline: Top-12, vendor shares, app layer — сравнить с июньским рейтингом.
- Определить complexity tiers: Tier 0 (batch/cron) → MiMo V2.5 / DeepSeek V4 Flash; Tier 1 (daily coding) → Kimi K3 / MiniMax M3; Tier 2 (complex agents) → Claude Opus 5; Tier 3 (long context) → Kimi K3 1M; Tier S (sensitive data) → local Ollama on remote Mac.
- openclaw.json primary/fallback: OpenRouter IDs с vendor prefix, SecretRef, 429 fallback — 429 triage.
- 24/7 remote Mac:
openclaw gateway install+ launchd; workspace SFTP/rsync с audit trail; Metal unified memory для local Ollama sidecar. - Monthly review: после
channels status --probeтестировать новые модели; august grey zone (MiMo pricing, GPT-6 preview) оценить за 48h.
9. FAQ
В: Token champion июля — MiMo или DeepSeek? По volume MiMo V2.5 (1,4T); по quality index Opus 5 (~62,1). Production нужна tiered matrix, не single winner.
В: Стоит ли Kimi K3 при более высокой цене? Для long context (1M) и complex reasoning — да, 398B/день показывают adoption. Для batch cron: MiMo или DeepSeek.
В: Как совместить OpenRouter с local Ollama? Tier S (PII/regulated) → local Ollama на Apple Silicon remote Mac; Tier 0–2 → OpenRouter с fallback chain. Разные SecretRef, один launchd guard.
В: Почему Hermes продолжает расти? Free + open source + cron-ready. Каждый новый automation job добавляет billions tokens — независимо от модели.
10. Вывод: штанга бьёт single model — инфраструктура бьёт всё
Июльская story — не «Xiaomi победил», а compression commodity margin. MiMo доказал: volume покупается; quality маршрутизируется. US vendors держат premium peak — Anthropic с Opus 5, Google с Gemini 3.5 Flash.
Ценно умение переключать tier в любой момент. Август ещё плотнее этот risk.
Когда OpenClaw routing работает, bottleneck — gateway uptime и auditable workspace. Laptop sleep, Windows hibernate, OOM на VPS — ROI ranking strategy обнуляется. SFTPMAC — Apple Silicon remote Mac nodes под OpenClaw: launchd guard, low-latency OpenRouter callback, SFTP/rsync baseline, Metal для local Ollama sidecar. Стабильнее «домашний ПК как AI gateway» для команд, которые хотят июльские метрики в production, а не в slide deck.