2026 年 7 月 OpenRouter 排行榜深度解析:MiMo V2.5 領跑、中國模型 46% 份額與分層路由決策指南
截至 2026 年 7 月 25 日,OpenRouter 公開排行顯示:小米 MiMo V2.5 以日均 1.4T Token 首度超越 DeepSeek V4 Flash,中國實驗室合計約 46% 份額,美國廠商維持 30–36%。本文解讀啞鈴型市場結構、應用層 Hermes/Kilo Code 真實占比,並附 Top 12 模型表、定價對照、8 月展望與五步分層路由決策矩陣。
1. 7 月榜單:MiMo V2.5 首度登頂,中國實驗室約 46% 份額
OpenRouter 彙整全球開發者真實呼叫量——不靠廠商公關稿,只看程式碼投票。數據截止 2026 年 7 月 25 日,最新榜單見 openrouter.ai/rankings。
7 月最顯著變化是榜首換人:小米 MiMo V2.5 憑藉極低定價與 MoE 架構,日量從 6 月的 327B 躍升至 1.4T,超越 DeepSeek V4 Flash(943.9B)與騰訊 Hy3 Preview(590B)。中國實驗室(小米、DeepSeek、騰訊、MiniMax、Moonshot、阿里 Qwen 等)合計約 46% Token 份額;美國廠商(Anthropic、Google、OpenAI)合計約 30–36%,較 6 月略有回升——主因 Claude Opus 5 於 7 月 24 日發布後帶動旗艦用量。
2. 用量 ≠ 品質:啞鈴型市場與閉源旗艦定價權
7 月榜單呈現典型的啞鈴型(barbell)市場:
- 左端(大量低價):MiMo V2.5、DeepSeek V4 Flash、Hy3、MiniMax M3 吸收 80%+ 日常 Agent 批處理與程式碼補全,單價可低至 $0.14–0.60/M。
- 右端(少量高價):Claude Opus 5($5/$25)、GPT-5.5 處理最難 5% 推理與長上下文任務,用量占比小但單客戶 ARPU 極高。
- 中間地帶消失:「品質不差但價格偏貴」的模型正在被兩端擠壓——這與 6 月 Anthropic「12% Token 收 46% 金額」的剪刀差一致,只是 7 月左端主角換成了小米。
Claude Opus 5 發布後,Artificial Analysis 綜合指數仍由 Anthropic 守品質高地;MiMo V2.5 贏在經濟學而非單項 Benchmark 榜首。生產環境應兩張表並看:用量榜選預設路由,品質榜選關鍵路徑。
3. 應用層秘密:Hermes Agent 45%、Kilo Code 13% 與隱藏市場
模型榜只告訴你「哪個模型 ID 被呼叫」;App 榜(openrouter.ai/apps)才反映「開發者用什麼產品」。7 月應用層結構:
- Hermes Agent ~45%:完全開源免費,大量部署在自動化腳本、CI 與 7×24 閘道,單條流水線即可產生巨量 Token。
- Kilo Code ~13%:多模型 IDE/CLI 主流選擇,支援 500+ 模型熱切換,是互動式編程場景的實際贏家。
- Cline → Roo → Kilo 分叉故事:Cline 曾以安全閘門著稱,Roo Code 從其分叉強化多 Agent;Kilo Code 再吸收兩者生態,成為 OpenRouter 上成長最快的編程 CLI 之一。選型時應跟蹤產品路線而非僅看 GitHub Stars。
- 角色扮演隱藏市場:OpenRouter 上存在大量未公開品牌的 RP App,消耗中價模型(MiniMax M3、Hy3)做長對話——這部分 Token 不進主流媒體報導,卻實實在在撐起廠商用量。
詳見本站《OpenRouter CLI 工具排行》與《OpenRouter API 接入指南》。
4. Top 12 模型、廠商份額與定價定位表
按模型排名(日均 Token,Top 12)
| 排名 | 模型 | 廠商 | 日均 Token | 來源地 |
|---|---|---|---|---|
| 1 | MiMo V2.5 | 小米 | 1.4T | 中國 |
| 2 | DeepSeek V4 Flash | DeepSeek | 943.9B | 中國 |
| 3 | Hy3 Preview | 騰訊 | 590B | 中國 |
| 4 | MiniMax M3 | MiniMax | 478B | 中國 |
| 5 | Kimi K3 | Moonshot AI | 412B | 中國 |
| 6 | DeepSeek V4 Pro | DeepSeek | 335B | 中國 |
| 7 | Claude Opus 5 | Anthropic | 298B | 美國 |
| 8 | Claude Sonnet 4.6 | Anthropic | 185B | 美國 |
| 9 | Gemini 3.5 Flash | 168B | 美國 | |
| 10 | Qwen 3.7 Max | 阿里 | 142B | 中國 |
| 11 | GPT-5.5 | OpenAI | 128B | 美國 |
| 12 | GLM 5.2 | 智譜 Z.ai | 115B | 中國 |
按廠商排名(週 Token 份額)
| 排名 | 廠商 | 來源地 | 週份額 | 代表模型 |
|---|---|---|---|---|
| 1 | DeepSeek | 中國 | 18.2% | V4 Flash / V4 Pro |
| 2 | 小米 | 中國 | 15.4% | MiMo V2.5 |
| 3 | 騰訊 | 中國 | 11.8% | Hy3 Preview |
| 4 | MiniMax | 中國 | 9.1% | M3 |
| 5 | Anthropic | 美國 | 8.9% | Opus 5 / Sonnet 4.6 |
| 6 | Moonshot AI | 中國 | 7.6% | Kimi K3 |
| 7 | 美國 | 6.8% | Gemini 3.5 Flash | |
| 8 | 阿里 Qwen | 中國 | 5.2% | Qwen 3.7 Max |
中國廠商合計約 46%;美國三巨頭合計約 30–36%(隨 Opus 5 發布週波動)。
定價定位表(輸入 / 輸出,每百萬 Token)
| 模型 | 輸入定價 | 輸出定價 | 定位 |
|---|---|---|---|
| MiMo V2.5 | $0.15/M | $0.60/M | 極致性價比批處理 |
| DeepSeek V4 Flash | $0.14/M | $0.28/M | Agent 預設路由 |
| Hy3 Preview | $0.20/M | $0.80/M | 騰訊生態整合 |
| MiniMax M3 | $0.60/M | $2.40/M | 開放權重可自部署 |
| Kimi K3 | $0.50/M | $2.00/M | 2.8T 開源權重 |
| Claude Opus 5 | $5.00/M | $25.00/M | 品質天花板 |
| GPT-5.5 | $2.50/M | $10.00/M | 工具呼叫與生態 |
5. 8 月趨勢預測(五項)
- GPT-6 發布視窗:OpenAI 高置信度窗口為 8–9 月,可能帶動美國廠商份額短期回升並觸發新一輪主備切換。
- Kimi K3 開源權重落地:Moonshot 計劃 7 月 27 日釋放 2.8T 權重,企業自部署與合規場景將新增一條低成本路線。
- DeepSeek V5 預告:開放權重、預估 1T+ 參數,可能再次改寫左端啞鈴定價地板。
- 定價戰加劇:MiMo V2.5 登頂後,騰訊、MiniMax 可能跟進降價;右端 Opus 5 半價策略已壓縮 Fable 5 區間。
- 應用層整合加速:Kilo Code 持續吸收 Cline/Roo 生態;Hermes 與 OpenClaw 在閘道層競合,CLI 榜單輪換速度將快於模型榜。
6. 三類選型痛點
- 只看模型周榜押寶單一廠商:MiMo V2.5 日量 1.4T 不代表你的合規場景能走中國路由;企業採購仍受資料駐留與出口管制約束。
- 忽視應用層與模型層的差異:Hermes 45% 是自動化滲透,Kilo 13% 才是互動式編程——把兩者混談會選錯 CLI 與硬體配置。
- 路由寫好了卻閘道不穩:OpenClaw 在筆電休眠後通道無回覆,再準的 7 月榜也無法兌現 ROI——須搭配常上線遠端 Mac 與
channels status --probe驗收。
7. 五步分層路由 How-to
- 歸檔 7 月榜基線:記錄 Top 12 日均 Token、廠商 46%/美國 30–36% 份額、Hermes/Kilo 應用占比,建立週度對比表(可參考《OpenRouter 周榜解讀》)。
- 按複雜度分層:最難 5% → Claude Opus 5;日常 Agent 批處理 → MiMo V2.5 / DeepSeek V4 Flash;長文與 RP → Kimi K3 / Hy3;多模態 → Gemini 3.5 Flash。
- 配置 openclaw.json 主備鏈:OpenRouter 模型 ID 帶廠商前綴,SecretRef 管理 Key,429 時自動回退備模型。
- 部署常上線遠端 Mac 閘道:
openclaw gateway install+ launchd 守護,工作區用 SFTP/rsync 同步。 - 按週複盤,8 月縮短灰度週期:
openclaw channels status --probe通過後灰度;GPT-6 / Kimi K3 權重落地後 48 小時內評估主備。
# openclaw.json 分層路由範例(概念)
# primary: xiaomi/mimo-v2.5 → fallback: deepseek/deepseek-v4-flash
# premium: anthropic/claude-opus-5(僅 hard 任務觸發)
openclaw channels status --probe
openclaw doctor
8. 三類角色決策矩陣
| 角色 | 預設模型 | 旗艦備援 | 推薦 CLI/App | 閘道建議 |
|---|---|---|---|---|
| 個人開發者 | MiMo V2.5 + DeepSeek V4 Flash | Claude Sonnet 4.6 | Kilo Code | 遠端 Mac mini M4 16GB |
| 企業工程團隊 | DeepSeek V4 Pro(內網)+ Kimi K3 自部署 | Claude Opus 5(審計路徑) | OpenClaw + 自訂 Agent | Mac mini M4 Pro 32GB + launchd |
| 自動化 / CI | MiMo V2.5 / MiniMax M3 | GPT-5.5(關鍵步驟) | Hermes Agent | 常上線節點 + SFTP 工作區同步 |
9. 常見問題
Q:7 月 OpenRouter 用量冠軍是 MiMo 還是 DeepSeek? 按日均 Token,MiMo V2.5(1.4T)已超越 DeepSeek V4 Flash(943.9B);按廠商週份額,DeepSeek 仍以 18.2% 略領先小米 15.4%。
Q:中國模型 46% 是否意味著品質全面領先? 不是。46% 反映性價比與 Agent 批處理滲透;Claude Opus 5 在綜合品質與長上下文仍守右端高地。
Q:該選 Hermes 還是 Kilo Code? 自動化與零成本批處理選 Hermes;互動式多模型編程選 Kilo Code。兩者 Token 占比差異大,勿混為一談。
Q:8 月最該提前準備什麼? 建好模型無關路由層,預留 GPT-6 與 Kimi K3 權重灰度窗口,並確保閘道 7×24 在線。
10. 總結:榜單輪換加速的時代,架構比押注更重要
7 月榜單的故事不是「小米打敗了 DeepSeek」,而是左端啞鈴定價持續下壓、右端旗艦以半價策略守品質。MiMo V2.5 登頂、Kimi K3 即將開源、Opus 5 剛發布——三週後榜首可能再次換人。
對開發者與技術決策者而言,最值錢的能力是構建能隨周榜調整的分層路由,而非鎖死單一模型。應用層 Hermes 與 Kilo 的分工、角色扮演隱藏市場、以及合規邊界,都應納入同一套決策框架。
若你已在 OpenClaw 上跑通多模型路由,瓶頸通常回到閘道是否 7×24 在線、工作區是否可審計同步。筆電間歇上線、Windows 休眠、低配 VPS 記憶體打滿,都會讓 7 月榜策略無法兌現。SFTPMAC 遠端 Mac 租賃提供面向 OpenClaw 與 OpenRouter 分層路由的 Apple Silicon 節點:原生 launchd 守護、低延遲回調、以及與站內 gateway / 通道 probe 專文銜接的 SFTP/rsync 同步基線——比「家用電腦兼 AI 閘道」更適合把 7 月榜策略當生產標配的團隊。