OpenRouter 2026 年 7 月大語言模型排行榜與中美 Token 份額變化示意

2026 年 7 月 OpenRouter 排行榜深度解析:MiMo V2.5 領跑、中國模型 46% 份額與分層路由決策指南

截至 2026 年 7 月 25 日,OpenRouter 公開排行顯示:小米 MiMo V2.5 以日均 1.4T Token 首度超越 DeepSeek V4 Flash,中國實驗室合計約 46% 份額,美國廠商維持 30–36%。本文解讀啞鈴型市場結構、應用層 Hermes/Kilo Code 真實占比,並附 Top 12 模型表、定價對照、8 月展望與五步分層路由決策矩陣。

1. 7 月榜單:MiMo V2.5 首度登頂,中國實驗室約 46% 份額

OpenRouter 彙整全球開發者真實呼叫量——不靠廠商公關稿,只看程式碼投票。數據截止 2026 年 7 月 25 日,最新榜單見 openrouter.ai/rankings

7 月最顯著變化是榜首換人:小米 MiMo V2.5 憑藉極低定價與 MoE 架構,日量從 6 月的 327B 躍升至 1.4T,超越 DeepSeek V4 Flash(943.9B)與騰訊 Hy3 Preview(590B)。中國實驗室(小米、DeepSeek、騰訊、MiniMax、Moonshot、阿里 Qwen 等)合計約 46% Token 份額;美國廠商(Anthropic、Google、OpenAI)合計約 30–36%,較 6 月略有回升——主因 Claude Opus 5 於 7 月 24 日發布後帶動旗艦用量。

2. 用量 ≠ 品質:啞鈴型市場與閉源旗艦定價權

7 月榜單呈現典型的啞鈴型(barbell)市場

  • 左端(大量低價):MiMo V2.5、DeepSeek V4 Flash、Hy3、MiniMax M3 吸收 80%+ 日常 Agent 批處理與程式碼補全,單價可低至 $0.14–0.60/M。
  • 右端(少量高價):Claude Opus 5($5/$25)、GPT-5.5 處理最難 5% 推理與長上下文任務,用量占比小但單客戶 ARPU 極高。
  • 中間地帶消失:「品質不差但價格偏貴」的模型正在被兩端擠壓——這與 6 月 Anthropic「12% Token 收 46% 金額」的剪刀差一致,只是 7 月左端主角換成了小米。

Claude Opus 5 發布後,Artificial Analysis 綜合指數仍由 Anthropic 守品質高地;MiMo V2.5 贏在經濟學而非單項 Benchmark 榜首。生產環境應兩張表並看:用量榜選預設路由,品質榜選關鍵路徑。

3. 應用層秘密:Hermes Agent 45%、Kilo Code 13% 與隱藏市場

模型榜只告訴你「哪個模型 ID 被呼叫」;App 榜openrouter.ai/apps)才反映「開發者用什麼產品」。7 月應用層結構:

  • Hermes Agent ~45%:完全開源免費,大量部署在自動化腳本、CI 與 7×24 閘道,單條流水線即可產生巨量 Token。
  • Kilo Code ~13%:多模型 IDE/CLI 主流選擇,支援 500+ 模型熱切換,是互動式編程場景的實際贏家。
  • Cline → Roo → Kilo 分叉故事:Cline 曾以安全閘門著稱,Roo Code 從其分叉強化多 Agent;Kilo Code 再吸收兩者生態,成為 OpenRouter 上成長最快的編程 CLI 之一。選型時應跟蹤產品路線而非僅看 GitHub Stars。
  • 角色扮演隱藏市場:OpenRouter 上存在大量未公開品牌的 RP App,消耗中價模型(MiniMax M3、Hy3)做長對話——這部分 Token 不進主流媒體報導,卻實實在在撐起廠商用量。

詳見本站《OpenRouter CLI 工具排行》與《OpenRouter API 接入指南》。

4. Top 12 模型、廠商份額與定價定位表

按模型排名(日均 Token,Top 12)

排名 模型 廠商 日均 Token 來源地
1MiMo V2.5小米1.4T中國
2DeepSeek V4 FlashDeepSeek943.9B中國
3Hy3 Preview騰訊590B中國
4MiniMax M3MiniMax478B中國
5Kimi K3Moonshot AI412B中國
6DeepSeek V4 ProDeepSeek335B中國
7Claude Opus 5Anthropic298B美國
8Claude Sonnet 4.6Anthropic185B美國
9Gemini 3.5 FlashGoogle168B美國
10Qwen 3.7 Max阿里142B中國
11GPT-5.5OpenAI128B美國
12GLM 5.2智譜 Z.ai115B中國

按廠商排名(週 Token 份額)

排名 廠商 來源地 週份額 代表模型
1DeepSeek中國18.2%V4 Flash / V4 Pro
2小米中國15.4%MiMo V2.5
3騰訊中國11.8%Hy3 Preview
4MiniMax中國9.1%M3
5Anthropic美國8.9%Opus 5 / Sonnet 4.6
6Moonshot AI中國7.6%Kimi K3
7Google美國6.8%Gemini 3.5 Flash
8阿里 Qwen中國5.2%Qwen 3.7 Max

中國廠商合計約 46%;美國三巨頭合計約 30–36%(隨 Opus 5 發布週波動)。

定價定位表(輸入 / 輸出,每百萬 Token)

模型 輸入定價 輸出定價 定位
MiMo V2.5$0.15/M$0.60/M極致性價比批處理
DeepSeek V4 Flash$0.14/M$0.28/MAgent 預設路由
Hy3 Preview$0.20/M$0.80/M騰訊生態整合
MiniMax M3$0.60/M$2.40/M開放權重可自部署
Kimi K3$0.50/M$2.00/M2.8T 開源權重
Claude Opus 5$5.00/M$25.00/M品質天花板
GPT-5.5$2.50/M$10.00/M工具呼叫與生態

5. 8 月趨勢預測(五項)

  1. GPT-6 發布視窗:OpenAI 高置信度窗口為 8–9 月,可能帶動美國廠商份額短期回升並觸發新一輪主備切換。
  2. Kimi K3 開源權重落地:Moonshot 計劃 7 月 27 日釋放 2.8T 權重,企業自部署與合規場景將新增一條低成本路線。
  3. DeepSeek V5 預告:開放權重、預估 1T+ 參數,可能再次改寫左端啞鈴定價地板。
  4. 定價戰加劇:MiMo V2.5 登頂後,騰訊、MiniMax 可能跟進降價;右端 Opus 5 半價策略已壓縮 Fable 5 區間。
  5. 應用層整合加速:Kilo Code 持續吸收 Cline/Roo 生態;Hermes 與 OpenClaw 在閘道層競合,CLI 榜單輪換速度將快於模型榜。

6. 三類選型痛點

  1. 只看模型周榜押寶單一廠商:MiMo V2.5 日量 1.4T 不代表你的合規場景能走中國路由;企業採購仍受資料駐留與出口管制約束。
  2. 忽視應用層與模型層的差異:Hermes 45% 是自動化滲透,Kilo 13% 才是互動式編程——把兩者混談會選錯 CLI 與硬體配置。
  3. 路由寫好了卻閘道不穩:OpenClaw 在筆電休眠後通道無回覆,再準的 7 月榜也無法兌現 ROI——須搭配常上線遠端 Mac 與 channels status --probe 驗收。

7. 五步分層路由 How-to

  1. 歸檔 7 月榜基線:記錄 Top 12 日均 Token、廠商 46%/美國 30–36% 份額、Hermes/Kilo 應用占比,建立週度對比表(可參考《OpenRouter 周榜解讀》)。
  2. 按複雜度分層:最難 5% → Claude Opus 5;日常 Agent 批處理 → MiMo V2.5 / DeepSeek V4 Flash;長文與 RP → Kimi K3 / Hy3;多模態 → Gemini 3.5 Flash。
  3. 配置 openclaw.json 主備鏈:OpenRouter 模型 ID 帶廠商前綴,SecretRef 管理 Key,429 時自動回退備模型。
  4. 部署常上線遠端 Mac 閘道openclaw gateway install + launchd 守護,工作區用 SFTP/rsync 同步。
  5. 按週複盤,8 月縮短灰度週期openclaw channels status --probe 通過後灰度;GPT-6 / Kimi K3 權重落地後 48 小時內評估主備。
# openclaw.json 分層路由範例(概念)
# primary: xiaomi/mimo-v2.5 → fallback: deepseek/deepseek-v4-flash
# premium: anthropic/claude-opus-5(僅 hard 任務觸發)
openclaw channels status --probe
openclaw doctor

8. 三類角色決策矩陣

角色 預設模型 旗艦備援 推薦 CLI/App 閘道建議
個人開發者 MiMo V2.5 + DeepSeek V4 Flash Claude Sonnet 4.6 Kilo Code 遠端 Mac mini M4 16GB
企業工程團隊 DeepSeek V4 Pro(內網)+ Kimi K3 自部署 Claude Opus 5(審計路徑) OpenClaw + 自訂 Agent Mac mini M4 Pro 32GB + launchd
自動化 / CI MiMo V2.5 / MiniMax M3 GPT-5.5(關鍵步驟) Hermes Agent 常上線節點 + SFTP 工作區同步

9. 常見問題

Q:7 月 OpenRouter 用量冠軍是 MiMo 還是 DeepSeek? 按日均 Token,MiMo V2.5(1.4T)已超越 DeepSeek V4 Flash(943.9B);按廠商週份額,DeepSeek 仍以 18.2% 略領先小米 15.4%。

Q:中國模型 46% 是否意味著品質全面領先? 不是。46% 反映性價比與 Agent 批處理滲透;Claude Opus 5 在綜合品質與長上下文仍守右端高地。

Q:該選 Hermes 還是 Kilo Code? 自動化與零成本批處理選 Hermes;互動式多模型編程選 Kilo Code。兩者 Token 占比差異大,勿混為一談。

Q:8 月最該提前準備什麼? 建好模型無關路由層,預留 GPT-6 與 Kimi K3 權重灰度窗口,並確保閘道 7×24 在線。

10. 總結:榜單輪換加速的時代,架構比押注更重要

7 月榜單的故事不是「小米打敗了 DeepSeek」,而是左端啞鈴定價持續下壓、右端旗艦以半價策略守品質。MiMo V2.5 登頂、Kimi K3 即將開源、Opus 5 剛發布——三週後榜首可能再次換人。

對開發者與技術決策者而言,最值錢的能力是構建能隨周榜調整的分層路由,而非鎖死單一模型。應用層 Hermes 與 Kilo 的分工、角色扮演隱藏市場、以及合規邊界,都應納入同一套決策框架。

若你已在 OpenClaw 上跑通多模型路由,瓶頸通常回到閘道是否 7×24 在線、工作區是否可審計同步。筆電間歇上線、Windows 休眠、低配 VPS 記憶體打滿,都會讓 7 月榜策略無法兌現。SFTPMAC 遠端 Mac 租賃提供面向 OpenClaw 與 OpenRouter 分層路由的 Apple Silicon 節點:原生 launchd 守護、低延遲回調、以及與站內 gateway / 通道 probe 專文銜接的 SFTP/rsync 同步基線——比「家用電腦兼 AI 閘道」更適合把 7 月榜策略當生產標配的團隊。