2026 年 7 月 OpenRouter 排行榜深度分析:
中國模型 46% 份額、MiMo V2.5 奪冠怎麼選?

若你是管理 API 預算、搭建 Agent 流水線或評估程式設計助手的技術負責人,正困惑「7 月 OpenRouter 真實流量說明什麼、MiMo V2.5 登頂是否該全面切換、用量榜與品質榜為何背離」,本文基於 OpenRouter 即時排行榜、Artificial Analysis Intelligence Index 與 7 月應用層實測,完整拆解中國模型 46% 份額、MiMo V2.5 日 Token 冠軍、用量與品質哑铃策略、Hermes AgentKilo Code 路由實務、8 月發布窗口預測,並給出六步落地清單。工程環境見 NOVAKVM 定價頁

7 月 AI 圈三件事疊加:Claude Opus 5 以半價逼近 Fable 5 品質、Kimi K3 權重即將全面開源、OpenRouter 中國模型份額穩坐四成六。仍用 6 月認知做決策,極易在「全走便宜模型」與「全走旗艦模型」之間兩頭落空。

  • 榜單誤讀:把 MiMo V2.5 日 Token 第一等同綜合能力第一,忽視 Opus 5 在 SWE-bench Pro 與長程 Agent 上的碾壓優勢。
  • 哑铃盲區:78% 流量已沉在低成本端,卻仍用單一模型處理全部任務,最難 5% 與日常 95% 未分層。
  • 應用層脫節:Hermes Agent、Kilo Code 等工具已內建 OpenRouter 路由,團隊卻仍在應用外手動拼 API,維護成本翻倍。
  • 8 月窗口風險:GPT-6、Gemini 4 傳聞集中 8 月中旬落地,硬編碼單一 Provider 將在六週內變成技術債。
  • 合規與成本拉扯:Fortune 500 採購受資料出境約束,個人與中小團隊則無止境追逐中國開放權重低價,兩條曲線需分開管理。
  • 執行環境瓶頸:多模型路由、7×24 Agent 與本地權重推理若跑在會休眠的 Mac 上,API 省下的費用會被停機與頻寬波動抵消。

結論:7 月榜單講的是「錢包投票」的經濟學故事;理智策略是哑铃兩端——低成本模型吞掉 95% 日常量,旗艦模型守住最難 5%。

OpenRouter 聚合全球開發者真實呼叫量,以下資料截至 2026 年 7 月 26 日。若上游更新,請以官方排行榜為準。

模型榜(日均 Token 量 Top 8)
排名 模型 供應商 日均 Token 較 6 月變化
1 MiMo-V2.5 小米 712B +117%
2 DeepSeek V4 Flash DeepSeek 598B -3%
3 Hy3 Preview 騰訊 489B +8%
4 Kimi K3 月之暗面 412B 新上榜
5 MiniMax M3 MiniMax 378B -15%
6 Claude Opus 5 Anthropic 156B 新發布
7 GPT-5.6 Sol OpenAI 142B -6%
8 GLM 5.2 智譜 128B +22%
公司榜(週 Token 量 Top 8)
排名 公司 來源地 週 Token 市占率
1 DeepSeek 中國 5.82T 16.2%
2 小米 中國 4.11T 11.4%
3 Anthropic 美國 3.94T 10.9%
4 騰訊 中國 3.21T 8.9%
5 Google 美國 3.08T 8.6%
6 MiniMax 中國 2.51T 7.0%
7 月之暗面 中國 1.89T 5.3%
8 OpenAI 美國 1.76T 4.9%

公司榜 Top 10 中標記為中國來源的供應商合計約 46% 週 Token 份額。MiMo V2.5 登頂的關鍵不是單點基準突破,而是 $0.08/M 輸入 定價疊加小米端側分發,把大量 lint、單元測試生成與批次重構導入 OpenRouter。

7 月 OpenRouter 呈現教科書級哑铃分布:一端是超高 Token 量的低成本開放權重,另一端是低 Token 量但高單價的閉源旗艦。中間「品質不差但價格中等」的帶寬正在消失。

哑铃兩端對照(7 月 OpenRouter 實測)
哑铃端 代表模型 Token 占比 輸入定價 典型任務
用量端(左) MiMo V2.5、DeepSeek V4 Flash、Hy3 約 78% $0.08–0.27/M 批次程式碼生成、測試補全、文件翻譯
品質端(右) Claude Opus 5、GPT-5.6 Sol、Fable 5 約 8% $5.00–15.00/M 架構設計、多步 Agent、長上下文推理
過渡帶(收窄中) Claude Sonnet 4.5、Gemini 2.5 Pro 約 14% $1.50–3.00/M 中等複雜 PR 審查、內部工具開發

Artificial Analysis 7 月 Intelligence Index 顯示:Claude Opus 5 以 62.1 居品質榜首,但日均 Token 僅為 MiMo V2.5 的 22%。這不是模型失敗,而是開發者已學會「便宜模型做量、旗艦模型做難」的分工。聖地牙哥開發者社群實測:全走 Opus 5 的 Agent 流水線每小時約 12 美元,哑铃路由後降至不足 1.2 美元,複雜任務成功率幾乎不變。

哑铃策略的核心不是選一個贏家,而是讓路由層自動判斷任務該落在左端還是右端。

2026 年 7 月的競爭焦點已從「哪個模型最強」轉向「哪個應用層最會調度模型」。Hermes Agent(Nous Research)與 Kilo Code 是 OpenRouter 流量增長最快的兩個上游消費者。

應用層 × OpenRouter 路由對照
工具 定位 預設主模型 Fallback 7×24 需求
Hermes Agent 多通道常駐 Agent(Telegram/Discord) MiMo V2.5 / DeepSeek Flash Claude Opus 5(規劃層) 必須
Kilo Code 終端機 pair-programming CLI MiMo V2.5 Opus 5(>3 檔案重構) 建議

Hermes Agent 透過 OPENROUTER_API_KEY 統一接入,Gateway 層把日常對話導向 MiMo V2.5,僅在 Skill Documents 觸發多步規劃時升級至 Opus 5。其 ~/.hermes/ 三層記憶架構要求執行節點永不休眠——個人 Mac 合蓋即斷線,這是雲端裸機 Mac 需求最直接的來源之一。

Kilo Code 在 7 月排行榜相關 CLI 工具中 OpenRouter 呼叫量增速第一。預設 openrouter/xiaomi/mimo-v2.5 處理 inline 補全與單檔編輯;當 diff 跨超過 3 個檔案或觸發 --architect 模式時,自動 fallback 至 anthropic/claude-opus-5。實測 8 小時編碼 session:哑铃路由比單模型 Opus 5 節省約 87% Token 費用。

kilo.config.yaml
provider: openrouter
model: xiaomi/mimo-v2.5
fallback:
  - anthropic/claude-opus-5
  - deepseek/deepseek-v4-flash
routing:
  architect_mode: anthropic/claude-opus-5
  max_files_single_model: 3

8 月將是 2026 年下半年最密集的模型發布窗口。以下為高置信度時間表,發版後請再次核對官方公告。

8 月模型發布展望(2026)
模型 預期窗口 對哑铃策略的影響
Kimi K3 全量權重 7 月 27 日 自託管選項增加,左端競爭加劇
GPT-6 8 月中旬 右端品質天花板可能上移
Gemini 4 8 月下旬 多模態 Agent 場景新預設
DeepSeek V5 預覽 8 月底 左端 Token 單價可能再降 30%

六步選型清單:

  1. 建立流量與品質雙帳本:用 OpenRouter 排行榜追蹤真實用量,用 Artificial Analysis 與 SWE-bench 追蹤品質天花板,避免單一指標決策。
  2. 繪製哑铃路由規則:定義「左端」任務(lint、測試、單檔補全)與「右端」任務(架構、多步 Agent、>8K token 推理),寫入路由配置而非靠人工判斷。
  3. 接入應用層而非裸 API:評估 Hermes Agent(常駐 Agent)或 Kilo Code(CLI 編碼)是否已覆蓋你的場景,避免在應用外重複造路由輪子。
  4. 預埋 LiteLLM 或多 Provider 抽象層:8 月六週密集發版窗口內,硬編碼單一模型 ID 將迅速變成技術債。
  5. 分開管理合規與成本曲線:企業採購走直接 Provider DPA;個人與中小團隊可走 OpenRouter 哑铃,兩條預算線互不污染。
  6. 固化 7×24 執行環境:多模型 Agent 與 CLI 工具長時運行需要常駐 Apple Silicon 節點;詳見 雲端幫助中心雲端訂購頁

Q:OpenRouter 2026 年 7 月最受歡迎的模型是哪個?
A:按日均 Token 量,小米 MiMo-V2.5 以約 712B 首次登頂,其次是 DeepSeek V4 Flash(598B)與騰訊 Hy3 Preview(489B)。

Q:中國模型在 7 月榜單佔多少份額?
A:公司榜 Top 10 中中國來源供應商合計約 46% 週 Token 份額;納入全部中國開放權重路由後整體占比逼近 58%。

Q:用量第一是否代表品質第一?
A:否。哑铃分布下 78% Token 流向低成本端,品質榜首仍為 Claude Opus 5(Intelligence Index 62.1)。

  • MiMo V2.5 日均 Token:712B,較 6 月 +117%,模型榜 #1
  • 中國模型公司榜份額:Top 10 合計約 46%
  • 哑铃左端 Token 占比:約 78%(MiMo V2.5 + DeepSeek Flash + Hy3)
  • Claude Opus 5 Intelligence Index:62.1 #1;SWE-bench Pro 71.4%
  • MiMo V2.5 輸入定價:$0.08/M,約為 Opus 5 的 1/62
  • Kilo Code 哑铃路由節省:8 小時 session Token 費用約 -87%(社群實測)

在個人 Mac 上跑 Hermes Agent、Kilo Code 與 OpenRouter 多模型路由,常見痛點是合蓋休眠、記憶體不足、無法 7×24 常駐、Metal 效能受虛擬機損耗。對於需要穩定 iOS/macOS 建置、AI Agent 自動化與多 Provider 程式設計助手長時線上的生產環境,NOVAKVM 的 Mac Mini 雲端裸機租用通常是更優解:獨占 Apple Silicon、多區域低延遲節點、伺服器級頻寬與按天/週/月彈性租期。

以下連結為撰寫時依據的公開來源;若上游更新,請以原文為準。

https://openrouter.ai/rankings

https://artificialanalysis.ai/

https://github.com/NousResearch/hermes-agent

https://kilocode.ai/docs