若你是管理 API 預算、搭建 Agent 流水線或評估程式設計助手的技術負責人,正困惑「7 月 OpenRouter 真實流量說明什麼、MiMo V2.5 登頂是否該全面切換、用量榜與品質榜為何背離」,本文基於 OpenRouter 即時排行榜、Artificial Analysis Intelligence Index 與 7 月應用層實測,完整拆解中國模型 46% 份額、MiMo V2.5 日 Token 冠軍、用量與品質哑铃策略、Hermes Agent 與 Kilo Code 路由實務、8 月發布窗口預測,並給出六步落地清單。工程環境見 NOVAKVM 定價頁。
[ SECTION_01 ] // PAIN_POINTS 為什麼 2026 年 7 月的 OpenRouter 資料要重寫你的模型路由?
7 月 AI 圈三件事疊加:Claude Opus 5 以半價逼近 Fable 5 品質、Kimi K3 權重即將全面開源、OpenRouter 中國模型份額穩坐四成六。仍用 6 月認知做決策,極易在「全走便宜模型」與「全走旗艦模型」之間兩頭落空。
- 榜單誤讀:把 MiMo V2.5 日 Token 第一等同綜合能力第一,忽視 Opus 5 在 SWE-bench Pro 與長程 Agent 上的碾壓優勢。
- 哑铃盲區:78% 流量已沉在低成本端,卻仍用單一模型處理全部任務,最難 5% 與日常 95% 未分層。
- 應用層脫節:Hermes Agent、Kilo Code 等工具已內建 OpenRouter 路由,團隊卻仍在應用外手動拼 API,維護成本翻倍。
- 8 月窗口風險:GPT-6、Gemini 4 傳聞集中 8 月中旬落地,硬編碼單一 Provider 將在六週內變成技術債。
- 合規與成本拉扯:Fortune 500 採購受資料出境約束,個人與中小團隊則無止境追逐中國開放權重低價,兩條曲線需分開管理。
- 執行環境瓶頸:多模型路由、7×24 Agent 與本地權重推理若跑在會休眠的 Mac 上,API 省下的費用會被停機與頻寬波動抵消。
結論:7 月榜單講的是「錢包投票」的經濟學故事;理智策略是哑铃兩端——低成本模型吞掉 95% 日常量,旗艦模型守住最難 5%。
[ SECTION_02 ] // RANKINGS OpenRouter 2026 年 7 月榜單:MiMo V2.5 登頂與中國 46% 份額
OpenRouter 聚合全球開發者真實呼叫量,以下資料截至 2026 年 7 月 26 日。若上游更新,請以官方排行榜為準。
| 排名 | 模型 | 供應商 | 日均 Token | 較 6 月變化 |
|---|---|---|---|---|
| 1 | MiMo-V2.5 | 小米 | 712B | +117% |
| 2 | DeepSeek V4 Flash | DeepSeek | 598B | -3% |
| 3 | Hy3 Preview | 騰訊 | 489B | +8% |
| 4 | Kimi K3 | 月之暗面 | 412B | 新上榜 |
| 5 | MiniMax M3 | MiniMax | 378B | -15% |
| 6 | Claude Opus 5 | Anthropic | 156B | 新發布 |
| 7 | GPT-5.6 Sol | OpenAI | 142B | -6% |
| 8 | GLM 5.2 | 智譜 | 128B | +22% |
| 排名 | 公司 | 來源地 | 週 Token | 市占率 |
|---|---|---|---|---|
| 1 | DeepSeek | 中國 | 5.82T | 16.2% |
| 2 | 小米 | 中國 | 4.11T | 11.4% |
| 3 | Anthropic | 美國 | 3.94T | 10.9% |
| 4 | 騰訊 | 中國 | 3.21T | 8.9% |
| 5 | 美國 | 3.08T | 8.6% | |
| 6 | MiniMax | 中國 | 2.51T | 7.0% |
| 7 | 月之暗面 | 中國 | 1.89T | 5.3% |
| 8 | OpenAI | 美國 | 1.76T | 4.9% |
公司榜 Top 10 中標記為中國來源的供應商合計約 46% 週 Token 份額。MiMo V2.5 登頂的關鍵不是單點基準突破,而是 $0.08/M 輸入 定價疊加小米端側分發,把大量 lint、單元測試生成與批次重構導入 OpenRouter。
[ SECTION_03 ] // BARBELL 用量與品質哑铃:為什麼流量冠軍與品質冠軍永遠是兩個人?
7 月 OpenRouter 呈現教科書級哑铃分布:一端是超高 Token 量的低成本開放權重,另一端是低 Token 量但高單價的閉源旗艦。中間「品質不差但價格中等」的帶寬正在消失。
| 哑铃端 | 代表模型 | Token 占比 | 輸入定價 | 典型任務 |
|---|---|---|---|---|
| 用量端(左) | MiMo V2.5、DeepSeek V4 Flash、Hy3 | 約 78% | $0.08–0.27/M | 批次程式碼生成、測試補全、文件翻譯 |
| 品質端(右) | Claude Opus 5、GPT-5.6 Sol、Fable 5 | 約 8% | $5.00–15.00/M | 架構設計、多步 Agent、長上下文推理 |
| 過渡帶(收窄中) | Claude Sonnet 4.5、Gemini 2.5 Pro | 約 14% | $1.50–3.00/M | 中等複雜 PR 審查、內部工具開發 |
Artificial Analysis 7 月 Intelligence Index 顯示:Claude Opus 5 以 62.1 居品質榜首,但日均 Token 僅為 MiMo V2.5 的 22%。這不是模型失敗,而是開發者已學會「便宜模型做量、旗艦模型做難」的分工。聖地牙哥開發者社群實測:全走 Opus 5 的 Agent 流水線每小時約 12 美元,哑铃路由後降至不足 1.2 美元,複雜任務成功率幾乎不變。
哑铃策略的核心不是選一個贏家,而是讓路由層自動判斷任務該落在左端還是右端。
[ SECTION_04 ] // APPS_LAYER 應用層實戰:Hermes Agent 與 Kilo Code 如何吃掉 OpenRouter 路由?
2026 年 7 月的競爭焦點已從「哪個模型最強」轉向「哪個應用層最會調度模型」。Hermes Agent(Nous Research)與 Kilo Code 是 OpenRouter 流量增長最快的兩個上游消費者。
| 工具 | 定位 | 預設主模型 | Fallback | 7×24 需求 |
|---|---|---|---|---|
| Hermes Agent | 多通道常駐 Agent(Telegram/Discord) | MiMo V2.5 / DeepSeek Flash | Claude Opus 5(規劃層) | 必須 |
| Kilo Code | 終端機 pair-programming CLI | MiMo V2.5 | Opus 5(>3 檔案重構) | 建議 |
Hermes Agent 透過 OPENROUTER_API_KEY 統一接入,Gateway 層把日常對話導向 MiMo V2.5,僅在 Skill Documents 觸發多步規劃時升級至 Opus 5。其 ~/.hermes/ 三層記憶架構要求執行節點永不休眠——個人 Mac 合蓋即斷線,這是雲端裸機 Mac 需求最直接的來源之一。
Kilo Code 在 7 月排行榜相關 CLI 工具中 OpenRouter 呼叫量增速第一。預設 openrouter/xiaomi/mimo-v2.5 處理 inline 補全與單檔編輯;當 diff 跨超過 3 個檔案或觸發 --architect 模式時,自動 fallback 至 anthropic/claude-opus-5。實測 8 小時編碼 session:哑铃路由比單模型 Opus 5 節省約 87% Token 費用。
provider: openrouter
model: xiaomi/mimo-v2.5
fallback:
- anthropic/claude-opus-5
- deepseek/deepseek-v4-flash
routing:
architect_mode: anthropic/claude-opus-5
max_files_single_model: 3
[ SECTION_05 ] // OUTLOOK_PLAYBOOK 8 月展望、六步選型清單、FAQ 與可引用資料
8 月將是 2026 年下半年最密集的模型發布窗口。以下為高置信度時間表,發版後請再次核對官方公告。
| 模型 | 預期窗口 | 對哑铃策略的影響 |
|---|---|---|
| Kimi K3 全量權重 | 7 月 27 日 | 自託管選項增加,左端競爭加劇 |
| GPT-6 | 8 月中旬 | 右端品質天花板可能上移 |
| Gemini 4 | 8 月下旬 | 多模態 Agent 場景新預設 |
| DeepSeek V5 預覽 | 8 月底 | 左端 Token 單價可能再降 30% |
六步選型清單:
- 建立流量與品質雙帳本:用 OpenRouter 排行榜追蹤真實用量,用 Artificial Analysis 與 SWE-bench 追蹤品質天花板,避免單一指標決策。
- 繪製哑铃路由規則:定義「左端」任務(lint、測試、單檔補全)與「右端」任務(架構、多步 Agent、>8K token 推理),寫入路由配置而非靠人工判斷。
- 接入應用層而非裸 API:評估 Hermes Agent(常駐 Agent)或 Kilo Code(CLI 編碼)是否已覆蓋你的場景,避免在應用外重複造路由輪子。
- 預埋 LiteLLM 或多 Provider 抽象層:8 月六週密集發版窗口內,硬編碼單一模型 ID 將迅速變成技術債。
- 分開管理合規與成本曲線:企業採購走直接 Provider DPA;個人與中小團隊可走 OpenRouter 哑铃,兩條預算線互不污染。
- 固化 7×24 執行環境:多模型 Agent 與 CLI 工具長時運行需要常駐 Apple Silicon 節點;詳見 雲端幫助中心與 雲端訂購頁。
Q:OpenRouter 2026 年 7 月最受歡迎的模型是哪個?
A:按日均 Token 量,小米 MiMo-V2.5 以約 712B 首次登頂,其次是 DeepSeek V4 Flash(598B)與騰訊 Hy3 Preview(489B)。
Q:中國模型在 7 月榜單佔多少份額?
A:公司榜 Top 10 中中國來源供應商合計約 46% 週 Token 份額;納入全部中國開放權重路由後整體占比逼近 58%。
Q:用量第一是否代表品質第一?
A:否。哑铃分布下 78% Token 流向低成本端,品質榜首仍為 Claude Opus 5(Intelligence Index 62.1)。
- MiMo V2.5 日均 Token:712B,較 6 月 +117%,模型榜 #1
- 中國模型公司榜份額:Top 10 合計約 46%
- 哑铃左端 Token 占比:約 78%(MiMo V2.5 + DeepSeek Flash + Hy3)
- Claude Opus 5 Intelligence Index:62.1 #1;SWE-bench Pro 71.4%
- MiMo V2.5 輸入定價:$0.08/M,約為 Opus 5 的 1/62
- Kilo Code 哑铃路由節省:8 小時 session Token 費用約 -87%(社群實測)
在個人 Mac 上跑 Hermes Agent、Kilo Code 與 OpenRouter 多模型路由,常見痛點是合蓋休眠、記憶體不足、無法 7×24 常駐、Metal 效能受虛擬機損耗。對於需要穩定 iOS/macOS 建置、AI Agent 自動化與多 Provider 程式設計助手長時線上的生產環境,NOVAKVM 的 Mac Mini 雲端裸機租用通常是更優解:獨占 Apple Silicon、多區域低延遲節點、伺服器級頻寬與按天/週/月彈性租期。
以下連結為撰寫時依據的公開來源;若上游更新,請以原文為準。
https://openrouter.ai/rankings
https://artificialanalysis.ai/