API予算管理、Agentパイプライン構築、コーディングアシスタント選定を担う技術責任者の方が、「7月の OpenRouter 実トラフィックが何を意味するか」「MiMo V2.5 首位で全面切替すべきか」「使用量ランキングと品質ランキングがなぜ乖離するか」に迷う場面は増えています。本稿は OpenRouter ライブランキング、Artificial Analysis Intelligence Index、7月のアプリ層実測に基づき、中国モデル 46% シェア、MiMo V2.5 の日次Token首位、用量×品質ダンベル戦略、Hermes Agent と Kilo Code のルーティング実務、8月リリース展望、六ステップ実装チェックリストをまとめます。環境構築は NOVAKVM 料金ページをご参照ください。
[ SECTION_01 ] // PAIN_POINTS 2026年7月の OpenRouter データがモデルルーティングを書き換える理由
7月は三件が重なりました。Claude Opus 5 が半額で Fable 5 に近い品質、Kimi K3 重みの全面オープンソース化が間近、OpenRouter で中国モデルシェアが46%に定着。6月の認識のまま判断すると、安価モデル一辺倒と旗艦モデル一辺倒の両方で損をしやすくなります。
- ランキングの誤読:MiMo V2.5 の日次Token 1位を総合能力1位と同一視し、Opus 5 の SWE-bench Pro と長期 Agent での優位を見落とす。
- ダンベルの盲点:約78%のトラフィックが低コスト側に沈んでいるのに、単一モデルで全タスクを処理し、最難5%と日常95%が未分離。
- アプリ層との乖離:Hermes Agent や Kilo Code は OpenRouter ルーティングを内蔵しているのに、チームがアプリ外で API を手組みし、保守コストが倍増。
- 8月ウィンドウリスク:GPT-6 と Gemini 4 が8月中旬に集中リリースされる見込みで、単一 Provider のハードコードは六週間で技術的負債化。
- コンプライアンスとコストの綱引き:大企業調達はデータ越境制約、個人・中小チームは中国オープンウェイトの低価格追従——二つの曲線を分けて管理する必要があります。
- 実行環境のボトルネック:マルチモデルルーティングと7×24 Agent をスリープする Mac で回すと、API節約がダウンタイムと帯域変動で相殺されます。
結論:7月ランキングは「財布による投票」の経済学の話です。合理的戦略はダンベル両端——低コストモデルが95%の日常量を、旗艦モデルが最難5%を担うことです。
[ SECTION_02 ] // RANKINGS OpenRouter 2026年7月ランキング:MiMo V2.5 首位と中国46%シェア
OpenRouter は世界中の開発者の実呼び出し量を集計します。以下は2026年7月26日時点のデータです。上流が更新された場合は公式ランキングを正としてください。
| 順位 | モデル | ベンダー | 日次Token | 6月比 |
|---|---|---|---|---|
| 1 | MiMo-V2.5 | 小米 | 712B | +117% |
| 2 | DeepSeek V4 Flash | DeepSeek | 598B | -3% |
| 3 | Hy3 Preview | 腾讯 | 489B | +8% |
| 4 | Kimi K3 | Moonshot AI | 412B | 新規 |
| 5 | MiniMax M3 | MiniMax | 378B | -15% |
| 6 | Claude Opus 5 | Anthropic | 156B | 新規 |
| 7 | GPT-5.6 Sol | OpenAI | 142B | -6% |
| 8 | GLM 5.2 | 智谱 | 128B | +22% |
| 順位 | 会社 | 発祥地 | 週Token | シェア |
|---|---|---|---|---|
| 1 | DeepSeek | 中国 | 5.82T | 16.2% |
| 2 | 小米 | 中国 | 4.11T | 11.4% |
| 3 | Anthropic | 米国 | 3.94T | 10.9% |
| 4 | 腾讯 | 中国 | 3.21T | 8.9% |
| 5 | 米国 | 3.08T | 8.6% | |
| 6 | MiniMax | 中国 | 2.51T | 7.0% |
| 7 | Moonshot AI | 中国 | 1.89T | 5.3% |
| 8 | OpenAI | 米国 | 1.76T | 4.9% |
会社ランキング Top 10 の中国発ベンダー合計は週Tokenシェア約 46% です。MiMo V2.5 が首位に立った要因はベンチマーク単独の突破ではなく、$0.08/M 入力の価格と端末側配信の組み合わせで、lint・テスト生成・バッチリファクタの大量トラフィックを OpenRouter に流入させたことにあります。
[ SECTION_03 ] // BARBELL 用量と品質のダンベル:なぜトラフィック王者と品質王者は別人なのか
7月の OpenRouter は教科書的なダンベル分布を示しています。一端は超高Token量の低コストオープンウェイト、もう一端は低Token量だが高単価のクローズドソース旗艦。「品質は悪くないが中価格」の中間帯は縮小しています。
| ダンベル端 | 代表モデル | Token比率 | 入力単価 | 典型タスク |
|---|---|---|---|---|
| 用量側(左) | MiMo V2.5、DeepSeek V4 Flash、Hy3 | 約78% | $0.08–0.27/M | バッチコード生成、テスト補完、ドキュメント翻訳 |
| 品質側(右) | Claude Opus 5、GPT-5.6 Sol、Fable 5 | 約8% | $5.00–15.00/M | アーキテクチャ設計、多段Agent、長コンテキスト推論 |
| 過渡帯(縮小中) | Claude Sonnet 4.5、Gemini 2.5 Pro | 約14% | $1.50–3.00/M | 中程度のPRレビュー、社内ツール開発 |
Artificial Analysis の7月 Intelligence Index では Claude Opus 5 が 62.1 で品質首位ですが、日次Tokenは MiMo V2.5 の22%にとどまります。これはモデルの失敗ではなく、開発者が「安いモデルで量、旗艦で難」を学習した結果です。サンディエゴの開発者コミュニティ実測では、Opus 5 一択の Agent パイプラインは時間あたり約12ドル、ダンベルルーティング後は1.2ドル未満に下がり、複雑タスクの成功率はほぼ変わりません。
ダンベル戦略の核心は勝者を一つ選ぶことではなく、ルーティング層がタスクを左端か右端に振り分けることです。
[ SECTION_04 ] // APPS_LAYER アプリ層実践:Hermes Agent と Kilo Code が OpenRouter ルーティングをどう消費するか
2026年7月の競争軸は「最強モデル」から「最もモデルを巧みに调度するアプリ層」へ移っています。Hermes Agent(Nous Research)と Kilo Code は OpenRouter トラフィック増加率トップの上流コンシューマーです。
| ツール | 位置づけ | デフォルト主モデル | フォールバック | 7×24要件 |
|---|---|---|---|---|
| Hermes Agent | マルチチャネル常駐 Agent | MiMo V2.5 / DeepSeek Flash | Claude Opus 5(計画層) | 必須 |
| Kilo Code | ターミナル pair-programming CLI | MiMo V2.5 | Opus 5(3ファイル超リファクタ) | 推奨 |
Hermes Agent は OPENROUTER_API_KEY で統一接続し、Gateway 層が日常会話を MiMo V2.5 に、Skill Documents が多段計画をトリガーしたときのみ Opus 5 にエスカレートします。~/.hermes/ の三層メモリはスリープしない実行ノードを要求します。個人 Mac のフタ閉じは即断線——クラウドベアメタル Mac 需要の直接的要因です。
Kilo Code は7月の OpenRouter 関連 CLI ツールで呼び出し増加率が首位です。デフォルト openrouter/xiaomi/mimo-v2.5 でインライン補完と単一ファイル編集を処理し、diff が3ファイルを超えるか --architect モード時に anthropic/claude-opus-5 へ自動フォールバックします。8時間コーディング session の実測では、ダンベルルーティングは Opus 5 単独より Token 費用を約 87% 削減しました。
provider: openrouter
model: xiaomi/mimo-v2.5
fallback:
- anthropic/claude-opus-5
- deepseek/deepseek-v4-flash
routing:
architect_mode: anthropic/claude-opus-5
max_files_single_model: 3
[ SECTION_05 ] // OUTLOOK_PLAYBOOK 8月展望、六ステップ選定、FAQ と引用可能データ
8月は2026年下半期で最もモデルリリースが集中するウィンドウです。以下は高信頼度のスケジュールで、発表後は公式告知を再確認してください。
| モデル | 予想時期 | ダンベル戦略への影響 |
|---|---|---|
| Kimi K3 全量重み | 7月27日 | 自ホスト選択肢増、左端競争激化 |
| GPT-6 | 8月中旬 | 右端の品質上限が上がる可能性 |
| Gemini 4 | 8月下旬 | マルチモーダル Agent の新デフォルト |
| DeepSeek V5 プレビュー | 8月末 | 左端 Token 単価がさらに30%低下の可能性 |
六ステップ選定チェックリスト:
- トラフィックと品質の二重台帳を構築:OpenRouter ランキングで実使用量、Artificial Analysis と SWE-bench で品質上限を追跡し、単一指標判断を避けます。
- ダンベルルーティング規則を定義:「左端」(lint、テスト、単一ファイル補完)と「右端」(アーキテクチャ、多段Agent、8K token超推論)を設定ファイルに書き、人手判断に頼りません。
- 裸APIではなくアプリ層に接続:常駐 Agent なら Hermes Agent、CLI コーディングなら Kilo Code がシナリオをカバーするか評価し、アプリ外でルーティングを再実装しない。
- LiteLLM またはマルチ Provider 抽象層を先行実装:8月の六週間集中リリース期間中、単一モデル ID のハードコードは急速に技術的負債化します。
- コンプライアンス曲線とコスト曲線を分離管理:大企業調達は直接 Provider DPA、個人・中小は OpenRouter ダンベル——予算線を混ぜない。
- 7×24 実行環境を固定:マルチモデル Agent と CLI の長時間運用には常駐 Apple Silicon ノードが必要です。詳細は ヘルプセンターと 注文ページをご参照ください。
Q:OpenRouter 2026年7月で最も人気のモデルは?
A:日次Token量では小米 MiMo-V2.5 が約712Bで初の1位、次いで DeepSeek V4 Flash(598B)と腾讯 Hy3 Preview(489B)です。
Q:中国モデルの7月シェアは?
A:会社ランキング Top 10 の中国発ベンダー合計で週Tokenシェア約46%です。
Q:使用量1位は品質1位を意味しますか?
A:いいえ。ダンベル分布下で約78%のTokenが低コスト側に流れ、品質首位は Claude Opus 5(Intelligence Index 62.1)のままです。
- MiMo V2.5 日次Token:712B、6月比+117%、モデルランキング1位
- 中国モデル会社シェア:Top 10 合計約46%
- ダンベル左端 Token 比率:約78%
- Claude Opus 5 Intelligence Index:62.1 首位、SWE-bench Pro 71.4%
- MiMo V2.5 入力単価:$0.08/M、Opus 5 の約1/62
- Kilo Code ダンベル節約:8時間 session で Token 費用約-87%(コミュニティ実測)
個人 Mac で Hermes Agent、Kilo Code、OpenRouter マルチモデルルーティングを回す典型的な課題は、フタ閉じスリープ、メモリ不足、7×24 常駐不可、VM による Metal 性能低下です。安定した iOS/macOS ビルド、AI Agent 自動化、マルチ Provider コーディングアシスタントの長時間オンライン運用が必要な本番環境では、NOVAKVM の Mac Mini クラウドベアメタルレンタルが通常より優れた選択肢です。専有 Apple Silicon、複数リージョン低レイテンシ、日/週/月の柔軟なレンタル期間を提供します。
以下のリンクは執筆時点の公開ソースです。上流が更新された場合は原文を正としてください。
https://openrouter.ai/rankings
https://artificialanalysis.ai/