Рейтинг AI-моделей июнь 2026:
китайские модели захватили OpenRouter — на кого ставить во второй половине года?

Если вы разработчик или техлид, выбираете AI-кодинг-ассистента, собираете Agent-pipeline или режете API-бюджет и не понимаете, что реально значит трафик OpenRouter за июнь, кого брать — DeepSeek или Claude, и перепишут ли GPT-6 и Opus 5 расклад во второй половине года — этот разбор на live-трафике OpenRouter, Artificial Analysis Intelligence Index и SWE-bench Pro даёт двойной рейтинг компаний/моделей, падение доли US с 70% до 30%, tier качества vs цены, матрицу из восьми сценариев, прогноз Q3 и пять макротрендов плюс модель-агностичный runbook из шести шагов. Инфра: тарифы аренды NOVAKVM.

Июнь 2026 — плотный event stack: Claude Fable 5 снят из-за export control, IPO-слухи OpenAI и Anthropic, доля китайских моделей на OpenRouter >60% token share. Решения по логике 2025 года бьют и по cost, и по quality одновременно.

  • Неверное чтение рейтинга: «#1 по вызовам» ≠ «#1 по capability» — Opus 4.8 доминирует в Agent и long context.
  • Cost blow-up: весь сложный код через Claude — dev из San Diego меряет ~$10/час vs DeepSeek <$0.50.
  • Compliance blind spot: enterprise-закупка китайских open-weight упирается в data security и регуляцию US Congress.
  • Жёсткая архитектура: hardcoded single provider превращается в tech debt в шестинедельном Q3-окне (GPT-6, Opus 5, Gemini 4, DeepSeek V5).
  • Agent gap: 2026 — год production Agents; ~44% Claude API calls — math/CS tasks (Anthropic); batch routing надо апгрейдить.
  • Local bottleneck: multi-model routing, self-host weights и 7×24 Agents на личном Mac убиваются sleep, RAM и disk — съедают API savings.

Тезис: OpenRouter = wallet voting глобальных devs. Это экономика, не только capability. Ratio: closed frontier на hardest 5%, open weights на оставшиеся 95%.

OpenRouter агрегирует миллионы реальных вызовов — не vendor slides, только code votes. Snapshot: июнь 2026.

Рейтинг по компаниям (недельные tokens)
# Компания Origin Tokens/нед Share
1 DeepSeek Китай 5.13T 17.6%
2 Anthropic США 4.34T 14.8%
3 Google США 3.66T 12.5%
4 OpenAI США 2.46T 8.4%
5 Xiaomi Китай 2.42T 8.3%
6 MiniMax Китай 2.37T 8.1%
7 Tencent Китай 2.36T 8.1%
8 Alibaba Qwen Китай 1.26T 4.3%

Маркированные китайские вендоры в top 10 суммарно ~46%; с off-list китайскими моделями total share >60%.

Рейтинг по моделям (daily tokens top 10)
# Модель Vendor Daily tokens
1 DeepSeek V4 Flash DeepSeek 619B
2 Hy3 Preview Tencent 451B
3 MiniMax M3 MiniMax 447B
4 MiMo-V2.5 Xiaomi 327B
5 DeepSeek V4 Pro DeepSeek 300B
6 Claude Opus 4.7 Anthropic 263B
7 Claude Opus 4.8 Anthropic ~200B
8 Claude Sonnet 4.6 Anthropic 178B
9 Gemini 3 Flash Preview Google 156B
10 Kimi K2.6 Moonshot AI ~150B

Таблица измеряет production trust — не marketing reach.

Bloomberg по данным OpenRouter и Exponential View:

  • Июнь 2025: US models (Google + OpenAI + Anthropic) ~70% token share на OpenRouter
  • Июнь 2026: тот же блок ~30%

40 pp уехали почти целиком в китайские модели. Это не «китайские devs голосуют за domestic» — база OpenRouter глобальная (US, EU, India). DeepSeek, Xiaomi, MiniMax выигрывают потому что дёшево, быстро, достаточно.

«Claude для кода — ~$10/час. DeepSeek — меньше $0.50.» — dev, San Diego

Dev из Dallas описывает stack: «$500/mo Claude + ChatGPT на hard tasks, $200 MiniMax + Kimi + MiMo на 90% coding и speech.» Классика: routing by complexity, optimize by cost.

Quality ceiling (Artificial Analysis Intelligence Index, конец мая 2026)
Модель Intelligence Index SWE-bench Pro Note
Claude Opus 4.8 61.4 (#1) 69.2% Long context и Agent лидируют
GPT-5.5 59–60 63.1% Ecosystem и tool calls
Gemini 3.1 Pro 57 Hardest reasoning
Qwen 3.7 Max 57 Top CN closed source
Claude Sonnet 4.6 80.8% (Verified) Writing и instruction following

Engineer прогнал 20 tasks: Opus 4.8 взял 16, GPT-5.5 — 5, Gemini 3.1 Pro — 4; на long context Opus — wipe.

Claude Fable 5 брал 100/100 в нескольких рейтингах, ~95% SWE-bench Verified — глобально снят mid-June 2026 из-за export control, status TBD. Signal: US frontier всё ещё #1 по pure capability.

Три драйвера китайского daily volume:

  • Price: MiniMax M3 ~$0.60/M input vs Opus 4.8 $5.00/M — factor 1/8
  • Good enough: coding assist, completion, translate, summary — 80–90% top quality
  • Open weights: DeepSeek V4, MiniMax M3 self-hostable — меньше outbound data risk

Модель по workload
Сценарий Pick Why
Complex code / Agent Claude Opus 4.8 Index #1, long context king
Daily coding DeepSeek V4 Flash / MiMo-V2.5 $/perf, low latency
Budget API MiniMax M3 $0.60/M, open weights, self-host
Long context Kimi K2.6 (1M context) Mega window, fair price
Google ecosystem Gemini 3.5 Flash Native Workspace
Live web search Grok 4.3 Real-time X/Twitter
Self-host / on-prem GLM 5.2 / Kimi K2.6 Top open weights
Image gen ChatGPT Images 2.0 Best text-in-image
General chat GPT-5.5 52.5% меньше hallucination vs GPT-5.3, mature stack

Confirmed / high-probability Q3 2026
Модель Vendor Window Hook
GPT-6 OpenAI Aug–Sep 2026 Longer context (rumor 1.5M), stronger Agents
Claude Opus 5 Anthropic ~Sep 2026 Long-horizon Agents, MCP refresh
Gemini 4 Google Q3 2026 Multimodal: video, audio, image
DeepSeek V5 DeepSeek Q3 2026 Open weights, >1T params, frontier-class
GLM 5.2 Z.ai Shipped Top open weights, strong coding
Grok 4.3+ xAI Q3 2026 1M context, enhanced live web

GPT-6, Opus 5, Gemini 4 likely land в six-week window mid-Aug – late Sep — benchmark crown меняется быстрее media cycle.

Пять макротрендов:

  1. Scenario beats single winner: five labs ship dense in 90 days — closed frontier на hardest 5%, CN open weights на 95% daily load.
  2. CN share растёт, enterprise compliance caps: indie adoption не стопорится; Fortune 500 limited by data + US Congress — OpenRouter может 70%+ indie, enterprise <30%.
  3. Agents = battlefield: ~44% Claude API math/CS (Anthropic Agent Report 2026); SWE-bench Pro, OSWorld-Verified, long-horizon решают enterprise deals.
  4. Dual IPO OpenAI + Anthropic: June 2026 signals — pricing transparency, возможная price war с CN vendors.
  5. Local >80% SWE-bench на consumer HW: к 2027 32GB GPU class ~80% SWE-bench Verified — ломает daily coding API biz model.

Q: Top model на OpenRouter июнь 2026?
A: DeepSeek V4 Flash, 619B daily tokens, далее Hy3 Preview (451B) и MiniMax M3 (447B).

Q: DeepSeek лучше Claude?
A: Task-dependent. Daily coding + cost: DeepSeek. Hardest 5%, Agents, long context: Opus 4.8 (index 61.4).

Q: Frontier drops Q3 2026?
A: GPT-6 (Aug–Sep), Claude Opus 5 (~Sep), Gemini 4, DeepSeek V5, Grok 4.3+.

  • DeepSeek weekly tokens: 5.13T, 17.6% (#1 company)
  • US big three: 70% (Jun 2025) → 30% (Jun 2026)
  • MiniMax M3: $0.60/M vs Opus 4.8 $5.00/M (~8×)
  • Opus 4.8: index 61.4 #1; SWE-bench Pro 69.2%
  • Claude Agent share: ~44% math/CS (Anthropic 2026)
  • GPT-5.5: ~52.5% меньше hallucination vs GPT-5.3

  1. Dual ledger traffic + quality: OpenRouter для volume, Artificial Analysis + SWE-bench для ceiling — no single-metric buys.
  2. Route by complexity: top 5% → Opus 4.8 / GPT-5.5; daily → DeepSeek V4 Flash, MiMo-V2.5, MiniMax M3.
  3. LiteLLM или multi-provider abstraction: Q3 releases делают hardcoding дорогим.
  4. Evaluate open-weight self-host: DeepSeek V4, GLM 5.2, Kimi K2.6 для data-sensitive teams.
  5. Track IPO и pricing: OpenAI/Anthropic могут shift tier prices — budget buffer.
  6. Fix 7×24 Agent host: multi-model gateway и local weights нужен awake Apple Silicon node — центр помощи, оформить заказ.

Story не «China won», а margin на model layer сжимается fast. DeepSeek 2025 показал: frontier не требует frontier compute; Xiaomi, Tencent, MiniMax, Moonshot давят base price в пол. US labs split: OpenAI ecosystem, Anthropic quality, Google multimodal — дорогая middle tier исчезает.

Самый ценный skill 2026: архитектура, которая swap models on demand — #1 сегодня через три месяца часто уже другой.

Multi-model Agents, OpenRouter gateway и local weights на личном Mac ломаются на lid sleep, RAM, no 7×24 и VM Metal overhead. Для stable iOS/macOS builds, Agent automation и multi-provider coding assistants 24/7 NOVAKVM Mac Mini bare-metal rent обычно robust pick: dedicated Apple Silicon, multi-region, flexible terms.

Источники на дату публикации; при upstream updates — primary sources first.

OpenRouter Rankings — live data

Artificial Analysis Intelligence Index

These Are The Most Popular AI Models On OpenRouter — officechai.com

OpenRouter Real AI Rankings — stockalarm.io

China Open-Weight Takeover — datagravity.dev

The 2026 State of AI Agents Report — Anthropic