Classement IA juin 2026 :
les modèles chinois prennent OpenRouter — sur quoi parier au second semestre ?

Si vous êtes développeur ou responsable technique en train de choisir un assistant de code IA, de monter un pipeline Agent ou de piloter un budget API, et que vous vous demandez ce que signifie réellement le trafic OpenRouter de juin, si DeepSeek ou Claude mérite votre confiance, ou si GPT-6 et Opus 5 redessineront la carte au second semestre, cet article s’appuie sur le trafic OpenRouter en temps réel, l’Intelligence Index d’Artificial Analysis et SWE-bench Pro pour décortiquer les doubles classements entreprises/modèles, la chute de la part US de 70% à 30%, la séparation qualité/prix, une matrice de huit scénarios, les prévisions Q3 et cinq tendances macro — avec un runbook en six étapes agnostique du modèle. Infrastructure : page tarifs NOVAKVM.

Juin 2026 concentre les signaux : retrait mystérieux de Claude Fable 5 pour export control, rumeurs d’IPO chez OpenAI et Anthropic, part chinoise des tokens OpenRouter au-delà de 60%. Décider avec la cartographie de 2025 expose à un double échec — coût et qualité.

  • Mauvaise lecture du classement : confondre « premier en volume » et « premier en capacité globale », en négligeant la domination d’Opus 4.8 sur les Agents et le long contexte.
  • Explosion des coûts : router tout le code complexe vers Claude — un développeur de San Diego estime ~10 USD/heure contre moins de 0,50 USD avec DeepSeek.
  • Angle mort conformité : l’achat entreprise de poids ouverts chinois se heurte à la sécurité des données et à la régulation américaine ; en UE, alignement DPA et localisation des données requis.
  • Architecture rigide : un seul fournisseur codé en dur devient une dette technique dès la fenêtre Q3 de six semaines (GPT-6, Opus 5, Gemini 4, DeepSeek V5).
  • Écart Agent : 2026 marque le passage à la production Agent ; ~44% des appels Claude API proviennent de tâches maths/informatique — la logique batch doit évoluer.
  • Plafond local : routage multi-modèles, poids self-hostés et Agents 7×24 sur Mac personnel perdent face au sommeil, à la RAM et au disque.

Thèse : OpenRouter reflète le vote par le portefeuille des développeurs mondiaux — une histoire économique autant que technique. Stratégie rationnelle : frontier fermée pour les 5% les plus durs, poids ouverts pour les 95% restants.

OpenRouter agrège des millions d’appels réels — pas de slides marketing, seulement le code qui consomme. Données arrêtées en juin 2026.

Classement par entreprise (tokens hebdomadaires)
Rang Entreprise Origine Tokens / semaine Part de marché
1 DeepSeek Chine 5,13T 17,6%
2 Anthropic États-Unis 4,34T 14,8%
3 Google États-Unis 3,66T 12,5%
4 OpenAI États-Unis 2,46T 8,4%
5 Xiaomi Chine 2,42T 8,3%
6 MiniMax Chine 2,37T 8,1%
7 Tencent Chine 2,36T 8,1%
8 Alibaba Qwen Chine 1,26T 4,3%

Les éditeurs chinois identifiés dans le top 10 totalisent ~46% ; en incluant les modèles hors liste, la part globale dépasse 60%.

Classement par modèle (tokens quotidiens — top 10)
Rang Modèle Éditeur Tokens / jour
1 DeepSeek V4 Flash DeepSeek 619B
2 Hy3 Preview Tencent 451B
3 MiniMax M3 MiniMax 447B
4 MiMo-V2.5 Xiaomi 327B
5 DeepSeek V4 Pro DeepSeek 300B
6 Claude Opus 4.7 Anthropic 263B
7 Claude Opus 4.8 Anthropic ~200B
8 Claude Sonnet 4.6 Anthropic 178B
9 Gemini 3 Flash Preview Google 156B
10 Kimi K2.6 Moonshot AI ~150B

Ce tableau mesure la confiance en production — pas la portée marketing.

Bloomberg, s’appuyant sur OpenRouter et Exponential View, trace la courbe :

  • Juin 2025 : modèles US (Google + OpenAI + Anthropic) ~70% des tokens OpenRouter
  • Juin 2026 : même bloc ~30%

Quarante points de part migrer vers la Chine. Ce n’est pas un vote patriotique — la base OpenRouter est mondiale (États-Unis, Europe, Inde). DeepSeek, Xiaomi et MiniMax gagnent parce qu’ils sont bon marché, rapides et suffisants.

« Avec Claude, je dépense environ 10 dollars de l’heure pour coder. Avec DeepSeek, moins de 50 cents. » — développeur, San Diego

Un ingénieur de Dallas décrit son empilement : « 500 USD/mois Claude + ChatGPT pour le difficile, 200 USD MiniMax + Kimi + MiMo pour 90% du code et la reconnaissance vocale. » Routage par complexité, optimisation par coût.

Plafond qualité (Artificial Analysis Intelligence Index, fin mai 2026)
Modèle Intelligence Index SWE-bench Pro Note
Claude Opus 4.8 61,4 (#1) 69,2% Long contexte et Agent en tête
GPT-5.5 59–60 63,1% Écosystème et tool calls
Gemini 3.1 Pro 57 Raisonnement le plus exigeant
Qwen 3.7 Max 57 Sommet chinois closed source
Claude Sonnet 4.6 80,8% (Verified) Rédaction et suivi d’instructions

Un ingénieur a testé 20 tâches : Opus 4.8 en remporte 16, GPT-5.5 cinq, Gemini 3.1 Pro quatre ; sur long contexte, Opus écrase la concurrence.

Claude Fable 5 affichait 100/100 sur plusieurs classements, ~95% SWE-bench Verified — retiré mondialement mi-juin 2026 pour export control, statut incertain. Message : la frontier US reste en tête sur la pure capacité.

Trois moteurs du volume quotidien chinois :

  • Prix : MiniMax M3 ~0,60 USD/M entrée vs Opus 4.8 5,00 USD/M — ratio 1/8
  • Suffisant : aide au code, complétion, traduction, résumé à 80–90% du top
  • Poids ouverts : DeepSeek V4, MiniMax M3 auto-hébergeables — moins de données sortantes

Modèle par charge de travail
Scénario Modèle recommandé Justification
Code complexe / Agent Claude Opus 4.8 Index #1, long contexte inégalé
Coding quotidien DeepSeek V4 Flash / MiMo-V2.5 Excellent rapport coût-vitesse
API ultra-compétitive MiniMax M3 0,60 USD/M, poids ouverts, self-host
Long contexte Kimi K2.6 (1M contexte) Fenêtre très longue, prix raisonnable
Écosystème Google Gemini 3.5 Flash Intégration native Workspace
Recherche web temps réel Grok 4.3 Contenu X/Twitter en direct
Déploiement local GLM 5.2 / Kimi K2.6 Poids ouverts de premier plan
Génération d’images ChatGPT Images 2.0 Rendu texte le plus fort
Dialogue général GPT-5.5 52,5% moins d’hallucinations vs GPT-5.3, écosystème mature

Confirmé ou très probable — Q3 2026
Modèle Éditeur Fenêtre Point clé
GPT-6 OpenAI août–sept. 2026 Contexte plus long (rumeur 1,5M), Agents renforcés
Claude Opus 5 Anthropic ~sept. 2026 Agents longue durée, refresh MCP
Gemini 4 Google Q3 2026 Multimodal : vidéo, audio, image
DeepSeek V5 DeepSeek Q3 2026 Poids ouverts, >1T paramètres, niveau frontier
GLM 5.2 Z.ai Déjà publié Poids ouverts top, code très fort
Grok 4.3+ xAI Q3 2026 1M contexte, web live renforcé

GPT-6, Opus 5 et Gemini 4 devraient atterrir dans une fenêtre de six semaines mi-août – fin septembre — le trône des benchmarks changera plus vite que le cycle média.

Cinq tendances macro :

  1. Axe « meilleur pour ce scénario » : cinq labs publient en 90 jours — plus de modèle unique ; frontier fermée pour 5% difficiles, poids ouverts chinois pour 95% du quotidien.
  2. Part chinoise en hausse, plafond conformité entreprise : adoption individuelle sans frein ; achats Fortune 500 limités par données et Congrès US — OpenRouter peut dépasser 70% côté indie, entreprise sous 30%.
  3. Les Agents sont le champ de bataille : ~44% appels Claude API en maths/CS (rapport Anthropic 2026) ; SWE-bench Pro, OSWorld-Verified et tâches longues décident les contrats.
  4. Double IPO OpenAI + Anthropic : signaux juin 2026 — tarification plus transparente, guerre des prix possible avec la Chine.
  5. Local >80% SWE-bench sur hardware grand public : d’ici 2027, GPU 32 Go ~80% SWE-bench Verified — remet en cause le modèle API coding quotidien.

Q : Modèle le plus populaire sur OpenRouter en juin 2026 ?
R : DeepSeek V4 Flash, 619B tokens/jour, puis Hy3 Preview (451B) et MiniMax M3 (447B).

Q : DeepSeek bat-il Claude ?
R : Selon la tâche. Coding quotidien et coût : DeepSeek. Top 5%, Agents, long contexte : Opus 4.8 (index 61,4).

Q : Quels modèles frontier au Q3 2026 ?
R : GPT-6 (août–sept.), Claude Opus 5 (~sept.), Gemini 4, DeepSeek V5, Grok 4.3+.

  • DeepSeek tokens/semaine : 5,13T, 17,6% (#1 entreprise)
  • Trois géants US : 70% (juin 2025) → 30% (juin 2026)
  • MiniMax M3 : 0,60 USD/M vs Opus 4.8 5,00 USD/M (~×8)
  • Opus 4.8 : index 61,4 #1 ; SWE-bench Pro 69,2%
  • Part Agent Claude API : ~44% maths/CS (Anthropic 2026)
  • GPT-5.5 : ~52,5% moins d’hallucinations vs GPT-5.3

  1. Double registre trafic + qualité : OpenRouter pour le volume, Artificial Analysis + SWE-bench pour le plafond — pas de décision sur une seule métrique.
  2. Routage par complexité : top 5% → Opus 4.8 / GPT-5.5 ; quotidien → DeepSeek V4 Flash, MiMo-V2.5, MiniMax M3.
  3. Couche LiteLLM ou multi-fournisseur : les releases Q3 rendent le hardcoding coûteux.
  4. Évaluer le self-host open weight : DeepSeek V4, GLM 5.2, Kimi K2.6 pour les équipes sensibles aux données.
  5. Suivre IPO et tarifs : OpenAI/Anthropic peuvent déplacer les grilles — budget flexible.
  6. Fixer l’hôte Agent 7×24 : gateway multi-modèles et inférence locale exigent un nœud Apple Silicon éveillé — centre d’aide, page commander.

L’histoire n’est pas « la Chine gagne », mais la marge sur la couche modèle se compresse vite. DeepSeek en 2025 a montré qu’il n’faut pas frontier-compute pour frontier-capability ; Xiaomi, Tencent, MiniMax et Moonshot ancrent les prix plancher. Les US se différencient : OpenAI écosystème, Anthropic qualité, Google multimodal — la zone médiane chère disparaît.

Compétence la plus précieuse : une architecture capable de changer de modèle — le numéro un d’aujourd’hui ne le sera souvent plus dans trois mois.

Agents multi-modèles, gateway OpenRouter et poids locaux sur Mac personnel butent sur sommeil au clapet, RAM, absence de 7×24 et overhead Metal en VM. Pour des builds iOS/macOS stables, l’automation Agent et des assistants multi-fournisseur en continu, la location Mac Mini bare metal NOVAKVM reste en général la option la plus fiable : Apple Silicon dédié, multi-régions, durées flexibles.

Sources publiques à la date de rédaction ; en cas de mise à jour amont, privilégier les originaux.

OpenRouter Rankings — live data

Artificial Analysis Intelligence Index

These Are The Most Popular AI Models On OpenRouter — officechai.com

OpenRouter Real AI Rankings — stockalarm.io

China Open-Weight Takeover — datagravity.dev

The 2026 State of AI Agents Report — Anthropic