Date de sortie Grok 4.6 :
l'objectif du 7 août de xAI est-il réaliste ?

Si vous êtes développeur ou décideur technique qui suit le rythme de sortie de la série Grok xAI et évalue les modèles agentiques pour le code, la réponse d'Elon Musk à Guillermo Rauch (CEO de Vercel) sur X le 28 juillet 2026 peut redessiner votre stack modèle pour les deux prochains mois. Grok 4.6 est visé vers le 7 août avec 1,5 billion de paramètres, suivi quelques semaines plus tard par Grok 4.7 à 2,1 billions — à peine un mois après Grok 4.5. Cet article couvre la chronologie, les tableaux de données, la logique SFT/RL, le positionnement face à Kimi K3 et Claude Fable 5.1, les points de vigilance et une checklist en six étapes. À lire avec notre revue Grok 4.5 et guide Kimi K3 open weight. Tarifs sur la page de location.

xAI n'a pas encore publié de scores benchmark ni de tarifs pour Grok 4.6. Les éléments ci-dessous proviennent des déclarations publiques de Musk et de la presse spécialisée — vérifiez via les canaux officiels xAI avant toute décision.

  • Risque de source unique : La seule source primaire à ce jour est la réponse X de Musk du 28 juillet. Pas de billet de blog xAI ni de page produit alignée — la date peut avancer ou reculer.
  • Marge « Musk time » : Les calendriers xAI, Tesla et SpaceX ont historiquement glissé de quelques jours à quelques semaines. « Autour du 7 août » est un objectif, pas une garantie.
  • Vide benchmark et tarification : Contrairement à Grok 4.5 et sa fiche modèle avec 15 benchmarks, Grok 4.6 n'a ni évaluation indépendante ni fiche officielle.
  • Fenêtre de pression concurrentielle : La date cible tombe environ 10 jours après la sortie open weight complète de Kimi K3, qui secoue déjà les classements code.
  • Fracture sectorielle sur le rythme : Le 28 juillet, plus de 1 200 employés d'OpenAI, Anthropic, Google DeepMind et Meta publient la lettre « Pacing the Frontier ». xAI n'y figure pas.
  • Contexte sécurité et conformité : En juillet 2026, xAI poursuit un utilisateur pour génération présumée de CSAM en contournant les garde-fous — première action de ce type. Un rapport Common Sense Media de janvier 2026 classait Grok parmi les pires chatbots pour la protection des mineurs.

En bref : « 1,5 billion de paramètres » et « SFT/RL nettement améliorés » sont des affirmations vendeur pour l'instant. Tant que la fiche modèle n'est pas publiée, gardez Kimi K3, Claude Fable 5.1 et d'autres routes de secours.

Chronologie clé :

  • 8 juillet 2026 : xAI lance Grok 4.5 pour le code et les agents, co-entraîné avec Cursor sur de vraies sessions développeur. Contexte 500K tokens, tarifs 2 $/6 $ par million de tokens entrée/sortie.
  • 16 juillet 2026 : Kimi K3 de Moonshot AI disponible en service hébergé.
  • 26 juillet 2026 : Kimi K3 publie les poids open un jour en avance — 2,8T paramètres, contexte 1M tokens.
  • 28 juillet 2026 : Musk dévoile la feuille de route Grok 4.6/4.7 en réponse à Rauch. Même jour : lettre « Pacing the Frontier ».
  • ~7 août 2026 (cible) : Grok 4.6 prévu — 1,5T paramètres, focus SFT/RL.
  • ~fin août–début septembre 2026 (estimé) : Grok 4.7 prévu — 2,1T paramètres. Musk : supérieur à 4.6 sauf vitesse de serving, meilleure efficacité token.

Cadence de sortie Grok et échelle de paramètres (au 30/07/2026)
Modèle Date sortie / cible Paramètres Positionnement Statut
Grok 4.3 Beta17 avr. 2026Non divulguéRéférence précédentePublié
Grok 4.58 juil. 2026Non divulgué (SKU unique, pas MoE)Code et agents, co-training CursorPublié
Grok 4.6~7 août 20261,5TUpgrade SFT/RL majeurAnnoncé, non livré
Grok 4.7~fin août–déb. sep.2,1TUpgrade global sur 4.6, meilleure efficacité tokenAnnoncé, non livré

Note : paramètres, tarifs et benchmarks sont des déclarations vendeur ou Musk. Grok 4.6/4.7 n'ont pas d'évaluation tierce — lignes « annoncé » à titre indicatif jusqu'au release officiel.

Ce que résolvent SFT et RL : Le fine-tuning supervisé (SFT) façonne le comportement avec des exemples curatés ; l'apprentissage par renforcement (RL) enseigne les séquences d'actions efficaces sur les tâches agentiques multi-étapes. Musk insiste sur SFT/RL plutôt que sur l'échelle brute — prolongement de Grok 4.5, qui a atteint 83,3 % sur Terminal-Bench 2.1 et 64,7 % sur SWE-Bench Pro avec bien moins de tokens de sortie que Claude Opus 4.8 (environ 19 000 vs 67 000 par tâche).

Double stratégie xAI : échelle et post-entraînement : Le saut à 1,5T pour Grok 4.6 est réel, mais Grok 4.7 à 2,1T « légèrement plus lent à servir » suggère deux SKU pour qualité vs latence — pas un modèle unique pour tout.

Pression concurrentielle Kimi K3 : Kimi K3 mène Frontend Code Arena à 1 679 points — premier modèle open weight devant tous les modèles fermés — et se classe 3e mondial sur l'Intelligence Index d'Artificial Analysis. Musk a commenté « impressionnant ». La cadence Grok 4.6/4.7 se lit comme réponse à OpenAI, Anthropic et les labs chinois.

Grok 4.6 vs concurrents : paramètres, tarifs, contexte
Modèle Éditeur Paramètres Fenêtre de contexte Tarif (entrée/sortie par 1M tokens) Source clé
Grok 4.5xAINon divulgué500K2 $ / 6 $xAI officiel
Grok 4.6 (annoncé)xAI1,5TNon divulguéNon divulguéPost X Musk (non vérifié)
Kimi K3Moonshot AI2,8T (MoE, ~16/896 experts actifs)1M0,30 $ (cache hit) / 3 $ (miss) entrée, 15 $ sortieMoonshot + Hugging Face
Claude Fable 5.1 (rumeur)AnthropicNon divulguéNon divulguéRumeur : tarifs Fable 5 (10 $ / 50 $)36kr, WinCentral — Anthropic non confirmé
GPT-5.6 SolOpenAINon divulguéNon divulguéNon divulguéOpenAI officiel

Les lignes Grok 4.6 et Claude Fable 5.1 sont des annonces pré-release, pas des benchmarks vérifiés — utiles pour le timing et le positionnement.

Si le calendrier de Musk tient, Grok 4.6 et 4.7 arrivent le même mois que le Claude Fable 5.1 rumoré (fuites 36kr et WinCentral, visant à devancer le GPT-6 attendu d'OpenAI) et quelques semaines après le choc open weight de Kimi K3. Août 2026 pourrait être l'un des mois les plus denses en sorties frontier. Pour les équipes, la durée de vie utile d'un flagship se compte en semaines — l'efficacité token et le coût réel par tâche priment sur le classement brut.

  1. Verrouiller les sources officielles : Suivre le blog xAI, @xai et @elonmusk sur X, activer les annonces dans Grok Build et la console API. Ne pas traiter les posts de Musk comme un SLA avant release officiel.
  2. Établir une baseline de coût Grok 4.5 : Mesurer distribution et facturation des tokens entrée/sortie sur vos workflows agents. Noter la moyenne de tokens de sortie sur tâches type SWE-Bench Pro (~19 000 selon xAI), prévoir 20 à 40 % de marge pour les tarifs 4.6.
  3. Cartographier l'impact SFT/RL sur les échecs agents : Lister hallucinations d'appels d'outils, troncature de contexte, récompenses rares sur longues chaînes — ce qui pourrait gagner avec le post-entraînement 4.6 vs ce qui exige revue humaine.
  4. Préparer un routage par niveaux : Volume batch via Kimi K3 ou DeepSeek V4 Flash ; étapes de raisonnement complexe réservées à Claude Fable 5.1 / GPT-5.6 Sol ; A/B Grok 4.6 hors production d'abord. Voir guide de tiering OpenRouter juillet.
  5. Réserver des slots d'intégration Cursor/API : Pré-câbler le changement d'ID modèle dans Cursor, OpenRouter ou API xAI directe — le jour J, modifier la chaîne model, pas toute la stack.
  6. Stabiliser l'orchestration agent macOS 7×24 : Les fenêtres de release impliquent régressions denses et évals multi-modèles. Faire tourner gateways agents, runners CI et scripts d'éval sur nœuds macOS permanents. Centre d'aide et page de commande.
grok-model-router.env
GROK_PRIMARY=grok-4.5
GROK_FALLBACK=kimi-k3
GROK_COMPLEX=claude-fable-5
XAI_API_BASE=https://api.x.ai/v1

  • Date cible Grok 4.6 : Musk : « autour du 7 août » — pas de confirmation xAI (source : post X 28/07/2026).
  • Échelle paramètres : Grok 4.6 annoncé 1,5T, Grok 4.7 2,1T (source : même post, non vérifié par tiers).
  • Contexte et tarif Grok 4.5 : 500K tokens, 2 $ entrée / 6 $ sortie par million (source : fiche modèle Grok 4.5 xAI).
  • Efficacité token Grok 4.5 : ~19 000 tokens de sortie par tâche SWE-Bench Pro vs ~67 000 pour Claude Opus 4.8 (source : fiche xAI).
  • Benchmarks code Grok 4.5 : Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 % (source : xAI officiel).
  • Classement code Kimi K3 : Frontend Code Arena 1 679 points, Intelligence Index Artificial Analysis #3 mondial (source : Arena.ai / Artificial Analysis).
  • Contexte sectoriel : 1 200+ signataires « Pacing the Frontier » le 28 juillet ; OpenAI et Anthropic au nom des entreprises (source : The Verge, TechTimes).

FAQ sélectionnée :

  • Q : Date exacte de Grok 4.6 ? R : Musk a dit « autour du 7 août 2026 » sur X — xAI n'a pas confirmé. Objectif susceptible de bouger.
  • Q : Différence Grok 4.6 vs 4.7 ? R : 4.6 : 1,5T, focus SFT/RL. 4.7 : 2,1T, quelques semaines après, supérieur sauf vitesse de serving, meilleure efficacité token.
  • Q : 4.6 bat Kimi K3 ou Fable 5.1 ? R : Trop tôt. Pas de benchmarks 4.6 ; K3 vérifié ; Fable 5.1 non confirmé.
  • Q : Prix de 4.6 ? R : Inconnu. 2 $/6 $ de Grok 4.5 comme référence, changement possible.
  • Q : Où l'utiliser ? R : Probablement Grok Build, API xAI, console en premier — non confirmé pour 4.6.

Sources publiques citées à la rédaction ; si la documentation amont change, consultez les liens.

https://x.ai/news/grok-4-5

https://media.x.ai

https://huggingface.co/moonshotai

Informations au 30 juillet 2026. Tous les détails Grok 4.6/4.7 sont des annonces vendeur ou fuites sectorielles — vérifiez via xAI avant de vous fier à une date, spec ou prix.

Vrais inconvénients des alternatives courantes (vue ingénierie) : (1) Tests de régression Grok 4.6 sur laptop personnel : fermeture du capot, veille, OAuth et batches agents longs interrompus — pas de pipeline 7×24 ; (2) Mac Studio haut de gamme pour la semaine de lancement alors que l'inférence reste sur l'API xAI et que le local ne sert qu'à l'orchestration macOS — amortissement sur 3 mois dépasse largement une location hebdomadaire ; (3) Verrouiller tous les workflows sur un seul SKU Grok en ignorant le choc Kimi K3 open weight et la rumeur Fable 5.1 en août — fenêtre d'évaluation compressée, facture token hors contrôle.

Pour les équipes qui ont besoin d'Apple Silicon dédié, disponibilité 7×24 et montée en charge flexible jour/semaine/mois pour router Grok / Kimi K3 / Claude et valider iOS CI sur le même hôte macOS — workflow créatif et CI Apple typiques de l'écosystème — la location cloud bare metal Mac Mini NOVAKVM est en général la meilleure option : six régions, gammes mémoire élevée, SSH direct, inférence API cloud séparée d'un plan d'exécution macOS stable, régressions denses sans interruption veille laptop. Comparez M4 Pro et stockage sur la page tarifs NOVAKVM, lancez un nœud d'essai sur la page de commande, session distante via le centre d'aide.