Grok 4.6 Release-Datum:
Ist Musks 7.-August-Ziel realistisch?

Wenn Sie als Entwickler oder technischer Entscheider die xAI-Grok-Release-Kadenz verfolgen und agentische Coding-Modelle evaluieren, kann Elon Musks X-Antwort an Vercel-CEO Guillermo Rauch vom 28. Juli 2026 Ihre Modell-Stack-Planung für die nächsten zwei Monate beeinflussen. Grok 4.6 ist für rund den 7. August mit 1,5 Billionen Parametern geplant, wenige Wochen später folgt Grok 4.7 mit 2,1 Billionen — nur einen Monat nach Grok 4.5. Dieser Artikel liefert Timeline, Kerndatentabellen, SFT/RL-Upgrade-Logik, Gegenüberstellung mit Kimi K3 und Claude Fable 5.1, Risikohinweise und eine Sechs-Schritte-Checkliste vor dem Release. Ergänzend: Grok-4.5-Review und Kimi-K3-Erklärung. Preise auf der Mietpreisseite.

xAI hat noch keine Benchmark-Scores oder Preise für Grok 4.6 veröffentlicht. Die folgenden Angaben stammen aus Musks öffentlichen Statements und Branchenberichten — vor dem Release unbedingt über offizielle xAI-Kanäle prüfen.

  • Einzelquellen-Risiko: Primärquelle ist bisher nur Musks X-Reply vom 28. Juli. Kein passender xAI-Blogpost oder Produktseite — das Datum kann vor- oder nachziehen.
  • „Musk time“-Spielraum: Zeitpläne von xAI, Tesla und SpaceX sind historisch um Tage bis Wochen verrutscht. „Rund 7. August“ ist ein Ziel, keine Garantie.
  • Benchmark- und Preislücken: Anders als Grok 4.5 mit Modellkarte und 15 Benchmarks gibt es für 4.6 keine unabhängige Evaluation oder offizielle Modellkarte.
  • Wettbewerbsfenster: Das Zieldatum liegt etwa 10 Tage nach Kimi K3s vollständigem Open-Weight-Release — Open-Source-Modelle drücken bereits Coding-Rankings.
  • Branchen-Spaltung beim Tempo: Am 28. Juli veröffentlichten über 1.200 Mitarbeitende von OpenAI, Anthropic, Google DeepMind und Meta den Brief „Pacing the Frontier“. xAI fehlt auf der Unterzeichnerliste.
  • Sicherheits- und Compliance-Hintergrund: Im Juli 2026 verklagte xAI erstmals einen Nutzer wegen mutmaßlicher CSAM-Generierung durch Sicherheitsumgehung. Ein Common-Sense-Media-Bericht von Januar 2026 stufte Grok unter die schlechtesten KI-Produkte für Kinderschutz ein — relevant für Unternehmen mit DSGVO-Pflichten bei personenbezogenen Daten in Agent-Workflows.

Kernaussage: „1,5 Billionen Parameter“ und „deutlich verbessertes SFT & RL“ sind derzeit Herstellerbehauptungen. Bis zur Modellkarte Kimi K3, Claude Fable 5.1 und weitere Fallback-Routen einplanen.

Wichtige Timeline:

  • 8. Juli 2026: xAI veröffentlicht Grok 4.5 für Coding und Agent-Aufgaben, Co-Training mit Cursor auf echten Entwicklersitzungen. 500K-Token-Kontext, 2 $/6 $ pro Million Input/Output-Tokens.
  • 16. Juli 2026: Moonshot AIs Kimi K3 startet als gehosteter Dienst.
  • 26. Juli 2026: Kimi K3 veröffentlicht Open Weights einen Tag früher — 2,8T Parameter, 1M-Token-Kontext.
  • 28. Juli 2026: Musk postet Grok-4.6/4.7-Roadmap als Antwort an Rauch. Gleicher Tag: „Pacing the Frontier“-Brief.
  • ~7. August 2026 (Ziel): Grok 4.6 geplant — 1,5T Parameter, Fokus SFT/RL.
  • ~Ende August bis Anfang September 2026 (geschätzt): Grok 4.7 geplant — 2,1T Parameter. Musk: überlegen in allem außer Serving-Geschwindigkeit, bessere Token-Effizienz.

Grok-Release-Kadenz und Parameterumfang (Stand 2026-07-30)
Modell Release / Zieldatum Parameter Positionierung Status
Grok 4.3 Beta17. Apr. 2026Nicht offengelegtVorgänger-BaselineVeröffentlicht
Grok 4.58. Jul. 2026Nicht offengelegt (Single SKU, kein MoE)Coding/Agent, Co-Training mit CursorVeröffentlicht
Grok 4.6~7. Aug. 20261,5TStarkes SFT/RL-UpgradeAngekündigt, nicht ausgeliefert
Grok 4.7~Ende Aug.–Anf. Sep.2,1TBreites Upgrade über 4.6, bessere Token-EffizienzAngekündigt, nicht ausgeliefert

Hinweis: Parameter, Preise und Benchmarks sind Hersteller- bzw. Musk-Angaben. Für Grok 4.6/4.7 gibt es keine Drittpartei-Evaluation — „angekündigt“ nur als Richtwert bis zum offiziellen Release.

Was SFT und RL lösen: Supervised Fine-Tuning (SFT) formt Modellverhalten mit kuratierten Beispielen. Reinforcement Learning (RL) nutzt Belohnungssignale für mehrstufige Agent-Aufgaben. Musk betonte SFT/RL statt reiner Skalierung — Fortsetzung von Grok 4.5. Dieses Modell erreichte 83,3 % auf Terminal-Bench 2.1 und 64,7 % auf SWE-Bench Pro mit deutlich weniger Output-Tokens als Claude Opus 4.8 (ca. 19.000 vs. 67.000 pro Aufgabe).

xAIs Doppelstrategie Skalierung plus Nachtraining: 1,5T bei Grok 4.6 ist ein klarer Sprung, doch Grok 4.7 mit 2,1T und „etwas langsamerem Serving“ deutet auf zwei SKUs für Qualität versus Latenz hin — nicht ein Modell für alle Szenarien.

Wettbewerbsdruck durch Kimi K3: Kimi K3 führt Frontend Code Arena mit 1.679 Punkten an — erstes Open-Weight-Modell vor allen Closed Models — und rangiert global #3 im Artificial-Analysis-Intelligence-Index. Musk kommentierte „beeindruckend“. Die komprimierte Grok-4.6/4.7-Kadenz gilt als Reaktion auf OpenAI, Anthropic und chinesische Anbieter.

Grok 4.6 vs. Konkurrenz: Parameter, Preise, Kontext
Modell Anbieter Parameter Kontextfenster Preis (Input/Output pro 1M Tokens) Quelle
Grok 4.5xAINicht offengelegt500K2 $ / 6 $xAI offiziell
Grok 4.6 (angekündigt)xAI1,5TNicht offengelegtNicht offengelegtMusk X-Post (unverifiziert)
Kimi K3Moonshot AI2,8T (MoE, ~16/896 Experten aktiv)1M0,30 $ (Cache Hit) / 3 $ (Miss) Input, 15 $ OutputMoonshot + Hugging Face
Claude Fable 5.1 (Gerücht)AnthropicNicht offengelegtNicht offengelegtGerücht: Fable-5-Preise (10 $ / 50 $)36kr, WinCentral — Anthropic unbestätigt
GPT-5.6 SolOpenAINicht offengelegtNicht offengelegtNicht offengelegtOpenAI offiziell

Zeilen zu Grok 4.6 und Claude Fable 5.1 sind Pre-Release-Angaben, keine verifizierten Benchmarks — nur für Timing und Positionierung.

Hält Musks Zeitplan, landen Grok 4.6 und 4.7 im selben Monat wie das gemunkelte Claude Fable 5.1 (Leaks von 36kr und WinCentral, Ziel vor OpenAIs erwartetem GPT-6) und wenige Wochen nach Kimi K3s Open-Weight-Schock. August 2026 könnte einer der dichtesten Frontier-Release-Monate werden. Für Teams verkürzt sich die Nutzungsdauer jedes Flaggschiffs auf Wochen — Token-Effizienz und reale Aufgabenkosten sind die haltbareren Entscheidungskriterien.

  1. Offizielle Informationsquellen fixieren: xAI-Blog, @xai und @elonmusk auf X folgen, Ankündigungen in Grok Build und API-Konsole aktivieren. Musks Posts vor offiziellem Release nicht als SLA werten.
  2. Grok-4.5-Kosten-Baseline aufbauen: Input/Output-Token-Verteilung und Rechnungen der aktuellen Agent-Workflows messen. Durchschnittliche Output-Tokens bei SWE-Bench-Pro-Klasse (~19.000 laut xAI) dokumentieren, 20–40 % Puffer für 4.6-Preise einplanen.
  3. SFT/RL-Upgrade auf Agent-Fehlermodi mappen: Tool-Call-Halluzinationen, Kontext-Truncation, spärliche Langketten-Belohnungen auflisten — was von 4.6-Nachtraining profitieren könnte vs. was menschliche Prüfung braucht.
  4. Gestuftes Routing vorbereiten: Batch-Volumen über Kimi K3 oder DeepSeek V4 Flash; schwere Reasoning-Schritte für Claude Fable 5.1 / GPT-5.6 Sol reservieren; Grok 4.6 zuerst in Nicht-Produktion A/B-testen. Siehe OpenRouter-Juli-Tiering.
  5. Integrations-Slots in Cursor/API-Clients reservieren: Entlang Grok-4.5-Rollout Modell-ID-Wechsel in Cursor, OpenRouter oder direkter xAI-API vorverdrahten — Release-Tag nur Model-String ändern.
  6. 7×24-macOS-Agent-Orchestrierung stabilisieren: Release-Fenster bedeuten dichte Regressionstests und parallele Modell-Evaluierung. Agent-Gateways, CI-Runner und Eval-Skripte auf dauerhaft laufenden macOS-Knoten betreiben. Hilfezentrum und Bestellseite.
grok-model-router.env
GROK_PRIMARY=grok-4.5
GROK_FALLBACK=kimi-k3
GROK_COMPLEX=claude-fable-5
XAI_API_BASE=https://api.x.ai/v1

  • Grok-4.6-Zieldatum: Musk: „rund 7. August“ — kein xAI-bestätigtes Datum (Quelle: X-Post 2026-07-28).
  • Parameterumfang: Grok 4.6 angekündigt 1,5T, Grok 4.7 2,1T (Quelle: gleicher Post, nicht Drittpartei-verifiziert).
  • Grok-4.5-Kontext und Preis: 500K Token, 2 $ Input / 6 $ Output pro Million (Quelle: xAI Grok-4.5-Modellkarte).
  • Grok-4.5-Token-Effizienz: ~19.000 Output-Tokens pro SWE-Bench-Pro-Aufgabe vs. ~67.000 bei Claude Opus 4.8 (Quelle: xAI-Modellkarte).
  • Grok-4.5-Coding-Benchmarks: Terminal-Bench 2.1 83,3 %, SWE-Bench Pro 64,7 % (Quelle: xAI offiziell).
  • Kimi-K3-Coding-Ranking: Frontend Code Arena 1.679 Punkte, Artificial Analysis Intelligence Index global #3 (Quelle: Arena.ai / Artificial Analysis).
  • Branchenhintergrund: 1.200+ Unterzeichner „Pacing the Frontier“ am 28. Juli; OpenAI und Anthropic auf Firmenebene (Quelle: The Verge, TechTimes).

FAQ-Auszug:

  • F: Wann genau erscheint Grok 4.6? A: Musk nannte „rund 7. August 2026“ in einem X-Post — xAI hat nicht offiziell bestätigt. Als verschiebbares Ziel behandeln.
  • F: Unterschied Grok 4.6 vs. 4.7? A: 4.6: 1,5T, SFT/RL-Fokus. 4.7: 2,1T, wenige Wochen später, überlegen außer Serving-Geschwindigkeit, bessere Token-Effizienz.
  • F: Schlägt 4.6 Kimi K3 oder Fable 5.1? A: Zu früh. Keine veröffentlichten 4.6-Benchmarks; K3 verifiziert; Fable 5.1 unbestätigt.
  • F: Was kostet 4.6? A: Unbekannt. 2 $/6 $ von Grok 4.5 als Referenz, Änderung möglich.
  • F: Wo nutzbar? A: Wahrscheinlich zuerst Grok Build, xAI-API, Konsole — für 4.6 unbestätigt.

Öffentliche Quellen zum Zeitpunkt der Erstellung; bei Aktualisierungen die Links prüfen.

https://x.ai/news/grok-4-5

https://media.x.ai

https://huggingface.co/moonshotai

Stand 30. Juli 2026. Alle Grok-4.6/4.7-Details sind Herstellerankündigungen oder Branchenleaks — vor Verlassen auf Datum, Spec oder Preis offizielle xAI-Kanäle prüfen.

Echte Nachteile gängiger Alternativen (Engineering-Sicht): (1) Grok-4.6-Regression auf dem Laptop: Deckel zu, Sleep, OAuth und lange Agent-Batches brechen ab — kein 7×24-Pipeline ohne Always-on-Host; (2) Mac Studio für Launch-Week kaufen, Inferenz bleibt auf xAI-API, lokale Hardware steht monatelang — Abschreibung übersteigt Wochenmiete deutlich; (3) Alles an ein Grok-SKU binden, Kimi-K3-Schock und August-Fable-5.1-Gerüchte ignorieren — nach Wochen Token-Kosten außer Kontrolle.

Für Teams mit Bedarf an dediziertem Apple Silicon, 7×24-Betrieb und flexibler Tag/Woche/Monat-Skalierung für Grok-/Kimi-K3-/Claude-Multi-Model-Routing und iOS-CI auf demselben macOS-Host ist NOVAKVM Mac-Mini-Bare-Metal-Miete in der Regel die bessere Wahl: sechs Regionen, High-Memory-Tiers, SSH-Direktzugriff — Cloud-API-Inferenz und stabile macOS-Ausführungsebene getrennt, dichte Release-Regression ohne Laptop-Sleep. M4-Pro- und Speicher-Tiers auf der NOVAKVM-Mietpreisseite vergleichen, Testknoten über Bestellseite starten, Remote-Setup im Hilfezentrum.