Wie schnell xAI mit Grok 4.6 und 4.7 aufschaltet
Nur einen Monat nach Grok 4.5 plant xAI offenbar drei Frontier-Modelle innerhalb von zwei Monaten. Benchmarks und Preise für Grok 4.6 sind noch nicht veröffentlicht.
8. Juli 2026: xAI veröffentlicht Grok 4.5, gemeinsam mit Cursor auf echten Entwicklersitzungen trainiert. 500K-Token-Kontext, $2/$6 pro Million Input/Output-Tokens.
16.–26. Juli 2026: Moonshot AIs Kimi K3 wechselt von gehostetem Preview zu vollständig offenen Gewichten (2,8T, 1M Token).
28. Juli 2026: Musk veröffentlicht die Grok-4.6/4.7-Roadmap. Am selben Tag erscheint der offene Brief „Pacing the Frontier" mit über 1.200 Unterzeichnern.
~7. August 2026 (Ziel): Grok 4.6, 1,5T Parameter, Fokus auf SFT/RL statt reiner Skalierung.
Ende August–Anfang September 2026 (geschätzt): Grok 4.7, 2,1T Parameter, laut Musk in jeder Hinsicht besser als 4.6, aber etwas langsamer beim Serving.
„Musk time" ist berüchtigt — Verzögerungen von Tagen bis Wochen sind bei xAI, Tesla und SpaceX keine Seltenheit. Verlassen Sie sich bis zur offiziellen Ankündigung auf xAI-Kanäle.
Grok 4.6 Spezifikationen im Vergleich mit Kimi K3 und Fable 5.1
| Modell | Datum | Parameter | Fokus | Status |
|---|---|---|---|---|
| Grok 4.5 | 08.07.2026 | Nicht offengelegt | Coding/Agentic | Veröffentlicht |
| Grok 4.6 | ~07.08.2026 | 1,5T | SFT/RL-Upgrade | Nur angekündigt |
| Grok 4.7 | ~Ende Aug.–Anf. Sep. | 2,1T | Über 4.6, bessere Token-Effizienz | Nur angekündigt |
| Modell | Anbieter | Parameter | Kontext | Preis (Input/Output pro 1M Tokens) |
|---|---|---|---|---|
| Grok 4.5 | xAI | Nicht offengelegt | 500K | $2 / $6 |
| Grok 4.6 (angekündigt) | xAI | 1,5T | Nicht offengelegt | Nicht offengelegt |
| Kimi K3 | Moonshot AI | 2,8T (MoE) | 1M | $0,30/$3 Input, $15 Output |
| Claude Fable 5.1 (Gerücht) | Anthropic | Nicht offengelegt | Nicht offengelegt | Wie Fable 5 vermutet |
Grok 4.6 soll fast genau 10 Tage nach Kimi K3s vollständiger Open-Weight-Veröffentlichung erscheinen — Kimi K3 führte die Frontend Code Arena mit 1.679 Punkten an.
Warum xAI Nachtraining statt nur Skalierung betont
Supervised Fine-Tuning (SFT) formt Modellverhalten anhand kuratierter Beispiele; Reinforcement Learning (RL) lehrt über Belohnungssignale, welche Aktionsfolgen in mehrstufigen Agentenaufgaben funktionieren.
Grok 4.5 erreichte dank Nachtraining auf echten Cursor-Entwicklersitzungen 83,3 % bei Terminal-Bench 2.1 und 64,7 % bei SWE-Bench Pro — mit nur etwa 15.954 Output-Tokens pro SWE-Bench-Pro-Aufgabe gegenüber 67.020 bei Opus 4.8, ein 4,2-facher Effizienzvorsprung.
Hinweis: Musk selbst kommentierte Kimi K3s Benchmark-Posts mit „beeindruckend". Im Artificial-Analysis-Intelligence-Index rangiert K3 weltweit auf Platz 3.
6-Schritte-Vorab-Runbook vor Grok 4.6
Informationsquellen fixieren: Den X-Post vom 28. Juli als „informelle Vorschau" markieren und xAI-Blog sowie Grok Build überwachen.
Baseline aufbauen: Token-Verbrauch und Latenz bei SWE-Bench, Terminal-Bench und eigenen Agentenaufgaben mit Grok 4.5, Kimi K3 API oder Claude Fable 5 dokumentieren.
A/B-Routing vorbereiten: Grok-4.6-Modell-ID-Platzhalter im API-Gateway oder LiteLLM einrichten für Grauveröffentlichung innerhalb von 24 Stunden.
Token-Effizienz messen: Leaderboard-Rang weniger wichtig als tatsächliche Rechnungskosten auf identischen Aufgaben nach dem Release.
Dual-SKU-Strategie planen: 4.6 für latenzkritische, 4.7 für qualitätskritische Workloads in der Routing-Policy trennen.
Lieferantenrisiko aktualisieren: Im Juli 2026 verklagte xAI erstmals einen Nutzer wegen mutmaßlicher CSAM-Generierung mit Grok. Common Sense Media stufte Grok im Januar 2026 als eines der schlechtesten KI-Produkte für Kinderschutz ein — relevant für DSGVO-konforme Anbieterbewertungen.
Risiken, Branchenspaltung und der August-2026-Release-Engpass
Einzige Quelle ist ein Tweet: Kein xAI-Blogpost, keine Model Card, keine Produktseite bestätigt Specs oder Datum.
Benchmarks und Preise fehlen: Im Gegensatz zu Grok 4.5s detaillierter Model Card gibt es für 4.6 keine unabhängige Evaluation.
Branchenspaltung beim Tempo: „Pacing the Frontier" und die Grok-4.6/4.7-Ankündigung fielen auf denselben Tag — xAI fehlt auf der Unterzeichnerliste.
Achtung: Hält Musks Zeitplan, treffen Grok 4.6, Grok 4.7 und das gemunkelte Claude Fable 5.1 im selben Monat aufeinander — August 2026 könnte einer der dichtesten Frontier-Release-Monate werden.
Die Nutzungsdauer jedes Flaggschiff-Modells schrumpft auf Wochen. Lokale Macs kämpfen mit Schlafmodus, Update-Dialogen und Speichergrenzen bei lang laufenden Agenten-Pipelines. Für stabile iOS-CI/CD- und AI-Agent-Automatisierung in Produktion ist MESHLAUNCH Mac Mini Cloud-Miete meist die bessere Wahl: dedizierte Apple Silicon, 24/7-Betrieb, flexible Tages-/Wochen-/Monatsabrechnung — Inferenz über API, Builds und Orchestrierung auf stabilen Cloud-Mac-Knoten.
Musk nannte auf X „etwa den 7. August 2026", xAI hat das Datum jedoch nicht offiziell bestätigt. Siehe Preisseite für Cloud-Mac-Entwicklungsumgebungen.
Grok 4.6: 1,5T Parameter, Fokus SFT/RL. Grok 4.7: 2,1T, laut Musk in jeder Hinsicht besser als 4.6, aber etwas langsamer beim Serving, mit höherer Token-Effizienz.
Zu früh für ein Urteil. Grok 4.6 hat keine veröffentlichten Benchmarks; Kimi K3 hat verifizierte Drittpartei-Scores. Siehe Hilfezentrum für Cloud-Mac-Konfiguration.
Unbekannt. Grok 4.5 startete bei $2 Input / $6 Output pro Million Tokens — ein sinnvoller Referenzwert, bis xAI 4.6-Preise nennt.
Nach Grok 4.5s Rollout wahrscheinlich zuerst Grok Build, xAI API und xAI-Konsole, danach Drittplattformen wie Cursor — für 4.6 noch unbestätigt.