Grok 4.6
Zurück an der Spitze, weiterhin $2/$6
Der Launch von SpaceXAI am 2026-08-12 konzentriert sich auf lang laufende Agenten und visuelle/interaktive erste Entwürfe. Verfügbar in Cursor, Grok Build, API und OpenRouter. Enthalten ist 2× Nutzung in der ersten Woche.
Aktualisiert 2026-08-15
Highlights
AA Intelligence
Gleichauf mit Sol; hinter Opus 5 max mit 63 und Fable 5 max mit 62.
Input / Output
Unverändert gegenüber 4.5. Der Cache-Treffer stieg von $0.30 auf $0.50. Die Fast-Variante kostet das Doppelte.
Kontext
Wie bei 4.5 – nicht 1M.
DeepSWE v1.1
Hinter Sol mit 73% und Fable mit 70% in der offiziellen 4.6-Tabelle.
Was 4.6 ist
Grok 4.6 ist ein längerer zusätzlicher Trainingslauf auf Basis von 4.5 plus mit 4.5 neu generierten SFT-Daten – kein neues Pre-Training. xAI hat für 4.6 keine Parameterzahl veröffentlicht; die von manchen frühen Blogs genannten „2T“ widersprechen späteren Aussagen des Gründers zu 4.7, daher nennt diese Seite keine Zahl.
Warum es im Trend liegt
Die meistgeteilte Zahl ist der Effizienzvergleich von Artificial Analysis: Bei Briefcase braucht Grok 4.6 etwa 53 Durchläufe und 0.5B Input-Tokens, Opus 5 dagegen rund 103 Durchläufe und 2.0B. Beachten Sie, dass die beiden Terminal-Bench-Werte nicht vergleichbar sind – die Launch-Tabelle von xAI nutzt TB v3.0 (26%), Artificial Analysis nennt TB v2.1 (88.4%).
Zeitachse
Ära des Grok-4.5-Launchs.
Musk deutet erst 4.6, dann 4.7 an.
4.6 allgemein verfügbar – einige Tage nach dem Hinweis um den 7. Aug.
Bestätigt vs. Vorsicht
Bestätigt
Launch-Beitrag + Eval-Tabelle; AA-Artikel vom 2026-08-12; $2/$6; 500K; in der ersten Woche 2× in Cursor/Build.
Vorsicht / Gerücht
Drei Dinge werden verwechselt: xAI hat für 4.6 keine Parameterzahl veröffentlicht, und die online kursierenden 2.1T stammen aus Aussagen des Gründers zu 4.7; Terminal-Bench v3.0 und 2.1 sind unterschiedliche Skalen und gehören nicht in dieselbe Spalte; und die Fast-Variante kostet das Doppelte – sie ist kein kostenloses Tempo.
So wählen Sie
4.6 wählen
Für lange Agenten, visuelle Apps, als $2/$6-Absicherung gegen hohe Opus-/Sol-Rechnungen sowie für Cursor-/Build-Nutzer.
Etwas anderes wählen
Sie brauchen 1M Kontext, die maximale DeepSWE-Leistung oder Stacks, die auf Claude bzw. OpenAI setzen.
So nutzen Sie es
console.x.ai / Cursor / x.ai/build. Modell über /models.
Bei QCode
QCode führt die Grok-Familie derzeit nicht – unter /models gibt es kein Grok-Modell. Wenn Sie eine Alternative im gleichen Leistungsbereich suchen, listet der Katalog claude-opus-5, gpt-5.6-sol, deepseek-v4-pro und kimi-k3.
FAQ
Ist 4.6 erschienen?
Ja. 2026-08-12.
Besser als Opus 5?
AA 61 vs. 63. Günstiger und weniger Durchläufe. Kein K.-o.
Besser als 4.5?
AA 56→61, deutlich stärkere Long-Agent-Story. Der Cache-Treffer wurde teurer.
Kontext 1M?
Nein. 500K.
Wo ist 4.7?
Nicht veröffentlicht. Separater Tracker.
TB 26% sieht schlecht aus?
Das ist Terminal-Bench v3.0 aus der Launch-Tabelle. Der TB-v2.1-Wert von AA liegt bei 88.4%. Unterschiedliche Tests.
Quellen
x.ai/news/grok-4-6; AA-Artikel vom 2026-08-12.
Nutzen Sie das Grok, das es gibt
4.6 ist die aktive ID. 4.7 ist nur eine Schlagzeile.
Verwandt
4.6 vs. Opus 5
Kosten und Durchläufe.
Grok-4.7-Tracker
Nicht veröffentlicht.
Grok-4.5-Guide
Seite zum vorherigen Flaggschiff.
Nicht mit SpaceXAI / xAI verbunden.