Vergleich · beide live

Grok 4.6 vs. Opus 5
Ein AA-Punkt, 4× Unterschied beim Output-Preis

Die Zahlen stammen aus dem Artificial-Analysis-Bericht vom 2026-08-12 und der offiziellen Launch-Tabelle von Grok 4.6. Opus 5 liegt bei der Intelligenz weiterhin vorn, 63 zu 61, während Grok 4.6 pro Output-Token etwa ein Viertel kostet.

Aktualisiert 2026-09-21

#61 vs. 63#$2/$6 vs. $5/$25#53 vs. 103 Turns#500K vs. prüfen

Highlights

61 vs. 63

AA

Opus 5 max 63, Grok 4.6 61, Sol 61, Fable 62.

$2/$6 vs. $5/$25

Listenpreise

Opus 5 $5/$25 ist das häufig genannte Paar – prüfen Sie Anthropic beim Deployment.

53 vs. 103

AA-Briefcase-Turns

Auch ~0,5 Mrd. vs. ~2,0 Mrd. Input-Tokens. Effizienz ist die Geschichte von 4.6.

DeepSWE

65.9% vs. 73% Sol / 70% Fable

Grok 4.6 erreicht 65.9% bei DeepSWE. Die Launch-Tabelle von 4.6 nennt keinen DeepSWE-Wert für Opus 5, daher gibt es für diese Zeile keinen Vergleich aus derselben Quelle. Beim Coding bleibt Grok die schwächere Seite.

Das Duell

Das ist die Frage „Kann ich Opus 5 ersetzen, um Geld zu sparen?“. Antwort: Sie geben einen AA-Punkt und etwas Coding-Benchmark ab, gewinnen dafür bei Preis und Turn-Zahl.

Warum es im Trend liegt

Grok 4.6 erzielt in der eigenen Tabelle außerdem Harvey LAB 15.8% vs. Sol 2.5% – ein netter Hinweis, nicht die Hauptsache.

Zeitachse

2026-08-12

4.6 + AA-Artikel am selben Tag.

—

Opus 5 ist bereits unter /claude-opus-5-guide auf dieser Website.

TB-Hinweis

Launch-Tabelle TB v3.0 26% vs. Fable 34.1% / Sol 34.6%. Getrennt von TB 2.1.

Bestätigt vs. Vorsicht

Bestätigt

AA 61 vs. 63; $2/$6 vs. angegebene $5/$25; Briefcase-Turns 53 vs. 103; 500K vs. Opus-5-Fenster auf der bestehenden Opus-Seite.

Vorsicht

Zwei häufige Fehler: einen nie veröffentlichten DeepSWE-Wert für Opus 5 einzutragen und Groks Terminal-Bench v3.0 mit DeepSeeks TB 2.1 zu vergleichen. Opus 5 ist offiziell mit $5/M Input und $25/M Output gelistet.

So wählen Sie

Opus 5 wählen

Maximales Urteilsvermögen, Claude-Stack, wenn ein AA-Punkt und Coding-Benchmarks wichtiger sind als die Rechnung.

Grok 4.6 wählen

Lange Agenten mit kleinem Budget, Cursor/Build, turn-effiziente Briefcase-ähnliche Aufgaben.

So nutzen Sie es

Beide sind Live-Produkte. Querverweise auf /grok-4-6-guide und /claude-opus-5-guide.

Bei QCode

QCode listet derzeit claude-opus-5 unter /models, führt die Grok-Familie aber nicht. Diese Seite ist ein Vergleich von Fähigkeiten und Preisen, keine Aussage, dass beide über QCode aufrufbar sind.

FAQ

Wer gewinnt?

Opus 5 bei AA und den meisten Coding-Zeilen; 4.6 bei Preis und Turns.

Sind $5/$25 offiziell?

Häufig genannt; prüfen Sie die Preisseiten von Anthropic/QCode.

Reichen 500K im Vergleich zu Opus?

Hängt vom Repo ab. 4.6 ist kein 1M-Modell.

2× in der ersten Woche?

Das 2×-Angebot der Launch-Woche (angekündigt am 2026-08-12) ist abgelaufen; kein Preisversprechen. Erneut geprüft am 2026-09-21.

Warum vergleicht diese Seite 4.6 und nicht 4.7?

4.7 ist nicht erschienen. Nutzen Sie den 4.7-Tracker.

Welche Rolle spielt Fable 5?

AA 62, neben den 61 von 4.6. Für dieses Paar gibt es eine andere Seite.

Quellen

AA-Artikel zu Grok 4.6; Tabelle unter x.ai/news/grok-4-6; bestehende Opus-5-Seite für Fenster/Preis.

Ein AA-Punkt, die vierfache Output-Rechnung

Mehr steht nicht auf dieser Seite. Überbewerten Sie keine der beiden Seiten.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.