Veröffentlicht am 2026-05-28 von Anthropic

Claude Opus 4.8
Schärferes Agentic-Urteil · 4x weniger Codefehler

Schärferes, zuverlässigeres Urteil bei Agentic-Aufgaben, 4x weniger Codefehler als Opus 4.7, Online-Mind2Web 84 %, natives 1M-Context — zum gleichen Preis wie Opus 4.7 ($5/$25 pro MTok)

#Opus 4.8 #claude-opus-4-8 #agentic Coding #starke Multimodalität #Langzeit-Aufgaben #Pflichtlektüre zur Migration

Wichtigste Highlights

+13%
4x weniger Codefehler

4x weniger wahrscheinlich als Opus 4.7, Fehler im Code zuzulassen — ein Quantensprung bei der Zuverlässigkeit von Produktionscode

64.3%
Online-Mind2Web 84 %

84 % Erfolgsquote bei Computer-Use- / Browser-Agent-Workloads, mit schärferem, zuverlässigerem Agentic-Urteil

3.75 MP
Legal Agent Benchmark

Höchster jemals erzielter Wert und das erste Modell, das beim All-Pass-Standard insgesamt die 10 %-Marke überschreitet

$5 / $25
Gleicher Preis

$5 Input / $25 Output pro MTok — identisch mit Opus 4.7, keine Preiserhöhung

Coding-Sprung: Zuverlässigkeit, die Sie ausliefern können

Von Langzeit-Autonomie bis zu komplexen Tool-Aufrufen macht Opus 4.8 die agentic Code-Arbeit deutlich zuverlässiger — weit weniger Defekte, die nachgelagert auffallen

4x weniger Codefehler gegenüber 4.7

Opus 4.8 lässt 4x seltener Fehler im Code zu als Opus 4.7, was weniger Review-Zyklen und weniger Regressionen im Produktionsbetrieb bedeutet

CursorBench über jede Effort-Stufe hinweg

Übertrifft alle früheren Opus-Modelle bei CursorBench über jede Effort-Stufe hinweg — mehr Spielraum, ob Sie auf Latenz oder Tiefe optimieren

Schärferes Agentic-Urteil

Schärfer und zuverlässiger bei Agentic-Aufgaben: bessere Entscheidungen darüber, wann gehandelt, wann überprüft und wann nachgefragt wird

Super-Agent: End-to-End-Abschluss

Im Super-Agent-Benchmark ist Opus 4.8 das einzige Modell, das jeden Fall durchgängig End-to-End abschließt, ohne die Aufgabe abzubrechen

Online-Mind2Web 84 %

84 % Erfolg bei Computer-Use- / Browser-Agent-Aufgaben — liest dichte UIs, navigiert und handelt zuverlässig über mehrstufige Abläufe hinweg

⭐ Verbesserte Ehrlichkeit

Verbesserte Ehrlichkeit bedeutet weniger selbstsichere, aber falsche Aussagen über die eigene Arbeit — es kennzeichnet Unsicherheit, statt sie zu übertünchen

Starke Multimodalität & Lang-Context-Verarbeitung

Opus 4.8 verbindet starkes multimodales Verständnis mit verbesserter Lang-Context-Verarbeitung über natives 1M-Context — senden Sie Bilder direkt über die API, kein Parameterwechsel nötig

Computer-Use-Agenten, die dichte Screenshots lesen

Starke multimodale Verankerung lässt Agenten UI-Details lesen und zuverlässig handeln, und trägt zum Ergebnis von 84 % bei Online-Mind2Web bei

Lang-Context-Stabilität

Verbesserte Lang-Context-Verarbeitung über natives 1M-Context — große Repos, lange Transkripte und Multi-Dokument-Aufgaben bleiben kohärent

Dokument- & Diagramm-Verständnis

Liest Diagramme, Tabellen und Dokumentlayouts im Rahmen des multimodalen Reasonings und extrahiert Struktur und Details in einem Durchgang

Führung beim Legal Agent Benchmark

Höchster jemals erzielter Wert und der erste, der beim All-Pass-Standard die 10 %-Marke überschreitet — Beleg für zuverlässiges Urteil bei anspruchsvollen Domain-Aufgaben

Plattformfähigkeiten

xhigh

Effort-Stufe: xhigh

Die xhigh-Stufe zwischen high und max bietet einen feiner abgestuften Kompromiss zwischen Reasoning-Tiefe und Latenz. Wird in Opus 4.8 fortgeführt

/ultrareview

/ultrareview Tiefes Code-Review

Claude Code-Befehl für eine unabhängige Review-Sitzung, die Änderungen durchgängig End-to-End durchläuft und Bugs sowie Design-Probleme findet

task_budgets

Adaptive Thinking

Adaptive Thinking lässt Claude die Reasoning-Tiefe bei langen Aufgaben selbst zuteilen, statt eines festen Token-Budgets

auto_mode

Fast Mode-Standard

Opus 4.8 ist nun der Claude Code Fast Mode-Standard (ersetzt 4.7) und bringt schärferes Urteil in die täglichen schnellen Iterationen

Migrationsleitfaden (⭐ Wichtig)

Das Upgrade von Opus 4.7 auf Opus 4.8 ist ein direkter Austausch (Modell-ID auf claude-opus-4-8 ändern) — Folgendes gilt es zu beachten

1. Direkter Austausch der Modell-ID

Ändern Sie die Modell-ID von claude-opus-4-7 auf claude-opus-4-8 — keine weitere Konfigurationsänderung erforderlich

2. Schärferes Urteil erwarten

Opus 4.8 bringt schärferes Agentic-Urteil und verbesserte Ehrlichkeit; validieren Sie Prompts und Harnesses erneut, um die zuverlässigeren Entscheidungen zu nutzen

3. Adaptive Thinking nutzen

Verwenden Sie thinking={type:"adaptive"} mit dem effort-Parameter; die Legacy-Form thinking={type:"enabled", budget_tokens:N} bleibt missbilligt

4. 1M-Context & Fast Mode

Der native 1M-Context wird übernommen; Opus 4.8 ist nun der Fast Mode-Standard. Eine 1M-Context-Varianten-ID (claude-opus-4-8[1m]) ist ebenfalls verfügbar

Code-Beispiel: Modell-ID-Migration
❌ Missbilligt
client.messages.create(
    model="claude-opus-4-7",
    thinking={"type": "enabled", "budget_tokens": 10000}
)
✅ Empfohlen
client.messages.create(
    model="claude-opus-4-8",
    thinking={"type": "adaptive"},
    effort="xhigh"   # available since 4.7
)

vs GPT-5.4 / Gemini 3.1 Pro

Vergleich der Flaggschiffe derselben Stufe (Anthropic hat für das neueste Opus keine vollständige SWE-bench-Pro-Zahl veröffentlicht — die zentralen Fortschritte sind Agentic-Zuverlässigkeit und 4x weniger Codefehler)

Metrik Opus 4.8 GPT-5.4 Gemini 3.1 Pro
Code-Zuverlässigkeit 4x weniger Fehler gegenüber 4.7 Siehe OpenAI Siehe Google
Input $ / MTok $5 Siehe OpenAI Siehe Google
Output $ / MTok $25 Siehe OpenAI Siehe Google
Context-Fenster Nativ 1M 272K / 1M beta 1M
Computer-Use (Online-Mind2Web) 84 % — —

Opus 4.8 über QCode.cc beziehen

Stabile Entwicklerplattform zu offiziellen Preisen — ab $8.57/Monat, nach der Zahlung automatisch freigeschaltet

Gleicher Preis $5/$25

QCode.cc abrechnet zu den offiziellen Sätzen von Anthropic ohne Multiplikator-Aufschlag

Volle Unterstützung neuer Parameter

Vollständige Durchleitung von xhigh effort, adaptive thinking und weiteren Opus 4.8-Parametern

Drop-in-Wechsel von 4.7 auf 4.8

Modell-ID von claude-opus-4-7 auf claude-opus-4-8 ändern, keine weiteren Konfigurationsänderungen nötig

China-Direkt mit Failover

Multi-Node-Smart-Routing + Circuit Breaker vermeiden die Instabilität des direkten offiziellen API-Zugriffs aus China

Opus 4.8 jetzt testen

Registrieren Sie sich bei QCode.cc für eine stabile Claude Opus 4.8 Entwicklerplattform

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.