Claude Haiku 5.5 Leitfaden: Preise, Specs und Plattformen
Stand 2026-10-08: Claude Haiku 5.5 (Modell-ID claude-haiku-5-5) ist am 2026-10-07 erschienen – mit 1M Kontextfenster und 128K maximaler Ausgabe, abgerechnet in zwei Stufen nach Prompt-Länge. Bei Prompts bis 100.000 Tokens kostet der Input $0.10 und der Output $0.50 pro Million Tokens, bei Prompts über 100.000 Tokens $0.50 bzw. $2.50. Anthropic nennt es sein leistungsfähigstes Modell für große Volumen und latenzkritische Aufgaben. Diese Seite fasst IDs, beide Preisstufen, Einsatzzwecke, die Unterschiede zu Haiku 4.5 und die Plattformen zusammen.
Aktualisiert 2026-10-08
Vier Kennzahlen
Veröffentlichung
Die offizielle Modellseite nennt „Released October 7, 2026“, am selben Tag erschien das Modell in den Release Notes der Claude API. Status: Active, Abschaltung nicht vor 2027-10-07.
Input / Output, Prompt ≤100K (pro Million Tokens)
Preise für Prompts bis 100.000 Tokens: Cache-Lesen $0.01, 5-Minuten-Cache-Schreiben $0.125, 1-Stunden-Cache-Schreiben $0.20.
Input / Output, Prompt >100K
Sobald ein Prompt 100.000 Tokens überschreitet, werden Input und Output nach dieser Stufe berechnet: Cache-Lesen $0.05, 5-Minuten-Cache-Schreiben $0.625, 1-Stunden-Cache-Schreiben $1.
Kontextfenster / max. Ausgabe
Haiku 4.5 bietet 200K / 64K. Eingabe: Text und Bilder, Ausgabe: Text.
Was Haiku 5.5 ist und wofür es gedacht ist
Stand 2026-10-08 ist Claude Haiku 5.5 das Haiku-Modell, das Anthropic am 2026-10-07 veröffentlicht hat; die offiziellen Release Notes nennen es „our most capable model tuned for high-volume and latency-sensitive work“. Die offizielle Modellseite nennt als typische Aufgaben Klassifizierung, Routing, Extraktion und Subagenten-Aufgaben. Die Ankündigung ergänzt, dass es schnelle, wiederkehrende Arbeit wie Zusammenfassungen, Kontext-Kompaktierung, Datenbankabfragen und Klassifizierungsanfragen zuverlässig erledigt und beim Programmieren gut als Subagent neben Opus 5.5 und Sonnet 5.5 funktioniert. Dort steht auch, dass Sonnet 5.5 und Opus 5.5 für komplexes agentisches Programmieren die bessere Wahl bleiben. Es ist das erste Haiku mit Effort-Einstellung: Standard ist medium, Thinking ist standardmäßig aktiv.
Die Darstellung des Anbieters (erschienen 2026-10-07)
Laut Ankündigung ist Haiku 5.5 deutlich günstiger als Haiku 4.5: „On average, it now costs around 75% less to run.“ Eine Fußnote erklärt die Kalkulation: Anfragen bis 100.000 Tokens sind 90 % günstiger als bei Haiku 4.5, Anfragen darüber 50 %; rund 90 % der Haiku-4.5-Anfragen fielen in die erste Gruppe, und der Mehrverbrauch an Tokens durch den neuen Tokenizer ist bereits eingerechnet. Das ist Anthropics eigene Kalkulation. Die Preisseite ergänzt, dass unter den Modellen ab Claude 4.6 nur Haiku 5.5 nach Prompt-Länge abgerechnet wird; die übrigen berechnen das gesamte 1M-Kontextfenster zum Standardpreis. Für Endnutzer: In Claude.ai können Free-, Pro-, Max-, Team- und Enterprise-Nutzer Haiku 5.5 im Web sowie unter iOS und Android auswählen, außerdem läuft es in Claude Code.
Zeitleiste zu Haiku 5.5
Claude Haiku 4.5 erscheint (Modell-ID claude-haiku-4-5-20251001) mit 200K Kontextfenster und 64K maximaler Ausgabe.
Claude Haiku 5.5 erscheint als claude-haiku-5-5 mit 1M / 128K und zwei Preisstufen nach Prompt-Länge.
Das offizielle Abschaltdatum für Haiku 4.5 (claude-haiku-4-5-20251001) lautet „Not sooner than October 15, 2026“, also nicht vor diesem Tag – eine Untergrenze, kein Abschalttermin. Der Status ist weiterhin Active; die tatsächliche Ankündigung finden Sie auf der offiziellen Deprecation-Seite.
Bestätigt vs. nicht verifiziert
Bestätigt (wörtlich auf den offiziellen Seiten)
Alles Folgende lässt sich wörtlich auf offiziellen Seiten prüfen: Veröffentlichung 2026-10-07; Modell-ID claude-haiku-5-5 (feste ID ohne Datumssuffix und ohne separaten Alias), auf Amazon Bedrock anthropic.claude-haiku-5-5; 1M Kontext und 128K maximale Ausgabe; zwei Preisstufen (bis 100K: Input $0.10 / Output $0.50; über 100K: Input $0.50 / Output $2.50); Cache-Lesen $0.01 / $0.05; Batch API mit 50 % Rabatt auf Input und Output; Standard-Effort medium; rund 30 % mehr Tokens für denselben Text; manuelles budget_tokens, nicht standardmäßige temperature / top_p / top_k und Assistant-Prefill liefern jeweils 400; Abschaltung nicht vor 2027-10-07. Die Angabe „around 75% less“ und die Einsatzbeschreibungen sind Aussagen des Anbieters.
Nicht verifiziert und vom Anbieter nicht veröffentlicht
Vier Punkte decken die offiziellen Seiten nicht ab – planen Sie nicht auf Vermutungen. Erstens erklärt die Preisliste nicht, wie die Schwelle von 100.000 Tokens gezählt wird (etwa ob Cache-Schreib- und Cache-Treffer-Anteile mitzählen); diese Seite leitet das nicht her, gleichen Sie Ihre usage-Daten mit der offiziellen Preisliste ab. Zweitens ist „around 75% less“ Anthropics eigene Kalkulation auf Basis der Anfrageverteilung von Haiku 4.5; Ihre Ersparnis hängt von der Verteilung Ihrer Prompt-Längen ab. Drittens sind Benchmark-Werte und Kundenzitate in der Ankündigung Tests des Anbieters und Aussagen von Kunden; sie werden hier nicht wiedergegeben. Viertens ist nicht angekündigt, ob und wann claude-haiku-5-5 bei QCode gelistet wird; maßgeblich ist /models.
Vergleich mit Haiku 4.5 und Sonnet 5.5
Gegenüber Haiku 4.5
Haiku 4.5 (claude-haiku-4-5-20251001) kostet $1 Input / $5 Output, mit 200K Kontextfenster und 64K maximaler Ausgabe. Umgerechnet nach der offiziellen Preisliste: Bei Prompts bis 100.000 Tokens kostet Haiku 5.5 pro Token ein Zehntel von Haiku 4.5 ($0.10 / $0.50 gegenüber $1 / $5), bei Prompts über 100.000 Tokens die Hälfte ($0.50 / $2.50 gegenüber $1 / $5). Laut offizieller Dokumentation ergibt derselbe Text auf Haiku 5.5 aber rund 30 % mehr Tokens – zählen Sie vor einem Kostenvergleich neu. Haiku 5.5 bringt außerdem Effort und adaptives Thinking und hebt die Grenzen auf 1M Kontext und 128K Ausgabe.
Gegenüber Sonnet 5.5
Sonnet 5.5 (claude-sonnet-5-5) bietet 1M / 128K zu $2 Input / $10 Output, ohne Stufen nach Prompt-Länge. Umgerechnet nach der offiziellen Preisliste liegen die Token-Preise von Haiku 5.5 bei Prompts bis 100.000 Tokens bei einem Zwanzigstel von Sonnet 5.5, darüber bei einem Viertel. Die offizielle Arbeitsteilung: Für komplexes agentisches Programmieren bleiben Sonnet 5.5 und Opus 5.5 die bessere Wahl, Haiku 5.5 eignet sich am besten für eng umrissene Aufgaben, die mit früheren Claude-Versionen zu teuer gewesen wären – Kontext-Kompaktierung, Zusammenfassungen oder Subagenten-Arbeit.
Was Sie beim Umstieg von Haiku 4.5 ändern müssen
Die offiziellen Release Notes sagen es deutlich: „Code written for Claude Haiku 4.5 can break on Claude Haiku 5.5.“ Die wichtigsten Punkte aus dem Migrationsleitfaden: Erstens model auf claude-haiku-5-5 setzen (auf Bedrock anthropic.claude-haiku-5-5). Zweitens Prompts mit dem neuen Modell neu zählen und max_tokens sowie Kostenschätzungen prüfen – derselbe Text ergibt rund 30 % mehr Tokens, und Thinking-Tokens zählen zu max_tokens. Drittens thinking enabled mit budget_tokens durch adaptive ersetzen und die Tiefe über effort steuern (Thinking abschalten geht nur bei low, medium und high; bei xhigh und max kommt 400). Viertens temperature, top_p und top_k entfernen – nicht standardmäßige Werte liefern 400. Fünftens messages mit einem user-Turn beenden – ein Assistant-Prefill liefert 400, selbst bei abgeschaltetem Thinking. Sechstens Inhaltsblöcke nach type auswählen, da eine Antwort mit thinking-Blöcken beginnen kann.
Bei QCode
Ob claude-haiku-5-5 bei QCode gelistet ist, zeigt /models. Sie können claude-haiku-4-5-20251001 oder claude-sonnet-5-5 nutzen, die derzeit in /models angeboten werden: Tragen Sie mit Ihrem QCode-API-Key als Base URL für das Anthropic-Protokoll https://api.qcode.cc/api ein (derselbe Wert gehört bei Claude Code in ANTHROPIC_BASE_URL) und setzen Sie im Feld model die passende ID. Die QCode-Dokumentation hält fest, dass Claude-Modelle nur über den Endpunkt des Anthropic-Protokolls laufen, nicht über den OpenAI-kompatiblen. Abgerechnet wird pro Token, die Preise je Modell stehen unter /models. Falls /models claude-haiku-5-5 später führt, berücksichtigen Sie vor dem Wechsel die rund 30 % mehr Tokens und die Breaking Changes aus dem Abschnitt oben.
Häufig gestellte Fragen
Wann ist Claude Haiku 5.5 erschienen?
Am 2026-10-07. Die offizielle Modellseite nennt „Released October 7, 2026“, Release Notes der Claude API und Anthropics Ankündigung erschienen am selben Tag; der Status ist Active, abgeschaltet wird es nicht vor 2027-10-07.
Was kostet Claude Haiku 5.5?
Es gibt zwei Stufen nach Prompt-Länge. Bei Prompts bis 100.000 Tokens: Input $0.10, Output $0.50, Cache-Lesen $0.01, 5-Minuten-Cache-Schreiben $0.125, 1-Stunden-Cache-Schreiben $0.20 pro Million Tokens. Bei Prompts über 100.000 Tokens: Input $0.50, Output $2.50, Cache-Lesen $0.05, 5-Minuten-Cache-Schreiben $0.625, 1-Stunden-Cache-Schreiben $1. Die Batch API gewährt zusätzlich 50 % Rabatt auf Input und Output.
Wie viel teurer wird ein Prompt über 100K?
Jeder Preis ist fünfmal so hoch wie in der unteren Stufe, umgerechnet nach der offiziellen Preisliste. Bei jeweils 2.000 Output-Tokens kostet eine Anfrage mit 50.000 Input-Tokens $0.005 + $0.001 = $0.006; eine mit 150.000 Input-Tokens wird komplett nach der oberen Stufe berechnet: $0.075 + $0.005 = $0.08.
Wie lautet die Modell-ID auf den einzelnen Plattformen?
claude-haiku-5-5 auf der Claude API, Google Cloud, Microsoft Foundry und Claude Platform on AWS, anthropic.claude-haiku-5-5 auf Amazon Bedrock. Laut Migrationsleitfaden ist claude-haiku-5-5 eine feste Modell-ID ohne Datumssuffix und ohne separaten Alias.
Worin unterscheidet sich Haiku 5.5 von Haiku 4.5?
Vor allem in vier Punkten: Preis (umgerechnet nach der offiziellen Preisliste ein Zehntel bis 100K und die Hälfte darüber), Grenzen (1M / 128K gegenüber 200K / 64K), Thinking (adaptives Thinking standardmäßig aktiv, mit Effort, Standard medium; manuelles budget_tokens liefert 400) und Tokenisierung (rund 30 % mehr Tokens für denselben Text). Das offizielle Abschaltdatum von Haiku 4.5 liegt nicht vor 2026-10-15 (eine Untergrenze, kein Abschalttermin), der Status ist weiterhin Active.
Gibt es Haiku 5.5 bei QCode?
Maßgeblich ist /models: Diese Live-Liste zeigt, ob claude-haiku-5-5 bei QCode gelistet ist. Derzeit können Sie claude-haiku-4-5-20251001 oder claude-sonnet-5-5 aus /models mit der Base URL für das Anthropic-Protokoll https://api.qcode.cc/api nutzen; abgerechnet wird pro Token zu den Preisen auf /models.
Quellen
Spezifikationen, IDs je Plattform, beide Preisstufen und die Abschaltzusage: die offizielle Anthropic-Dokumentation – Übersichtsseite zu Claude Haiku 5.5, What's new in Claude Haiku 5.5 und der Migrationsleitfaden (abgerufen am 2026-10-08). Vollständige Preisliste, Erläuterung zu den Long-Context-Preisen und Batch-Rabatt: die offizielle Preisseite, am selben Tag abgerufen. Erscheinungsdatum und Plattformen: der Eintrag vom 2026-10-07 in den Release Notes der Claude Platform und die Anthropic-Newsseite. Positionierung, Einsatzzwecke und die Fußnote zur Kalkulation hinter „around 75% less“: die offizielle Ankündigung Introducing Claude Haiku 5.5 und die Produktseite Claude Haiku. Standard-Effort und Grenzen beim Abschalten des Thinking: die offizielle Effort-Dokumentation und Prompting Claude Haiku 5.5. Spezifikationen und Abschaltdatum von Haiku 4.5: die offizielle Übersichtsseite zu Claude Haiku 4.5. Spezifikationen von Sonnet 5.5: die offizielle Übersichtsseite zu Claude Sonnet 5.5. Verbindungsadresse bei QCode: die QCode-Dokumentationsseite zu Endpunkten und API-Formaten (aktualisiert am 2026-09-25).
Mit den Claude-Modellen starten, die es heute gibt
Ein Key für Claude-Modelle wie claude-haiku-4-5-20251001 und claude-sonnet-5-5, abgerechnet pro Token; ob Haiku 5.5 gelistet ist, zeigt /models.
Weiterführende Lektüre
Claude Haiku 5.5: Zeitpunkt der Veröffentlichung und was bekannt ist
Die Chronik vor dem Start und was wann bekannt war.
Claude Haiku 4.5: Der komplette Leitfaden
Spezifikationen, Preise und Einsatz des Vorgängers.
Claude Sonnet 5.5 Komplettguide
1M Kontext, $2 / $10 und die Breaking Changes.
Die Zahlen und Zitate auf dieser Seite wurden am 2026-10-08 anhand der offiziellen Anthropic-Dokumentation, Preisliste und Ankündigung geprüft; Änderungen beim Anbieter sind ohne Vorankündigung möglich. Kostenaussagen wie „around 75% less“ sind Angaben und Kalkulationen des Anbieters, keine Zusage für Ihre konkrete Arbeitslast. Für die Modellverfügbarkeit ist /models maßgeblich.