Modellleitfaden

Claude Fable 5.1:
der vollständige Leitfaden

Veröffentlicht am 2026-09-01. Input mit $10 und Output mit $50 pro Million Tokens sind gegenüber Fable 5 unverändert; geändert haben sich die Cache-Lesevorgänge, von $1.00 auf $0.25 – die Ankündigung sagt: „Cache reads now cost 75% less“. Der Kontext beträgt 1M, die maximale Ausgabe 128K. Bei QCode lautet die Modell-ID claude-fable-5-1.

Aktualisiert 2026-09-02

#Cache-Lesevorgänge −75 %#1M Kontext#128K Output#claude-fable-5-1

Vier Kennzahlen zu Preisen und Spezifikationen

$0.25

Cache-Lesevorgang, pro Million Tokens

Fable 5 berechnet $1.00, das sind 75 % weniger. Workloads, die langen Kontext wiederholt neu einlesen, profitieren am direktesten.

$10 / $50

Input / Output, pro Million Tokens

Identisch mit Fable 5 – der Listenpreis hat sich nicht geändert. Nur die Cache-Zeile wurde angepasst.

1M / 128K

Kontextfenster / maximaler Output

Wie bei Fable 5. Auch die Cache-Schreibvorgänge sind unverändert: $12.50 für die 5-Minuten-Stufe und $20 für die 1-Stunden-Stufe.

≈−25 %

Offizielle Schätzung für eine typische Rechnung

Laut Ankündigung sind typische Workloads etwa 25 % günstiger als mit Fable 5, bei komplexen, stark agentischen Aufgaben sind die Einsparungen größer.

Was sich tatsächlich geändert hat

Die Hauptpreise haben sich nicht geändert: $10 Input und $50 Output pro Million Tokens, genau wie bei Fable 5. Geändert hat sich der Cache-Lesevorgang, von $1.00 auf $0.25. Das ist keine Marketingzahl – sie entscheidet über die tatsächliche Rechnung bei Workloads der Klasse „langer Kontext, viele Turns“. Ein Agent liest bei jedem Turn seinen gesamten Kontext neu ein, daher sind Cache-Lesevorgänge oft der größte Posten auf der Rechnung; wird dieser Posten um drei Viertel gekürzt, bringt das deutlich mehr als eine Senkung des Input-Preises.

Offizielle Formulierung und Preise (geprüft am 2026-09-02)

Die Ankündigung nennt „Cache reads now cost 75% less, or $0.25 per million tokens“ sowie „costs are reduced by around 25% relative to Fable 5“, mit größeren Einsparungen bei komplexen, stark agentischen Aufgaben. Die Preistabelle stimmt Zeile für Zeile damit überein: Input $10, Output $50, Cache-Lesevorgang $0.25, Cache-Schreibvorgänge $12.50 für die 5-Minuten-Stufe und $20 für die 1-Stunden-Stufe, 1M Kontext und 128K maximaler Output. Mythos 5.1, das zeitgleich erschienen ist, teilt dieselbe Basis mit lockereren Schutzmechanismen und steht nur geprüften Organisationen zur Verfügung – es ist kein öffentlich aufrufbares Modell.

Zeitachse der Fable-Reihe

2026-06-09

Fable 5 und Mythos 5 veröffentlicht.

2026-06-12 → 07-01

Fable 5 wurde aufgrund einer US-Exportkontrollanweisung für alle Kunden deaktiviert und am 1. Juli wiederhergestellt. Andere Claude-Modelle waren damals nicht betroffen.

2026-09-01

Fable 5.1 und Mythos 5.1 veröffentlicht. Fable 5.1 ist allgemein verfügbar; Mythos 5.1 ist auf geprüfte Organisationen beschränkt.

Bestätigt vs. was Sie selbst messen müssen

Bestätigt, mit Primärquelle

① Cache-Lesevorgänge wurden von $1.00 auf $0.25 gesenkt, in der Ankündigung als 75 % niedriger angegeben. ② Input $10 und Output $50 unverändert. ③ 1M Kontext und 128K maximaler Output. ④ Die offizielle Schätzung für typische Workloads liegt bei etwa 25 % günstiger. ⑤ Mythos 5.1 ist kein öffentlich aufrufbares Modell.

Was Sie selbst messen müssen

Wie viel Sie tatsächlich sparen, hängt von Ihrer Cache-Trefferquote ab, die wiederum von Ihrer Prompt-Struktur und Ihrer Aufruffrequenz abhängt. Die offiziellen 25 % sind eine Schätzung für typische Workloads, keine Zusage. So messen Sie: Senden Sie einen festen, einigermaßen langen Input mindestens dreimal, verwerfen Sie den ersten Durchlauf und sehen Sie sich an, welchen Anteil der Nutzung bei den übrigen Cache-Lesevorgänge ausmachen – dieser Anteil entscheidet, wie viel Ihnen diese Preissenkung wert ist.

Fable 5.1 vs. Fable 5

Eine andere Rechnungsstruktur

Input und Output kosten bei beiden gleich viel; der gesamte Unterschied liegt bei den Cache-Lesevorgängen ($0.25 gegenüber $1.00). Je höher Ihre Trefferquote, je länger Ihr Kontext und je mehr Turns Sie ausführen, desto größer ist der Vorteil von 5.1. Bei einer einmaligen kurzen Frage zeigt sich fast kein Unterschied.

Spezifikationen und Migration

1M Kontext und 128K maximaler Output sind identisch, der Wechsel besteht also nur darin, die Modell-ID zu ändern. Beachten Sie, dass 5.1 einige Verhaltensänderungen auf Entwicklerseite mitbringt – zum Beispiel beim Umgang mit Thinking-Inhalten aus früheren Turns –, führen Sie daher vor der Migration eines Agents mit langen Ketten eigene Regressionsfälle durch.

So entscheiden Sie, ob sich der Wechsel lohnt

① Messen Sie, welchen Anteil Cache-Lesevorgänge an Ihrer aktuellen Rechnung haben – dafür ist kein Modellwechsel nötig, Sie müssen nur die Zusammensetzung Ihrer bestehenden Rechnung ansehen. ② Ist dieser Anteil klein (kurze Unterhaltungen, jedes Mal ein anderer Input), betrifft Sie diese Preissenkung kaum und es besteht keine Eile. ③ Ist er groß (Agents mit langem Kontext, die wiederholt dieselbe Codebasis lesen), entspricht Ihre Einsparung im Kern diesem Posten mal 75 %. ④ Führen Sie vor dem Wechsel eigene Regressionsfälle durch; entscheiden Sie nicht allein nach dem Preis.

Bei QCode

Die Modell-ID lautet claude-fable-5-1 (die Schreibweise mit Punkt, claude-fable-5.1, wird auf dasselbe Modell normalisiert). Der Preis ergibt sich aus dem Listenpreis des Anbieters mal einem Service-Multiplikator, sodass die Senkung beim Cache-Lesevorgang direkt in Ihre Abbuchung einfließt – Grundlage der Abbuchung ist der usage-Block in der Antwort. So überprüfen Sie das: Senden Sie einen festen Input einige Male und prüfen Sie, ob der Cache-Lesevorgang in usage zur $0.25-Stufe berechnet wird.

FAQ

Wie viel günstiger ist Fable 5.1 als Fable 5?

Beim Listenpreis hat sich nur das Lesen aus dem Cache geändert: von $1.00 auf $0.25 pro Million Tokens, also 75 % weniger. Input mit $10 und Output mit $50 bleiben unverändert. Die offizielle Gesamtschätzung liegt bei rund 25 % niedrigeren Kosten für typische Workloads und bei noch mehr für komplexe agentische Workloads – der tatsächliche Wert hängt jedoch vollständig von Ihrer Cache-Trefferquote ab.

Haben sich das Kontextfenster oder die maximale Ausgabe geändert?

Nein. Das Kontextfenster beträgt 1M und die maximale Ausgabe 128K, genau wie bei Fable 5. Auch die beiden Cache-Schreibstufen ($12.50 für 5 Minuten, $20 für eine Stunde) bleiben unverändert.

Kann ich Mythos 5.1 aufrufen?

Nein. Mythos 5.1 teilt sich die Basis mit Fable 5.1, hat aber lockerere Schutzmechanismen und steht nur geprüften Organisationen offen; es ist kein öffentlich aufrufbares Modell. Wenn ein Kanal behauptet, Ihnen Mythos bereitstellen zu können, sollten Sie dafür einen Nachweis verlangen.

Welche Modell-ID sollte ich verwenden?

Verwenden Sie claude-fable-5-1. Die Schreibweise mit Punkt wird zum selben Modell normalisiert, aber wenn Sie einheitlich die Schreibweise mit Bindestrichen verwenden, stehen in Ihren eigenen Logs und Rechnungen nicht zwei Schreibweisen für dasselbe Modell.

Muss ich für die Migration von Fable 5 Code ändern?

Auf Schnittstellenebene genügt es, die Modell-ID zu ändern. Allerdings bringt 5.1 einige Verhaltensänderungen auf Entwicklerseite mit – zum Beispiel, wie Thinking-Inhalte aus früheren Turns behandelt werden. Führen Sie daher Ihre eigenen Regressionsfälle aus, bevor Sie einen Agenten mit langen Ketten allein wegen des Preises komplett umstellen.

Wie stelle ich fest, ob die Preissenkung tatsächlich auf meiner Rechnung angekommen ist?

Sehen Sie sich die Nutzung an. Senden Sie mindestens dreimal denselben, einigermaßen langen Input, verwerfen Sie den ersten Durchlauf (Kaltstart), nehmen Sie dann bei den übrigen die Cache-Read-Tokens und die zugehörigen Abbuchungen und rechnen Sie daraus den Stückpreis zurück, um zu sehen, ob er bei der Stufe von $0.25 liegt. Das ist direkter als jede Darstellung aus zweiter Hand.

Quellen

Senkung beim Cache-Lesen und Gesamtreduktion: Offizielle Ankündigungsseite von Anthropic (abgerufen am 2026-09-02; sie enthält „Cache reads now cost 75% less, or $0.25 per million tokens“ und „costs are reduced by around 25% relative to Fable 5“). Preise je Position, Kontext und maximale Ausgabe: der litellm-Preis-Snapshot, auf dem unsere Preise basieren (geprüft am 2026-09-02: Input 1e-05, Output 5e-05, Cache-Lesen 2.5e-07, Cache-Schreiben 1.25e-05 und 2e-05 pro Token; max_input 1,000,000, max_output 128,000). Die Verfügbarkeit von Mythos 5.1 wird in derselben Ankündigung genannt. Preise ändern sich mit Änderungen beim Anbieter; maßgeblich sind die offiziellen Seiten und unsere Preisseite.

Messen Sie zuerst Ihren Cache-Anteil

Je größer der Anteil des Cache-Lesens an Ihrer Rechnung ist, desto mehr lohnt sich diese Senkung; ist er klein, besteht kein Grund zur Eile beim Umstieg.

Weiterführende Informationen

Preise und Spezifikationen auf dieser Seite wurden am 2026-09-02 geprüft und ändern sich mit Änderungen beim Anbieter. Die offizielle Kostensenkung ist eine Schätzung für typische Workloads und keine Zusage für Ihre. Maßgeblich für die Modellverfügbarkeit sind /models und Ihre eigenen Tests.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.