Was kostet GPT-5.6 wirklich?
Tier-Preise, Caching und echte Kosten
Entscheidend ist die Rechnung, nicht das Launch-Preisschild. Sol kostet jetzt $4/$20 laut Archiv der offiziellen Preisseite vom 2026-09-12 (Promo mindestens bis 2026-11-21; das Launch-Preisschild war $5/$30), Terra $2/$12, Luna $0.20/$1.20 pro Million Token; die tatsächlichen Kosten hängen von Cache-Hits ab. Die Codex-Abo-Nutzung läuft über einen eigenen Zähler: OpenAIs @thsottiaux schrieb am 2026-07-29 (abgerufen 2026-08-30), dass OpenAI die Nutzung in keinem Abo-Plan reduziert hat, dass Sol die Codex-Limits schneller als erwartet verbraucht hat, dass die Nutzungslimits für alle ChatGPT-Work- und Codex-Nutzer zurückgesetzt wurden und dass die typische Sol-Nutzung rund 18% länger halten sollte.
OpenAI senkte Luna um 80% auf $0.20/$1.20 und Terra um 20% auf $2/$12. Sol blieb Stand 2026-08-02 bei $5/$30, mit Fast mode (das Archiv der offiziellen Preisseite vom 2026-09-12 zeigt $4/$20, Promo mindestens bis 2026-11-21). Laufende Änderungen verfolgen Sie im Luna-Preis-Tracker.
GPT-5.6 Luna-Preis-Tracker öffnenOffizielle Preistabelle (pro 1M Token)
Cache-Writes kosten das 1.25-Fache der Input-Rate, Cache-Reads erhalten 90% Rabatt. Alle drei Tiers teilen sich einen API-Context von 1,050,000 Token und 128,000 Max-Output; über 272K Input wird die gesamte Request mit 2x Input und 1.5x Output abgerechnet. Die Sol-Spalte zeigt aktuelle Promo-Preise (mindestens bis 2026-11-21) -- das Launch-Preisschild $5/$30 steht in den Beispielen unten.
| Tier | Input | Output | Cache-Write (1.25x) | Cache-Read (−90%) |
|---|---|---|---|---|
| gpt-5.6-sol | $4 | $20 | $5.00 | $0.40 |
| gpt-5.6-terra | $2 | $12 | $2.50 | $0.20 |
| gpt-5.6-luna | $0.20 | $1.20 | $0.25 | $0.02 |
Die GA-Cache-Upgrades, für die sich Planung lohnt
GPT-5.6 liefert ab GA ein vorhersagbareres Prompt-Caching: explizite Cache-Breakpoints (Sie entscheiden, wo der Prefix geteilt wird) und mindestens 30 Minuten Cache-Lebensdauer. Für Agent-Workflows heißt das: System-Prompts und Tool-Definitionen als gecachten Prefix fixieren — so lassen sich die Input-Kosten langer Sessions um bis zu 90% senken.
Drei nachvollziehbare Kostenbeispiele
Im Einzelnen zu offiziellen Raten — eigene Volumina einsetzen und nachprüfen.
Agent-Alltagssitzung (Terra)
800K Input + 60K Output bei Terra: 0.8 x $2 + 0.06 x $12 = $1.60 + $0.72 = rund $2.32 (Listenpreise für kurzen Context, Stand 2026-08-02). Entfallen 80% des Inputs auf Cache-Reads ($0.20/M), kostet der Input-Teil 0.16 x $2 + 0.64 x $0.20 = $0.448, gesamt also rund $1.17.
Schwere Aufgabe (Sol, viele Cache-Hits)
500K Input (davon 400K als Cache-Reads) + 50K Output zum aktuellen Sol-Preis laut Archiv der offiziellen Preisseite vom 2026-09-12 ($4 Input, $0.40 Cache-Read, $20 Output; Promo mindestens bis 2026-11-21): 0.1 x $4 + 0.4 x $0.40 + 0.05 x $20 = $0.40 + $0.16 + $1.00 = rund $1.56 (rund $2.20 zum Launch-Preis $5/$30). Mit Caching landet ein Sol-Deep-Dive bei gleichem Volumen fast beim Terra-Preis ohne Cache (rund $1.60).
Leichte Aufgaben in Masse (Luna)
1,000 Aufrufe mit je 10K Input + 1K Output (10M Input + 1M Output): 10 x $0.20 + 1 x $1.20 = rund $3.20 auf Luna nach der Senkung vom 2026-07-30. Das gleiche Volumen auf Sol kostet rund $60 beim aktuellen $4/$20 (rund $80 beim Launch-Preis $5/$30) — leichte Aufgaben nach Luna zu verlagern, bleibt die direkteste Ersparnis.
So vergleichen sich die Preise
Sol ($5/$30, Basis 2026-08) gleicht Claude Opus 4.8 beim Input ($5/$25) und liegt beim Output leicht darüber; Terra ($2/$12 nach der Senkung vom 2026-07-30) ist der Alltags-Standard; Luna ($0.20/$1.20) kostet für hohes Volumen rund 1/25 des Sol-Listenpreises. Stand 2026-08-02 trennen OpenAIs Listenpreise Flaggschiff-Können von Flaggschiff-Ausgaben.
Preise und Nutzung auf QCode
Die Seite /models von QCode zeigt aktuelle Raten, die OpenAIs offiziellen Preisen entsprechen; die Nutzung innerhalb Ihres Plans wird pro Token zu diesen Raten gemessen. Die drei Tiers teilen sich einen API-Key und ein Kontingent mit GPT-5.5, Claude und Gemini — Zugriff mit niedriger Latenz aus Festlandchina, lokale Zahlung, Pläne ab $8.57/Monat.
FAQ zu Preisen
Wie genau wird Caching abgerechnet?
Cache-Writes kosten das 1.25-Fache der Input-Rate (Sol $6.25, Terra $2.50, Luna $0.25 pro 1M, Stand 2026-08-02). Cache-Reads bleiben bei rund 10% des Inputs (Sol $0.50, Terra $0.20, Luna $0.02).
Wird langer Context extra abgerechnet?
Es gibt eine Preisstufe für langen Context. OpenAIs Sol-Modellseite sagt: Sobald der Input 272K übersteigt, wird die gesamte Request mit 2x Input und 1.5x Output abgerechnet ("Prompts with >272K input tokens are priced at 2x input and 1.5x output for the full request."). Beachten Sie: 272K ist keine Obergrenze dafür, was Sie senden können -- das Fenster bleibt 1,050,000 -- es ist eine Preisklippe. Der Hebel bleibt: Cache-Hits auf einem stabilen Prefix, nicht ein gekürzter Context.
Beeinflusst ein Tier-Wechsel Abrechnung oder Kontingent?
Nein. Die Tiers sind nur verschiedene Model-Ids, die jeweils zu ihrer eigenen Rate gegen dasselbe Kontingent abgerechnet werden. Sie können sie in einem Projekt Request für Request mischen — etwa Sol zum Planen, Terra zum Ausführen, Luna für Batch-Arbeit.
Entsprechen die QCode-Preise OpenAIs offiziellen Raten?
Ja. Die Seite /models zeigt die drei Tiers zu offiziellen Raten (Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20, Stand 2026-08-02).
GPT-5.6 zu offiziellen Raten
Alle drei GPT-5.6-Tiers rechnen im QCode-Monatsplan zu offiziellen Raten ab — ab $8.57/Monat, Monat für Monat, jederzeit kündbar.