OpenAI API Usage Tiers: Build, Launch und Grow
Stand 2026-10-08 hat die OpenAI API drei bezahlte Nutzungsstufen: Build, Launch und Grow. Sie setzen Guthabenkäufe von insgesamt $5, $100 und $500 voraus und haben monatliche Nutzungslimits von $500, $5,000 und $200,000. Laut offiziellem Changelog ersetzen sie seit 2026-10-06 die bisherigen fünf Stufen. Diese Seite zeigt die offiziellen Rate Limits je Stufe, einen Vorher-nachher-Vergleich mit den alten Tier 1–5 und wo Sie Ihre aktuelle Stufe sehen.
Aktualisiert 2026-10-08
Die neuen Stufen in vier Zahlen
Guthabenkäufe insgesamt (Build / Launch / Grow)
Die offizielle Rate-Limits-Seite spricht von total credit purchases, also der Summe aller Guthabenkäufe; erreicht eine Organisation die Schwelle, steigt ihre Stufe automatisch.
Monatliches Nutzungslimit
Das ist das monatliche Nutzungslimit, das OpenAI für jede Organisation genehmigt; laut Dokumentation ist es unabhängig von den Spend Limits, die Sie selbst setzen. Die Free-Stufe liegt bei $100 pro Monat und setzt ein unterstütztes Land voraus, wie schon auf der am 2026-10-01 archivierten offiziellen Seite.
TPM für Astra, Sol und Terra
Die RPM liegen bei Build, Launch und Grow bei 5,000 / 10,000 / 15,000; die Luna-Zeile lautet RPM 5,000 / 10,000 / 30,000 und TPM 2M / 10M / 180M. Die Dokumentation nennt das Standard Rate Limits, die sich von den Limits im Ultrafast-Modus unterscheiden.
Schwelle der höchsten Stufe
Laut der am 2026-10-01 archivierten offiziellen Rate-Limits-Seite verlangte die alte höchste Stufe Tier 5 $1,000 paid; auf der aktuellen offiziellen Seite verlangt die neue höchste Stufe Grow $500 an Guthabenkäufen. Beide haben ein monatliches Nutzungslimit von $200,000.
Was sich geändert hat
Stand 2026-10-08 sind die bezahlten Nutzungsstufen der OpenAI API Build, Launch und Grow: Build verlangt $5 an Guthabenkäufen bei einem Monatslimit von $500, Launch $100 bei $5,000 und Grow $500 bei $200,000. Der Eintrag im OpenAI API Changelog vom 2026-10-06 lautet „Simplified API usage tiers from five to three: Build, Launch, and Grow.“ und ergänzt, dass Organisationen automatisch aufsteigen, sobald ihre Guthabenkäufe die Mindestschwelle einer Stufe erreichen. Die Free-Stufe ist dieselbe wie auf der am 2026-10-01 archivierten offiziellen Seite: Der Nutzer muss sich in einem unterstützten Land befinden, das Monatslimit liegt bei $100. Die Rate-Limits-Seite fasst zusammen, dass höhere Stufen in der Regel über alle Modelle hinweg höhere Rate Limits bieten.
Der offizielle Wortlaut (Changelog vom 2026-10-06)
Die Zeile im Changelog lautet: „Organizations automatically upgrade as total credit purchases reach tier minimums.“ Die überarbeitete Rate-Limits-Seite schreibt: „Your organization's usage tier upgrades automatically as its total credit purchases reach each threshold.“ Im Archiv derselben Seite vom 2026-10-01 stand noch: „As your spend on our API goes up, we automatically graduate you to the next usage tier.“, und in der Spalte mit den Voraussetzungen wurde aus Formulierungen wie „$5 paid“ nun „$5 in total credit purchases“. Die Dokumentation weist außerdem darauf hin, dass das monatliche Nutzungslimit, das OpenAI je Organisation festlegt, eine eigene Kontrolle ist, getrennt von den Spend Limits, die Sie für Organisation oder Projekt einstellen.
Zeitleiste der Stufenänderung
Laut der am 2026-10-01 archivierten offiziellen Rate-Limits-Seite gab es noch Tier 1 bis Tier 5: Schwellen von $5, $50, $100, $250 und $1,000 paid, Monatslimits von $100, $500, $1,000, $5,000 und $200,000.
Der OpenAI API Changelog kündigt an, dass die Nutzungsstufen von fünf auf drei vereinfacht werden, Build, Launch und Grow, mit automatischem Aufstieg nach Guthabenkäufen.
Diese Seite wurde mit der offiziellen Rate-Limits-Seite, den Modellseiten von gpt-6-sol und gpt-6-luna und dem Changelog abgeglichen; zu diesem Datum verlangt Grow $500 an Guthabenkäufen.
Bestätigt und nicht offiziell gesagt
Bestätigt (wörtlich auf den offiziellen Seiten)
Folgendes lässt sich auf den offiziellen Seiten von OpenAI wörtlich nachprüfen: die Vereinfachung von fünf auf drei Stufen am 2026-10-06; die drei bezahlten Stufen heißen Build, Launch und Grow; Schwellen von $5 / $100 / $500 an Guthabenkäufen; monatliche Nutzungslimits von $500 / $5,000 / $200,000; die Free-Stufe mit $100 pro Monat; RPM und TPM für die Zeile Astra, Sol, Terra und die Zeile Luna; Rate Limits gelten auf Ebene von Organisation und Projekt, nicht pro Nutzer; unter Settings > Organization > Limits sehen Sie die Limits jedes Modells auf Ihrer aktuellen Stufe, und mit Upgrade tier im Bereich Usage Tiers steigen Sie auf. Die Zahlen der alten Tier 1–5 stammen aus dem Archiv derselben offiziellen Seite vom 2026-10-01 und dem Archiv der gpt-6-sol-Modellseite vom 2026-10-05.
Nicht bestätigt oder nicht veröffentlicht
Drei Dinge stehen nicht auf den offiziellen Seiten, planen Sie also nicht damit. Erstens, in welche neue Stufe ein Konto aus den alten Tier 1–5 jeweils fällt: Weder Dokumentation noch Changelog enthalten eine Zuordnungstabelle, nur die Regel, dass die Stufe nach Guthabenkäufen automatisch steigt. Zweitens stand in der alten Spalte paid, in der neuen total credit purchases, und OpenAI erklärt nicht, ob beides gleich gezählt wird. Drittens wurden die Limits der neuen Stufen für andere Modelle als Astra, Sol, Terra und Luna (Bild, Audio, Embeddings usw.) hier nicht einzeln geprüft; maßgeblich ist die Limits-Seite Ihrer Organisation.
Alte und neue Stufen und die verschiedenen Limits
Im Vergleich zu den alten Tier 1–5
Vergleicht man die am 2026-10-01 archivierte offizielle Rate-Limits-Seite und die am 2026-10-05 archivierte gpt-6-sol-Modellseite mit den aktuellen offiziellen Seiten (nur ein Zahlenvergleich, eine Zuordnungstabelle hat OpenAI nicht veröffentlicht): Bei denselben $5 steigt das Monatslimit von $100 (Tier 1) auf $500 (Build), und die Limits für gpt-6-sol steigen von 500 RPM / 500,000 TPM auf 5,000 RPM / 1,000,000 TPM, so viel wie beim alten Tier 2. Bei insgesamt $100 gab der alte Tier 3 $1,000 pro Monat und 5,000 RPM / 2,000,000 TPM, Launch gibt $5,000 pro Monat und 10,000 RPM / 4,000,000 TPM, so viel wie der alte Tier 4. Ganz oben entsprechen die gpt-6-sol-Limits von Grow mit 15,000 RPM / 40,000,000 TPM dem alten Tier 5; gesunken ist nur die Schwelle, von $1,000 auf $500.
Im Vergleich zu Ihren eigenen Spend Limits
Die Stufe bestimmt das von OpenAI genehmigte monatliche Nutzungslimit und die Rate Limits; ein Spend Limit ist eine Ausgabenkontrolle, die Sie selbst auf Organisation oder Projekt setzen. Laut Dokumentation verschickt ein Spend Alert nur eine Benachrichtigung, der Traffic läuft weiter; ist ein Hard Spend Limit erreicht, liefern betroffene Anfragen 429 mit dem Code organization_spend_limit_exceeded oder project_spend_limit_exceeded. Bei organization_usage_limit_exceeded beantragen Sie ein höheres genehmigtes Nutzungslimit; credit_balance_exhausted heißt, dass Ihr Prepaid-Guthaben aufgebraucht ist und Sie Guthaben nachkaufen müssen.
Was das für Entwickler heißt: vier Prüfungen
Erstens die Stufe prüfen: Unter Settings > Organization > Limits sehen Sie die Rate Limits jedes Modells auf Ihrer aktuellen Stufe; zum Aufsteigen wählen Sie Upgrade tier im Bereich Usage Tiers. Zweitens Fehler auseinanderhalten: Rate Limits gelten pro Organisation und Projekt, nicht pro Nutzer. Lesen Sie zuerst error.code, um zu sehen, ob ein Rate Limit, das monatliche Nutzungslimit, ein Spend Limit oder ein leeres Guthaben greift. Drittens auch nach dem Aufstieg langsam hochfahren: Die Dokumentation empfiehlt, den Traffic ab 1 Million Eingabe-Tokens pro Minute um höchstens 50 % alle 15 Minuten zu steigern, und ein slow_down-Fehler kann selbst innerhalb Ihrer RPM- und TPM-Limits kommen. Viertens die Response-Header beobachten: Verbleibende Anfragen und Tokens stehen in HTTP-Headern wie x-ratelimit-remaining-requests und x-ratelimit-remaining-tokens; Long-Context-Modelle wie GPT-5.5 haben für lange Anfragen ein eigenes Rate Limit.
GPT-Modelle über QCode aufrufen
Wenn Sie einen Schlüssel für GPT-Modelle möchten: Auf QCode lassen sich gpt-6.1-sol, gpt-6-sol, gpt-6-astra und gpt-5.6-terra aufrufen. Laut Dokumentation setzen Sie im OpenAI Python / JS SDK base_url auf https://api.qcode.cc/openai/v1; GPT-Modelle laufen nur über die Endpunkte des OpenAI-Protokolls, nicht über den Anthropic-Endpunkt. Berechnet wird pro Token, die Preise je Modell stehen unter /models. QCode arbeitet mit Vorauszahlung: Sie laden zuerst Guthaben auf und kaufen dann einen Tarif, der vom Guthaben abgebucht wird; Aufladungen in US-Dollar reichen von $1 bis $2,000, bezahlbar per Karte (Visa / Mastercard / AMEX), Apple Pay, Google Pay, WeChat Pay, Alipay oder Kryptowährung. Diese Seite verspricht nichts zu Rate Limits auf Seiten von QCode.
Häufig gestellte Fragen
Wie viele Nutzungsstufen hat die OpenAI API jetzt?
Drei bezahlte, Build, Launch und Grow, plus die Free-Stufe. Laut OpenAI API Changelog vom 2026-10-06 wurden fünf Stufen auf drei vereinfacht; Stand 2026-10-08 liegen die Schwellen bei $5, $100 und $500 an Guthabenkäufen, die Monatslimits bei $500, $5,000 und $200,000. Die Free-Stufe setzt ein unterstütztes Land voraus und ist auf $100 pro Monat begrenzt.
Wie viel muss ich kaufen, um Grow zu erreichen?
$500 an Guthabenkäufen insgesamt. Danach wechselt Ihre Organisation automatisch zu Grow, mit einem Monatslimit von $200,000. Laut der am 2026-10-01 archivierten offiziellen Rate-Limits-Seite verlangte die alte höchste Stufe Tier 5 $1,000 paid bei demselben Monatslimit von $200,000.
In welche neue Stufe kommen Konten aus den alten Tier 1–5?
Eine Zuordnung alter zu neuen Stufen veröffentlicht OpenAI in der Dokumentation nicht. Bestätigt ist nur die Regel, dass die Stufe einer Organisation nach Guthabenkäufen automatisch steigt: $5, $100 und $500 entsprechen Build, Launch und Grow. Ihre aktuelle Stufe und die Limits je Modell sehen Sie unter Settings > Organization > Limits.
Welche Rate Limits hat die Stufe Build?
Die offizielle Rate-Limits-Seite nennt für Build diese Standard-Limits: 5,000 RPM und 1,000,000 TPM für Astra, Sol und Terra sowie 5,000 RPM und 2,000,000 TPM für Luna. Launch hat jeweils 10,000 RPM / 4,000,000 TPM und 10,000 RPM / 10,000,000 TPM, Grow 15,000 RPM / 40,000,000 TPM und 30,000 RPM / 180,000,000 TPM.
Heißt ein 429, dass meine Stufe zu niedrig ist?
Nicht unbedingt. Die Dokumentation beschreibt mindestens drei Ursachen für 429: ein überschrittenes Rate Limit; einen slow_down-Fehler bei zu schnell wachsendem Traffic, der selbst innerhalb der RPM- und TPM-Limits auftreten kann; und ein erreichtes Hard Spend Limit, das Sie selbst gesetzt haben (Code organization_spend_limit_exceeded oder project_spend_limit_exceeded). Lesen Sie zuerst error.code und entscheiden Sie dann, ob Sie warten und erneut senden, das Spend Limit anheben oder eine höhere Stufe anstreben.
Kann ich GPT-Modelle auf QCode mit demselben Schlüssel aufrufen?
Ja. gpt-6.1-sol, gpt-6-sol, gpt-6-astra und gpt-5.6-terra lassen sich auf QCode mit base_url https://api.qcode.cc/openai/v1 aufrufen, berechnet pro Token, Preise je Modell unter /models. QCode arbeitet mit Vorauszahlung, Aufladungen in US-Dollar reichen von $1 bis $2,000. Zu Rate Limits auf Seiten von QCode macht diese Seite keine Zusage; maßgeblich sind die tatsächlichen Antworten.
Quellen
Stufendefinitionen, Schwellen, Monatslimits und die Standard-Tabelle der Rate Limits: die Seite Rate limits in der OpenAI-Entwicklerdokumentation (abgerufen am 2026-10-08). Datum und Wortlaut der Änderung: der Eintrag vom 2026-10-06 im OpenAI API Changelog (am selben Tag abgerufen). Limits je Modell: die Modellseiten von gpt-6-sol und gpt-6-luna (am selben Tag). Schwellen, Limits und gpt-6-sol-Werte der alten Tier 1–5: die Kopien im Internet Archive von der offiziellen Seite Rate limits (2026-10-01) und der gpt-6-sol-Modellseite (2026-10-05). Nutzungslimit und Spend Limit sowie die Fehlercodes: die Seite Spend limits von OpenAI (abgerufen am 2026-10-08). Der QCode-Teil: die Seiten zu Kosten pro Token, Zahlungsarten und Endpunkten auf docs.qcode.cc (abgerufen am 2026-10-08).
Ein Schlüssel für GPT-Modelle
gpt-6.1-sol, gpt-6-sol und weitere GPT-Modelle über https://api.qcode.cc/openai/v1, berechnet pro Token, Preise unter /models.
Weiterführende Lektüre
OpenAI-API-Ausfall, 503 und Timeout
Erst die Statusseite lesen, dann entscheiden, ob Sie die Anbindung wechseln.
GPT-6.1 Sol API: Preise und 272K-Regel
Preise, die 272K-Regel und der Unterschied zu gpt-6-sol.
Claude API mit Apple Pay und Google Pay bezahlen
Guthaben mit einer Karte aufladen, die schon in Ihrem Wallet hinterlegt ist.
Die Zahlen und Zitate auf dieser Seite wurden am 2026-10-08 mit dem offiziellen Changelog, der Rate-Limits-Seite und den Modellseiten von OpenAI abgeglichen; Änderungen beim Anbieter sind ohne Vorankündigung möglich. Die Zahlen der alten Tier 1–5 stammen aus Archiven der offiziellen Seiten vom 2026-10-01 und 2026-10-05. Für die tatsächliche Stufe und die Limits Ihrer Organisation gilt deren Limits-Seite; für die Modellverfügbarkeit auf QCode gilt /models.