Codex-Fehler "Selected model is at capacity. Please try a different model": das ist weder Ihr Kontingent noch ein 429
Kapazität, Kontingent und 429 sind drei verschiedene Dinge
Das ist ein Kapazitätssignal — kein erschöpftes Kontingent und kein 429. Das von Nutzern gemeldete Issue #46189 im offiziellen Codex-Repo von OpenAI, eröffnet am 2026-09-17, dokumentiert den wörtlichen Fehler "Selected model is at capacity. Please try a different model". Wie Sie die drei unterscheiden, plus Backoff- und Wechselmaßnahmen, steht unten.
Aktualisiert 2026-09-19
Vier Kernpunkte
Fehlerklasse
Wortlaut "Selected model is at capacity" — serverseitige Auslastung genau jetzt.
Issue eröffnet
Nutzer-Issue #46189 im offiziellen Codex-Repo dokumentiert es; an dem Tag ungelöst.
Häufigster Irrtum
Erschöpftes Kontingent, Guthaben und 429 — jeder Text klingt anders.
Maßnahme, die hilft
Parallelstufe wählen oder Backoff mit Jitter.
Was das ist
Codex gibt diese Zeile zurück, wenn ein Model gesättigt ist. Sie beschreibt die serverseitige Kapazität in dem Moment — nicht Ihren Kontingent-Status, nicht das 429-Throttling. Die drei unterscheiden sich in Wortlaut und Abhilfe: Kontingent heißt Nutzungsseite prüfen, Throttling heißt Retry-After einhalten, Kapazität heißt Model wechseln oder Zeitfenster verlagern.
Was geschah
Das Nutzer-Issue #46189 im offiziellen Codex-Repository wurde am 2026-09-17 mit dem wörtlichen Fehler "Selected model is at capacity. Please try a different model." eröffnet und meldet, dass das Konto zwischen diesem Fehler und einem zweiten hin- und herschwingt.
Chronik
2026-09-17 wurde das Nutzer-Issue #46189 eröffnet; es dokumentiert den Fehler und die zwei alternierenden Fehlerbilder.
2026-09-18 erneut geprüft: Issue weiter offen, diese Seite gibt den Issue-Text unverändert wieder.
2026-10-14: sachfremdes, doch verwechselbares Ereignis — GPT-5.5 wird aus ChatGPT / Work / Codex entfernt (API ausgenommen).
Bestätigt vs. Vorsicht
Offiziell bestätigt
Der Issue-Text sagt: Das Konto schwanke zwischen "Selected model is at capacity" und einer erfolgreichen Anfrage, deren Model-Verhalten Auffälligkeiten zeigt; Stand 2026-09-17 ungelöst.
⚠️ Vorsicht
OpenAI hat im Issue keinen Kapazitätsalgorithmus dokumentiert und kein ETA genannt; am Eröffnungstag, dem 2026-09-17, war es weiterhin ungelöst. Aussagen wie "es erholt sich immer in fünf Minuten" oder "einige Regionen erhalten Vorrang" stehen nicht in der Quelle.
Gleich vs. anders
Gleich
Alle drei lassen Anfragen scheitern und sollten irgendwie als wiederholbar gelten.
Anders
Kapazität: Model wechseln oder Zeit verschieben. Wochenkontingent leer: Reset abwarten oder Plan wechseln — der Wortlaut zeigt auf die Nutzung. 429: Rate Limit, Retry-After einhalten. Der Wortlaut trennt sie; vermischen Sie sie nicht.
Was tun?
1) Erst den Wortlaut lesen, bevor Sie das Kontingent verdächtigen; 2) auf eine Parallelstufe wechseln (z. B. gpt-5.6-sol ↔ gpt-6-astra) oder exponentielles Backoff mit Jitter ergänzen; 3) wenn es bleibt, vergleichen Sie den Fall mit dem Issue #46189, statt nach Gefühl Konfigurationsänderungen vorzunehmen.
Auf QCode
Auf QCode teilen sich gpt-5.6-sol, gpt-6-astra und deepseek-v4.1-flash einen API-Key; "bei einem Kapazitätssignal die Stufe wechseln" kostet ein Feld und keinen Endpoint-Wechsel. Kontingent und Guthaben stehen auf der Nutzungsseite der Konsole — dort bestätigen Sie ein Kontingent-Problem.
FAQ
Ist das mein Wochenkontingent?
Nein. Kontingent-Erschöpfung formuliert sich anders und zeigt auf Nutzung oder Plan. "Selected model is at capacity. Please try a different model" betrifft die serverseitige Kapazität dieses Models genau jetzt.
Ist es ein 429?
Nein. Rate Limiting hat eigene Wortlaute und Retry-Semantik. Auf ein Kapazitätssignal antworten Sie mit Model-Wechsel oder Zeitfenster-Verschiebung, nicht mit Warten auf einen festen Header.
Was hilft sofort?
Wechseln Sie auf ein Parallelmodell, ergänzen Sie exponentielles Backoff mit Jitter. Teilen sich mehrere Models einen Key, ist der Wechsel die Änderung eines einzigen Felds.
Warum ist es auch mal seltsam, funktioniert aber weiter?
Das Issue meldet dieses alternierende Verhalten; OpenAI nennt im Thread keine Ursache, die Seite zieht daraus keinen Schluss. Erfassen Sie beide Fehlerbilder mit Model-ID und Zeitstempel, suchen Sie ein Muster.
Dasselbe wie die Stilllegung am 2026-10-14?
Nein. Die Stilllegung entfernt ein Model aus ChatGPT / ChatGPT Work / Codex und nimmt die API ausdrücklich aus; ein Kapazitätssignal ist eine Laufzeit-Auslastung. Anderer Wortlaut, andere Abhilfe.
Ein Ticket eröffnen?
Verweisen Sie zuerst auf das Nutzer-Issue #46189. Sehen Sie die alternierenden Fehler ebenfalls, hängen Sie Zeitstempel, Model-ID und den exakten Fehlertext an — deutlich hilfreicher als "es funktioniert nicht".
Quellen
Nutzer-Issue #46189 im offiziellen OpenAI-Codex-Repo (2026-09-17; kein offizielles Statement) und die offiziellen Release Notes, erfasst am 2026-09-18. Fehlertext gemäß Issue-Text.
Stufenwechsel in einer Zeile
Ein QCode-Key deckt gpt-5.6-sol, gpt-6-astra und deepseek-v4.1-flash ab — bei Sättigung wechseln Sie einfach das Model.
Verwandte
GPT-5.5-Stilllegung
Ein Model-Wegfall am 2026-10-14, kein Kapazitätssignal.
GPT-6 Sol erschienen: Specs und Preise
Offiziell seit 2026-09-22: $2 / $10, Kontext mit 1,050,000 Token.
Wechsel der DeepSeek-Model-IDs
Ebenfalls eine Klasse nach dem Muster "id ist gesetzt, aber falsch".
Nur der im Nutzer-Issue im offiziellen Codex-Repo von OpenAI und in den offiziellen Release Notes vorhandene Fehlertext wird wiedergegeben; keine Schlussfolgerungen zur internen Kapazitätsrichtlinie.