Wie sich die Abrechnung von GPT-Live-1 Voice tatsächlich aufteilt
zwei Rechnungen, nicht ein Paket
Die Voice-Sitzung wird pro Minute berechnet. Das Backend-Reasoning wird nach Tokens abgerechnet. Wenn Sie $0.05/min als Komplettpreis für einen Telefonanruf betrachten, springt die Rechnung, sobald die Sitzung zum ersten Mal an Astra oder ein anderes Modell delegiert. In der 30-Tage-Nutzungstabelle von QCode gibt es keine gpt-live-1-Zeile, daher behauptet diese Seite nicht, dass die Voice-Schicht hier aufrufbar ist.
Aktualisiert 2026-09-11
Die Rechnung in vier Fakten aufteilen
Pro Voice-Minute
Die Modellseite sagt: Voice sessions cost $0.05 per minute, billed per second. Das betrifft Zuhören und Sprechen, nicht den gesamten Anruf.
Nicht auf die nächste Minute aufgerundet
Dieselbe Seite: Session duration is not rounded up to the next whole minute. Abgerechnet wird in Sekunden, nicht nach dem Muster „1m1s zählt als zwei Minuten“.
Reasoning und Tools sind eine zweite Rechnung
Die Nutzung von Backend-Modell und Tools wird separat abgerechnet. Wenn Live-1 eine schwierige Runde an Astra / Luna / einen Drittanbieter übergibt, gilt für diesen Responses-Aufruf der Listenpreis des delegierten Modells.
Keine gpt-live-1-Nutzungszeile
In der 30-Tage-Tabelle von QCode gibt es keine gpt-live-1-Zeile. Alle gpt-realtime*-Zeilen stehen auf 0. Die Kategorie ist default: Wir behaupten nicht, dass dieses Modell hier bereits verkauft wird.
So teilen Sie diese Art von Rechnung auf
Full-Duplex-Voice-APIs werden zum Problem für alle, die „die Schicht, die spricht“ und „die Schicht, die denkt“ als eine Preisliste behandeln. Die Reihenfolge bleibt gleich: Lesen Sie den Preis der Voice-Schicht und die Rundungsregel auf der offiziellen Modellseite, listen Sie auf, welche Runden delegieren werden, und multiplizieren Sie dann die geschätzten Tokens mit dem Input-/Output-Preis des Backends. QCode kann bei der Backend-Rechnung helfen – ein Key für gpt-5.6-sol / gpt-6-astra. Für die Voice-ID gibt es keine Nutzungszeile, daher ist das keine Aussage über eine Verfügbarkeit im Verkauf.
Was die offiziellen Seiten am 2026-09-10 sagten
Am 2026-09-10 nannte die OpenAI-Modellseite für gpt-live-1 $0.05/min, sekundengenau abgerechnet, ohne Aufrundung auf volle Minuten, wobei Backend-Modell und Tools separat abgerechnet werden. Der Beitrag im Entwicklerforum vom selben Tag beschrieb Full-Duplex-Voice im ChatGPT-Stil in der API und die Delegation an ein Backend Ihrer Wahl. The New Stack schrieb am selben Tag die Variante mit zwei Rechnungen: erst die Voice-Schicht bezahlen, dann den Astra-Aufruf, an den sie übergibt.
Zeitlinie
2026-09-10: gpt-live-1 erscheint auf der Entwickler-Modellseite. Preissatz: Voice sessions cost $0.05 per minute, billed per second. Backend model and tool usage is billed separately.
Forenankündigung vom 2026-09-10: Full Duplex plus Backend-Delegation. In Kombination mit GPT-6 Astra bei mittlerem Reasoning liegt Tau3 beim ersten Versuch bei 83.6 % gegenüber 45.7 % bei GPT-Realtime-2.1. Das ist deren Eval-Aussage, kein QCode-Benchmark.
2026-09-11: Dieselbe Modellseite enthält weiterhin den Preis und die Zeile „backend billed separately“. QCode CRS hat an diesem Tag keine gpt-live-1-Zeile. Der Produktbeitrag auf openai.com liefert Cloudflare 403; die Fakten stammen von developers.openai.com.
Bestätigt versus leicht falsch hinzugerechnet
Auf der Modellseite (2026-09-10)
Stand 2026-09-10 lässt sich überprüfen: Modell-ID gpt-live-1; Voice-Sitzungen $0.05/min, sekundengenau abgerechnet; Dauer nicht auf die nächste volle Minute aufgerundet; Backend-Responses-Aufrufe nutzen die normalen Preise des konfigurierten Modells und der Tools.
Was Leute sagen, das die Doku nicht bündelt
Um den 2026-09-10 behandeln einige Beiträge $0.05/min als „drei Dollar pro Stunde für einen kompletten Voice-Agent“. Die Modellseite sagt das nicht. The New Stack schreibt von etwa $3/Stunde für die Voice-Schicht, dazu kommt Astra obendrauf. Unbestätigt: wann ein Reseller gpt-live-1 listen wird und wie die Stufen für gleichzeitige Sitzungen zugeordnet werden. QCode hat diese ID nicht veröffentlicht.
Zwei Spalten, nicht vermischen
Nur Voice-Schicht
Verwenden Sie dies, um die Kosten für Zuhören und Sprechen zu schätzen: Sekunden × $0.05/60. Nutzen Sie es nicht als Projektbudget – eine einzige Delegation sprengt die Spalte.
Sprachschicht plus Backend
Verwenden Sie dies für einen Sprach-Agenten mit Tool-Nutzung. Ist das Backend gpt-5.6-sol oder gpt-6-astra, addieren Sie den Token-Preis dieses Modells. Die offizielle GPT-5.6-Sol-Liste lautet $4 / $20 (Aktionspreis mindestens bis 2026-11-21).
Drei Schritte nach einer überraschenden Rechnung
Erstens: Öffnen Sie die offizielle gpt-live-1-Seite und prüfen Sie, ob die Sprachschicht mit $0.05/min sekundengenau abgerechnet wird und kein Abo ist. Zweitens: Listen Sie auf, welche Turns delegieren; diese Turns werden auf dem Backend-Modell tokenbasiert abgerechnet. Drittens: Testen Sie die Voice-ID nicht durch Ausprobieren. Senden Sie eine winzige Textanfrage und prüfen Sie den Key sowie das zurückgegebene Modell. Wenn Ihr Gateway gpt-live-1 nicht kennt, tragen Sie es nicht fest im Code ein.
Was Sie bei QCode konkret tun
In der 30-Tage-Tabelle von QCode gibt es kein gpt-live-1, daher behauptet diese Seite nicht, dass die Sprachschicht aufrufbar ist. Richten Sie zuerst die Backend-Rechnung ein: Kopieren Sie nach der Registrierung den Key aus dem Dashboard. Claude Code: ANTHROPIC_BASE_URL = https://api.qcode.cc und ANTHROPIC_AUTH_TOKEN auf diesen Key setzen. Codex CLI: Richten Sie die OpenAI-kompatible Basis-URL auf denselben Host. Testen Sie mit gpt-5.6-sol (offiziell $4 / $20, Aktionspreis mindestens bis 2026-11-21) und wechseln Sie dann je nach Aufgabe zu gpt-6-astra. Nächster Schritt: eine winzige Anfrage ohne Streaming, HTTP 200, passende Modell-ID im Body.
FAQ
Sind im Preis von $0.05/min auch Backend-Reasoning-Kosten enthalten?
Nein. Die Modellseite trennt Sprachsitzungen von der Nutzung des Backend-Modells und der Tools. Ein delegierter Aufruf an Astra (oder ein anderes Modell) wird zum Tarif dieses Modells abgerechnet.
Wie wird eine angebrochene Minute abgerechnet?
Sekundengenau. Laut Dokumentation wird die Dauer nicht auf die nächste volle Minute aufgerundet. 61 Sekunden sind 61 Sekunden, nicht zwei Minuten.
Kann ich gpt-live-1 heute bei QCode aufrufen?
Das behaupten wir nicht. Es gibt keine Nutzungszeile. Eine Seite mit der Aussage „bereits bei QCode verfügbar“ wäre falsch. Maßgeblich ist /models.
Warum dann diese Seite lesen?
Damit die Rechnung mit zwei Posten und der Backend-Pfad stimmen, bevor ein Gateway die Voice-ID listet. Die Rechnung hängt nicht davon ab, ob QCode gpt-live-1 listet.
Sol oder Astra im Backend?
Die Dokumentation lässt Ihnen die Wahl. Die offizielle Sol-Liste von $4 / $20 (Aktionspreis mindestens bis 2026-11-21) eignet sich für einen Pathfinder; aufwendigere Turns können zu gpt-6-astra wechseln. Beide haben echte QCode-Nutzung.
Ist das die alte Realtime-Preisliste?
Nein. Die Sprachschicht von gpt-live-1 wird pro Minute abgerechnet. Realtime-IDs sind separate Zeilen in der Nutzungstabelle und stehen zuletzt bei 0. Übertragen Sie keine alten Realtime-Token-Preise auf Live-1-Minuten.
Quellen
Preis, sekundengenaue Abrechnung, separates Backend, Modell-ID: developers.openai.com/api/docs/models/gpt-live-1 (abgerufen am 2026-09-11). Vollduplex und Delegation: OpenAI-Entwicklerforum 2026-09-10. Beitrag zu den zwei Rechnungen: The New Stack 2026-09-10. Sol-Aktionszeitraum: offizielle Preisseite, „at least through November 21, 2026“. Der Produktbeitrag auf openai.com liefert 403 und ist keine maßgebliche Quelle.
Sprachschicht hier nicht im Angebot – richten Sie zuerst das Backend ein
Ein QCode-Key für gpt-5.6-sol und gpt-6-astra. Keine Aussage zu gpt-live-1. Tarife ab ¥60/Monat.
Verwandte Artikel
Warum GPT-6 Astra das Kontingent so schnell verbraucht
Wenn Sie an Astra delegieren, kommen Credit-Multiplikatoren zusätzlich zur Rechnung der Sprachschicht hinzu.
GPT-5.6 Sol im Vergleich zu Astra
Zwei Backend-Stufen mit offiziellen Preisen, damit Sie Sprache und Reasoning nicht in einer SKU vermischen.
Checkliste bei OpenAI-API-Ausfällen
Lesen Sie bei 5xx-Fehlern von Sprache oder Bildern die Statusseite, bevor Sie Clients umschreiben.
Diese Seite erläutert die Aufteilung der Abrechnung. Sie ist keine Aussage von OpenAI und behauptet nicht, dass QCode gpt-live-1 listet. Maßgeblich sind die Modellseite und /models.