Veröffentlicht · Preise & Spezifikationen

GPT-6.1 Sol API: Preise, Spezifikationen und der Vergleich mit GPT-6 Sol

Stand 2026-10-07: GPT-6.1 Sol (Modell-ID gpt-6.1-sol) ist das neue Sol-Modell, das OpenAI am 2026-09-29 auf der DevDay veröffentlicht hat. Die Standardpreise pro Million Tokens liegen bei $2 Input, $0,10 für Cache-Lesezugriffe, $2,50 für Cache-Writes und $10 Output; dazu kommen 1.050.000 Tokens Kontext, 128.000 Tokens maximale Ausgabe und ein Wissensstand bis 2026-04-30. Gegenüber GPT-6 Sol ändert sich nur einer der vier Listenpreise: Cache-Lesezugriffe kosten die Hälfte ($0,20 → $0,10). Hat eine Anfrage mehr als 272K Input-Tokens, wird die gesamte Anfrage zu Long-Context-Preisen abgerechnet. Diese Seite vergleicht beide Modelle Punkt für Punkt anhand der offiziellen Modellseiten und Preisliste und zeigt, wann sich der Wechsel lohnt.

Aktualisiert 2026-10-07

#gpt-6.1-sol#Cache-Lesen $0,10#1,05M Kontext#272K gilt für die ganze Anfrage

Vier zentrale Zahlen

$2 / $10

Input / Output (pro Million Tokens)

Offizielle Standardpreise für Anfragen bis 272K Input-Tokens, identisch mit gpt-6-sol. Laut Launch-Beitrag von OpenAI ist das ein Fünftel der Standardpreise von GPT-6 Astra für Input und Output (Astra: $10 / $50).

$0,10 / $2,50

Cache-Lesen / Cache-Writes

Laut offizieller Modellseite kosten Cache-Lesezugriffe 5% des Preises für ungecachten Input, Cache-Writes das 1,25-Fache. Bei gpt-6-sol kosten Cache-Lesezugriffe $0,20 (10%), Cache-Writes ebenfalls $2,50.

1,05M / 128K

Kontext / maximale Ausgabe

Laut offizieller Modellseite: 1.050.000 Tokens Kontextfenster, 922.000 Tokens maximaler Input und 128.000 Tokens maximale Ausgabe, Wissensstand bis 2026-04-30. Alle drei Grenzen sind identisch mit gpt-6-sol.

272K

Schwelle für langen Kontext

Eine Anfrage mit mehr als 272K Input-Tokens wird vollständig mit dem 2-Fachen für Input und Cache und dem 1,5-Fachen für Output berechnet, also $4 / $0,20 / $5 / $15, und nicht nur für die Tokens oberhalb der Schwelle.

Was GPT-6.1 Sol ist

Stand 2026-10-07 ist GPT-6.1 Sol die Stufe, die der Modellkatalog von OpenAI für die Balance aus Intelligenz und Kosten empfiehlt; Modell-ID und Standard-Snapshot lauten beide gpt-6.1-sol. Im Launch-Beitrag beschreibt OpenAI das Modell als Upgrade von GPT-6 Sol, das bei agentischem Coding, Computer Use und professioneller Arbeit nahezu an GPT-6 Astra heranreicht, und zwar zu einem Fünftel der Standardpreise von Astra für Input und Output. Es verarbeitet Text und Bilder als Input und liefert Text; Audio und Video werden nicht unterstützt. Die Endpunkte Responses, Chat Completions und Batch werden unterstützt, Tool Calling erfordert jedoch die Responses API; Chat Completions nimmt nur Anfragen ohne Tools an. reasoning.effort akzeptiert low, medium (Standard), high, xhigh und max; none und minimal werden nicht unterstützt.

Die Darstellung des Herstellers (DevDay, 2026-09-29)

Der Eintrag im Changelog der OpenAI API vom 2026-09-29 lautet sinngemäß: GPT-6.1 Sol (gpt-6.1-sol) ist für komplexes Coding und professionelle Arbeit zu niedrigeren Kosten als GPT-6 Astra erschienen; die Standardpreise für Anfragen bis 272K Input-Tokens betragen $2 Input, $0,10 Cached Input, $2,50 Cache-Write und $10 Output, und in der Responses API wird Multi-agent als Beta unterstützt. Die DevDay-2026-Seite vom selben Tag führt das Modell im Bereich API und empfiehlt den Einsatz in der API und in Codex, wo verfügbar. Laut Launch-Beitrag ist Cached Input mit $0,10 um 95% günstiger als der Standard-Input und um 50% günstiger als Cached Input bei GPT-6 Sol. Der Beitrag enthält zudem eigene Benchmark-Werte von OpenAI, die diese Seite nicht übernimmt; OpenAI ergänzt, dass für die schwierigsten wissenschaftlichen Forschungsaufgaben weiterhin GPT-6 Astra genutzt werden sollte.

Die Chronologie

2026-09-22

GPT-6 Sol (gpt-6-sol) erscheint mit Standardpreisen von $2 Input, $0,20 Cached Input und $10 Output.

2026-09-29

Auf der DevDay 2026 erscheint GPT-6.1 Sol (gpt-6.1-sol): Cached Input sinkt auf $0,10, Input, Cache-Writes und Output bleiben auf dem Niveau von GPT-6 Sol.

2026-09-30

gpt-6.1-sol ist bei QCode aufrufbar. Stand 2026-10-07 laufen gpt-6.1-sol und gpt-6-sol über denselben Key.

Bestätigt vs. nicht veröffentlicht

Bestätigt (wörtlich auf den offiziellen Seiten)

Alles Folgende lässt sich auf den offiziellen Modellseiten, in der Preisliste, im Changelog und im Launch-Beitrag von OpenAI wörtlich prüfen: Veröffentlichung am 2026-09-29; Modell-ID gpt-6.1-sol; 1.050.000 Kontext, 922.000 maximaler Input, 128.000 maximale Ausgabe; Wissensstand bis 2026-04-30; Standardpreise $2 Input, $0,10 Cache-Lesen, $2,50 Cache-Writes, $10 Output; bei mehr als 272K Input-Tokens die ganze Anfrage zum 2-Fachen für Input und Cache und zum 1,5-Fachen für Output; Batch und Flex 50% unter Standard, Fast das 2-Fache von Standard; regionale Verarbeitung kostet, wo angeboten, 10% Aufschlag; die Reasoning-Efforts none und minimal werden nicht unterstützt; Tool Calling erfordert die Responses API. Die Aussage „nahezu auf Astra-Niveau“ und die zugehörigen Werte sind Eigenangaben und eigene Tests von OpenAI. Auf QCode-Seite: gpt-6.1-sol ist bei QCode seit 2026-09-30 verfügbar.

Nicht verifiziert und vom Hersteller nicht veröffentlicht

Stand 2026-10-07 gibt es zu diesen Punkten keine offizielle Antwort, planen Sie also nicht damit: Erstens Ultrafast für GPT-6.1 Sol: Der Launch-Beitrag sagt „in the coming days“, die Codex-Dokumentation „coming later“, und die Ultrafast-Tabelle der offiziellen Preisliste führt weiterhin nur gpt-6-astra, ohne Preis für 6.1 Sol. Zweitens Abschalttermine: Die offizielle Deprecation-Seite nennt weder gpt-6.1-sol noch gpt-6-sol als auslaufend, gpt-6-sol steht in der Mitteilung vom 2026-10-01 sogar als empfohlener Ersatz für gpt-5.1 und gpt-5.3-codex. Drittens stammen „nahezu auf Astra-Niveau“ und alle Werte ausschließlich aus eigenen Tests von OpenAI; eine Reproduktion durch Dritte haben wir nicht gefunden. Viertens übernehmen wir im Netz kursierende Vergleichs-Screenshots und selbst gerechnete Multiplikatoren nicht, solange keine Primärquelle sie stützt.

Der Vergleich mit GPT-6 Sol und GPT-6 Astra

vs. GPT-6 Sol (gpt-6-sol)

Zeile für Zeile laut offizieller Preisliste (Standard, Input bis 272K): Input kostet bei beiden $2, Cache-Writes $2,50, Output $10; nur Cache-Lesezugriffe unterscheiden sich, mit $0,10 bei gpt-6.1-sol gegenüber $0,20 bei gpt-6-sol. Oberhalb von 272K sind es $0,20 gegenüber $0,40, bei Batch $0,05 gegenüber $0,10. Kontext 1.050.000, maximaler Input 922.000 und maximale Ausgabe 128.000 sind identisch; der Wissensstand reicht bis 2026-04-30 gegenüber 2026-04-20. Der Unterschied im Verhalten liegt bei den Parametern: gpt-6-sol unterstützt den Reasoning-Effort none und erlaubt Function Calling in Chat Completions nur mit reasoning_effort none; gpt-6.1-sol unterstützt none nicht, Tool Calling läuft immer über Responses.

vs. GPT-6 Astra (gpt-6-astra)

Die Astra-Zeile der offiziellen Preisliste lautet $10 Input, $1,00 Cache-Lesen, $12,50 Cache-Writes und $50 Output. Umgerechnet nach der offiziellen Preisliste kostet gpt-6.1-sol bei Input und Output genau ein Fünftel von Astra, beim Cache-Lesen ein Zehntel. Der offizielle Leitfaden zur Modellwahl empfiehlt, GPT-6.1 Sol für komplexe Projekte in Betracht zu ziehen, bei denen die Kosten zählen, und es auf derselben Aufgabe mit Astra zu vergleichen, um Qualität gegen Kosten abzuwägen; laut OpenAI bleibt Astra für die schwierigsten wissenschaftlichen Forschungsaufgaben die richtige Wahl.

Drei Punkte, die Sie beim Umstieg von gpt-6-sol prüfen sollten

Der GPT-6-Leitfaden von OpenAI rät allen, die gpt-6-sol bereits nutzen, vor dem Wechsel auf GPT-6.1 Sol die Migrationshinweise zu lesen. Laut offizieller Checkliste: Erstens Reasoning-Effort: GPT-6.1 Sol unterstützt none nicht, verwenden Sie stattdessen low; wer bisher minimal nutzt, beginnt mit low und vergleicht die Ergebnisse an repräsentativen Aufgaben. Zweitens Tool Calling: GPT-6.1 Sol unterstützt Chat Completions, Tool Calling erfordert aber die Responses API. Drittens Parameter: Ist der Reasoning-Effort nicht none, entfernen Sie temperature, top_p und top_logprobs. Planen Sie außerdem Budget für lange Jobs ein, deren Input 272K überschreiten kann: Umgerechnet nach der offiziellen Preisliste kosten 270K Input plus 10K Output (ohne Cache) $0,64, 280K Input plus 10K Output dagegen $1,27, sodass 10K mehr Input die gesamte Anfrage fast verdoppeln.

Auf QCode

gpt-6.1-sol ist bei QCode seit 2026-09-30 verfügbar, gpt-6-sol ebenfalls; beide laufen mit demselben API-Key. QCode rechnet pro Token ab, die Preise je Modell stehen unter /models. Die Pfade folgen der QCode-Dokumentation: Für das OpenAI Python/JS SDK setzen Sie base_url auf https://api.qcode.cc/openai/v1, das SDK baut daraus /openai/v1/chat/completions; der Pfad für das OpenAI-Responses-Protokoll ist /openai/v1/responses, und Codex CLI muss diesen verwenden: Setzen Sie in config.toml base_url auf https://api.qcode.cc/openai und wire_api auf responses; im Feld model können Sie gpt-6.1-sol aus der Modellliste der Dokumentation eintragen. Nutzer in Nordamerika und Europa können auch den Host us.qcode.cc (Los Angeles) verwenden.

Häufig gestellte Fragen

Was kostet die gpt-6.1-sol API?

Stand 2026-10-07 gelten diese offiziellen Standardpreise (Input bis 272K Tokens) pro Million Tokens: $2 Input, $0,10 Cache-Lesen, $2,50 Cache-Writes und $10 Output. Bei mehr als 272K Input-Tokens wechselt die ganze Anfrage auf $4 / $0,20 / $5 / $15. Batch und Flex kosten $1 / $0,05 / $1,25 / $5, Fast $4 / $0,20 / $5 / $20; regionale Verarbeitung kostet, wo angeboten, 10% Aufschlag.

Worin unterscheiden sich gpt-6.1-sol und gpt-6-sol?

Beim Listenpreis unterscheidet sich nur das Cache-Lesen: $0,10 gegenüber $0,20 (5% gegenüber 10% des Preises für ungecachten Input); Input, Cache-Writes und Output sind gleich. Kontext, maximaler Input und maximale Ausgabe sind identisch, der Wissensstand ist 10 Tage jünger (2026-04-30 gegenüber 2026-04-20). Bei den Parametern unterstützt gpt-6.1-sol den Reasoning-Effort none nicht, und Tool Calling läuft über Responses. OpenAI spricht von deutlichen Verbesserungen gegenüber GPT-6 Sol bei komplexen professionellen Aufgaben; das ist eine Eigenangabe des Herstellers.

Wie wird ein Input von mehr als 272K berechnet?

Für die gesamte Anfrage, nicht nur für den Überhang. Auf der offiziellen Modellseite heißt es: Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request. Die Preisliste definiert Short Context als bis zu 272K Input-Tokens und Long Context als mehr als 272K. Umgerechnet nach der offiziellen Preisliste kosten 270K Input plus 10K Output (ohne Cache) $0,64, 280K Input plus 10K Output $1,27. Für gpt-6-sol gilt dieselbe Regel.

Wie groß sind Kontext und maximale Ausgabe, und wie aktuell ist der Wissensstand?

Laut offizieller Modellseite: 1.050.000 Tokens Kontextfenster, 922.000 Tokens maximaler Input, 128.000 Tokens maximale Ausgabe, Wissensstand bis 2026-04-30. Als Input sind Text und Bilder möglich, ausgegeben wird Text; Audio und Video werden nicht unterstützt.

Wann sollte ich gpt-6.1-sol wählen?

OpenAI empfiehlt, GPT-6.1 Sol für komplexe Projekte in Betracht zu ziehen, bei denen die Kosten zählen, und es auf derselben Aufgabe mit Astra zu vergleichen; auch die Codex-Dokumentation empfiehlt GPT-6.1 Sol für komplexes Coding und agentische Workflows, sofern es für Sie freigeschaltet ist. Wenn Sie bereits gpt-6-sol nutzen, liegt der einzige Unterschied beim Listenpreis im Cache-Lesen, und laut OpenAI gibt der niedrigere Cache-Preis mehr Spielraum für Agents, die Kontext über Anfragen hinweg wiederverwenden; umgerechnet nach der offiziellen Preisliste zahlen Sie pro Million Cache-Lese-Tokens $0,10 weniger. Anfragen, die auf den Reasoning-Effort none angewiesen sind (auch Function Calling in Chat Completions mit none), müssen vor dem Wechsel umgebaut werden.

Kann ich gpt-6.1-sol jetzt bei QCode aufrufen?

Ja. gpt-6.1-sol ist bei QCode seit 2026-09-30 verfügbar, gpt-6-sol ebenfalls, beide mit demselben Key; beim Umstieg von gpt-6-sol prüfen Sie zuerst die drei Migrationspunkte oben (Reasoning-Effort, Tool Calling, Parameter). QCode rechnet pro Token ab; Preise je Modell und die aktuelle Modellliste finden Sie unter /models.

Quellen

Spezifikationen und Einzelpreise: die Modellseiten zu gpt-6.1-sol und gpt-6-sol in der Entwicklerdokumentation von OpenAI sowie die offizielle Preisseite (die Tabellen Standard, Batch, Flex, Fast und Ultrafast und der Hinweis zur 272K-Schwelle). Veröffentlichungsdatum und Inhalte: das Changelog der OpenAI API (Einträge vom 2026-09-29 und 2026-09-22) und die DevDay-2026-Seite auf learn.chatgpt.com. Positionierung und Eigenangaben: der offizielle Launch-Beitrag Introducing GPT-6.1 Sol von OpenAI (gelesen über eine Kopie der Wayback Machine). Migration und Modellwahl: der offizielle GPT-6-Leitfaden, der Leitfaden zur Modellwahl, die Codex-Modelldokumentation und die Deprecation-Seite. Alles abgerufen am 2026-10-07. Die QCode-Einrichtung stammt aus zwei Seiten von docs.qcode.cc, „Endpunkte und API-Formate“ und „Codex-Schnellstart“, das Datum der Freischaltung bei QCode von der Seite zur OpenAI DevDay 2026 auf qcode.cc, alles am selben Tag abgerufen.

Sol mit halbiertem Cache-Preis, sofort nutzbar

Rufen Sie gpt-6.1-sol, gpt-6-sol und gpt-6-astra über einen Endpunkt auf, abgerechnet pro Token; die Preise stehen unter /models.

Weiterführende Lektüre

Die Zahlen und Zitate auf dieser Seite wurden am 2026-10-07 anhand der offiziellen Modellseiten, der Preisliste und des Changelogs von OpenAI geprüft; OpenAI kann sie ohne Vorankündigung ändern. Aussagen wie „nahezu auf Astra-Niveau“ sind Eigenangaben und eigene Tests von OpenAI, keine Prüfung durch Dritte und kein Versprechen für Ihre konkrete Arbeitslast. Rechenbeispiele sind nach der offiziellen Preisliste umgerechnet; QCode rechnet pro Token ab, die Preise je Modell stehen unter /models. Maßgeblich für die Modellverfügbarkeit ist /models.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.