Kimi K3 vs. GPT-5.6 Sol
Open-Source-Flaggschiff vs. Closed-Source-Flaggschiff
Bei Terminal-Bench 2.1 (nach AA-Maßstab): Sol 89.5, K3 88.3 – das größte Open-Weights-Modell aller Zeiten liegt nur 1.2 Punkte hinter dem Closed-Source-Flaggschiff. Der Preisunterschied beträgt eine Größenordnung.
Aktualisiert 2026-09-21
Das Wichtigste
TB 2.1 (nach AA-Maßstab)
K3 88.3 vs. Sol 89.5 – ein Abstand von 1.2 Punkten. Unter dem einheitlichen Harness von vals.ai: 80.90 / 85.77.
Parameteranzahl von K3
Das größte Open-Weights-Modell aller Zeiten: Stable LatentMoE, 896 Experten, davon 16 aktiv pro Token.
Offizieller API-Preis von K3
Pro Million Input-/Output-Tokens (Cache-Treffer $0.30). Der offizielle Preis von Sol beträgt laut Archivstand der offiziellen Preisseite vom 2026-09-12 jetzt $4/$20, als Aktionspreis mindestens bis 2026-11-21.
Kontextfenster
K3 bietet nativ 1M; die offizielle API-Spezifikation von Sol nennt 1,050,000. Beide gehören zur 1M-Klasse, daher entscheidet der lange Kontext nicht mehr.
Wo die Modelle stehen
Kimi K3 (auf der WAIC am 07-16 vorgestellt, Gewichte am 07-27 als Open Source veröffentlicht) ist das Flaggschiff-Reasoning-Modell von Moonshot: 2.8T MoE, 1M Kontext, verpflichtendes Reasoning (Stufen low/high/max, Standard max). GPT-5.6 Sol ist die Flaggschiff-Stufe der 5.6-Serie von OpenAI: Closed Source, 1,050,000 API-Kontext, das Premium-Standardmodell von Codex. Das eine ist die Obergrenze offener Gewichte, das andere der Maßstab geschlossener APIs.
Open Source kommt erstmals so nah heran
Seit dem Start liegt K3 auf mehreren Boards gleichauf mit geschlossenen Flaggschiffen: Im Artificial Analysis Intelligence Index teilt es sich mit GLM-5.3 die Open-Source-Spitze (~60 gegenüber 61 beim geschlossenen Flaggschiff Sol), und es ist das erste offene Modell an der Spitze der Frontend Code Arena mit 1679 Elo. Innerhalb von 11 Tagen nach der Freigabe der Gewichte stiegen die Anfragen stark an, und Moonshot setzte den Ausbau der Consumer-Abos kurzzeitig aus.
Zeitachse
Kimi K3 startet auf der WAIC: 2.8T, das größte Open-Weights-Modell aller Zeiten.
Die Gewichte von K3 werden freigegeben und die Anfragen steigen stark an; im selben Zeitraum senkt die 5.6-Serie von Sol die Preise (Luna -80%).
K3 teilt sich mit GLM-5.3 die AA-Open-Source-Spitze; bei TB 2.1 bleibt K3 mit 88.3 dicht hinter Sol mit 89.5.
Bestätigt vs. Vorsicht
Bestätigt
Parameter, Kontext, offizielle Preise und Platzierungen beider Modelle sind durch offizielle Seiten oder nachprüfbare Bestenlisten belegt; beide haben bei QCode echtes Aufrufvolumen.
Vorsicht
Das Reasoning von K3 lässt sich nicht abschalten, daher verbrauchen einfache Aufgaben naturgemäß mehr Tokens; Sol kann ohne Reasoning laufen. Rechnen Sie beim Preisvergleich nach Aufgabentyp um – lesen Sie nicht nur die Tabelle der Stückpreise.
Auswahl nach Szenario
Kimi K3 wählen
Sie wünschen offene Gewichte (selbst hostbar), ultralangen Kontext (1M) oder preissensible Aufgaben mit intensivem Reasoning. Offizielle API: $3/$15.
GPT-5.6 Sol wählen
Sie wünschen das Codex-Ökosystem, einstellbare Reasoning-Stufen, den Fast-Modus (2.5x) oder eine bestehende OpenAI-Toolchain. Jetzt $4/$20 (Aktion mindestens bis 2026-11-21).
So prüfen Sie es selbst
Lassen Sie denselben Satz realer Aufgaben auf beiden laufen: K3 nutzt standardmäßig max Reasoning (mehr Tokens, aber höhere Erfolgsquote im ersten Durchlauf), während Sie bei Sol den Aufwand pro Aufgabe einstellen können. Rechnen Sie nach „Erfolgsquote im ersten Durchlauf × Gesamtkosten der Tokens“ um – das ist Ihr realer Stückpreis.
Bei QCode
Sowohl kimi-k3 als auch gpt-5.6-sol sind erhältlich (mit echten Aufrufen in den letzten 30 Tagen). Derselbe Key, offizieller Preis mal Servicesatz; angesichts des Token-Profils von K3 mit verpflichtendem Reasoning sollten Sie vor einer Festlegung einen kleinen realen Durchlauf testen.
FAQ
Welches Modell ist stärker, Kimi K3 oder GPT-5.6 Sol?
Bei TB 2.1 (nach AA-Maßstab): Sol 89.5 vs. K3 88.3 – ein Abstand von 1.2 Punkten, so nah wie nie zuvor bei einem offenen Modell. Die Werte unterscheiden sich je nach Bestenliste, legen Sie sich daher vor dem Vergleich auf ein Board fest.
Ist K3 Open Source?
Ja – die Gewichte wurden am 2026-07-27 freigegeben (2.8T, das größte aller Zeiten). Selbst-Hosting erfordert sehr viel GPU-Speicher; für die meisten ist die API der realistische Weg.
Wie groß ist der Preisunterschied?
Offizielle API: K3 mit $3/$15 ($0.30 bei Cache-Treffer), Sol mit aktuell $4/$20 (Aktion mindestens bis 2026-11-21). Doch das verpflichtende Reasoning von K3 treibt den Token-Verbrauch in die Höhe – rechnen Sie vor dem Vergleich nach Aufgabentyp um.
Wie groß sind die Kontextfenster?
K3 bietet nativ 1M, während die offizielle API-Spezifikation von Sol 1,050,000 nennt; beide gehören also zur 1M-Klasse. Bei langen Repos und Dokumenten liegt der Unterschied in Selbst-Hosting versus verwaltetem Ökosystem, nicht im Fenster.
Lässt sich das Reasoning von K3 abschalten?
Nein – nur die Stufen low / high / max, Standard max. Für einfache Fragen und Antworten ist es teuer; leiten Sie Routinearbeiten an günstigere Modelle.
Kann ich beide bei QCode aufrufen?
Beide sind erhältlich und lassen sich mit demselben Key wechseln. Die Katalogpreise richten sich nach der aktuellen /models-Liste.
Quellen
Offizieller Start von Moonshot (07-16) und Freigabe der Open Weights (07-27), Artificial Analysis Intelligence Index, vals.ai-TB2.1-Momentaufnahme (08-22), The Batch (08-21), QCode /models (08-22).
Open oder Closed – testen Sie beide und entscheiden Sie dann
K3 und Sol lassen sich auf QCode mit nur einem Key testen; rechnen Sie an realen Aufgaben nach.
Weiterführende Artikel
Kimi-K3-Leitfaden
Aufruf, Reasoning-Stufen und Preisdetails.
Sol vs. Terra vs. Luna
Die Wahl innerhalb der 5.6-Serie.
K3 vs. Opus 5
Ein weiteres Flaggschiff-Duell: Open Source gegen Closed Source.
Nicht mit Moonshot / OpenAI verbunden. Die Leaderboard-Werte sind eine Momentaufnahme von 2026-08.