Offen vs. geschlossen · 2026-08-22

Kimi K3 vs. GPT-5.6 Sol
Open-Source-Flaggschiff vs. Closed-Source-Flaggschiff

Bei Terminal-Bench 2.1 (nach AA-Maßstab): Sol 89.5, K3 88.3 – das größte Open-Weights-Modell aller Zeiten liegt nur 1.2 Punkte hinter dem Closed-Source-Flaggschiff. Der Preisunterschied beträgt eine Größenordnung.

Aktualisiert 2026-09-21

#kimi k3#gpt-5.6 sol#offen vs. geschlossen#Vergleich

Das Wichtigste

88.3 / 89.5

TB 2.1 (nach AA-Maßstab)

K3 88.3 vs. Sol 89.5 – ein Abstand von 1.2 Punkten. Unter dem einheitlichen Harness von vals.ai: 80.90 / 85.77.

2.8T

Parameteranzahl von K3

Das größte Open-Weights-Modell aller Zeiten: Stable LatentMoE, 896 Experten, davon 16 aktiv pro Token.

$3 / $15

Offizieller API-Preis von K3

Pro Million Input-/Output-Tokens (Cache-Treffer $0.30). Der offizielle Preis von Sol beträgt laut Archivstand der offiziellen Preisseite vom 2026-09-12 jetzt $4/$20, als Aktionspreis mindestens bis 2026-11-21.

1M / 1.05M

Kontextfenster

K3 bietet nativ 1M; die offizielle API-Spezifikation von Sol nennt 1,050,000. Beide gehören zur 1M-Klasse, daher entscheidet der lange Kontext nicht mehr.

Wo die Modelle stehen

Kimi K3 (auf der WAIC am 07-16 vorgestellt, Gewichte am 07-27 als Open Source veröffentlicht) ist das Flaggschiff-Reasoning-Modell von Moonshot: 2.8T MoE, 1M Kontext, verpflichtendes Reasoning (Stufen low/high/max, Standard max). GPT-5.6 Sol ist die Flaggschiff-Stufe der 5.6-Serie von OpenAI: Closed Source, 1,050,000 API-Kontext, das Premium-Standardmodell von Codex. Das eine ist die Obergrenze offener Gewichte, das andere der Maßstab geschlossener APIs.

Open Source kommt erstmals so nah heran

Seit dem Start liegt K3 auf mehreren Boards gleichauf mit geschlossenen Flaggschiffen: Im Artificial Analysis Intelligence Index teilt es sich mit GLM-5.3 die Open-Source-Spitze (~60 gegenüber 61 beim geschlossenen Flaggschiff Sol), und es ist das erste offene Modell an der Spitze der Frontend Code Arena mit 1679 Elo. Innerhalb von 11 Tagen nach der Freigabe der Gewichte stiegen die Anfragen stark an, und Moonshot setzte den Ausbau der Consumer-Abos kurzzeitig aus.

Zeitachse

2026-07-16

Kimi K3 startet auf der WAIC: 2.8T, das größte Open-Weights-Modell aller Zeiten.

2026-07-27

Die Gewichte von K3 werden freigegeben und die Anfragen steigen stark an; im selben Zeitraum senkt die 5.6-Serie von Sol die Preise (Luna -80%).

2026-08

K3 teilt sich mit GLM-5.3 die AA-Open-Source-Spitze; bei TB 2.1 bleibt K3 mit 88.3 dicht hinter Sol mit 89.5.

Bestätigt vs. Vorsicht

Bestätigt

Parameter, Kontext, offizielle Preise und Platzierungen beider Modelle sind durch offizielle Seiten oder nachprüfbare Bestenlisten belegt; beide haben bei QCode echtes Aufrufvolumen.

Vorsicht

Das Reasoning von K3 lässt sich nicht abschalten, daher verbrauchen einfache Aufgaben naturgemäß mehr Tokens; Sol kann ohne Reasoning laufen. Rechnen Sie beim Preisvergleich nach Aufgabentyp um – lesen Sie nicht nur die Tabelle der Stückpreise.

Auswahl nach Szenario

Kimi K3 wählen

Sie wünschen offene Gewichte (selbst hostbar), ultralangen Kontext (1M) oder preissensible Aufgaben mit intensivem Reasoning. Offizielle API: $3/$15.

GPT-5.6 Sol wählen

Sie wünschen das Codex-Ökosystem, einstellbare Reasoning-Stufen, den Fast-Modus (2.5x) oder eine bestehende OpenAI-Toolchain. Jetzt $4/$20 (Aktion mindestens bis 2026-11-21).

So prüfen Sie es selbst

Lassen Sie denselben Satz realer Aufgaben auf beiden laufen: K3 nutzt standardmäßig max Reasoning (mehr Tokens, aber höhere Erfolgsquote im ersten Durchlauf), während Sie bei Sol den Aufwand pro Aufgabe einstellen können. Rechnen Sie nach „Erfolgsquote im ersten Durchlauf × Gesamtkosten der Tokens“ um – das ist Ihr realer Stückpreis.

Bei QCode

Sowohl kimi-k3 als auch gpt-5.6-sol sind erhältlich (mit echten Aufrufen in den letzten 30 Tagen). Derselbe Key, offizieller Preis mal Servicesatz; angesichts des Token-Profils von K3 mit verpflichtendem Reasoning sollten Sie vor einer Festlegung einen kleinen realen Durchlauf testen.

FAQ

Welches Modell ist stärker, Kimi K3 oder GPT-5.6 Sol?

Bei TB 2.1 (nach AA-Maßstab): Sol 89.5 vs. K3 88.3 – ein Abstand von 1.2 Punkten, so nah wie nie zuvor bei einem offenen Modell. Die Werte unterscheiden sich je nach Bestenliste, legen Sie sich daher vor dem Vergleich auf ein Board fest.

Ist K3 Open Source?

Ja – die Gewichte wurden am 2026-07-27 freigegeben (2.8T, das größte aller Zeiten). Selbst-Hosting erfordert sehr viel GPU-Speicher; für die meisten ist die API der realistische Weg.

Wie groß ist der Preisunterschied?

Offizielle API: K3 mit $3/$15 ($0.30 bei Cache-Treffer), Sol mit aktuell $4/$20 (Aktion mindestens bis 2026-11-21). Doch das verpflichtende Reasoning von K3 treibt den Token-Verbrauch in die Höhe – rechnen Sie vor dem Vergleich nach Aufgabentyp um.

Wie groß sind die Kontextfenster?

K3 bietet nativ 1M, während die offizielle API-Spezifikation von Sol 1,050,000 nennt; beide gehören also zur 1M-Klasse. Bei langen Repos und Dokumenten liegt der Unterschied in Selbst-Hosting versus verwaltetem Ökosystem, nicht im Fenster.

Lässt sich das Reasoning von K3 abschalten?

Nein – nur die Stufen low / high / max, Standard max. Für einfache Fragen und Antworten ist es teuer; leiten Sie Routinearbeiten an günstigere Modelle.

Kann ich beide bei QCode aufrufen?

Beide sind erhältlich und lassen sich mit demselben Key wechseln. Die Katalogpreise richten sich nach der aktuellen /models-Liste.

Quellen

Offizieller Start von Moonshot (07-16) und Freigabe der Open Weights (07-27), Artificial Analysis Intelligence Index, vals.ai-TB2.1-Momentaufnahme (08-22), The Batch (08-21), QCode /models (08-22).

Open oder Closed – testen Sie beide und entscheiden Sie dann

K3 und Sol lassen sich auf QCode mit nur einem Key testen; rechnen Sie an realen Aufgaben nach.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.