GLM-5.2: Der stärkste Open-Weight-Coder 2026
Zhipus MIT-lizenziertes 1M-Kontext-Flaggschiff führt die Open-Weight-Coding-Benchmarks an. Hier erfahren Sie, was verifiziert ist, wo es steht und was Sie heute auf QCode nutzen können.
GLM-5.2 ist jetzt auf QCode /models als glm-5.2 gelistet. Die MIT-Open-Weights sind unverändert. Ältere Texte auf dieser Seite besagten, dass wir keine Kapazität hätten — das ist veraltet. Die aktuelle Verfügbarkeit entspricht dem, was /models anzeigt.
GLM-5.2 auf einen Blick
MIT-lizenziert auf Hugging Face (zai-org/GLM-5.2) — selbst hostbar.
Ein Eine-Million-Token-Fenster, viermal so groß wie die vorherige Generation.
Mixture-of-Experts: 256 Experten, 8 aktive pro Token (~40B aktiv).
Spitzenmodell unter Open Weights in Coding- und Agent-Benchmarks — noch hinter Claude Opus 4.8.
Verifizierte Benchmarks
Offizielle Zahlen aus Zhipus Release — stark, aber im Kontext lesen.
Offizielle Zahlen aus Zhipus Release. SWE-bench Pro 62.1 liegt knapp vor GPT-5.5 (58.6). Beachten Sie, dass SWE-bench Verified und Code Arena nicht offiziell veröffentlicht wurden — ignorieren Sie erfundene Zahlen — und GLM-5.2 liegt insgesamt weiterhin hinter Claude Opus 4.8, daher ist „stärkstes Open Weight“ die zutreffende Einordnung. Intelligence Index 51 stammt von einem Drittanbieter (Artificial Analysis).
Open Weights vs. Cloud-API
Zwei Möglichkeiten, GLM-5.2 zu betreiben — mit sehr unterschiedlichen Abwägungen.
Open Weights selbst hosten
Die MIT-Lizenz erlaubt es Ihnen, GLM-5.2 auf eigener Hardware zu betreiben — aber ein 753B-MoE-Modell erfordert erhebliche Rechenleistung und Engineering-Aufwand.
Cloud-API des Anbieters
Am schnellsten gestartet, aber in der Einführungswoche gab es strenge Rate Limits, und die Datenleitung über einen Anbieter mit Sitz in China birgt Compliance-Hinweise für regulierte Workloads.
Wo QCode bei GLM-5.2 steht
GLM-5.2 ist jetzt auf QCode /models gelistet. Es bleibt das MIT-Open-Weight-Flaggschiff (~1M Kontext). Leiten Sie Produktions-Traffic anhand des Live-Katalogs; Anbieter-Benchmarks auf dieser Seite stammen noch aus den Einführungs-Tabellen.
Was Sie heute auf QCode nutzen können
Produktionsreife Modelle, sofort über einen API-Key verfügbar.
Claude Opus 4.8
Agentic Coding auf höchstem Niveau.
Codex (GPT-5.5)
Terminal-native agentische Workflows.
Gemini 3 Pro / 3.5 Flash
1M-Kontext-Reasoning, schnelles Multimodal.
Häufig gestellte Fragen
Ist GLM-5.2 auf QCode verfügbar?
Ja. QCode /models listet derzeit glm-5.2. Die frühere Antwort „derzeit nicht verfügbar“ bezog sich auf die Kapazität in der Einführungswoche und ist veraltet.
Ist GLM-5.2 wirklich das beste Coding-Modell?
Es ist das stärkste Open-Weight-Modell — SWE-bench Pro 62.1, vor GPT-5.5 — liegt aber weiterhin hinter Claude Opus 4.8 unter den proprietären Spitzenmodellen. „Bestes Open Weight“ ist zutreffend; „bestes insgesamt“ nicht.
Kann ich GLM-5.2 selbst hosten?
Ja — die Gewichte sind MIT-lizenziert auf Hugging Face. Es handelt sich jedoch um ein 753B-Mixture-of-Experts-Modell, sodass für das Self-Hosting erhebliche GPU-Kapazität und Engineering nötig sind.
Ist GLM-5.2 kostenlos?
Die Open Weights sind unter MIT kostenlos. Der gehostete API-Zugang ist kostenpflichtig — Drittanbieter-Aggregatoren listen etwa $0.95 / $3 pro Million Input-/Output-Tokens — und war zum Start stark rate-limited.
Nutzen Sie heute ein produktionsreifes Modell
Ein Tarif ab $8.57/Monat deckt Claude, Codex und Gemini ab — und wir informieren Sie hier, falls GLM-5.2 zum Sortiment hinzukommt.