GLM-5.3-Flash vs DeepSeek V4 Flash
Liste $0.15/$0.50 vs $0.14/$0.28; beide mit 1M-Fenster, MIT-Gewichte
Zhipu hat GLM-5.3-Flash am 2026-08-26 veröffentlicht (320B-A18B, 1M, MIT). Offizieller Listenpreis $0.15 / $0.50 pro Million; Launch-Rabatt von 50 % mit $0.075 / $0.25 bis 2026-09-09 24:00 UTC+8. Die aktuell laufende Flash-Stufe von DeepSeek ist V4.1-Flash seit 2026-09-10, Off-Peak-Listenpreis $0.15 / $0.6, Fenster 1M / 384K; der Build 0731 ist eingestellt, sein damaliger Preis lag bei $0.14 / $0.28. Beide IDs zeigen hier über 30 Tage eine Nutzung > 0 – ein Key, ein Endpunkt, Sie wechseln nur das Modellfeld.
Aktualisiert 2026-09-20
Vier Zahlen zum Zitieren
Offizieller Listenpreis von GLM-5.3-Flash
Input / Output pro Million. Der Launch-Rabatt von 50 % beträgt $0.075 / $0.25 bis 2026-09-09 24:00 UTC+8. QCode folgt dem offiziellen Preis × Gebühr; am 2026-08-27 lag das abgerechnete Paar bei $0.14 / $0.49.
DeepSeek V4 Flash ohne Cache / Output
Offizielle Preise von 0731 im August 2026 (Peak/Off-Peak ab 2026-08-16 16:00 UTC). Dieser Build wurde am 2026-09-10 eingestellt; der aktuelle ist deepseek-v4.1-flash, Fenster 1M Input / 384K max. Output.
Beide werben mit einem Kontext von einer Million Tokens
GLM-5.3-Flash offiziell 1M. DeepSeek V4 Flash 1M / 384K. Bei Aufgaben mit großen Repositories: Achten Sie auf die tatsächliche Grenze, nicht nur auf das Marketing-Fenster.
Beide veröffentlichen offene Gewichte
GLM-5.3-Flash erschien am 2026-08-26 auf HF. DeepSeek V4 Flash-0731 steht ebenfalls unter MIT, wurde aber am 2026-09-10 eingestellt. Offene Gewichte ≠ Sie müssen selbst hosten; der API-Weg folgt den offiziellen Listenpreisen.
Flash gegen Flash, kein weiterer GLM-Leitfaden
Die Website hat bereits einen Leitfaden zu GLM-5.3-Flash, eine Verlaufsseite zu DeepSeek V4 Flash 0731 und GLM-5.2 vs DeepSeek V4 Pro. Diese Seite stellt nur die günstigen Stufen bei offiziellem Preis, Fenster und Lizenz gegenüber – und die aktuelle günstige Stufe von DeepSeek ist V4.1-Flash seit 2026-09-10. GLM ist ein multimodales MoE mit 320B-A18B; 0731 hatte dieselbe Flash-Größe mit frischem Post-Training und einem sprunghaft gestiegenen Agent-Score (historisch). Wählen Sie nach Aufgabe, nicht nach Slogan.
Warum Flash-vs-Flash nach dem 08-26 aufkam
Am Launch-Tag endete der Stealth-Test Ox Alpha und z-ai/glm-5.3-flash trat an seine Stelle. Bei DeepSeek lief 0731 ab 2026-07-31 als Preview, erhielt am 2026-08-16 Peak/Off-Peak-Preise und wurde am 2026-09-10 zugunsten von V4.1-Flash eingestellt. Die beiden offiziellen Output-Preise liegen nun bei etwa $0.50 gegenüber $0.6. Nachdem QCode GLM-5.3-Flash am 2026-08-27 aufgenommen hat, erhalten beide IDs echten Traffic über einen Endpunkt.
Zeitleiste
2026-07-31 API-Preview von DeepSeek V4 Flash 0731; die ID blieb deepseek-v4-flash, und der damalige offizielle Preis ohne Cache / Output lag bei $0.14 / $0.28. Der Build wurde am 2026-09-10 eingestellt.
2026-08-16 DeepSeek Flash wechselt auf Peak/Off-Peak. Zitieren Sie nicht nur den Tagespreis der Liste.
GLM-5.3-Flash erscheint und veröffentlicht seine Gewichte; QCode nimmt es am nächsten Tag (2026-08-27) zu $0.14 / $0.49 auf (offiziell × Gebühr). Der offizielle Rabatt von 50 % läuft bis 2026-09-09 24:00 UTC+8.
Bestätigt vs missverstanden
Bestätigt
Beide offiziellen Preise, 1M-Fenster, MIT, GLM-Veröffentlichung am 2026-08-26, Rabattende 2026-09-09 24:00 UTC+8, DeepSeek Peak/Off-Peak ab 2026-08-16, beide IDs mit Nutzung > 0 hier – Anbieterseiten und bereits veröffentlichte Website-Texte, geprüft am 2026-08-30.
Missverstanden
„Flash heißt, ein Laptop kann es ausführen“ – GLM hat insgesamt 320B; das ist nichts für ein Smartphone. „Die Output-Preise stimmen überein“ – offiziell $0.50 vs $0.28. „QCode entspricht dem offiziellen Rabatt von 50 %“ – QCode ist offiziell × Gebühr; vermischen Sie nicht $0.14/$0.49 vom 2026-08-27 mit $0.075/$0.25.
Wann welches Modell
Eher GLM-5.3-Flash
Sie brauchen Vision-Input, die Zhipu-Toolchain oder den offiziellen Rabatt von 50 % vor dem 09-09. Die Architektur ist multimodal mit 320B-A18B. Listenpreis für Cache-Lesen zum Launch $0.015. Maßgeblich für die Abrechnung ist die Konsole.
Eher DeepSeek V4 Flash
Sie wollen den niedrigeren offiziellen Output-Preis, Peak/Off-Peak oder nutzen bereits die Agent-Scores der Flash-Linie von DeepSeek. Terminal Bench 2.1 öffentlich 82.7 gehört zum Build 0731 und steht auf dessen Verlaufsseite. Prüfen Sie die 384K max. Output gegen Ihre Aufgabe.
So wechseln Sie auf einem Endpunkt (beide im Angebot)
Die IDs lauten glm-5.3-flash und deepseek-v4-flash. Ein bereits eingerichteter Key, ein Chat-Completions-Endpunkt, Sie ändern nur das Modell. Schätzen Sie anhand der offiziellen Listen und lesen Sie dann die gebührenbehaftete Zahl in Ihrem Konto ab. Betrachten Sie das Rabattfenster nicht als Dauerpreis.
Beide Flash-IDs sind bei QCode aufrufbar
glm-5.3-flash und deepseek-v4.1-flash zeigen beide eine Nutzung > 0 in unserer 30-Tage-Tabelle, und Sie wechseln zwischen ihnen auf demselben Endpunkt mit einem einzigen Prepaid-Guthaben zum offiziellen Preis × Servicesatz. GLM wurde bei der Aufnahme am 2026-08-27 mit $0.14/M Input und $0.49/M Output gelistet, das Cache-Lesen wurde am 2026-09-08 auf $0.04/M gesenkt. Der aktuelle offizielle Preis von DeepSeek V4.1-Flash beträgt $0.15/M Input Off-Peak und $0.3/M Peak, $0.6/M Output Off-Peak und $1.2/M Peak. Das Paar $0.14/$0.28 unter dem Legacy-Namen deepseek-v4-flash gehört zur Generation vom 2026-07-31.
FAQ
Welche Tabelle ist der offizielle Preis?
GLM: Zhipu / Z.ai $0.15/$0.50, Rabatt von 50 % $0.075/$0.25 bis 2026-09-09 24:00 UTC+8. DeepSeek: der Preis ohne Cache / Output $0.14/$0.28 aus der 0731-Zeit plus Peak/Off-Peak. QCode-Abrechnung = offiziell × Gebühr.
Haben beide ein 1M-Fenster?
GLM offiziell 1M. DeepSeek Flash 1M Input, 384K max. Output. Bei Aufgaben mit langem Output: Prüfen Sie zuerst die 384K.
Wie unterscheidet sich das von GLM-5.2 vs DeepSeek V4 Pro?
Jene Seite behandelt Flaggschiff / Pro. Diese Seite nur Flash. Übertragen Sie keine Pro-Scores auf die Flash-Zeile.
Empfehlung für Self-Hosting?
Beide MIT. Den VRAM-Bedarf von GLM 320B-A18B fasst das Wort „Flash“ nicht zusammen. Auch zum Build 0731 gab es Homelab-Threads, er wurde aber am 2026-09-10 eingestellt. Diese Seite dient der API-Auswahl, nicht als Rack-Liste.
Kann ich beide bei QCode testen?
Ja. Beide IDs haben echte Nutzung. Gleicher Key, Sie ändern nur das Modell. Die Preise folgen dem Anbieter.
Gilt der Rabatt von 50 % bei GLM auch nach dem 09-09?
Der offizielle Rabatt ist bis 2026-09-09 24:00 UTC+8 angegeben. Danach gilt der Listenpreis $0.15/$0.50, sofern Zhipu nichts anderes mitteilt. Betrachten Sie den Rabatt nicht als dauerhaft.
Quellen
GLM-Liste, Halbpreis-Zeitraum, 320B-A18B, 1M, MIT: Veröffentlichung von Zhipu / Z.ai vom 2026-08-26 sowie der Guide zu glm-5-3-flash und die Preisseite auf der Website (erneut geprüft am 2026-08-30). Die aktuellen DeepSeek-Werte $0.15 / $0.6 und 1M/384K: die offizielle Preisseite (erfasst am 2026-09-18). Die historischen 0731-Preise von $0.14 / $0.28 sowie Peak/Off-Peak ab 2026-08-16: die Verlaufsseite deepseek-v4-flash-0731 auf der Website. Abschaltung und temporäres Routing: die Release Note vom 2026-09-10 und Preisfußnote (1). Nutzung: die CRS-Tabelle der Aufrufvolumen der letzten 30 Tage, abgerufen am 2026-09-18.
Beide Flash-Modelle sind im Angebot; Modellwechsel über denselben Endpunkt
Offizieller Preis × Servicegebühr. Der GLM-Halbpreis hat ein Enddatum; DeepSeek hat Peak/Off-Peak. Erst schätzen, dann den Traffic verlagern.
Verwandte Themen
GLM-5.3-Flash-Guide
320B-A18B, Ox-Alpha-Test, Vision – hier nicht näher behandelt.
DeepSeek V4 Flash 0731 (historisch)
Post-Training, Peak/Off-Peak, TB2.1-Score.
GLM-5.2 vs. DeepSeek V4 Pro
Vergleich der Flaggschiffe; nicht mit der Flash-Zeile vermischen.
Preise und Zeiträume folgen den offiziellen Seiten von Zhipu / DeepSeek und Ihrer Rechnung. Rabatte und Peak/Off-Peak ändern sich. QCode berechnet offiziellen Preis × Gebühr und verspricht nicht, den offiziellen Halbpreis auf den Cent genau abzubilden.