Offizielle Daten · 2026-09-18

DeepSeek V4.1 Flash vs. V4 Pro
Wer ist stärker, wer teurer und wie wählen Sie

Nachdem DeepSeek am 2026-09-10 V4.1 Flash veröffentlicht hatte, hieß es in den Release Notes: „Tests mehrerer Parteien sehen V4.1-Flash bei Leistung, Kosten, Geschwindigkeit und Gesamtlaufzeit vor V4-Pro.“ V4 Pro wurde nicht eingestellt: Laut Changelog läuft es mit unveränderter Abrechnung weiter, und die Preisseite führt es weiterhin auf. Diese Seite trennt die beiden Stufen.

Aktualisiert 2026-09-21

#V4.1 Flash#V4 Pro#Offizieller Vergleich#Peak/Off-Peak

Vier zentrale Unterschiede

Flash vorn

Offizielle Tests mehrerer Parteien

Release Note: V4.1-Flash schlägt V4-Pro bei Leistung/Kosten/Geschwindigkeit/Gesamtlaufzeit.

Weiterhin verfügbar

Status von V4 Pro

Laut Changelog läuft V4 Pro mit unveränderter Abrechnung weiter (V4-Pro-0813).

1M / 384K

Kontext/Output

Die Preisseite von V4.1 Flash nennt 1M Kontext und 384K maximalen Output.

Peak/Off-Peak

Preisstruktur

Beide haben Peak/Off-Peak-Preise, wobei Off-Peak die Hälfte kostet; der Stückpreis von Flash liegt deutlich niedriger.

Was jedes Modell ist

V4.1 Flash ist das kleinste Modell der neuen Familie – schnell, günstig, mit nativer Bildverarbeitung. V4 Pro (V4-Pro-0813) ist die Linie für anspruchsvolles Reasoning. Offiziell heißt es, Flash schlage Pro inzwischen in mehreren Punkten, dennoch läuft Pro weiter. Wählen Sie nach Latenz/Kosten oder nach stärkstem Reasoning.

Die offizielle Aussage „Flash schlägt Pro“

Die Release Note vom 2026-09-10 sagt: „Tests mehrerer Parteien sehen V4.1-Flash bei Leistung, Kosten, Geschwindigkeit und Gesamtlaufzeit vor V4-Pro. Wir stellen V4-Pro ein.“ Der Changelog-Eintrag vom 2026-09-10 bestätigte anschließend, dass V4 Pro mit unveränderter Abrechnung weiterläuft. Für die Entscheidung gilt der Changelog, für die aktuellen Preise die Preisseite: Beide Modelle bleiben bestehen; Flash ist der neue Standard, den DeepSeek vorantreibt.

Zeitachse

2026-08-13

Am 2026-08-13 ging V4 Pro in die allgemeine Verfügbarkeit (V4-Pro-0813), DeepSeeks Linie für anspruchsvolle Aufgaben.

2026-09-10

Am 2026-09-10 wurde V4.1 Flash veröffentlicht; offizielle Aussage, es schlage Pro; die Release Note erwähnt die Einstellung von V4-Pro.

2026-09-14

Der Changelog-Eintrag vom 2026-09-10 bestätigte, dass V4 Pro mit unveränderter Abrechnung weiterläuft; keine Umleitung.

Bestätigt vs. Vorsicht

✅ Bestätigt

V4.1 Flash am 2026-09-10 veröffentlicht; laut Release Note liegt Flash in mehreren Punkten vorn; laut Changelog läuft V4 Pro mit unveränderter Abrechnung weiter; aktuelle Versionen: DeepSeek-V4.1-Flash und DeepSeek-V4-Pro-0813.

⚠️ Vorsicht

Die Release Note besagte zeitweise, dass v4-pro ab 2026-09-14 auf Flash geleitet wird, doch der Changelog-Eintrag vom 2026-09-10 bestätigte, dass v4-pro mit unveränderter Abrechnung weiterläuft. Maßgeblich ist der Changelog-Eintrag. Keine Benchmarks von Drittanbietern.

Gemeinsamkeiten und Unterschiede

Gemeinsam

Beide nutzen die offizielle DeepSeek-API mit derselben Base-URL, Thinking/Non-Thinking und Tool Calls sowie 1M Kontext.

Unterschiede

Flash ist schneller/günstiger und offiziell in mehreren Punkten vorn; Pro ist die Linie für anspruchsvolles Reasoning zu einem höheren Stückpreis. Gleiche Peak/Off-Peak-Struktur, aber eine Größenordnung Abstand.

So wählen Sie

Niedrige Latenz, hohes Volumen, budgetbewusst: V4.1 Flash (niedrigere Peak/Off-Peak-Preise, günstigere Cache-Treffer). Stärkstes Reasoning bzw. komplexe Aufgaben bei höherem Stückpreis: V4 Pro. Bei QCode nutzen beide denselben Key und Endpunkt – Sie wechseln über die Modell-ID.

Vergleichen bei QCode

deepseek-v4.1-flash und deepseek-v4-pro sind beide im Verkauf und werden nach tatsächlicher Nutzung abgerechnet, mit einem Key und einem Kontingent. Führen Sie dieselben Anfragen auf beiden aus, um Ihre eigene Kosten-/Qualitäts-Baseline aufzubauen. Die neue offizielle ID deepseek-flash ist derzeit nicht in /models gelistet; ob sie sich setzen lässt, richtet sich nach /models.

FAQ

Ist V4.1 Flash wirklich besser als V4 Pro?

Die Release Note verweist auf Tests mehrerer Parteien, die Flash bei Leistung/Kosten/Geschwindigkeit/Gesamtlaufzeit vorn sehen. Das ist die offizielle Aussage; prüfen Sie dennoch anhand Ihrer eigenen Aufgaben.

Wird V4 Pro eingestellt?

In den Release Notes stand einst „phasing out“, doch der Changelog-Eintrag vom 2026-09-10 bestätigt, dass V4 Pro nach dem 2026-09-14 mit unveränderter Abrechnung weiterläuft, und die Preisseite führt es weiterhin auf.

Wie groß ist der Preisunterschied?

Beide mit Spitzen-/Nebenzeittarif und niedrigerem Preis für Cache-Treffer; der Stückpreis von Flash liegt deutlich unter dem von Pro (siehe die Tagestabelle der Preisseite).

Gleicher Kontext?

Die Preisseite nennt für V4.1 Flash 1M Kontext / 384K maximale Ausgabe; V4 Pro ebenfalls 1M.

Wie vergleicht man auf QCode?

Legen Sie deepseek-v4.1-flash und deepseek-v4-pro fest, führen Sie dieselben Anfragen mit einem Key aus und vergleichen Sie Latenz, Qualität und Kosten.

Sollte ich zu Flash wechseln?

Wenn „Flash vorn“ für Ihren Anwendungsfall zutrifft und Sie geringere Kosten bzw. Latenz wünschen, ja; wenn Sie auf das stärkste Reasoning von Pro angewiesen sind, ist Pro weiterhin erhältlich.

Quellen

DeepSeek-Release-Note news260910, Changelog und Preisseite, erfasst am 2026-09-18. Wo sich Release Note und Changelog zu v4-pro widersprechen, gilt der Changelog-Eintrag vom 2026-09-10, da er die Entscheidung festhält; die Preisseite zeigt nur, was aktuell gelistet ist. QCode-IDs und Nutzung aus /models und den 30-Tage-Statistiken.

Ein Key für den Vergleich beider Modelle

deepseek-v4.1-flash und deepseek-v4-pro teilen sich einen QCode-Key und ein Kontingent – Sie wechseln per Modell-ID; abgerechnet wird zum offiziellen Preis × Servicegebühr.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.