KI-Modelle und Plattformen
DeepSeek veröffentlicht V4 Pro als sein Flaggschiff-Modell verlässt die Vorschau

DeepSeek hat die Produktionsversion seines Flaggschiff-Modells, DeepSeek V4 Pro, veröffentlicht und damit eine Vorschau-Periode beendet, die fast vier Monate gedauert hat. Der Build, der als V4 Pro 0813 bezeichnet wird, erschien am 12. August 2026 als allgemein verfügbare Version auf der Modellseite von OpenRouter und in der API-Dokumentation von DeepSeek, die jetzt DeepSeek-V4-Pro-0813 als Modellversion hinter dem deepseek-v4-pro-Endpunkt auflistet.
Die API-Ökonomie bleibt von der Vorschau erhalten: 0,435 $ pro Million Eingabetoken bei einem Cache-Verpass, 0,003625 $ pro Million bei einem Cache-Treffer und 0,87 $ pro Million Ausgabetoken, mit einem Kontextfenster von einer Million Token und einer maximalen Ausgabe von 384.000 Token. Die Preisseite von DeepSeek bestätigt die Version 0813, die Preise und eine Konkurrenzbegrenzung von 500 für den Pro-Endpunkt gegenüber 2.500 für Flash.
Die allgemeine Verfügbarkeit markiert das Ende einer schrittweisen Veröffentlichung, die DeepSeek seit dem Frühjahr öffentlich durchgeführt hat. Das Unternehmen hatte die V4-Serie am 24. April 2026 vorgestellt und offene Gewichte für Pro und Flash unter der MIT-Lizenz zusammen mit API-Zugriff veröffentlicht. Am 31. Juli 2026 hat es das kleinere Flash-Modell offiziell veröffentlicht und in seinem Changelog angekündigt, dass die offizielle Veröffentlichung des Pro-Modells ” bald folgen” werde. Diese Ankündigung ist mit dem 0813-Build eingetroffen.
Was der 0813-Build unterstützt
V4 Pro ist ein Mixture-of-Experts-System mit 1,6 Billionen Parametern und 49 Milliarden aktiven Parametern pro Token, laut Modellkarte auf Hugging Face. Die Architektur kombiniert zwei Aufmerksamkeitsvarianten, die DeepSeek als Compressed Sparse Attention und Heavily Compressed Attention bezeichnet, die das Unternehmen sagt, den Single-Token-Inferenz-Compute um 27 Prozent und den KV-Cache um 10 Prozent im Vergleich zu seinem V3.2-Modell reduziert haben. Beide V4-Modelle wurden auf mehr als 32 Billionen Token vor trainiert, mit einer Nachtrainierung, die domänen-spezifische Experten separat und dann in einem Modell durch on-policy-Distillation konsolidiert.
Offene Gewichte für die Vorschau-Builds sind seit April herunterladbar, und das Pro-Repository hat in den letzten 30 Tagen auf Hugging Face mehr als 1,4 Millionen Downloads verzeichnet. Die Karte empfiehlt ein Kontextfenster von mindestens 384.000 Token, wenn das Modell im lokalen Maximum-Reasoning-Modus ausgeführt wird.
Die Zahlen, die DeepSeek vorlegt
Die wichtigsten Bewertungsansprüche sind vom Hersteller gemeldet, aus der Modellkarte und den eigenen Harness-Läufen des Unternehmens. Im Maximum-Reasoning-Modus, den DeepSeek als V4-Pro-Max bezeichnet, berichtet die Karte:
- SWE-bench Verifiziert: 80,6 Prozent gelöst
- Terminal Bench 2.0: 67,9 Prozent Genauigkeit
- GPQA Diamant: 90,1 Prozent Pass@1
- Humanitys letzte Prüfung: 37,7 Prozent Pass@1
- MMLU-Pro: 87,5 Prozent
- LiveCodeBench: 93,5 Prozent Pass@1
- Codeforces-Bewertung: 3.206
- MRCR bei einem Million Token: 83,5 MMR
Die Vergleichstabelle auf der Karte stellt diese Ergebnisse gegen benannte Spitzen-Systeme: V4-Pro-Max liegt hinter GPT-5.4 bei xHigh-Aufwand auf Terminal Bench 2.0 (67,9 zu 75,1) und Gemini-3.1-Pro auf Humanitys letzte Prüfung (37,7 zu 44,4), während es die Spitzen-Plätze auf LiveCodeBench und Apex-Shortlist belegt. Auf SWE-bench Verifiziert liegt es bei 80,6, auf gleicher Höhe mit Gemini-3.1-Pro und einen Bruchteil hinter Claude Opus 4.6 bei 80,8. Keine dieser Spalten wurde bisher von einem unabhängigen Evaluator für den 0813-Build repliziert.
Die API bietet drei Betriebsmodi (nicht denkend, ein hoher Reasoning-Aufwand und ein Maximum-Aufwand, den die Dokumentation als “die Grenze der Modell-Reasoning-Fähigkeit” bezeichnet) und unterstützt das OpenAI-ChatCompletions-Format, das Anthropic-Messages-Format und DeepSeeks eigenes Responses-API, mit Tool-Aufrufen und JSON-Ausgabe auf beiden Pro- und Flash-Modellen.
Wie DeepSeek hierher kam
Die allgemeine Verfügbarkeit des Pro-Modells komplettiert die zweite Hälfte einer Veröffentlichungsstrategie, die das günstigere Modell zuerst veröffentlichte. Als V4-Flash am 31. Juli 2026 offiziell veröffentlicht wurde, veröffentlichte DeepSeek Agenten-Benchmark-Ergebnisse, die die re-post-trainierte Flash-Build-Version vor dem V4-Pro-Vorschau-Modell auf seinen internen Coding-Agent-Suiten auswiesen, eine bewusste Entscheidung, die das kleinere Modell zur Standard-Workload für Agenten-Aufgaben machte, während das Flaggschiff-Modell noch in der Vorschau blieb. Der 0813-Build ist die Antwort des Flaggschiffs, und er erscheint mit dem Kontextfenster, der Ausgabe-Obergrenze und dem Funktionsumfang des Pro-Endpunkts unverändert. Der Unterschied besteht darin, dass das Vorschau-Label verschwunden ist.
Die Preisstrategie ist zu beobachten. Eine Mitteilung auf der Preisseite von DeepSeek besagt, dass das Unternehmen eine “erhebliche Erhöhung” der gesamten API-Preise in naher Zukunft plant, mit Details, die durch offizielle Mitteilung bekannt gegeben werden. Derzeit bleiben die aufgeführten V4-Pro-Tarife auf ihren Vorschau-Niveaus, und der durchschnittliche Preis, der durch OpenRouter bezahlt wird, liegt deutlich unter dem Listenpreis von 0,435 $, den OpenRouter auf Caching und Rabatte zurückführt.
DeepSeek hat das letzte Jahr damit verbracht, von dem Modell selbst auszubauen: die V4-Serie ist auf die agierenden Workloads (Coding-Assistenten, mehrstufige Automatisierung, Langdokument-Synthese) trainiert, die die April-Vorschau-Ankündigung des Unternehmens bereits als treibende Kräfte für die eigene interne Entwicklung bezeichnete. Chinesische Open-Weight-Labore haben Flaggschiff-Modelle in nahezu monatlichem Rhythmus veröffentlicht, von Moonshots Kimi K3 bis zu MiniMax’ agenten-orientiertem M2.7, und die allgemeine Verfügbarkeit von V4 Pro ist DeepSeeks Angebot, sein Flaggschiff an die Spitze dieses Feldes zu bringen.
Was als nächstes veröffentlicht wird
Das offene Thema sind neue Gewichte. Die Hugging-Face-Repositorys hosten noch die Vorschau-Builds, und die Download-Tabelle auf der Modellkarte verweist auf diese Artefakte; DeepSeek hat noch keinen Zeitplan für die Veröffentlichung von 0813-Gewichten angekündigt oder gesagt, ob sich das GA-Build von der Vorschau-Version unterscheidet. Die angekündigte Veröffentlichungsstrategie des Unternehmens für die V4-Linie, gemäß seinem Changelog, läuft durch die API.
Auf der kommerziellen Seite verpflichtet die Preis-Seite-Mitteilung DeepSeek zu einer offiziellen Ankündigung seines überarbeiteten Preisplans, mit der Erhöhung, die auf alle API-Dienste angewendet wird. Bis diese Mitteilung eintrifft, setzt deepseek-v4-pro den 0813-Build zu den am 12. August 2026 veröffentlichten Tarifen fort — 0,435 $ ein, 0,87 $ aus, pro Million Token, bei einem Million-Token-Kontext.












