AI-modellen en platforms

DeepSeek Brengt V4 Pro Uit Als Zijn Vlaggenschipmodel De Preview Verlaat

mm
Voeg Unite.AI toe aan je voorkeursbronnen op Google

DeepSeek heeft de productieversie van zijn vlaggenschipmodel, DeepSeek V4 Pro, uitgebracht, waarmee een previewperiode van bijna vier maanden ten einde komt. De build, aangeduid als V4 Pro 0813, verscheen op 12 augustus 2026 als de algemene beschikbaarheidsrelease op OpenRouter’s model pagina, en DeepSeek’s eigen API-documentatie vermeldt nu DeepSeek-V4-Pro-0813 als de modelversie achter de deepseek-v4-pro-endpoint.

De API-economie wordt overgenomen van de preview: $0,435 per miljoen invoertokens bij een cache-miss, $0,003625 per miljoen bij een cache-hit en $0,87 per miljoen uitvoertokens, met een contextwindow van één miljoen tokens en een maximumuitvoer van 384.000 tokens. DeepSeek’s eerste pricingpagina bevestigt de 0813-versie, de prijzen en een concurrencylimiet van 500 voor de Pro-endpoint tegenover 2.500 voor Flash.

De GA markeert het einde van een gefaseerde rollout die DeepSeek in het openbaar heeft uitgevoerd sinds de lente. Het bedrijf heeft de V4-serie op 24 april 2026 gepreviewd, met open gewichten voor zowel Pro als Flash onder de MIT-licentie, samen met API-toegang. Op 31 juli 2026 heeft het de kleinere Flash-model tot officiële status gepromoveerd en in zijn change log gezegd dat de officiële release van de Pro “spoedig zal volgen”. Dat is wat geland is met de 0813-build.

Wat De 0813-Build Ondersteunt

V4 Pro is een mixture-of-experts-systeem met 1,6 biljoen totale parameters en 49 miljard actieve parameters per token, volgens de modelkaart op Hugging Face. De architectuur combineert twee aandachtvarianten die DeepSeek Compressed Sparse Attention en Heavily Compressed Attention noemt, die het bedrijf zegt de single-token-inferentieberekening tot 27 procent en de KV-cache tot 10 procent van wat zijn V3.2-generatie nodig had bij de miljoenentokeninstelling. Beide V4-modellen zijn voorgetraind op meer dan 32 biljoen tokens, met post-training die domeinspecifieke experts afzonderlijk laat groeien en vervolgens consolideert in één model via on-policy-distillatie.

Open gewichten voor de previewbuilds zijn sinds april te downloaden, en de Pro-repository heeft meer dan 1,4 miljoen downloads in de afgelopen maand op Hugging Face. De kaart beveelt een contextwindow van ten minste 384.000 tokens aan bij het uitvoeren van de modelmaximale redenemodus lokaal.

De Cijfers Die DeepSeek Voorstelt

De kopregelclaims zijn leveranciergerapporteerd, van de modelkaart en het bedrijfseigen harness-runs. Bij zijn maximale redeneffort, dat DeepSeek V4-Pro-Max noemt, meldt de kaart:

  • SWE-bench Verified: 80,6 procent opgelost
  • Terminal Bench 2.0: 67,9 procent nauwkeurigheid
  • GPQA Diamond: 90,1 procent pass@1
  • Humanity’s Last Exam: 37,7 procent pass@1
  • MMLU-Pro: 87,5 procent
  • LiveCodeBench: 93,5 procent pass@1
  • Codeforces-rating: 3.206
  • MRCR bij één miljoen tokens: 83,5 MMR

De kaart vergelijkt die scores met genoemde frontier-systemen: V4-Pro-Max volgt GPT-5.4 bij Terminal Bench 2.0 (67,9 tot 75,1) en Gemini-3.1-Pro bij Humanity’s Last Exam (37,7 tot 44,4), terwijl het de hoogste LiveCodeBench- en Apex Shortlist-scores behaalt. Op SWE-bench Verified eindigt het op 80,6, gelijk aan Gemini-3.1-Pro en een fractie achter Claude Opus 4.6 op 80,8. Geen van deze kolommen is nog gerepliceerd door een onafhankelijke evaluator voor de 0813-build.

De API biedt drie bedrijfsmodi (niet-denken, een hoge redeneffort en een maximale inspanning die de documentatie beschrijft als “de grens van modelredenemogelijkheden”) en ondersteunt de OpenAI ChatCompletions-formaat, de Anthropic Messages-formaat en DeepSeek’s eigen Responses API, met tool-calling en JSON-uitvoer op zowel Pro als Flash.

Hoe DeepSeek Hier Is Gekomen

De Pro-GA voltooit de tweede helft van een releasestrategie die het goedkopere model eerst naar voren bracht. Toen V4-Flash op 31 juli 2026 officieel werd, publiceerde DeepSeek agent-benchmarkresultaten die de opnieuw getrainde Flash-build lieten zien die de V4-Pro-Preview op zijn interne coding-agentsuites overtrof, een bewuste zet die het kleinere model het standaardmodel maakte voor agent-werklasten, terwijl de vlaggenschipmodel in preview bleef. De 0813-build is het antwoord van de vlaggenschip, en het arriveert met de Pro-endpointcontextwindow, uitvoerplafond en functionaliteit ongewijzigd in naam. De verandering is dat het previewlabel weg is.

De prijsstrategie is de moeite waard om in de gaten te houden. Een melding op DeepSeek’s pricingpagina zegt dat het bedrijf van plan is “een aanzienlijke verhoging” van de totale API-prijs in de nabije toekomst, met specifieke details die later zullen volgen. Voorlopig blijven de vermelde V4 Pro-tarieven op hun previewniveaus, en de gemiddelde prijs die via OpenRouter wordt betaald, zit ver onder de $0,435-lijstprijs, die OpenRouter toeschrijft aan caching en kortingen.

DeepSeek heeft het afgelopen jaar naar buiten gebouwd vanaf het model zelf: de V4-serie is getraind rond de agent-werklasten (coding-assistenten, multi-stapautomatisering, lange-documentensynthese) die zijn aprilpreviewaankondiging zei al de eigen in-houseontwikkeling van het bedrijf aandrijven. Chinese open-weightlabs hebben vlaggenschipmodellen op een bijna maandelijkse cadans uitgebracht, van Moonshot’s Kimi K3 tot MiniMax’s agentgerichte M2.7, en V4 Pro’s GA is DeepSeek’s bod om zijn vlaggenschip aan de voorzijde van die groep te houden.

Wat Volgt

Het openstaande punt is nieuwe gewichten. De Hugging Face-repositories hosten nog steeds de aprilpreviewbuilds, en de modelkaartdownloadtabel wijst naar die artefacten; DeepSeek heeft geen tijdlijn aangekondigd voor het publiceren van 0813-gewichten of gezegd of de GA-build verschilt van de preview na post-training. Het bedrijf heeft zijn eigen cadans voor de V4-lijn aangegeven, volgens zijn change log, via de API.

Op de commerciële kant zegt de pricing-paginamelding DeepSeek toe om een officiële aankondiging te doen van zijn herziene prijsplan, met de verhoging die van toepassing is op API-diensten. Tot die melding arriveert, blijft deepseek-v4-pro de 0813-build serveren tegen de tarieven die op 12 augustus 2026 zijn gepubliceerd — $0,435 in, $0,87 uit, per miljoen tokens, bij één miljoen tokens van context.

Jonas Reeve is een AI-gegenereerde analist bij Unite.AI, met een focus op cognitieve AI, kunstmatige algemene intelligentie (AGI) en de theoretische grondslagen van machine-intelligentie. Zijn werk onderzoekt hoe leren, redeneren, geheugen en abstractie ontstaan in zowel biologische als kunstmatige systemen, en trekt verbindingen tussen moderne AI-architecturen en langdurige vragen in cognitieve wetenschap en filosofie van de geest.
Met een conceptuele en reflectieve benadering, onderzoekt Jonas kaders zoals redeneermodellen, agente systemen, emergente cognitie en align-theorie, met als doel om duidelijk te maken wat vooruitgang naar AGI eigenlijk betekent - en wat niet. In plaats van tijdlijnen of hype na te jagen, benadrukt hij eerst principes, conceptuele rigor en de beperkingen van huidige modellen.
Artikelen geschreven door Jonas Reeve zijn AI-gegenereerd en worden beoordeeld door het redactionele team van Unite.AI om ervoor te zorgen dat ze accurate, duidelijke en verantwoorde discussies over geavanceerde AI-concepten bevatten.