Modely a platformy AI
DeepSeek Spouští V4 Pro Jako Svoji Vlajkovou Loď, Která Opouští Náhled

DeepSeek vydal produkční verzi své vlajkové lodi, DeepSeek V4 Pro, a ukončil tak náhledový období, které trvalo téměř čtyři měsíce. Sestavení, označené jako V4 Pro 0813, se objevilo 12. srpna 2026 jako všeobecně dostupná verze na stránce modelu OpenRouter a vlastní dokumentaci API DeepSeeku nyní uvádí DeepSeek-V4-Pro-0813 jako verzi modelu za koncovým bodem deepseek-v4-pro.
Ekonomika API se přenáší z náhledu: 0,435 USD za milion vstupních tokenů při chybě cache, 0,003625 USD za milion při zásahu cache a 0,87 USD za milion výstupních tokenů, s oknem kontextu o velikosti jednoho milionu tokenů a maximálním výstupem 384 000 tokenů. První stránka s cenami DeepSeeku potvrzuje řetězec verze 0813, ceny a limit souběžnosti 500 pro koncový bod Pro ve srovnání s 2 500 pro Flash.
GA ukončuje fázi rolloutu, kterou DeepSeek provádí veřejně od jara. Společnost představila náhled V4 série 24. dubna 2026, dodávající otevřené váhy pro Pro i Flash pod licencí MIT spolu s přístupem k API. 31. července 2026 povýšila menší model Flash na oficiální status a uvedla ve svém seznamu změn, že oficiální vydání Pro “následuje brzy”. Toto následné vydání je to, co přineslo sestavení 0813.
Na Čem Sestavení 0813 Spočívá
V4 Pro je systém mixture-of-experts s 1,6 bilionem celkových parametrů a 49 miliardami aktivních parametrů na token, podle modelové karty na Hugging Face. Architektura kombinuje dvě varianty pozornosti, které DeepSeek nazývá Compressed Sparse Attention a Heavily Compressed Attention, které společnost uvádí, že snižují výpočetní nároky na inference jednoho tokenu o 27 procent a KV cache o 10 procent ve srovnání s potřebami V3.2 při nastavení jednoho milionu tokenů. Obě modely V4 byly předtrénovány na více než 32 bilionech tokenů, s post-trénováním, které roste doménově specifické odborníky samostatně a poté je konsoliduje do jednoho modelu prostřednictvím on-policy distilace.
Otevřené váhy pro náhledové sestavení jsou ke stažení od dubna a repozitář Pro na Hugging Face zaznamenal více než 1,4 milionu stažení za poslední měsíc. Karta doporučuje kontextové okno o velikosti alespoň 384 000 tokenů při spuštění modelu v režimu maximálního uvažování místně.
Čísla, Která DeepSeek Předkládá
Hlavní tvrzení o hodnocení jsou podle údajů dodavatele, z modelové karty a vlastních běhů společnosti. Při maximálním úsilí uvažování, které DeepSeek označuje jako V4-Pro-Max, karta uvádí:
- SWE-bench Verified: 80,6 procent vyřešeno
- Terminal Bench 2.0: 67,9 procent přesnosti
- GPQA Diamond: 90,1 procent pass@1
- Humanity’s Last Exam: 37,7 procent pass@1
- MMLU-Pro: 87,5 procent
- LiveCodeBench: 93,5 procent pass@1
- Codeforces rating: 3 206
- MRCR při jednom milionu tokenů: 83,5 MMR
Vlastní srovnávací tabulka karty umístí tyto skóre proti pojmenovaným systémům na hranici: V4-Pro-Max zaostává za GPT-5.4 při úsilí xHigh na Terminal Bench 2.0 (67,9 až 75,1) a Gemini-3.1-Pro na Humanity’s Last Exam (37,7 až 44,4), zatímco dosahuje nejvyšších skóre v LiveCodeBench a Apex Shortlist. Na SWE-bench Verified dosahuje 80,6, což je srovnatelné s Gemini-3.1-Pro a jen mírně za Claude Opus 4.6 na 80,8. Žádná z těchto sloupců nebyla dosud nezávisle ověřena pro sestavení 0813.
API nabízí tři provozní režimy (non-thinking, vysoké úsilí uvažování a maximální úsilí, které dokumentace popisuje jako “hranici modelu uvažování”) a podporuje formát OpenAI ChatCompletions, formát Anthropic Messages a vlastní formát DeepSeek Responses API, s voláním nástrojů a výstupem JSON na obou Pro i Flash.
Jak DeepSeek Došel Sem
GA Pro ukončuje druhou polovinu strategie vydání, která nejprve umístila levnější model. Když V4-Flash získal oficiální status 31. července 2026, DeepSeek zveřejnil výsledky agentních benchmarků, které ukazují, že přeškolený model Flash překonal V4-Pro-Preview ve svých interních kódovacích agentních sadách, což byla úmyslná akce, která učinila menší model výchozím pro agentní zatížení, zatímco vlajková loď zůstala v náhledu. Sestavení 0813 je odpovědí vlajkové lodi a přichází se stejným kontextovým oknem, stropem výstupu a sadou funkcí pro koncový bod Pro, ale s tím, že náhledový štítek zmizel.
Cenová pozice si zaslouží pozornost. Oznámení na cenové stránce DeepSeeku uvádí, že společnost plánuje “významné zvýšení” celkových cen API v blízké budoucnosti, s detaily, které budou oznámeny oficiálně. Prozatím zůstávají uvedené sazby V4 Pro na svých náhledových úrovních a průměrná cena, která je skutečně placena přes OpenRouter, je výrazně nižší než uvedená cena 0,435 USD, což OpenRouter přisuzuje cache a slevám.
DeepSeek strávil poslední rok budováním ven z modelu samotného: série V4 je trénována kolem agenty zatížení (kódovací asistenti, vícestupňová automatizace, syntéza dlouhých dokumentů), které jeho dubnové oznámení náhledu uvedlo jako ty, které již pohání vývoj společnosti. Čínské otevřené laboratoře váhy vydávají vlajkové modely téměř měsíčně, od Kimi K3 Moonshotu po agentní zaměřený M2.7 MiniMaxu, a GA V4 Pro je snahou DeepSeeku udržet svou vlajkovou loď na čele této skupiny.
Co Následuje
Otevřená položka jsou nové váhy. Repozitáře Hugging Face stále hostí náhledová sestavení z dubna a tabulka ke stažení na modelové kartě odkazuje na tyto artefakty; DeepSeek neuvedl časový plán pro publikování vah 0813 nebo neuvedl, zda GA sestavení se liší od náhledu kromě post-trénování. Společnost uvedla, že její kmitočtová perioda pro řadu V4 prochází API jako první.
Na komerční straně se oznámení na cenové stránce zavazuje DeepSeek k oficiálnímu oznámení své revidované cenové politiky, se zvýšením, které se bude vztahovat na všechny služby API. Dokud toto oznámení nebude vydáno, deepseek-v4-pro bude i nadále poskytovat sestavení 0813 za sazeb uvedených 12. srpna 2026 – 0,435 USD za milion tokenů, 0,87 USD za milion výstupních tokenů, při kontextovém okně o velikosti jednoho milionu tokenů.












