Modele i platformy AI
DeepSeek Wprowadza V4 Pro Jako Swoje Flagowe Urządzenie Po Okresie Podglądu

DeepSeek wydał wersję produkcyjną swojego flagowego modelu, DeepSeek V4 Pro, kończąc okres podglądu, który trwał prawie cztery miesiące. Wersja, oznaczona jako V4 Pro 0813, pojawiła się 12 sierpnia 2026 r. jako ogólnie dostępna wersja na stronie modelu OpenRouter oraz w własnej dokumentacji API DeepSeek, która teraz wymienia DeepSeek-V4-Pro-0813 jako wersję modelu za punktem końcowym deepseek-v4-pro.
Ekonomika API jest taka sama jak w okresie podglądu: 0,435 USD za milion tokenów wejściowych przy braku trafień w pamięci podręcznej, 0,003625 USD za milion przy trafieniu w pamięci podręcznej oraz 0,87 USD za milion tokenów wyjściowych, z oknem kontekstu o długości jednego miliona tokenów i maksymalnym wyjściem 384 000 tokenów. Strona cenowa DeepSeek potwierdza ciąg wersji 0813, ceny oraz limit współbieżności 500 dla punktu końcowego Pro w porównaniu z 2 500 dla Flash.
Wersja GA kończy stopniowe wdrożenie, które DeepSeek prowadziło publicznie od wiosny. Firma zapowiedziała serię V4 24 kwietnia 2026 r., dostarczając otwarte wagi dla modeli Pro i Flash na licencji MIT wraz z dostępem do API. 31 lipca 2026 r. awansowała mniejszy model Flash do oficjalnego statusu i stwierdziła w dzienniku zmian, że oficjalne wydanie modelu Pro “nastąpi wkrótce”. To właśnie nastąpiło z wydaniem 0813.
Czym Jest Wersja 0813
V4 Pro to system mieszany z 1,6 biliona parametrów ogółem i 49 miliardami aktywnych na token, zgodnie z kartą modelu na Hugging Face. Architektura łączy dwie warianty uwagi, które DeepSeek nazywa Compressed Sparse Attention i Heavily Compressed Attention, co według firmy zmniejsza obliczenia jednego tokenu o 27 procent i pamięć podręczną KV o 10 procent w porównaniu z potrzebami wersji V3.2 przy ustawieniu miliona tokenów. Oba modele V4 zostały wstępnie przeszkolone na ponad 32 bilionach tokenów, a szkolenie po wstępnym przeszkoleniu rozwija specjalistów domenowych oddzielnie, a następnie konsoliduje ich w jeden model za pomocą destylacji zgodnej z zasadami.
Otwarte wagi dla wersji podglądu są dostępne do pobrania od kwietnia, a repozytorium Pro zanotowało ponad 1,4 miliona pobrań w ciągu ostatniego miesiąca na Hugging Face. Karta zaleca okno kontekstu o długości co najmniej 384 000 tokenów podczas uruchamiania trybu maksymalnego modelu lokalnie.
Numery Przedstawiane Przez DeepSeek
Główne roszczenia dotyczące oceny pochodzą od dostawcy, z karty modelu i własnych testów firmy. Przy maksymalnym wysiłku rozumu, który DeepSeek oznacza jako V4-Pro-Max, karta podaje:
- SWE-bench Verified: 80,6 procent rozwiązanych
- Terminal Bench 2.0: 67,9 procent dokładności
- GPQA Diamond: 90,1 procent pass@1
- Humanity’s Last Exam: 37,7 procent pass@1
- MMLU-Pro: 87,5 procent
- LiveCodeBench: 93,5 procent pass@1
- Codeforces rating: 3 206
- MRCR przy jednym milionie tokenów: 83,5 MMR
Własna tabela porównawcza karty umieszcza te wyniki wobec systemów na czele: V4-Pro-Max jest gorszy od GPT-5.4 przy wysiłku xHigh w teście Terminal Bench 2.0 (67,9 do 75,1) i Gemini-3.1-Pro w teście Humanity’s Last Exam (37,7 do 44,4), podczas gdy osiąga najwyższe wyniki w teście LiveCodeBench i Apex Shortlist. W teście SWE-bench Verified osiąga 80,6, na poziomie Gemini-3.1-Pro i nieco poniżej Claude Opus 4.6, który uzyskał 80,8. Żadna z tych kolumn nie została jeszcze powtórzona przez niezależnego ewaluatora dla wersji 0813.
API udostępnia trzy tryby operacyjne (bez myślenia, wysiłek rozumu i maksymalny wysiłek, który dokumentacja opisuje jako “przeciąganie granic możliwości modelu”) oraz obsługuje format OpenAI ChatCompletions, format Anthropic Messages i własny format Responses API, z wywołaniem narzędzi i wyjściem JSON zarówno dla Pro, jak i Flash.
Jak DeepSeek Dojść Do Tego Miejsca
Oficjalna wersja Pro kończy drugą połowę strategii wydawniczej, która umieściła tańszy model na czele. Kiedy V4-Flash uzyskał status oficjalny 31 lipca 2026 r., DeepSeek opublikował wyniki benchmarków agentów, pokazując, że zrekonstruowany model Flash przewyższa wersję V4-Pro-Preview w wewnętrznych suitach kodowania agentów, co było celowym posunięciem, które uczyniło mniejszy model domyślnym dla obciążeń agenta, podczas gdy flagowy model pozostał w wersji podglądu. Wersja 0813 jest odpowiedzią flagowego modelu i pojawia się z oknem kontekstu, limitem wyjścia i zestawem funkcji punktu końcowego Pro, które nie uległy zmianie. Zmiana polega na tym, że etykieta podglądu zniknęła.
Postawa cenowa wymaga uwagi. Zawiadomienie na stronie cenowej DeepSeek mówi, że firma planuje “znaczną podwyżkę” ogólnych cen API w najbliższej przyszłości, z szczegółami, które zostaną podane w oficjalnym zawiadomieniu. Na razie podane stawki V4 Pro pozostają na poziomie wersji podglądu, a średnia cena rzeczywiście zapłacona za pośrednictwem OpenRouter jest znacznie poniżej deklarowanej ceny 0,435 USD, co OpenRouter przypisuje pamięci podręcznej i rabatom.
DeepSeek spędził miniony rok rozbudowując model: seria V4 jest szkolona wokół obciążeń agentycznych (asystentów kodowania, wieloetapowej automatyzacji, syntezy długich dokumentów), które ogłoszenie zapowiedzi z kwietnia powiedziało, że już napędzają rozwój wewnętrzny firmy. Chińskie laboratoria open-weight wydają flagowe modele w niemal miesięcznej kadencji, od Kimi K3 Moonshot do agenta M2.7 MiniMax, a GA V4 Pro to oferta DeepSeek, aby utrzymać swoje flagowe miejsce na czele.
Co Następuje
Otwartym punktem są nowe wagi. Repozytoria Hugging Face nadal hostują wersje podglądu z kwietnia, a tabela pobierania karty wskazuje na te artefakty; DeepSeek nie ogłosił harmonogramu publikacji wag 0813 ani nie powiedział, czy wersja GA różni się od wersji podglądu poza szkoleniem po wstępnym. Oświadczone tempo linii V4, zgodnie z dziennikiem zmian, prowadzi przez API jako pierwsze.
Na stronie komercyjnej zawiadomienie na stronie cenowej zobowiązuje DeepSeek do oficjalnego ogłoszenia swojego zrewidowanego planu cenowego, z podwyżką mającą zastosowanie do wszystkich usług API. Do czasu otrzymania zawiadomienia deepseek-v4-pro nadal obsługuje wersję 0813 według stawek opublikowanych 12 sierpnia 2026 r. — 0,435 USD za wejście, 0,87 USD za wyjście za milion tokenów, przy jednym milionie tokenów kontekstu.
Źródła artykułu oryginalnego: api-docs.deepseek.com [1] · huggingface.co [2]












