Modele i platformy AI

DeepSeek Wprowadza V4 Pro Jako Swoje Flagowe Urządzenie Po Okresie Podglądu

mm
Dodaj Unite.AI do preferowanych ÅšrÃģdeł w Google

DeepSeek wydał wersję produkcyjną swojego flagowego modelu, DeepSeek V4 Pro, kończąc okres podglądu, ktÃģry trwał prawie cztery miesiące. Wersja, oznaczona jako V4 Pro 0813, pojawiła się 12 sierpnia 2026 r. jako ogÃģlnie dostępna wersja na stronie modelu OpenRouter oraz w własnej dokumentacji API DeepSeek, ktÃģra teraz wymienia DeepSeek-V4-Pro-0813 jako wersję modelu za punktem końcowym deepseek-v4-pro.

Ekonomika API jest taka sama jak w okresie podglądu: 0,435 USD za milion tokenÃģw wejściowych przy braku trafień w pamięci podręcznej, 0,003625 USD za milion przy trafieniu w pamięci podręcznej oraz 0,87 USD za milion tokenÃģw wyjściowych, z oknem kontekstu o długości jednego miliona tokenÃģw i maksymalnym wyjściem 384 000 tokenÃģw. Strona cenowa DeepSeek potwierdza ciąg wersji 0813, ceny oraz limit wspÃģłbieÅžności 500 dla punktu końcowego Pro w porÃģwnaniu z 2 500 dla Flash.

Wersja GA kończy stopniowe wdroÅženie, ktÃģre DeepSeek prowadziło publicznie od wiosny. Firma zapowiedziała serię V4 24 kwietnia 2026 r., dostarczając otwarte wagi dla modeli Pro i Flash na licencji MIT wraz z dostępem do API. 31 lipca 2026 r. awansowała mniejszy model Flash do oficjalnego statusu i stwierdziła w dzienniku zmian, Åže oficjalne wydanie modelu Pro “nastąpi wkrÃģtce”. To właśnie nastąpiło z wydaniem 0813.

Czym Jest Wersja 0813

V4 Pro to system mieszany z 1,6 biliona parametrÃģw ogÃģłem i 49 miliardami aktywnych na token, zgodnie z kartą modelu na Hugging Face. Architektura łączy dwie warianty uwagi, ktÃģre DeepSeek nazywa Compressed Sparse Attention i Heavily Compressed Attention, co według firmy zmniejsza obliczenia jednego tokenu o 27 procent i pamięć podręczną KV o 10 procent w porÃģwnaniu z potrzebami wersji V3.2 przy ustawieniu miliona tokenÃģw. Oba modele V4 zostały wstępnie przeszkolone na ponad 32 bilionach tokenÃģw, a szkolenie po wstępnym przeszkoleniu rozwija specjalistÃģw domenowych oddzielnie, a następnie konsoliduje ich w jeden model za pomocą destylacji zgodnej z zasadami.

Otwarte wagi dla wersji podglądu są dostępne do pobrania od kwietnia, a repozytorium Pro zanotowało ponad 1,4 miliona pobrań w ciągu ostatniego miesiąca na Hugging Face. Karta zaleca okno kontekstu o długości co najmniej 384 000 tokenÃģw podczas uruchamiania trybu maksymalnego modelu lokalnie.

Numery Przedstawiane Przez DeepSeek

GłÃģwne roszczenia dotyczące oceny pochodzą od dostawcy, z karty modelu i własnych testÃģw firmy. Przy maksymalnym wysiłku rozumu, ktÃģry DeepSeek oznacza jako V4-Pro-Max, karta podaje:

  • SWE-bench Verified: 80,6 procent rozwiązanych
  • Terminal Bench 2.0: 67,9 procent dokładności
  • GPQA Diamond: 90,1 procent pass@1
  • Humanity’s Last Exam: 37,7 procent pass@1
  • MMLU-Pro: 87,5 procent
  • LiveCodeBench: 93,5 procent pass@1
  • Codeforces rating: 3 206
  • MRCR przy jednym milionie tokenÃģw: 83,5 MMR

Własna tabela porÃģwnawcza karty umieszcza te wyniki wobec systemÃģw na czele: V4-Pro-Max jest gorszy od GPT-5.4 przy wysiłku xHigh w teście Terminal Bench 2.0 (67,9 do 75,1) i Gemini-3.1-Pro w teście Humanity’s Last Exam (37,7 do 44,4), podczas gdy osiąga najwyÅžsze wyniki w teście LiveCodeBench i Apex Shortlist. W teście SWE-bench Verified osiąga 80,6, na poziomie Gemini-3.1-Pro i nieco poniÅžej Claude Opus 4.6, ktÃģry uzyskał 80,8. Åŧadna z tych kolumn nie została jeszcze powtÃģrzona przez niezaleÅžnego ewaluatora dla wersji 0813.

API udostępnia trzy tryby operacyjne (bez myślenia, wysiłek rozumu i maksymalny wysiłek, ktÃģry dokumentacja opisuje jako “przeciąganie granic moÅžliwości modelu”) oraz obsługuje format OpenAI ChatCompletions, format Anthropic Messages i własny format Responses API, z wywołaniem narzędzi i wyjściem JSON zarÃģwno dla Pro, jak i Flash.

Jak DeepSeek Dojść Do Tego Miejsca

Oficjalna wersja Pro kończy drugą połowę strategii wydawniczej, ktÃģra umieściła tańszy model na czele. Kiedy V4-Flash uzyskał status oficjalny 31 lipca 2026 r., DeepSeek opublikował wyniki benchmarkÃģw agentÃģw, pokazując, Åže zrekonstruowany model Flash przewyÅžsza wersję V4-Pro-Preview w wewnętrznych suitach kodowania agentÃģw, co było celowym posunięciem, ktÃģre uczyniło mniejszy model domyślnym dla obciÄ…Åžeń agenta, podczas gdy flagowy model pozostał w wersji podglądu. Wersja 0813 jest odpowiedzią flagowego modelu i pojawia się z oknem kontekstu, limitem wyjścia i zestawem funkcji punktu końcowego Pro, ktÃģre nie uległy zmianie. Zmiana polega na tym, Åže etykieta podglądu zniknęła.

Postawa cenowa wymaga uwagi. Zawiadomienie na stronie cenowej DeepSeek mÃģwi, Åže firma planuje “znaczną podwyÅžkę” ogÃģlnych cen API w najbliÅžszej przyszłości, z szczegÃģłami, ktÃģre zostaną podane w oficjalnym zawiadomieniu. Na razie podane stawki V4 Pro pozostają na poziomie wersji podglądu, a średnia cena rzeczywiście zapłacona za pośrednictwem OpenRouter jest znacznie poniÅžej deklarowanej ceny 0,435 USD, co OpenRouter przypisuje pamięci podręcznej i rabatom.

DeepSeek spędził miniony rok rozbudowując model: seria V4 jest szkolona wokÃģł obciÄ…Åžeń agentycznych (asystentÃģw kodowania, wieloetapowej automatyzacji, syntezy długich dokumentÃģw), ktÃģre ogłoszenie zapowiedzi z kwietnia powiedziało, Åže juÅž napędzają rozwÃģj wewnętrzny firmy. Chińskie laboratoria open-weight wydają flagowe modele w niemal miesięcznej kadencji, od Kimi K3 Moonshot do agenta M2.7 MiniMax, a GA V4 Pro to oferta DeepSeek, aby utrzymać swoje flagowe miejsce na czele.

Co Następuje

Otwartym punktem są nowe wagi. Repozytoria Hugging Face nadal hostują wersje podglądu z kwietnia, a tabela pobierania karty wskazuje na te artefakty; DeepSeek nie ogłosił harmonogramu publikacji wag 0813 ani nie powiedział, czy wersja GA rÃģÅžni się od wersji podglądu poza szkoleniem po wstępnym. Oświadczone tempo linii V4, zgodnie z dziennikiem zmian, prowadzi przez API jako pierwsze.

Na stronie komercyjnej zawiadomienie na stronie cenowej zobowiązuje DeepSeek do oficjalnego ogłoszenia swojego zrewidowanego planu cenowego, z podwyÅžką mającą zastosowanie do wszystkich usług API. Do czasu otrzymania zawiadomienia deepseek-v4-pro nadal obsługuje wersję 0813 według stawek opublikowanych 12 sierpnia 2026 r. — 0,435 USD za wejście, 0,87 USD za wyjście za milion tokenÃģw, przy jednym milionie tokenÃģw kontekstu.

Jonas Reeve jest analitykiem wygenerowanym przez AI w Unite.AI, specjalizującym się w sztucznej inteligencji kognitywnej, ogÃģlnej inteligencji sztucznej (AGI) oraz teoretycznych podstawach inteligencji maszynowej. Jego praca bada, jak uczenie się, rozumowanie, pamięć i abstrakcja pojawiają się w systemach biologicznych i sztucznych, nawiązując połączenia między nowoczesnymi architekturami AI a długotrwałymi pytaniami w nauce o poznaniu i filozofii umysłu.
Z konceptualnym i refleksyjnym podejściem, Jonas bada ramy takie jak modele rozumowania, systemy agenty, emergentna percepcja i teoria dopasowania, mając na celu wyjaśnienie, co oznacza postęp w kierunku AGI - i co nie. Zamiast gonienia za harmonogramami lub hiperem, kładzie nacisk na pierwsze zasady, konceptualną surowość i granice obecnych modeli.
Artykuły napisane przez Jonasa Reeve są wygenerowane przez AI i sprawdzane przez zespÃģł redakcyjny Unite.AI, aby zapewnić dokładność, klarowność i odpowiedzialną dyskusję zaawansowanych pojęć AI.