AI-mallit ja alustat
DeepSeek julkaisee V4 Pro -mallinsa lippulaivamallina esikatselun jälkeen

DeepSeek on julkaissut tuotantoversion lippulaivamallistaan, DeepSeek V4 Pro, mikä lopettaa neljän kuukauden esikatselujakson. Rakennus, joka on nimetty V4 Pro 0813, ilmestyi 12. elokuuta 2026 yleisesti saatavilla olevana julkaisuna OpenRouterin mallisivulla, ja DeepSeekin omat API-dokumentaatiot listaa nyt DeepSeek-V4-Pro-0813-mallin deepseek-v4-pro-päätepisteen takana.
API-taloudelliset tiedot ovat edelleen esikatseluvaiheesta: 0,435 dollaria miljoonalle syötetokelle välimuistin epäonnistuessa, 0,003625 dollaria miljoonalle välimuistin osuvalla ja 0,87 dollaria miljoonalle tulostokelle, yhden miljoonan tokenin kontekstiruudun ja 384 000 tokenin maksimituotannon kanssa. DeepSeekin omat hinnoittelusivut vahvistavat 0813-versiomerkin, hinnan ja rinnakkaisuuden 500 raja-arvon Pro-päätepisteen osalta Flashin 2 500 raja-arvoa vastaan.
GA-rakennus on DeepSeekin julkisesti kestäneen, vaiheittaisen julkaisustrategian huipentuma. Yritys esitteli V4-sarjan 24. huhtikuuta 2026 ja toimitti avoimet painot sekä Pro- että Flash-malleille MIT-lisenssillä API-käyttöoikeuksien rinnalla. 31. heinäkuuta 2026 se siirsi pienemmän Flash-mallin viralliseen asemaan ja ilmoitti muutoslokiekirjassa, että Pro-mallin virallinen julkaisu “seuraa pian”. Tuo seuraus on se, mikä toteutui 0813-rakennuksella.
Mihin 0813-rakennus perustuu
V4 Pro on asiantuntijoiden sekoitusjärjestelmä, jossa on 1,6 biljoonaa yhteistä parametria ja 49 miljardia aktiivista tokennia kohti, kuten mallikortissa Hugging Facessa mainitaan. Arkkitehtuuri yhdistää kaksi DeepSeekin kehittämää tarkastelumuotoa, jotka ovat tiivissti pakattu tarkastelu ja voimakkaasti pakattu tarkastelu, jotka yritys sanoo leikkaavan yksittäisen tokenin inference-laskennan 27 prosenttiin ja KV-välimuistiin 10 prosenttiin siitä, mitä V3.2-sukupolvi tarvitsi miljoonan tokenin asetuksella. Molemmat V4-mallit on esikoulutettu yli 32 biljoonalla tokenilla, ja jälkikoulutus kasvattaa aihekohtaisia asiantuntijoita erikseen ja yhdistää ne yhteen malliin käytännön tislaamisen kautta.
Avaimet esikatselurakennuksille ovat olleet ladattavissa huhtikuusta lähtien, ja Pro-repositorio on kirjannut yli 1,4 miljoonaa latausta viime kuussa Hugging Facessa. Kortti suosittelee vähintään 384 000 tokenin kontekstiruutua, kun ajetaan mallin maksimireasoning-tila paikallisesti.
DeepSeekin esittämät luvut
Otsikkoarviot ovat toimittajan ilmoittamia, mallikortista ja yrityksen omista hihnoista. Maksimireasoning-pyrittäessä, jonka DeepSeek merkitsee V4-Pro-Max, kortti ilmoittaa:
- SWE-bench vahvistettu: 80,6 prosenttia ratkaistu
- Terminal Bench 2.0: 67,9 prosentin tarkkuus
- GPQA Diamond: 90,1 prosentin läpäisy @1
- Humanity’s Last Exam: 37,7 prosentin läpäisy @1
- MMLU-Pro: 87,5 prosenttia
- LiveCodeBench: 93,5 prosentin läpäisy @1
- Codeforces-arvosana: 3 206
- MRCR yhdellä miljoonalla tokenilla: 83,5 MMR
Kortin vertailutaulukko asettaa nämä tulokset nimettyjen eturintamajärjestelmien rinnalle: V4-Pro-Max jää GPT-5.4:lle xHigh-pyrittäessä Terminal Bench 2.0:lla (67,9 vs. 75,1) ja Gemini-3.1-Pro:lle Humanity’s Last Examilla (37,7 vs. 44,4), mutta saa korkeimman LiveCodeBench- ja Apex Shortlist -tuloksen. SWE-bench Verified -tuloksella se on 80,6, mikä on sama kuin Gemini-3.1-Pro ja hieman alle Claude Opus 4.6:n 80,8. Näitä sarakkeita ei ole vielä toistettu riippumattoman arvioijan toimesta 0813-rakennukselle.
API tarjoaa kolme toimintatilaa (ei ajatusta, korkea reasonointipyrintä ja maksimipyrintä, jonka dokumentaatio kuvaa “mallin reasonointikapasiteetin rajan työntämiseksi”) ja tukee OpenAI ChatCompletions -muotoa, Anthropic Messages -muotoa ja DeepSeekin omaa Responses API:ta, työkalukutsuilla ja JSON-tulostuksella sekä Pro- että Flash-malleissa.
Miten DeepSeek pääsi tänne
Pro-GA toteuttaa toisen osan julkaisustrategiaa, jossa halvempi malli esiteltiin ensin. Kun V4-Flash siirtyi viralliseen asemaan 31. heinäkuuta 2026, DeepSeek julkaisi agenttibenchmark-tuloksia, jotka osoittivat uudelleen koulutetun Flash-rakennuksen saavuttaneen V4-Pro-Preview-mallin sisäisillä koodiagenttisarjoilla, tietoisen siirron, joka teki pienemmästä mallista oletuksen agenttityökuormille, kun lippulaiva pysyi esikatseluvaiheessa. 0813-rakennus on lippulaivan vastaus, ja se saapuu Pro-päätepisteen kontekstiruudun, tulostuskaton ja ominaisuusjoukon muuttumattomana. Muutos on, että esikatselumerkintä on poissa.
Hinnoittelulaskeuma vaatii tarkkailua. DeepSeekin hinnoittelusivun ilmoitus kertoo yrityksen aikovan “merkittävän hinnankorotuksen” koko API-hinnoittelussa lähitulevaisuudessa, ja yksityiskohdat tulevat virallisen ilmoituksen myötä. Toistaiseksi listatut V4 Pro -hinnat säilyvät esikatselutasolla, ja OpenRouterin keskimääräinen maksama hinta on paljon alempi kuin 0,435 dollarin listahinta, jonka OpenRouter selittää välimuistin ja alennusten ansiosta.
DeepSeek on viime vuoden ajan laajentanut ulospäin mallista itsestään: V4-sarja on koulutettu agenteille tyypillisille työkuormille (koodin avustajat, monivaiheinen automaatio, pitkien asiakirjojen synteesi), joista yrityksen huhtikuun esikatseluilmoitus sanoi jo ohjaavan yrityksen oman sisäisen kehityksen. Kiinalaiset avoimien painojen laboratoriot ovat toimittaneet lippulaivamalleja melkein kuukausittain, Moonshotin Kimi K3:sta MiniMaxin agenttikeskeiseen M2.7:ään, ja V4 Pro -mallin GA on DeepSeekin pyrkimys pitää lippulaivansa edelläkävijänä.
Mitä seuraa
Avoin kohta on uudet painot. Hugging Facen repositoriot isännöivät edelleen huhtikuun esikatselurakennuksia, ja mallikortin lataustaulukko osoittaa näihin artefakteihin; DeepSeek ei ole ilmoittanut aikataulua 0813-painojen julkaisemiseksi eikä sanonut, eroaako GA-rakennus esikatselusta jälkikoulutuksen ulkopuolella. Yrityksen ilmoittama V4-linjan aikataulu, sen muutoslokiekirjan mukaan, suoritetaan ensin API-kautta.
Kaupallisella puolella hinnoittelusivun ilmoitus sitouttaa DeepSeekin viralliseen ilmoitukseen uudistetusta hinnoittelusuunnitelmasta, jossa korotus koskee kaikkia API-palveluita. Ennen kuin ilmoitus saapuu, deepseek-v4-pro jatkaa 0813-rakennuksen toimittamista 12. elokuuta 2026 julkaistuilla hinnoilla — 0,435 dollaria sisään, 0,87 dollaria ulos, miljoonalle tokenille, yhden miljoonan tokenin kontekstilla.












