Modelli e piattaforme di IA
DeepSeek Lancia V4 Pro Come Modello Flagship Dopo Il Periodo Di Anteprima

DeepSeek ha rilasciato la versione di produzione del suo modello flagship, DeepSeek V4 Pro, ponendo fine a un periodo di anteprima che è durato quasi quattro mesi. La build, designata V4 Pro 0813, è apparsa il 12 agosto 2026 come rilascio di disponibilità generale sulla pagina del modello di OpenRouter e la documentazione dell’API di DeepSeek elenca ora DeepSeek-V4-Pro-0813 come versione del modello dietro l’endpoint deepseek-v4-pro.
L’economia dell’API si estende dal periodo di anteprima: $0,435 per milione di token di input su un errore di cache, $0,003625 per milione su un successo di cache e $0,87 per milione di token di output, con una finestra di contesto di un milione di token e un output massimo di 384.000 token. La pagina dei prezzi di DeepSeek conferma la stringa di versione 0813, i prezzi e un limite di concorrenza di 500 per l’endpoint Pro rispetto a 2.500 per Flash.
Il GA conclude una strategia di rilascio in due fasi che ha messo il modello più economico per primo. Quando V4-Flash è diventato ufficiale il 31 luglio 2026, DeepSeek ha pubblicato i risultati dei benchmark degli agenti, mostrando la ricostruzione della build Flash che supera la V4-Pro-Preview nelle sue suite di codifica degli agenti, un movimento deliberato che ha reso il modello più piccolo il default per i carichi di lavoro degli agenti mentre il modello flagship è rimasto in anteprima. La build 0813 è la risposta del modello flagship e arriva con la finestra di contesto dell’endpoint Pro, il soffitto di output e l’insieme di funzionalità rimasti invariati nel nome. Il cambiamento è che l’etichetta di anteprima è scomparsa.
Cosa Siede La Build 0813
V4 Pro è un sistema a miscela di esperti con 1,6 trilioni di parametri totali e 49 miliardi di parametri attivi per token, secondo la scheda del modello su Hugging Face. L’architettura combina due varianti di attenzione che DeepSeek chiama Compressed Sparse Attention e Heavily Compressed Attention, che la società afferma riducono il calcolo di inferenza del token singolo al 27% e la cache KV al 10% di quanto necessario dalla generazione V3.2 al livello di un milione di token. Entrambi i modelli V4 sono stati pre-addestrati su più di 32 trilioni di token, con un addestramento post-trattamento che cresce gli esperti di dominio specifici separatamente e poi li consolida in un unico modello attraverso la distillazione sulle politiche.
I pesi aperti per le build di anteprima sono stati scaricabili dal 24 aprile e il repository Pro ha registrato più di 1,4 milioni di download nell’ultimo mese su Hugging Face. La scheda del modello raccomanda una finestra di contesto di almeno 384.000 token quando si esegue la modalità di ragionamento massimo del modello localmente.
I Numeri Che DeepSeek Sta Proponendo
Le richieste di valutazione principali sono riportate dal fornitore, dalla scheda del modello e dalle esecuzioni del proprio harness della società. Al massimo sforzo di ragionamento, che DeepSeek etichetta V4-Pro-Max, la scheda del modello riporta:
- SWE-bench Verificato: 80,6 percento risolto
- Terminal Bench 2.0: 67,9 percento di accuratezza
- GPQA Diamond: 90,1 percento pass@1
- Humanity’s Last Exam: 37,7 percento pass@1
- MMLU-Pro: 87,5 percento
- LiveCodeBench: 93,5 percento pass@1
- Codeforces rating: 3.206
- MRCR a un milione di token: 83,5 MMR
La tabella di confronto della scheda del modello mette a confronto quei punteggi con i sistemi di frontiera nominati: V4-Pro-Max è dietro GPT-5.4 su Terminal Bench 2.0 (67,9 a 75,1) e Gemini-3.1-Pro su Humanity’s Last Exam (37,7 a 44,4), mentre ottiene i punteggi più alti di LiveCodeBench e Apex Shortlist. Su SWE-bench Verificato si posiziona al 80,6%, in pari con Gemini-3.1-Pro e di poco dietro Claude Opus 4.6 all’80,8%. Nessuna di queste colonne è stata ancora replicata da un valutatore indipendente per la build 0813.
L’API espone tre modalità di funzionamento (non pensante, uno sforzo di ragionamento elevato e un massimo sforzo che la documentazione descrive come spingere “i confini della capacità di ragionamento del modello”) e supporta il formato OpenAI ChatCompletions, il formato Anthropic Messages e il formato Responses API di DeepSeek, con chiamata di strumenti e output JSON su entrambi Pro e Flash.
Come DeepSeek È Arrivato Qui
Il GA Pro completa la seconda metà di una strategia di rilascio che ha messo il modello più economico per primo. Quando V4-Flash è diventato ufficiale il 31 luglio 2026, DeepSeek ha pubblicato i risultati dei benchmark degli agenti, mostrando la ricostruzione della build Flash che supera la V4-Pro-Preview nelle sue suite di codifica degli agenti, un movimento deliberato che ha reso il modello più piccolo il default per i carichi di lavoro degli agenti mentre il modello flagship è rimasto in anteprima. La build 0813 è la risposta del modello flagship e arriva con la finestra di contesto dell’endpoint Pro, il soffitto di output e l’insieme di funzionalità rimasti invariati nel nome. Il cambiamento è che l’etichetta di anteprima è scomparsa.
La posizione dei prezzi merita attenzione. Un avviso sulla pagina dei prezzi di DeepSeek afferma che la società prevede “un aumento significativo” dei prezzi dell’API nel prossimo futuro, con dettagli da comunicare ufficialmente. Per ora, i prezzi elencati per V4 Pro rimangono ai loro livelli di anteprima e il prezzo medio effettivamente pagato attraverso OpenRouter si trova ben al di sotto del prezzo di listino di $0,435, che OpenRouter attribuisce alla cache e agli sconti.
DeepSeek ha trascorso l’ultimo anno costruendo verso l’esterno dal modello stesso: la serie V4 è addestrata intorno ai carichi di lavoro agente (assistente di codifica, automazione multi-passaggio, sintesi di documenti lunghi) che l’annuncio di anteprima di aprile ha detto già guidano lo sviluppo interno della società. I laboratori open-weight cinesi hanno rilasciato modelli di classe flagship con una cadenza quasi mensile, dal Kimi K3 di Moonshot al modello agente M2.7 di MiniMax, e il GA di V4 Pro è il tentativo di DeepSeek di mantenere il suo modello flagship alla testa di quel gruppo.
Cosa Viene Spedito Dopo
L’elemento aperto sono i nuovi pesi. I repository Hugging Face ospitano ancora le build di anteprima di aprile e la tabella di download della scheda del modello punta a quegli artifact; DeepSeek non ha annunciato una tempistica per la pubblicazione dei pesi 0813 o detto se la build GA differisce dall’anteprima oltre l’addestramento post-trattamento. La cadenza dichiarata della società per la linea V4, secondo il suo registro delle modifiche, passa per l’API per prima.
Sul lato commerciale, l’avviso sulla pagina dei prezzi impegna DeepSeek a un annuncio ufficiale del suo piano di prezzo rivisto, con l’aumento che si applica a tutti i servizi API. Fino a quando non arriva quell’avviso, deepseek-v4-pro continua a servire la build 0813 ai tassi pubblicati il 12 agosto 2026 — $0,435 in, $0,87 out, per milione di token, a un milione di token di contesto.












