Model dan platform AI
DeepSeek Meluncurkan V4 Pro sebagai Model Banderolnya Keluar dari Pratinjau

DeepSeek telah merilis versi produksi dari model andalannya, DeepSeek V4 Pro, yang menandai akhir dari periode pratinjau yang berlangsung hampir empat bulan. Build ini, yang ditandai dengan V4 Pro 0813, muncul pada 12 Agustus 2026, sebagai rilis umum di halaman model OpenRouter, dan dokumentasi API DeepSeek sekarang menyebutkan DeepSeek-V4-Pro-0813 sebagai versi model di balik endpoint deepseek-v4-pro.
Ekonomi API masih sama dengan yang ada di pratinjau: $0,435 per juta token input pada cache miss, $0,003625 per juta pada cache hit, dan $0,87 per juta token output, dengan jendela konteks sebesar satu juta token dan output maksimum 384.000 token. Halaman harga DeepSeek mengkonfirmasi string versi 0813, harga, dan batas konkurensi 500 untuk endpoint Pro dibandingkan dengan 2.500 untuk Flash.
Rilis ini menandai akhir dari strategi peluncuran bertahap yang dijalankan DeepSeek sejak musim semi. Perusahaan mempratinjau seri V4 pada 24 April 2026, mengirimkan bobot terbuka untuk Pro dan Flash di bawah lisensi MIT bersama dengan akses API. Pada 31 Juli 2026, mereka mempromosikan model Flash yang lebih kecil ke status resmi dan menyatakan dalam catatan perubahan bahwa rilis resmi Pro “akan segera menyusul.” Itulah yang terjadi dengan build 0813.
Apa yang Dimiliki Build 0813
V4 Pro adalah sistem campuran-ahli dengan 1,6 triliun parameter total dan 49 miliar parameter aktif per token, menurut kartu model di Hugging Face. Arsitektur ini menggabungkan dua varian perhatian yang disebut DeepSeek sebagai Perhatian Sparis yang Ditekan dan Perhatian yang Ditekan Berat, yang menurut perusahaan dapat mengurangi komputasi inferensi token tunggal hingga 27 persen dan cache KV hingga 10 persen dari apa yang dibutuhkan oleh generasi V3.2 pada pengaturan jutaan token. Kedua model V4 telah dipratinjau pada lebih dari 32 triliun token, dengan pasca-pelatihan yang tumbuh menjadi ahli domain-spesifik secara terpisah dan kemudian mengkonsolidasikan mereka menjadi satu model melalui destilasi kebijakan.
Bobot terbuka untuk build pratinjau telah dapat diunduh sejak April, dan repositori Pro mencatat lebih dari 1,4 juta unduhan dalam sebulan terakhir di Hugging Face. Kartu merekomendasikan jendela konteks minimal 384.000 token saat menjalankan mode alasan maksimum model secara lokal.
Angka-angka yang Dibawa oleh DeepSeek
Klaim evaluasi utama adalah laporan vendor, dari kartu model dan harness perusahaan. Pada upaya alasan maksimum, yang DeepSeek labeli V4-Pro-Max, kartu melaporkan:
- SWE-bench Verifikasi: 80,6 persen diselesaikan
- Terminal Bench 2.0: 67,9 persen akurasi
- GPQA Diamond: 90,1 persen lulus@1
- Ujian Terakhir Kemanusiaan: 37,7 persen lulus@1
- MMLU-Pro: 87,5 persen
- LiveCodeBench: 93,5 persen lulus@1
- Peringkat Codeforces: 3.206
- MRCR pada satu juta token: 83,5 MMR
Tabel perbandingan kartu menempatkan skor tersebut melawan sistem frontier yang dinamai: V4-Pro-Max kalah dari GPT-5.4 pada upaya xHigh di Terminal Bench 2.0 (67,9 hingga 75,1) dan Gemini-3.1-Pro di Ujian Terakhir Kemanusiaan (37,7 hingga 44,4), sementara memunculkan skor LiveCodeBench dan Apex Shortlist teratas. Pada SWE-bench Verifikasi, itu mencapai 80,6, setara dengan Gemini-3.1-Pro dan sedikit di belakang Claude Opus 4.6 pada 80,8. Tidak ada kolom yang telah direplikasi oleh evaluator independen untuk build 0813.
API membuka tiga mode operasi (non-pemikiran, upaya alasan tinggi, dan upaya maksimum yang dideskripsikan dalam dokumentasi sebagai “mendorong batas kemampuan alasan model”) dan mendukung format OpenAI ChatCompletions, format Anthropic Messages, dan API Respon DeepSeek, dengan panggilan alat dan output JSON pada Pro dan Flash.
Bagaimana DeepSeek Sampai di Sini
GA Pro menyelesaikan setengah kedua dari strategi rilis yang meletakkan model yang lebih murah di depan terlebih dahulu. Ketika V4-Flash menjadi resmi pada 31 Juli 2026, DeepSeek menerbitkan hasil benchmark agen yang menunjukkan build Flash yang diposting ulang mengungguli V4-Pro-Pratinjau pada suite agen pengkodean internal, langkah yang disengaja yang membuat model kecil menjadi default untuk beban kerja agen sementara model andalan tetap dalam pratinjau. Build 0813 adalah jawaban model andalan, dan itu tiba dengan jendela konteks, batas output, dan fitur set Pro yang tidak berubah dalam nama. Perubahan itu adalah bahwa label pratinjau telah hilang.
Sikap harga patut diperhatikan. Pemberitahuan di halaman harga DeepSeek menyatakan perusahaan berencana “menaikkan secara signifikan” harga API secara keseluruhan di masa depan, dengan rincian yang akan datang dengan pemberitahuan resmi. Untuk saat ini, tarif V4 Pro yang tercantum tetap pada level pratinjau, dan harga rata-rata yang dibayarkan melalui OpenRouter jauh di bawah harga daftar $0,435, yang OpenRouter atribusikan pada caching dan diskon.
DeepSeek telah menghabiskan setahun terakhir membangun ke luar dari model itu sendiri: seri V4 dilatih di sekitar beban kerja agen (asisten pengkodean, otomatisasi multi-langkah, sintesis dokumen panjang) yang pengumuman pratinjau April menyatakan sudah mengarahkan pengembangan internal perusahaan. Lab bobot terbuka Tiongkok telah mengirimkan model kelas andalan pada frekuensi hampir bulanan, dari Kimi K3 Moonshot hingga M2.7 MiniMax yang berfokus pada agen, dan GA V4 Pro adalah upaya DeepSeek untuk menjaga model andalannya di depan paket itu.
Apa yang Akan Dikirim Selanjutnya
Item terbuka adalah bobot baru. Repositori Hugging Face masih menyimpan build pratinjau April, dan tabel unduhan kartu model menunjuk ke artefak tersebut; DeepSeek belum mengumumkan timeline untuk menerbitkan bobot 0813 atau menyatakan apakah build GA berbeda dari pratinjau melampaui pasca-pelatihan. Sikap perusahaan yang dinyatakan untuk garis V4, menurut catatan perubahan, berjalan melalui API terlebih dahulu.
Di sisi komersial, pemberitahuan di halaman harga mengikat DeepSeek untuk mengumumkan rencana harga yang direvisi secara resmi, dengan kenaikan yang berlaku untuk layanan API. Sampai pemberitahuan itu tiba, deepseek-v4-pro terus melayani build 0813 pada tarif yang dipublikasikan pada 12 Agustus 2026 — $0,435 masuk, $0,87 keluar, per juta token, pada satu juta token konteks.












