Mô hình và nền tảng AI
DeepSeek Ra Mắt V4 Pro Là Mẫu Mới Của Họ

DeepSeek đã phát hành phiên bản sản xuất của mẫu đầu tàu của mình, DeepSeek V4 Pro, kết thúc giai đoạn xem trước kéo dài gần bốn tháng. Bản build, được chỉ định là V4 Pro 0813, đã xuất hiện vào ngày 12 tháng 8 năm 2026, như là bản phát hành chung trên trang mô hình của OpenRouter, và tài liệu API của DeepSeek hiện liệt kê DeepSeek-V4-Pro-0813 là phiên bản mô hình đằng sau điểm cuối deepseek-v4-pro.
Kinh tế API được chuyển từ giai đoạn xem trước: 0,435 đô la mỗi triệu token đầu vào khi bỏ lỡ bộ nhớ cache, 0,003625 đô la mỗi triệu trên một lần đánh dấu, và 0,87 đô la mỗi triệu token đầu ra, với một cửa sổ ngữ cảnh một triệu token và đầu ra tối đa 384.000 token. Trang giá của DeepSeek xác nhận chuỗi phiên bản 0813, giá và giới hạn đồng thời 500 cho điểm cuối Pro so với 2.500 cho Flash.
GA đánh dấu kết thúc của một quá trình phát hành công khai mà DeepSeek đã thực hiện từ mùa xuân. Công ty đã xem trước loạt V4 vào ngày 24 tháng 4 năm 2026, vận chuyển trọng lượng mở cho cả Pro và Flash dưới giấy phép MIT cùng với truy cập API. Vào ngày 31 tháng 7 năm 2026, nó đã nâng cấp mô hình Flash nhỏ hơn lên trạng thái chính thức và nói trong nhật ký thay đổi rằng việc phát hành chính thức của Pro “sẽ theo sau sớm”. Đó là những gì đã hạ cánh với bản build 0813.
Điều Gì 0813 Build Đặt Trên
V4 Pro là một hệ thống hỗn hợp của các chuyên gia với 1,6 nghìn tỷ tham số tổng và 49 tỷ hoạt động trên mỗi token, theo thẻ mô hình trên Hugging Face. Kiến trúc kết hợp hai biến thể chú ý mà DeepSeek gọi là Chú ý nén và Chú ý nén nặng, mà công ty nói cắt giảm tính toán suy luận đơn token xuống 27% và bộ nhớ cache KV xuống 10% so với những gì cần thiết cho V3.2 tại cài đặt một triệu token. Cả hai mô hình V4 đều được đào tạo trước trên hơn 32 nghìn tỷ token, với đào tạo sau đó phát triển các chuyên gia riêng biệt theo từng lĩnh vực và sau đó hợp nhất chúng thành một mô hình thông qua sự phân hủy chính sách.
Trọng lượng mở cho các bản xem trước đã có thể tải xuống kể từ tháng 4, và kho lưu trữ Pro đã ghi nhận hơn 1,4 triệu lượt tải xuống trong tháng qua trên Hugging Face. Thẻ khuyến nghị một cửa sổ ngữ cảnh ít nhất 384.000 token khi chạy mô hình ở chế độ suy luận tối đa cục bộ.
Số Liệu DeepSeek Đặt Ra
Các yêu cầu đánh giá tiêu đề là báo cáo của nhà cung cấp, từ thẻ mô hình và các cuộc chạy kiểm tra của công ty. Ở nỗ lực suy luận tối đa, mà DeepSeek gọi là V4-Pro-Max, thẻ báo cáo:
- SWE-bench Xác minh: 80,6% giải quyết
- Terminal Bench 2.0: 67,9% độ chính xác
- GPQA Diamond: 90,1% vượt qua@1
- Humanity’s Last Exam: 37,7% vượt qua@1
- MMLU-Pro: 87,5%
- LiveCodeBench: 93,5% vượt qua@1
- Codeforces xếp hạng: 3.206
- MRCR ở một triệu token: 83,5 MMR
Bảng so sánh trên thẻ đặt những điểm số đó so với các hệ thống tiền phong có tên: V4-Pro-Max tụt lại sau GPT-5.4 ở nỗ lực xHigh trên Terminal Bench 2.0 (67,9 so với 75,1) và Gemini-3.1-Pro trên Humanity’s Last Exam (37,7 so với 44,4), trong khi đăng bài điểm số hàng đầu LiveCodeBench và Apex Shortlist. Trên SWE-bench Xác minh, nó đạt 80,6, ngang bằng với Gemini-3.1-Pro và một phần nhỏ sau Claude Opus 4.6 ở 80,8. Không có cột nào trong số này đã được nhân rộng bởi một người đánh giá độc lập cho bản build 0813.
API暴露 ba chế độ hoạt động (không suy nghĩ, nỗ lực suy luận cao và nỗ lực tối đa mà tài liệu mô tả là “đẩy ranh giới khả năng suy luận của mô hình”) và hỗ trợ định dạng ChatCompletions của OpenAI, định dạng Messages của Anthropic và API Responses của DeepSeek, với cuộc gọi công cụ và đầu ra JSON trên cả Pro và Flash.
Làm Thế Nào DeepSeek Đã Đến Được Đâu
GA Pro hoàn thành nửa sau của chiến lược phát hành mà đặt mô hình rẻ hơn lên trước. Khi V4-Flash trở thành chính thức vào ngày 31 tháng 7 năm 2026, DeepSeek đã xuất bản kết quả benchmark của tác nhân, cho thấy bản build Flash được đào tạo lại vượt qua V4-Pro-Preview trên các bộ đồ mã hóa nội bộ, một động thái cố ý khiến mô hình nhỏ trở thành mặc định cho các tác vụ của tác nhân trong khi mô hình đầu tàu vẫn còn trong giai đoạn xem trước. Bản build 0813 là câu trả lời của mô hình đầu tàu, và nó đến với cửa sổ ngữ cảnh, trần đầu ra và bộ tính năng của điểm cuối Pro không đổi về tên. Thay đổi là nhãn xem trước đã biến mất.
Thái độ định giá đáng được chú ý. Một thông báo trên trang giá của DeepSeek nói rằng công ty dự định “tăng đáng kể” giá API tổng thể trong tương lai gần, với chi tiết sẽ được thông báo chính thức. Cho đến khi thông báo đó đến, tỷ giá V4 Pro được liệt kê vẫn giữ ở mức xem trước, và giá trung bình thực tế được trả qua OpenRouter nằm dưới mức giá danh sách 0,435 đô la, mà OpenRouter cho là do bộ nhớ cache và giảm giá.
DeepSeek đã dành cả năm qua để xây dựng ra ngoài mô hình: loạt V4 được đào tạo xung quanh các tác vụ của tác nhân (trợ lý mã hóa, tự động hóa nhiều bước, tổng hợp tài liệu dài) mà thông báo xem trước vào tháng 4 nói đã thúc đẩy sự phát triển nội bộ của công ty. Các phòng thí nghiệm trọng lượng mở của Trung Quốc đã vận chuyển các mô hình đầu tàu lớp mỗi tháng, từ Kimi K3 của Moonshot đến M2.7 của MiniMax, và GA V4 Pro là nỗ lực của DeepSeek để giữ mô hình đầu tàu của mình ở đầu gói đó.
Điều Gì Đánh Thể Là Tiếp Theo
Mục mở là trọng lượng mới. Kho lưu trữ Hugging Face vẫn lưu trữ các bản xem trước tháng 4, và bảng tải xuống của thẻ mô hình trỏ đến các artifact đó; DeepSeek chưa thông báo thời gian biểu cho việc xuất bản trọng lượng 0813 hay nói liệu bản build GA có khác với bản xem trước ngoài đào tạo sau.
Trên mặt thương mại, thông báo trên trang giá cam kết DeepSeek với thông báo chính thức về kế hoạch giá sửa đổi của mình, với việc tăng áp dụng trên các dịch vụ API. Cho đến khi thông báo đó đến, deepseek-v4-pro tiếp tục phục vụ bản build 0813 với tỷ giá được xuất bản vào ngày 12 tháng 8 năm 2026 — 0,435 đô la vào, 0,87 đô la ra, mỗi triệu token, với một triệu token ngữ cảnh.












