AI 模型与平台
DeepSeek 发布 V4 Pro 作为其旗舰模型离开预览

DeepSeek 已发布其旗舰模型 DeepSeek V4 Pro 的生产版本,结束了近四个月的预览期。该版本,指定为 V4 Pro 0813,于 2026 年 8 月 12 日出现在 OpenRouter 的模型页面 上,并且 DeepSeek 自己的 API 文档 现在列出了 DeepSeek-V4-Pro-0813 作为 deepseek-v4-pro 端点的模型版本。
API 经济学继承自预览:每百万个输入令牌的缓存未命中为 0.435 美元,每百万个缓存命中为 0.003625 美元,每百万个输出令牌为 0.87 美元,具有一个百万令牌的上下文窗口和 384,000 个令牌的最大输出。DeepSeek 的第一方价格页面确认了 0813 版本字符串、价格和 Pro 端点的并发限制为 500,而 Flash 为 2,500。
GA 完成了 DeepSeek 自春季以来公开运行的分阶段推出计划的一半。当 V4-Flash 于 2026 年 7 月 31 日正式发布时,DeepSeek 发布了代理基准测试结果,显示重新发布的 Flash 构建在其内部编码代理套件上超过了 V4-Pro-Preview,这是故意使小型模型成为代理工作负载的默认值,而旗舰模型仍然处于预览状态。0813 版本是旗舰模型的答案,它带来了 Pro 端点的上下文窗口、输出上限和功能集,名称保持不变。变化是预览标签消失了。
0813 版本的基础
V4 Pro 是一个混合专家系统,具有 1.6 万亿个参数和每个令牌 490 亿个活动参数,根据 Hugging Face 上的模型卡。该架构结合了两种注意力变体,DeepSeek 称为压缩稀疏注意力和重度压缩注意力,该公司声称将单个令牌推理计算减少到 27%,KV 缓存减少到 10%,与 V3.2 生成在百万令牌设置时相比。两个 V4 模型都在超过 32 万亿个令牌上进行了预训练,后期训练单独生长领域专家,然后通过策略蒸馏将它们合并为一个模型。
自四月以来,预览版本的开源权重就可以下载了,Pro 仓库在 Hugging Face 上的过去一个月内记录了超过 140 万次下载。该卡建议在本地运行模型的最大推理模式时,至少使用 384,000 个令牌的上下文窗口。
DeepSeek 提出的数字
头条评估声明是供应商报告的,从模型卡和公司自己的套件运行中得出。在其最大推理努力下,DeepSeek 标记为 V4-Pro-Max,卡报告:
- SWE-bench Verified:80.6% 解决
- Terminal Bench 2.0:67.9% 准确率
- GPQA Diamond:90.1% 通过@1
- Humanity’s Last Exam:37.7% 通过@1
- MMLU-Pro:87.5%
- LiveCodeBench:93.5% 通过@1
- Codeforces 评分:3,206
- MRCR 在 100 万令牌时:83.5 MMR
卡片自己的比较表格将这些分数与命名的前沿系统进行比较:V4-Pro-Max 在 Terminal Bench 2.0 上的 xHigh 努力跟随 GPT-5.4(67.9 到 75.1),在 Humanity’s Last Exam 上跟随 Gemini-3.1-Pro(37.7 到 44.4),同时发布表格的最高 LiveCodeBench 和 Apex Shortlist 分数。在 SWE-bench Verified 上,它以 80.6 的分数与 Gemini-3.1-Pro 持平,略低于 Claude Opus 4.6 的 80.8 分。这些列尚未被独立评估者复制用于 0813 版本。
API 公开了三个操作模式(非思考、一个高推理努力和一个最大努力,文档将其描述为“推动模型推理能力的边界”),并支持 OpenAI ChatCompletions 格式、Anthropic Messages 格式和 DeepSeek 自己的 Responses API,具有工具调用和 JSON 输出,适用于 Pro 和 Flash。
DeepSeek 如何走到这一步
Pro GA 完成了 DeepSeek 的发布策略的第二半部分,该策略首先发布了更便宜的模型。当 V4-Flash 于 2026 年 7 月 31 日正式发布时,DeepSeek 发布了代理基准测试结果,显示重新发布的 Flash 构建在其内部编码代理套件上超过了 V4-Pro-Preview,这是故意使小型模型成为代理工作负载的默认值,而旗舰模型仍然处于预览状态。0813 版本是旗舰模型的答案,它带来了 Pro 端点的上下文窗口、输出上限和功能集,名称保持不变。变化是预览标签消失了。
价格姿态值得关注。DeepSeek 的价格页面上有一条通知,称公司计划“在近期内显著增加”整体 API 定价,具体细节将通过官方通知公布。目前,列出的 V4 Pro 费率保持在预览级别,平均通过 OpenRouter 支付的价格远低于 0.435 美元的列出价格,这是 OpenRouter 将缓存和折扣归因于的原因。
DeepSeek 在过去一年中一直在模型本身以外进行扩展:V4 系列是围绕公司自己的内部开发已经驱动的代理工作负载(编码助手、多步骤自动化、长文档合成)进行训练的。中国开源实验室一直以每月的频率发布旗舰级模型,从 Moonshot 的 Kimi K3 到 MiniMax 的代理专注的 M2.7,V4 Pro 的 GA 是 DeepSeek 保持其旗舰在该包的前沿的尝试。
接下来会发生什么
开放的项目是新的权重。Hugging Face 仓库仍然托管着四月份的预览版本,模型卡的下载表指向这些工件;DeepSeek 尚未宣布发布 0813 权重的时间表,也没有说明 GA 版本是否在后期训练之外与预览版本有所不同。公司针对 V4 线的声明节奏,根据其更改日志,首先通过 API 运行。
在商业方面,价格页面上的通知承诺 DeepSeek 将在近期内正式宣布其修订的价格计划,价格上涨将适用于所有 API 服务。直到该通知发布之前,deepseek-v4-pro 将继续以 2026 年 8 月 12 日发布的费率为 0813 版本提供服务 —— 每百万令牌 0.435 美元输入,0.87 美元输出,一个百万令牌的上下文窗口。












