DeepSeek V4 Pro 正式版上线:2%的价格追平顶尖性能

DeepSeek V4 Pro 0813 正式版上线,1.6万亿参数 MoE,490亿激活,100万上下文,定价仅为 Claude Fable 5 的2%。

昨晚刷 DeepSeek 的 API 定价页,发现一个细微变化:deepseek-v4-pro 后面的版本号从 preview 变成了 DeepSeek-V4-Pro-0813。没有公众号推文,没有技术博客,没有发布会。就这么悄悄转正了。

这意味着从 2026 年 4 月就开始以预览版身份运行的旗舰模型,正式进入生产就绪状态。

DeepSeek API 定价页面显示 V4 Pro 0813 正式版 DeepSeek API 定价页面——deepseek-v4-pro 版本号已更新为 0813。

规格一览

参数数值
总参数量1.6 万亿(1,600B)
每 token 激活参数490 亿(49B)
架构MoE(混合专家)
上下文窗口100 万 token
最大输出38.4 万 token
并发限制500
许可证MIT
API 格式OpenAI + Anthropic 双格式

这个规模放在全世界 AI 模型里属于第一梯队。此前所有第三方测试跑的都是预览版本,预览版在 HuggingFace 上已被下载超过 140 万次。

价格:Claude Fable 5 的 2%

正式版价格与此前非高峰时段价格一致——也就是 5 月份永久降价后的标准价格。

计价项DeepSeek V4 ProClaude Fable 5差距
输入(/1M tokens)$0.435$10.004.35%
输出(/1M tokens)$0.87$50.001.74%
缓存命中输入$0.003625

按输出算,不到 Fable 5 的 2%。整整两个数量级的差距。

单任务成本差距更加夸张。有机构测试过,Claude Fable 5 完成一个基准任务花费 $3.15,DeepSeek V4 Flash 只需 $0.03——100 倍的差距。V4 Pro 0813 的单任务成本还没有第三方测过,但定价体系没变,情况应该类似。

为什么能这么便宜

主要和架构设计有关。DeepSeek V4 Pro 使用了两种注意力变体:

  1. 压缩稀疏注意力(Compressed Sparse Attention)
  2. 重度压缩注意力(Heavy Compressed Attention)

按 DeepSeek 的说法,这套架构把单 token 推理计算量降到 V3.2 代的 27%,KV 缓存降到原来的 10%。对 100 万 token 的长上下文来说,能省的成本非常可观。推理效率高了,定价空间自然就出来了。

DeepSeek 官网 DeepSeek 官网——低调地没有任何发布会或公告。

性能:和 Fable 5 打得有来有回

DeepSeek 在自家评测中做了 10 个 Agent 基准和 Claude Fable 5 的对比。去掉差距最大的一项(Humanity’s Last Exam,落后 10.6 个百分点)之后,剩下 9 项平均只落后 2.8%,有 2 项 DeepSeek 还赢了。

但得说清楚:这些数据是 DeepSeek 自己测的,评测框架没有对外开放,测试集也没有公开榜单可以验证。0813 版本的真实表现,得等第三方机构测完才知道。

三个推理模式

V4 Pro 在 API 里开放了三个模式:

模式说明适用场景
普通模式标准推理日常对话、简单任务
高推理模式增强 Chain-of-Thought复杂推理、代码生成
最高推理模式推到模型能力边界数学、长链推理、Agent

API 同时支持 OpenAI 和 Anthropic 两种接口格式。之前在这两个生态里开发的开发者无需改代码就能切过来。支持工具调用、结构化 JSON 输出。

V4 系列产品矩阵

正式版上线后,DeepSeek V4 的产品结构清晰了:

模型定位输入价格输出价格
V4 Flash 0731高频高并发,便宜$0.14/M$0.28/M
V4 Pro 0813复杂推理、长上下文、Agent$0.435/M$0.87/M

Flash 负责跑量,Pro 负责跑质。不少做 AI 应用的团队已经在搭配使用。

几个值得注意的点

涨价预警:定价页面写着”近期会有一次显著的价格调整”,具体涨多少还没公布。当前低价窗口能开多久不好说。

算力:创始人梁文锋披露过,DeepSeek 目前约 2 万张 H100 等效算力。和海外大厂几十万卡集群比不在一个量级,但在动态采购中。另外已经拿到 16000 张昇腾 950 做软件生态验证。

权重:MIT 许可证,但正式版权重还没放出来。按 V4 Flash “API 先跑、权重随后跟上”的节奏,应该只是时间问题。

Artificial Analysis 模型评测排行榜 第三方评测机构正在排队测 V4 Pro 0813,数据出来才能看清真实提升幅度。

对开发者意味着什么

如果你在做 AI Agent 或者需要长上下文处理:

  1. 成本可以降两个数量级——从 Fable 5 切到 V4 Pro,同样的任务成本从美元级降到美分级
  2. 无需改代码——支持 OpenAI 和 Anthropic 两种 API 格式
  3. Flash + Pro 搭配——简单任务走 Flash($0.28),复杂任务走 Pro($0.87),整体成本极低
  4. 等第三方验证——自测数据好看,但生产环境上之前最好等独立评测出来

参考资料:DeepSeek API 定价

常见问题

V4 Pro 和 V4 Flash 怎么选?

Flash 适合高频调用、对延迟敏感的场景(聊天、补全、简单 QA);Pro 适合需要深度推理的场景(数学、代码生成、Agent 多步任务、长文档处理)。

正式版和预览版有什么区别?

版本号从 preview 改为 0813,意味着 DeepSeek 认为模型已经达到生产就绪状态。具体能力差异需要等第三方测完才能量化。

真的只要 Fable 5 的 2% 价格?

按输出价格算,$0.87 vs $50.00 = 1.74%。但要注意 DeepSeek 提示即将涨价。

国内开发者怎么接入?

直接调用 https://api.deepseek.com,支持 OpenAI SDK 格式。也可以通过 SandBase 等聚合平台统一接入。

权重什么时候放出来?

官方没说具体时间,但 MIT 许可 + Flash 权重已放的先例来看,应该不会太久。