DeepSeek V4 Pro 正式版上线:2%的价格追平顶尖性能
DeepSeek V4 Pro 0813 正式版上线,1.6万亿参数 MoE,490亿激活,100万上下文,定价仅为 Claude Fable 5 的2%。
昨晚刷 DeepSeek 的 API 定价页,发现一个细微变化:deepseek-v4-pro 后面的版本号从 preview 变成了 DeepSeek-V4-Pro-0813。没有公众号推文,没有技术博客,没有发布会。就这么悄悄转正了。
这意味着从 2026 年 4 月就开始以预览版身份运行的旗舰模型,正式进入生产就绪状态。
DeepSeek API 定价页面——deepseek-v4-pro 版本号已更新为 0813。
规格一览
| 参数 | 数值 |
|---|---|
| 总参数量 | 1.6 万亿(1,600B) |
| 每 token 激活参数 | 490 亿(49B) |
| 架构 | MoE(混合专家) |
| 上下文窗口 | 100 万 token |
| 最大输出 | 38.4 万 token |
| 并发限制 | 500 |
| 许可证 | MIT |
| API 格式 | OpenAI + Anthropic 双格式 |
这个规模放在全世界 AI 模型里属于第一梯队。此前所有第三方测试跑的都是预览版本,预览版在 HuggingFace 上已被下载超过 140 万次。
价格:Claude Fable 5 的 2%
正式版价格与此前非高峰时段价格一致——也就是 5 月份永久降价后的标准价格。
| 计价项 | DeepSeek V4 Pro | Claude Fable 5 | 差距 |
|---|---|---|---|
| 输入(/1M tokens) | $0.435 | $10.00 | 4.35% |
| 输出(/1M tokens) | $0.87 | $50.00 | 1.74% |
| 缓存命中输入 | $0.003625 | — | — |
按输出算,不到 Fable 5 的 2%。整整两个数量级的差距。
单任务成本差距更加夸张。有机构测试过,Claude Fable 5 完成一个基准任务花费 $3.15,DeepSeek V4 Flash 只需 $0.03——100 倍的差距。V4 Pro 0813 的单任务成本还没有第三方测过,但定价体系没变,情况应该类似。
为什么能这么便宜
主要和架构设计有关。DeepSeek V4 Pro 使用了两种注意力变体:
- 压缩稀疏注意力(Compressed Sparse Attention)
- 重度压缩注意力(Heavy Compressed Attention)
按 DeepSeek 的说法,这套架构把单 token 推理计算量降到 V3.2 代的 27%,KV 缓存降到原来的 10%。对 100 万 token 的长上下文来说,能省的成本非常可观。推理效率高了,定价空间自然就出来了。
DeepSeek 官网——低调地没有任何发布会或公告。
性能:和 Fable 5 打得有来有回
DeepSeek 在自家评测中做了 10 个 Agent 基准和 Claude Fable 5 的对比。去掉差距最大的一项(Humanity’s Last Exam,落后 10.6 个百分点)之后,剩下 9 项平均只落后 2.8%,有 2 项 DeepSeek 还赢了。
但得说清楚:这些数据是 DeepSeek 自己测的,评测框架没有对外开放,测试集也没有公开榜单可以验证。0813 版本的真实表现,得等第三方机构测完才知道。
三个推理模式
V4 Pro 在 API 里开放了三个模式:
| 模式 | 说明 | 适用场景 |
|---|---|---|
| 普通模式 | 标准推理 | 日常对话、简单任务 |
| 高推理模式 | 增强 Chain-of-Thought | 复杂推理、代码生成 |
| 最高推理模式 | 推到模型能力边界 | 数学、长链推理、Agent |
API 同时支持 OpenAI 和 Anthropic 两种接口格式。之前在这两个生态里开发的开发者无需改代码就能切过来。支持工具调用、结构化 JSON 输出。
V4 系列产品矩阵
正式版上线后,DeepSeek V4 的产品结构清晰了:
| 模型 | 定位 | 输入价格 | 输出价格 |
|---|---|---|---|
| V4 Flash 0731 | 高频高并发,便宜 | $0.14/M | $0.28/M |
| V4 Pro 0813 | 复杂推理、长上下文、Agent | $0.435/M | $0.87/M |
Flash 负责跑量,Pro 负责跑质。不少做 AI 应用的团队已经在搭配使用。
几个值得注意的点
涨价预警:定价页面写着”近期会有一次显著的价格调整”,具体涨多少还没公布。当前低价窗口能开多久不好说。
算力:创始人梁文锋披露过,DeepSeek 目前约 2 万张 H100 等效算力。和海外大厂几十万卡集群比不在一个量级,但在动态采购中。另外已经拿到 16000 张昇腾 950 做软件生态验证。
权重:MIT 许可证,但正式版权重还没放出来。按 V4 Flash “API 先跑、权重随后跟上”的节奏,应该只是时间问题。
第三方评测机构正在排队测 V4 Pro 0813,数据出来才能看清真实提升幅度。
对开发者意味着什么
如果你在做 AI Agent 或者需要长上下文处理:
- 成本可以降两个数量级——从 Fable 5 切到 V4 Pro,同样的任务成本从美元级降到美分级
- 无需改代码——支持 OpenAI 和 Anthropic 两种 API 格式
- Flash + Pro 搭配——简单任务走 Flash($0.28),复杂任务走 Pro($0.87),整体成本极低
- 等第三方验证——自测数据好看,但生产环境上之前最好等独立评测出来
参考资料:DeepSeek API 定价
常见问题
V4 Pro 和 V4 Flash 怎么选?
Flash 适合高频调用、对延迟敏感的场景(聊天、补全、简单 QA);Pro 适合需要深度推理的场景(数学、代码生成、Agent 多步任务、长文档处理)。
正式版和预览版有什么区别?
版本号从 preview 改为 0813,意味着 DeepSeek 认为模型已经达到生产就绪状态。具体能力差异需要等第三方测完才能量化。
真的只要 Fable 5 的 2% 价格?
按输出价格算,$0.87 vs $50.00 = 1.74%。但要注意 DeepSeek 提示即将涨价。
国内开发者怎么接入?
直接调用 https://api.deepseek.com,支持 OpenAI SDK 格式。也可以通过 SandBase 等聚合平台统一接入。
权重什么时候放出来?
官方没说具体时间,但 MIT 许可 + Flash 权重已放的先例来看,应该不会太久。


