DeepSeek V4.1 Flash vs V4 Pro:便宜多少,还要留旧版吗?
DeepSeek V4.1 Flash vs V4 Pro 怎么选?对照官方 API 价格、图片输入与 9 月 14 日退役安排,算清同一批任务的费用,并解释旧版 Flash 名称为什么已经不能锁定旧模型。
配置里的 deepseek-v4-flash 没改,回答问题的模型却已经换了。讨论 DeepSeek V4.1 Flash vs V4 Pro,得先弄清这件事:截至 2026 年 9 月 10 日,官方文档明确说明,旧版 Flash 已经退役,旧名称仍能调用,但请求实际由 V4.1 Flash 处理。
对正在维护客服助手、文档提取或代码工具的开发者,新版的吸引力很实在:官方单价更低,还能接收图片。不过,“旧接口还能用”和“旧模型还在”是两回事。升级要不要做,与新旧对比还能不能做,不能混成一个问题。
DeepSeek V4.1 Flash vs V4 Pro,先说结论
- 新项目值得优先评估 V4.1 Flash:价格和图片输入有明确优势,但不能据此断言每道题都比 Pro 答得好。
- 官方高峰价下,Flash 的未缓存输入为每百万 token 0.30 美元,输出为 1.20 美元;Pro 分别为 1.32 和 3.96 美元。
- 两者都列出 1M 上下文和最高 384K 输出,这不是新版独有的升级点。
- 官方计划从北京时间 9 月 14 日 12 点起,把 Pro 请求转到 V4.1 Flash,直至 V4.1 Pro 发布。旧 Flash 名称已经完成切换。
旧名称还在,旧模型已经不在了
官方价格页最值得读的,其实是表格下面的脚注。它把“请求里填什么”和“背后由谁回答”分得很清楚。
| 官方 API 名称 | 9 月 10 日文档所列状态 |
|---|---|
deepseek-flash | 当前推荐名称,实际为 V4.1 Flash |
deepseek-v4-flash | 旧模型已退役,请求转到 V4.1 Flash |
deepseek-v4-flash-vision-exp | 实验版已退役,同样转到 V4.1 Flash |
deepseek-v4-pro | 当前列为 V4 Pro 0813,计划 9 月 14 日切换 |
旧 Flash 名称已经指向新版;Pro 的转向安排另有明确日期。脚注同时说明了高峰计费时段。
现在给两个 Flash 名称各发一道题,再把答案排成“新旧实测”,可能只是在比较同一模型两次生成的差异。真正的历史对照,需要升级前保存的输出、日期和请求设置,或者能够确认版本的独立部署。
Pro 还有一个短暂的对照窗口。过了官方计划的切换时间,读者照抄同一个名称,也未必能复现同一个对手。站内此前的Flash 内测与 Harness 观察记录的是发布前的信息;当前型号、上下文与退役安排,应以这次正式文档为准。
便宜多少,把一批任务算完就知道
官方把费用分为缓存命中输入、未命中输入和输出。缓存命中,是重复输入被服务端复用后按较低单价收费,不等于历史对话免费。token 则是模型处理和计费的单位,不能直接当成字数。
下表单位为美元/百万 token,均取高峰价,非高峰减半。
| 计费项目 | V4.1 Flash | V4 Pro 0813 |
|---|---|---|
| 输入:缓存命中 | 0.006 | 0.044 |
| 输入:缓存未命中 | 0.30 | 1.32 |
| 输出 | 1.20 | 3.96 |
假设一批文档用了 100 万个未缓存输入 token,产生 20 万个输出 token。Flash 的费用是 0.30+0.2×1.20=0.54 美元;Pro 是 1.32+0.2×3.96=2.112 美元。相同用量下,前者低约 74.4%。若每天一批、连续 30 天,分别是 16.20 和 63.36 美元。这是按官方单价推算,不是实测账单,也不是 SandBase 报价。
缓存会改变这个比例。仍是上述用量,如果输入全部按缓存命中收费,费用变成 0.246 和 0.836 美元,差距约为 70.6%。实际预算必须看返回的用量,不能假定重复提示词一定全部命中缓存。
更不能直接把“单价便宜”写成“业务省了这么多钱”。新版若输出更长、重试更多,总量会变;如果一次就答对,也可能进一步省下费用。真正值得比较的是完成同一件事的总账。
时间同样影响价格。官方高峰为工作日 UTC 01:00–04:00、06:00–10:00,换算成北京时间是 09:00–12:00、14:00–18:00。夜间报表可以考虑错峰,在线客服却不能让客户等到晚上。
能看图片,不等于能读清一整页小字
V4.1 Flash 支持图片输入,当前表中的 Pro 不支持,这是最直接的能力差异。工具调用、JSON 输出、Responses 和 Anthropic 兼容接口,两者都有,不能单独算作新版优势。
例如售后工单里有一张报错截图。过去用文本模型,可能要先做 OCR,也就是识别图片文字,再把文字交给模型;现在可以把截图与问题一起发送,让模型同时参考页面位置。但识别得准不准,仍是另一件事。
视觉文档支持 JPEG、PNG、GIF 和 WebP,并明确写出:detail: low 会先把图片缩到 512×512。拿一张满屏小字的财报测试阅读能力,却用了这个选项,结果就混入了缩图损失。
低细节模式先缩图;选择 original 后,大图仍受后续推理缩放规则约束。
original 也不是“无限原图阅读”。较大图片会保持比例,缩到总像素数约等于 1300×1300 的规模,每张图片最多计 1024 个图片 token。一整页长截图即使源文件很清晰,进入模型后,小字也可能变得难以辨认。
因此,财报更值得比较的是整页输入与分区裁剪:裁出清晰表格,同时保留表头、单位和注释。多张裁图会分别计费,这不是免费增加细节;也不能在没测之前,宣称裁剪一定提高准确率。
对原本把文字识别和分析拆成两步的应用,Flash 提供了简化的可能。对只处理文本的代码工具,视觉价值没那么大,输出格式和代码是否正确仍是主线。
Pro 值得留下的是对照答案,不是名字
DeepSeek 表示,内部测试中 V4.1 Flash 在性能、成本、速度和总耗时上超过 V4 Pro。这是厂商的判断;价格页没有提供可复现的逐题记录,不能代替某个代码库或文档集上的比较。
已有应用保留旧版的合理理由,是它已经积累了一批验收过的结果。比如必须输出固定字段的代码审查工具,或者总在金额单位上出错的发票提取任务。把这些材料和正确答案留下来,才知道替换之后哪里真的变好了。
但官方托管 API 的退役安排,限制了这个对照能保留多久。确实需要锁定版本,就要向服务商确认明确的版本承诺,不能只看配置里写着“Pro”。通过 SandBase 调用的读者,可以核对具体的 V4 Pro 模型页;官方切换时间和价格不能直接套用到这条路由,V4.1 Flash 的接入状态也需另行确认。
例如发票提取,旧答案里最有价值的不是一段漂亮解释,而是税额、币种和含税总价是否填对。换版后应检查相同字段,再计算完成这些任务用了多少 token。若只比较回答长短,既看不出漏掉了哪个字段,也很难判断省下的钱是否值得。
新项目先评估 Flash,理由已经足够具体。旧项目要保留的是难题、正确答案和版本日期。只把旧名称留在配置里,并不能让底层模型停止变化。
FAQ
V4.1 Flash 比 V4 Pro 便宜多少?
按官方高峰价,未缓存输入为每百万 token 0.30 对 1.32 美元,输出为 1.20 对 3.96 美元。本文同量文档示例便宜约 74.4%,实际比例随输入、输出和缓存占比变化。
继续填旧 Flash 名称,可以不升级吗?
不可以。deepseek-v4-flash 和视觉实验版旧名都已转向 V4.1 Flash。名称兼容意味着请求仍被接受,不意味着旧模型仍被保留。
V4 Pro 什么时候停止按旧版提供服务?
官方计划从 2026 年 9 月 14 日北京时间 12 点起转向 V4.1 Flash,直至 V4.1 Pro 发布。其他平台是否同期切换,需要分别确认。
V4.1 Flash 的上下文比 Pro 更长吗?
当前表格没有这个差别:两者都为 1M,上限输出都为 384K。规格能容纳更多材料,也不等于能准确利用全部内容;图片中的小字还受视觉缩放规则影响。



