DeepSeek V4.1 Flash vs V4 Pro:便宜多少,还要留旧版吗?

DeepSeek V4.1 Flash vs V4 Pro 怎么选?对照官方 API 价格、图片输入与 9 月 14 日退役安排,算清同一批任务的费用,并解释旧版 Flash 名称为什么已经不能锁定旧模型。

配置里的 deepseek-v4-flash 没改,回答问题的模型却已经换了。讨论 DeepSeek V4.1 Flash vs V4 Pro,得先弄清这件事:截至 2026 年 9 月 10 日,官方文档明确说明,旧版 Flash 已经退役,旧名称仍能调用,但请求实际由 V4.1 Flash 处理。

对正在维护客服助手、文档提取或代码工具的开发者,新版的吸引力很实在:官方单价更低,还能接收图片。不过,“旧接口还能用”和“旧模型还在”是两回事。升级要不要做,与新旧对比还能不能做,不能混成一个问题。

DeepSeek V4.1 Flash vs V4 Pro,先说结论

  • 新项目值得优先评估 V4.1 Flash:价格和图片输入有明确优势,但不能据此断言每道题都比 Pro 答得好。
  • 官方高峰价下,Flash 的未缓存输入为每百万 token 0.30 美元,输出为 1.20 美元;Pro 分别为 1.32 和 3.96 美元。
  • 两者都列出 1M 上下文和最高 384K 输出,这不是新版独有的升级点。
  • 官方计划从北京时间 9 月 14 日 12 点起,把 Pro 请求转到 V4.1 Flash,直至 V4.1 Pro 发布。旧 Flash 名称已经完成切换。

旧名称还在,旧模型已经不在了

官方价格页最值得读的,其实是表格下面的脚注。它把“请求里填什么”和“背后由谁回答”分得很清楚。

官方 API 名称9 月 10 日文档所列状态
deepseek-flash当前推荐名称,实际为 V4.1 Flash
deepseek-v4-flash旧模型已退役,请求转到 V4.1 Flash
deepseek-v4-flash-vision-exp实验版已退役,同样转到 V4.1 Flash
deepseek-v4-pro当前列为 V4 Pro 0813,计划 9 月 14 日切换

DeepSeek 官方脚注说明旧 Flash 名称的转向及 V4 Pro 的退役时间 旧 Flash 名称已经指向新版;Pro 的转向安排另有明确日期。脚注同时说明了高峰计费时段。

现在给两个 Flash 名称各发一道题,再把答案排成“新旧实测”,可能只是在比较同一模型两次生成的差异。真正的历史对照,需要升级前保存的输出、日期和请求设置,或者能够确认版本的独立部署。

Pro 还有一个短暂的对照窗口。过了官方计划的切换时间,读者照抄同一个名称,也未必能复现同一个对手。站内此前的Flash 内测与 Harness 观察记录的是发布前的信息;当前型号、上下文与退役安排,应以这次正式文档为准。

便宜多少,把一批任务算完就知道

官方把费用分为缓存命中输入、未命中输入和输出。缓存命中,是重复输入被服务端复用后按较低单价收费,不等于历史对话免费。token 则是模型处理和计费的单位,不能直接当成字数。

下表单位为美元/百万 token,均取高峰价,非高峰减半。

计费项目V4.1 FlashV4 Pro 0813
输入:缓存命中0.0060.044
输入:缓存未命中0.301.32
输出1.203.96

DeepSeek 官方表格对照 V4.1 Flash 与 V4 Pro 的价格、视觉能力及上下文 输入、输出和缓存分别计价;两者上下文相同,视觉支持不同。

假设一批文档用了 100 万个未缓存输入 token,产生 20 万个输出 token。Flash 的费用是 0.30+0.2×1.20=0.54 美元;Pro 是 1.32+0.2×3.96=2.112 美元。相同用量下,前者低约 74.4%。若每天一批、连续 30 天,分别是 16.20 和 63.36 美元。这是按官方单价推算,不是实测账单,也不是 SandBase 报价。

缓存会改变这个比例。仍是上述用量,如果输入全部按缓存命中收费,费用变成 0.246 和 0.836 美元,差距约为 70.6%。实际预算必须看返回的用量,不能假定重复提示词一定全部命中缓存。

更不能直接把“单价便宜”写成“业务省了这么多钱”。新版若输出更长、重试更多,总量会变;如果一次就答对,也可能进一步省下费用。真正值得比较的是完成同一件事的总账。

时间同样影响价格。官方高峰为工作日 UTC 01:00–04:00、06:00–10:00,换算成北京时间是 09:00–12:00、14:00–18:00。夜间报表可以考虑错峰,在线客服却不能让客户等到晚上。

能看图片,不等于能读清一整页小字

V4.1 Flash 支持图片输入,当前表中的 Pro 不支持,这是最直接的能力差异。工具调用、JSON 输出、Responses 和 Anthropic 兼容接口,两者都有,不能单独算作新版优势。

例如售后工单里有一张报错截图。过去用文本模型,可能要先做 OCR,也就是识别图片文字,再把文字交给模型;现在可以把截图与问题一起发送,让模型同时参考页面位置。但识别得准不准,仍是另一件事。

视觉文档支持 JPEG、PNG、GIF 和 WebP,并明确写出:detail: low 会先把图片缩到 512×512。拿一张满屏小字的财报测试阅读能力,却用了这个选项,结果就混入了缩图损失。

DeepSeek 视觉文档列出 detail 设置、图片缩放和每张 1024 token 上限 低细节模式先缩图;选择 original 后,大图仍受后续推理缩放规则约束。

original 也不是“无限原图阅读”。较大图片会保持比例,缩到总像素数约等于 1300×1300 的规模,每张图片最多计 1024 个图片 token。一整页长截图即使源文件很清晰,进入模型后,小字也可能变得难以辨认。

因此,财报更值得比较的是整页输入与分区裁剪:裁出清晰表格,同时保留表头、单位和注释。多张裁图会分别计费,这不是免费增加细节;也不能在没测之前,宣称裁剪一定提高准确率。

对原本把文字识别和分析拆成两步的应用,Flash 提供了简化的可能。对只处理文本的代码工具,视觉价值没那么大,输出格式和代码是否正确仍是主线。

Pro 值得留下的是对照答案,不是名字

DeepSeek 表示,内部测试中 V4.1 Flash 在性能、成本、速度和总耗时上超过 V4 Pro。这是厂商的判断;价格页没有提供可复现的逐题记录,不能代替某个代码库或文档集上的比较。

已有应用保留旧版的合理理由,是它已经积累了一批验收过的结果。比如必须输出固定字段的代码审查工具,或者总在金额单位上出错的发票提取任务。把这些材料和正确答案留下来,才知道替换之后哪里真的变好了。

但官方托管 API 的退役安排,限制了这个对照能保留多久。确实需要锁定版本,就要向服务商确认明确的版本承诺,不能只看配置里写着“Pro”。通过 SandBase 调用的读者,可以核对具体的 V4 Pro 模型页;官方切换时间和价格不能直接套用到这条路由,V4.1 Flash 的接入状态也需另行确认。

例如发票提取,旧答案里最有价值的不是一段漂亮解释,而是税额、币种和含税总价是否填对。换版后应检查相同字段,再计算完成这些任务用了多少 token。若只比较回答长短,既看不出漏掉了哪个字段,也很难判断省下的钱是否值得。

新项目先评估 Flash,理由已经足够具体。旧项目要保留的是难题、正确答案和版本日期。只把旧名称留在配置里,并不能让底层模型停止变化。

FAQ

V4.1 Flash 比 V4 Pro 便宜多少?

按官方高峰价,未缓存输入为每百万 token 0.30 对 1.32 美元,输出为 1.20 对 3.96 美元。本文同量文档示例便宜约 74.4%,实际比例随输入、输出和缓存占比变化。

继续填旧 Flash 名称,可以不升级吗?

不可以。deepseek-v4-flash 和视觉实验版旧名都已转向 V4.1 Flash。名称兼容意味着请求仍被接受,不意味着旧模型仍被保留。

V4 Pro 什么时候停止按旧版提供服务?

官方计划从 2026 年 9 月 14 日北京时间 12 点起转向 V4.1 Flash,直至 V4.1 Pro 发布。其他平台是否同期切换,需要分别确认。

V4.1 Flash 的上下文比 Pro 更长吗?

当前表格没有这个差别:两者都为 1M,上限输出都为 384K。规格能容纳更多材料,也不等于能准确利用全部内容;图片中的小字还受视觉缩放规则影响。