DeepSeek V4.1 Flash 怎么用?内测 API 型号与 Harness 配置

DeepSeek V4.1 Flash 内测消息中的型号是什么,Harness 如何添加,费用、20 并发与多模态哪些尚未确认,以及当前可用的 V4 模型入口。

DeepSeek V4.1 Flash 的内测消息提出了五项升级:新的模型结构、原生多模态、能力更强、速度更快、成本更低。 这些是消息对中间测试版本的描述,尚未获得公开技术报告或对照测试的独立验证。

这次流传的 DeepSeek V4.1 Flash 型号是 deepseek-v4.1-flash-expires-on-0910,但不能据此判断所有账号都能调用。 9 月 8 日流传的一条内测消息将其称为“中间版本”。当天核对的 DeepSeek 官方 API 首页仍列出 V4 Flash、V4 Pro 和 Flash Vision Exp,没有把这个临时型号列入公开说明。

如果你已经用 V4 Flash 跑代码助手,最容易做的事就是把模型名替换掉。问题在于,新名字可能没有对你的账号开放,也可能在短期测试结束后失效。先保留原来的可用配置,另外增加测试项,会比直接替换正在使用的模型省事。

先说结论

  • 素材讲的是 V4.1 Flash 中间版本内测,目前未确认全面正式发布;转发群消息的身份尚未独立核实。
  • 截图给出了完整临时型号,但名称中的 0910 不能单独证明具体截止时刻、时区或后续替代型号。
  • “新架构、原生多模态、能力更强、更快、成本更低”来自转发消息,尚无本次核实到的公开 V4.1 规格或对照测试支持。
  • 当前有公开文档的 V4 Flash、Flash Vision Exp 与这个临时型号不同,不能把它们的能力、价格或接入状态直接搬过来。

这条内测消息到底提供了什么

cxuanAI 在 2026 年 9 月 8 日的报道展示了一条署名“DeepSeek小助手@深度求索”的内测消息。其中关于模型升级的原话是:

DeepSeek V4.1 Flash 的中间版本内测,欢迎试用。采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。

这段描述把关注点从“多了一个临时型号”扩展到架构、输入能力、效果、速度和成本。对于已经使用 V4 Flash 的开发者,值得对照的是原来做不好的任务能否完成、图片能否直接输入,以及相同任务的耗时和账单是否下降;目前消息没有提供这些对照结果。

接入方面,消息称保持 base_url 不变,修改模型名即可调用。

同一条消息还写了“当前计费与 deepseek-v4-flash 相同”“每账号限流 20 并发”。这些数字可以作为消息中的说法引用,但不能当作已核实的公开服务条款。

后面的 Harness 截图展示了新增模型配置,以及模型在对话中自称该版本。前者说明作者填了什么,后者说明助手回答了什么;两张图都不能单独证明后端权重、实际架构或普遍可用性。

读者关心的问题目前能确认到哪一步
流传的型号是什么?截图写明 deepseek-v4.1-flash-expires-on-0910
所有 DeepSeek API 账号都能用吗?尚未确认,需要核对本账号权限
真的是新架构吗?群消息这样描述,未核实到技术细节
支持图片、视频还是音频?尚无该临时型号的已确认输入规格
比 V4 Flash 快多少?没有可比较的测量结果
SandBase 已经接入了吗?本次目录检索没有返回 V4.1 的精确匹配

先分清公开型号和临时型号

DeepSeek 官方 API 首页给出的 OpenAI 兼容地址是 https://api.deepseek.com,公开列出的型号为 deepseek-v4-flashdeepseek-v4-prodeepseek-v4-flash-vision-exp。页面说明,Flash 别名对应 Flash-0731,Pro 别名对应 Pro-0813。

DeepSeek 官方英文 API 首页中的地址与公开模型列表

官方英文首页列出当前公开 API 型号;它和流传的 V4.1 内测消息是两份不同的材料。

官网没有列出,不等于私下测试一定不存在;这个页面尚未记录临时型号。V4.1 的上下文长度、开源许可证和权重下载地址仍未确认,现有 V4 的参数不能证明新版保持相同规格。

今天就要交付的应用,继续使用自己账号已经验证可用的型号。如果要处理图片,明确选择有图片输入文档的接口,不要只看名字里是否带“Flash”。

DeepSeek Harness 怎么添加内测型号

Harness 是管理对话和工具调用的应用,模型服务商才是接收请求的后端。还没安装的读者可以先看官方快速开始。下面的设置路径依据素材里的界面,不能保证不同安装版本的按钮完全相同。

先通过账号的官方通知确认:这个账号是否获准测试,以及应该使用哪个地址和完整型号。 别人账号的截图不能替你确认权限。

  1. 打开 Settings → Models,进入已有的 DeepSeek 服务商设置。
  2. 留存当前配置,保留原来的 V4 Flash 条目,不要把唯一可用的模型覆盖掉。
  3. 在素材展示的自定义模型列表里选择 Add model。只有账号通知确认了同一型号,才把 deepseek-v4.1-flash-expires-on-0910 填入模型 ID。显示名称可以简写,但它不能代替发送给 API 的完整标识。
  4. Base URL 只在与该账号、服务商确认的地址一致时保持不变。“不用改地址”不能推导成任意第三方网关都已经支持内测。
  5. 点击 Apply,明确选中新增模型,另开一段对话,先发一条简短的纯文字请求。

Harness 的 Settings → Models 页面及新增内测模型条目

内测报道中的配置截图展示了 deepseek-official 服务商、Base URL、自定义 Models 列表、Add model 和 Apply。输入框中的临时型号显示不全,完整标识见第 3 步。配置页面不代表已成功调用;点击图片可查看原始尺寸。

手动添加模型时,客户端的输入设置也会影响行为。Harness 服务商指南说明了自定义适配器的纯文字默认值和逐模型图片声明。应按所安装的适配器配置;在客户端声明支持图片,并不会让服务端自动接受图片。

检查请求实际携带的模型名、地址、返回状态,以及服务商提供的模型元数据,日志不要记录密钥。一条成功响应只能证明该账号在当时完成了这次调用,不能证明以后一直可用。若被拒绝,先切回原来能用的型号,再核对权限和测试窗口。

“你的模型是什么”不是可靠的验证方法。模型可能复述提示词或客户端上下文里的名字;即便响应带有 model 字段,也要结合服务商的路由说明理解,不能把它当成对后端权重的独立鉴定。

API 调用失败时,先检查哪一层

官方文档确认了现有服务支持 OpenAI 兼容的 Chat Completions 格式,却没有替私人测试确认每个参数或账号权限。拿到内测说明后,从它要求的最小请求开始,先确认文字调用,再分别增加流式输出、工具调用和图片输入。

不要一次复制带有十几个参数的旧请求,再把所有失败都归结为“新模型不行”。不支持这个型号,与不支持某个参数,是两种不同问题。

保存实际错误码和错误正文,对照官方错误码说明。认证、余额、请求格式、限流和服务端错误,需要分别处理。失败不一定是过期;反复重试也不会自动获得内测资格。

本文未执行 V4.1 调用或测速。获得权限后,按本账号的内测说明发出最小请求,检查真实响应,再加入自己的工作流程。

原生多模态,不等于已经确认所有文件都能传

群消息中的“原生多模态”没有给出图片数量、分辨率、文件格式,也没有说明是否支持视频或音频。架构描述和能照着发送请求的输入格式,不是一回事。

DeepSeek 已有另一份视觉输入文档,对应的是 deepseek-v4-flash-vision-exp。这是有公开图片输入说明的实验型号,名字与 V4.1 临时版不同。

DeepSeek 官方英文 Vision 图片输入文档

这里介绍的是 Flash Vision Exp,不能作为 V4.1 多模态规格或两者行为相同的证据。

例如,现在就需要识别设置面板截图,应先用输入格式已明确的视觉接口。之后拿到 V4.1 权限,再按它确认的格式,用同一张图片做对照。一次图片请求成功,也不能推出音频、视频已经支持。

费用、20 并发和 0910 怎么理解

消息一边说“成本更低”,一边说“当前计费与 V4 Flash 相同”。不能把两句话合成“用户已经降价”:前者可能描述推理实现成本,后者才涉及当时声称的收费方式。具体账单应以测试账号收到的计费说明为准。

DeepSeek 直连价格和第三方网关价格也是两回事。SandBase 上 V4 Flash 的价格,不能证明尚未列出的 V4.1 应该收多少钱。

如果账号确实适用“20 并发”,它指的是同时进行的请求数,不是每秒 20 次。一个尚未结束的请求仍然占用并发位置。先用单请求确认行为,再测试应用需要的并发,不要一开始就把队列打满。

expires-on-0910 看起来是临时测试标识,但仅凭名字无法确定截止时区、到期后是否替换,或 9 月 10 日之后能否继续访问。不要把它写进无人值守的生产任务;保留备用型号,并记录每条结果实际走了哪个配置,避免把回退结果误认成 V4.1 成功。

现在可以进入哪个 SandBase 模型页面

文字、代码和现有 Agent 工作流,可以查看 DeepSeek V4 Flash 模型页。需要识别图片,则查看独立的 DeepSeek V4 Flash Vision Exp 模型页,按该页支持的输入格式配置。

这两个入口服务于当前工作,不是 V4.1 内测入口。本次目录检索返回了相关 V4 型号,没有返回 V4.1 精确条目。不要把直连服务商给的临时 ID 填到网关里,就认定已经接入。Harness 的完整安装背景可参考已有文章

FAQ

DeepSeek V4.1 Flash 正式发布了吗?

素材报道的是中间版本内测。本次核对的官方 API 首页没有列出这个临时型号,目前核对的来源尚未确认全面正式发布。

V4.1 Flash 内测模型名是什么?

截图里是 deepseek-v4.1-flash-expires-on-0910。使用前先确认自己的服务商和账号接受这个型号;知道名字不等于获得权限。

Harness 的 Base URL 要改吗?

转发消息说保持不变,但只应套用到对应、已确认的服务商配置。它不能证明另一个网关或账号也兼容。

更便宜、20 并发,都是确定的吗?

这些来自转发群消息,其中收费说法是“当前与 V4 Flash 相同”,并提到每账号 20 并发。本文尚未独立确认它们是公开的 V4.1 服务条款。

SandBase 能调用 V4.1 Flash 吗?

本次目录检索没有发现精确条目。文中的 V4 Flash、Flash Vision Exp 是另外的型号,应等到明确支持的入口出现后再使用。

结论

先确认账号权限,再在 Harness 里添加独立测试条目,保留原来可用的 V4 配置。按实际需要逐项测试,记录真实响应。截图提供了一个值得关注的内测型号,还不足以支持生产迁移或速度、价格胜负的结论。