DeepSeek V4.1 Pro 发布了吗?官方状态与现在该用哪个
DeepSeek V4.1 Pro 发布了吗?截至 2026 年 10 月 4 日还没有。按官方更新日志梳理时间线:9 月 14 日 V4 Pro 为什么没下线、两款模型现价多少,附我们实测的 Agent 工具调用得分和选型建议。

先说答案:DeepSeek V4.1 Pro 还没有发布。我们在北京时间 2026 年 10 月 4 日 11:15 左右(UTC 03:15)把 DeepSeek 的更新日志、新闻页、模型与价格页,以及 Hugging Face 上的 deepseek-ai 组织页挨个翻了一遍,没有任何 V4.1 Pro 的模型名、价格或权重。官方唯一一次提到它,是 9 月 10 日 V4.1 Flash 发布稿里的一句条件:V4 Pro 的请求转给 V4.1 Flash,“至未来 V4.1 Pro 上线之前”。
所以搜“DeepSeek V4.1 Pro 发布”的人,真正要解决的是另一个问题:现在能调用的两款模型——V4.1 Flash 和 V4 Pro 0813——选哪个?9 月 14 日原定的 V4 Pro 下线计划后来被官方撤回了,两款都还能用。只想对比两者价格和功能的话,可以看我们之前写的 DeepSeek V4.1 Flash vs V4 Pro 对比。这篇只讲三件事:发布状态、官方时间线、我们自己测出来的数据。
先说结论
- 截至 2026-10-04 03:15 UTC,DeepSeek 没有发布 V4.1 Pro:价格页没有模型名,更新日志没有条目,Hugging Face 上也没有仓库。
- 9 月 10 日的新闻稿原计划从北京时间 9 月 14 日 12:00 起,把
deepseek-v4-pro的请求全部路由到 V4.1 Flash,直到 V4.1 Pro 上线;现在的更新日志则写明 9 月 14 日之后继续提供 V4 Pro 的 API 服务,计费方式不变。- 官方高峰价(每百万 token):V4.1 Flash 输入 $0.30、输出 $1.20;V4 Pro 0813 输入 $1.32、输出 $3.96。SandBase 上标的是同样两档价格。
- 我们 51 次的工具调用测试里,V4 Pro 0813 得 49/51,单任务成本中位数 $0.0069;V4.1 Flash 得 48/51,$0.0015。默认先上 Flash,Pro 留给确实测出差距的场景。
- 在 SandBase 上请求
deepseek/deepseek-v4.1-pro,03:17 UTC 返回 HTTP 404 “model not found”。
DeepSeek V4.1 Pro 发布了吗?逐个来源核对
一个模型真正发布,通常会同时留下好几处痕迹:更新日志里有日期条目,价格表多一列,Hugging Face 上出权重,然后第三方平台陆续接入。我们按这个顺序挨个查了。
| 查的地方 | 如果 V4.1 Pro 发布了,这里会多什么 | 10 月 4 日实际看到的 |
|---|---|---|
| DeepSeek 更新日志 | 一条带日期的 V4.1 Pro 条目 | 最新一条是 2026-09-10「DeepSeek-V4.1-Flash 发布」 |
| DeepSeek 新闻页 | 一篇发布稿 | 最新一篇就是 9 月 10 日的 V4.1 Flash 发布稿 |
| 模型与价格 | 第三列模型 | 只有两列:deepseek-flash(DeepSeek-V4.1-Flash)和 deepseek-v4-pro(DeepSeek-V4-Pro-0813) |
| Hugging Face deepseek-ai | V4.1-Pro 仓库 | 最新仓库是 DeepSeek-V4.1-Flash,创建于 2026-09-10 |
| SandBase 模型目录 | deepseek-v4.1-pro 这个 id | 四种 Pro 写法(deepseek-v4.1-pro、deepseek-v4-1-pro、deepseek-v4.1-pro-preview、deepseek-pro)全部 404;已启用的 DeepSeek id 共 8 个 |
结论很干脆:没发布,不是“可能快了”。这也意味着,今天任何地方给出的 V4.1 Pro 价格、上下文长度或跑分,都是猜的。别把 V4.1 Flash 的参数直接抄进 V4.1 Pro 那一行——同系列更大的模型,限制和价格完全可能不一样。
官方说过的只有方向。更新日志把 V4.1 Flash 描述为“全新模型结构系列中的最小尺寸的模型”,并说新结构的设计初衷之一是“可扩展到更大参数模型”。这是设计目标,不是发布日期。我们没找到任何官方给出的 V4.1 Pro 时间表。
官方时间线:那个后来改掉的计划
DeepSeek 自己的页面其实讲了一个三段式的故事,大部分误解都出在中间那段。
| 日期 | 官方来源 | 说了什么 |
|---|---|---|
| 2026-08-13 | 更新日志「DeepSeek-V4-Pro 更新」 | V4 Pro 正式版上线,模型名不变,仍是 deepseek-v4-pro |
| 2026-09-10 | 更新日志「DeepSeek-V4.1-Flash 发布」 | 发布 V4.1 Flash,模型名改为 deepseek-flash;V4 Flash 与 V4 Flash Vision Exp 下线,旧模型名“暂时路由到 V4.1 Flash” |
| 2026-09-10 | 新闻页 V4.1 Flash 发布稿 | 北京时间 9 月 14 日 12:00 之后、V4.1 Pro 上线之前,deepseek-v4-pro 的请求全部路由到 V4.1 Flash,按 Flash 单价计费 |
| 无单独日期,位于 09-10 条目下 | 更新日志 | “在 2026 年 9 月 14 日之后继续提供 DeepSeek V4 Pro 的 API 调用服务,计费方式保持不变” |
| 2026-10-04 | 价格页 | deepseek-v4-pro 仍对应 DeepSeek-V4-Pro-0813,按 Pro 价格;没有关于它的路由脚注 |
网上流传的“等 V4.1 Pro 到来为止”是转述。官方英文稿原话是 “This will continue until V4.1-Pro launches”,中文稿写的是“至未来 V4.1 Pro 上线之前”。截至 10 月 4 日,这两版新闻稿都还挂在官网上。
截图:DeepSeek 9 月 10 日发布稿(英文版)至今仍写着原计划——把 V4 Pro 路由到 V4.1 Flash,直到 V4.1 Pro 上线(2026-10-04 截取)。
计划后来被撤回,证据在更新日志里。两页要对着看:新闻稿是原计划,更新日志是撤回。
截图:更新日志 2026-09-10 条目(英文版)。“API changes”下的第二段就是撤回:9 月 14 日之后继续提供 V4 Pro 服务,计费不变(2026-10-04 截取)。
有两点要说在前面。第一,撤回那段没有自己的日期,官方页面看不出它是哪天加的,也看不出撤回前有没有 V4 Pro 请求真的被转走过。第二,“继续提供”不等于给了下线日期。官方说“如有变动,我们将另行通知”,长期依赖 V4 Pro 的话,记得定期看更新日志。
现在该用哪个:V4.1 Flash 还是 V4 Pro 0813
V4.1 Pro 不存在,选择就只剩新的小模型和旧的大模型。官方价格表把规格这一侧讲得很清楚,而且两者的共同点比想象中多。
截图:官方模型与价格表(英文版)。两款模型上下文都是 1M、最大输出 384K,只有 Flash 支持图片输入,Pro 的输入价约为 Flash 的 4.4 倍;截图里功能列的对勾显示成了空方框,网页源码里是 ✓(2026-10-04 截取)。
10 月 3 日,我们通过 SandBase 在自己的两套测试里跑过 V4 Pro 0813,V4.1 Flash 只跑了其中一套。下表把实测结果和官方规格放在一起:
| V4.1 Flash | V4 Pro 0813 | |
|---|---|---|
| 官方模型名 | deepseek-flash | deepseek-v4-pro |
| SandBase id | deepseek/deepseek-v4.1-flash | deepseek/deepseek-v4-pro、deepseek/deepseek-v4-pro-0813 |
| 高峰价,输入 / 输出(每百万 token) | $0.30 / $1.20 | $1.32 / $3.96 |
| 闲时价(仅官方 API) | $0.15 / $0.60 | $0.66 / $1.98 |
| 上下文 / 最大输出 | 1M / 384K | 1M / 384K |
| 图片输入 | 支持 | 不支持 |
| 官方并发上限 | 2500 | 500 |
| 我们的工具调用测试,51 次 | 48/51,单任务中位数 $0.0015,6.3 秒 | 49/51,单任务中位数 $0.0069,10.2 秒 |
| 我们的 Claude Code 编码测试,12 次 | 没测 | 10/12,单任务中位数 $0.046 |
工具调用测试是同一套 17 个任务、每个跑 3 次:调数据工具查数、再做汇总,工具返回走缓存,参数全默认。V4 Pro 0813 错的两次:一次把账号 ID 抄错了,一次没按要求去调用户资料接口。V4.1 Flash 错的三次:两次粉丝数取错了来源,一次列表里四个 ID 只给了三个。细节见 12 模型工具调用评测 和 Pro vs Flash 分档评测。
编码数据来自 Claude Code 接其他模型的评测:6 个小型 Python 任务,每个跑 2 次。V4 Pro 0813 两次都栽在重构题上——把一个舍入 bug 原封不动搬进了新模块。V4.1 Flash 没跑这套测试,所以两者在编码上没有可比数据。
按这些数据,我们会这么选:
| 你的情况 | 用哪个 | 理由 |
|---|---|---|
| 新做的 Agent,工具调用加简短回答 | V4.1 Flash | 我们的测试里只比 Pro 少 1 分,单任务成本中位数约为 Pro 的 1/4.5 |
| 要看截图、图表或图片形式的文档 | V4.1 Flash | V4 Pro 0813 不支持图片输入 |
| 在 DeepSeek 官方 API 上并发量大 | V4.1 Flash | 并发上限 2500 对 500 |
| 已有基于 Pro 的应用,输出必须和以前对得上 | 暂时继续用 V4 Pro 0813 | 仍按 Pro 计费正常提供;切换前先拿这些用例在 Flash 上回归一遍 |
| 就想要 V4.1 Pro | 两个都不是 | 它还不存在;先在 Flash 上搭,以后改个 id 就行 |
说实话,我们的数据看不出 V4 Pro 在 Agent 工具任务上值它 4.4 倍的输入价。51 次里差 1 分,在多次运行的波动范围之内。长推理、大代码库上 Pro 也许能拉开差距,但这个我们没测。
一把 key 切换两款模型
在 SandBase 上,两款模型都走同一个 OpenAI 兼容的 POST /v1/chat/completions,切换就是改一个字符串。下面这个程序把同一个工具调用请求分别发给每个 id,再从 GET /v1/models/<id> 读目录价,在代码里算成本。两个接口用的是同一个 Authorization: Bearer key;只想看价格的话,公开的模型页不登录也能看到。
"""Same tool-calling request to two DeepSeek ids on SandBase, one key.
Prints, per model: the id you sent, the `model` field the response came back with,
finish_reason, the tool call it made, token usage and the cost computed from the
catalog price (GET /v1/models/<id>). Arithmetic happens here, not in the model.
"""
import json
import os
import sys
import requests
BASE = "https://api.sandbase.ai/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['SANDBASE_API_KEY']}"}
MODELS = sys.argv[1:] or ["deepseek/deepseek-v4.1-flash", "deepseek/deepseek-v4-pro"]
TOOLS = [{
"type": "function",
"function": {
"name": "get_order_status",
"description": "Look up the shipping status of one order by its ID.",
"parameters": {
"type": "object",
"properties": {"order_id": {"type": "string", "description": "Order ID, e.g. A-1042"}},
"required": ["order_id"],
},
},
}]
MESSAGES = [
{"role": "system", "content": "You are a support agent. Use tools for order data; never guess."},
{"role": "user", "content": "Where is my order A-1042?"},
]
def catalog_price(model):
"""Return (input $/M, output $/M) from the model card. Same Bearer key."""
r = requests.get(f"{BASE}/models/{model}", headers=HEADERS, timeout=60)
r.raise_for_status()
card = r.json()["model_card"]
return float(card["prompt_token_price"]), float(card["completion_token_price"])
def run(model):
price_in, price_out = catalog_price(model)
r = requests.post(f"{BASE}/chat/completions", headers=HEADERS, timeout=120, json={
"model": model,
"messages": MESSAGES,
"tools": TOOLS,
"max_tokens": 1500,
})
if r.status_code != 200:
raise RuntimeError(f"{model}: HTTP {r.status_code} {r.text[:300]}")
body = r.json()
choice = body["choices"][0]
calls = choice["message"].get("tool_calls") or []
usage = body["usage"]
cost = usage["prompt_tokens"] / 1e6 * price_in + usage["completion_tokens"] / 1e6 * price_out
return {
"sent": model,
"returned_model": body.get("model"),
"id": body.get("id"),
"finish": choice.get("finish_reason"),
"tool_call": [(c["function"]["name"], json.loads(c["function"]["arguments"])) for c in calls],
"tokens_in_out": (usage["prompt_tokens"], usage["completion_tokens"]),
"reasoning_tokens": (usage.get("completion_tokens_details") or {}).get("reasoning_tokens"),
"cost_usd": round(cost, 6),
}
if __name__ == "__main__":
for m in MODELS:
print(json.dumps(run(m)))
实测记录:2026-10-04(UTC)
03:17 UTC 原样运行,带三个 id:python3 ds_check.py deepseek/deepseek-v4.1-flash deepseek/deepseek-v4-pro deepseek/deepseek-v4-pro-0813。订单号是编的,不是真实客户数据。完整输出,每个模型一行:
{"sent": "deepseek/deepseek-v4.1-flash", "returned_model": "deepseek/deepseek-v4.1-flash", "id": "fe138e9e-6933-41df-9a07-04fcc78bc9a7", "finish": "tool_calls", "tool_call": [["get_order_status", {"order_id": "A-1042"}]], "tokens_in_out": [335, 43], "reasoning_tokens": 0, "cost_usd": 0.000152}
{"sent": "deepseek/deepseek-v4-pro", "returned_model": "deepseek/deepseek-v4-pro", "id": "8729b374-ee50-4bd9-87bc-c84680076fa8", "finish": "tool_calls", "tool_call": [["get_order_status", {"order_id": "A-1042"}]], "tokens_in_out": [319, 85], "reasoning_tokens": 27, "cost_usd": 0.000758}
{"sent": "deepseek/deepseek-v4-pro-0813", "returned_model": "deepseek/deepseek-v4-pro-0813", "id": "47ba019f-4d06-4ef2-87c4-4963dfe36895", "finish": "tool_calls", "tool_call": [["get_order_status", {"order_id": "A-1042"}]], "tokens_in_out": [398, 64], "reasoning_tokens": 15, "cost_usd": 0.000779}
三个都调对了工具,参数是合法 JSON。之后我们用 GET /v1/tasks/<id>/cost(同一个 Bearer key)查了每次调用的结算费用:$0.000152、$0.000758、$0.000779,和代码算的一致。也就是说,SandBase 上的 deepseek/deepseek-v4-pro 是按 Pro 价结算的,不是按 Flash 价。
但这次测试回答不了“上游到底是哪个版本在答”。响应里的 model 字段只是把你发的 id 原样回显,不是版本戳。这是这一次运行里观察到的行为,不是文档承诺。每个模型只调了一次单轮请求,只能说明这条路由今天通,说明不了质量。
请求一个不存在的模型会直接报错——对于那种有人手动把配置“升级”成 V4.1 Pro 的情况,这正是你想要的。03:17 UTC 我们发了一个最简单的请求(只有一条 “ping” 消息,不带工具),"model" 写成 "deepseek/deepseek-v4.1-pro",返回 HTTP 404,完整响应体如下;deepseek/deepseek-v4-1-pro 报的是同样的错:
{"error":{"code":null,"message":"model not found: deepseek/deepseek-v4.1-pro","param":null,"type":"not_found_error"}}
截图:SandBase 上 deepseek/deepseek-v4-pro 的模型页,输入 $1.32、输出 $3.96 每百万 token,与 DeepSeek 官方高峰价一致;页面上下文窗口显示 N/A,官方表格写的是 1M(2026-10-04 截取)。
SandBase 的模型卡每个模型只列一档价格,等于 DeepSeek 的高峰价;price_formula 里没看到闲时价。任务能等到闲时跑的话,直接用 DeepSeek 官方 API 能省一半。
想自己跑一遍,可以看 Chat Completions 指南、V4.1 Flash 模型页 和 V4 Pro 模型页,然后去 申请一个 SandBase API key。
V4.1 Pro 上线时,怎么第一时间确认
传闻、官宣、能用的路由是三回事。下面是我们会按顺序做的检查,以及每一步之后能放心做什么:
| 阶段 | 看什么证据 | 可以做什么 |
|---|---|---|
| 1. 官宣 | 更新日志 出现带日期的 V4.1 Pro 条目 | 读清楚官方给的限制和价格 |
| 2. 官方模型名 | 价格页多出一列,或 deepseek-v4-pro 的 MODEL VERSION 换成新版本 | 在官方 API 上做小范围测试 |
| 3. 权重 | Hugging Face deepseek-ai 下出现 V4.1-Pro 仓库 | 有自部署需求的可以开始评估 |
| 4. SandBase 路由 | GET /v1/models/deepseek/<新 id> 返回 200 且 enabled: true | 在预发环境里换 id |
| 5. 我们的实测 | 同一套 51 次工具调用测试和 12 次 Claude Code 测试 | 拿准确率和单任务成本做决定 |
如果你是按名字调用 deepseek-v4-pro,最该盯的是第 2 步。9 月 10 日官方就准备只提前四天,把这个名字指向另一个模型。要是将来 V4.1 Pro 接管了 Pro 这个名字,你的代码一行没改,背后的模型就换了。能锁版本号的地方尽量锁,再留一小组已验收的提示词和标准输出,模型一换就能发现。
V4.1 Pro 一出来,我们会用同样的任务和参数把两套测试都跑一遍,并更新这篇文章。
常见问题
DeepSeek V4.1 Pro 发布了吗?
没有。截至 2026-10-04 03:15 UTC 左右,DeepSeek 的更新日志、新闻页、价格页和 Hugging Face 组织页都没有 V4.1 Pro。最新发布的是 2026-09-10 的 V4.1 Flash。
DeepSeek V4.1 Pro 什么时候出?
官方没给日期。唯一的提法是 9 月 10 日新闻稿里那句:V4 Pro 转给 Flash 的安排持续“至未来 V4.1 Pro 上线之前”。这是个条件,不是时间表。
DeepSeek V4 Pro 9 月 14 日下线了吗?
按官方现在的页面,没有。原计划是北京时间 9 月 14 日 12:00 起把 deepseek-v4-pro 路由到 V4.1 Flash;更新日志后来写明 9 月 14 日之后继续提供 V4 Pro 的 API 服务,计费不变。价格页上它仍对应 DeepSeek-V4-Pro-0813,高峰价 $1.32 / $3.96。
要等 V4.1 Pro,还是现在就用 V4.1 Flash?
除非你测出了不能用 Flash 的理由,否则现在就用 V4.1 Flash。在我们 51 次的工具调用测试里,它得 48/51,V4 Pro 0813 得 49/51,单任务成本中位数是 $0.0015 对 $0.0069。把模型 id 做成一个配置项,以后换起来成本很低。
SandBase 上能调用 DeepSeek V4.1 Pro 吗?
还不能。deepseek/deepseek-v4.1-pro 返回 HTTP 404 “model not found”。2026-10-04 已启用的 DeepSeek id 有:deepseek-v4.1-flash、deepseek-v4-pro、deepseek-v4-pro-0813、deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v4-flash-vision-exp、deepseek-chat 和 deepseek-v3.2。
局限
这是某一时刻的状态核查,时间点是 2026-10-04 03:15 UTC 前后。DeepSeek 随时可能发布 V4.1 Pro,也随时可能调整 V4 Pro 的状态,需要复查时以更新日志为准。发布相关的事实我们只用了 DeepSeek 自己的页面,没有采用媒体报道。
实测数据来自 10 月 3 日跑的两套范围很窄的测试:17 个数据查询类工具任务各跑 3 次,6 个小型 Python 编码任务各跑 2 次,参数全默认。长推理、长文档、图片输入和大代码库都没覆盖,51 次里差 1 分也不构成有意义的差距。文中的实时调用,每个模型只有一次单轮请求。我们能确认 SandBase 对 deepseek/deepseek-v4-pro 按 Pro 价结算,但没有任何响应字段告诉我们上游具体是哪个模型版本在服务。