Blog/模型对比/

DeepSeek V4.1 Pro 发布了吗?官方状态与现在该用哪个

DeepSeek V4.1 Pro 发布了吗?截至 2026 年 10 月 4 日还没有。按官方更新日志梳理时间线:9 月 14 日 V4 Pro 为什么没下线、两款模型现价多少,附我们实测的 Agent 工具调用得分和选型建议。

DeepSeek V4.1 Pro 发布状态封面,示意插图,并非产品截图

先说答案:DeepSeek V4.1 Pro 还没有发布。我们在北京时间 2026 年 10 月 4 日 11:15 左右(UTC 03:15)把 DeepSeek 的更新日志、新闻页、模型与价格页,以及 Hugging Face 上的 deepseek-ai 组织页挨个翻了一遍,没有任何 V4.1 Pro 的模型名、价格或权重。官方唯一一次提到它,是 9 月 10 日 V4.1 Flash 发布稿里的一句条件:V4 Pro 的请求转给 V4.1 Flash,“至未来 V4.1 Pro 上线之前”。

所以搜“DeepSeek V4.1 Pro 发布”的人,真正要解决的是另一个问题:现在能调用的两款模型——V4.1 Flash 和 V4 Pro 0813——选哪个?9 月 14 日原定的 V4 Pro 下线计划后来被官方撤回了,两款都还能用。只想对比两者价格和功能的话,可以看我们之前写的 DeepSeek V4.1 Flash vs V4 Pro 对比。这篇只讲三件事:发布状态、官方时间线、我们自己测出来的数据。

先说结论

  • 截至 2026-10-04 03:15 UTC,DeepSeek 没有发布 V4.1 Pro:价格页没有模型名,更新日志没有条目,Hugging Face 上也没有仓库。
  • 9 月 10 日的新闻稿原计划从北京时间 9 月 14 日 12:00 起,把 deepseek-v4-pro 的请求全部路由到 V4.1 Flash,直到 V4.1 Pro 上线;现在的更新日志则写明 9 月 14 日之后继续提供 V4 Pro 的 API 服务,计费方式不变。
  • 官方高峰价(每百万 token):V4.1 Flash 输入 $0.30、输出 $1.20;V4 Pro 0813 输入 $1.32、输出 $3.96。SandBase 上标的是同样两档价格。
  • 我们 51 次的工具调用测试里,V4 Pro 0813 得 49/51,单任务成本中位数 $0.0069;V4.1 Flash 得 48/51,$0.0015。默认先上 Flash,Pro 留给确实测出差距的场景。
  • 在 SandBase 上请求 deepseek/deepseek-v4.1-pro,03:17 UTC 返回 HTTP 404 “model not found”。

DeepSeek V4.1 Pro 发布了吗?逐个来源核对

一个模型真正发布,通常会同时留下好几处痕迹:更新日志里有日期条目,价格表多一列,Hugging Face 上出权重,然后第三方平台陆续接入。我们按这个顺序挨个查了。

查的地方如果 V4.1 Pro 发布了,这里会多什么10 月 4 日实际看到的
DeepSeek 更新日志一条带日期的 V4.1 Pro 条目最新一条是 2026-09-10「DeepSeek-V4.1-Flash 发布」
DeepSeek 新闻页一篇发布稿最新一篇就是 9 月 10 日的 V4.1 Flash 发布稿
模型与价格第三列模型只有两列:deepseek-flash(DeepSeek-V4.1-Flash)和 deepseek-v4-pro(DeepSeek-V4-Pro-0813)
Hugging Face deepseek-aiV4.1-Pro 仓库最新仓库是 DeepSeek-V4.1-Flash,创建于 2026-09-10
SandBase 模型目录deepseek-v4.1-pro 这个 id四种 Pro 写法(deepseek-v4.1-pro、deepseek-v4-1-pro、deepseek-v4.1-pro-preview、deepseek-pro)全部 404;已启用的 DeepSeek id 共 8 个

结论很干脆:没发布,不是“可能快了”。这也意味着,今天任何地方给出的 V4.1 Pro 价格、上下文长度或跑分,都是猜的。别把 V4.1 Flash 的参数直接抄进 V4.1 Pro 那一行——同系列更大的模型,限制和价格完全可能不一样。

官方说过的只有方向。更新日志把 V4.1 Flash 描述为“全新模型结构系列中的最小尺寸的模型”,并说新结构的设计初衷之一是“可扩展到更大参数模型”。这是设计目标,不是发布日期。我们没找到任何官方给出的 V4.1 Pro 时间表。

官方时间线:那个后来改掉的计划

DeepSeek 自己的页面其实讲了一个三段式的故事,大部分误解都出在中间那段。

日期官方来源说了什么
2026-08-13更新日志「DeepSeek-V4-Pro 更新」V4 Pro 正式版上线,模型名不变,仍是 deepseek-v4-pro
2026-09-10更新日志「DeepSeek-V4.1-Flash 发布」发布 V4.1 Flash,模型名改为 deepseek-flash;V4 Flash 与 V4 Flash Vision Exp 下线,旧模型名“暂时路由到 V4.1 Flash”
2026-09-10新闻页 V4.1 Flash 发布稿北京时间 9 月 14 日 12:00 之后、V4.1 Pro 上线之前,deepseek-v4-pro 的请求全部路由到 V4.1 Flash,按 Flash 单价计费
无单独日期,位于 09-10 条目下更新日志“在 2026 年 9 月 14 日之后继续提供 DeepSeek V4 Pro 的 API 调用服务,计费方式保持不变”
2026-10-04价格页deepseek-v4-pro 仍对应 DeepSeek-V4-Pro-0813,按 Pro 价格;没有关于它的路由脚注

网上流传的“等 V4.1 Pro 到来为止”是转述。官方英文稿原话是 “This will continue until V4.1-Pro launches”,中文稿写的是“至未来 V4.1 Pro 上线之前”。截至 10 月 4 日,这两版新闻稿都还挂在官网上。

DeepSeek 新闻稿片段:自 2026 年 9 月 14 日 04:00 UTC 起,deepseek-v4-pro 请求路由到 V4.1-Flash,直到 V4.1-Pro 上线 截图:DeepSeek 9 月 10 日发布稿(英文版)至今仍写着原计划——把 V4 Pro 路由到 V4.1 Flash,直到 V4.1 Pro 上线(2026-10-04 截取)。

计划后来被撤回,证据在更新日志里。两页要对着看:新闻稿是原计划,更新日志是撤回。

DeepSeek 更新日志 2026-09-10 条目,API 变更段落及 V4 Pro 在 9 月 14 日后继续提供服务、计费不变的说明 截图:更新日志 2026-09-10 条目(英文版)。“API changes”下的第二段就是撤回:9 月 14 日之后继续提供 V4 Pro 服务,计费不变(2026-10-04 截取)。

有两点要说在前面。第一,撤回那段没有自己的日期,官方页面看不出它是哪天加的,也看不出撤回前有没有 V4 Pro 请求真的被转走过。第二,“继续提供”不等于给了下线日期。官方说“如有变动,我们将另行通知”,长期依赖 V4 Pro 的话,记得定期看更新日志。

现在该用哪个:V4.1 Flash 还是 V4 Pro 0813

V4.1 Pro 不存在,选择就只剩新的小模型和旧的大模型。官方价格表把规格这一侧讲得很清楚,而且两者的共同点比想象中多。

DeepSeek 模型与价格表:deepseek-flash 对应 DeepSeek-V4.1-Flash,deepseek-v4-pro 对应 DeepSeek-V4-Pro-0813,含高峰与闲时价格 截图:官方模型与价格表(英文版)。两款模型上下文都是 1M、最大输出 384K,只有 Flash 支持图片输入,Pro 的输入价约为 Flash 的 4.4 倍;截图里功能列的对勾显示成了空方框,网页源码里是 ✓(2026-10-04 截取)。

10 月 3 日,我们通过 SandBase 在自己的两套测试里跑过 V4 Pro 0813,V4.1 Flash 只跑了其中一套。下表把实测结果和官方规格放在一起:

V4.1 FlashV4 Pro 0813
官方模型名deepseek-flashdeepseek-v4-pro
SandBase iddeepseek/deepseek-v4.1-flashdeepseek/deepseek-v4-pro、deepseek/deepseek-v4-pro-0813
高峰价,输入 / 输出(每百万 token)$0.30 / $1.20$1.32 / $3.96
闲时价(仅官方 API)$0.15 / $0.60$0.66 / $1.98
上下文 / 最大输出1M / 384K1M / 384K
图片输入支持不支持
官方并发上限2500500
我们的工具调用测试,51 次48/51,单任务中位数 $0.0015,6.3 秒49/51,单任务中位数 $0.0069,10.2 秒
我们的 Claude Code 编码测试,12 次没测10/12,单任务中位数 $0.046

工具调用测试是同一套 17 个任务、每个跑 3 次:调数据工具查数、再做汇总,工具返回走缓存,参数全默认。V4 Pro 0813 错的两次:一次把账号 ID 抄错了,一次没按要求去调用户资料接口。V4.1 Flash 错的三次:两次粉丝数取错了来源,一次列表里四个 ID 只给了三个。细节见 12 模型工具调用评测 和 Pro vs Flash 分档评测。

编码数据来自 Claude Code 接其他模型的评测:6 个小型 Python 任务,每个跑 2 次。V4 Pro 0813 两次都栽在重构题上——把一个舍入 bug 原封不动搬进了新模块。V4.1 Flash 没跑这套测试,所以两者在编码上没有可比数据。

按这些数据,我们会这么选:

你的情况用哪个理由
新做的 Agent,工具调用加简短回答V4.1 Flash我们的测试里只比 Pro 少 1 分,单任务成本中位数约为 Pro 的 1/4.5
要看截图、图表或图片形式的文档V4.1 FlashV4 Pro 0813 不支持图片输入
在 DeepSeek 官方 API 上并发量大V4.1 Flash并发上限 2500 对 500
已有基于 Pro 的应用,输出必须和以前对得上暂时继续用 V4 Pro 0813仍按 Pro 计费正常提供;切换前先拿这些用例在 Flash 上回归一遍
就想要 V4.1 Pro两个都不是它还不存在;先在 Flash 上搭,以后改个 id 就行

说实话,我们的数据看不出 V4 Pro 在 Agent 工具任务上值它 4.4 倍的输入价。51 次里差 1 分,在多次运行的波动范围之内。长推理、大代码库上 Pro 也许能拉开差距,但这个我们没测。

一把 key 切换两款模型

在 SandBase 上,两款模型都走同一个 OpenAI 兼容的 POST /v1/chat/completions,切换就是改一个字符串。下面这个程序把同一个工具调用请求分别发给每个 id,再从 GET /v1/models/<id> 读目录价,在代码里算成本。两个接口用的是同一个 Authorization: Bearer key;只想看价格的话,公开的模型页不登录也能看到。

"""Same tool-calling request to two DeepSeek ids on SandBase, one key.

Prints, per model: the id you sent, the `model` field the response came back with,
finish_reason, the tool call it made, token usage and the cost computed from the
catalog price (GET /v1/models/<id>). Arithmetic happens here, not in the model.
"""
import json
import os
import sys

import requests

BASE = "https://api.sandbase.ai/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['SANDBASE_API_KEY']}"}
MODELS = sys.argv[1:] or ["deepseek/deepseek-v4.1-flash", "deepseek/deepseek-v4-pro"]

TOOLS = [{
    "type": "function",
    "function": {
        "name": "get_order_status",
        "description": "Look up the shipping status of one order by its ID.",
        "parameters": {
            "type": "object",
            "properties": {"order_id": {"type": "string", "description": "Order ID, e.g. A-1042"}},
            "required": ["order_id"],
        },
    },
}]
MESSAGES = [
    {"role": "system", "content": "You are a support agent. Use tools for order data; never guess."},
    {"role": "user", "content": "Where is my order A-1042?"},
]


def catalog_price(model):
    """Return (input $/M, output $/M) from the model card. Same Bearer key."""
    r = requests.get(f"{BASE}/models/{model}", headers=HEADERS, timeout=60)
    r.raise_for_status()
    card = r.json()["model_card"]
    return float(card["prompt_token_price"]), float(card["completion_token_price"])


def run(model):
    price_in, price_out = catalog_price(model)
    r = requests.post(f"{BASE}/chat/completions", headers=HEADERS, timeout=120, json={
        "model": model,
        "messages": MESSAGES,
        "tools": TOOLS,
        "max_tokens": 1500,
    })
    if r.status_code != 200:
        raise RuntimeError(f"{model}: HTTP {r.status_code} {r.text[:300]}")
    body = r.json()
    choice = body["choices"][0]
    calls = choice["message"].get("tool_calls") or []
    usage = body["usage"]
    cost = usage["prompt_tokens"] / 1e6 * price_in + usage["completion_tokens"] / 1e6 * price_out
    return {
        "sent": model,
        "returned_model": body.get("model"),
        "id": body.get("id"),
        "finish": choice.get("finish_reason"),
        "tool_call": [(c["function"]["name"], json.loads(c["function"]["arguments"])) for c in calls],
        "tokens_in_out": (usage["prompt_tokens"], usage["completion_tokens"]),
        "reasoning_tokens": (usage.get("completion_tokens_details") or {}).get("reasoning_tokens"),
        "cost_usd": round(cost, 6),
    }


if __name__ == "__main__":
    for m in MODELS:
        print(json.dumps(run(m)))

实测记录:2026-10-04(UTC)

03:17 UTC 原样运行,带三个 id:python3 ds_check.py deepseek/deepseek-v4.1-flash deepseek/deepseek-v4-pro deepseek/deepseek-v4-pro-0813。订单号是编的,不是真实客户数据。完整输出,每个模型一行:

{"sent": "deepseek/deepseek-v4.1-flash", "returned_model": "deepseek/deepseek-v4.1-flash", "id": "fe138e9e-6933-41df-9a07-04fcc78bc9a7", "finish": "tool_calls", "tool_call": [["get_order_status", {"order_id": "A-1042"}]], "tokens_in_out": [335, 43], "reasoning_tokens": 0, "cost_usd": 0.000152}
{"sent": "deepseek/deepseek-v4-pro", "returned_model": "deepseek/deepseek-v4-pro", "id": "8729b374-ee50-4bd9-87bc-c84680076fa8", "finish": "tool_calls", "tool_call": [["get_order_status", {"order_id": "A-1042"}]], "tokens_in_out": [319, 85], "reasoning_tokens": 27, "cost_usd": 0.000758}
{"sent": "deepseek/deepseek-v4-pro-0813", "returned_model": "deepseek/deepseek-v4-pro-0813", "id": "47ba019f-4d06-4ef2-87c4-4963dfe36895", "finish": "tool_calls", "tool_call": [["get_order_status", {"order_id": "A-1042"}]], "tokens_in_out": [398, 64], "reasoning_tokens": 15, "cost_usd": 0.000779}

三个都调对了工具,参数是合法 JSON。之后我们用 GET /v1/tasks/<id>/cost(同一个 Bearer key)查了每次调用的结算费用:$0.000152、$0.000758、$0.000779,和代码算的一致。也就是说,SandBase 上的 deepseek/deepseek-v4-pro 是按 Pro 价结算的,不是按 Flash 价。

但这次测试回答不了“上游到底是哪个版本在答”。响应里的 model 字段只是把你发的 id 原样回显,不是版本戳。这是这一次运行里观察到的行为,不是文档承诺。每个模型只调了一次单轮请求,只能说明这条路由今天通,说明不了质量。

请求一个不存在的模型会直接报错——对于那种有人手动把配置“升级”成 V4.1 Pro 的情况,这正是你想要的。03:17 UTC 我们发了一个最简单的请求(只有一条 “ping” 消息,不带工具),"model" 写成 "deepseek/deepseek-v4.1-pro",返回 HTTP 404,完整响应体如下;deepseek/deepseek-v4-1-pro 报的是同样的错:

{"error":{"code":null,"message":"model not found: deepseek/deepseek-v4.1-pro","param":null,"type":"not_found_error"}}

SandBase 上 DeepSeek V4 Pro 的模型页,id 为 deepseek/deepseek-v4-pro,输入 $1.32、输出 $3.96 每百万 token,最大输出 384K 截图:SandBase 上 deepseek/deepseek-v4-pro 的模型页,输入 $1.32、输出 $3.96 每百万 token,与 DeepSeek 官方高峰价一致;页面上下文窗口显示 N/A,官方表格写的是 1M(2026-10-04 截取)。

SandBase 的模型卡每个模型只列一档价格,等于 DeepSeek 的高峰价;price_formula 里没看到闲时价。任务能等到闲时跑的话,直接用 DeepSeek 官方 API 能省一半。

想自己跑一遍,可以看 Chat Completions 指南、V4.1 Flash 模型页 和 V4 Pro 模型页,然后去 申请一个 SandBase API key。

V4.1 Pro 上线时,怎么第一时间确认

传闻、官宣、能用的路由是三回事。下面是我们会按顺序做的检查,以及每一步之后能放心做什么:

阶段看什么证据可以做什么
1. 官宣更新日志 出现带日期的 V4.1 Pro 条目读清楚官方给的限制和价格
2. 官方模型名价格页多出一列,或 deepseek-v4-pro 的 MODEL VERSION 换成新版本在官方 API 上做小范围测试
3. 权重Hugging Face deepseek-ai 下出现 V4.1-Pro 仓库有自部署需求的可以开始评估
4. SandBase 路由GET /v1/models/deepseek/<新 id> 返回 200 且 enabled: true在预发环境里换 id
5. 我们的实测同一套 51 次工具调用测试和 12 次 Claude Code 测试拿准确率和单任务成本做决定

如果你是按名字调用 deepseek-v4-pro,最该盯的是第 2 步。9 月 10 日官方就准备只提前四天,把这个名字指向另一个模型。要是将来 V4.1 Pro 接管了 Pro 这个名字,你的代码一行没改,背后的模型就换了。能锁版本号的地方尽量锁,再留一小组已验收的提示词和标准输出,模型一换就能发现。

V4.1 Pro 一出来,我们会用同样的任务和参数把两套测试都跑一遍,并更新这篇文章。

常见问题

DeepSeek V4.1 Pro 发布了吗?

没有。截至 2026-10-04 03:15 UTC 左右,DeepSeek 的更新日志、新闻页、价格页和 Hugging Face 组织页都没有 V4.1 Pro。最新发布的是 2026-09-10 的 V4.1 Flash。

DeepSeek V4.1 Pro 什么时候出?

官方没给日期。唯一的提法是 9 月 10 日新闻稿里那句:V4 Pro 转给 Flash 的安排持续“至未来 V4.1 Pro 上线之前”。这是个条件,不是时间表。

DeepSeek V4 Pro 9 月 14 日下线了吗?

按官方现在的页面,没有。原计划是北京时间 9 月 14 日 12:00 起把 deepseek-v4-pro 路由到 V4.1 Flash;更新日志后来写明 9 月 14 日之后继续提供 V4 Pro 的 API 服务,计费不变。价格页上它仍对应 DeepSeek-V4-Pro-0813,高峰价 $1.32 / $3.96。

要等 V4.1 Pro,还是现在就用 V4.1 Flash?

除非你测出了不能用 Flash 的理由,否则现在就用 V4.1 Flash。在我们 51 次的工具调用测试里,它得 48/51,V4 Pro 0813 得 49/51,单任务成本中位数是 $0.0015 对 $0.0069。把模型 id 做成一个配置项,以后换起来成本很低。

SandBase 上能调用 DeepSeek V4.1 Pro 吗?

还不能。deepseek/deepseek-v4.1-pro 返回 HTTP 404 “model not found”。2026-10-04 已启用的 DeepSeek id 有:deepseek-v4.1-flash、deepseek-v4-pro、deepseek-v4-pro-0813、deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v4-flash-vision-exp、deepseek-chat 和 deepseek-v3.2。

局限

这是某一时刻的状态核查,时间点是 2026-10-04 03:15 UTC 前后。DeepSeek 随时可能发布 V4.1 Pro,也随时可能调整 V4 Pro 的状态,需要复查时以更新日志为准。发布相关的事实我们只用了 DeepSeek 自己的页面,没有采用媒体报道。

实测数据来自 10 月 3 日跑的两套范围很窄的测试:17 个数据查询类工具任务各跑 3 次,6 个小型 Python 编码任务各跑 2 次,参数全默认。长推理、长文档、图片输入和大代码库都没覆盖,51 次里差 1 分也不构成有意义的差距。文中的实时调用,每个模型只有一次单轮请求。我们能确认 SandBase 对 deepseek/deepseek-v4-pro 按 Pro 价结算,但没有任何响应字段告诉我们上游具体是哪个模型版本在服务。