DeepSeek V4.1 Pro 的主视觉标题卡片,副标题为“开发中:我们从一则两句话的泄露中所知的信息”,药丸徽章上写着“尚未发布”和“由 DeepSeek 团队命名”,页脚文字为“无模型卡——无规格——尚无发布日期”,右下角合成 OrcaRouter 标志。
Guides & Insights

DeepSeek V4.1 Pro 正在开发中:路由通知、架构承诺,以及尚不明确之处

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

DeepSeek V4.1 Pro尚未发布、上线、评测或定价。它不出现在任何模型页面上,没有模型卡,也没有任何端点回应其名称——然而在2026年9月9日,DeepSeek技术团队的一名成员在一则关于DeepSeek V4 Pro流量届时将如何处理的简短两句通知中,几乎顺带地公开证实了它的存在。以@tianyi账号发帖的崔天翼写道,一旦DeepSeek V4.1 Flash正式上线(预计在北京时间9月10日左右),所有指向DeepSeek V4 Pro的API请求都将被重新路由至DeepSeek V4.1 Flash,并按Flash较低的费率计费,这一安排将持续到DeepSeek V4.1 Pro本身上线为止。

那段尾随从句才是新闻。迄今为止,V4.1 系列仅通过为期两天的“中间版本”测试而浮出水面,该测试于 9 月 8 日开始提供服务,模型 ID 为 deepseek-v4.1-flash-expires-on-0910,同时还附有一份反馈表单,询问测试者 V4.1 Flash 是否可以在生产中取代 DeepSeek V4 Pro。将 DeepSeek V4.1 Pro 命名为路由窗口的终点,是这家公司首次在内部承认这款旗舰产品。化名 DeepSeek 观察者 teortaxesTex 引用了这份通知,并做了同样的解读——随后又提出了一个更强的说法:DeepSeek V4.1 Pro 的存在证实 DeepSeek 已经“解决了 V4 系列架构上的问题,正如他们在 V4 论文中承诺要做的那样。”

在细节之前先说明一下消息来源。以下关于 DeepSeek V4.1 Pro 的所有内容都建立在两件事之上:一条 DeepSeek 技术团队成员发布的带日期社交帖子(几小时内得到多家中国媒体的佐证),以及某位追踪者对其的解读。目前没有技术报告,没有参数数量,没有发布日期,今天也无法调用该模型。路由说明是一种陈述;"架构已解决"的说法是一种推断。本文把两者区分开来,因为它们是不同类型的证据。

9月9日通知实际所说的内容

北京时间9月9日15:14左右,崔天屹在X上发文称,继续以溢价销售旧版DeepSeek V4 Pro已不再合理。他的理由大意是:内外部测试显示,V4.1 Flash模型在性能、成本、速度和总处理时间上全面超越DeepSeek V4 Pro,因此,为一款性能较弱的模型向用户收取更多费用、提供更慢的速度并占用更多算力是不合适的。因此,一旦V4.1 Flash正式上线,在V4.1 Pro上线之前,对V4 Pro模型的请求将统一路由至V4.1 Flash,并按Flash定价计费。

那个“全面超越”的说法是DeepSeek团队自行宣称的,并非独立验证结果:发布帖没有附带任何基准测试表,V4.1 Flash测试版也没有模型卡。真正可以验证的是计划的轮廓——DeepSeek打算在Flash正式上线的那一刻就把当前的Pro层级视为过时,并在下一代Pro问世之前,将Pro流量转移到更便宜的模型上。

今天致电 DeepSeek V4 Pro 意味着什么

对于任何正在运行当前旗舰产品的用户——DeepSeek V4 Pro,这款于8月中旬达到GA的1.6万亿参数MoE——此项变更是自动的,且在服务端完成。一旦重路由生效,指定V4 Pro模型的请求将由V4.1 Flash版本响应,并按Flash费率计费,调用方无需改动任何代码。计费切换才是最犀利的部分。报道该通知的中文媒体称,新Flash费率表的最高输出价格自9月10日起为每百万token ¥8,而被其取代的Pro层级为每百万token ¥27——对于原本命中Pro的流量而言,降幅约70%,且该模型据DeepSeek团队称速度更快。作为一项同步升级与降价的公告,即便以DeepSeek自身的标准衡量,也称得上激进。

A screenshot of the DeepSeek API docs Models & Pricing page (captured September 9, 2026) showing the current public lineup — deepseek-v4-flash, deepseek-v4-pro and deepseek-v4-flash-vision-exp — in English, with no V4.1 entry visible in the model table.

一个时间上的注意事项,因为表述的框架很重要:如果你今天持有 DeepSeek V4 Pro 的密钥,在 V4.1 Flash 真正发布之前,一切都不会改变;而有关重新路由的描述来自团队的发文及相关报道——还不是来自更新日志条目。截至上面 9 月 9 日的截图,DeepSeek 的官方模型页面仍然只列出了普通的 V4 产品线——DeepSeek V4 Flash、DeepSeek V4 Pro 和 DeepSeek-V4-Flash-Vision-Exp——表格中没有 V4.1 条目。

为什么“V4 paper”是泄密的关键

teortaxesTex的具体说法是,DeepSeek V4.1 Pro正在开发中,这证实DeepSeek已经解决了V4系列存在的架构问题,“正如他们在V4论文中所承诺的那样”。这一说法是可以查证的。DeepSeek的V4技术报告——DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence——异常坦率地指出了其设计目前尚不擅长的方面,以及未来迭代版本原本要解决的问题:

• 该报告称其自身架构“相对复杂”,并承诺“在未来的迭代中,我们将进行更全面、更严谨的研究,将架构提炼至最核心的设计。”

• 报告称,其两种训练稳定化机制——Anticipatory Routing 和 SwiGLU Clamping——在实践中有效,但其基本原理仍“未被充分理解”。

• 长上下文检索在超过128K token后仍会衰减。在报告引用的8针检索测试中,V4-Pro-Max在128K时得分约为0.92,在1M时降至约0.59——这就是“能加载百万token”与“能真正利用它们”之间的差距。

• 而 V4 系列最初仅发布文本版本;视觉能力后来才以附加的实验性编码器 DeepSeek-V4-Flash-Vision-Exp 的形式出现,而不是作为基础模型的一部分。

对照那份清单,V4.1 的故事就变得清晰起来。DeepSeek 自己对 V4.1 Flash 测试版的描述,恰恰使用了那些问题所暗示的语言——一种“新的模型结构”和从底层构建的原生多模态支持。基于同一已解决基础构建的 V4.1 Pro 是自然的下一步,这正是 teortaxesTex 所推断的。这只是一个推断,并且应该保持标注为推断:DeepSeek 尚未发布 V4.1 技术报告,而“正在开发中”除了团队成员提到 Pro 最终发布之外,并未得到确认。

证据台账——哪些已得到确认,哪些尚未确认

将9月9日的信号叠加到9月8日的beta版本上,得到的已确认事实清单很短,而未解问题清单却很长。

A single-column scoreboard titled 'DeepSeek V4.1 Pro - what we know so far' listing Status: named by DeepSeek team - not released, First evidence: Sept 9 2026 routing notice, Claimed base: V4.1 new structure + native multimodal, Predecessor: DeepSeek V4 Pro 1.6T MoE (GA Aug 13), Specs: none published yet, Weights: none yet - family so far API-only, with a footer reading 'Vendor-team statement plus a tracker's reading - no independent benchmarks yet.'

• 厂商声明(数小时内得到多家中国媒体的证实)——DeepSeek 有一个 V4.1 Flash 模型,计划于北京时间 9 月 10 日左右发布;DeepSeek V4 Pro 的 API 流量将路由至该模型,并按 Flash 费率计费,直到 V4.1 Pro 发布;DeepSeek 团队认为 Flash 版本在成本、速度和总时间上均优于当前的 Pro 版本。

• 合理但未经证实——DeepSeek V4.1 Pro 目前正在训练中或即将推出。teortaxesTex 的“正在进行中”没有注明日期,也没有内部来源;唯一的佐证是路由窗口本身,而它预设了 Pro 最终会出现。

• 解读——Pro 的存在证明了 V4 论文的架构承诺已经兑现。V4.1 Flash 测试版中“新结构、原生多模态”的说法指向同一方向,但目前尚未发布任何 V4.1 架构可供对照验证。

• 未知 — V4.1 Pro 的规格、参数数量、上下文窗口、定价、发布日期,以及它是否像 DeepSeek V4 Flash 和 DeepSeek V4 Pro 那样提供开放权重。当前的 V4.1 Flash 测试版仅限 API 使用且即将到期,因此开放权重的问题确实是悬而未决的,而不仅仅是尚未回答。

看什么

• 北京时间9月10日 — V4.1 Flash正式发布、其新费率表,以及V4 Pro改道的开始。如果真如所述,从那天起,"DeepSeek V4 Pro"模型ID将开始以Flash价格返回V4.1架构。

• V4.1 技术报告或模型卡——测试版两者都没有,而第一张模型卡正是把架构声明变成审阅者可以核查的内容。

• 首批独立基准测试——验证V4.1基础版是否真正修复了V4报告中已知的差距:128K以上的检索能力,以及报告自身所估计的、落后前沿模型约三至六个月的推理短板。

• V4.1 Pro 的命名与时机——teortaxesTex 所称的 DeepSeek V4.1 Pro 是否作为独立卡片出现,以及在 Flash 之后多快落地。

与此同时该做什么

目前还没有任何可调用的东西。DeepSeek V4.1 Pro尚未上线任何API,将生产环境接入一个仅有两天的测试版模型ID本身就是个错误。不过,改道消息确实改变了当前DeepSeek V4 Pro用户的一项计算:他们正以旗舰价格付费使用的模型即将被官方宣布为已被取代,这不利于现在就签署长期承诺,而更倾向于在下次购买决策之前观望Flash的发布。

这种观望姿态正是路由层发挥价值的地方。在 OrcaRouter 上,DeepSeek V4 Flash、DeepSeek V4 Pro 和 DeepSeek-V4-Flash-Vision-Exp 可通过一个 API 访问,按 DeepSeek 官方列表价原价透传,零加价——因此供应商侧的价格变动或路由调整会在当天同步到我们这边,而不是等到费率表更新。当 V4.1 Flash 正式发布,以及之后如果 V4.1 Pro 出现,同样的配置便是低成本切换的采用方式:将一部分流量发送到新模型,保留稳定模型作为自动故障转移,并让路由 DSL 决定哪些调用值得使用未经充分验证的模型,哪些应继续使用主力模型。

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro (captured September 3, 2026) showing the Tools, JSON and Reasoning badges, a 1M-token context, 384K max output, text-only input, a p50 time-to-first-token of 635 ms, and the description 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context, top-tier reasoning + agentic tool use.'

两句话路线图的要点

解读9月9日信号最直接的方式是:DeepSeek已经以尽可能轻描淡写的方式告诉市场,其当前旗舰产品只是一个权宜之计。V4.1 Flash是发布的证明,路线转向等于承认目前在售的DeepSeek V4 Pro已被取代,而"直到V4.1 Pro发布"这一句话就是路线图。这句话中缺失的,是能将DeepSeek V4.1 Pro从传闻转变为产品决策的一切要素:日期、规格、价格、基准测试,以及除某个追踪者的解读之外、能证明V4论文中的架构承诺已真正兑现的任何证据。在DeepSeek发布正式消息之前,理性的立场就是teortaxesTex所持的立场——将V4.1 Pro视为真实存在,将其每一个细节视为未经证实,并将9月10日左右的Flash发布视为V4.1架构的第一个可验证部分。

虽然 DeepSeek V4.1 Pro 尚未可供调用,但目前通过一个 API 即可访问的旗舰模型是 DeepSeek V4 Pro on OrcaRouter —— 按 DeepSeek 官方列表价格直供,零加价。

而且,如果你想直接对比,DeepSeek模型表示V4 Pro流量将重新路由至:OrcaRouter上的DeepSeek V4 Flash

本文中的对比2

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新