
DeepSeek V4.1 Pro 正在开发中:路由通知、架构承诺,以及尚不明确之处
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77代码
- google新Google: Gemini 3.8 Flash2026-09-0241智能76代码
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72代码
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82代码
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0340智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123智能49代码
DeepSeek V4.1 Pro尚未发布、上线、评测或定价。它不出现在任何模型页面上,没有模型卡,也没有任何端点回应其名称——然而在2026年9月9日,DeepSeek技术团队的一名成员在一则关于DeepSeek V4 Pro流量届时将如何处理的简短两句通知中,几乎顺带地公开证实了它的存在。以@tianyi账号发帖的崔天翼写道,一旦DeepSeek V4.1 Flash正式上线(预计在北京时间9月10日左右),所有指向DeepSeek V4 Pro的API请求都将被重新路由至DeepSeek V4.1 Flash,并按Flash较低的费率计费,这一安排将持续到DeepSeek V4.1 Pro本身上线为止。
那段尾随从句才是新闻。迄今为止,V4.1 系列仅通过为期两天的“中间版本”测试而浮出水面,该测试于 9 月 8 日开始提供服务,模型 ID 为 deepseek-v4.1-flash-expires-on-0910,同时还附有一份反馈表单,询问测试者 V4.1 Flash 是否可以在生产中取代 DeepSeek V4 Pro。将 DeepSeek V4.1 Pro 命名为路由窗口的终点,是这家公司首次在内部承认这款旗舰产品。化名 DeepSeek 观察者 teortaxesTex 引用了这份通知,并做了同样的解读——随后又提出了一个更强的说法:DeepSeek V4.1 Pro 的存在证实 DeepSeek 已经“解决了 V4 系列架构上的问题,正如他们在 V4 论文中承诺要做的那样。”
在细节之前先说明一下消息来源。以下关于 DeepSeek V4.1 Pro 的所有内容都建立在两件事之上:一条 DeepSeek 技术团队成员发布的带日期社交帖子(几小时内得到多家中国媒体的佐证),以及某位追踪者对其的解读。目前没有技术报告,没有参数数量,没有发布日期,今天也无法调用该模型。路由说明是一种陈述;"架构已解决"的说法是一种推断。本文把两者区分开来,因为它们是不同类型的证据。
9月9日通知实际所说的内容
北京时间9月9日15:14左右,崔天屹在X上发文称,继续以溢价销售旧版DeepSeek V4 Pro已不再合理。他的理由大意是:内外部测试显示,V4.1 Flash模型在性能、成本、速度和总处理时间上全面超越DeepSeek V4 Pro,因此,为一款性能较弱的模型向用户收取更多费用、提供更慢的速度并占用更多算力是不合适的。因此,一旦V4.1 Flash正式上线,在V4.1 Pro上线之前,对V4 Pro模型的请求将统一路由至V4.1 Flash,并按Flash定价计费。
那个“全面超越”的说法是DeepSeek团队自行宣称的,并非独立验证结果:发布帖没有附带任何基准测试表,V4.1 Flash测试版也没有模型卡。真正可以验证的是计划的轮廓——DeepSeek打算在Flash正式上线的那一刻就把当前的Pro层级视为过时,并在下一代Pro问世之前,将Pro流量转移到更便宜的模型上。
今天致电 DeepSeek V4 Pro 意味着什么
对于任何正在运行当前旗舰产品的用户——DeepSeek V4 Pro,这款于8月中旬达到GA的1.6万亿参数MoE——此项变更是自动的,且在服务端完成。一旦重路由生效,指定V4 Pro模型的请求将由V4.1 Flash版本响应,并按Flash费率计费,调用方无需改动任何代码。计费切换才是最犀利的部分。报道该通知的中文媒体称,新Flash费率表的最高输出价格自9月10日起为每百万token ¥8,而被其取代的Pro层级为每百万token ¥27——对于原本命中Pro的流量而言,降幅约70%,且该模型据DeepSeek团队称速度更快。作为一项同步升级与降价的公告,即便以DeepSeek自身的标准衡量,也称得上激进。

一个时间上的注意事项,因为表述的框架很重要:如果你今天持有 DeepSeek V4 Pro 的密钥,在 V4.1 Flash 真正发布之前,一切都不会改变;而有关重新路由的描述来自团队的发文及相关报道——还不是来自更新日志条目。截至上面 9 月 9 日的截图,DeepSeek 的官方模型页面仍然只列出了普通的 V4 产品线——DeepSeek V4 Flash、DeepSeek V4 Pro 和 DeepSeek-V4-Flash-Vision-Exp——表格中没有 V4.1 条目。
为什么“V4 paper”是泄密的关键
teortaxesTex的具体说法是,DeepSeek V4.1 Pro正在开发中,这证实DeepSeek已经解决了V4系列存在的架构问题,“正如他们在V4论文中所承诺的那样”。这一说法是可以查证的。DeepSeek的V4技术报告——DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence——异常坦率地指出了其设计目前尚不擅长的方面,以及未来迭代版本原本要解决的问题:
• 该报告称其自身架构“相对复杂”,并承诺“在未来的迭代中,我们将进行更全面、更严谨的研究,将架构提炼至最核心的设计。”
• 报告称,其两种训练稳定化机制——Anticipatory Routing 和 SwiGLU Clamping——在实践中有效,但其基本原理仍“未被充分理解”。
• 长上下文检索在超过128K token后仍会衰减。在报告引用的8针检索测试中,V4-Pro-Max在128K时得分约为0.92,在1M时降至约0.59——这就是“能加载百万token”与“能真正利用它们”之间的差距。
• 而 V4 系列最初仅发布文本版本;视觉能力后来才以附加的实验性编码器 DeepSeek-V4-Flash-Vision-Exp 的形式出现,而不是作为基础模型的一部分。
对照那份清单,V4.1 的故事就变得清晰起来。DeepSeek 自己对 V4.1 Flash 测试版的描述,恰恰使用了那些问题所暗示的语言——一种“新的模型结构”和从底层构建的原生多模态支持。基于同一已解决基础构建的 V4.1 Pro 是自然的下一步,这正是 teortaxesTex 所推断的。这只是一个推断,并且应该保持标注为推断:DeepSeek 尚未发布 V4.1 技术报告,而“正在开发中”除了团队成员提到 Pro 最终发布之外,并未得到确认。
证据台账——哪些已得到确认,哪些尚未确认
将9月9日的信号叠加到9月8日的beta版本上,得到的已确认事实清单很短,而未解问题清单却很长。

• 厂商声明(数小时内得到多家中国媒体的证实)——DeepSeek 有一个 V4.1 Flash 模型,计划于北京时间 9 月 10 日左右发布;DeepSeek V4 Pro 的 API 流量将路由至该模型,并按 Flash 费率计费,直到 V4.1 Pro 发布;DeepSeek 团队认为 Flash 版本在成本、速度和总时间上均优于当前的 Pro 版本。
• 合理但未经证实——DeepSeek V4.1 Pro 目前正在训练中或即将推出。teortaxesTex 的“正在进行中”没有注明日期,也没有内部来源;唯一的佐证是路由窗口本身,而它预设了 Pro 最终会出现。
• 解读——Pro 的存在证明了 V4 论文的架构承诺已经兑现。V4.1 Flash 测试版中“新结构、原生多模态”的说法指向同一方向,但目前尚未发布任何 V4.1 架构可供对照验证。
• 未知 — V4.1 Pro 的规格、参数数量、上下文窗口、定价、发布日期,以及它是否像 DeepSeek V4 Flash 和 DeepSeek V4 Pro 那样提供开放权重。当前的 V4.1 Flash 测试版仅限 API 使用且即将到期,因此开放权重的问题确实是悬而未决的,而不仅仅是尚未回答。
看什么
• 北京时间9月10日 — V4.1 Flash正式发布、其新费率表,以及V4 Pro改道的开始。如果真如所述,从那天起,"DeepSeek V4 Pro"模型ID将开始以Flash价格返回V4.1架构。
• V4.1 技术报告或模型卡——测试版两者都没有,而第一张模型卡正是把架构声明变成审阅者可以核查的内容。
• 首批独立基准测试——验证V4.1基础版是否真正修复了V4报告中已知的差距:128K以上的检索能力,以及报告自身所估计的、落后前沿模型约三至六个月的推理短板。
• V4.1 Pro 的命名与时机——teortaxesTex 所称的 DeepSeek V4.1 Pro 是否作为独立卡片出现,以及在 Flash 之后多快落地。
与此同时该做什么
目前还没有任何可调用的东西。DeepSeek V4.1 Pro尚未上线任何API,将生产环境接入一个仅有两天的测试版模型ID本身就是个错误。不过,改道消息确实改变了当前DeepSeek V4 Pro用户的一项计算:他们正以旗舰价格付费使用的模型即将被官方宣布为已被取代,这不利于现在就签署长期承诺,而更倾向于在下次购买决策之前观望Flash的发布。
这种观望姿态正是路由层发挥价值的地方。在 OrcaRouter 上,DeepSeek V4 Flash、DeepSeek V4 Pro 和 DeepSeek-V4-Flash-Vision-Exp 可通过一个 API 访问,按 DeepSeek 官方列表价原价透传,零加价——因此供应商侧的价格变动或路由调整会在当天同步到我们这边,而不是等到费率表更新。当 V4.1 Flash 正式发布,以及之后如果 V4.1 Pro 出现,同样的配置便是低成本切换的采用方式:将一部分流量发送到新模型,保留稳定模型作为自动故障转移,并让路由 DSL 决定哪些调用值得使用未经充分验证的模型,哪些应继续使用主力模型。

两句话路线图的要点
解读9月9日信号最直接的方式是:DeepSeek已经以尽可能轻描淡写的方式告诉市场,其当前旗舰产品只是一个权宜之计。V4.1 Flash是发布的证明,路线转向等于承认目前在售的DeepSeek V4 Pro已被取代,而"直到V4.1 Pro发布"这一句话就是路线图。这句话中缺失的,是能将DeepSeek V4.1 Pro从传闻转变为产品决策的一切要素:日期、规格、价格、基准测试,以及除某个追踪者的解读之外、能证明V4论文中的架构承诺已真正兑现的任何证据。在DeepSeek发布正式消息之前,理性的立场就是teortaxesTex所持的立场——将V4.1 Pro视为真实存在,将其每一个细节视为未经证实,并将9月10日左右的Flash发布视为V4.1架构的第一个可验证部分。
虽然 DeepSeek V4.1 Pro 尚未可供调用,但目前通过一个 API 即可访问的旗舰模型是 DeepSeek V4 Pro on OrcaRouter —— 按 DeepSeek 官方列表价格直供,零加价。
而且,如果你想直接对比,DeepSeek模型表示V4 Pro流量将重新路由至:OrcaRouter上的DeepSeek V4 Flash。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
