
DeepSeek V4 Pro API 定价:非高峰时段 $0.73/$2.18,以及 9 月 14 日的关停为何被取消
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 223 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
DeepSeek V4 Pro 不会退役。2026 年 9 月 11 日,DeepSeek 表示将在 9 月 14 日之后继续通过其 API 提供该模型,计费方式保持不变——这推翻了此前两天宣布的一项计划:原本所有 deepseek-v4-pro 请求都将被改道至DeepSeek V4.1 Flash,并按 Flash 的费率计费。对于任何提示词、temperature 设置和工具调用 schema 都是针对 V4 Pro 调校的人来说,这才是本周真正重要的事实:你所基于开发的那个模型仍留在原处,你原本可能安排在本周一的迁移也不必进行了。
价格则是另一回事,而这个页面有一个月都写错了。DeepSeek V4 Pro 不再按每百万 token 0.44 美元/0.88 美元收费。在非高峰时段,OrcaRouter 上的计费为每 100 万 token 输入 0.726 美元、输出 2.178 美元,在高峰时段内翻倍至 1.452 美元/4.356 美元,缓存读取为 0.024 美元。周末现在完全属于非高峰时段。而厂商自己的价目表——也就是 DeepSeek API 文档中的那份——在同一张价格表的脚注中附有延续通知,这差不多就是定价页面所能达到的最接近一手来源的程度了。
DeepSeek 实际上说了什么,以及它推翻了什么
时间顺序很重要,因为这三则公告中有两则彼此相反,而中间那则正是人们记得的。
• 9 月 9 日 — DeepSeek 告知用户,在 V4.1 Pro 发布之前,对 V4 Pro 的请求将被路由至 DeepSeek V4.1 Flash,并按 V4.1 Flash 的费率计费。
• 9月10日 — V4.1 Flash 发布,DeepSeek 将切换时间定在一个固定时刻:北京时间 2026 年 9 月 14 日 12:00,此后 V4 Pro 将下线,其流量将由 Flash 承接。
• 9月11日——DeepSeek 立场反转。其原话如今被逐字引用,作为脚注出现在自家 API 文档的“模型与定价”页面上:“应用户需求,我们决定在 2026 年 9 月 14 日之后继续为 DeepSeek V4 Pro 提供 API 服务,计费方式保持不变。如有任何变动,我们将另行通知。”
那是厂商在谈论自家产品,也是这里能拿到的最有力的来源——但请看清它解决了什么、又没有解决什么。它确定的是延续性与计费:V4 Pro 继续保留,费率按现行标准执行。它并未承诺任何时间期限。我们将另行通知就是承诺的全部内容,而同一句话也为该方案日后的回归留了口子。如果你要做跨多个季度的承诺,请按“能迁走的模型”来规划,而不是按“能留下的模型”。
迫使这一逆转的强烈反对声值得理解,因为它对应着一个你可能即将自己做出的决定。开发者反对的并非 V4.1 Flash——DeepSeek 称其在性能、价格、速度和总任务耗时上都优于 V4 Pro——而是这种自动替换。更换稳定模型 ID 背后的模型,会在不改变代码的情况下改变行为:调优过的提示词、可用的 temperature、能正常解析的工具调用 schema,都是特定检查点的属性。CLS(科创板日报)、36氪、IT之家和凤凰网的报道,以及 TheBlockBeats 的英文报道,都描述了 DeepSeek 先是推迟、继而放弃这一计划;DeepSeek 自己的文档则清晰地呈现出这种对比,因为旧版 deepseek-v4-flash 名称已被弃用,如今服务于 V4.1 Flash,而这一切换保留了下来。Pro 的切换则没能站住脚。
今天的价格,已对照供应商自己的费率卡进行核对

有两个数字很重要,它们是两种货币下的相同标价。
• 非高峰时段(下方高峰时段窗口之外的每个小时)—— 缓存未命中时,输入每 100 万 $0.726,或 ¥4.5;输出 $2.178,或 ¥13.5;缓存命中输入 $0.024,或 ¥0.15。
• 高峰时段 — 恰好翻倍。输入 $1.452 / ¥9,输出 $4.356 / ¥27,缓存命中输入 $0.048 / ¥0.30。
• DeepSeek 自己的美元换算——厂商文档把同一份人民币价目表印成非高峰时段输入 $0.66 / 输出 $1.98,高峰时段 $1.32 / $3.96,缓存命中为 $0.022 和 $0.044。与 OrcaRouter 的美元数字之间的差距在于双方换算时采用的汇率,而不是额外加收的 token 费用:OrcaRouter 按供应商费率原样传递,不加价,所以列表上的数字就是你实际支付的数字。
• V4 Pro 没有免费套餐。目录中提供免费的 Flash 套餐,但旗舰版仅限付费使用。
• 先说规格表作为背景——V4 Pro 是一款开放权重模型,采用 MIT 许可证,总参数 1.6T,每 token 激活 49B,上下文窗口 100 万 token,最多可输出 384K token,并发上限为 500。Artificial Analysis 列出的输出速度为每秒 72.3 个 token。
支撑这一切的模型版本是 DeepSeek-V4-Pro-0813,自 8 月 13 日正式发布以来始终未变——而这正是关键所在。9 月 11 日,检查点本身没有任何改动;唯一改变的,是关于其未来的决定。
高峰、非高峰,以及改变计算的周末规则
本页早先版本称将于8月17日推出的高峰/非高峰方案,如今已实施满一个月,并且此后已修订过一次。
• 高峰时段——UTC 周一至周五 01:00–04:00 和 06:00–10:00。换算成北京时间,即 09:00–12:00 和 14:00–18:00,正是 DeepSeek 自己的工作日。非高峰费率恰好是高峰费率的一半,而不是在高峰费率之上叠加的折扣档位。
• 周末完全属于非高峰时段。自北京时间 2026 年 8 月 23 日 00:00 起,DeepSeek 已停止在周六和周日收取高峰费率。如果你的批处理任务可以挪动,把它挪到周末能让费用减半——而对于服务美洲用户的团队来说,大部分工作周本来就落在非高峰时段,完全无需任何调度安排。
• 此次调价的幅度,对比该模型8月13日发布时的¥3/¥6——如今非高峰时段的输出价格是发布价的2.25倍,高峰输出为4.5倍;高峰缓存命中输入价格是原先¥0.025的12倍。
这里存在一种不对称,解释了为什么即便关停已被取消,迁移问题仍不断被提起。V4 Pro 的价格在8月上涨,而其继任者的价格却下降了:DeepSeek 自9月10日起将 Flash 系列 API 价格最高下调了60%。迁移的压力其实从来都不是来自9月14日的通知;通知只是让它变得紧迫。
一次请求的实际成本
按今日非高峰费率计算的三个示例。每一个在高峰时段内都会翻倍。
100K 输入 + 50K 输出 — $0.0726 + $0.1089 ≈ $0.18。
• 1M 输入 + 1M 输出 — $0.726 + $2.178 = $2.90。同样的调用在高峰时段是 $5.81,而在 8 月中旬是 $1.32。
• 智能体会话,500K 输入 + 200K 输出 — $0.363 + $0.4356 ≈ $0.80。
月度视图位于模型页面上,是检验旧有标价是否仍能描述你的账单的诚实测试:每月 1000 万 tokens、输入占比 70% 时,成本计算器算出的结果是 $11.62,若开启提示词缓存则约为 $9.16。如果你的预算是按 $0.44 制定的,那么它现在只够覆盖约 60% 的账单。
缓存是没人摆上台面的杠杆。
当费率上涨时,提示缓存变得更有价值,而不是更没价值——而原因就在于这两个数字的变化方向。在 OrcaRouter 上,如今缓存读取按每 100 万 token 0.024 美元计费,而未缓存的则为 0.726 美元,也就是说,你重新发送的任何输入都可享受 96.7% 的折扣。在本页的先前版本中,缓存费率为 0.060 美元,而输入价格为 0.442 美元,折扣为 86%。缓存读取价格下降了一半以上,而未缓存输入价格则上涨了 64%,因此缓存 token 与未缓存 token 之间的实际差距显著拉大。
对于一个每一轮都要重新发送大型系统提示词和长上下文的 agent 来说,缓存输入决定了账单是随对话长度增长,还是不会增长。那条实用规则没有变,也值得再说一遍:把稳定的系统提示词和参考资料放在最前面,把易变的内容放在最后,这样你重新发送的前缀才能真正命中缓存。在这个模型上,这一个结构性选择的价值,超过它下面任何路由或调度决策。
V4 Pro 定价与同类产品的比较

目录标价按每 1M token 的输入/输出计,核对日期为 2026-09-12,并与 V4 Pro 的错峰价格 $0.726/$2.178 作对比。自本页首次发布以来,其中两项价格已经变动,而其中一项会改变结论。
• Claude Fable 5 — $10 / $50。V4 Pro 的输入成本便宜 13.8 倍,输出成本便宜 23 倍。
• Claude Opus 5 — $5 / $25。6.9× / 11.5×。
• GPT-5.6 Sol — 272K 上下文以内 $4 / $20,超出后 $8 / $30。较短档为 5.5× / 9.2×,较长档为 11× / 13.8×。
• Kimi K3 — 3 美元 / 15 美元。4.1× / 6.9×。
• Qwen3.8 Max — $2 / $6。2.8× / 2.8×。
• Grok 4.5 — $2 / $6。2.8× / 2.8×。
• Gemini 3.6 Flash — $0.75 / $3.75。输入价格大致持平,为 1.03 倍,输出价格则为 1.7 倍。自本页撰写以来,其价格已减半。
• MiniMax M3 — $0.30 / $1.20。现在在两项上都比 V4 Pro 便宜:V4 Pro 的输入成本高出 2.4×,输出成本高出 1.8×,而两者的上下文窗口同为 1M token。
• DeepSeek V4 Flash — 目录上为 $0.242 / $0.726。两项价格都大约便宜 3 倍,同样是 1M 上下文。
所以,诚实的表述已经变了,本页应当如实说明,而不是继续沿用旧有的最高级说法。DeepSeek V4 Pro 不再是榜单上最便宜的 100 万上下文模型:Gemini 3.6 Flash 和 MiniMax M3 都比它更便宜,而 MiniMax M3 在做到这一点的同时还匹配了上下文窗口。V4 Pro 仍然以超过一个数量级的优势,是前沿梯队中最便宜的那个——那份榜单上每一款西方旗舰级模型,在两条价格线上都是它的数倍。如果问题是“尽可能便宜的 100 万上下文调用”,答案已不再是这个模型。如果问题是“表现像前沿模型的最便宜模型”,目前它仍然是。
当V4 Pro是错误的选择时
• 如果你的流量在北京白天时段最为集中。高峰时段费率翻倍,而且高峰窗口正好落在中国的工作日。如果你的用户在美洲,你的大部分流量本来就落在非高峰时段,这是一个实实在在的结构性优势。如果你是在为中国用户构建产品,那么在做出承诺之前,请明确测算高峰账单——并检查周末规则是否能帮你把任何东西挪到别处。
• 如果你的提示词很短。在大约 10K token 的上下文以下,旗舰层级就是在浪费容量。目录中 DeepSeek V4 Flash 的定价为 $0.242/$0.726,能以约三分之一的价格处理同样的 1M 上下文,而对于真正简短的任务,更便宜的模型依然更胜一筹。
• 如果你需要视觉能力。V4 Pro 仅支持文本——不支持图像或音频输入——Artificial Analysis 也将其输入模态列为文本。如果关键就在于模态,Gemini 3.6 Flash 或 Claude Fable 5 会是更合适的选择。DeepSeek 自家的 API 在这里同样值得一提:它现在用 V4.1 Flash 来承接其旧版 flash 模型名的请求,而 V4.1 Flash 确实接受图像。
• 如果你看重的是登顶基准的原始分数,而不是每上下文的成本。在 Artificial Analysis 当前的评分标准下,V4 Pro 在 Intelligence Index 上得 36 分——撰写本文时为 113 个模型中的第 8 名——并在 OrcaRouter 目录收录的 Coding index 上得 69 分。这具有竞争力,但并非领先:Claude Fable 5、Claude Opus 5 和 GPT-5.6 Sol 在编码方面得分都高于它。V4 Pro 的卖点是以每 token 价格的一小部分提供接近前沿的能力,而不是在每张榜单上都位居榜首。
如何在 OrcaRouter 上调用它?

DeepSeek V4 Pro 托管在 OrcaRouter 上,使用模型 ID deepseek/deepseek-v4-pro,通过 api.orcarouter.ai/v1 上兼容 OpenAI 的端点,按提供商费率提供服务,零加价。从现有 OpenAI 客户端迁移只需更改基础 URL 和模型 ID,别无其他。
这一反转改变了你该采取的应对方式。如果你的日程表上原本排着9月14日的迁移——因为 V4 Pro 即将下线,所以要从 V4 Pro 改指向 DeepSeek V4.1 Flash——那你可以把它从日程表上划掉,或者至少把它从截止期限降级为一次测试。两个模型共用一个 OrcaRouter 密钥,所以比较它们不过是在请求里改一下模型 ID,而不必再签一份合同、再接入一套 SDK;而如果你确实想让 V4.1 Flash 在真实流量上接受评估,又不想把生产路径押在它身上,那么自动故障转移就是一种低风险的方式,让它承接线上请求,同时 V4 Pro 仍作为回退。这就是9月11日那个决定的实际形态:选择权仍在你手里,而且始终可以逆转。
对定价页而言,真正重要的诚实说明:我们只负责把请求路由到模型,并不设定其价格。$0.726/$2.178 的低谷时段价格是 DeepSeek 费率原样传导,DeepSeek 调整时它们也会随之变动——这正是本页标注日期的原因,也是你正在阅读的这个版本是重写而非追加的原因。
来源和日期
本页的价格与规格已于 2026-09-12 重新核实。DeepSeek V4 Pro 以及对比中每一款机型的美元数字均读取自OrcaRouter 模型目录,并与同日核对;参数规模、许可、上下文窗口、模态与速度数据来自 Artificial Analysis 的 DeepSeek V4 Pro 0813 模型页面。人民币汇率、高峰时段以及 9 月 11 日的继续通知出自 DeepSeek 自家的《模型与定价》文档,该文档在价格表脚注中逐字载有该声明。三步式公告序列——9 月 9 日的路由通知、9 月 10 日推迟至北京时间 9 月 14 日 12:00,以及 9 月 11 日的反转——由 CLS(科创板日报)、36Kr、IT之家和凤凰网报道,英文报道则来自 TheBlockBeats。8 月 23 日的周末计费规则和 9 月 10 日的 Flash 降价来自 DeepSeek 的公告,由 IT之家、《澎湃新闻》和《21 世纪经济报道》报道。
关于可信度,最后再说明一点,因为这个具体价格在一个月内已经变动了三次——8月13日的发布价、8月17日的高峰/非高峰价、8月23日的周末修订。任何没有标注日期的“V4 Pro 定价”页面都应视为不可用。这个页面的较早版本曾报价 $0.44/$0.88,以及 Artificial Analysis 智能指数 44.3;这两者在写下时都是正确的,但都没能撑过这个月。
本文中的对比3
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
