
GPT-6 Sol Pro vs DeepSeek V4 Pro:固定费率对阵时间表
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77代码
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0345智能76代码
GPT-6 Sol Pro 和 DeepSeek V4 Pro 是目前通过 API 运行严肃推理工作负载的两种最便宜且可信的方案,而它们的定价原则完全不同。GPT-6 Sol——即 gpt-6-sol-pro 配置所运行的厂商模型,自 2026 年 9 月 22 日起全面可用——每天每个小时都按每百万输入 token 2.00 美元、每百万输出 token 10.00 美元计费。DeepSeek V4 Pro 是开放权重的旗舰模型,其 0813 检查点于 2026 年 8 月 13 日全面可用,在一周的大部分时间里价格为 0.66 美元和 1.98 美元,而在工作日早晨的两个狭窄时段,价格正好翻倍。任何只给出单一费率的比较,都只报出了一半的价格。
时间表才是关键。这场较量中的其他一切——指数评分、上下文窗口、许可条款——都取决于这样一个事实:这两家供应商中的一家已经决定,其标价是时钟的函数。
每条价格明细究竟是什么
GPT-6 Sol 的价目表只有一行。输入 $2.00,缓存输入 $0.20,缓存写入 $2.50,输出 $10.00 每百万 tokens,并且当输入超过某一阈值时会触发长上下文重新定价,一旦越过该阈值,整个请求都按新价格计费。这里没有时间维度,也没有促销窗口期。OpenAI 于 9 月 22 日将前代模型的价格下调至这些数字,并称其为永久价格。
DeepSeek 的费率表是一张表格。根据该供应商自家定价页面上的内容:
• 非高峰时段输入 — 每百万 tokens $0.66,缓存未命中;每百万 tokens $0.022,缓存命中
• 非高峰输出 — 每百万 tokens 1.98 美元
• 峰值输入 — 每百万 token 1.32 美元,缓存未命中;每百万 token 0.044 美元,缓存命中
• 峰值输出 — 每百万 token 3.96 美元
• 高峰时段 — UTC 01:00–04:00 和 06:00–10:00,周一至周五,中国法定节假日除外
• 其他所有时段——非高峰时段,包括整个周末,该规定自北京时间2026年8月23日午夜起生效
一周168小时中的7小时高峰时段,七天中的五天,按较高费率计算约占日历时间的21%,按较低费率计算则占79%。因此,对DeepSeek V4 Pro 诚实的单一数字总结既不是 $0.66,也不是 $1.32——而是在两者之间,具体取决于你的流量形态,而不是供应商的慷慨程度。
这张表源自的那次重新定价
值得注意的是,这套价格体系推行得有多新近,因为几乎每一个对比页面至今引用的仍是它所取代的那个数字。2026年5月22日,DeepSeek将V4 Pro的限时折扣转为永久定价——降幅约75%,输入价格降至每百万token约0.435美元,输出价格降至约0.87美元。
北京时间2026年8月17日午夜,情况发生了逆转,而且远不止如此。高峰/非高峰系统上线,受影响的各档平均涨幅约为3.5倍,最高达12倍——这12倍恰好落在缓存命中输入费率上,该费率在高峰期从每百万 token ¥0.025 涨至 ¥0.30。缓存未命中输入上涨约200%,输出上涨约350%。六天后,又加入了周末豁免,这为任何能够迁移批处理作业的人挽回了一部分涨幅。
由此可以推出两个结果。第一,任何告诉你 DeepSeek V4 Pro 是“不到一美元”模型的页面,引用的都是已被两次取代的价目表。第二,涨幅的形态透露了 DeepSeek 的优化方向:涨幅比例最大的是缓存命中,而这一费率最关乎的,恰恰是最初让该模型具有吸引力的那种工作负载——长时间反复重发同一稳定前缀的智能体循环。

大家都在引用的那个指数数值已经停用了
Artificial Analysis 是本次对比所采用的中立评测框架,它在 2026 年期间已多次对其智能指数(Intelligence Index)进行版本更新。在当前榜单上,GPT-6 Sol 在最高推理强度下得分为 48,每项指数任务成本为 1.06 美元。DeepSeek V4 Pro 在 0813 检查点、最高推理强度下得分为 36,每项指数任务成本为 0.67 美元。
关于 DeepSeek 流传的数字是 53。这个数字是真实的,而且确实公布过——是在该指数较早的一个修订版中,在那次改动了大多数模型得分的重新版本化之前。把一篇 v4.3 之前的文章里拿到的 53 与当前的 48 相比,就是把一项已弃用的测量与一项仍然有效的测量相比较,而这会造成这场对比中最常见的一个错误:声称这两个模型彼此相差不到一分。在当前指数上,它们相差十二分,而每完成一项任务的价格差距并不是标称费率所暗示的 3 倍,而是更接近 1.6 倍,因为 DeepSeek 在得出答案时会消耗更多 token。
另外两个独立的数据点也应与这些并列放在一起,二者都按其真实属性加以标注。Vals AI 在隔离测试框架下运行,将 DeepSeek V4 Pro 在 SWE-bench Verified 上的成绩定为 96.40%,每次测试成本为 0.103 美元——在该榜单上仅次于 Claude Opus 5 的 97.00%,且每次测试的成本便宜得多。Artificial Analysis 的编程智能体榜单显示,其在 Terminal-Bench 4.0 上为 14%,而 GPT-6 Sol 为 44%。第一个数字说明 DeepSeek 在一项狭窄、定义明确的编程任务上具有竞争力。第二个数字说明它在智能体终端任务上不具备竞争力。两者都是真的,只是衡量的是不同的东西。
当这两个模型存在结构性差异,而不仅仅是定价不同时
• 许可 — GPT-6 Sol 是封闭 API,不公开权重;DeepSeek V4 Pro 采用 MIT 许可,在 Hugging Face 上公开检查点,包括用于继续预训练的基础变体
• 最大输出 — GPT-6 Sol 128,000 tokens,对比 DeepSeek V4 Pro 384,000 tokens,上限是其三倍,输出费率却仅为其五分之一
• 上下文窗口 — GPT-6 Sol 1,050,000 个 token,对比 DeepSeek V4 Pro 1,048,576 个 token,实际上完全相同
• 模态 — 输入和输出均为文本;两者在 API 上都不接受图像
• 长上下文定价——GPT-6 Sol 在超过其输入阈值后,会对整个请求重新定价;DeepSeek V4 Pro 的高峰/非高峰时段方案是它唯一的定价结构
• 规模——DeepSeek V4 Pro 是一个 1.6 万亿参数的混合专家模型,每个 token 有 490 亿活跃参数;OpenAI 并未公布 GPT-6 Sol 的可比数据
关于那个参数数量,有一点说明,因为它常常会引起混淆:某些列表中出现的 1.7 万亿这个数字,是包含可选 DSpark 推测解码模块在内的 Hugging Face 包大小,而不是一个参数规模更大的目标模型。已公布的架构总参数量为 1.6T。用四舍五入后的徽章数值相减来推断草稿模块的大小,并不是有效的计算;把较大的数字解读为模型变大了的证据,也同样不成立。

那次撤回,才是支持开放权重的真正理由
2026年9月9日,DeepSeek 宣布将逐步淘汰 V4 Pro,并称从9月14日04:00 UTC起,所有发往 deepseek-v4-pro 模型字符串的请求都将被路由至 DeepSeek V4.1 Flash,并按 Flash 费率计费,直到 V4.1 Pro 模型发布为止。该模型字符串仍会响应。但它背后的模型将不再是任何人曾基准测试过的那个。
开发者提出反对,重定向随后被撤回。DeepSeek 的更新日志现在表示,V4 Pro API 服务在 9 月 14 日之后继续提供,计费保持不变,且价格表中仍将 deepseek-v4-pro 列为有效条目,有其独立费率,也没有停用标记。此前的公告页面仍保留着路由相关措辞,因此两份文档相互矛盾——而实时价格页面所描述的,才是你实际调用时真正会发生的情况。
那一期是整个对决中最有力的论据,而且它并非价格论据。闭源模型可能会按供应商的时间表被重新定价、重新路由或退役,而唯一的应对办法就是迁移。一个在公共仓库上以 MIT 许可发布权重的模型,可以由你自己的基础设施来提供服务,这意味着你评估过的那个检查点,就是你持续提供服务的那个检查点——无论供应商的路线图在六周后怎么说。DeepSeek 展示了这种风险,并在同一个两周内给出了缓解方案。
平心而论,需要权衡的是,自行托管一个1.6万亿参数的模型并不是大多数团队会轻率做出的决定。它是一个有着真实固定成本的真实选项,而不是免费的对冲。
路由层改变算术之处
DeepSeek V4 Pro 已在 OrcaRouter 的目录中。当前检查点和基础模型字符串均可解析——deepseek/deepseek-v4-pro-0813 与 deepseek/deepseek-v4-pro——按非高峰时段标价计费,高峰倍率按同样的 UTC 时间表生效,上下文窗口为 1,048,576 个 token,输出上限为 384,000 个 token,首 token 延迟中位数(p50)为 3.56 秒,这是在我们自己的模型页面上测得的。供应商目录价原样透传,不额外加价,也就是说,在这种情况下,高峰/非高峰的分界线出现在你账单上的那一刻,与它出现在 DeepSeek 账单上的那一刻完全相同。
GPT-6 Sol 不是我们提供的渠道之一,因此这里没有任何关于通过我们获取其价格的声明。

调度正是让单一端点在此处具有独特价值的原因。一个可以转移的工作负载,其价值是無法转移的两倍,而转移它是一个路由决策,而非迁移——相同的密钥、相同的请求形态,只是换一个时段或背后的模型不同。将 DeepSeek V4 Pro 与 DeepSeek V4.1 Flash 配对在同一端点上,是这一理念更精准的体现:Flash 模型在输入上的成本比 V4 Pro 的非高峰费率便宜 4.4 倍,在输出上便宜 3.3 倍,且拥有相同的上下文窗口和相同的高峰时段,这使其成为那些完全不需要更大模型的流量的天然去处。自动故障转移之所以重要,原因一如既往——你的流水线所依赖的廉价层级不应成为单点故障。
决策规则
• 可调度的批处理与离线作业——DeepSeek V4 Pro,并对它进行调度。全年 95% 的时间按 $0.66 和 $1.98 计费,周末则完全处于非高峰时段,这是本榜单上最便宜的可信费率,输入价格仅为其三分之一,输出价格仅为其五分之一。
• 落在高峰时段内的延迟敏感型交互流量——GPT-6 Sol。固定的 $2.00 和 $10.00 比 DeepSeek 的非高峰费率更贵,比什么都没有更便宜,但这是可以提前知道的;而且每天有两个小时,它在输出上是两者中更便宜的那个。
• 采用大型稳定前缀的智能体循环——在做选择之前,先算清缓存命中的账。DeepSeek 的缓存命中输入在非高峰时段为 $0.022,是 GPT-6 Sol 的 $0.20 的九分之一,但这也正是 DeepSeek 在高峰时段上调了十二倍的那一行。优势确实存在,但它取决于时钟。
• 任何受监管的事物,或任何你承受不起被重新路由的事物——DeepSeek V4 Pro,从 MIT 检查点自托管。九月撤回事件就是典型案例,而且比起任何按 token 的比较,它都更能成为接受固定成本的理由。
• 凡是需要达到智能体能力区间顶端的东西——GPT-6 Sol。十二个指数点和 Terminal-Bench 上的三十分并非四舍五入的差异,而 DeepSeek 自己厂商报告的数字也无法弥合这些差距。
统一费率与分时费率表都是诚实的定价设计。它们只是回答了不同的问题:一个告诉你一个 token 要花多少钱,另一个告诉你当你需要这个 token 时要花多少钱。
本文中的对比3
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
