主视觉标题卡显示“GPT-6 Sol Pro vs DeepSeek V4 Pro”,副标题为“固定费率对时间表”,配有一组“GPT-6 Sol Pro”/“DeepSeek V4 Pro”标签,页脚一行文字为“厂商标价;数据依据 Artificial Analysis。”,右下角为真实的 OrcaRouter 徽标。
Guides & Insights

GPT-6 Sol Pro vs DeepSeek V4 Pro:固定费率对阵时间表

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

GPT-6 Sol Pro 和 DeepSeek V4 Pro 是目前通过 API 运行严肃推理工作负载的两种最便宜且可信的方案,而它们的定价原则完全不同。GPT-6 Sol——即 gpt-6-sol-pro 配置所运行的厂商模型,自 2026 年 9 月 22 日起全面可用——每天每个小时都按每百万输入 token 2.00 美元、每百万输出 token 10.00 美元计费。DeepSeek V4 Pro 是开放权重的旗舰模型,其 0813 检查点于 2026 年 8 月 13 日全面可用,在一周的大部分时间里价格为 0.66 美元和 1.98 美元,而在工作日早晨的两个狭窄时段,价格正好翻倍。任何只给出单一费率的比较,都只报出了一半的价格。

时间表才是关键。这场较量中的其他一切——指数评分、上下文窗口、许可条款——都取决于这样一个事实:这两家供应商中的一家已经决定,其标价是时钟的函数。

每条价格明细究竟是什么

GPT-6 Sol 的价目表只有一行。输入 $2.00,缓存输入 $0.20,缓存写入 $2.50,输出 $10.00 每百万 tokens,并且当输入超过某一阈值时会触发长上下文重新定价,一旦越过该阈值,整个请求都按新价格计费。这里没有时间维度,也没有促销窗口期。OpenAI 于 9 月 22 日将前代模型的价格下调至这些数字,并称其为永久价格。

DeepSeek 的费率表是一张表格。根据该供应商自家定价页面上的内容:

• 非高峰时段输入 — 每百万 tokens $0.66,缓存未命中;每百万 tokens $0.022,缓存命中

• 非高峰输出 — 每百万 tokens 1.98 美元

• 峰值输入 — 每百万 token 1.32 美元,缓存未命中;每百万 token 0.044 美元,缓存命中

• 峰值输出 — 每百万 token 3.96 美元

• 高峰时段 — UTC 01:00–04:00 和 06:00–10:00,周一至周五,中国法定节假日除外

• 其他所有时段——非高峰时段,包括整个周末,该规定自北京时间2026年8月23日午夜起生效

一周168小时中的7小时高峰时段,七天中的五天,按较高费率计算约占日历时间的21%,按较低费率计算则占79%。因此,对DeepSeek V4 Pro 诚实的单一数字总结既不是 $0.66,也不是 $1.32——而是在两者之间,具体取决于你的流量形态,而不是供应商的慷慨程度。

这张表源自的那次重新定价

值得注意的是,这套价格体系推行得有多新近,因为几乎每一个对比页面至今引用的仍是它所取代的那个数字。2026年5月22日,DeepSeek将V4 Pro的限时折扣转为永久定价——降幅约75%,输入价格降至每百万token约0.435美元,输出价格降至约0.87美元。

北京时间2026年8月17日午夜,情况发生了逆转,而且远不止如此。高峰/非高峰系统上线,受影响的各档平均涨幅约为3.5倍,最高达12倍——这12倍恰好落在缓存命中输入费率上,该费率在高峰期从每百万 token ¥0.025 涨至 ¥0.30。缓存未命中输入上涨约200%,输出上涨约350%。六天后,又加入了周末豁免,这为任何能够迁移批处理作业的人挽回了一部分涨幅。

由此可以推出两个结果。第一,任何告诉你 DeepSeek V4 Pro 是“不到一美元”模型的页面,引用的都是已被两次取代的价目表。第二,涨幅的形态透露了 DeepSeek 的优化方向:涨幅比例最大的是缓存命中,而这一费率最关乎的,恰恰是最初让该模型具有吸引力的那种工作负载——长时间反复重发同一稳定前缀的智能体循环。

A two-column scoreboard card titled 'GPT-6 Sol vs DeepSeek V4 Pro - the scoreboard'. Left column 'GPT-6 Sol': AA Index, max 48; price in/out $2 / $10 flat; peak surcharge none; cost per index task $1.06; max output 128K; weights closed. Right column 'DeepSeek V4 Pro': AA Index, max 36; price in/out $0.66 / $1.98 off-peak; peak surcharge 2x, 7h a week; cost per index task $0.67; max output 384K; weights MIT, downloadable. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

大家都在引用的那个指数数值已经停用了

Artificial Analysis 是本次对比所采用的中立评测框架,它在 2026 年期间已多次对其智能指数(Intelligence Index)进行版本更新。在当前榜单上,GPT-6 Sol 在最高推理强度下得分为 48,每项指数任务成本为 1.06 美元。DeepSeek V4 Pro 在 0813 检查点、最高推理强度下得分为 36,每项指数任务成本为 0.67 美元。

关于 DeepSeek 流传的数字是 53。这个数字是真实的,而且确实公布过——是在该指数较早的一个修订版中,在那次改动了大多数模型得分的重新版本化之前。把一篇 v4.3 之前的文章里拿到的 53 与当前的 48 相比,就是把一项已弃用的测量与一项仍然有效的测量相比较,而这会造成这场对比中最常见的一个错误:声称这两个模型彼此相差不到一分。在当前指数上,它们相差十二分,而每完成一项任务的价格差距并不是标称费率所暗示的 3 倍,而是更接近 1.6 倍,因为 DeepSeek 在得出答案时会消耗更多 token。

另外两个独立的数据点也应与这些并列放在一起,二者都按其真实属性加以标注。Vals AI 在隔离测试框架下运行,将 DeepSeek V4 Pro 在 SWE-bench Verified 上的成绩定为 96.40%,每次测试成本为 0.103 美元——在该榜单上仅次于 Claude Opus 5 的 97.00%,且每次测试的成本便宜得多。Artificial Analysis 的编程智能体榜单显示,其在 Terminal-Bench 4.0 上为 14%,而 GPT-6 Sol 为 44%。第一个数字说明 DeepSeek 在一项狭窄、定义明确的编程任务上具有竞争力。第二个数字说明它在智能体终端任务上不具备竞争力。两者都是真的,只是衡量的是不同的东西。

当这两个模型存在结构性差异,而不仅仅是定价不同时

• 许可 — GPT-6 Sol 是封闭 API,不公开权重;DeepSeek V4 Pro 采用 MIT 许可,在 Hugging Face 上公开检查点,包括用于继续预训练的基础变体

• 最大输出 — GPT-6 Sol 128,000 tokens,对比 DeepSeek V4 Pro 384,000 tokens,上限是其三倍,输出费率却仅为其五分之一

• 上下文窗口 — GPT-6 Sol 1,050,000 个 token,对比 DeepSeek V4 Pro 1,048,576 个 token,实际上完全相同

• 模态 — 输入和输出均为文本;两者在 API 上都不接受图像

• 长上下文定价——GPT-6 Sol 在超过其输入阈值后,会对整个请求重新定价;DeepSeek V4 Pro 的高峰/非高峰时段方案是它唯一的定价结构

• 规模——DeepSeek V4 Pro 是一个 1.6 万亿参数的混合专家模型,每个 token 有 490 亿活跃参数;OpenAI 并未公布 GPT-6 Sol 的可比数据

关于那个参数数量,有一点说明,因为它常常会引起混淆:某些列表中出现的 1.7 万亿这个数字,是包含可选 DSpark 推测解码模块在内的 Hugging Face 包大小,而不是一个参数规模更大的目标模型。已公布的架构总参数量为 1.6T。用四舍五入后的徽章数值相减来推断草稿模块的大小,并不是有效的计算;把较大的数字解读为模型变大了的证据,也同样不成立。

Screenshot of OpenAI's developer model page for GPT-6 Sol, captured 23 September 2026, showing the model id gpt-6-sol, a 1,050,000-token context window with 922,000 maximum input tokens and a 128,000-token output ceiling, an April 20, 2026 knowledge cutoff, text and image input with text output, reasoning effort values of none, low, medium, high, xhigh and max with medium as the default, and Standard pricing of $2.00 input, $0.20 cached input, $2.50 cache writes and $10.00 output per million tokens.

那次撤回,才是支持开放权重的真正理由

2026年9月9日,DeepSeek 宣布将逐步淘汰 V4 Pro,并称从9月14日04:00 UTC起,所有发往 deepseek-v4-pro 模型字符串的请求都将被路由至 DeepSeek V4.1 Flash,并按 Flash 费率计费,直到 V4.1 Pro 模型发布为止。该模型字符串仍会响应。但它背后的模型将不再是任何人曾基准测试过的那个。

开发者提出反对,重定向随后被撤回。DeepSeek 的更新日志现在表示,V4 Pro API 服务在 9 月 14 日之后继续提供,计费保持不变,且价格表中仍将 deepseek-v4-pro 列为有效条目,有其独立费率,也没有停用标记。此前的公告页面仍保留着路由相关措辞,因此两份文档相互矛盾——而实时价格页面所描述的,才是你实际调用时真正会发生的情况。

那一期是整个对决中最有力的论据,而且它并非价格论据。闭源模型可能会按供应商的时间表被重新定价、重新路由或退役,而唯一的应对办法就是迁移。一个在公共仓库上以 MIT 许可发布权重的模型,可以由你自己的基础设施来提供服务,这意味着你评估过的那个检查点,就是你持续提供服务的那个检查点——无论供应商的路线图在六周后怎么说。DeepSeek 展示了这种风险,并在同一个两周内给出了缓解方案。

平心而论,需要权衡的是,自行托管一个1.6万亿参数的模型并不是大多数团队会轻率做出的决定。它是一个有着真实固定成本的真实选项,而不是免费的对冲。

路由层改变算术之处

DeepSeek V4 Pro 已在 OrcaRouter 的目录中。当前检查点和基础模型字符串均可解析——deepseek/deepseek-v4-pro-0813 与 deepseek/deepseek-v4-pro——按非高峰时段标价计费,高峰倍率按同样的 UTC 时间表生效,上下文窗口为 1,048,576 个 token,输出上限为 384,000 个 token,首 token 延迟中位数(p50)为 3.56 秒,这是在我们自己的模型页面上测得的。供应商目录价原样透传,不额外加价,也就是说,在这种情况下,高峰/非高峰的分界线出现在你账单上的那一刻,与它出现在 DeepSeek 账单上的那一刻完全相同。

GPT-6 Sol 不是我们提供的渠道之一,因此这里没有任何关于通过我们获取其价格的声明。

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), captured 23 September 2026, showing the model id, a 384K-token maximum output, a 1M-token context window, text-only input, Tools, JSON and Reasoning tags, an input price of $0.66 and an output price of $1.98 per million tokens, a p50 time to first token of 3.56 seconds, and both the /v1/chat/completions and /v1/responses endpoints.

调度正是让单一端点在此处具有独特价值的原因。一个可以转移的工作负载,其价值是無法转移的两倍,而转移它是一个路由决策,而非迁移——相同的密钥、相同的请求形态,只是换一个时段或背后的模型不同。将 DeepSeek V4 Pro 与 DeepSeek V4.1 Flash 配对在同一端点上,是这一理念更精准的体现:Flash 模型在输入上的成本比 V4 Pro 的非高峰费率便宜 4.4 倍,在输出上便宜 3.3 倍,且拥有相同的上下文窗口和相同的高峰时段,这使其成为那些完全不需要更大模型的流量的天然去处。自动故障转移之所以重要,原因一如既往——你的流水线所依赖的廉价层级不应成为单点故障。

决策规则

• 可调度的批处理与离线作业——DeepSeek V4 Pro,并对它进行调度。全年 95% 的时间按 $0.66 和 $1.98 计费,周末则完全处于非高峰时段,这是本榜单上最便宜的可信费率,输入价格仅为其三分之一,输出价格仅为其五分之一。

• 落在高峰时段内的延迟敏感型交互流量——GPT-6 Sol。固定的 $2.00 和 $10.00 比 DeepSeek 的非高峰费率更贵,比什么都没有更便宜,但这是可以提前知道的;而且每天有两个小时,它在输出上是两者中更便宜的那个。

• 采用大型稳定前缀的智能体循环——在做选择之前,先算清缓存命中的账。DeepSeek 的缓存命中输入在非高峰时段为 $0.022,是 GPT-6 Sol 的 $0.20 的九分之一,但这也正是 DeepSeek 在高峰时段上调了十二倍的那一行。优势确实存在,但它取决于时钟。

• 任何受监管的事物,或任何你承受不起被重新路由的事物——DeepSeek V4 Pro,从 MIT 检查点自托管。九月撤回事件就是典型案例,而且比起任何按 token 的比较,它都更能成为接受固定成本的理由。

• 凡是需要达到智能体能力区间顶端的东西——GPT-6 Sol。十二个指数点和 Terminal-Bench 上的三十分并非四舍五入的差异,而 DeepSeek 自己厂商报告的数字也无法弥合这些差距。

统一费率与分时费率表都是诚实的定价设计。它们只是回答了不同的问题:一个告诉你一个 token 要花多少钱,另一个告诉你当你需要这个 token 时要花多少钱。

本文中的对比3

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新