一张生成的主视觉卡片,标题为“一档,三款模型”,带有三个标签,分别显示“GPT-6.1 Sol Ultrafast:可用,$12.00 / $60.00”、“GPT-6 Astra Ultrafast:可用,$60.00 / $300.00”和“GPT-5.6 Sol Ultrafast:仅供预览,未公布费率”,页脚显示“摘自 OpenAI 于 2026 年 10 月 9 日发布的文档”。
Guides & Insights

GPT-6.1 Sol Ultrafast 对比 GPT-5.6 Sol Ultrafast:同一层级,三款模型,其中一款仍在等待

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

GPT-6.1 Sol Ultrafast与GPT-5.6 Sol Ultrafast是将同一个服务层级应用于两个不同的 Sol 代际,而在 2026 年 10 月 8 日之后,两者处于截然相反的状态。GPT-6.1 Sol已从“即将推出”变为公布了费率表——每百万输入 token 12.00 美元,每百万输出 token 60.00 美元,是 Standard 的六倍——面向所有 API 用户开放,也面向 Pro 500 美元套餐的 Codex 和 ChatGPT Work 用户开放。GPT-5.6 Sol则仍停留在 Ultrafast 最初的状态:一个已宣布的层级,处于有限预览阶段,定价页上完全没有它的条目。同样的名称,同样的机制,但其中只有一个是你真正能买到的。

那是简略版。更详细的版本之所以重要,是因为该层级宣传的主打速度数字分别对应不同的模型,是在不同界面上测得的,而且其中一项已经过时三个月了。

每个型号上的“Ultrafast”实际上是什么

在这两个模型上,Ultrafast 都不是一个单独的检查点。你发送相同的模型 id,只切换服务层级——model: "gpt-6.1-sol"搭配service_tier: "ultrafast",在 Responses API 中——OpenAI 就会把你的请求调度到低延迟路径上。权重、答案和上下文窗口都不变。在 GPT-6.1 Sol 上,该窗口为 1,050,000 个 token,最大输入 922,000 个 token,最大输出 128,000 个 token;GPT-5.6 Sol 拥有完全相同的窗口和输出上限,主要区别在于知识截止日期(2026 年 2 月 16 日对 2026 年 4 月 30 日),以及推理层级——GPT-5.6 Sol 仍然接受 none,而 GPT-6.1 Sol 不接受。

所以,比较不在于“哪个模型思考得更快”。而在于“同一档次的哪一代对你开放”,而这个答案四天前变了。

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

已公布的倍数,以及那个始终保持在14倍的数字

OpenAI 已就这一档位发布了两项速度声明,分别针对两个模型,而这两项都不是关于“Ultrafast”的普遍性声明。

• GPT-6 Astra Ultrafast —“在 Codex 中,其生成 token 的速度最高可达 GPT-6 Astra 标准模式的 8 倍”。这是该档位目前的宣传语,在 ChatGPT 一侧的速度文档中被反复引用。

• GPT-5.6 Sol Ultrafast——于2026年8月13日发布,号称"处理速度最高可达标准模式的14倍",仅面向部分客户限量预览。

请注意缺失了什么。GPT-6.1 Sol Ultrafast 并没有公布任何速度倍数。它的文档页面介绍了该层级,给出了速率限制和数据驻留立场,并指向价格表——但整套文档中唯一一个针对具体模型的倍数属于 Astra。诚实的说法是,“最高 8 倍”是 Astra 在同一服务栈上的测量结果,而这次推广正是靠这个数字来推销的,却没有任何人——无论是在 OpenAI 内部还是外部——为 Sol 复现过它。

14x 这个数字比通常更值得怀疑,因为它已经存在太久了。它于八月中旬为一个尚未正式发布的层级宣布,此后大约两个月未经修订,而该层级本身已围绕另外两个模型重建。在那段时间里,显而易见预期的事情——5.6 Sol's Ultrafast 将从预览版毕业并获得定价——从未发生。相反,GPT-6 Astra 在 9 月 29 日获得了它,GPT-6.1 Sol 在 10 月 8 日获得了它。一个只存在于公告中、附属于无人能购买的配置的数字,在它出现在价目表上之前,只是营销文案。

并排对比:每一项的费用是多少,以及谁能够使用它

• 标准费率 — GPT-6.1 Sol 每 100 万 token:输入 $2.00 / 缓存 $0.10 / 缓存写入 $2.50 / 输出 $10.00,而 GPT-5.6 Sol 为 $4.00 / $0.40 / $5.00 / $20.00

• 超高速费率 — GPT-6.1 Sol $12.00 / $0.60 / $15.00 / $60.00,依据 6x-Standard 规则发布,并在超高速定价表中拥有独立行;相比之下 GPT-5.6 Sol 未公布费率

• 超过 272K 输入 token 的长上下文 —— GPT-6.1 Sol 对整个请求按 2 倍输入和缓存费率、1.5 倍输出费率重新定价,由此形成一条 Ultrafast 长上下文价格线:$24.00 / $1.20 / $30.00 / $90.00,而 GPT-5.6 Sol 的 Ultrafast 同类价格则无人公布过

• 该层级的可用性 — GPT-6.1 Sol:面向所有 API 用户开放,但须遵守单独的速率限制,且在 Pro $500 以及符合条件的 Enterprise 和 Edu 套餐上,Codex 与 ChatGPT Work 也可使用;相比之下,GPT-5.6 Sol:仅面向部分 API 客户提供有限预览

• 发布时的速率限制 —— GPT-6.1 Sol 拥有独立的 Ultrafast 预算,与 Standard 和 Fast 的限制分开,按组织单独设定,相比 GPT-5.6 Sol 可应请求提高,且不予公开

• 数据驻留 — GPT-6.1 Sol 在 Fast 和 Ultrafast 下支持美国与欧盟驻留及全球处理,而 GPT-5.6 Sol 仅支持美国驻留和全球处理

• 速度倍数 — GPT-6.1 Sol,未公布任何数据;对比 GPT-5.6 Sol 在8月公告中所称的“最高14倍”,未获复现

• 上下文和输出上限 — 两者分别为 1,050,000 和 128,000

这份清单中有一处不对称值得单独指出。GPT-6.1 Sol 是唯一具备欧盟数据驻留的 Ultrafast 配置:Astra 的 Ultrafast 仅限美国,而 5.6 Sol 则完全没有开放。如果你的工作负载被限定在欧盟境内处理,那么 10 月 8 日是该层级以任何形式向你开放的最早日期。

在订阅制下,区别在于套餐,而不是模式

在 Codex 和 ChatGPT Work 中,两代产品在结构上的表现相同——Ultrafast 是你已有模型上的一项速度设置——但它前面的准入门槛是新的。Ultrafast 在 Pro $500 以及符合条件的 Enterprise 和 Edu 套餐中可用,并且在 Enterprise 工作区中默认关闭,直到管理员将其启用。在订阅内,包含的用量按 Standard 费率的 8 倍消耗,购买的额度或 Enterprise 按量付费按 6 倍计费;在 API 上,每条定价项的倍率统一为 6 倍。

具体到 GPT-5.6 Sol,这些都还无法触及。没有订阅途径——ChatGPT 一侧的速度文档中,Ultrafast 列出的支持对象是 GPT-6 Astra 和 GPT-6.1 Sol——而 API 途径仍被限制在预览批次之内。无论 14 倍这个数字承诺了什么,它承诺给的都是一批两个月来未曾扩大的账户。

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

实际该用哪一个,以及什么时候该等待

如果你从今天开始,这个问题基本不言自明:GPT-6.1 Sol Ultrafast 可以购买、有定价、也有文档,而 GPT-5.6 Sol Ultrafast 则没有。转而选择较旧模型的原因根本不在于层级——而在于 GPT-5.6 Sol 自 2026 年 7 月 9 日起就已投入使用,如果你有基于它构建的提示词套件、评估和成本模型,那么迁移到一个知识截止日期不同、推理阶梯严格更窄的 Sol 更新版,其迁移成本是实实在在的,即便价格减半也是如此。这个迁移应按它自己的节奏进行,而不是因为某个速度设置终于出现了。

针对这一层级本身的决策规则,正是 Astra 的数据所暗示、Sol 所验证的那一条:当人类或智能体因等待输出而受阻时,为降低延迟支付六倍价格是划算的;而当任务可以等到早上时,这就不划算了。GPT-6.1 Sol 的推出丝毫没有改变这笔账;它只是让这一层级可以在更便宜的基础模型上使用,而在这样的模型上,快速响应的绝对费用更低。

而如果你想要的是 Fast 档,那么仅凭费率卡也能推断出来:它是 Standard 的两倍;并且自 O​penAI 于 2026 年 7 月 30 日将 Priority processing 更名以来,Fast 一直是稳定的中间选项。Ultrafast 仍然是你花钱买一项无法衡量的承诺的档位;而在 GPT-5.6 Sol 这一边,它甚至是一个你根本买不到的档位。

一键呼叫两者中的任意一个

标准层级的 GPT-5.6 Sol 和 GPT-6.1 Sol 都已登陆 OrcaRouter——openai/gpt-5.6-sol每百万 token 输入 $4.00、输出 $20.00,openai/gpt-6.1-sol则为 $2.00 和 $10.00——均以 0% 加价提供,供应商的标价直接透传,因此厂商价格一变动,当天就会同步到你的账单上。在这对模型上,这一点比平时更重要,因为 GPT-5.6 Sol 的 $4.00 / $20.00 明确是促销价,OpenAI 表示其至少供应到 2026 年 11 月 21 日。当这一窗口关闭后,两代之间的差距会缩小,而透传平台意味着你会从自己的用量数字中发现这一点,而不是从一封续约邮件里得知。

同一个密钥和端点即可承载 200 多个模型,因此在你自己的流量上比较两代 Sol 无需两套集成或两份合同,而自动故障转移可在一个提供商性能下降时让生产路径持续可用。当单一答案不够用时,路由 DSL 可将多个模型组合为一次调用,模型融合则在其背后组建一个专家小组。

我们不提供的是 Ultrafast。在任一模型上,它都是 OpenAI 账户上的一个服务层级标志,而不是可单独路由的模型,因此它仍留在你的直接 OpenAI 集成之内——而在 GPT-5.6 Sol 上,它甚至在那里都尚未全面可用。我们说得这么直白,是因为另一种做法就意味着暗示我们并不具备的能力。而这可不是我们想在这个博客上出现的句子。

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

本文中的对比1

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新