一张生成的标题卡,标题为"Ultrafast vs Ultrafast",副标题为"GPT-6 Astra 对阵 GPT-5.6 Sol",还有两个徽章,分别写着"一个已公布价格","另一个仍是预览版"。
Guides & Insights

GPT-6 Astra Ultrafast 与 GPT-5.6 Sol Ultrafast:一个在价目表上,一个不在

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

两个 Ultrafast 档位并非孪生,它们之间的差异也不是基准测试。GPT-6 Astra Ultrafast 运行在 GPT-6 Astra 上,这是该公司的旗舰模型,于 2026 年 9 月 3 日发布,并于 2026 年 9 月 29 日在 Ultrafast 档位上全面可用。GPT-5.6 Sol Ultrafast 运行在 GPT-5.6 Sol 上,该模型从 2026 年 7 月 9 日起一直占据公司产品线的顶端,并且自 2026 年 8 月 13 日起一直处于有限预览阶段——至今仍是这一状态。查阅该公司自己在 2026 年 9 月 30 日的 API 文档,其中这句话毫不含糊:Ultrafast“已面向 GPT-6 Astra 全面可用,并为 GPT-5.6 Sol 提供预览访问权限。”

那一个句子就带来了整个对比,也带来了一种不对称——而由两行完全相同的条目组成的规格表,恰恰会把这种不对称掩盖起来。两个层级都公开了各自母模型完全相同的权重,两者是同一种服务概念,然而其中一个在 OpenAI 的价目表上有价格,另一个却没有。因此,在两者之间做选择的买家,并不是在两个价格之间做选择。他们是在一个价格和一份等候名单之间做选择,这是一种不同类型的决策,也需要一个不同的页面。

实际上相同的是什么?

从那些没有差异的部分开始,因为它们构成了大部分实质内容,而且正是它们从一开始就让命名变得令人困惑。

• 权重——GPT-6 Astra Ultrafast 就是在更快的服务路径上运行的标准 GPT-6 Astra,而 GPT-5.6 Sol Ultrafast 则是在更快的服务路径上运行的标准 GPT-5.6 Sol。二者都不是蒸馏模型、微调模型或单独的检查点。OpenAI 针对该层级的请求 schema 将 model 设为基础模型 id,并额外加上 service_tier: "ultrafast";并不存在 gpt-6-astra-ultrafast 这样的模型字符串。

• 这些答案——相同的检查点在相同的努力程度设置下应当返回相同的内容,除采样带来的差异外。如果你的两条通道在完全相同的提示、完全相同的设置下出现分歧,那这是一个值得深入调查的发现,而不是你所购买的一项功能。

• 调用接口层面——两者均可通过 Responses API 访问,OpenAI 建议二者都使用 WebSockets,并警告称每次请求的网络开销可能会侵蚀该层级所付费换来的延迟优势。

• 驻留限制——Ultrafast 仅支持美国数据驻留和全球处理,不支持欧盟或其他非美国区域的处理端点。这适用于层级,而非模型,因此它对双方施加同等约束。

在它们真正产生分歧的地方

区分这两种生活的所有信息,都藏在营销材料不会并排展示的栏目里。

• 可用性 — GPT-6 Astra Ultrafast 今日面向所有 API 用户开放,初始速率限制较低。GPT-5.6 Sol Ultrafast 是面向特定群体的有限预览;OpenAI 今日的指引是联系您的客户团队,为 GPT-5.6 Sol 申请更高的速率限制或预览访问权限。

• 价格——GPT-6 Astra Ultrafast 已在公布的价目表中:对于最多 272,000 个输入 token 的请求,每 100 万 token 的输入费用为 $60.00、缓存输入为 $6.00、缓存写入为 $75.00、输出为 $300.00;超过该上限后,则调整为 $120.00 / $12.00 / $150.00 / $450.00。GPT-5.6 Sol Ultrafast 则完全没有公布价目表。OpenAI 的 Ultrafast 定价表中恰好只有一行,而这一行就是 gpt-6-astra。

下方的标准档价格 — GPT-6 Astra 的标准计费为 $10.00 / $50.00,GPT-5.6 Sol 为 $4.00 / $20.00,OpenAI 自家页面将 Sol 的费率描述为促销价,并至少在 2026 年 11 月 21 日前提供。在套用任何速度档位之前,Sol 在两个维度上都便宜 2.5 倍。

• 吞吐量上限 —— OpenAI 的 Ultrafast 文档称其速度最高可达标准模式的 8 倍。而 Sol 的 Ultrafast 预览版所对应的数字是最高达 14 倍,每秒最多可输出 750 个 token,这正是 2026 年 8 月 13 日公告中给出的数字。这是针对两个不同模型的两项不同说法,而非对同一说法的修订。

• 硬件 — 预览公告中指明 Cerebras 是 Ultrafast 背后的合作伙伴,其模型权重与芯片紧密相邻。当前文档中没有任何内容将硬件相关的说法专门与 Astra 层级挂钩;Cerebras 的相关说明是针对 Sol 预览版记录的。

• 速率限制——GPT-6 Astra 的 Ultrafast 记录为:API 层级 1 至 3 每分钟 500,000 个 token,层级 4 为 1,000,000 个,层级 5 为 5,000,000 个。由于 Sol 尚未普遍可用,Ultrafast 上没有它的相应已发布表格。

在你认定最新模型会继承快车道之前,有一个相关事实值得了解:OpenAI 的定价页面也列出了 gpt-6.1-sol,而 Ultrafast 部分同样没有它的条目。如今,快速层级是一项 Astra 能力,并附带 Sol 预览。

A screenshot of OpenAI's Ultrafast documentation page, showing the sentence 'Our fastest API service tier, with up to 8x faster speeds than Standard mode.', the sentence 'It is broadly available for GPT-6 Astra, with preview access for GPT-5.6 Sol.', the recommendation to use WebSockets because per-request network overhead can reduce the latency gains, the note that Ultrafast for GPT-6 Astra is available to all API users at low rate limits with higher limits or Sol preview access available through an OpenAI account team, and a Python code sample setting service_tier to 'ultrafast' with model 'gpt-6-astra'.

同时读取 8x 和 14x

这两个速度数字是这一比较中最常被误引的部分,因此有必要准确说明它们各自究竟是什么。

14倍这个数字和每秒750个token这个数字来自OpenAI在2026年8月13日对GPT-5.6 Sol上Ultrafast的预览。正如该页面上所写,Ultrafast“运行GPT-5.6 Sol的速度比标准处理快达14倍”,并“每秒最多生成750个输出token”。两者都是输出吞吐量的上限,由供应商在有限预览中测得。

8 倍这个数字是 OpenAI 的 Ultrafast 文档页面目前对该层级本身的描述:“我们最快的 API 服务层级,速度最高可达标准模式的 8 倍。”该页面上广泛可用的模型是 GPT-6 Astra。

经得起审视的解读是:该档位公布的上限是 8x,而 Sol 预览版公布的上限是 14x。Astra 在 Ultrafast 上能否达到更高的数字,OpenAI 并未公布;而且这两个数字都不是针对你的流量的延迟承诺——端到端时间仍然包含输入处理、工具调用和你自己的编排。对 Astra 按 8x 来规划,把 14x 当作一个可能适用、也可能不适用的 Sol 预览版数字,并对照你自己的追踪记录来验证,而不是看幻灯片。

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing a single Ultrafast row for gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, with gpt-5.6-sol shown only at its standard rates of $4.00 / $0.40 / $5.00 / $20.00 short-context and $8.00 / $0.80 / $10.00 long-context, and page notes covering the 10% data-residency uplift for models released on or after March 5, 2026, the further 10% FedRAMP uplift, the July 30, 2026 renaming of Priority processing to Fast mode, and the availability of GPT-5.6 Sol's promotional pricing at least through November 21, 2026.

为了便于比较,这两个之下的层级也值得留意:在 GPT-6 Astra 上,Batch 和 Flex 的定价为 Standard 的 50%,而 Fast 模式——于 2026 年 7 月 30 日由 Priority processing 更名而来——定价为 Standard 的 2 倍,并有文档记载的速度上限,最高可达 2.5 倍。因此,这一阶梯依次为 0.5 倍、1 倍、2 倍(速度最高 2.5 倍),以及 6 倍(速度最高 8 倍)。从 2 倍到 6 倍这一步,多花 3 倍的钱换来大约 3.2 倍的速度提升,这大致是一种线性交换,而不是 8 倍这一宣传数字所暗示的阶跃式变化。

真正重要的一切都发生在标准层级

这个比较有一个版本,其中快速层级不做任何决定,而这是大多数团队应该采用的版本。

两个父模型共享 1,050,000 token 的上下文窗口和 128,000 token 的输出上限,均接受文本和图像输入并返回文本,也都支持相同的函数调用和结构化输出接口。它们的差异是同一系列两代之间的常见差异:GPT-6 Astra 的知识截止日期为 2026 年 4 月 30 日,而 Sol 为 2026 年 2 月 16 日;并且 GPT-6 Astra 提供从 low 到 max 的推理强度档位,而 Sol 提供从 none 到 max。在 OrcaRouter 目录从 Artificial Analysis 收录的独立基准测试中,按 2026 年 9 月 30 日读取的结果,GPT-6 Astra 在 GPQA Diamond 上得 96.1 分,在 Humanity's Last Exam 上得 54.7 分,而 GPT-5.6 Sol 为 94.1 和 49.5;编码方面差距较小——AA Coding Index 上为 76.9 对 77.4——在 Terminal-Bench v2.1 上则几乎持平,为 88.39 对 88.01。这些是来自单一评测者的单次运行数据,且是在每个模型自身默认配置下取得的,而 Artificial Analysis 会重新划分其指数,因此应将其视为快照,而非长期定论。

把它们放在这里的意义在于,当你加上 Ultrafast 时,那些数字一个都不会变。快速层级让你更早买到同一个模型,所以如果你的决策依据是每 token 的质量,那么它完全由标准层级决定,快速层级根本不会进入讨论。你想要哪个模型,按 $10 / $50 还是按 $4 / $20?这个问题有一个你今天就能测试的答案。你是否还愿意支付六倍的价格来更早得到那个模型的回答,是一个单独的、窄得多的问题,而对于 GPT-5.6 Sol 来说,这个问题目前根本买不到答案。

购买决定,直截了当地说

如果你今天就需要速度,GPT-6 Astra Ultrafast 是这两者中唯一实际可用的。任何 API 用户都可以在文档所载的速率限制下普遍使用它,而且其成本可以提前预知:短上下文 $60 / $300,长上下文 $120 / $450,缓存读取为每百万 $6.00,缓存写入为 $75.00。决策规则遵循统一的 6 倍倍数——该档位在有人等待的交互式工作中,以及在速度可明显减少计费轮次的循环中,能够值回其价格;而在批处理形态或受吞吐限制的工作中则不值,因为在这些场景下,Batch 和 Flex 在同一价目卡上仅为标准价的一半。

如果你想在 GPT-5.6 Sol 上获得速度,诚实的答案是:你现在还买不到,而且 OpenAI 自己的页面也是这么说的。预览版已经存在,14 倍和每秒 750 个 token 的数字已经公布,访问需要通过客户团队。任何告诉你 GPT-5.6 Sol Ultrafast 价格的人都是在推测;公布的费率卡上只有一行 Ultrafast,而且那不是 Sol 的。务实的做法是:现在在生产环境中,继续使用适合你工作负载的任一模型的标准层级,并把 Sol 预览版当作一个待跟进事项,等它变得可购买时再重新考虑。

路由所在位置

一点运营说明:这两个快速层级都不是可单独寻址的模型。标准服务下的 GPT-5.6 Sol 已在 OrcaRouter 上线,模型标识为openai/gpt-5.6-sol,按提供商自身的费率计费——每百万 token 输入 $4.00、输出 $20.00,超过 272K 后长上下文阶梯价升至 $8.00 / $30.00——而 GPT-6 Astra 已以openai/gpt-6-astra上线,价格为 $10.00 / $50.00,并有其自己的长上下文阶梯价。两者均以 0% 加价提供服务,意味着提供商的标价会直接透传,因此供应商一旦调价,当天就会反映在你的账单上,而不是等到合同续约时;并且两者都位于同一个密钥之后,与 200 多个其他模型并列,支持自动故障转移,因此你可以在自己的流量上比较它们,而无需进行第二次集成。

Ultrafast 层级不是我们提供的路由。它们是 OpenAI 账户上受访问控制的服务层级标志——由调用方在针对基础模型 id 的请求中设置,由 OpenAI 按上述费率计费——而对于 GPT-5.6 Sol,还需通过预览请求才能解锁。准确说明这一点,比暗示一种并不存在的能力更重要:如果你正在运行 Ultrafast,那它就在你与 OpenAI 的直接集成中;而你在其旁边路由的标准层级流量,合适的归处是一个按标价原样透传的网关。

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1M-token context window, 128K maximum output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.72 s, a 10.00 s figure, and 89.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

看什么

有两件事会改变这个页面,而两者都不是可以预料到的传闻。第一是一份价目表:一旦 OpenAI 公布 GPT-5.6 Sol 的 Ultrafast 价格,这项比较就会变成一个直截了当的“六倍对多少倍”的问题,而我上面草拟的那套算术就得改以 Sol 的 $4 / $20 基础价来重算,而不是 Astra 的 $10 / $50。第二是 Sol 预览版的正式全面可用,这会让页面中“你买不到这个”的那一半内容发生变化。在这两者之一落地之前,诚实的总结是:GPT-6 Astra Ultrafast 是更贵、更新的旗舰机型上一条已定价、可购买、已全面可用的快车道,而 GPT-5.6 Sol Ultrafast 则是更便宜机型上一份有文档记录的预览版,标称速度更高,却根本没有价格。

本文中的对比1

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新