
GPT-6.1 Ultrafast 专业版仅需 500 美元,而这个细节藏在第三条帖子里
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
GPT-6.1 Sol Ultrafast于 2026 年 10 月 8 日发布,随之而来的是速度层级所能具备的最罕见的东西:公开标价。每百万输入 token 12.00 美元,每百万输出 token 60.00 美元,恰好是GPT-6.1 Sol——OpenAI 于 2026 年 9 月 29 日在 DevDay 2026 主题演讲上发布的模型——在标准通道上价格的六倍。公告帖一开头并没有说明 ChatGPT 订阅用户究竟能在哪里把它打开,而答案就在往下第三条帖子里:500 美元的 Pro 套餐。这个先后次序值得比它实际获得的更多关注,因为这次上线的 API 那一半与订阅那一半受到了方向相反的开放限制,而这一差别决定了 Ultrafast 是你这周就能试用的东西,还是必须先买一个套餐才能用上的东西。
模型本身没有任何改变。GPT-6.1 Sol Ultrafast 是同一个检查点,同样的 1,050,000 token 上下文窗口,同样的 128,000 token 输出上限,同样的 2026 年 4 月 30 日知识截止日期,给出的回答也与 GPT-6.1 Sol 相同。Ultrafast 是一种服务层级——你请求的调度优先级——而不是第二个模型。整个产品卖的就是延迟,而且是以数倍价格出售,真正重要的只有两个问题:你能得到多少,以及谁有资格购买。
记录实际所说的内容,按照它陈述的顺序
这个故事的控诉版是,OpenAI 把门控埋了起来。准确的说法则更具体,并且可以逐行对照 OpenAI 自己的文档来核实。
开发者变更日志载有 10 月 8 日的条目:在 Responses API 中为 GPT-6.1 Sol 添加 Ultrafast 模式,可通过发送 model: "gpt-6.1-sol"并搭配 service_tier: "ultrafast"来请求;其被描述为可缩短生成输出 token 之间的时间,并声明面向所有 API 用户开放(受速率限制约束),采用全球处理以及美国和欧盟数据驻留。单独来看,这是一次以公布费率进行的无限制发布。
层级文档称,Ultrafast 是 API 中最快的服务层级,广泛适用于 GPT-6 Astra 和 GPT-6.1 Sol,GPT-5.6 Sol 则为预览访问,并建议对其使用 WebSockets。仍未提及任何计划。

订阅详情位于 ChatGPT 一侧的速度页面上,而它是在同一段话里叠加起来的三项限制:Ultrafast 可在 Codex 和 ChatGPT Work 中使用,也适用于 Pro $500,以及符合条件的 Enterprise 和 Edu 方案。企业管理员默认将其关闭,必须按用户或按工作区逐一启用。而面向消费者的 Chat 界面则完全没有提供这一档位——GPT-6.1 Sol 本身就位于 Work 和 Codex 中,因此 Chat 从来就不在范围之内。
把这三页放在一起,全貌就很清楚了。API 密钥就是一张门票。ChatGPT 订阅只有在它是 OpenAI 出售的最贵那一档时,或者管理员已为你启用它时,才算一张门票。任何读公告第一帖的人都猜不到这一点。
为什么这道门槛存在,而且它并非随意设置的
最显而易见的解读是,OpenAI 在用这条快车道推销 500 美元的套餐。但底层的机制没那么算计,反而更有用:Ultrafast 是一种昂贵的计价器,而 500 美元套餐是唯一一种能让 8 倍计价器落入套餐包含用量之内的消费者套餐。
在订阅方案中,当你使用 Ultrafast 时,包含的用量会以标准速率八倍的速度被消耗,因此单次 Ultrafast 轮次消耗的额度相当于八次标准轮次。这是该层级功能本质带来的结果——它通过消耗服务容量来换取实际时间,而订阅是一种固定容量的产品。如果为八倍的容量消耗只收取同样的额度,那么每月 20 美元的套餐经济模型就会崩溃。如果收取八倍的额度,这个层级在小套餐上就变得毫无吸引力。无论哪种方式,该层级最终都会落在额度足够大、足以吸收它的位置。
API 没有这种限制,因为它是按量计费的。在那里,Ultrafast 拥有自己的速率限制配额,与 Standard 和 Fast 的配额分开,而 OpenAI 将这些限制描述为按组织设定,而不是发布在层级页面上。这是公告没有突出强调的第二件需要注意的事:将工作负载切换到 Ultrafast 不仅会使账单成倍增加,还会将工作负载转移到一个不同的上限,而且如果你将流量提高到超过组织被授予的额度,该层级自身的限制就会成为故障模式。
以两种不同方式购买速度的算术
下面用数字来说明这个决定,而这部分值得用你自己的 token 数量来算,而不是我的。取一个智能体会话:在 40 轮里,每轮发送 30,000 个输入 token,接收 1,500 个输出 token。
• 每次运行的总 token 数 — 输入 1,200,000,输出 60,000,分摊到 40 个请求中,每个请求都稳稳低于 272,000 token 这一阈值,一旦超过,OpenAI 就会对整个请求重新计价。
• 在标准 GPT-6.1 Sol 上——120 万 token 按每百万 $2.00 计算是 $2.40,再加上 60,000 个 token 按每百万 $10.00 计算是 $0.60。每次运行三美元。
• 在 GPT-6.1 Sol Ultrafast 上——120 万按 $12.00 计算是 $14.40,加上 60,000 按 $60.00 计算是 $3.60。每次运行十八美元。
• 区别在于——每次运行 $15.00,就能在一个除此之外不会变化的任务上省去大部分生成时间。
每次运行 15.00 美元,这个数字要拿来和订阅费用作对比。如果你考虑 Pro 方案唯一的原因是 Ultrafast,那么在这些 token 用量下,每月大约 33 次运行正是该方案的 500 美元与 API 按 token 计费的交叉点——低于这个次数,按量计费是购买同一档位更便宜的方式;高于这个次数,方案开始更划算。你的 token 用量会改变这个交叉点,有时幅度很大,所以在把 33 当作阈值之前,先算算你自己的数字。这只是我们基于所述工作负载所做的计算,并非官方公布的盈亏平衡点。

p>无论 token 数量多少都成立的两点结构性说明。
速度声明是借鉴而来的,而这正是唯一需要仔细审视的一点。
Ultrafast 以"最高快 8 倍"为卖点,而 OpenAI 在这一说法背后公布的唯一一项针对具体模型的测量数据,却属于另一款模型。其文档中的那句话写着:GPT-6 Astra Ultrafast 在 Codex 中生成 token 的速度最高可达标准模式下 GPT-6 Astra 的 8 倍。这是 Astra 的数据,且是在 Codex 中测得的。GPT-6.1 Sol 这一档位的文档将其描述为缩短了 token 间的时间,并指向一份价目表;文档并未给出具体数字,也没有任何独立第三方公布过 Sol 版本的每秒 token 数测量结果。
它很可能成立。两个模型都运行在同一套服务栈上,层级机制也相同,所以 Astra 的倍数对 Sol 来说是一个合理的先验。但“最高 8 倍”是厂商给出的上限,未经复现,还是取自一个同门模型——而在这句话里,“最高”可不是摆设。要把这个倍数当作一个假设,在你自己的提示词上检验它,因为该层级自己的文档从不会替你检验。
对于较旧的层级,同样的告诫说出来代价更低。基于 GPT-5.6 Sol 的 Ultrafast 于 2026 年 8 月 13 日发布,在有限预览中号称“比 Standard processing 快至多 14 倍”,而三个月后,文档仍写着预览访问,同时 Ultrafast 费率表恰好只有两行——GPT-6 Astra 和 GPT-6.1 Sol。一个没有公布价格、也尚未全面可用的 14 倍数字,只是一个说法,而不是一款产品;它也提供了一个有用的提醒:这个层级阶梯中有多大一部分仍然只是愿景。
如果500美元的计划无法实现
对于不打算花 500 美元买 Pro 来测试某个延迟层级的人来说,有用的做法是把这次发布捆绑在一起的两件事拆开看。该层级面向所有 API 用户开放,因此无需订阅即可买到这条快车道——价格为每百万 token 12.00 美元和 60.00 美元,拥有独立的速率限制额度,且可在一个小到足以测量的负载上使用。先在那里用你自己的提示词,对照标准通道进行测试。
标准通道就是那个无需这一切也依然存在的通道。OrcaRouter 提供 GPT-6.1 Sol,模型标识为 openai/gpt-6.1-sol,按 OpenAI 自己的标价——每百万输入 token 2.00 美元、每百万输出 token 10.00 美元——0% 加价,供应商价格直接透传,因此供应商调价当天就会反映到我们这边。Ultrafast 不是我们出售的东西:它是一个计费到你自己 OpenAI 账户上的服务层级标记,我们宁愿把这一点直说,也不愿让模型页面暗示并非如此。一把密钥真正能买到的是:能够路由标准通道以及目录中的其余部分—— 一个 OpenAI 兼容端点背后的 200 多个模型——以及在某个提供商性能下降时自动跨提供商故障转移,如果你即将在生产路径前面加上一个延迟层级,这是能买到的最便宜的保险。

如果你使用的是 Plus 或 Team,而你想找的答案是“我能直接把它打开吗”,那么答案是:不能,而且有具体的条件。Codex 和 ChatGPT Work 可在 Pro(500 美元)或符合条件的 Enterprise 或 Edu 套餐中使用;如果是企业版,则需由管理员启用。其他所有情况都通过 API 使用 Ultrafast,并按 token 付费。
接下来看什么
有三件事会让这次发布从受限发布变成常规发布,而这三件事都是可观察的。公布 GPT-6.1 Sol 的 Ultrafast 速率限制,将终结关于该档位自身的上限是否会先于账单成为约束的猜测。一项针对特定模型的速度测量——或者一项独立测量——将用一个可用于评判 Sol 档位的数值,取代借用来的 Astra 数字。而 Ultrafast 登陆 ChatGPT Plus 将意味着容量计算已经改变,这正是表明该门槛源于发布初期的稀缺,而非该档位的永久形态的信号。
在那之前,诚实的概括范围有限且可核验。GPT-6.1 Sol 于 2026 年 9 月 29 日发布,此后没有变化。2026 年 10 月 8 日,它获得了一条带有真实价格的快速通道,面向 API 用户开放,并在 ChatGPT 中以 $500 套餐为门槛。这个细节本该出现在第一篇中,而不是第三篇中,对大多数读者来说,这也决定了它究竟是一笔预算条目,还是一张采购订单。
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
