
GPT-6.1 Sol Ultrafast 正式登陸 API、Codex 與 ChatGPT Work
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
OpenAI 正在推出 Ultrafast 模式,適用於 GPT-6.1 Sol——這是它所販售的最快服務層級,也是接近 Astra 的 Sol 層級首次擁有這項模式。此舉將 GPT-6.1 Sol與 GPT-6 Astra Ultrafast歸於同一級別,在 API、Codex 和 ChatGPT Work 中都是如此;而且它推出時附有公開的費率表,而非等候名單:每百萬個輸入 token 為 12.00 美元,每百萬個輸出 token 為 60.00 美元,正好是標準 GPT-6.1 Sol 費用的六倍。包裝上的速度宣稱是「最高 8 倍」。有趣的部分在於那句話衡量的究竟是什麼,而答案並不是你即將付費購買的模型。
開發者更新日誌中有 10 月 8 日的條目:「在 Responses API 中為 GPT-6.1 Sol 新增 Ultrafast 模式。使用 gpt-6.1-sol搭配service_tier: "ultrafast",以縮短生成輸出權杖之間的時間。所有 API 使用者皆可使用,但須遵守速率限制,並具備全球處理以及美國與歐盟資料駐留。」Ultrafast 文件頁面現在寫道:「已廣泛提供給 GPT-6 Astra 與 GPT-6.1 Sol,並為 GPT-5.6 Sol 提供預覽存取」,而 ChatGPT 端的速度頁面則確認了訂閱方案的部分:Ultrafast 已在 Pro $500 的 Codex 與 ChatGPT Work,以及符合資格的 Enterprise 和 Edu 方案中提供。
Ultrafast 是一個服務層級,而非第二個模型
權重完全沒有改變。同樣的檢查點、同樣 1,050,000 token 的上下文視窗、同樣 922,000 token 的最大輸入、同樣 128,000 token 的輸出上限、同樣 2026 年 4 月 30 日的知識截止點、同樣的回答。你買到的是一種排程優先權:模型產生 token的速度更快,而 OpenAI 自己的說法刻意保守狹隘——這個等級「縮短了生成輸出 token 之間的時間」。它不會讓模型變得更聰明,也不會讓思考階段變得更短。
這個區別就是整個決策的關鍵。對於一個會連續發出四十次工具呼叫的代理迴圈,優勢會複合累積,因為每一回合的輸出都能更早送達。對於單一困難的推理請求,其大部分實際時間都花在思索上,你可能付了六倍的錢,卻盯著同一個載入轉圈。
等級階梯,用白話說一次:
• Batch and Flex — 價格只要 Standard 的一半,是專供沒人急著要的工作使用的低價通道
• 標準 — 每百萬個 Token:輸入 $2.00 / 快取 $0.10 / 快取寫入 $2.50 / 輸出 $10.00
• 快速 — 標準的兩倍,或 $4.00 / $0.20 / $5.00 / $20.00;OpenAI 於 2026 年 7 月 30 日將 Priority processing 更名為 Fast 模式
• 超快速 — 標準方案的六倍,或 $12.00 / $0.60 / $15.00 / $60.00
• 超過 272K 輸入 token — 整筆請求會以輸入與快取費率的 2 倍、輸出費率的 1.5 倍重新計價;Ultrafast 長上下文為 $24.00 / $1.20 / $30.00 / $90.00
沒有人會放上行銷頁面的那筆算術
以六倍的價格換取八倍的速度,並不是一筆虧本買賣,也不是免費的午餐。Ultrafast 按 token 計費,因此一件在 Standard 要價 $1.00 的工作,在 Ultrafast 要價 $6.00——而且大約只需八分之一的時間就能完成。省下的不是帳單金額,而是實際時間。你多付五美元,是為了消除那件工作八分之七的排隊時間;而這究竟便宜還是荒謬,完全取決於在另一端等待的人或管線每分鐘值多少錢。
隨之而來有兩項意涵,而它們正是最常被忽略的:
• 互動式工作是那個容易點頭的選項。開發者盯著 diff 落地、代理在讀到結果之前無法繼續——在這些情況下,延遲本身就是產品。在四十輪的迴圈中快上八倍的輸出,對人類感知而言並不是邊際改善;它是「你會拿來用的工具」與「你會丟到背景執行的工具」之間的差別。
• 排程型與批次型工作是最容易直接說不的情況。如果一項工作反正要到早上才有需要,用 Ultrafast 就是白花 6 倍的帳單,而半價的 Batch 通道就擺在那裡。
快取輸入值得再多看一眼,因為它也會變動:Ultrafast 上每百萬 $0.60,而 Standard 上是 $0.10,仍是非快取輸入費率的 5%。每回合都重新傳送大型系統提示的提示快取代理會發現,快取折扣會隨方案層級而變,而不是讓它們免受其影響。

「最高 8 倍」這個數字是從哪裡來的
這是需要仔細閱讀的部分,因為正是在這裡,推出的標題與推出的說明文件悄悄地描述了不同的內容。
OpenAI 唯一公布的模型專屬速度測量數據,就是這句話:「GPT-6 Astra Ultrafast 在 Codex 中生成 token 的速度,最高可達 GPT-6 Astra 在 Standard 模式下速度的 8 倍。」那是 Astra 的數據,是在 Codex 中測得的。GPT-6.1 Sol 則沒有公布對等的倍數。說明此模型 Ultrafast 的文件提到,它可縮短生成輸出 token 之間的時間,並指向一份定價表;但未提供具體數字。ChatGPT 端的速度頁面只重述了 Astra 那句話,就沒有下文。
所以對「最快可達 8 倍」的誠實解讀是:這是該層級的主打說法,來自自 9 月 29 日起就登上 Ultrafast 的同系列姊妹模型,而且這是供應商宣稱,沒有任何獨立第三方對任一模型重現過。這很可能也適用於 GPT-6.1 Sol——兩者跑在相同的服務堆疊上,而且該層級的機制也相同——但 OpenAI 之外沒有人發表過 Sol 版本的每秒 token 數測量,而那句裡的「可達」確實在發揮實際作用。
也值得按模型將各層級分開,因為較舊的那個仍是尚未完成的事。Ultrafast 於 2026 年 8 月 13 日針對 GPT-5.6 Sol 宣布,號稱「比標準處理快最多 14 倍」,以限量預覽形式提供給特定客戶。三個月後,文件中仍寫著 GPT-5.6 Sol 具有「預覽存取權」,而 Ultrafast 定價表恰好包含兩行——GPT-6 Astra 與 GPT-6.1 Sol。一個從未達到一般可用性、也沒有公布費率的 14 倍數字,只是宣稱,不是產品。

到底是誰能真正把它開啟?
API 方面範圍很廣;訂閱方面則很窄,而這個差異常讓人措手不及。
• API — 所有 API 使用者皆可使用 gpt-6.1-sol,但速率限制與 Standard 及 Fast 分開計算。這表示要留意的是第二筆預算,而不只是第二個價格。
• GPT-6.1 Sol 的超高速速率限制 — Build 每分鐘 1,000,000 個 token,Launch 每分鐘 4,000,000 個,Grow 每分鐘 40,000,000 個。OpenAI 於 10 月 6 日將其用量層級從五個簡化為三個,因此這三個名稱是現行的層級,而非舊制。
• 資料落地 — GPT-6.1 Sol 支援美國與歐盟的資料落地以及全球處理,包括在 Fast 與 Ultrafast 模式下。Astra 的 Ultrafast 無法取得歐盟資料落地資格,因此若你的工作負載必須綁定在歐盟,這是第一款你真正能購買的 Ultrafast 配置。
• Codex 與 ChatGPT Work — Ultrafast 適用於 Pro $500 方案,以及符合資格的 Enterprise 與 Edu 方案。Enterprise 管理員的預設為關閉狀態,必須依使用者或依工作區逐一啟用。
• Chat——不包含在內。GPT-6.1 Sol 本身存在於 Work 與 Codex 中;消費者端的 Chat 介面不屬於此範圍。
• 訂閱方案的計費方式——隨附用量會以標準費率的 8 倍消耗,而已購買的額度或企業按用量付費則以標準費率的 6 倍計費。在讓它維持開啟之前,這兩個數字都值得先了解。
一個實作細節就能決定你是否看得到任何速度提升。OpenAI 的指引說得很直白:使用 WebSockets,「尤其是對於會快速連續發出大量工具呼叫的代理式應用程式」,因為「沒有持久連線,網路額外負擔可能會抵銷延遲改善」。如果你的用戶端每次呼叫都開啟新的 HTTP 連線,每次請求的額外負擔可能吃掉你才剛付 6 倍價格所換來的那個層級的全部優勢。HTTP 仍然可用。只是可能不值得選用那個層級。
我們會路由什麼,以及我們不會路由什麼
標準等級的 GPT-6.1 Sol 已在 OrcaRouter 上架,型號為openai/gpt-6.1-sol,以供應商自訂的每百萬個詞元 $2.00 輸入、$10.00 輸出計價,並以 0% 加成提供——直接沿用廠商牌價,因此當 OpenAI 調整費率時,這項變動會在登上價目表的同一天反映到你的帳單上,而不是等到下一次合約續約才生效。同一組金鑰與端點就能取用超過 200 個模型,因此 GPT-6.1 Sol 的呼叫與 Claude 或 Qwen 的呼叫都位於同一個整合介面之後,具備自動容錯移轉,且無須第二份合約;當某項任務需要不只一種意見時,路由 DSL 還能將多個模型組合成單一呼叫。
Ultrafast 並不是那類模型之一,若暗示它是,就會造成誤導。它是 OpenAI 帳戶上的一個服務層級旗標——你把 service_tier: "ultrafast"送到gpt-6.1-sol,OpenAI 就會以上述費率向你的自有帳戶收費——所以它存在於你直連 OpenAI 的整合之內。如果你啟用它,就把分層流量留在你的供應商金鑰上,並把一般量的流量導向我們。這是誠實的分流做法,而對任何不是在等真人處理的事情來說,這也是更便宜的那一種。

今天要怎麼處理它
如果你在 Pro $500 方案上有 Codex 或 ChatGPT Work 席次,那個切換開關已經在那裡了,試用對你唯一的代價就是用量倍率——用兩種方式跑同一個任務,看看你實際執行的迴圈是否有足夠的回合數讓那八倍提升顯現出來。如果你是使用 API,值得做的實驗比公告所暗示的範圍更窄:量測你的延遲中有多少是 token 生成、多少是模型在思考,然後把 Ultrafast 對準它真正能壓縮的部分。
而如果你能在同一請求上於 2x 的 Fast 和 6x 的 Ultrafast 之間做選擇,Fast 是先出現的那個層級,也是單憑價目表就能推斷其行為的那個。Ultrafast 對這個模型來說是新的,未經任何人獨立測量定價,其價值完全取決於你自己的碼錶怎麼說。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
