一張生成的主視覺卡片,標題為「現已登上最快層級」,副標題為「GPT-6.1 Sol Ultrafast 正式推出至 API、Codex 與 ChatGPT Work」,並有四張標籤寫著「每 100 萬個 token 12.00 美元/60.00 美元」、「標準版的 6 倍」、「最高快 8 倍(依 Astra 測量)」以及「API、Codex 與 ChatGPT Work」,底部的頁腳則寫著「供應情況與價格依 OpenAI 文件,2026 年 10 月 8 日」。
Guides & Insights

GPT-6.1 Sol Ultrafast 正式登陸 API、Codex 與 ChatGPT Work

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

OpenAI 正在推出 Ultrafast 模式,適用於 GPT-6.1 Sol——這是它所販售的最快服務層級,也是接近 Astra 的 Sol 層級首次擁有這項模式。此舉將 GPT-6.1 Sol與 GPT-6 Astra Ultrafast歸於同一級別,在 API、Codex 和 ChatGPT Work 中都是如此;而且它推出時附有公開的費率表,而非等候名單:每百萬個輸入 token 為 12.00 美元,每百萬個輸出 token 為 60.00 美元,正好是標準 GPT-6.1 Sol 費用的六倍。包裝上的速度宣稱是「最高 8 倍」。有趣的部分在於那句話衡量的究竟是什麼,而答案並不是你即將付費購買的模型。

開發者更新日誌中有 10 月 8 日的條目:「在 Responses API 中為 GPT-6.1 Sol 新增 Ultrafast 模式。使用 gpt-6.1-sol搭配service_tier: "ultrafast",以縮短生成輸出權杖之間的時間。所有 API 使用者皆可使用,但須遵守速率限制,並具備全球處理以及美國與歐盟資料駐留。」Ultrafast 文件頁面現在寫道:「已廣泛提供給 GPT-6 Astra 與 GPT-6.1 Sol,並為 GPT-5.6 Sol 提供預覽存取」,而 ChatGPT 端的速度頁面則確認了訂閱方案的部分:Ultrafast 已在 Pro $500 的 Codex 與 ChatGPT Work,以及符合資格的 Enterprise 和 Edu 方案中提供。

Ultrafast 是一個服務層級,而非第二個模型

權重完全沒有改變。同樣的檢查點、同樣 1,050,000 token 的上下文視窗、同樣 922,000 token 的最大輸入、同樣 128,000 token 的輸出上限、同樣 2026 年 4 月 30 日的知識截止點、同樣的回答。你買到的是一種排程優先權:模型產生 token的速度更快,而 O​penAI 自己的說法刻意保守狹隘——這個等級「縮短了生成輸出 token 之間的時間」。它不會讓模型變得更聰明,也不會讓思考階段變得更短。

這個區別就是整個決策的關鍵。對於一個會連續發出四十次工具呼叫的代理迴圈,優勢會複合累積,因為每一回合的輸出都能更早送達。對於單一困難的推理請求,其大部分實際時間都花在思索上,你可能付了六倍的錢,卻盯著同一個載入轉圈。

等級階梯,用白話說一次:

• Batch and Flex — 價格只要 Standard 的一半,是專供沒人急著要的工作使用的低價通道

• 標準 — 每百萬個 Token:輸入 $2.00 / 快取 $0.10 / 快取寫入 $2.50 / 輸出 $10.00

• 快速 — 標準的兩倍,或 $4.00 / $0.20 / $5.00 / $20.00;OpenAI 於 2026 年 7 月 30 日將 Priority processing 更名為 Fast 模式

• 超快速 — 標準方案的六倍,或 $12.00 / $0.60 / $15.00 / $60.00

• 超過 272K 輸入 token — 整筆請求會以輸入與快取費率的 2 倍、輸出費率的 1.5 倍重新計價;Ultrafast 長上下文為 $24.00 / $1.20 / $30.00 / $90.00

沒有人會放上行銷頁面的那筆算術

以六倍的價格換取八倍的速度,並不是一筆虧本買賣,也不是免費的午餐。Ultrafast 按 token 計費,因此一件在 Standard 要價 $1.00 的工作,在 Ultrafast 要價 $6.00——而且大約只需八分之一的時間就能完成。省下的不是帳單金額,而是實際時間。你多付五美元,是為了消除那件工作八分之七的排隊時間;而這究竟便宜還是荒謬,完全取決於在另一端等待的人或管線每分鐘值多少錢。

隨之而來有兩項意涵,而它們正是最常被忽略的:

• 互動式工作是那個容易點頭的選項。開發者盯著 diff 落地、代理在讀到結果之前無法繼續——在這些情況下,延遲本身就是產品。在四十輪的迴圈中快上八倍的輸出,對人類感知而言並不是邊際改善;它是「你會拿來用的工具」與「你會丟到背景執行的工具」之間的差別。

• 排程型與批次型工作是最容易直接說不的情況。如果一項工作反正要到早上才有需要,用 Ultrafast 就是白花 6 倍的帳單,而半價的 Batch 通道就擺在那裡。

快取輸入值得再多看一眼,因為它也會變動:Ultrafast 上每百萬 $0.60,而 Standard 上是 $0.10,仍是非快取輸入費率的 5%。每回合都重新傳送大型系統提示的提示快取代理會發現,快取折扣會隨方案層級而變,而不是讓它們免受其影響。

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, alongside the page's notes that regional processing endpoints carry a 10% uplift, that FedRAMP endpoints carry a further 10%, that Priority processing was renamed Fast mode on July 30, 2026, and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

「最高 8 倍」這個數字是從哪裡來的

這是需要仔細閱讀的部分,因為正是在這裡,推出的標題與推出的說明文件悄悄地描述了不同的內容。

OpenAI 唯一公布的模型專屬速度測量數據,就是這句話:「GPT-6 Astra Ultrafast 在 Codex 中生成 token 的速度,最高可達 GPT-6 Astra 在 Standard 模式下速度的 8 倍。」那是 Astra 的數據,是在 Codex 中測得的。GPT-6.1 Sol 則沒有公布對等的倍數。說明此模型 Ultrafast 的文件提到,它可縮短生成輸出 token 之間的時間,並指向一份定價表;但未提供具體數字。ChatGPT 端的速度頁面只重述了 Astra 那句話,就沒有下文。

所以對「最快可達 8 倍」的誠實解讀是:這是該層級的主打說法,來自自 9 月 29 日起就登上 Ultrafast 的同系列姊妹模型,而且這是供應商宣稱,沒有任何獨立第三方對任一模型重現過。這很可能也適用於 GPT-6.1 Sol——兩者跑在相同的服務堆疊上,而且該層級的機制也相同——但 O​penAI 之外沒有人發表過 Sol 版本的每秒 token 數測量,而那句裡的「可達」確實在發揮實際作用。

也值得按模型將各層級分開,因為較舊的那個仍是尚未完成的事。Ultrafast 於 2026 年 8 月 13 日針對 GPT-5.6 Sol 宣布,號稱「比標準處理快最多 14 倍」,以限量預覽形式提供給特定客戶。三個月後,文件中仍寫著 GPT-5.6 Sol 具有「預覽存取權」,而 Ultrafast 定價表恰好包含兩行——GPT-6 Astra 與 GPT-6.1 Sol。一個從未達到一般可用性、也沒有公布費率的 14 倍數字,只是宣稱,不是產品。

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the statement that Ultrafast mode for GPT-6 Astra and GPT-6.1 Sol is available to all API users, the recommendation to use WebSockets because network overhead without a persistent connection can reduce the latency gains, the note that Ultrafast has separate rate limits from Standard and Fast modes, the GPT-6.1 Sol rate-limit row reading 1,000,000 / 4,000,000 / 40,000,000 tokens per minute and 5,000 / 20,000 / 200,000 requests per minute, the line that GPT-6.1 Sol supports US and EU data residency and global processing, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

到底是誰能真正把它開啟?

API 方面範圍很廣;訂閱方面則很窄,而這個差異常讓人措手不及。

• API — 所有 API 使用者皆可使用 gpt-6.1-sol,但速率限制與 Standard 及 Fast 分開計算。這表示要留意的是第二筆預算,而不只是第二個價格。

• GPT-6.1 Sol 的超高速速率限制 — Build 每分鐘 1,000,000 個 token,Launch 每分鐘 4,000,000 個,Grow 每分鐘 40,000,000 個。OpenAI 於 10 月 6 日將其用量層級從五個簡化為三個,因此這三個名稱是現行的層級,而非舊制。

• 資料落地 — GPT-6.1 Sol 支援美國與歐盟的資料落地以及全球處理,包括在 Fast 與 Ultrafast 模式下。Astra 的 Ultrafast 無法取得歐盟資料落地資格,因此若你的工作負載必須綁定在歐盟,這是第一款你真正能購買的 Ultrafast 配置。

• Codex 與 ChatGPT Work — Ultrafast 適用於 Pro $500 方案,以及符合資格的 Enterprise 與 Edu 方案。Enterprise 管理員的預設為關閉狀態,必須依使用者或依工作區逐一啟用。

• Chat——不包含在內。GPT-6.1 Sol 本身存在於 Work 與 Codex 中;消費者端的 Chat 介面不屬於此範圍。

• 訂閱方案的計費方式——隨附用量會以標準費率的 8 倍消耗,而已購買的額度或企業按用量付費則以標準費率的 6 倍計費。在讓它維持開啟之前,這兩個數字都值得先了解。

一個實作細節就能決定你是否看得到任何速度提升。OpenAI 的指引說得很直白:使用 WebSockets,「尤其是對於會快速連續發出大量工具呼叫的代理式應用程式」,因為「沒有持久連線,網路額外負擔可能會抵銷延遲改善」。如果你的用戶端每次呼叫都開啟新的 HTTP 連線,每次請求的額外負擔可能吃掉你才剛付 6 倍價格所換來的那個層級的全部優勢。HTTP 仍然可用。只是可能不值得選用那個層級。

我們會路由什麼,以及我們不會路由什麼

標準等級的 GPT-6.1 Sol 已在 OrcaRouter 上架,型號為openai/gpt-6.1-sol,以供應商自訂的每百萬個詞元 $2.00 輸入、$10.00 輸出計價,並以 0% 加成提供——直接沿用廠商牌價,因此當 O​penAI 調整費率時,這項變動會在登上價目表的同一天反映到你的帳單上,而不是等到下一次合約續約才生效。同一組金鑰與端點就能取用超過 200 個模型,因此 GPT-6.1 Sol 的呼叫與 Claude 或 Q​wen 的呼叫都位於同一個整合介面之後,具備自動容錯移轉,且無須第二份合約;當某項任務需要不只一種意見時,路由 DSL 還能將多個模型組合成單一呼叫。

Ultrafast 並不是那類模型之一,若暗示它是,就會造成誤導。它是 OpenAI 帳戶上的一個服務層級旗標——你把 service_tier: "ultrafast"送到gpt-6.1-sol,OpenAI 就會以上述費率向你的自有帳戶收費——所以它存在於你直連 OpenAI 的整合之內。如果你啟用它,就把分層流量留在你的供應商金鑰上,並把一般量的流量導向我們。這是誠實的分流做法,而對任何不是在等真人處理的事情來說,這也是更便宜的那一種。

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1M-token context window, 128K maximum output, text, image and file input with text output, vision, tools, JSON and reasoning capabilities, public benchmarks attributed to OpenAI dated 2026-09-29, input price $2.00 and output price $10.00 per 1M tokens, p50 time to first token 6.14 s, a 10.00 s figure, and 313.9M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

今天要怎麼處理它

如果你在 Pro $500 方案上有 Codex 或 ChatGPT Work 席次,那個切換開關已經在那裡了,試用對你唯一的代價就是用量倍率——用兩種方式跑同一個任務,看看你實際執行的迴圈是否有足夠的回合數讓那八倍提升顯現出來。如果你是使用 API,值得做的實驗比公告所暗示的範圍更窄:量測你的延遲中有多少是 token 生成、多少是模型在思考,然後把 Ultrafast 對準它真正能壓縮的部分。

而如果你能在同一請求上於 2x 的 Fast 和 6x 的 Ultrafast 之間做選擇,Fast 是先出現的那個層級,也是單憑價目表就能推斷其行為的那個。Ultrafast 對這個模型來說是新的,未經任何人獨立測量定價,其價值完全取決於你自己的碼錶怎麼說。

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新