一張生成的主視覺卡片,標題為「一個層級,三個模型」,帶有三個標籤,內容分別為「GPT-6.1 Sol Ultrafast:可用,$12.00 / $60.00」、「GPT-6 Astra Ultrafast:可用,$60.00 / $300.00」和「GPT-5.6 Sol Ultrafast:僅供預覽,未公布費率」,下方頁尾寫著「依 2026 年 10 月 9 日從 OpenAI 文件讀取所得」。
Guides & Insights

GPT-6.1 Sol Ultrafast 對決 GPT-5.6 Sol Ultrafast:同一層級,三款模型,其中一款仍在等待

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

GPT-6.1 Sol Ultrafast 與 GPT-5.6 Sol Ultrafast是套用於兩個不同 Sol 世代的相同服務層級,而在 2026 年 10 月 8 日之後,兩者處於完全相反的狀態。GPT-6.1 Sol從「即將推出」變成已公布的價目表——每百萬輸入權杖 12.00 美元、每百萬輸出權杖 60.00 美元,是 Standard 的六倍——所有 API 使用者都能使用,Pro 500 美元方案上的 Codex 與 ChatGPT Work 使用者亦然。GPT-5.6 Sol仍停留在 Ultrafast 最初開始的地方:一個已宣布的層級,處於有限預覽,定價頁面上完全沒有對應的欄位。同樣的名稱、同樣的機制,而其中只有一個是你買得到的。

那是簡短的版本。較長的版本之所以重要,是因為這個層級的主打速度數字分別對應到不同模型、在不同介面上測得,而且其中一項資料還已經過時三個月。

「Ultrafast」在各機型上實際上是什麼

在兩種模型上,Ultrafast 都不是獨立的檢查點。你傳送相同的模型 ID 並切換服務層級——model: "gpt-6.1-sol"搭配service_tier: "ultrafast"在 Responses API 中——​OpenAI 便會將你的請求排入低延遲路徑。權重、答案與上下文視窗皆維持不變。在 GPT-6.1 Sol 上,該視窗為 1,050,000 個 token,最大輸入為 922,000 個 token,最大輸出為 128,000 個;GPT-5.6 Sol 具有完全相同的視窗與輸出上限,主要差異在於知識截止日期(2026 年 2 月 16 日對比 2026 年 4 月 30 日),以及推理階梯,其中 GPT-5.6 Sol 仍接受 none,而 GPT-6.1 Sol 則不接受。

所以,比較的不是「哪個模型思考更快」。而是「同等級中的哪個世代對你開放」,而答案在四天前改變了。

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

已公佈的倍數,以及那個始終維持在 14 倍的數字

OpenAI 已針對這個層級,在兩個模型上發表了兩項速度宣稱,但兩者都不是關於「Ultrafast」的概括性陳述。

• GPT-6 Astra Ultrafast — 「在 Codex 中,生成 token 的速度最高可達 GPT-6 Astra 標準模式的 8 倍」。這是該級別目前的主打宣傳,在 ChatGPT 端的速度說明文件中反覆出現。

• GPT-5.6 Sol Ultrafast——於 2026 年 8 月 13 日宣布,其處理速度「最高比標準處理快 14 倍」,目前以有限預覽形式提供給特定客戶。

請注意少了什麼。GPT-6.1 Sol Ultrafast 並沒有公布任何速度倍數。它的說明文件頁面描述了這個方案層級、列出其速率限制與資料存放地立場,並指向定價表——但整套文件中唯一一個模型專屬的倍數,是屬於 Astra 的。誠實的立場是:「最高可達 8 倍」是 Astra 的實測數據,量測於同一套推論服務堆疊,而這個數字正是這次推行所主打的賣點,卻從來沒有任何人——無論是 O​penAI 內部或外部——針對 Sol 重現過。

14x 這個數字比它通常受到的質疑更值得存疑,因為它已經存在太久了。它在八月中為一個至今仍未達到一般可用性的層級宣布,約莫兩個月來未經修訂,而該層級本身卻是圍繞另外兩個模型重建的。在那段時間裡,最理所當然該期待的事——5.6 Sol 的 Ultrafast 會從預覽版畢業並獲得定價——從未發生。反倒是 GPT-6 Astra 在 9 月 29 日得到它,GPT-6.1 Sol 在 10 月 8 日得到它。一個只存在於公告中、附屬於沒有人買得到的配置的數字,在登上價目表之前,都只是行銷文案。

並列比較:每一項各需花費多少,以及誰能觸及它

• 標準費率 — GPT-6.1 Sol 每 100 萬個 token 為輸入 $2.00 / 快取 $0.10 / 快取寫入 $2.50 / 輸出 $10.00,相較於 GPT-5.6 Sol 的 $4.00 / $0.40 / $5.00 / $20.00

• 超高速費率 — GPT-6.1 Sol $12.00 / $0.60 / $15.00 / $60.00,依 6 倍標準規則公布,並於超高速定價表中擁有專屬一列;相較於 GPT-5.6 Sol,未公布費率

• 超過 272K 輸入 token 的長上下文 — GPT-6.1 Sol 將整個請求的輸入與快取費率重新定價為 2 倍、輸出為 1.5 倍,因此 Ultrafast 長上下文方案的價格為 $24.00 / $1.20 / $30.00 / $90.00,相較於 GPT-5.6 Sol 的 Ultrafast 對等方案,而後者從未有人公布

• 此層級的可用性 — GPT-6.1 Sol:所有 API 使用者皆可使用,但須遵守個別的速率限制;Codex 加上 ChatGPT Work 則適用於 Pro $500 及符合資格的 Enterprise 與 Edu 方案,對比 GPT-5.6 Sol:僅限特定 API 客戶的有限預覽

• 上線時的速率限制 — GPT-6.1 Sol 擁有專屬的 Ultrafast 額度,與 Standard 和 Fast 的限制分開計算,依組織個別設定,且相較於 GPT-5.6 Sol 可應要求調高,並未公開

• 資料駐留 — GPT-6.1 Sol 在 Fast 與 Ultrafast 下支援美國及歐盟駐留與全球處理,相較於 GPT-5.6 Sol 的美國駐留與全球處理

• 速度倍數 — GPT-6.1 Sol,未公布任何數據;GPT-5.6 Sol 在八月公告中稱「最高 14 倍」,尚未重現

• 上下文與輸出上限 — 兩者皆為 1,050,000 與 128,000

那份清單中有一項不對稱值得特別指出。GPT-6.1 Sol 是唯一具備歐盟資料駐留的 Ultrafast 組態:Astra 的 Ultrafast 僅限美國,而 5.6 Sol 則完全未開放。如果你的工作負載被綁定在歐盟處理,10 月 8 日是這個層級首次以任何形式可供你使用的日期。

在訂閱制中,差別在於方案,而非模型。

在 Codex 與 ChatGPT Work 中,兩代在結構上的行為方式相同——Ultrafast 是你現有模型上的一項速度設定——但它前面的存取門檻是新的。Ultrafast 適用於 Pro $500 以及符合資格的 Enterprise 與 Edu 方案,且在 Enterprise 工作區中預設為關閉,直到管理員啟用為止。在訂閱方案內,內含用量以標準費率的 8 倍消耗,而購買的點數或 Enterprise 隨用隨付則以 6 倍計費;在 API 上,每一項計價項目的乘數一律為固定 6 倍。

就 GPT-5.6 Sol 而言,上述這些目前全都還無法觸及。沒有訂閱途徑——ChatGPT 端的速率文件將 Ultrafast 列為支援 GPT-6 Astra 與 GPT-6.1 Sol——而 API 途徑仍受制於預覽測試群組。無論 14x 這個數字承諾了什麼,它承諾的對象都是一批兩個月來未曾擴大的帳號。

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

實際上該用哪一個,以及何時該等待

如果你從今天才開始,這個問題基本上會自己給出答案:GPT-6.1 Sol Ultrafast 買得到、有定價、也有文件,而 GPT-5.6 Sol Ultrafast 則否。之所以反而該伸手去拿較舊的模型,原因完全不在於等級本身——而是 GPT-5.6 Sol 自 2026 年 7 月 9 日起就已在市面上流通,若你已有針對它建立的提示詞套件、評估與成本模型,那麼遷移到知識截止點不同、推理階梯嚴格更窄的 Sol 更新版,其遷移成本是真實存在的,即使價格砍半也一樣。要移,就照它自己的時程移,而不是因為某個速度設定終於推出才移。

這個層級本身的決策規則,正是 Astra 的數字所暗示、而 Sol 所驗證的那一條:為了換取延遲降低而付出六倍價格,當人類或代理被輸出結果卡住時是划算的,而當一項工作還有餘裕等到期限時則不划算。GPT-6.1 Sol 的推出完全不會改變這套算計;它只是讓這件事能在更便宜的基礎模型上實現,而在那裡,快速完成一輪的絕對帳單金額更小。

而如果你想要的是 Fast 層級,只從價目表就能推論出來:Standard 的 2 倍;而且自從 OpenAI 在 2026 年 7 月 30 日將 Priority processing 更名以來,Fast 一直是穩定的中間選項。Ultrafast 仍然是那個你買到的是未經衡量承諾的層級,而在 GPT-5.6 Sol 這邊,更是你根本買不到的承諾。

從單一按鍵呼叫其中任一個

標準層級的 GPT-5.6 Sol 與 GPT-6.1 Sol 都已上架 OrcaRouter——openai/gpt-5.6-sol每百萬個 token 輸入 $4.00、輸出 $20.00,openai/gpt-6.1-sol則為 $2.00 與 $10.00——以 0% 加成提供服務,供應商的定價直接原樣傳遞,因此廠商調價當天就會反映到你的帳單上。這一點在這兩款模型上比平常更重要,因為 GPT-5.6 Sol 的 $4.00 / $20.00 明確是促銷價,而 OpenAI 表示至少會提供到 2026 年 11 月 21 日。當這個期間結束,兩代之間的差距就會縮小,而直通定價的平台意味著你會從用量數字中發現這件事,而不是從續約通知信裡得知。

同一組金鑰與端點即可支援超過 200 個模型,因此在自己的流量上比較兩代 Sol,不需要兩套整合或兩份合約;而當某個供應商效能下降時,自動容錯移轉能讓生產路徑持續運作。當單一答案不足時,路由 DSL 會將多個模型組合成一次呼叫,並由模型融合在背後組成一個模型小組。

我們不提供的是 Ultrafast。在兩種模型上,它都只是 OpenAI 帳戶上的一個服務層級旗標,而不是可單獨路由的模型,因此它仍留在你直接的 OpenAI 整合之中——而在 GPT-5.6 Sol 上,它甚至尚未全面開放。我們直白地把這點說清楚,因為另一種做法等於暗示我們擁有並不具備的能力。而那可不是我們想在這個部落格上寫下的一句話。

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新