一張生成的主視覺卡片,標題為「三則貼文深處」,副標題為「GPT-6.1 Ultrafast 為 Pro $500,僅在 ChatGPT 提供——開放給所有 API 使用者」,標籤寫著「Pro $500 方案」、「符合資格的 Enterprise 與 Edu」以及「所有 API 使用者」,頁尾寫著「可用性依 OpenAI 文件,2026 年 10 月 8 日」。
Guides & Insights

GPT-6.1 Ultrafast 的 Pro 只要 $500,而那個細節藏在三篇貼文深處

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

GPT-6.1 Sol Ultrafast於 2026 年 10 月 8 日登場,帶著一個速度層級產品所能推出最罕見的東西:公開定價。每百萬輸入 token 12.00 美元、每百萬輸出 token 60.00 美元,正好是GPT-6.1 Sol——亦即 OpenAI 在 2026 年 9 月 29 日 DevDay 2026 主題演講上發布的模型——在標準通道上價格的六倍。這則公告討論串沒有擺在開頭的是,ChatGPT 訂閱者實際上能在哪裡把它打開,而答案就在往下三則貼文處:500 美元的 Pro 方案。這個排序值得比它實際獲得的更多關注,因為這波推出的 API 那一半與訂閱那一半受到方向相反的管制,而這個差異決定了 Ultrafast 是這週就能試用的東西,還是得先買方案才能用的東西。

模型本身沒有任何改變。GPT-6.1 Sol Ultrafast 是相同的檢查點、相同的 1,050,000 個詞元上下文視窗、相同的 128,000 個詞元輸出上限、相同的 2026 年 4 月 30 日知識截止日期,而且與 GPT-6.1 Sol 給出的答案相同。Ultrafast 是一種服務層級——一種由你要求的排程優先順序——不是第二個模型。整個產品賣的就是延遲,並以倍數價格出售,而唯一重要的兩個問題是:你能得到多少,以及誰獲准購買。

紀錄實際上說了什麼,就按它所說的順序

這個故事的怨憤版本是 OpenAI 把那道閘門埋掉了。準確版本則更具體,而且可以逐行對照 OpenAI 自家文件來查核。

開發者更新日誌中有一則日期為10月8日的條目:在 Responses API 中為 GPT-6.1 Sol 新增 Ultrafast 模式,可透過傳送 model: "gpt-6.1-sol" 並搭配 service_tier: "ultrafast" 來要求使用;此模式被描述為可縮短生成輸出 token 之間的時間,並表示所有 API 使用者皆可使用,但須遵守速率限制,且提供全球處理以及美國與歐盟資料駐留。單看這一點,這是一項以公開費率推出、沒有限制的發布。

層級說明文件指出,Ultrafast 是 API 中最快的服務層級,廣泛提供給 GPT-6 Astra 和 GPT-6.1 Sol 使用,並提供 GPT-5.6 Sol 預覽存取,且建議搭配 WebSockets 使用。仍然沒有提到任何方案。

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

訂閱細節放在 ChatGPT 端的 speed 頁面上,而它其實是三個限制擠在同一段話裡:Ultrafast 可在 Codex 與 ChatGPT Work 中使用,適用於 Pro $500,以及符合資格的 Enterprise 與 Edu 方案。Enterprise 管理員預設會是關閉狀態,必須逐一為使用者或依工作區開啟。而消費端的 Chat 介面則完全不提供這個層級——GPT-6.1 Sol 本身存在於 Work 與 Codex 中,所以 Chat 從頭到尾都不在範圍內。

把這三頁放在一起,輪廓就清楚了。API 金鑰是一張票。ChatGPT 訂閱只有在它是 O​penAI 所販售最昂貴的方案時,或是有管理員替你啟用時,才是一張票。讀了那則公告第一篇貼文的人,誰也猜不到這一點。

為什麼這道關卡存在,而且它不是隨意設立的

顯而易見的解讀是,OpenAI 正在利用這條快車道來販售 500 美元方案。其背後的機制則沒那麼憤世嫉俗,反而更實用:Ultrafast 是一項昂貴的計量,而 500 美元方案是唯一能讓 8 倍計量納入內含用量的消費者方案。

在訂閱方案中,當你使用 Ultrafast 時,內含用量會以標準費率的八倍被消耗,因此單一次 Ultrafast 回合用掉的額度,等同於八次標準回合。這是這個層級本身運作方式的必然結果——它靠消耗服務容量來換取實際處理時間,而訂閱本質上是固定容量的產品。若八倍的容量消耗只收取相同的額度,方案在每月 20 美元的價位上就撐不住經濟模型;若收取八倍的額度,這個層級在小方案上就變得毫無吸引力。無論哪一種,這個層級最終都只能落在額度大到足以吸納它的方案上。

API 沒有這類限制,因為它是按用量計費的。在那裡,Ultrafast 擁有自己的速率限制額度,與 Standard 和 Fast 的額度分開,而 OpenAI 將這些限制描述為依組織設定,而非公佈在方案層級頁面上。這是公告沒有特別強調、值得留意的第二件事:將工作負載切換到 Ultrafast 不只是讓帳單倍增,還會把工作負載移到不同的上限;如果你將流量提高到超過該組織獲配的額度,方案層級自身的限制就會成為失效模式。

以兩種不同方式購買速度的算術

以下是這項決策的數字,而這部分值得用你自己的 token 數量來算,而不是用我的。假設有一個代理程式工作階段,每回合傳送 30,000 個輸入 token、接收 1,500 個輸出 token,共 40 回合。

• 每次執行的總 token 數 — 1,200,000 輸入、60,000 輸出,分散於 40 次請求,而每次請求都輕鬆低於 272,000 token 的門檻;達到該門檻時,OpenAI 會對整筆請求重新計價。

• 在標準 GPT-6.1 Sol 上 — 120 萬個 token,以每百萬 $2.00 計算,是 $2.40,再加上 60,000 個 token,以每百萬 $10.00 計算,是 $0.60。每次執行三美元。

• 在 GPT-6.1 Sol Ultrafast 上 — 120 萬以 $12.00 計算為 $14.40,再加上 60,000 以 $60.00 計算為 $3.60。每次執行十八美元。

• 差別在於——每次執行 $15.00,就能在一項除此之外不變的工作中,省下大部分的生成時間。

每次執行 $15.00 是你要拿來對比訂閱方案的數字。如果你考慮 Pro 方案唯一的原因是 Ultrafast,那麼在這些 token 數量下,大約每月 33 次執行,就是方案的 $500 與 API 按 token 計費的交叉點——低於這個次數,按 token 計費是購買同一層級更便宜的方式;高於這個次數,方案就開始勝出。你的 token 數量會讓這個交叉點移動,有時幅度還很大,所以在把 33 當成門檻之前,先算你自己的數字。這是我們針對所述工作負載所做的計算,不是官方公布的損益兩平點。

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>無論 token 數量為何都成立的兩項結構性說明。

那個速度宣稱是借來的,而這正是唯一需要仔細審視的一點。

Ultrafast 以「最高快 8 倍」作為賣點,而 OpenAI 在這句話背後所公布的唯一一項特定模型測量數據,其實屬於另一個模型。其說明文件中的句子寫道,GPT-6 Astra Ultrafast 在 Codex 中生成 token 的速度,最高可達 Standard 模式下 GPT-6 Astra 的 8 倍。那是 Astra 的數據,而且是在 Codex 中測得的。GPT-6.1 Sol 層級的說明文件將其描述為能縮短 token 間的時間,並指向一份費率表;文件並未給出數字,也沒有任何獨立第三方公布過 Sol 變體的 tokens-per-second 測量數據。

這很可能成立。兩個模型跑在相同的服務堆疊上,分層機制也一樣,因此 Astra 的倍數對 Sol 而言是合理的先驗。但「最高 8 倍」是廠商標示的上限,未經重現,而且是取自同門模型——而「最高」那兩個字在這句話裡可是扎扎實實地在發揮作用。把這個倍數當成假設,用自己的提示詞去驗證,因為該層級自己的文件從來不會替你測這件事。

同樣的但書,對較舊的層級說起來更省事。Ultrafast over GPT-5.6 Sol 於 2026 年 8 月 13 日宣布,在有限預覽中「最高比 Standard 處理快 14 倍」,而三個月後,文件仍寫著預覽存取,Ultrafast 費率表則恰好只有兩列——GPT-6 Astra 和 GPT-6.1 Sol。一個 14 倍的數字,既沒有公布價格,也沒有正式推出,與其說是產品,不如說是一項宣稱;這也適時提醒我們,這座層級階梯有多少部分仍只是抱負。

如果這個 $500 的方案不辦了

對於不打算花 {{1}}500{{/1}} 美元買 Pro 來測試某個延遲層級的人來說,有用的做法是把這項公告綁在一起的兩件事拆開來看。該層級已在 API 上開放給所有 API 使用者,因此不必訂閱就能買到這條快速通道——每百萬個 token 要價 {{2}}$12.00{{/2}} 與 {{3}}$60.00{{/3}},附帶自己專屬的速率限制額度,而且可以套用在規模小到足以測量的工作負載上。先在那裡、用你自己的提示詞,對照標準通道測試它。

標準通道,就是不需要這一切也依然存在的那條。OrcaRouter 以 openai/gpt-6.1-sol 提供 GPT-6.1 Sol,價格一併採用 O​penAI 自家的定價表——每百萬輸入詞元 2.00 美元、每百萬輸出詞元 10.00 美元——0% 加成,供應商價格原樣直接傳遞,因此廠商一旦調價,當天就會反映到我們這邊。極速不是我們販售的東西:它是計費在你自己的 O​penAI 帳戶上的一項服務層級旗標,我們寧可把話直說,也不願讓模型頁面暗示成別的。一把金鑰真正買到的,是能把標準通道與型錄其餘部分路由出去的能力——超過 200 個模型,全都在同一個 O​penAI 相容端點之後——以及在某個供應商降級時自動跨供應商容錯切換;如果你正打算在正式環境路徑前面放上一個延遲層級,這是最划得來的保險。

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

如果你使用的是 Plus 或 Team,而你想找的答案是「我能不能直接把它開啟」,答案是:不行,而且有特定條件。Codex 和 ChatGPT Work 要在 Pro $500,或符合資格的 Enterprise 或 Edu 方案上才能使用;如果是企業版類型,則需由管理員啟用。其他所有情況都必須透過 API 使用 Ultrafast,並按 token 計費。

接下來要看什麼

有三件事會讓這從一道設限的分階段推出,變成一次普通的推出,而這三件事全都可觀察。公布 GPT-6.1 Sol 的 Ultrafast 速率限制,就能終結這種憑空猜測:究竟是該層級自身的上限先觸頂,還是帳單先觸頂。一項針對特定模型的速度測量——或一項獨立的測量——將能以可用來評判 Sol 層級的依據,取代借來的 Astra 數字。而 Ultrafast 若登上 ChatGPT Plus,就意味著容量計算已改變,這正是訊號:那道門檻是推出初期的稀缺所致,而非該層級的永久形態。

在那之前,誠實的摘要範圍狹窄且可查證。GPT-6.1 Sol 於 2026 年 9 月 29 日推出,至今未變。2026 年 10 月 8 日,它獲得了一條附帶真實價格的快速通道,開放給 API 使用者,並在 ChatGPT 中以 $500 方案為門檻——這個細節值得放在第一篇文章,而不是第三篇,而且對大多數讀者而言,它決定了這究竟是一筆明細項目,還是一張採購單。

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新