
GPT-5.6 Sol Ultrafast:Ultrafast 以標準價格的 6 倍推出,但此模型仍僅限預覽
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
這個層級的等待已經結束,但這款模型還沒。在 2026 年 9 月 29 日的 DevDay 上,供應商把 Ultrafast 變成能買到的東西:每月 500 美元的新 ChatGPT Pro 500 方案將其納入,API 現在公布 Ultrafast 價目表,費率是標準費率的六倍——GPT-6 Astra 上每百萬個 token 為 60.00 美元輸入/300.00 美元輸出——而供應商的 Codex 文件確認,Pro 層級完全沒有五小時使用限制,該限制適用於 Plus。這些全都是供應商所述,發布於供應商自家的 DevDay 回顧、說明頁面與開發者文件。仍未有變動的,是本頁所談的模型。GPT-5.6 Sol Ultrafast,於 2026 年 8 月 13 日宣布,作為 Cerebras 加速的服務層級,適用於 GPT-5.6 Sol,最高可達標準吞吐量的 14 倍,以及每秒 750 個輸出 token,目前仍僅限預覽存取——透過供應商的客戶團隊安排——而且本身仍沒有公布價格。該層級已經推出。Sol 變體仍在等待。
自從我們第一次撰寫這篇報導以來,出現了兩波價格變動,而且方向相反。底層的模型變便宜了:標準版 GPT-5.6 Sol 現在的計費是每百萬輸入 token 4.00 美元、每百萬輸出 token 20.00 美元——這是 OpenAI 的促銷價,該廠商表示至少會持續到 2026 年 11 月 21 日——而非八月當時現行的 5.00/30.00 美元。疊加在其上的速度等級首次有了定價,而且並不便宜:GPT-6 Astra 的 Ultrafast 方案計費為每百萬 60.00/300.00 美元。本文中的每一項數字,都已於 2026-09-30 對照 OpenAI 公布的價目表、其 API 參考文件及其 Codex 定價說明文件重新查核過。
Ultrafast mode 實際上是什麼
Ultrafast 是一種服務層級,不是新模型。OpenAI 於 2026 年 8 月 13 日宣布,它是其與晶片製造商 Cerebras 於 2026 年 1 月建立的運算合作夥伴關係的首項產品——據報導,這筆交易為期三年,金額約 100 億美元。相較之下,標準的GPT-5.6 Sol推論在 GPU 叢集上執行,且大部分時間都花在記憶體與運算單元之間搬移權重,而 Ultrafast 則將模型權重載入 Cerebras 晶圓級晶片上的 44 GB 片上 SRAM;Sol 這種規模的模型會分層橫跨數個晶圓,因此權重就位於運算所在之處。結果是,吞吐量上限由矽晶而非記憶體頻寬決定。
硬體領域在2026年8月18日迎來新進展。在Supernova活動上,Cerebras發表了CS-4,這是基於Nexus平台打造的下一代機架級系統——每個機架配備三顆Wafer-Scale Engine晶片,token生成速度最高達前代CS-3的2倍,且依Cerebras所言,在超過10兆參數的模型上,每秒可產生逾1,000個token。這些是Cerebras針對一款仍處於早期存取、尚未全面供應的系統所提出的數據。自發表以來,X上僅有一篇貼文聲稱CS-4已能以每秒約1,300個token的速度服務GPT-5.6 Sol——方向與Cerebras自家數字一致,但至今無人證實。請將其視為早期訊號:看似合理、未經驗證,若要以它為依據規劃容量,值得再行查證。
對你的程式碼而言,重點是:模型 ID、權重、推理行為和輸出皆與標準 GPT-5.6 Sol 一致。OpenAI 將 Ultrafast 定位為「每秒更有用的工作量」,而非品質等級,且預覽版運行的是完整旗艦模型——速度並非來自於換用較便宜的模型。改變的只是 token 產出的速度。
別把 Ultrafast 和快速模式混為一談。快速模式是在標準硬體上另行選購的層級:輸出速度最高約 2.5 倍,代價是每 token 貴 2 倍,品質則不變——它於 2026 年 7 月 30 日從 Priority Processing 更名而來,而在 GPT-5.6 Sol 上,每 1M 為 $8.00 輸入 / $40.00 輸出。Ultrafast 則是另一回事——採用 Cerebras 硬體,在 GPT-5.6 Sol 上最高可達 14 倍,在 GPT-6 Astra 上最高可達 8 倍,在 Astra 上的費用是標準費率的 6 倍,在 Sol 上則尚未定價。這兩個名稱現在並列在同一個模型選擇器中,而這依然是這次發布最令人困惑的一點。
有多快 — 重要的數字

標題數字是14倍,而且需要定義。OpenAI表示,Ultrafast每秒最多可生成750個輸出token,相較於標準GPT-5.6 Sol處理。這是輸出token的吞吐量數字,而不是一個籠統的「一切運行速度快14倍」的說法——端到端的請求時間還包括輸入處理和模型自身的推理,這就是為什麼14倍被標記為最大值。
• 最大輸出吞吐量 — 根據 OpenAI 的公告(2026-08-13),最高每秒可達 750 個輸出 token。
• 相較於標準處理 — 根據同一份公告,最高可快達 14 倍;實際增益會因輸入長度與任務類型而異。
• Humanity's Last Exam,2,500 道題目——OpenAI/Cerebras 報告 GPT-5.6 Sol Ultrafast 在 11 小時 11 分鐘內完成,相較於 Claude Fable 5 的 78 小時 27 分鐘,且準確度相當。由廠商自行回報,且這項比較橫跨兩家廠商的硬體堆疊——應將其視為方向性參考,而非定論。
• GDP-Val,端到端 — Cerebras 回報整體快 5.6 倍,且沒有可量測的品質損失。同樣為廠商回報。
• Fast mode 與 Ultrafast 的比較 —— Fast mode 的輸出速度最高約可達 2.5 倍,但需多付 2 倍的價格,且上限與標準定價相同,約為 272K 個 token。Ultrafast 則是更大幅度的躍進:根據八月的公告,在 GPT-5.6 Sol 上可達 14 倍;而根據 OpenAI 目前的文件,在 Codex 中的 GPT-6 Astra 上最高可達 8 倍,發表時的報導更指出這相當於每秒最高 300 個輸出 token。
• CS-4,下一代硬體——Cerebras 宣稱 CS-4 機架在超過 10 兆參數的模型上每秒可產生超過 1,000 個 token,token 生成速度最高可達 CS-3 的 2 倍。一份未經證實的社群報告指出,GPT-5.6 Sol 在 CS-4 上約為每秒 1,300 個 token——方向一致,但尚未獲得 OpenAI 或 Cerebras 證實。
在引用 14× 之前,有一點要提醒:那是單一廠商硬體上的輸出吞吐量上限,而針對八月發表的獨立比較,依所測量的工作負載部分不同,大約落在 7× 到 11× 之間。同樣的嚴謹態度也適用於 CS-4 的速度訊號——GPT-5.6 Sol 在 CS-4 上約 1,300 token/s 的數字,最初只是來自一則 X 貼文,OpenAI 和 Cerebras 都尚未證實。把這些全都當成廠商與社群的說法,而非基準測試的定論。
Ultrafast 現在要花多少錢——以及為何這仍無法為 Sol 定價

以下是 2026-09-30 價格問題的狀態,直白說明。Ultrafast 有一項公開費率——針對 GPT-6 Astra,且僅限 GPT-6 Astra。OpenAI 的定價頁面現在在 Standard、Batch、Flex 和 Fast 之外,還有一欄 Ultrafast:在短情境下,每百萬 token 為 $60.00 輸入 / $6.00 快取輸入 / $75.00 快取寫入 / $300.00 輸出,超過約 272K token 後倍增至 $120.00 / $12.00 / $150.00 / $450.00。這是標準 Astra 費率的六倍,而 Fast 模式是兩倍——也是 OpenAI 為該層級給出的第一個硬數字。上方那張卡是我們自己的 2026-08-18 快照,其美元數字已被兩度取代:先是標準費率調降,現在則是這列 Ultrafast。那張表仍缺少的是 GPT-5.6 Sol 的任何 Ultrafast 費率:Ultrafast 欄只列出一個模型,gpt-6-astra。該層級已有定價;這個模型則沒有。
你今天可以定價的項目,依型號逐一如下:
• 標準 GPT-5.6 Sol — 每 1M tokens 輸入 $4.00/輸出 $20.00,適用於大約 272K tokens 以內的提示。OpenAI 將此列為促銷價格,至少提供至 2026 年 11 月 21 日。這是您現在就能呼叫的基準方案。
• Fast mode — 在 GPT-5.6 Sol 上,短上下文為 $8.00 / $40.00,超過約 272K token 後加倍至 $16.00 / $60.00。價格是標準費率的兩倍,換來最高約 2.5 倍的輸出速度;而在 Sol 上,它依然是你能真正買到的最快選擇。
• 提示快取 — 快取讀取每 1M 計費 $0.40(比全新輸入便宜 90%);快取寫入每 1M 計費 $5.00。
• 長上下文層級 — 超過約 272K 個 token 的輸入,在標準處理下按 $8.00 / $30.00 計費,且落在模型約 1.05M token 的視窗與 128K token 的最大輸出範圍內。
• Batch API — 短上下文 $2.00 / $10.00,長上下文 $4.00 / $15.00,一律 50% 折扣,約 24 小時完成。
對 GPT-5.6 Sol 而言,Astra 這個數字是目前可得的最佳線索,僅此而已。OpenAI 將 Ultrafast 定價為底層模型標準費率的 6 倍;把這個倍率套用到 Sol 的 $4 / $20,就會得出每百萬 $24 / $120。這是算術推算,不是已公布的價格——OpenAI 從未提及 Sol Ultrafast 的費率,而八月的預覽批次根本沒有按分級費率計費。在供應商公布該費率列之前,請以標準 Sol 的 $4 / $20 或快速模式的 $8 / $40 來規劃。
如何使用——在 Astra 上已廣泛提供,在 Sol 上仍需申請
存取權在9月29日一分為二,而這樣的分流對本頁所涵蓋的模型不利。Ultrafast 現在已在 GPT-6 Astra 上廣泛提供:OpenAI 的 API 文件指出,它以較低的速率限制開放給所有 API 使用者——使用層級 1–3 為每分鐘 500,000 個 token,第 4 層為 100 萬個,第 5 層為 500 萬個——並且它隨新的 Pro 500 方案,以及符合資格的 Enterprise 與 Edu 方案,內建於 ChatGPT Work 和 Codex 中;在這些方案中,工作區擁有者必須自行開啟它,而對於需要在美國境外進行推論的工作區則不支援。GPT-5.6 Sol Ultrafast 並未隨之轉移。同一份文件仍將其描述為透過 OpenAI 客戶團隊取得的預覽存取權,而該參數在 API schema 中的自身描述仍寫著「currently available for gpt-5.6-sol」——這句話如今已落後於文件的其他部分,而非引領它們。如果你今天就想用這個層級,你就得在 Astra 上用它。
介面問題也已定案。TestingCatalog 於 2026 年 9 月 26 日報導,一個提供 Standard、Fast 與 Ultrafast 的速度選擇器,一直未發布地存在於 Responses API Playground 中;三天後,OpenAI 推出了正是那樣的消費端版本,其中 Ultrafast 現在已是 Pro 500 上 ChatGPT Work 與 Codex 模型選擇器中的選項。我們當時將那次目擊標註為某家媒體對未發布 UI 的解讀,並表示 OpenAI 並未證實其中任何一點。它在方向上正確,而它所指向的推出是在 DevDay 當天到來,而非之後。
OpenAI 在八月點名的預覽群組包括程式設計、商務、金融研究、支援,以及其他互動式工作負載——這些團隊的代理程式每次請求會發出許多呼叫,且回應延遲是瓶頸。Jane Street、Rogo 和 Podium 都在被點名的早期測試者之列。如果你的工作負載是單輪對話,速度層級的重要性遠低於 40 次呼叫的代理程式迴圈。現在實務上的答案取決於你問的是哪個模型:在 GPT-6 Astra 上,你今天下午就能設定 service_tier: "ultrafast";而在 GPT-5.6 Sol 上,你仍然不行。
你今天能做什麼——務實的答案

在 GPT-5.6 Sol Ultrafast 仍留在預覽門後的同時,兩款旗艦模型都已以供應商費率在 OrcaRouter 上線,每 token 加價 $0 —— 模型 ID openai/gpt-5.6-sol可透過 api.orcarouter.ai/v1 的 OpenAI 相容端點取用,而 GPT-6 Astra 就在一旁,採用標準的 $10.00 / $50.00,也就是 OpenAI 如今在其上加了一層 Ultrafast 的模型,而我們並未在該層級提供路由。下方的截圖來自 2026 年 8 月,仍顯示當時的 $5.00 / $30.00 價格;今日的 Sol 費率是 $4.00 / $20.00,而這正是我們實際轉嫁的價格。正因為是直接轉嫁,供應商的價格變動當天就會反映到我們這邊:輸入 $4.00 / 輸出 $20.00,與 OpenAI 公佈的數字相同,沒有額外加上每 token 加價。如果你已經有 OpenAI 用戶端,遷移不過是變更 base-URL 和模型 ID;其他都不用動。同一組金鑰與端點即可取用 200+ 個模型,因此 Sol 與自家的兄弟模型並列 —— GPT-5.6 Terra 為 $2.00 / $12.00,以及 GPT-5.6 Luna 為 $0.20 / $1.20 —— 還有你可能拿來與它比較的開放權重模型,而你可以依難度來路由,不必逐一重新整合。
在速度頁面上,有兩個 OrcaRouter 的具體特點值得點名。BYOK:自備你的 OpenAI 金鑰,OpenAI 會直接按其自身費率向你收費——OrcaRouter 每 token 加收 $0,並讓你的供應商速率限制與額度維持不變。Guardrails:PII Shield 與內容政策會在計費前執行,因此被封鎖的請求會回傳乾淨的 400,且絕不會被收費;Agent Firewall 則會在工具與 MCP 呼叫執行前對其評分。Ultrafast 本身已在 GPT-6 Astra 上廣泛提供,但並非以可路由條款提供,也不適用於 Sol——它是受存取控制的層級,按標準費率的 6 倍計費,而我們不提供它。如果 OpenAI 未來以標準條款提供它,把它接入同一個端點只是變更 model-id;你今天建立的設定會沿用下去。
誠實的界線——當Ultrafast不是答案時
速度敘事仍有五處站不住腳,如今其中一半已經塵埃落定:
可用不等於你可以使用。Ultrafast 在 GPT-6 Astra 上向所有 API 使用者開放,但開放時的速率限制很低,在 OpenAI 的 schema 中仍被描述為受存取控管,不支援 EU 或其他非美國地區的處理,而且在 Enterprise 工作區中,除非由擁有者啟用,否則維持關閉。在 GPT-5.6 Sol 上則完全沒有開放。在你以任一者為基礎進行架構設計之前,先確認你自己的存取權限。
14× 是最大值,而非保證。它是 Cerebras 硬體上的輸出吞吐量上限;端到端延遲仍包含輸入處理、模型的推理時間,以及你自己的網路。一個推理繁重的提示,可能大部分實際時間都花在思考上,此時標題所宣稱的加速幅度就會縮小。
其中一個型號有標價,另一個則沒有。Astra Ultrafast 的費率是有公布的——為標準價的 6 倍——而 GPT-5.6 Sol 在任何地方都沒有 Ultrafast 這一列。請以標準 Sol 的 $4 / $20,或快速模式的 $8 / $40 來編列預算,並把你看到的任何「GPT-5.6 Sol Ultrafast 成本」數字(包括上方 $24 / $120 的外推值)一律視為算術推算,而非正式費率表。
這些基準測試數據是由廠商自行提供的。11 小時的 HLE 執行與 5.6× GDP-Val 數據,是 OpenAI/Cerebras 在八月公告中提供的數字;針對加速幅度的獨立估計則介於約 7× 到 11× 之間,取決於衡量的是什麼。把 CS-4 的訊號也加入這份清單:GPT-5.6 Sol 在 CS-4 上約 1,300 token/秒的數據,來自單一 X 貼文,且沒有獨立佐證。新的 Astra Ultrafast 數據——在 Codex 中 8×、價格 6×——同樣是 OpenAI 自家的數字。
而那個省錢而非省時間的作法:它不會解決你並未遇到的問題。如果你的代理程式之所以慢,是因為你的協調編排、工具延遲,或是輸入量龐大的提示詞,那麼更快的輸出途徑只能稍稍改善尾端延遲。分級配對——GPT-5.6 Sol 為 $4 / $20,對比 GPT-5.6 Terra 為 $2 / $12,再對比 GPT-5.6 Luna 為 $0.20 / $1.20——對你的帳單影響,依然大於速度分級。
重點結論。Ultrafast 不再只是你只能聽聞的候補名單層級。自 2026 年 9 月 29 日起,OpenAI 正式開賣:在 Work 與 Codex 中隨 $500 的 ChatGPT Pro 500 方案提供,所有 API 使用者可在 GPT-6 Astra 上以低速率限制使用,且定價為標準費率的六倍——每百萬短上下文 $60 / $300。GPT-5.6 Sol Ultrafast,也就是本頁原本圍繞介紹的八月預覽版,則毫無變動:仍受存取控管、在 API schema 中仍僅限 gpt-5.6-sol、仍未定價,而據稱 Sol 在 Cerebras CS-4 上約 1,300 token/秒的數字,依舊只是單一則未經證實的 X 貼文。標準版 GPT-5.6 Sol 以 $4 / $20 的價格,是你今天就能在 OrcaRouter 上以零加成呼叫的;而 GPT-6 Astra 以 $10 / $50 的價格,則是若你想要那個得到 Ultrafast 定位的模型時,可以呼叫的選擇。
Ultrafast 在 GPT-6 Astra 上現在得實際付費了——是標準方案的 6 倍,或是打包在 500 美元的 Pro 500 方案中——而 GPT-5.6 Sol Ultrafast 仍處於預覽階段。完整的 GPT-5.6 Sol 已在 OrcaRouter 上線,每百萬個 token 收費 4 美元/20 美元,零加價,隨時可用你自己的金鑰。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
