
GPT-6 登陸 ChatGPT:Sol、Luna,以及 OpenAI 早已棄用的路線
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
2026 年 10 月 7 日GPT-6 Sol成為 ChatGPT 內部所有付費席次使用者的預設答案引擎,GPT-6 Astra維持 Pro 的 effort 等級,而GPT-6 Luna在 OpenAI 自家的公告中是為免費方案層級命名——然而同一產品的說明中心卻說 Free 和 Go 拿到的是 GPT-5.6 Luna。這些模型本身早在 2026 年 9 月 22 日就已推出,比這件事早了將近三週,所以本週它們的權重或價目表都沒有任何變動。真正變動的是它們在哪些地方可以取用,以及它們回應的是誰。麻煩之處在於另一個 Sol:GPT-6.1 Sol於 9 月 29 日發布,如今坐上了 OpenAI 旗艦定價表中 GPT-6 Sol 原本的位置,而那個以 GPT-6 Sol 進行基準測試的獨立評測機構,也已經將 GPT-6 Sol 標記為棄用,改以 GPT-6.1 Sol 取而代之。
如果你只想要實務上的結論:在付費的 ChatGPT 方案中,你正在對話的模型就是你可以透過 API 呼叫的同一個 GPT-6 Sol,而更有趣的是,OpenAI 已經開始以兩種方式逐漸與它保持距離。
10月7日究竟改變了什麼?
截至九月,GPT-6 是一個 API 世代,擁有三個成員,本身沒有面向消費者的介面。GPT-6 Astra 位居頂端,價格為 $10.00 / $50.00,GPT-6 Sol 居中,為 $2.00 / $10.00,而 GPT-6 Luna 位居最底層,為 $0.10 / $0.50。10 月 7 日,OpenAI 透過一項名為 Intelligent UI 的能力,將該世代呈現在每週使用 ChatGPT 的逾 12 億人面前;並於 10 月 8 日將推行範圍擴大至 Free 與 Go 層級。
Intelligent UI 是一種回應格式,而不是新模型。OpenAI 將其描述為「一組原生、可串流的元件庫,以及一個能在模型生成時處理介面的編譯器」,因此答案可以圖表、表單、可點擊的圖表、計算機或遊戲的形式出現,而不是一大片文字。OpenAI 提供的例子包括:用來探索儲蓄如何成長的計算機、與朋友聚餐時用的分帳工具,以及可以在對話中遊玩的遊戲。由於介面會在模型生成時同步編譯,回應可以在模型完成思考之前就開始出現——這是 10 月 7 日那項變化的另一半,也是較容易衡量的一半。
OpenAI 所附上的這兩項效能宣稱都是廠商自行提供的數據,且是在內部產生的。在 OpenAI 對「高價值、日常代理式任務」的評估中,GPT-6 在 Extra High 設定下開始回答的時間與 GPT-5.6 Medium 相同,但整體得分優於 GPT-5.6 Extra High。對於需要網路搜尋的問題,GPT-6 Instant 開始回答的平均時間比 GPT-5.6 Instant 快 44%。這兩項數據目前都還沒有獨立的對照結果,而且兩者都是與前一代的比較,而非與 OpenAI 目前銷售、定位在其之上的模型相比。
此次推出於10月7日在 Chat 分頁中涵蓋 Plus、Pro、Business 與 Enterprise,Free 與 Go 則自10月8日起跟進,而企業版可用性由工作場所管理員設定控管。驅動 Work 與 Codex 的模型則明確維持不變。
實際上是哪個模型在回答你?
層級規則值得釐清,因為兩個 OpenAI 介面在同一天對它的描述各不相同。
• ChatGPT Instant、Medium、High 與 Extra High,於 Plus、Pro、Business 與 Enterprise:GPT-6 Sol
• ChatGPT 在 Pro 推理等級:GPT-6 Pro,由 GPT-6 Astra 驅動
• Free 與 Go,依 OpenAI 公告:GPT-6 Luna
• Free 與 Go,依 OpenAI 針對 ChatGPT 中 GPT-6 的說明中心:GPT-5.6 Luna
公告明確表示:「ChatGPT 中的 GPT-6,在 Plus、Pro、Business 和 Enterprise 層級由 GPT-6 Sol 驅動,在 Free 和 Go 層級則由 GPT-6 Luna 驅動。」同日讀到的說明中心頁面則說,在 Instant 之下——「為日常問題提供快速回覆」——Free 和 Go 使用 GPT-5.6 Luna,並補充說 Free 和 Go 使用者獲得 GPT-5.6 Luna,無法使用 GPT-5.6 Sol。這些是關於同一層級卻互不相容的陳述。其中一則已過時,或其中一則有誤,而 OpenAI 並未說明是哪一則。如果你的工作取決於免費層級背後是哪個便宜模型,請把說明中心條目視為較具體的頁面,把公告視為較概括的頁面,並在依據其中任一者建置之前重新查核。
第二件要注意的事是,「GPT-6」從來就不是單一模型,而且付費方案也不會取得特殊的檢查點。在 Plus 席次上回答 ChatGPT 問題的 GPT-6 Sol,與下方 API 費率表上的 GPT-6 Sol 是同一個。消費者端介面是一條配銷通路,而不是不同的 SKU。
獨立讀取,以及一個棄用旗標
Artificial Analysis 對這些模型進行基準測試時並未向廠商收取費用,而其 GPT-6 Sol 頁面目前帶有棄用通知。該頁面指出「OpenAI 已推出較新的版本 GPT-6.1 Sol」,並建議改為考慮該版本,同時指出只有預設的 10k 輸入 token 工作負載會繼續進行基準測試,其他工作負載的結果則凍結為歷史資料。

就目前的數據而言:GPT-6 Sol 在最大推理設定下,於 Artificial Analysis Intelligence Index 拿下 48 分,在該排行榜的 212 個模型中排名第 18,Coding Index 為 60,Agentic Index 為 52.5,每百萬個 token 混合計價為 $1.54。GPT-6.1 Sol 在同一指數拿下 51.8 分,混合計價為 $1.47——以評測者的混合計價基準而言,這是以更低價格取得更高分數。GPT-6 Astra 拿下 52.7 分,混合計價為 $7.70;GPT-6 Luna 則為 38.1 分,價格為 $0.077。這些是獨立數據,而非廠商圖表;它們是比較兩款 Sol 模型的誠實依據,因為 OpenAI 從未公布兩者的相互對照。
有兩點但書。首先,指數分數不等於工作負載:GPT-6 Sol 是一個推理模型,具有可設定的 reasoning.effort,其範圍從 none 到 max,而上述數字是它的一種組態,不是一個範圍。如果某項決策取決於兩、三分的差距,請用自己的流量來做基準測試。第二,在獨立評估機構被標示為已棄用,意味著測量數據已停止更新;這並不表示供應商已讓該模型退役。這兩件事是分開的,而本週只發生了第一件。
供應商這一邊實際發生的情況則低調得多。OpenAI 目前的定價表在其旗艦級欄位中列出了 GPT-6 Astra、GPT-6.1 Sol 和 GPT-6 Luna。它並未列出 GPT-6 Sol,而這正是該表對已被取代世代的做法。該模型仍可呼叫,也仍在其專屬頁面上留有文件說明;該頁將它計費為每百萬輸入 token 2.00 美元、快取輸入 0.20 美元、快取寫入 2.50 美元,以及輸出 10.00 美元,並具備 1,050,000 個 token 的上下文視窗與 128,000 個 token 的輸出上限——而且其中還有一行指引讀者,將 GPT-6.1 Sol 標示為較新的 Sol 模型。
兩張 Sol 費率卡,並排對照
因為這兩款車型的頭款價格相同,差異會顯現在其下的分級之中。
• 標準輸入:GPT-6 Sol 每百萬 $2.00,GPT-6.1 Sol 每百萬 $2.00
• 標準輸出:GPT-6 Sol 每百萬 $10.00,GPT-6.1 Sol 每百萬 $10.00
• 快取輸入:GPT-6 Sol 每百萬 $0.20,GPT-6.1 Sol 每百萬 $0.10
• 快取寫入:GPT-6 Sol 每百萬 $2.50,GPT-6.1 Sol 每百萬 $2.50
• 超過 272K 輸入 token 時:兩者都會將整個請求重新計價為 $4.00 / $15.00
• 超過 272K 的快取輸入:GPT-6 Sol 每百萬 $0.40,GPT-6.1 Sol 每百萬 $0.20
• 上下文與輸出:兩者皆為輸入 1,050,000 個 token,輸出 128,000 個 token
• 推理強度:兩者皆提供可設定的 reasoning.effort,從 none 到 max
長上下文規則與 OpenAI 在這一代產品線中所採用的一致:輸入 token 超過 272,000 的提示,整筆請求都會以輸入與快取費率的 2 倍、輸出費率的 1.5 倍計費,而不只是超過門檻的那一部分。實務上的解讀是,GPT-6.1 Sol 的定價相同,但兩個層級的cached input 都是半價,獨立評分更佳,而且基準測試更新仍在進行中。之所以仍選擇鎖定 GPT-6 Sol,是因為你的評估基準是針對它建立的——而這點說的是你的回歸測試套件,而不是這些模型本身。

這讓任何在其上構建的人處於什麼境地
隨之而來有三個後果。首先,這個世代本身並沒有專屬的模型 ID:在 OrcaRouter 上,四條現行路由是 openai/gpt-6-sol、openai/gpt-6-luna、openai/gpt-6-astra 與 openai/gpt-6.1-sol,各自有自己的費率表與自己的角色,而且沒有 openai/gpt-6 可呼叫。如果你的程式碼寫著「GPT-6」,它會根據執行所在的位置,表達四種不同的意思。
第二,消費端介面的變化速度比 API 更快。智慧 UI 在 Chat 分頁中登場的時程,與模型發布毫無關係,而它也會以類似的時程再次變動。你為正式環境打造的任何東西,只要依賴生成功能,就應該依賴固定的 model id,以及你已讀過的價目表,而不是依賴 ChatGPT 這個月正在宣傳哪些能力。
第三,當評估機構與供應商在相隔數週內都開始將某個模型標記為已被取代時,順利移轉的窗口便已開啟,而且不會無限期地敞開。
在一個正處於轉型中期的世代中進行路由
像這樣的轉換,麻煩之處在於舊模型仍然可用,而新模型在你的流量上可能還沒比較好。這正是 OrcaRouter 為此打造的情境:一個 API 置於 200 多個模型之前,供應商的定價以 0% 加價原樣傳遞,因此供應商價格變動當天就會反映在這裡,而不是等到你下次帳務對帳時才出現,此外若某條路由品質下降,會自動跨供應商容錯移轉。四個 GPT-6 模型都是同一份目錄中的上線路由,透過 OpenAI 相容的 chat completions 與 Responses 端點呼叫,因此把流量從一個 Sol 移到另一個,只是改動 model-id,而不是重寫。路由 DSL 讓你依請求大小或流量占比來拆分,這正是這類遷移的常見模式:把一部分流量送往 GPT-6.1 Sol,用你自己的評估進行比較,擴大該比例,並保留 GPT-6 Sol 作為備援,直到數據證明並非如此為止。
OrcaRouter 不會做的一件事,就是把 Intelligent UI 交到你手上。那項能力屬於 ChatGPT 自身的介面——它是用戶端裡的渲染管線,而不是模型,且 API 回應中沒有任何東西會將它轉售出去。

底線
10月7日的變動是一次發布事件,而非模型發布。GPT-6 Sol 成為付費 ChatGPT 席次的預設答案引擎,而 Intelligent UI 則讓它有了新的曝光舞台;這些模型本身可追溯至 2026 年 9 月 22 日。開發者應該據以行動的是:OpenAI 已將 GPT-6 Sol 從其旗艦定價表中移除,一家獨立評測機構已將其標記為棄用,而後繼模型每 token 成本相同、快取經濟效益更佳,且基準測試仍在持續更新中——與此同時,ChatGPT 仍持續向每週十億以上的使用者提供較舊的模型。只有在凍結的評估基準線比這個差距更有價值時,才鎖定 GPT-6 Sol;否則 GPT-6.1 Sol 價格相同,具備持續維護的基準測試與更佳的快取經濟效益,而遷移只不過是變更模型 ID。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
