
GPT-6.1 Sol:OpenAI 以近乎 Astra 的效能,推出與所取代機型同價的產品
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 934 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 194 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1167 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
OpenAI 於 2026 年 9 月 29 日的 DevDay 2026 主題演講上發布了 GPT-6.1 Sol——這是對一週前才推出高階 GPT-6 Sol 層級的更新,價格完全相同:每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,而廠商將其定位為以大約 Astra 每 token 成本五分之一的代價,逼近 GPT-6 Astra,也就是每百萬輸入 10 美元、輸出 50 美元的旗艦機型。不尋常的地方不在價格,而在於這個價格不變、晚一週推出的更新版竟宣稱能力出現跳躍式提升,而且截至本文撰寫之際,還沒有任何獨立評測機構為它打過分。本文中每一個來自 OpenAI 的能力數字都經過標註,因為目前還沒有其他資料可供核對。
實際發布了什麼,以及何時發布

這次發布的資料記錄異常完整,就一場 DevDay 發表會而言,這本身就值得一提:幾個小時內就冒出了模型頁面、定價表、system card 增補文件,以及該廠商公開 API schema 中一筆已提交的項目——一筆於 9 月 29 日 17:16 UTC 提交、標題為「Add gpt-6.1-sol model to model enums」的 commit,而其父修訂版中該字串出現次數為零。然而,廠商自家的 changelog 仍停在 9 月 22 日發布的GPT-6 Sol與 GPT-6 Luna;6.1 Sol 的條目尚未寫進那裡,因此模型頁面與發表貼文才是正式記錄。
具體的樣貌:
• 模型 ID: gpt-6.1-sol,單一快照,沒有帶日期的變體——你永遠使用當前版本。
• 可用性:即日起提供給 ChatGPT Work 與 Codex 中的 Plus、Pro、Business、Enterprise 和 Edu 使用者,並可透過 API 使用。明確不包含在消費端 Chat 產品中,這點 OpenAI 有明說,而非留待推斷。
• 上下文:1,050,000 個 token,最大輸出 128,000,知識截止日為 2026 年 4 月 30 日。
• 推理控制:low、medium(預設)、high、xhigh 與 max——五個等級,不是六個。GPT-6.1 Sol 與 GPT-6 Astra 不再接受 GPT-6 Sol 與 GPT-6 Luna 所接受的 none 強度。
• 模態:輸入文字與圖像,輸出文字。不支援音訊與視訊輸入。
• 工具:網頁搜尋、檔案搜尋、圖像生成、程式碼解譯器、託管 shell、apply patch、skills、電腦操作、MCP 與工具搜尋——全部透過 Responses API。Chat Completions 僅在沒有工具時可用。
• 不支援:微調。這是讓你下提示詞的模型,不是讓你訓練的模型。
• 已宣布,尚未推出:Ultrafast 層級。OpenAI 表示將「在未來幾天內」提供 GPT-6.1 Sol Ultrafast,在 Codex 中 token 生成速度最高可快 8 倍,但未附上價格與日期。
有兩行值得再讀一次。五級努力程度階梯意味著,一個使用了 none 作為廉價逃生出口的提示,將在 6.1 Sol 上驗證失敗,而廠商針對正是從 gpt-6-sol 的這項移轉發布了遷移指引。而 Ultrafast 產品線值得仔細閱讀:同一層級已廣泛提供給 GPT-6 Astra,並在 GPT-5.6 Sol 上處於預覽階段,因此 6.1 Sol 被描述為即將加入一個已存在於其他模型的層級——而非一個全新層級。
定價,以及它真正讓人吃不消的地方
主要費率與 GPT-6 Sol 相比維持不變:每百萬輸入 token 2.00 美元、每百萬輸出 token 10.00 美元,快取寫入則為 2.50 美元。廠商在公告中自己的說法,是與其旗艦產品相比,其中 2/10 美元是 GPT-6 Astra 的 10/50 美元的五分之一——這確實是實質差距,也是整份價目表上最不有趣的數字,因為 GPT-6 Sol 本來就已經是 2/10 美元。
真正有變的是快取輸入那一行,而它正是會左右預算的項目。GPT-6.1 Sol 的快取價格為 每百萬個詞元 $0.10,對比 GPT-6 Sol 的 $0.20——價格只要一半,而且僅為未快取輸入費率的 5%。對於任何會跨請求重複使用長前綴的用途,該前綴的實際輸入成本就在模型變得更強的同時又砍半了,而如果你要為一個會在回合之間帶著上下文的代理定價,這正是你該拿來建模的數字。
倍率,取自供應商的定價頁面:
• 標準: $2.00 輸入 / $0.10 快取 / $2.50 快取寫入 / $10.00 輸出。
• 快速模式: 正好是標準的 2 倍 — $4.00 / $0.20 / $5.00 / $20.00。不適用於歐盟資料駐留。
• 批次與 Flex: 標準的 50% — $1.00 / $0.05 / $1.25 / $5.00。
• 區域處理: 在可提供的地區加收 10% 溢價;此模型同時支援美國與歐盟資料駐留。
• 長提示: 任何超過 272,000 個輸入 token 的內容,都會針對整個請求以 2 倍輸入與快取費率及 1.5 倍輸出費率重新計價 — $4.00 / $0.20,輸出為 $15.00。輸出端上升 1.5 倍而非翻倍,是此系列長上下文級距較為溫和的一環。
長上下文那一列,才是設計時該圍繞的重點。上下文視窗雖有一百萬個 token,但價格分界點落在 272,000——因此單次請求的實用上限是預算決策,而不是視窗決策;而文件管線一旦越過這個門檻,會是整筆請求付雙倍,而不是只對超出部分付雙倍。
OpenAI 聲稱了什麼,而至今尚無人衡量的是什麼
迄今為止,針對 GPT-6.1 Sol 公布的每一項效能數據,都是廠商自行報告且未經重現的。OpenAI 的公告描述了在五項評估上的提升:
• DeepSWE v1.1(真實程式碼庫中的複雜軟體工程)——以約五分之一的成本達到 GPT-6 Astra 的水準,並在較低的推理強度下,以 6.4 個百分點超越 GPT-6 Sol 的最佳成績。
• GDP.pdf(針對複雜 PDF 的專業問題)——分數高於搭配備援機制的 Claude Opus 5.5,每項任務成本卻不到一半,並以約五分之一的每項任務成本逼近 Astra。
• AutomationBench 1.0.6(47 項工具、多步驟商業工作流程)——在中等推理強度下,以約三分之一的成本高出 Claude Opus 5.5 達 2.2 個百分點,且在同一設定下比 GPT-6 Sol 高出 4.8 個百分點。
• OSWorld 2.0 離線集(電腦操作)——在最高推理強度下,以不到一半的成本高出 GPT-6 Sol 七個百分點,並以約七分之一的每項任務成本,與 Astra 的差距在 2.1 個百分點之內。
• Terminal-Bench Science 0.1(資料分析、模擬、定理證明)——在最高推理強度下,分數是 GPT-6 Sol 的兩倍以上;平均每項任務 5.47 美元,相較之下 Opus 5.5 為 23.21 美元、Astra 為 23.80 美元。OpenAI 指出,Astra 仍以 68.1% 領先該組。
這裡有兩個不是能力分數的數字,反而更有意思,因為它們是失敗率的主張,而不是排行榜上的主張。在事實性方面,OpenAI 回報,在低推理強度下,包含至少一項事實錯誤的回應比例從 11.4% 降至 7.7%——約減少 32%——並表示在受測的各種設定下,錯誤率與 Astra 的差距都維持在 1.9 個百分點以內。在工具可靠性方面,代理未能告知使用者其搜尋工具故障的情況比例降至 2.1%,相較之下 GPT-6 Sol 為 4.9%、GPT-6 Astra 為 1.5%,而 GPT-6 Luna 則為 28.7%。
兩者都附帶供應商自身的但書,而且這些但書異常具體:事實性資料集是去識別化的對話,其中使用者曾標記較早模型的錯誤;工具揭露任務則是為了引出失敗而挑選的。兩者都不是對典型使用情況的主張,OpenAI 也這麼說。把它們當作供應商對自身可靠性工作的描述,而不是已測量的事實。
獨立評測呈現的樣貌,比你在一個準旗艦級發布中所預期的還要單薄。Artificial Analysis——這個家族的其餘模型通常都以其 Intelligence Index 作為引用基準的評測機構——並沒有 GPT-6.1 Sol 的條目:其模型網址回傳 404,而該字串也未出現在其排行榜資料中的任何位置,儘管該資料確實收錄了 GPT-6 Sol、GPT-6 Astra 與 GPT-6 Luna 及其各種推理設定。目前最接近的可用參照,是這款模型所取代的模型:Artificial Analysis 在最高努力設定下,給 GPT-6 Sol 的Intelligence Index 分數為 48,每項任務的評估成本為 1.05 美元,整次運行產生 7,700 萬個詞元,速度為每秒 78 個詞元。在 6.1 Sol 有可比的資料列之前,對於這項能力宣稱最誠實的總結是:OpenAI 說這是大幅進步,而尚未有人發表任何數字來支持或反駁。
那個名字,以及那個從未到來的模型
GPT-6 系列讀起來是三個層級——最上層的 Astra、其下的 Sol、最底層的 Luna——外加一個幽靈。那個幽靈就是 GPT-6.1 Astra,也就是《華爾街日報》9 月 28 日報導指出已遭取消、前沿訓練也隨之暫停的旗艦更新計畫。我們已在另一篇報導中討論過那項決定,不在此處重新爭辯。要讀懂這次發布,關鍵在於它留下的樣貌:中階層級只升了 0.1 版,卻承接了原本會歸於旗艦款的改良,而模型頁面自身的定位標語也直白道出意圖——以更低成本,為複雜工作提供接近 Astra 的效能。GPT-6.1 Sol 與其說是上週 Sol 的迭代,不如說是某個從未推出之模型的替代品。
老實說,這件事對我們來說的定位
OrcaRouter 目前尚未路由 GPT-6.1 Sol。公開目錄中沒有它的項目,而我們不會把無法提供的模型描述得好像我們能提供一樣。我們確實提供的是它所取代的模型:OrcaRouter 上的 GPT-6 Sol維持相同的 $2.00 輸入 / $10.00 輸出定價,且兩列上下文層級皆已公開,上方是 GPT-6 Astra,下方是 GPT-6 Luna。

對於以同價更新而非降價來說,真正重要的是:因為我們原封不動轉嫁供應商的牌價、不額外加價,所以 GPT-6.1 Sol 一上架到目錄,價格就是 OpenAI 對它收取的費用,我們這邊不會有重新定價的延遲——而且因為一組 API 金鑰就能觸及我們上架的所有供應商,把工作負載切換到它只是改一個模型 ID,不是簽新合約。對於現任模型與替代模型成本完全相同的替換情境,這就是一行編輯與一項遷移專案之間的差別。在那之前,對尚未評分的模型,明智之舉是讓它遠離正式環境路徑,並在主要模型出錯時容錯移轉到已驗證的同類模型——這也是了解供應商說法是否適用於你的工作負載最便宜的方法。
接下來兩週該關注什麼
有三件事能解答這次發布留下的疑問,而它們目前都還沒到位。首先,一個獨立評分——GPT-6.1 Sol 在 Artificial Analysis 上的一筆資料列——將能把公告中最大的宣稱變成可查核的東西,而這也是最可能影響採購決策的數字。其次,Ultrafast 的價格:OpenAI 表示這個層級「將在未來幾天內」在 Codex 推出,生成速度最高可達 8 倍,但一個已宣布卻沒有附上數字的服務層級只是承諾,不是產品,而 Fast 模式的 2 倍標準費率是猜測其成本的唯一依據。第三,11.4% 到 7.7% 的事實性提升,是否經得起不是 OpenAI 的測試框架的檢驗——因為那項提升,以及搜尋工具揭露率,才是能證明該轉移正式環境流量、而不只是排行榜上多一筆的兩項宣稱。

誠實的總結是,GPT-6.1 Sol 是一個真實的發布,有真實的價格表、有文檔記錄的 API 介面,以及一組供應商數字,這些數字比 0.1 版升級通常帶來的還要大。價格論點很簡單:它的成本與它所淘汰的模型相同,而且其快取輸入的成本只有一半。能力論點完全屬於 OpenAI,直到其他人對其進行衡量為止——這正是現在閱讀規格表、一週後閱讀基準測試的原因。
GPT-6.1 Sol 目前尚未在我們的路由上線。等到上線時,它將出現在完整模型目錄{{2}}完整模型目錄{{/2}}中,以 OpenAI 本身的標價、不加收任何額外費用,與已經透過單一 API 金鑰即可取用的 200 多個模型並列。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
