一張為 GPT-6.1 Sol 生成的主視覺卡片,標題為「接近 Astra 的效能,在它所取代的模型推出一週後隨即發布」,標籤寫著「發布日期:2026 年 9 月 29 日」、「價格:每 100 萬個 token 2.00 美元 / 10.00 美元」以及「獨立評分:尚無」,頁尾寫著「OpenAI 的數據為廠商自行公布;截至 2026 年 9 月 30 日,尚未發布任何獨立評估」,右下角則有 OrcaRouter 標誌。
Guides & Insights

GPT-6.1 Sol:OpenAI 以近乎 Astra 的效能,推出與所取代機型同價的產品

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

OpenAI 於 2026 年 9 月 29 日的 DevDay 2026 主題演講上發布了 GPT-6.1 Sol——這是對一週前才推出高階 GPT-6 Sol 層級的更新,價格完全相同:每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,而廠商將其定位為以大約 Astra 每 token 成本五分之一的代價,逼近 GPT-6 Astra,也就是每百萬輸入 10 美元、輸出 50 美元的旗艦機型。不尋常的地方不在價格,而在於這個價格不變、晚一週推出的更新版竟宣稱能力出現跳躍式提升,而且截至本文撰寫之際,還沒有任何獨立評測機構為它打過分。本文中每一個來自 OpenAI 的能力數字都經過標註,因為目前還沒有其他資料可供核對。

實際發布了什麼,以及何時發布

A screenshot of OpenAI's own model page for GPT-6.1 Sol, showing the positioning line 'Near-Astra performance for complex work at a lower cost', the pricing block reading $2 input and $10 output per million tokens, a 1,050,000-token context window with 128,000 maximum output tokens, an April 30 2026 knowledge cutoff, and the note that reasoning effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.

這次發布的資料記錄異常完整,就一場 DevDay 發表會而言,這本身就值得一提:幾個小時內就冒出了模型頁面、定價表、system card 增補文件,以及該廠商公開 API schema 中一筆已提交的項目——一筆於 9 月 29 日 17:16 UTC 提交、標題為「Add gpt-6.1-sol model to model enums」的 commit,而其父修訂版中該字串出現次數為零。然而,廠商自家的 changelog 仍停在 9 月 22 日發布的GPT-6 Sol與 GPT-6 Luna;6.1 Sol 的條目尚未寫進那裡,因此模型頁面與發表貼文才是正式記錄。

具體的樣貌:

• 模型 ID: gpt-6.1-sol,單一快照,沒有帶日期的變體——你永遠使用當前版本。
• 可用性:即日起提供給 ChatGPT Work 與 Codex 中的 Plus、Pro、Business、Enterprise 和 Edu 使用者,並可透過 API 使用。明確不包含在消費端 Chat 產品中,這點 Open​AI 有明說,而非留待推斷。
• 上下文:1,050,000 個 token,最大輸出 128,000,知識截止日為 2026 年 4 月 30 日。
• 推理控制:low、medium(預設)、high、xhigh 與 max——五個等級,不是六個。GPT-6.1 Sol 與 GPT-6 Astra 不再接受 GPT-6 Sol 與 GPT-6 Luna 所接受的 none 強度。
• 模態:輸入文字與圖像,輸出文字。不支援音訊與視訊輸入。
• 工具:網頁搜尋、檔案搜尋、圖像生成、程式碼解譯器、託管 shell、apply patch、skills、電腦操作、MCP 與工具搜尋——全部透過 Responses API。Chat Completions 僅在沒有工具時可用。
• 不支援:微調。這是讓你下提示詞的模型,不是讓你訓練的模型。
• 已宣布,尚未推出:Ultrafast 層級。Open​AI 表示將「在未來幾天內」提供 GPT-6.1 Sol Ultrafast,在 Codex 中 token 生成速度最高可快 8 倍,但未附上價格與日期。

有兩行值得再讀一次。五級努力程度階梯意味著,一個使用了 none 作為廉價逃生出口的提示,將在 6.1 Sol 上驗證失敗,而廠商針對正是從 gpt-6-sol 的這項移轉發布了遷移指引。而 Ultrafast 產品線值得仔細閱讀:同一層級已廣泛提供給 GPT-6 Astra,並在 GPT-5.6 Sol 上處於預覽階段,因此 6.1 Sol 被描述為即將加入一個已存在於其他模型的層級——而非一個全新層級。

定價,以及它真正讓人吃不消的地方

主要費率與 GPT-6 Sol 相比維持不變:每百萬輸入 token 2.00 美元、每百萬輸出 token 10.00 美元,快取寫入則為 2.50 美元。廠商在公告中自己的說法,是與其旗艦產品相比,其中 2/10 美元是 GPT-6 Astra 的 10/50 美元的五分之一——這確實是實質差距,也是整份價目表上最不有趣的數字,因為 GPT-6 Sol 本來就已經是 2/10 美元。

真正有變的是快取輸入那一行,而它正是會左右預算的項目。GPT-6.1 Sol 的快取價格為 每百萬個詞元 $0.10,對比 GPT-6 Sol 的 $0.20——價格只要一半,而且僅為未快取輸入費率的 5%。對於任何會跨請求重複使用長前綴的用途,該前綴的實際輸入成本就在模型變得更強的同時又砍半了,而如果你要為一個會在回合之間帶著上下文的代理定價,這正是你該拿來建模的數字。

倍率,取自供應商的定價頁面:

• 標準: $2.00 輸入 / $0.10 快取 / $2.50 快取寫入 / $10.00 輸出。
• 快速模式: 正好是標準的 2 倍 — $4.00 / $0.20 / $5.00 / $20.00。不適用於歐盟資料駐留。
• 批次與 Flex: 標準的 50% — $1.00 / $0.05 / $1.25 / $5.00。
• 區域處理: 在可提供的地區加收 10% 溢價;此模型同時支援美國與歐盟資料駐留。
• 長提示: 任何超過 272,000 個輸入 token 的內容,都會針對整個請求以 2 倍輸入與快取費率及 1.5 倍輸出費率重新計價 — $4.00 / $0.20,輸出為 $15.00。輸出端上升 1.5 倍而非翻倍,是此系列長上下文級距較為溫和的一環。

長上下文那一列,才是設計時該圍繞的重點。上下文視窗雖有一百萬個 token,但價格分界點落在 272,000——因此單次請求的實用上限是預算決策,而不是視窗決策;而文件管線一旦越過這個門檻,會是整筆請求付雙倍,而不是只對超出部分付雙倍。

OpenAI 聲稱了什麼,而至今尚無人衡量的是什麼

迄今為止,針對 GPT-6.1 Sol 公布的每一項效能數據,都是廠商自行報告且未經重現的。Open​AI 的公告描述了在五項評估上的提升:

• DeepSWE v1.1(真實程式碼庫中的複雜軟體工程)——以約五分之一的成本達到 GPT-6 Astra 的水準,並在較低的推理強度下,以 6.4 個百分點超越 GPT-6 Sol 的最佳成績。
• GDP.pdf(針對複雜 PDF 的專業問題)——分數高於搭配備援機制的 Claude Opus 5.5,每項任務成本卻不到一半,並以約五分之一的每項任務成本逼近 Astra。
• AutomationBench 1.0.6(47 項工具、多步驟商業工作流程)——在中等推理強度下,以約三分之一的成本高出 Claude Opus 5.5 達 2.2 個百分點,且在同一設定下比 GPT-6 Sol 高出 4.8 個百分點。
• OSWorld 2.0 離線集(電腦操作)——在最高推理強度下,以不到一半的成本高出 GPT-6 Sol 七個百分點,並以約七分之一的每項任務成本,與 Astra 的差距在 2.1 個百分點之內。
• Terminal-Bench Science 0.1(資料分析、模擬、定理證明)——在最高推理強度下,分數是 GPT-6 Sol 的兩倍以上;平均每項任務 5.47 美元,相較之下 Opus 5.5 為 23.21 美元、Astra 為 23.80 美元。OpenAI 指出,Astra 仍以 68.1% 領先該組。

這裡有兩個不是能力分數的數字,反而更有意思,因為它們是失敗率的主張,而不是排行榜上的主張。在事實性方面,OpenAI 回報,在低推理強度下,包含至少一項事實錯誤的回應比例從 11.4% 降至 7.7%——約減少 32%——並表示在受測的各種設定下,錯誤率與 Astra 的差距都維持在 1.9 個百分點以內。在工具可靠性方面,代理未能告知使用者其搜尋工具故障的情況比例降至 2.1%,相較之下 GPT-6 Sol 為 4.9%、GPT-6 Astra 為 1.5%,而 GPT-6 Luna 則為 28.7%。

兩者都附帶供應商自身的但書,而且這些但書異常具體:事實性資料集是去識別化的對話,其中使用者曾標記較早模型的錯誤;工具揭露任務則是為了引出失敗而挑選的。兩者都不是對典型使用情況的主張,OpenAI 也這麼說。把它們當作供應商對自身可靠性工作的描述,而不是已測量的事實。

獨立評測呈現的樣貌,比你在一個準旗艦級發布中所預期的還要單薄。Artificial Analysis——這個家族的其餘模型通常都以其 Intelligence Index 作為引用基準的評測機構——並沒有 GPT-6.1 Sol 的條目:其模型網址回傳 404,而該字串也未出現在其排行榜資料中的任何位置,儘管該資料確實收錄了 GPT-6 Sol、GPT-6 Astra 與 GPT-6 Luna 及其各種推理設定。目前最接近的可用參照,是這款模型所取代的模型:Artificial Analysis 在最高努力設定下,給 GPT-6 Sol 的Intelligence Index 分數為 48,每項任務的評估成本為 1.05 美元,整次運行產生 7,700 萬個詞元,速度為每秒 78 個詞元。在 6.1 Sol 有可比的資料列之前,對於這項能力宣稱最誠實的總結是:OpenAI 說這是大幅進步,而尚未有人發表任何數字來支持或反駁。

那個名字,以及那個從未到來的模型

GPT-6 系列讀起來是三個層級——最上層的 Astra、其下的 Sol、最底層的 Luna——外加一個幽靈。那個幽靈就是 GPT-6.1 Astra,也就是《華爾街日報》9 月 28 日報導指出已遭取消、前沿訓練也隨之暫停的旗艦更新計畫。我們已在另一篇報導中討論過那項決定,不在此處重新爭辯。要讀懂這次發布,關鍵在於它留下的樣貌:中階層級只升了 0.1 版,卻承接了原本會歸於旗艦款的改良,而模型頁面自身的定位標語也直白道出意圖——以更低成本,為複雜工作提供接近 Astra 的效能。GPT-6.1 Sol 與其說是上週 Sol 的迭代,不如說是某個從未推出之模型的替代品。

老實說,這件事對我們來說的定位

OrcaRouter 目前尚未路由 GPT-6.1 Sol。公開目錄中沒有它的項目,而我們不會把無法提供的模型描述得好像我們能提供一樣。我們確實提供的是它所取代的模型:OrcaRouter 上的 GPT-6 Sol維持相同的 $2.00 輸入 / $10.00 輸出定價,且兩列上下文層級皆已公開,上方是 GPT-6 Astra,下方是 GPT-6 Luna。

A screenshot of the OrcaRouter model page for GPT-6 Sol (openai/gpt-6-sol), showing the header 'by OpenAI - 2026-09-22', tags for Vision, Tools, JSON and Reasoning, a side panel listing a 1M-token context window and 128k maximum output, and a stat strip reading $2.00 per million input tokens and $10.00 per million output tokens.

對於以同價更新而非降價來說,真正重要的是:因為我們原封不動轉嫁供應商的牌價、不額外加價,所以 GPT-6.1 Sol 一上架到目錄,價格就是 Open​AI 對它收取的費用,我們這邊不會有重新定價的延遲——而且因為一組 API 金鑰就能觸及我們上架的所有供應商,把工作負載切換到它只是改一個模型 ID,不是簽新合約。對於現任模型與替代模型成本完全相同的替換情境,這就是一行編輯與一項遷移專案之間的差別。在那之前,對尚未評分的模型,明智之舉是讓它遠離正式環境路徑,並在主要模型出錯時容錯移轉到已驗證的同類模型——這也是了解供應商說法是否適用於你的工作負載最便宜的方法。

接下來兩週該關注什麼

有三件事能解答這次發布留下的疑問,而它們目前都還沒到位。首先,一個獨立評分——GPT-6.1 Sol 在 Artificial Analysis 上的一筆資料列——將能把公告中最大的宣稱變成可查核的東西,而這也是最可能影響採購決策的數字。其次,Ultrafast 的價格:Open​AI 表示這個層級「將在未來幾天內」在 Codex 推出,生成速度最高可達 8 倍,但一個已宣布卻沒有附上數字的服務層級只是承諾,不是產品,而 Fast 模式的 2 倍標準費率是猜測其成本的唯一依據。第三,11.4% 到 7.7% 的事實性提升,是否經得起不是 Open​AI 的測試框架的檢驗——因為那項提升,以及搜尋工具揭露率,才是能證明該轉移正式環境流量、而不只是排行榜上多一筆的兩項宣稱。

A generated scoreboard titled 'GPT-6.1 Sol - the scoreboard' listing six rows: price $2.00 input and $10.00 output per million tokens; cached input $0.10 per million; context window 1,050,000 tokens; independent score none published yet; availability in ChatGPT Work, Codex and the API; vendor claim near-Astra at about one fifth the cost. A footer reads that OpenAI figures are vendor-reported and no independent index score was published as of September 30, 2026.

誠實的總結是,GPT-6.1 Sol 是一個真實的發布,有真實的價格表、有文檔記錄的 API 介面,以及一組供應商數字,這些數字比 0.1 版升級通常帶來的還要大。價格論點很簡單:它的成本與它所淘汰的模型相同,而且其快取輸入的成本只有一半。能力論點完全屬於 OpenAI,直到其他人對其進行衡量為止——這正是現在閱讀規格表、一週後閱讀基準測試的原因。

GPT-6.1 Sol 目前尚未在我們的路由上線。等到上線時,它將出現在完整模型目錄{{2}}完整模型目錄{{/2}}中,以 OpenAI 本身的標價、不加收任何額外費用,與已經透過單一 API 金鑰即可取用的 200 多個模型並列。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新