一張為文章《Claude Opus 5.5 對決 GPT-6.1 Sol:實測 5 倍訂閱價值差距》生成的標題卡,主標為「Claude Opus 5.5 對決 GPT-6.1 Sol:訂閱價值差距」,副標為「同樣每月 200 美元。同樣的代理式工作負載。Anthropic 方案的 API 等效價值是 5.6 倍。」並有三張卡片寫著「$200/mo Claude Max 20x - Opus 5.5 / $11,726 API 等效」、「$200/mo ChatGPT Pro 200 - GPT-6.1 Sol / $2,084 API 等效」以及「差距 / 5.6 倍」。頁腳寫著「代理式工作負載,96.6% 快取輸入。價值數據:SemiAnalysis,2026 年 10 月 5 日——單一出版方對供應商訂閱限制的模型推估。方案價格為供應商定價。」
Guides & Insights

Claude Opus 5.5 vs GPT-6.1 Sol:實測 5 倍訂閱價值落差

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

每月兩百美元可以購買一個 Claude Max 20x 席位或一個 ChatGPT Pro 200 席位。在相同的代理工作負載下,其中一個回傳每月 11,726 美元的第一方 API 等價代幣,另一個則回傳2,084 美元——兩者之間有 5.6 倍的差距,即 Claude Opus 5.5與GPT-6.1 Sol。這兩個模型都不是這則新聞的重點,而且都不是新的:Claude Opus 5.5 於 2026 年 9 月 22 日推出,GPT-6.1 Sol 則於 2026 年 9 月 29 日推出,因此模型本身分別已經有兩週和一週的歷史。新的是,運行它們的訂閱經濟學現在有了一個實測數字,由 SemiAnalysis 於 2026 年 10 月 5 日發布——就在本文發布前一天——此前該公司建立了一套方法,為供應商未公布的限制定價。

那個頭條數字自 10 月 5 日晚間起就在 X 上流傳,通常還被剝去了其附帶的但書。所以先把但書講在前頭,因為少了它們,這個數字就毫無價值。下方圖表中的每一個數值,都是某研究出版品對他人私有計量所做的模型推估,是在明確界定的工作負載型態下測得,並以區間形式呈報,而不是經稽核的基準測試。方案價格是各家廠商自行公布的定價表價格。後文提到的能力分數是 Artificial Analysis 的,且是在具名配置下測得。而整個比較所談的是 訂閱制——一種有其自身規則的計費模式——而不是任一模型每 token 的成本,那是另一個問題,也有另一個答案。

你如何為一個無法看透內部的方案定價?

Anthropic 和 OpenAI 都將訂閱用量呈現為百分比計量表,而非價格。有五小時的用量窗口與每週上限,而且沒有按請求計費的帳單。廠商以相對於自家其他方案的多倍數來區分方案等級——Claude 的 Max 5x 與 Max 20x 字面上就是依其相對於 Pro 的定位來命名,而 ChatGPT 的各級方案也曾以相同方式宣傳,直到 OpenAI 從其定價頁面移除相對用量的說法。

因此,同一份方案會因為你把它花在哪個模型上而有不同的價值,因為被快取的輸入 token 所消耗的一單位額度,與輸出 token 所消耗的一單位額度,兩者的計價比例和供應商在 API 上的收費比例並不相同。這就是這項練習的整體論點:你不能單獨說一份方案值 $X。你需要把方案、模型和工作負載一起考量。

SemiAnalysis 的方法值得說明,因為它決定了這些數字能承載多少份量。該公司會執行重複呼叫,設計成一次只隔離一種 token 類型——一部分的《戰爭與和平》,每次呼叫使用隨機標籤,用於未快取的輸入;同一提示則標記為快取,用於快取寫入;固定標籤用於快取讀取;還有一篇長篇技術文章用來逼出輸出。每次呼叫都會記錄供應商計費的 token 數量,以及用量計量器的位置。由於單一請求幾乎完全不會讓計量器移動,他們便以步進方式量測:兩次計量器移動之間的 token 總數,即為一個計量器單位的成本;兩端的部分步進會捨棄,而步進會持續累加,直到範圍落在 ±5% 以內。在 5 億個 token 後仍未使計量器移動的快取讀取,則視為免費。工作量組合則來自該公司自己九月的使用比例,而數值則是所得出的 token 容量,乘以供應商針對每種 token 類型公布的 API 價格。

方法論章節中最有趣的發現,與兩家實驗室任何一方的慷慨無關。在驗證期間,SemiAnalysis 發現,它在同一方案上測試的三個帳戶中,有一個較舊帳戶的限制比另外兩個低約 20%。供應商證實,那是一項針對限制進行的「極小型」A/B 測試,並強調它並未全面削減限制。這件事的兩半都很重要:它證明訂閱限制可以隨時被悄悄調整,也證明該方法足夠敏感,能在 20% 的變動發生時偵測到它。

每個等級在 $200、$100 和 $20 時會回傳什麼

三個層級、兩家實驗室、代理式工作負載,按第一方定價表費率計算的每月 API 等效價值:

• 每月 $200 — Max 20x 上的 Claude Opus 5.5 可帶來 $11,726 — 以 API 等值 token 計算,是費用的 58.6 倍;ChatGPT Pro 200 上的 GPT-6.1 Sol 可帶來 $2,084 — 是費用的 10.4 倍。比率:5.6 倍。

• $100 一個月 — Claude Opus 5.5 在 Max 5x 上的回報為$5,725(為費用的 57.3 倍);GPT-6.1 Sol 在 ChatGPT Pro 100 上的回報為$1,055(為費用的 10.6 倍)。比率:5.4 倍。

• 每月 $20——Claude Pro 上的 Claude Opus 5.5 可帶來 $1,178(費用的 58.9 倍);ChatGPT Plus 上的 GPT-6.1 Sol 可帶來 $211(費用的 10.6 倍)。比率:5.6 倍。

真正的發現是這三個層級都落在 5.4 倍到 5.6 倍之間,而不是個別的金額數字。這項比較是以各實驗室產品陣容中的中階方案來進行——也就是兩家供應商都定位為日常主力、而非旗艦的模型——而且涵蓋整個價格級距,因此使用 20 美元方案的人得到的答案,與使用 200 美元方案的人相同。SemiAnalysis 自己的摘要直言不諱:在這個層級,Anthropic「壓倒性地更划算,全面提供約 5 倍的 API 等效價值」。

這三列背後的工作負載型態都有標示,而且值得讀兩次:代理式、0.4% 未快取輸入、96.6% 快取輸入、2.6% 快取寫入、0.3% 輸出。這就是代理迴圈的樣子——少量全新指令、大量重新讀取的上下文,以及一小片生成的文字。正如下一節所示,這也是最能襯托 Anthropic 的混合比例。

A generated two-column scoreboard titled 'Claude Opus 5.5 vs GPT-6.1 Sol - the scoreboard'. Left column 'Claude Opus 5.5': Input $4.00 per Mtok, Output $20.00 per Mtok, Cache read $0.20 per Mtok, Released Sept 22 2026, AA Intelligence Index 58 (max effort), API value on the $200 plan $11,726. Right column 'GPT-6.1 Sol': Input $2.00 per Mtok, Output $10.00 per Mtok, Cache read $0.10 per Mtok, Released Sept 29 2026, AA Intelligence Index 51.8 (max effort), API value on the $200 plan $2,084. The footer reads 'Prices: vendor rate cards. Index: Artificial Analysis v4.3.2, max effort. $200-plan value: SemiAnalysis, Oct 5, 2026 - model estimate, not audited.'

Opus 5.5 每個 token 的成本是兩倍,但依然以 5.6 倍勝出

這就是目前流傳的圖表版本漏掉的一點。Claude Opus 5.5 不是比較便宜的模型。它是比較貴的那一款,價格是兩倍。

兩份價目表都是公開的。Claude Opus 5.5 的定價為每百萬輸入 token $4.00、每百萬快取讀取 $0.20、每百萬快取寫入 $5.00,以及每百萬輸出 token $20.00。GPT-6.1 Sol 在同樣這四項的定價則為 $2.00、$0.10、$2.50 和 $10.00。用上述代理式組合對這些價格加權後,混合費率大致為Claude Opus 5.5 每百萬 token $0.399,對比 GPT-6.1 Sol 的 $0.200——比率為 2.00 倍。這個算法是我們根據兩家廠商公開的價目表得出的,但這並不具爭議:它直接從公開價格與標示的組合推導而來。

把 5.6 倍的價值差距除以 2.0 倍的價格差距,在 Claude 這邊大約會得到每美元方案可換得 2.8 倍更多的 token。在 $20 方案層級做同樣的除法會得到 2.79 倍——這個差距在於某一項計量方式慷慨得多,而且幾乎在整個方案階梯上完全一致,而不是某個模型跑起來更便宜。這意味著 5 倍這個頭條數字,是關於 Anthropic 點數定價的陳述,而且只對看起來像所測量那類的工作負載成立。

改變組合,數字就會變動。這個組合是 96.6% 的快取讀取,其中 Opus 5.5 收費 $0.20,而 Sol 為 $0.10。快取用量低的工作負載——冗長的全新文件、幾乎沒有重複使用——偏重輸入計價項目,而同樣的 2 倍差距也出現在那裡。輸出密集的工作,例如長時間生成而非長時間的代理執行,則會落在 Opus 為 $20.00、對手為 $10.00 的那一項。而 SemiAnalysis 明確指出,它自己偏好的指標有其失效模式:如果某個模型在 API 價格下特別划算或特別不划算,API 等價價值「當然會造成誤導」,而這正是目前的情況——每 token 較貴的模型,反而是訂閱方案較好的那一個。該公司也不願倚賴 token 效率圖表,表示它不認為典型的代理式基準測試任務能代表真實工作,而且業界缺乏可靠的效率資料。請把這個 5 倍視為來自單一出版品、針對某一種工作負載形態的審慎陳述,而不是任一模型的永久屬性。

讓這個落差成為實際問題、而非中性取捨的關鍵在於,訂閱制且較便宜的那一方,在獨立評測榜上也是較強的一方。Artificial Analysis 在其 Intelligence Index 上,把 Claude Opus 5.5 列在58,採用的是其模型頁面標題為「max with fallback」的配置,並在變體選擇器中列為「Claude Opus 5.5 (Max, Default Fallback)」——這是它當時測得的最高分,領先數分。GPT-6.1 Sol 在同一指數、指數版本 v4.3.2 下,以最大努力程度測得51.8,而 GPT-6 Astra 為 52.7。因此,正在權衡兩款 200 美元方案的買家,等於被要求為得分較低的模型,按每美元可用容量計算多付 5.6 倍。這些分數屬於第三方且獨立;價值數字則是 SemiAnalysis 的模型。兩者都有標示,且都不是廠商提供的數字。

A screenshot of the OrcaRouter model page for Claude Opus 5.5 (anthropic/claude-opus-5.5), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the $4.00 input and $20.00 output pricing tiles, p50 TTFT 3.81 s, p95 TTFT 10.00 s, 48.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by Anthropic - 2026-09-22', an OpenAI-compatible code sample using base_url https://api.orcarouter.ai/v1, and the buttons 'Get the Claude Opus 5.5 API' and 'Try in playground'.

OpenAI 在 9 月 29 日更改了什麼?

這一切都不是靜態的。這個落差之所以會在本週而非上週被討論,是因為 OpenAI 在測量結果出爐的八天前,就調整了自己的衡量標準。

2026 年 9 月 29 日,OpenAI 重新向新訂閱者開放 $200 Pro 訂閱方案,並在重新開放之際改變了用量的計算方式。當天用他們自己的話來說,這項變更「相較於舊的 Pro $200 方案,API 支出的金額淨額會減半」,而同日的第二篇貼文則描述該方案層級的 API 等值價值減半。這是廠商針對自家方案所作出、有日期可考的聲明,而正是這個事件,讓一項訂閱價值的衡量值得公開發表。

SemiAnalysis 所測得的三項後果:

• 各層級的 Token 數量減半,而 Sol 等級的價值跌幅更甚於此。OpenAI 同時調降了 GPT-6.1 Sol 的快取輸入價格——降至每百萬 $0.10,OpenAI 的開發者帳號於 9 月 29 日稱此價格比標準輸入定價低 95%,也比 GPT-6 Sol 的快取費率低 50%——因此該方案中 Sol 等級模型的實測 API 等值價值跌幅超過 50%,而非僅憑 Token 刪減所推得的 50%。

• 500 美元方案層級登場了,但它並沒有把價值補回來。 新的 Pro 500 方案提供的 GPT-6 Astra 比舊的 200 美元方案多 21%;但由於 Sol 降價,500 美元層級中 Sol 級別的 API 等效價值實際上反而下降了。Ultrafast 模式——每秒 300 個 token 的服務層級——才是那裡真正新增的東西,而 SemiAnalysis 表示其限制仍在測試中。

• 現有訂閱者可保留原有權益至 2026 年 10 月 29 日。在降價前所持有的 200 美元方案,在該日期前仍可保有較舊、較大的額度,之後則以不變的價格轉為較低的額度。對於在 9 月 29 日之前購買的人而言,本文的比較從月底起才適用於其帳戶,而非今日。

重新平衡才是微妙的部分。在這次調降之前,OpenAI 的每美元價值在高階方案上偏袒自己:在 Astra 上,Pro 200 的每美元價值大約是 Pro 100 的兩倍,而 Pro 100 本身又大約是 Plus 的兩倍。調降之後,Pro 100、Pro 200 和 Pro 500 在每個模型上每美元提供的 token 數都相同,而 Plus 在 Sol 上已可相比,但在 Astra 上仍相對較差。OpenAI 透過把一切砍半到最底層級,讓自家階梯在內部變得公平。相較之下,Anthropic 早已在每個層級提供相同的每美元價值——這就是為什麼無論你看的是 20 美元方案還是 200 美元方案,都會出現同樣的 5.6 倍。如果你用的是 Plus,而且原本指望能使用 Astra,這次調降移除了過去讓 OpenAI 最高層級值得追求的那份價值。

OpenAI 確實保有一項真正的結構性優勢,而 SemiAnalysis 也承認這點:所有 Pro 等級方案都沒有五小時的視窗限制,這使得在單一長時間工作階段中消耗月用量上限的較高比例變得更容易。該公司的判斷是,這並不足以抵銷在 API 等效價值上約 4 到 5 倍的差距。

兩個經濟體,一個模型名稱

把這一切解讀為關於模型的陳述,這裡有個陷阱。如果你是依 token 付費——無論是 API 金鑰、自架技術堆疊,還是你自己打造的代理平台——5.6 倍從來就不是你的數字,現在也不是。你的數字是混合後的 2.00x,而以此為基準,在同樣的代理迴圈下,GPT-6.1 Sol 是較便宜的模型。訂閱方案的比較回答的是「我該買哪個席位」。API 的比較回答的是「我該呼叫哪個模型」。對這兩個模型而言,兩者的結論方向相反,而將它們混為一談,是圍繞這張圖表的評論中最常見的錯誤。

那輪納入訂閱衡量計算的降價,如今已反映在 API 費率表中。Anthropic 在 9 月 25 日該模型推出時,將 Opus 5.5 的輸入與輸出價格較 Opus 5 調降 20%,快取讀取調降 60%。OpenAI 於 9 月 29 日推出時,將 GPT-6.1 Sol 的快取輸入價格砍半。這兩份價目表是本文通篇所引用的依據,且無論你是購買席位還是 token 都適用。兩款模型都以供應商定價列於 OrcaRouter 目錄中——Claude Opus 5.5 以供應商定價提供,0% 加成,以及GPT-6.1 Sol 在單一端點後使用同一把金鑰——因此供應商降價在公布當下即時生效,而不必等待路由表更新。

有件事值得說明白:OrcaRouter 不賣訂閱,所以這項量測並不會改變 OrcaRouter 使用者所付的錢。它改變的是他們該為什麼模型付費,並且為替代方案標了價。比較中屬於方案的那一端,是你無法控制的一道牆——兩家實驗室,兩者都已證明它們會調整限制,無聲無息且臨時通知,而且就在降價的同一週。那股風險在 API 上的對應做法,就是能在不簽新合約的情況下,把同一個請求送到別的地方,而這正是跨供應商自動容錯移轉的用途。如果你跑的是快取讀取率達 96.6% 的代理迴圈,你真正想要的其實是能接受這個請求的最便宜路徑,以及在供應商改變心意時改變心意的能力。

誰應該搬家,誰不應該

如果你正在付費訂閱 Claude,並且執行代理式編碼或長時間的工具迴圈,那麼留下來的理由如今已有實測數據,而不只是傳聞:在 200 美元方案中,你付出的費用會以相當於 API 容量的形式回饋 58.6 倍,而同等級的 ChatGPT 方案則為 10.4 倍,而且這在每個價格級距都成立。如果你使用的是在 9 月 29 日之前購買的 ChatGPT Pro 200 方案,那麼在 2026 年 10 月 29 日之前你擁有的是較舊的額度,之後則是較低的額度——在做任何決定之前先確認日期,因為接下來三週,你拿來比較的是一個對新買家已不存在的方案。

如果你是 API 開發者,就別理會 5.6x。改用 2.00x 混合費率來路由,以每次任務而非每 token 計價,並在每次供應商價格變動後重新檢查,因為這一季就出現了四次這類變動——GPT-6 Sol、Fable 5.1、Opus 5.5 和 GPT-6.1 Sol,全在短短一個多月內發生。對訂閱制而言,真正重要的量測是實驗室外沒人看得見的計量器。對 API 而言,真正重要的量測是費率表,而那是公開的。

接下來要觀察的重點:Anthropic 的 Opus 限制能否撐過這一季,畢竟其自家競爭對手才剛在上週縮減限制,而且兩家實驗室都仍保有悄然調整用量表的能耐;OpenAI 是否會透過提高限制、而非再次降價,來在 500 美元方案上恢復 Sol 等級的價值;以及 200 美元方案的祖父條款是否真會如公告所述在 10 月 29 日終止。SemiAnalysis 將底層數據維持為即時儀表板,而非固定研究,因此此處引用的數字,是這份本就設計為會變動的資料集在 2026 年 10 月 5 日的狀態。

A screenshot of the OrcaRouter model page for GPT-6.1 Sol (openai/gpt-6.1-sol), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the reasoning / coding / agentic capability tags, the $2.00 input and $10.00 output pricing tiles, 10.60 s p50 TTFT, 10.00 s p95 TTFT and 248.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by OpenAI - 2026-09-29', and the buttons 'Get the GPT-6.1 Sol API' and 'Try in playground'.

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新