一張為 Claude Opus 5.5 對上 GPT-6 Sol 生成的標題卡,副標題為「價格只要一半,直到上下文變長」,搭配兩個扁平線性圖示(一份文件與一朵雲),以及一行頁尾文字:「Index 數據依據 Artificial Analysis 在最大努力設定下的結果;價格依各廠商為準。」真正的 OrcaRouter 標誌合成於右下角。
Guides & Insights

Claude Opus 5.5 對決 GPT-6 Sol:價格只要一半,直到上下文變長為止

作者

Magnus Corvin

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

AnthropicOpenAI 在同一個下午推出了相互競爭的旗艦模型。 Claude Opus 5.5於 2026 年 9 月 22 日發布,每百萬輸入 token 收費 4 美元、每百萬輸出 token 收費 20 美元,兩條產品線都比 Claude Opus 5 降價 20%。 GPT-6 Sol在同一天發布,輸入 2 美元、輸出 10 美元,相較 GPT-5.6 Sol 直接降價 50%,OpenAI 稱之為永久降價,而非促銷。只看這兩句話,這場對決還沒開始就看似已成定局:OpenAI 的模型只要半價,而半價就是半價。讀完兩份費率表的其餘部分,差距大致就會縮小——不是因為任何一家供應商做了改變,而是因為兩款模型都對同一類請求加收附加費,而這讓 Sol 損失的優勢遠比 Anthropic 多。

兩張費率卡,兩者都含有一個級距

在 272,000 個輸入 token 以下,這是當前前沿中最簡單的比較:

• 輸入 — GPT-6 Sol 每百萬 $2.00,相較於 Claude Opus 5.5 $4.00

• 輸出 — GPT-6 Sol 每百萬 $10.00,對比 Claude Opus 5.5 $20.00

• 快取輸入 — 就快取部分而言,GPT-6 Sol 比 Claude Opus 5.5 的每百萬 $0.20 便宜約 90%,相當於基礎輸入的 5% 倍率

• 上下文與輸出 —— 根據 Artificial Analysis 實測,GPT-6 Sol 為 872K,其他地方則宣稱 1M,最大輸出為 128K;相較之下,Claude Opus 5.5 為 1M 與 128K

• 知識截止 — Claude Opus 5.5 為 2026 年 6 月,而 GPT-6 Sol 未以相同表述載明

超過 272,000 個輸入詞元後,兩邊的計算方式都會改變,而且改變的幅度並不相同。GPT-6 Sol 會將整筆請求重新計價——不是超出的部分,而是整通呼叫——輸入費率大約變成兩倍,輸出費率則增加一半,來到輸入約 $4.00、輸出 $15.00。Claude Opus 5.5 的價目表沒有長上下文級距:Anthropic 在整個 1M 詞元視窗內一律收取 $4.00 和 $20.00,並表示一筆 900K 詞元的請求,每詞元成本與一筆 9K 詞元的請求相同。

把這些放在一起看,排序會在一個意想不到的地方翻轉。在長上下文呼叫中,兩個模型的輸入費率都收斂到約 $4——Sol 在輸入上的半價優勢完全消失——而輸出則從 2 倍差距縮小到約 $15 對 $20,是 25% 的優勢,而非 50%。Sol 仍然比較便宜。但它已經不再便宜到足以成為決策中唯一的數字,而原因是這兩種附加費用形狀不同:Anthropic 的模式收取固定費率,只是恰好較高;OpenAI 的模式則收取一種懲罰性費用,而這種費用衝擊最重的地方,正好就是兩家公司推銷這些模型所鎖定的代理式、讀取儲存庫、文件集等工作負載。

A generated graphic titled 'Two rate cards, one step each', with a subtitle reading 'Above 272,000 input tokens the input rates converge and the output gap narrows to about a quarter.' Two panels compare per-million-token input and output rates: below 272,000 input tokens Claude Opus 5.5 is $4.00 / $20.00 against GPT-6 Sol at $2.00 / $10.00, and above 272,000 input tokens Claude Opus 5.5 stays at $4.00 / $20.00 while GPT-6 Sol moves to approximately $4.00 / $15.00 because the whole call reprices. The footer reads 'Per-million-token rates. Sol's step per OpenAI; Opus 5.5 bills its full 1M window at one rate per Anthropic.'

獨立評分,是唯一在相同條件下進行的比較

A two-column scoreboard comparing Claude Opus 5.5 and GPT-6 Sol across six shared rows: Intelligence Index (58, ranked #1 of 210, against 48, ranked #18), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), output speed (not yet published against 113.3 tokens per second), time to first token (not yet published against 142.74s), knowledge cutoff (Jun 2026 against not stated in the same terms) and long-context step (none against the whole call repriced above 272K). The footer reads 'Index, speed and latency figures per Artificial Analysis at max effort; prices and the 272K step per the vendors.'

兩份發布表格都沒有包含對方的新模型——兩者都是在同日發布的模型推出之前寫成的——因此廠商資料根本無法為這兩者排名。Artificial Analysis 可以,因為它會以同一套公開配置來執行每個模型:

• 智能指數 — Claude Opus 5.5 為 58,在 210 個中排名第 1,對比 GPT-6 Sol 為 48,排名第 18

• 組態標籤 —— 兩者皆以最高投入計分;Claude Opus 5.5 另標示為「Default Fallback」

• 輸出速度 — GPT-6 Sol 每秒 113.3 個 token,排名第 38,相較之下 Claude Opus 5.5 尚未公布

• 首個權杖時間 — GPT-6 Sol 142.74 秒,對比排行榜中位數 3.83 秒;Claude Opus 5.5 尚未公布

• 價格 — GPT-6 Sol 每百萬 $2.00 / $10.00,對比 Claude Opus 5.5 的 $4.00 / $20.00

十個指數點與十七個名次的差距,是當前任何一組 Claude 對 OpenAI 配對中最懸殊的一次,而且這已是本月第二次對較便宜的模型不利——同樣的模式在先前一次比較中也出現過:當時 GPT-6 Sol 對上 Claude Opus 5,在成本低 60% 的情況下輸了三點。 速度列則朝相反方向發展,而且其重要性比表面上看來更高:每秒 113.3 個符元大約是 GPT-6 Astra 旗艦機型速度的兩倍,也是這組中最快的數字。再加上首個符元耗時 142 秒,整體輪廓就是一個先思考很久、再快速寫出的模型;這對任何互動式用途都不太合適,但對長時間無人看管的執行來說則尚稱合理。

這兩個數字都帶有與廠商相同的但書:它們都是最大努力(max-effort)下的測量值,而兩款模型的出貨預設值都不是最大努力。Claude Opus 5.5 在從低到最大的努力量表上預設為 中等;GPT-6 Sol 則提供從無到最大的量表。最大努力指數是比較模型上限的公平方式,卻也是預測你帳單時會誤導人的方式。

切換時,兩個方向分別會有哪些東西壞掉

這裡的遷移摩擦是不對稱的,在採取任一舉措之前都值得先了解。

Claude Opus 5.5 並非可直接替代 Claude Opus 5 的版本。現在已無法停用 thinking,因此設定非 thinking 路徑的程式碼將會發生錯誤,或是在無聲無息中改變行為。強制使用工具會傳回錯誤。Thinking 區塊會綁定至產生它們的模型與對話,因此無法跨模型重播。較舊的 computer_20251124 電腦使用工具在 Claude API 或 Google Cloud 上皆不被接受。另外,工具呼叫之間的文字現在會傳回 thinking 區塊內,而在預設顯示設定下這些區塊是空的,因此若應用程式將該文字以進度形式串流,將只會在呼叫之間悄然無聲,而不會拋出任何錯誤。

GPT-6 Sol 的努力程度調節是兩者中更具彈性的一個:它可以在對話中途變更,而不會導致提示快取失效,這意味著在同一上下文中先進行低成本的第一輪、再進行高成本的重試,是一種受支援的模式,而非會破壞快取的做法。對於任何在單一會話中執行分層推理的人來說,這是一項真正的工程優勢,也是支持 Sol 最有力的論據,而這點並未出現在任何價格表中。

同時執行兩者,並用你自己的數字來決定

對這場對決的誠實立場是:廠商提供的比較表無法斷定勝負,而獨立指數只能決定上限。剩下的就是工作負載問題——你的上下文實際上跑多久,以及一次失敗嘗試要付出多少代價——而這可以從你自己的流量中衡量,而不是靠新聞稿來爭論。

兩款模型都可透過 OrcaRouter 以供應商牌價、0% 加價進行路由:GPT-6 Sol 為 OpenAI 的 $2.00 / $10.00,Claude Opus 5.5 則為 Anthropic 的 $4.00 / $20.00。由於原價直通精確無誤,且供應商調價當天價格就隨之變動,你在預備環境量到的比例,就是你在正式環境支付的比例,沒有加價層需要重新推算。一組金鑰即可同時涵蓋兩者,因此那條把低於 272K 的呼叫導向 Sol、把長脈絡呼叫導向在你評估中勝出模型的路由規則,只是變更設定,而非再串接一次整合——而且自動容錯移轉意味著任一方當日推出上線時,你可以先投入一部分流量,而不是拿整條管線來下注。

A screenshot of OrcaRouter's own model page for openai/gpt-6-sol, headed 'GPT-6 Sol' and credited to OpenAI, showing a 1M-token context, 128K max output, and a stat strip reading INPUT $2.00 and OUTPUT $10.00 per 1M tokens with a 2.25s p50 time to first token and 4.8M tokens of traffic over 7 days.

這個在碰上帳單後還能存活的版本

GPT-6 Sol 在每一項目、每一種配置上都是較便宜的模型,這點無可爭議。無法成立的是「半價」是規劃時該依據的數字這個假設:在長脈絡呼叫中,輸入費率大約在 $4 交會,輸出價差則縮小到四分之一,這與發表頁面所描述的是截然不同的決策。將這點與十點的指數差距、十七個名次,以及實測 142 秒的首個 token 相權衡,對大多數工作負載而言,分流方式便不言自明——Sol 作為短、中脈絡下的高流量預設,Claude Opus 5.5 則用於脈絡拉長,或任務難到重試成本高於 token 差價的情況。值得避免的錯誤,是只憑頭條費率就從兩者中挑一個,因為決定這兩款模型各自被打造來應付之情況的,是每張費率卡上的第二個數字。

本文中的比較3

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新