
Claude Opus 5.5 對決 GPT-6 Sol:價格只要一半,直到上下文變長為止
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 177 tok/s
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1323 tok/s
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0345智能76程式
Anthropic 與 OpenAI 在同一個下午推出了相互競爭的旗艦模型。 Claude Opus 5.5於 2026 年 9 月 22 日發布,每百萬輸入 token 收費 4 美元、每百萬輸出 token 收費 20 美元,兩條產品線都比 Claude Opus 5 降價 20%。 GPT-6 Sol在同一天發布,輸入 2 美元、輸出 10 美元,相較 GPT-5.6 Sol 直接降價 50%,OpenAI 稱之為永久降價,而非促銷。只看這兩句話,這場對決還沒開始就看似已成定局:OpenAI 的模型只要半價,而半價就是半價。讀完兩份費率表的其餘部分,差距大致就會縮小——不是因為任何一家供應商做了改變,而是因為兩款模型都對同一類請求加收附加費,而這讓 Sol 損失的優勢遠比 Anthropic 多。
兩張費率卡,兩者都含有一個級距
在 272,000 個輸入 token 以下,這是當前前沿中最簡單的比較:
• 輸入 — GPT-6 Sol 每百萬 $2.00,相較於 Claude Opus 5.5 $4.00
• 輸出 — GPT-6 Sol 每百萬 $10.00,對比 Claude Opus 5.5 $20.00
• 快取輸入 — 就快取部分而言,GPT-6 Sol 比 Claude Opus 5.5 的每百萬 $0.20 便宜約 90%,相當於基礎輸入的 5% 倍率
• 上下文與輸出 —— 根據 Artificial Analysis 實測,GPT-6 Sol 為 872K,其他地方則宣稱 1M,最大輸出為 128K;相較之下,Claude Opus 5.5 為 1M 與 128K
• 知識截止 — Claude Opus 5.5 為 2026 年 6 月,而 GPT-6 Sol 未以相同表述載明
超過 272,000 個輸入詞元後,兩邊的計算方式都會改變,而且改變的幅度並不相同。GPT-6 Sol 會將整筆請求重新計價——不是超出的部分,而是整通呼叫——輸入費率大約變成兩倍,輸出費率則增加一半,來到輸入約 $4.00、輸出 $15.00。Claude Opus 5.5 的價目表沒有長上下文級距:Anthropic 在整個 1M 詞元視窗內一律收取 $4.00 和 $20.00,並表示一筆 900K 詞元的請求,每詞元成本與一筆 9K 詞元的請求相同。
把這些放在一起看,排序會在一個意想不到的地方翻轉。在長上下文呼叫中,兩個模型的輸入費率都收斂到約 $4——Sol 在輸入上的半價優勢完全消失——而輸出則從 2 倍差距縮小到約 $15 對 $20,是 25% 的優勢,而非 50%。Sol 仍然比較便宜。但它已經不再便宜到足以成為決策中唯一的數字,而原因是這兩種附加費用形狀不同:Anthropic 的模式收取固定費率,只是恰好較高;OpenAI 的模式則收取一種懲罰性費用,而這種費用衝擊最重的地方,正好就是兩家公司推銷這些模型所鎖定的代理式、讀取儲存庫、文件集等工作負載。

獨立評分,是唯一在相同條件下進行的比較

兩份發布表格都沒有包含對方的新模型——兩者都是在同日發布的模型推出之前寫成的——因此廠商資料根本無法為這兩者排名。Artificial Analysis 可以,因為它會以同一套公開配置來執行每個模型:
• 智能指數 — Claude Opus 5.5 為 58,在 210 個中排名第 1,對比 GPT-6 Sol 為 48,排名第 18
• 組態標籤 —— 兩者皆以最高投入計分;Claude Opus 5.5 另標示為「Default Fallback」
• 輸出速度 — GPT-6 Sol 每秒 113.3 個 token,排名第 38,相較之下 Claude Opus 5.5 尚未公布
• 首個權杖時間 — GPT-6 Sol 142.74 秒,對比排行榜中位數 3.83 秒;Claude Opus 5.5 尚未公布
• 價格 — GPT-6 Sol 每百萬 $2.00 / $10.00,對比 Claude Opus 5.5 的 $4.00 / $20.00
十個指數點與十七個名次的差距,是當前任何一組 Claude 對 OpenAI 配對中最懸殊的一次,而且這已是本月第二次對較便宜的模型不利——同樣的模式在先前一次比較中也出現過:當時 GPT-6 Sol 對上 Claude Opus 5,在成本低 60% 的情況下輸了三點。 速度列則朝相反方向發展,而且其重要性比表面上看來更高:每秒 113.3 個符元大約是 GPT-6 Astra 旗艦機型速度的兩倍,也是這組中最快的數字。再加上首個符元耗時 142 秒,整體輪廓就是一個先思考很久、再快速寫出的模型;這對任何互動式用途都不太合適,但對長時間無人看管的執行來說則尚稱合理。
這兩個數字都帶有與廠商相同的但書:它們都是最大努力(max-effort)下的測量值,而兩款模型的出貨預設值都不是最大努力。Claude Opus 5.5 在從低到最大的努力量表上預設為 中等;GPT-6 Sol 則提供從無到最大的量表。最大努力指數是比較模型上限的公平方式,卻也是預測你帳單時會誤導人的方式。
切換時,兩個方向分別會有哪些東西壞掉
這裡的遷移摩擦是不對稱的,在採取任一舉措之前都值得先了解。
Claude Opus 5.5 並非可直接替代 Claude Opus 5 的版本。現在已無法停用 thinking,因此設定非 thinking 路徑的程式碼將會發生錯誤,或是在無聲無息中改變行為。強制使用工具會傳回錯誤。Thinking 區塊會綁定至產生它們的模型與對話,因此無法跨模型重播。較舊的 computer_20251124 電腦使用工具在 Claude API 或 Google Cloud 上皆不被接受。另外,工具呼叫之間的文字現在會傳回 thinking 區塊內,而在預設顯示設定下這些區塊是空的,因此若應用程式將該文字以進度形式串流,將只會在呼叫之間悄然無聲,而不會拋出任何錯誤。
GPT-6 Sol 的努力程度調節是兩者中更具彈性的一個:它可以在對話中途變更,而不會導致提示快取失效,這意味著在同一上下文中先進行低成本的第一輪、再進行高成本的重試,是一種受支援的模式,而非會破壞快取的做法。對於任何在單一會話中執行分層推理的人來說,這是一項真正的工程優勢,也是支持 Sol 最有力的論據,而這點並未出現在任何價格表中。
同時執行兩者,並用你自己的數字來決定
對這場對決的誠實立場是:廠商提供的比較表無法斷定勝負,而獨立指數只能決定上限。剩下的就是工作負載問題——你的上下文實際上跑多久,以及一次失敗嘗試要付出多少代價——而這可以從你自己的流量中衡量,而不是靠新聞稿來爭論。
兩款模型都可透過 OrcaRouter 以供應商牌價、0% 加價進行路由:GPT-6 Sol 為 OpenAI 的 $2.00 / $10.00,Claude Opus 5.5 則為 Anthropic 的 $4.00 / $20.00。由於原價直通精確無誤,且供應商調價當天價格就隨之變動,你在預備環境量到的比例,就是你在正式環境支付的比例,沒有加價層需要重新推算。一組金鑰即可同時涵蓋兩者,因此那條把低於 272K 的呼叫導向 Sol、把長脈絡呼叫導向在你評估中勝出模型的路由規則,只是變更設定,而非再串接一次整合——而且自動容錯移轉意味著任一方當日推出上線時,你可以先投入一部分流量,而不是拿整條管線來下注。

這個在碰上帳單後還能存活的版本
GPT-6 Sol 在每一項目、每一種配置上都是較便宜的模型,這點無可爭議。無法成立的是「半價」是規劃時該依據的數字這個假設:在長脈絡呼叫中,輸入費率大約在 $4 交會,輸出價差則縮小到四分之一,這與發表頁面所描述的是截然不同的決策。將這點與十點的指數差距、十七個名次,以及實測 142 秒的首個 token 相權衡,對大多數工作負載而言,分流方式便不言自明——Sol 作為短、中脈絡下的高流量預設,Claude Opus 5.5 則用於脈絡拉長,或任務難到重試成本高於 token 差價的情況。值得避免的錯誤,是只憑頭條費率就從兩者中挑一個,因為決定這兩款模型各自被打造來應付之情況的,是每張費率卡上的第二個數字。
本文中的比較3
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
