一張 Claude Opus 5.5 定價的標題卡,顯示主要費率為每百萬輸入 token 4.00 美元、每百萬輸出 token 20.00 美元,以及每百萬快取讀取 token 0.20 美元。
Guides & Insights

Claude Opus 5.5 定價:完整價目表、快取計價項目,以及一項任務究竟要花多少錢

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

Claude Opus 5.5的定價為每百萬輸入 token 4.00 美元、每百萬輸出 token 20.00 美元,相較Claude Opus 5一路以來的 5.00/25.00 美元,均一調降 20%,而快取讀取更下降 60%,降至每百萬 0.20 美元。這些都是 Anthropic 公布的價格,摘自 Anthropic 自家的定價文件,時間為2026 年 9 月 24 日,也就是該模型推出兩天後。標價只是最簡單的部分。Anthropic 還表示,該模型在典型工作負載下的執行成本「約低 40%」,而這個數字並不在價目表上——它是供應商的描述,由每 token 的降幅,加上模型完成同樣工作會耗用更少 token、更少輪次的假設所組成。本頁將兩者分開來看:今天你能在價目表上查證的每一項費率,以及你查證不到的那個數字背後的計算過程。Claude Fable 5.1——位於其上一級的 10/50 美元價位——全文都會出現,作為 Anthropic 自己所做的比較對象。

完整費率表,每一行都與 Anthropic 公布的一致

本節的所有內容均讀取自 Anthropic 在 platform.claude.com 與 claude.com 上的定價文件,時間為 2026 年 9 月 24 日。此處沒有任何內容是從其他文章沿用而來的。

輸入 — 每百萬個 Token 4.00 美元(Anthropic 公布的費率)。

輸出 — 每百萬個 token 20.00 美元。思考 token 會以輸出 token 計費,且 Claude Opus 5.5 的自適應思考一律開啟,無法停用。

快取讀取 — 每百萬個權杖 $0.20。Anthropic 將其記載為基礎輸入價格的 0.05 倍,並為此模型另闢專屬的註腳例外。

5 分鐘快取寫入 — 每百萬個 token 為 5.00 美元,這是 Anthropic 對本表上每個模型套用的標準 1.25 倍基礎輸入倍數。

1 小時快取寫入 — 每百萬個詞元 $8.00,即標準的 2 倍基礎輸入倍率。

Batch API — 雙向皆享 5 折:每百萬輸入 $2.00、輸出 $10.00。Ant​hropic 直接公布折扣後的數字,不必由你自己折半換算。

Fast mode —— 每百萬輸入 $8.00、輸出 $40.00,正好是標準價格的 2 倍。Anthropic 的說明文件將該頁面命名為「Fast mode(研究預覽)」。

僅限美國境內推論 — 輸入、輸出、快取寫入享 1.1 倍乘數快取讀取,當 inference_geo: "us" 設定時。預設的全域路由則採用標準計價。

上下文與輸出上限——標準定價下提供 100 萬個 token 的上下文與 128K 的同步輸出,且不加收長上下文費用。Ant​hropic 表示,90 萬個 token 的請求與 9 千個 token 的請求,每 token 的計費費率相同。在 Batch API 上,只要帶上 output-300k-2026-03-24 beta 標頭,輸出上限即可提升至 300K。

Anthropic 也指出,快取乘數「會與其他定價調整因子疊加,例如 Batch API 折扣與資料駐留」——因此,一個經過批次處理、快取且指定美國的請求會同時乘上這三者,而算術結果是複合疊加,而非取代。

以下是兩個模型的讀者實際上在同一張表上如何權衡成本:

Claude Opus 5 — 輸入 $5.00、輸出 $25.00、快取讀取 $0.50、5 分鐘快取寫入 $6.25、1 小時寫入 $10.00,Batch 則為 $2.50/$12.50(Anthropic 公布費率,查閱於 2026-09-24)。

Claude Fable 5.1 — $10.00 輸入,$50.00 輸出,$0.25 快取讀取,5 分鐘快取寫入 $12.50,1 小時寫入 $20.00,Batch 為 $5.00/$25.00(Anthropic 公布費率,讀取於 2026-09-24)。

A two-column rate-card scoreboard comparing Claude Opus 5.5 and Claude Opus 5 across six dimensions: input, output, cache read, 5-minute cache write, 1-hour cache write and Batch pricing, with Anthropic's published per-million rates.

快取行才是代理帳單實際上被決定的地方。

發表報導把快取讀取當成註腳帶過。對任何會重新傳送大型前綴的工作負載來說——也就是大多數程式編寫與代理工作負載——它是整張表上最大的單一槓桿。

Anthropic 自家的註腳對這些比例說得異常直白:在多數 Claude 模型上,快取命中與快取更新的費用是基礎輸入價格的 0.1 倍,Claude Fable 5.1 上是 0.025 倍,而 Claude Opus 5.5 上是 0.05 倍。所以 Claude Opus 5.5 的快取比例比標準比例糟了一倍,也比 Claude Fable 5.1 的糟了一倍。

以金額計,它無論如何都會勝出,而這正是值得內化的重點:當基準率高出兩倍半時,再好的乘數也無法在金額上取勝。

• Claude Fable 5.1 — $10.00 基準的 2.5% 為 $0.25/每百萬個快取符元。

• Claude Opus 5.5 — 以 $4.00 為基準的 5% 為$0.20/每百萬個快取詞元。

• Claude Opus 5 — $5.00 基準的 10% 即為$0.50/每百萬個快取權杖。

寫入方面也存在同樣的反轉。Claude Fable 5.1 將一百萬個 token 寫入 5 分鐘快取要價 $12.50,寫入 1 小時視窗則為 $20.00;Claude Opus 5.5 分別收取 $5.00 和 $8.00。快取讀取則是唯一一項,Claude Opus 5.5 儘管比率居中,卻在絕對金額上勝過兩個同門模型。

兩條規則決定這筆寫入究竟值不值得付費。Ant​hropic 的文件指出,5 分鐘的寫入成本是基準輸入的 1.25 倍,因此只要一次快取讀取就能回本;而 1 小時的寫入成本是基準輸入的 2 倍,需要兩次讀取才能回本。而且快取與產生它的前綴綁定:Ant​hropic 指出,在快速與標準速度之間切換會使快取失效,因為不同速度的請求不會共用快取的前綴。更換模型、努力程度或工具定義也有同樣的效果。一個較便宜的模型,若每次切換都強制重寫前綴,可能比它所取代的昂貴模型花費更多。

一個冗長的 agent 迴圈實際上要付出多少成本

以一個 40 輪的程式編寫代理為例,它在每一輪都會重新送出 120,000 個 token 的前綴——系統提示、工具結構定義、檔案樹——並從工具結果中每輪增加 1,000 個全新的輸入 token,且每輪產生 800 個輸出 token。這裡的重點在於代換:把這四個數字中的任一個改成符合你自己流量樣態的數值,接下來的計算依然成立。

關於 Claude Opus 5.5:

• 快取寫入,一次 — 120,000 個 token,每百萬 $5.00 = $0.60

• 快取讀取,39 回合 — 4,680,000 個 token,每百萬 $0.20 = $0.94

• 全新輸入,40 回合 — 40,000 個 token,每百萬 $4.00 = $0.16

• 輸出,40 回合 — 32,000 個 token,每百萬 $20.00 = $0.64

工作階段總計 — $2.34,其中快取讀取約佔 40%。

在 Claude Opus 5 上,相同的 token 數量:快取寫入 $0.75、快取讀取 $2.34、全新輸入 $0.20,以及輸出 $0.80 —— $4.09

在 Claude Fable 5.1 上,相同的 token 數量:快取寫入 $1.50、快取讀取 $1.17、全新輸入 $0.40,以及輸出 $1.60 —— $4.67

相同的 token 數、相同的輪次,無須提出任何效率主張:Claude Opus 5.5 的結果比 Claude Opus 5 低 43%,比 Claude Fable 5.1 低 50%。而相對於 Claude Opus 5 的 1.75 美元差距中,有 1.40 美元——佔這筆節省的八成——單單來自快取讀取這一項,而非來自檯面上的輸入費率。

現在換個相反的情境:單次呼叫,輸入 20,000 個 token、輸出 8,000 個,不用快取。Claude Opus 5.5 的輸入費用是 $0.08,加上輸出的 $0.16,總共 $0.24。Claude Opus 5 則是 $0.10 加 $0.20,總共 $0.30。這正好就是那 20% 的牌價調降,一分一毫都沒多。

所以單憑價目表就能帶來介於 20% 到 43% 之間的成效,具體取決於你的帳單中有多少比例是快取讀取。任何高於這個範圍的說法,都是來自代幣用量,而不是來自價格。

Anthropic「運行成本約便宜 40%」這個說法從何而來

Anthropic 的發布資料指出,Claude Opus 5.5「提供服務時所需的運算資源比 Opus 5 少」,且其測試顯示,在預設設定下,它「在典型工作負載上的成本將比 Opus 5 低 40%」。Anthropic 給出的拆解是,該模型「每 token 成本比 Opus 5 低,且每項任務使用的 token 較少,兩者相抵後使成本降低 40%。」

就照實話說:這是供應商對 Anthropic 自行挑選的一組工作負載平均值的描述,不是經過稽核的結果,也不是價目表上公布的費率。可驗證的是前半段——輸入與輸出省 20%、快取讀取省 60%,這兩項今天在價目表上都看得到。後半段則取決於模型在你的工作負載上是否花費更少的 token 與更少的回合,而這只能靠實際跑一遍來驗證。

Anthropic 為 token 這一半提供的證據,是一組推出時的客戶聲明。以下全部皆由供應商發布,描述供應商及其客戶所選擇的工作負載:

Box — 該模型「使用的 token 數量只有 Opus 5 的三分之一」,回答「精簡 40%,卻不失準確度」。

Kiro — 它「在呼叫次數減少約 40%、詞元用量減半的情況下,解決的問題比 Opus 5 還多。」

Factory—— 它在高強度模式下與 Opus 5 表現相當,但輸出 token 數少了 20% 至 25%。

GitHub — 它「在我們測量的項目中,使用了最少的符元和步驟之一」,並且在 VS Code 中「以不到一半的步驟解決了比 Opus 5 更多的終端機任務。」

併購分析,一個實作範例——兩家虛構的人力資源軟體公司,各自建立一個 Excel 模型與一份高階主管簡報。Anthropic 指出 Claude Opus 5.5 在 63 分鐘內完成,而 Claude Opus 5 則需 93 分鐘,且「生產成本低了 50%」。由供應商自述,n=1。

這裡的獨立制衡數據很重要,因為它指向相反方向。Artificial Analysis 測量 Claude Opus 5.5 在最大 effort 下的表現為每項 Intelligence Index 任務約 119,000 個輸出 token,相較之下,Claude Opus 5 在最大 effort 下約為 73,000 個——token 數量是上升,而非下降。其對該配置的總結是,Claude Opus 5.5「在每項任務成本上與 Opus 5 持平,儘管輸出 token 數是 1.6 倍」,公布的每項 Intelligence Index 任務成本為 $5.98。這是在最大 effort 下進行的獨立測量,並不與 Anthropic 的說法矛盾——這是 effort 尺度的另一端。

這就帶出了貫穿本節每個數字的注意事項。Anthropic 表示,除非另有說明,其所有 Claude Opus 5.5 的結果都是在自適應思考模式下、以最大努力程度執行。Claude Opus 5.5 預設為中等努力程度;Claude Opus 5 則預設為,而兩個模型中同名的等級並不代表相同的思考預算。因此,一份以最大努力程度跑出的廠商數據表,和一份以最大努力程度、但啟用預設回退機制跑出的獨立數據表,並不是相同的組態設定;而預設設定也不是讀者實際會部署的設定。在經過挑選的一組工作負載上、以你可能根本不會用到的設定所測得的 40% 平均值,只是個初步假設——而不是一筆預算數字。

快速模式是研究預覽版,不是一個層級

Claude Opus 5.5 的快速模式價格為 每百萬輸入 $8.00、每百萬輸出 $40.00——正好是標準定價的兩倍——可換取最高 2.5 倍的每秒輸出 token 數。它不會縮短首個 token 的產生時間;其效益在於輸出速度,且在串流時最為明顯。

把其餘的部分講清楚,因為很容易把它當成一個方案層級來編列預算,但它其實不是。Anthropic 將 fast mode 標示為 研究預覽。存取權限須透過客戶經理或候補名單申請。它需要在請求中帶上 fast-mode-2026-02-01 beta 標頭,以及 speed: "fast"。它僅適用於 Claude API——Amazon Bedrock、Google Cloud、Microsoft Foundry,或 AWS 上的 Claude Platform 都不支援。它無法與 Batch API 或 Priority Tier 承諾合併使用。它確實可與提示快取及資料落地倍率疊加,因此一個指定美國的 fast mode 快取請求,需在 2 倍之上再付 1.1 倍。而在 fast 與標準速度之間切換工作負載會使提示快取失效,這在長時間的代理迴圈中,成本可能高於速度所省下的部分。

Claude Opus 5 與 Claude Opus 4.8 也支援快速模式,價格為 $10.00/$50.00。Claude Opus 4.7 則會直接拒絕該參數。

決定帳單的單位是每項完成任務的成本

上述每一項費率都是每詞元的價格。沒有人會買詞元。每詞元價格唯有乘上一項任務所消耗的詞元數,以及完成它所需的嘗試次數,才會成為成本。

來算一下先前那個低快取用量的例子。每次執行 $0.24 時,一個第一次嘗試就完成任務的模型成本是 $0.24。同一項任務若由競爭對手以每次執行 $0.30 來做,成本是 $0.30——所以那個較便宜的模型看起來領先 20%。現在讓較便宜的模型每完成一項任務需要 1.2 次執行,這對代理式工作來說是相當寬鬆的成功率:1.2 × $0.24 是 $0.288,相較於單次執行替代方案的 $0.30。省下的錢沒了。三次執行時是 $0.72,而那個每 token 看似便宜 20% 的模型,每完成一項工作反而貴了 140%。

這就是為什麼 Anthropic 自己宣稱的效率——更少的 token、更少的呼叫、更少的步驟——是以正確的單位來表述。這也是為什麼在你重現它們之前,不該把它們任何一項當成預算科目。檢查方式很機械:每次執行的價格,乘以每個完成任務的執行次數,並以你自己的流量來衡量。這兩個數字都得由你產生,而且沒有廠商會針對你的工作負載公布第二個數字。

如果你想取得一個來自供應商外部的單一參考基準,Artificial Analysis 估計 Claude Opus 5.5 在其最高投入設定下,每項 Intelligence Index 任務為 5.98 美元——這是一個獨立數字,且此設定是多數正式環境流量不會採用的,適合作為上限而非預測。

Anthropic's own pricing documentation table, showing the Claude Opus 5.5 row at $4 input and $20 output per million, a $5.00 five-minute cache write, an $8.00 one-hour cache write and a $0.20 cache read, above the Claude Fable 5.1 and Claude Opus 5 rows.

主要費率不包含的項目

駐留。僅限美國境內的推論在每個 token 類別(包括快取讀取與寫入)皆為 1.1 倍。它可與快速模式及 Batch 折扣疊加使用。

工具定義。 Anthropic 會公布各模型的工具使用系統提示額外負擔:宣告工具會為每個 Claude Opus 5.5 請求增加 286 個權杖。以每百萬 4.00 美元來看不算多,但這是按每次請求計費,而代理迴圈會發出大量請求。

快取失效。在模型、effort、工具定義或速度變更後重寫的前綴,會依寫入費率計費——在 Claude Opus 5.5 上為每百萬 $5.00 或 $8.00——而非 $0.20 的讀取費率。

位於其下方的模型。 Claude Sonnet 5 的價格為每百萬輸入 $2.00、輸出 $10.00,Anthropic 的定價註腳證實這現在已是標準價格,而非當初公布時所稱的優惠費率。Claude Opus 5.5 在輸入與輸出兩方面都正好是 Sonnet 5 的 2 倍。

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, and a stat strip reading $4.00 per million input tokens and $20.00 per million output tokens.

以 Anthropic 的定價呼叫 Claude Opus 5.5

Claude Opus 5.5 已在 OrcaRouter 上anthropic/claude-opus-5.5,每百萬 token 輸入 $4.00、輸出 $20.00 —— 這正是 Anthropic 自家的定價,並以0% 加價直接轉嫁。這種原價直通的做法,值得在定價頁上講清楚:因為供應商費率是即時轉送,而不是快取在表格裡,所以供應商調價在公布當天就會在此生效,不必等同步週期跑完。若 Anthropic 調整這份價目表,你撥打的那個號碼也會跟著更動。

同一把金鑰就能觸及本頁用來與它比較的各個層級——anthropic/claude-opus-5,價格為 $5.00/$25.00,以及anthropic/claude-fable-5.1,價格為 $10.00/$50.00——還有 Claude 系列其餘成員,以及其他 200 多個模型,因此要測試較低的每符元價格在你自己的通過次數下是否依然成立,並不需要另外簽約或修改程式碼。自動容錯移轉則適用於你想在正式環境路徑上執行不熟悉的模型,卻不想把整條路徑押在它身上的情況。

這頁在講什麼,兩行就能回答:價目表是輸入 $4.00、輸出 $20.00,快取讀取每百萬 $0.20,而 20% 的降幅是真的,而且今天就能驗證。40% 則是 Ant​hropic 在其自行挑選的工作負載上的平均值。在你依據第二個數字編列預算之前,先讓你自己的一個 agent 迴圈跑過一遍。

本文中的比較3

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新