Claude Opus 5.5 的主視覺標題卡,寫著「Claude Opus 5.5 示範:第一週」,副標題為「三筆回報帳單:$3.21、$13.30、$25.66」,頁腳一行寫著「單價依 Anthropic 為準;示範成本依其開發者回報。」,右下角則有 OrcaRouter 標誌。
Engineering & Research

Claude Opus 5.5 示範成本 3 至 26 美元:如何解讀建構的最初幾天

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

來自 Claude Opus 5.5第一週的兩個數字,描述的是同一個模型,卻相差了一個數量級。有位開發者回報,一個已完成的互動式鏡頭實驗室——一個讓你拖曳對焦環、看著發光的焦平面掃過山谷的頁面——花了 $25.66 的 API 費用,以及 1 小時 26 分鐘的實際耗時。一篇廣為流傳的上市示範彙整,則將一段以程序化方式打造的 Blender 城堡動畫(還配上煙火與湖面倒影)標價為 $13.30 與 35 分鐘。一篇登上 r/ClaudeAI 首頁的討論串則說 $3.21。廠商於 2026 年 9 月 22 日推出 Claude Opus 5.5,定價為每百萬輸入 token 4 美元、每百萬輸出 token 20 美元,而這三個數字都沒有錯。它們衡量的是不同的東西,如果你要拿它們來編預算,就得知道各自衡量的是什麼。

這個落差不是雜訊。它是代理程式執行所產出與其消耗之間的差異,而過去四天已產生數量可觀的後者,卻幾乎沒有對其作出核算。所以,以下是那些展示旁沒有人貼出的計算,接著是這場發布中真正列在價目表上、而且可以查核的部分。

25.66 美元實際買到了什麼

這個範圍中最昂貴的一端就是最有用的一端,因為建造者同時公布了成品與帳單。

Ryan Sael 的鏡頭實驗室,標題為「The Plane of Focus」,是一個互動式單頁作品,靠一次工作階段中的一段提示詞建構而成。它把一顆相機鏡頭放上畫面,讓你拖曳對焦環,並展現出每位攝影師都知道、卻幾乎沒人親眼見過的東西:現實世界中那一片讓照片真正變清晰的薄層。轉動對焦環,這片薄層就會移動,鏡筒內的玻璃鏡片也會前後滑動以說明原因,而一個主控台會回報距離、光圈與清晰範圍——頁面開啟時的設定是 60 cm、f/2、1.9 cm 的景深。把光圈從 f/2 縮到 f/16,光錐變窄,清晰範圍也隨之變寬。爆炸圖檢視則把玻璃鏡片一一拆解開來。整條流程中沒有任何影像模型,也沒有下載任何素材:每一個元素都是在程式碼中繪製並製作動態,這正是為什麼整個模糊圈的示範是一場即時模擬,而不是一張示意圖。

那確實是一篇很好的解說,而附帶其上的說法精確得不太尋常:一次完成、1 小時 26 分鐘、25.66 美元的 API 用量,而且我讀到時,頁面仍在 lens.lab.sael.net 上線。這個數字是自行回報、無法稽核的,但它也是目前流通中唯一附有可供相除之工作階段長度的示範成本。

用價目表來算一下。以 Claude Opus 5.5 公布的每百萬輸入 $4、每百萬輸出 $20 計算,$25.66 相當於 128 萬到 640 萬個 token,取決於輸入輸出的組合比例——若這次執行全是輸入就落在上限,若全是輸出就落在下限。像這樣的代理式建置會落在中間某處,而它之所以偏向下限,原因就在多數人會忽略的那個項目:Claude Opus 5.5 的快取讀取每百萬只要 $0.20,是輸入費率的四十分之一,因此長時間工作階段若不斷重讀同一份持續長大的程式碼庫,這部分流量幾乎不花什麼錢。一千萬個快取輸入 token 只花 $2。輸出側才是模型花一個半小時寫程式、思考、再改寫所累積的地方:以每百萬 $20 計算,一百萬個輸出 token 就是 $20,而思考 token 也以輸出計費。Sael 的數字與一次產生約一百萬輸出 token、並搭配龐大而便宜的快取輸入端的執行相符——而這正是無人看管的 86 分鐘建置所呈現的樣子。

接下來有兩件事。第一,發表日當天受到矚目的標價調降,從 $5/$25 降到 $4/$20,換算下來是每個 token 有 20% 的變動,單憑這一點並不會讓這次執行變便宜;真正讓 90 分鐘的迴圈變得可負擔的,是快取讀取費用從 $0.50 降到 $0.20 這一項。第二,這點比較令人不太舒服:$25.66 的帳單報告裡,沒有任何內容能告訴你這次執行順不順利。一次執行得當的一次性完成,和一個折騰了一個半小時後來才成功的工作階段,會產生一模一樣的帳單。

$13.30 這個數字經不起自身算術的檢驗

這個區間的中段之所以具有啟發性,是出於另一個原因。一篇於 9 月 23 日發布的發表示範彙整報導了一場正面對決:Claude Opus 5.5 被要求僅憑一則提示,以程序化方式建構一段十秒的 Blender 動畫——城堡、湖面倒影、煙火——對手是 GPT-6 Astra,全程不進行手動編輯;報導指出它耗時 35 分鐘、輸出 199,600 個 token、花費約 13.30 美元,而 GPT-6 Astra 則耗時 28 分鐘、花費約 14.50 美元。有趣的部分在於 token 數量,因為它與價格並不相符。

199,600 個輸出 token,以 Claude Opus 5.5 每百萬 $20 計算,是 $3.99,而非 $13.30。若單靠輸出要達到 $13.30,你需要 665,000 個 token。少掉的錢在其他欄位:輸入每百萬 $4、五分鐘斷點的快取寫入每百萬 $5、一小時的快取寫入每百萬 $8,以及任何重試。這不是報告裡的矛盾——而是報告誠實面對一個只計算一件事的 token 數量,以及一張計算四件事的帳單;這是發布週成本討論中最常見的混淆。如果你要從已發布的示範中取用一個數字,就拿美元金額,並把旁邊任何 token 數量視為對這次執行過程的部分描述。

在便宜的那一端,帳目計算又更加單薄。r/ClaudeAI 上那則聲稱某個完成成品用了 3.21 美元 API 用量的討論串,就是這類內容的典型:一個標題、一段影片,卻沒有細項。這可能是較短的工作階段、較小的產物,或是大量快取的輸入。這不是可以拿來規劃預算的依據,而我也無法核實其中任何一美元。

為什麼這些數字每一個都是下界

這裡的失敗模式,不在於製作者會掩飾造假,而在於選擇性。會流傳開來的示範,都是成功奏效的那些,而且是由它們奏效的對象所發布;至於那四次做出壞掉頁面的嘗試,成本與那一次沒壞掉的一樣。那篇彙整 Blender 比較的總整理文章把這點說得很白——沒有人會發布失敗案例——而它自己最詳盡的一則條目正是例證:一個手錶品牌網站第一次沒抓準需求,用了難以辨讀的字體,得再做第二次,才成為最後被展示的版本。

「One shot」在那套詞彙中也默默發揮著作用。它描述的是一段單一工作階段,而不是一次單一嘗試;而一段工作階段可以容許模型產生多少自我修正,就包含多少——在長達 86 分鐘的執行中,這可不少。模型在同一個上下文視窗內重寫自己的程式碼兩次,是單次工作階段,卻也是兩次嘗試。

所以,對前四天的誠實解讀是三個層級的證據,而它們不應該被平均:

• 自報成本並附上工作階段長度——可用於判斷數量級,但無法驗證。Sael 在 1 小時 26 分鐘內花費 $25.66,是這一層級中最有力的項目。
• 自報成本並附上 token 數量——往往內部不一致,正如 $13.30 這個數字所示。
• 只是一個金額數字,背後別無其他——僅能作為有人做出過某些東西的訊號,如此而已。

發布活動中列在價目表上的部分

剝除示範性宣稱後,可驗證的情況既狹隘又清楚。以下所有數字皆為 Anthropic 公布的費率,摘自該公司自家的模型文件與 2026 年 9 月 25 日的公告:

• 輸入 — 每百萬 token 4 美元。輸出 — 每百萬 20 美元,思考 token 以輸出計費,且 Claude Opus 5.5 的自適應思考永遠開啟,無法關閉。
• 快取讀取 — 每百萬 0.20 美元,為 0.05 倍乘數。快取寫入 — 五分鐘時限每百萬 5 美元,一小時時限每百萬 8 美元。Batch API — 雙向皆五折,分別為 2 美元與 10 美元。
• 快速模式 — 每百萬輸入 8 美元、輸出 40 美元,速度最高可達 2.5 倍,而 Anthropic 仍將其標示為研究預覽版。
• 規格範圍 — 100 萬 token 上下文,同步輸出 128K token,搭配 beta 標頭在 Batch API 上可達 300K,可靠的知識截止日期為 2026 年 6 月,預設投入程度為 medium,而非 Claude Opus 5 預設的 high。
• 可用性 — Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 AWS 上的 Claude Platform,並承諾退役時間不早於 2027 年 9 月 22 日。

廠商自家的效能宣稱,並標明為宣稱:Claude Opus 5.5 在多數工作上的表現達到 Claude Fable 5.1 的水準,執行成本比 Claude Opus 5 低約 40%,產生輸出速度則快超過 30%。這 40% 是廠商自行挑選的工作負載平均值,不是價目表上的數字,兩者不應被當成同一類事實來引用。

獨立檢驗的規模小於廠商表格,但指向同一方向,且差距更小。Artificial Analysis 在其 Intelligence Index 上給 Claude Opus 5.5 打了 57.6 分,並在其模型頁面所載的數據中,於 Humanity's Last Exam 拿下 61.4、SciCode 拿下 66.9,以及在長脈絡回憶上取得 84.7。在同一出版品的程式編寫代理量測中,該量測報告的是每項任務成本而非每詞元成本,數字卻朝另一方向走:在最大努力程度下,每項任務成本升至約 $13.04,而同一測試框架中 Claude Opus 5 為 $10.79。模型花費更多的那種更便宜詞元,並不代表任務更便宜。這正是示範帳單所教導的同一堂課,只是從第三方傳來。

第二週該做什麼不同的事

如果 $25.66 這個數字正是讓你想要嘗試這件事的原因,那麼有用的做法並不是編列 $25.66 的預算——而是讓你自己的執行跑出一個你能解釋的數字。

明確設定 effort,而不要接受預設值,因為相較於模型選擇,這個旋鈕更能左右每項任務的 token 用量,而且此模型的預設值已不同於 Claude Opus 5。刻意快取穩定的前綴:Claude Opus 5.5 上可快取的最小提示為 512 個 token,低於先前的 1,024,因此以前從未快取的短共用前綴,現在可以快取了。為任何長時間執行的作業在 max_tokens 中預留餘裕,因為 thinking 是該預算的一部分,且已無法關閉——Anthropic 自家的移轉指引建議,最高 effort 等級的工作從 64K 開始,再從那裡調整。並且在最後而非一開始就為執行加上監測:讀取每個回應最上層的 model 欄位,因為對於其分類器標記的提示,Anthropic 會在同一次呼叫內重新路由請求,而你送出的模型字串並不代表實際回答的是什麼。

最後這一點,正是路由器不再只是便利功能的地方。一個在防護邊界下無人看管地運行一個半小時的建置,回來時可能已經默默地在較小的模型上完成了某些回合,而唯一能得知的方法就是親自去看。Claude Opus 5.5 是在 OrcaRouter 上以 Anthropic 自家的定價、0% 加成——供應商費率直接透傳,所以供應商價格一有變動,這裡在價格公布的同一天就會生效——而這其實是這裡的路由所做的最不有趣的一件事。有趣的是,一個 API 對應 200+ 個模型把整個實驗放在單一金鑰上,因此「用前沿模型來跑,失敗時回退而不是直接失敗」是一行設定,而不是第二份合約和一次改寫。自動容錯移轉正是讓不熟悉的模型能安全放上你在意路徑的關鍵,而一個你能繞開的拒絕,就是不會在第 70 分鐘終結你那次執行的拒絕。

接下來將移動的數字

Anthropic 表示,Claude Sonnet 5.5 與 Claude Haiku 5.5 將在「未來幾週內」接續推出,而這將重新定價這些示範中的每一個,卻不改變它們的形態:以更便宜的每 token 費率,對上沒人能事先預測的 token 數量。同樣的不確定性,曾讓第一週的數字無法使用,也將適用於下一代的數字,這正是為什麼要現在就養成習慣,而不是等降價再次落地之後才做。

目前為止,誠實的總結說來簡短。Claude Opus 5.5 是真的,已正式全面推出,定價為 $4 與 $20,而快取讀取的價格是這條產品線歷來最低。它在最初四天做出的展示成果非常出色,而那些價格標籤只是軼聞。若你想知道自己工作負載的成本,唯一能讀出這個數字的工具,就是你自己跑一次、設定上限,然後事後再看帳單。

A three-card graphic titled 'Claude Opus 5.5 — what the demos reported', with the first card reading 'Lens lab: One shot, 1h 26m / $25.66 reported', the second reading 'Blender castle: 35 min, 199,600 output tokens / $13.30 reported / output at list price: $3.99', the third reading 'Reddit build: $3.21 reported / no breakdown published', over a footer reading 'Demo costs are builder-reported and unauditable; unit prices per Anthropic.'A single-column rate card for Claude Opus 5.5 with rows reading Input: $4.00 / M tokens; Output: $20.00 / M; Cache read: $0.20 / M; Cache write, 5 min: $5.00 / M; Batch API: 50% off both ways; Default effort: medium, over a footer reading 'Prices per Anthropic, September 25, 2026. Vendor performance claims not shown.'OrcaRouter model page for anthropic/claude-opus-5.5 showing the pricing row of $4.00 input and $20.00 output per million tokens, a p50 time-to-first-token of 6.19 seconds, a 1M-token context with 128K max output, capability chips for vision, tools, JSON and reasoning, the public benchmarks by Anthropic dated 2026-09-22, and OpenAI-compatible and Anthropic SDK code samples pointing at api.orcarouter.ai.

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新