
OpenCode Go 中的 Claude Haiku 5.5:每月 10 美元究竟能買到什麼
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
Anthropic 於Claude Haiku 5.52026 年 10 月 7 日推出,不到一天就被列入 OpenCode 的 Go 與 Zen 目錄——那些以每月美元額度計量、而非按 token 計費的編程代理訂閱服務。第二筆上架紀錄才是值得慢下來細看的部分,因為 OpenCode 為 Claude Haiku 5.5 所公布的額度,並不是這款模型的折扣。那是一具以 Anthropic 自家牌價設定的預算計量器,而它背後的每一個數字,都能對照公布它的那兩個頁面逐一查核。如果你還在猶豫該用什麼來取代 Claude Haiku 4.5,那麼決定的是額度,而不是標價。
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Anthropic 在10月7日公開發表的內容
這家廠商並非悄悄推出這項產品。Anthropic 的新聞室裡有一則註明日期的公告、一個附有基準測試表的產品頁面、一份系統卡、一張定價表,以及六則具名的客戶證言。這裡沒有可檢視的儲存庫,也沒有發布權重,因為根本沒有東西可發布:Artificial Analysis 將Claude Haiku 5.5記錄為專有,且未揭露參數數量。任何將此描述為外洩或未發表模型的人,讀的都是不存在的儲存庫。
Anthropic 自身的定調是量產型模型,而非前沿型模型:
• 定位——「我們歷來推出過最便宜、最迅速、能力最強的小型模型」,瞄準摘要、壓縮、資料庫查詢與分類等用途,並主打為可與 Claude Opus 5.5 和 Claude Sonnet 5.5 搭配處理程式設計工作的子代理。
• 價格 — 每百萬個輸入 token 為 $0.10,每百萬個輸出 token 為 $0.50,適用於最多 100,000 個 token 的提示;超過此數量則為 $0.50 與 $2.50。快取讀取 $0.01 / $0.05,快取寫入 $0.125 / $0.625。
• 上下文與輸出 —— 具備 1M token 視窗與 128,000 token 最大輸出,這是更大型 5.5 級模型所具備的相同規格範圍,並在最便宜的層級上重現。
• Effort — 首款具備可調整 Effort 設定的 Haiku 等級模型,範圍從 Low 到 Max,預設為 medium。Anthropic 會公布各設定下的準確度對成本曲線,而非單一數字。
• 基準測試,由廠商自行回報且未經獨立重現 — GDPval-AA v2.1 為 1620,對比 Claude Haiku 4.5 的 735;AA-Briefcase v1.1 為 1578,對比 614;OSWorld 2.1 為 72.4%,對比 15.7%;Humanity's Last Exam 在無工具時為 45.9%、使用工具時為 57.4%,對比 10.2% 與 18.7%;Terminal-Bench 4.0 為 39.2%,對比 0.0%;Chartography 為 46.4%,對比 6.4%。
• 廠商自設的天花板——Anthropic 對其 Terminal-Bench 圖表的評論指出,Claude Sonnet 5.5 與 Claude Opus 5.5「在複雜的代理式程式設計任務上仍是更好的選擇」。同一篇文章中的客戶引述來自搶先體驗合作夥伴,描述的是他們自家的評估,而非稽核:Asana 回報延遲降低超過 30%,且每個代理回合的推論速度最高快 2.5 倍;HubSpot 三次執行平均達 92.8%;AlphaSense 在每週約 800 萬次呼叫的工作負載上,400 次查詢的成績為 0.84 對 0.76;Box 在約一半延遲下高出 11 分;Cognition 則以 Haiku 5.5 作為助手,取得 FrontierCode 分數 66.2。

Anthropic 也藉這次發布調整了兩項相鄰的價格:Claude Sonnet 5.5 的快取讀取費用減半至每百萬個 token 0.10 美元,該公司表示這讓 Sonnet 5.5 在多數代理式工作上的成本降低約 20%;此外還為 Claude Max 與 Team 訂閱者推出新的每月 API 額度。這兩項都是上一層級的變動,而對已經全面採用 Sonnet 的團隊來說,其重要性遠高於任何正在挑選小型模型的人。
該津貼是美元預算,而非折扣
這裡是那則公告推文沒有說的部分。OpenCode 的 Go 文件指出,「使用限制是以每月美元金額定義」,兩個方案的 Token 定價相同,而且每個模型的額度會按照固定時程逐步遞減:每五小時為月度限額的 20%、每週 50%、每月 100%。該文件也公布了它為此模型假設的每請求 Token 設定——1,100 個輸入 Token、55,000 個快取 Token、240 個輸出 Token。
把那些數字套進 Anthropic 的標價和已公布的請求次數來算,它們就不再像是任意分配了:
• 按定價計算,每次請求成本 — 1,100 個輸入以每百萬 $0.10 計,加上 55,000 次快取讀取以每百萬 $0.01 計,加上 240 個輸出以每百萬 $0.50 計,合計為 $0.00078。
• 每月請求次數——$15 除以 $0.00078 等於 19,230,這正是文件中列出的數字。$40 方案的 $60 額度換算後為 76,923,而文件列出的是 76,920。
• 遞減——19,230 的 20% 是 3,846,列印為每五小時 3,850;50% 是 9,615,列印為每週 9,620。Go Plus 也在 15,380 和 38,460 上套用相同算法。
• 換算成美元是什麼意思——這筆額度在 $10 方案中相當於價值 $15 的 Anthropic 計價 token,在 $40 方案中則為 $60。因此,$10 訂閱每月最多只能買到價值 $15 的此模型 token,若你把整個額度都花在 Claude Haiku 5.5,且不花在其他任何東西上。
那是解讀 Go 頁面上「New」標章的誠實方式。訂閱很便宜,模型也很便宜,而這兩件事彼此獨立:額度是按供應商自身費率計價的計量預算,所以這個方案限制的是你能花多少錢,而不是模型成本有多低。重度使用者會觸及上限,直接付錢給 Anthropic——或者自行路由該模型。

百分之九十、百分之七十五,以及五倍斷崖
Anthropic 的頭條消息是:Claude Haiku 5.5的成本比 Claude Haiku 4.5低約 90%(針對最多 100,000 個 token 的提示),且平均而言,它「現在執行成本低了約 75%」。這兩個數字都是供應商說的。它們也同樣正確,而兩者之間的落差正是定價風險的全部所在。
• 在這個價格區間內——輸入 $0.10、輸出 $0.50,相較於 Haiku 4.5 的固定 $1 與 $5。Anthropic 表示,對其前一代 Haiku 模型提出的請求約有 90% 落在這個區間,而 90% 這個數字正是由此而來。
• 超出該區間後——同一個請求的計費為輸入 $0.50、輸出 $2.50,輸入價格躍升為五倍。這仍是 Haiku 4.5 費率的一半,但遠遠算不上是 90% 的降幅。
• 混合式說法——75% 這個數字是 Anthropic 自己針對真實流量組合所做的估算,不是價目表,而這正是應該放進預測裡的數字。
• 分詞器——與 Claude 4.7 及後續版本共用的較新分詞器,根據 Anthropic 自家文件,對相同文字會產生約多 30% 的 token,因此每 token 的降價不會一對一轉化為更低的帳單。
努力程度旋鈕會把所有這些因素疊加起來。因為預設是 medium,而公布的曲線一路延伸到 Max,同一個提示可能因為多數呼叫者從未設定的參數而貴上數倍——而 OpenCode 的請求估算假設在某個隱含設定下只有一種固定的 token 概況。如果你的提示接近 100,000 個 token、執行用量受限的子代理,或你調整了 effort 旋鈕,那麼 90% 這個標題數字就不是你會看到的數字。
獨立董事會就分數達成一致,並點出自身計算的問題
Artificial Analysis 在其 Intelligence Index v4.3.2 中,於該模型的 Max 配置下,給 Claude Haiku 5.5打出 43 分,對比排行榜中位數 13;並測得每秒 241.9 個輸出 token,而可比較模型的中位數為 110.9。同一頁面列出每項 Intelligence Index 任務的成本為 0.21 美元,並回報該模型在評估期間產生了 4.4 億個輸出 token,而中位數為 1 億——形容其「非常冗長」。
冗長度正是這兩個排行榜交會的地方。上述的額度計算是按 token 收費,因此一個會長篇推理的模型,消耗預算的速度會比請求次數所顯示的更快,而 OpenCode 每筆請求 55,000 個快取 token 的概況,是一種關於提示快取的假設,訂閱使用者不見得能重現。Artificial Analysis 頁面上的兩項揭露,比它的標題數字更有價值:那個 43 是 Max 組態,而不是你什麼都不做所得到的 effort 設定;而且該頁面明確註記,Claude Haiku 5.5在較長脈絡的輸入上定價高出 5 倍,而這點目前並未反映在其成本數據中。長脈絡的斷崖是真實存在的,而這個獨立排行榜已經告訴你,它尚未納入自身的數字裡。

大多數買家會跳過的留存文字
OpenCode 的 Go 說明文件包含一份各模型隱私表,而這正是Claude Haiku 5.5與目錄中大多數模型不同的一列。供應商自己的說法是零保留,但附帶例外。那份 Go 表上的多數模型顯示「0 天」。這一個則顯示「30 天」,並註明請求會依 Anthropic 的資料政策保留 30 天——與它對 GPT-6 Luna 和 GPT-5.6 Luna 的處理方式相同,而這與構成清單大部分的「零天」資料列正好相反。
對一個程式編寫代理而言,這表示提示詞、檔案路徑和貼上的原始碼可能會在上游供應商那裡停留一個月,而且所屬方案的宣傳用語還是「零保留」。這不是避開該模型的理由;而是去讀那一列,而不是讀宣傳橫幅的理由。與此同時,Anthropic 的發布素材中沒有任何內容改變 API 端的立場:Claude API 已提供零資料保留,而模型卡的保留條款才是規範直接整合的條款。
哪些已確認,哪些尚未確認
已確認的內容既龐大又具體,對這麼新的模型來說並不尋常。尚未確認的部分則較狹窄,值得直接點名,而非含糊帶過:
• 已確認 — 該模型存在,為僅限 API 提供,ID 為 claude-haiku-5-5,於 10 月 7 日在 Claude API 以及 Amazon Web Services、Google Cloud 和 Microsoft Azure 上推出,價格如上,具備 1M token 視窗、可調整的 effort,並附有已發布的系統卡。
• 已確認——兩個第三方平台在同一天就將其列出,附有模型 ID、端點以及計量額度。
• 未經證實——我們找不到任何獨立基準測試重現過該廠商的表格。Anthropic 發布文章中的每一項準確率數字,都來自 Anthropic 自家的測試框架;而每一則客戶引述,都是合作夥伴自行回報的早期測試結果。
• 未確認 — 沒有權重、沒有儲存庫、沒有檢查點,也沒有可檢視的授權。該模型是封閉的,任何關於其架構或規模的說法都只是推論。
• 尚未確認——平台的請求估算是否能在其假設的 token 設定檔以外也成立,以及 5 倍長上下文定價是否(或何時)會納入獨立排行榜的成本數字中。
將它與你已經稱作的東西並排執行
這次推出所帶出的實際問題,不是「Haiku 5.5 好不好」——廠商的表格說它好,而 Anthropic 以外沒有人查核過。問題是「帳單是多少,以及當便宜層級不是這通特定呼叫的正確層級時會發生什麼事」。這兩半都是路由問題。
在成本方面,計費表看的是詞元帳單,而不是標價:輸入量削減 90%,加上詞元化器大了 30%,再加上一個冗長的推理模型,再加上長上下文一次五倍的躍進,這意味著除非你測量自己的提示長度分布,否則你預測的數字和你實際支付的數字會出現分歧。一個在超過 100,000 個詞元之後貴上 5 倍的模型,會讓壓縮變得划算——而 Haiku 5.5 本身正是被定位為壓縮模型,這是個值得留意的循環。
就風險而言,未經實證的層級正是你不該把正式環境路徑押在它上面的情況。Claude Haiku 4.5 已經在 OrcaRouter 上,以 Anthropic 的定價提供,加成 0%,因此舊層級不需要新合約,而從新模型退回已知模型的路由只是設定變更,而非改寫。effort 參數是逐次呼叫設定的,這意味著同一個端點可以用低 effort 執行摘要、用高 effort 執行艱難的擷取,而不必維護兩套整合——路由 DSL正是為這類決策而存在,而自動容錯移轉正是讓你能在握有獨立數據之前,就把推出才幾天的模型放到真實流量前面的機制。尚未成真的是那件顯而易見的事:Claude Haiku 5.5今天並不在我們的路由中,如果你這週就想要它,你得直接呼叫 Anthropic,或透過發布它的那個平台。
誰該行動:用量以摘要、分類、壓縮與子代理工作為主的團隊,在 90% 級距適用、而分詞器的 30% 是你能吸收的算術時。誰該等待:提示經常超過 100,000 個 token 的人、需要在投入前看到獨立基準測試的人,以及程式碼無法待在 30 天保留視窗內的人。這次發布是真的,定價也是真的。但證據仍握在供應商手上。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
