Claude Haiku 5.5 的主視覺標題卡,標題為「Anthropic 表示最便宜的層級即將推出」,附有三個膠囊標籤,分別寫著「已宣布,未定日期」、「尚未發布」和「未公布規格」,底部一行文字引用 Anthropic 於 2026 年 9 月 22 日發布的 Opus 5.5 上市文章,右下角則有 OrcaRouter 標誌。
Guides & Insights

Claude Haiku 5.5:Anthropic 稱最便宜等級即將推出,數週前洩密消息才稱其已胎死腹中

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

在九月的約兩週時間裡,追蹤該廠商產品藍圖的人普遍抱持的運作假設是:最便宜的 Claude 方案即將退役。這項外洩消息——來自 X 上一則由以爆料該廠商藍圖聞名的帳號所發的貼文——指出 5.5 世代將重整產品陣容:Claude FableClaude OpusClaude Sonnet 都會推出 5.5 版本,Fable 將轉移到新的預訓練基礎,而 Haiku 系列則會退場。該公司從未證實其中任何一點。接著在 2026 年 9 月 22 日,隨著Claude Opus 5.5的推出,該公司以一句話說明了相反的情況:「Claude Sonnet 5.5 與 Claude Haiku 5.5 將在接下來幾週內跟進。」Claude Haiku 5.5因此已被宣布、尚未定出日期,也尚未推出——而它之所以存在,正是因為關於它的傳言是錯的。目前仍在出貨的小型模型Claude Haiku 4.5,依舊是你今天會實際使用的那一個。

以下是實際已確立的事實、推論,以及目前仍無人知道的部分。這裡這種區分比平常更重要,因為流傳中關於 Haiku 5.5 的大部分內容,都是從其上一層級推斷而來。

實際上已確認的是什麼,又是由誰確認的?

已確認的集合很小,而讓它保持精簡是值得的。

A single-column scoreboard for Claude Haiku 5.5 with six rows reading 'Status: announced, undated', "Release window: 'coming weeks'", 'Price: not announced', 'Context window: not announced', 'Model ID: not announced' and 'Predecessor: Claude Haiku 4.5 at $1 / $5', with a footer noting the announcement came from Anthropic on 2026-09-22 with no specifications published.

• 這則公告——Anthropic 自家為 Claude Opus 5.5 發布的貼文——寫道:「Claude Sonnet 5.5 與 Claude Haiku 5.5 將在接下來幾週內推出。」直接證據就僅止於此。它只是他人發布貼文中的一句話,並不是 Haiku 5.5 的公告。

• 承諾的範圍——同一篇文章指出,這兩款模型將帶來與 Claude Opus 5「在效能、效率與安全上許多相同的改進」。那是一份分類清單,不是規格。沒有基準測試、沒有價格、沒有上下文視窗、沒有模型 ID、沒有日期。

• 層級定位——Haiku 是 Anthropic 目前三個層級中最快、最便宜的一款,位在 Sonnet 和 Opus 之下。自該系列問世以來始終如此,這點並無爭議。

• 時程——「未來幾週」,這把最早可能的到來時間放在 2026 年 9 月下旬或 10 月,而對最晚時間則隻字未提。

其他所有流傳中的內容,要嘛是爆料者的說法——Anthropic 並未認可,且該公告在核心論點上與之矛盾——要嘛是從 Claude Opus 5.5 推導出的推論。兩者都應視為未經證實。

Screenshot of Anthropic's Claude Platform model overview page, showing the Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 and Claude Haiku 4.5 comparison table alongside the line 'Claude Sonnet 5.5 and Claude Haiku 5.5 will follow in the coming weeks.'

具體來說,那則謠言,以及它為何顯得可信

退出說法並不愚蠢。它有其真實根據,而理解這點能讓你明白 Anthropic 的小型層級一直以來是如何被對待的。

Claude Haiku 4.5 於 2025 年 10 月 15 日推出,每百萬個輸入 token 為 1 美元、每百萬個輸出 token 為 5 美元,具備 200K token 的上下文視窗與 64K 輸出上限。它是產品陣容中最快的模型,且價格遠低於其他模型,並被定位為在程式設計與代理任務上可媲美較舊世代的 Sonnet,而成本約僅為其三分之一。

接著,這個層級沉寂了下來。從 2025 年 10 月的 Haiku 4.5 到 2026 年 9 月 Opus 5.5 發布之間——整整十一個月——Claude 其他每個層級都至少更迭了兩次。Opus 從 4.5、4.6、4.7、4.8、5 一路走到 5.5。Sonnet 從 4.5、4.6 到 5。Fable 則以全新的頂層層級之姿登場。Haiku 卻完全文風不動。在同一段期間內,Anthropic 對 Haiku 4.5 的退役承諾順延為「不早於 2026 年 10 月 15 日」——截至本文撰寫時,這個日期大約還有三週。

一個過去大約每六個月就會更新一次的層級,出現了長達十一個月的空窗,再加上退役倒數即將歸零,這正是一條產品線走向退場時會呈現的樣貌。那正是這份外洩消息所讀出的意思。那是個合理的解讀。但它也錯了,而更正來自廠商,而不是來自第二位爆料者。

Haiku 5.5 幾乎肯定會從 Claude Opus 5.5 繼承什麼

本節屬於推論。之所以如此標示,是因為 Anthropic 並未證實其中任何內容,也因為與上一層級的類比是唯一可得的訊號來源。

Anthropic 承諾的「許多同樣的改進」提供了一份起始清單。Claude Opus 5.5 推出時具備四項特性,可供讀者拿來對照目前的小型模型:

• 價格走向——Claude Opus 5.5 為每百萬 $4 輸入/$20 輸出,低於 Claude Opus 5 的 $5/$25,快取讀取費用也從 $0.50 降至 $0.20。旗艦款降價 20%,使小型方案跟進同等降幅顯得合理。這並非承諾,公告中也沒有任何相關說法。

• 自適應思考 — Claude Opus 5.5 不接受thinking: {"type": "disabled"}或固定的budget_tokens;兩者都會回傳 400。思考一律保持開啟,並以 effort 作為控制項。今日的 Claude Haiku 4.5 則恰恰相反:它使用較舊的手動{"type": "enabled", "budget_tokens": N}形式,而且完全沒有 effort 參數。

• 上下文視窗 — Claude Opus 5.5 維持 100 萬 token 的上下文,最大輸出為 128K。Claude Haiku 4.5 則是 200K,輸出為 64K。躍升至 100 萬是唯一最足以改變小型層級適用範圍的重大變革,而且也是任何人都不該預設會發生的事。

• 防護措施 — Claude Opus 5.5 可在更廣泛的類別集合中傳回拒絕停止原因,其中生物學相關請求會轉交由 Claude Opus 5 處理,而大多數資安請求則轉交給 Claude Opus 4.8。小型層級究竟是繼承同一組分類器,還是採用較輕量的一組,目前仍不得而知。

如果你正打算基於「Haiku 5.5 是更便宜、上下文視窗更小的 Claude Opus 5.5」這個假設來規劃遷移,那你是在憑一個類比做規劃。這個類比是目前最好的,但它不是證據。

為什麼分級比旗艦更重要

旗艦級發布能搏得版面,小模型卻拿下實際流量,這種錯配值得被點名。

Claude Haiku 4.5 正是運行在那些每天要進行數十萬次模型呼叫、而每個詞元的價格就足以左右整個產品決策的地方:分類、擷取、路由、摘要、串聯式流程中低成本的第一輪處理,以及代替昂貴模型去讀取檔案的子代理。Anthropic 自己對它的定位是具備近乎前沿智慧的最快模型,而延遲表現也印證了這一點——獨立量測顯示,它的輸出速度約為每秒 86 個詞元,首詞元時間為 0.65 秒,兩項數據都優於同價位帶中非推理模型的中位數。

相較之下,Haiku 4.5 並非前沿模型,也不假裝自己是。它在 Artificial Analysis Intelligence Index 的獨立得分是 15,在該榜單 61 個模型中排名第 28,並被標示為估計值。正是這個數字讓 5.5 更新顯得有趣而非例行公事:如果小尺寸層級能取得類似 Claude Opus 5.5 所跨出的能力躍進,就會移動高流量工作的價格效能底線,而許多生產管線正是建立在這個底線上。

對今天的讀者來說,實際的問題不是要不要等,而是等待要付出什麼代價。如果你正在以 Haiku 4.5 為基礎開發,那十一個月的空窗期已經回答了這個層級是否穩定到足以依賴——供應商才剛告訴你,是的。如果你為了 Haiku 5.5 而擱置移轉,那你是在為一個沒有定案日期、也沒有公布規格的模型而延後,這比先以現有版本推出、等新模型問世再轉換,處境更糟。

執行你擁有的小型層級,緊鄰其上方那些層級。

Screenshot of the OrcaRouter model page for Claude Haiku 4.5 (anthropic/claude-haiku-4.5), showing the model header, the attribution 'by Anthropic - 2025-10-15', pricing of $1.00 per million input tokens and $5.00 per million output tokens, and a 200K context window.

從路由的視角、而非模型審查的視角來看,Haiku 的更新之所以值得關注,是因為真正有趣的決策很少是要用哪個模型——而是要針對哪一次呼叫使用哪個模型。把簡單的 80% 交給小模型、其餘再升級處理的串接式流程,是標準的成本策略,而唯有兩個層級都能從同一個地方、用同一組憑證觸及,這個策略才行得通。

Claude Haiku 4.5 已經以 Anthropic 的定價在 OrcaRouter 上提供,Claude Opus 5 和 Claude Sonnet 5 也一樣——三個模型共用一組 API 金鑰,而且0% 加成,意思是直接沿用供應商的定價,而非額外加價。當供應商降價時,我們這邊當天就會同步生效,這點在你呼叫一百萬次的那個層級上,比只呼叫一百次的那個層級更為重要。就級聯(cascade)而言,路由 DSL讓你能將各層級組合成單一次呼叫,使升級邏輯存在於路由之中,而非你的應用程式裡,而自動容錯移轉意味著某家供應商一個下午出狀況,也不會連帶拖垮整條管線。

兩點必須誠實說明。Claude Opus 5.5 本身並不在 OrcaRouter 上——最新的等級不一定就是最新的路由,而我們寧可如實說出這點,也不願暗示相反的情況。另外,Haiku 5.5 完全無法被路由,因為它還不存在。目前可呼叫的模型,就是上方所列出的那些。

依序需留意的事項

當 Haiku 5.5 真的到來時,四項事實將能解答幾乎所有懸而未決的問題,而它們會以可預測的順序出現。

• 來自 Anthropic 模型總覽頁面的模型 ID 與上下文視窗——採用 claude-haiku-5-5 這種不帶日期格式的 ID,會符合 4.6 世代以後的慣例,而 1M 詞元(token)的視窗則會是最大亮點。

• 價目表。這個層級存在的全部理由就是它的價格。高於 $1/$5 的數字會是一次重新定位;等於或低於它的數字則是直接的改善。

• 思考是否僅限自適應模式。如果 Haiku 5.5 像 Claude Opus 5.5 那樣拒絕 budget_tokens,那對所有目前有設定此參數的整合來說都是破壞性變更,而且這種問題只有在實際執行時才會顯現。

• 獨立分數。該層級的廠商基準測試,歷來相對於獨立評測機構所測得的結果都偏寬鬆,因此首次登上 Artificial Analysis 的排名,比發布時公布的表格更有價值。

在那些成真之前,準確的說法其實很無聊:Anthropic 已表示 Claude Haiku 5.5 會在接下來幾週推出,但沒說它是什麼,而那個聲稱它已被取消的爆料是錯的。最後那一點才是新聞。其餘的一切都只是時程。

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新