
Claude Haiku 5.5 現已登陸 GitHub Copilot:最便宜的 Anthropic 模型在點數預算內要花多少成本
- Orca新Orca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 每百萬 tokens · 71 tok/s
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
Claude Haiku 5.5 於 2026 年 10 月 7 日出現在 GitHub Copilot 模型選擇器中——就在供應商發布它的同一天——而宣布此事的變更記錄條目,多數篇幅都花在平台面上。Visual Studio Code、Visual Studio、Copilot CLI、GitHub Copilot 雲端代理程式、Copilot 應用程式、github.com、iOS 與 Android 上的 GitHub Mobile、JetBrains IDE、Xcode、Eclipse。如果你掌握預算,真正要緊的那句話更短:該模型是「依供應商定價表中之價格,按用量計費」收費。在 Copilot 內,這代表 AI 點數,而 Claude Haiku 5.5 的費率低到讓點數計算成為這次發布中有趣的部分,而非事後才想到的事。本文會實際計算這些數字,區分 GitHub 實際展示的內容與僅僅宣稱的內容,並涵蓋該供應商自家文件中兩項例外條款,而這些是發布報導大多略過的。
GitHub 發布了什麼,以及發布給誰
這篇文章的標題直白地寫著「Claude Haiku 5.5 in GitHub Copilot」,並於10月7日太平洋時間13:12發布。Copilot Pro、Pro+、Max、Business 與 Enterprise 訂閱者皆可使用——也就是說,每個付費層級都能使用,而值得注意的是免費層級並不包括在內;在免費層級中,模型選擇仍由系統自動處理,而非由使用者自行選擇。這次推出是逐步進行的,因此你編輯器中的選擇器可能會比 changelog 晚幾天;這一點已在文章中說明,而不是留待你自己發現。
GitHub 自己對這個模型用途的界定值得仔細閱讀,因為它比廠商的界定更狹隘:
• 快速、高頻的大量工作——用 GitHub 自己的話說,就是子代理、快速編輯與終端機任務 • 並非定位為選單中大型模型的替代品,而是它們底下的低成本層級 • 根據 GitHub 的支援模型參考資料,已正式推出(GA),其中將 Claude Haiku 5.5 列為正式推出,狀態標示為 GA • 該參考資料中也列有一列 IDE 版本,標示為 TBD,這正是從編輯器端看來推出節奏顯得漸進的實際原因 • 在用量計費模式下採用供應商的定價表價格,而非 Copilot 專屬的加價 img src="2.png"> p>周邊的更新日誌日期提供了單一模型頁面無法呈現的節奏脈絡。Claude Sonnet 5.5 於 9 月 28 日登上 Copilot,Claude Opus 5.5 於 9 月 22 日,Claude Fable 5.1 則於 9 月 1 日。Anthropic 大約每兩到四週就推出一個 Copilot 整合,而 GitHub 則在幾天內完成每一個的處理。這樣的節奏也正是這件事有時限壓力的原因:GitHub 在 9 月中旬發布了一則淘汰通知,針對 10 月中旬的「特定 GitHub Copilot 模型」,接著在 10 月 2 日發布後續說明,確認這些移除。如果你的團隊在 Copilot 設定中固定使用某個模型,現在最可能出問題的是這個固定設定,而不是價格。

費率表,解讀為信用分類帳
Claude Haiku 5.5 採用兩種級別計費,切換依據是請求大小,而不是你所選擇的任何設定。以下全部都是 GitHub 自己公布的費率表,而且一律以每百萬個詞元計:
• 輸入在 100,000 個 token 以內或以下——$0.10 輸入、$0.01 快取輸入、$0.125 快取寫入、$0.50 輸出 • 輸入超過 100,000 個 token——$0.50 輸入、$0.05 快取輸入、$0.625 快取寫入、$2.50 輸出 • Claude Haiku 4.5,對照之下——$1.00 輸入、$0.10 快取輸入、$1.25 快取寫入、$5.00 輸出 • 再上一級的 Claude Sonnet 5.5——$2.00 輸入、$0.10 快取輸入、$2.50 快取寫入、$10.00 輸出 • 在 Anthropic 的模型上,快取寫入是額外計費的,加在快取輸入之上——這一項目並非選單中每個供應商都有img src="3.png"> p>把這些列擺在一起讀,會得出兩件事。第一,Claude Haiku 5.5 的短上下文級距,在輸入與輸出上都恰好比 Claude Haiku 4.5 便宜十倍,而在輸入上大約比 Claude Sonnet 5.5 便宜二十倍——這正是它適合放在子代理位置的原因,因為在那裡,一整批小型呼叫會把你每次呼叫所付的費用成倍放大。第二,長上下文級距在同樣的 100,000 個 token 分界線上,每一項費率都恰好是短上下文級距的五倍。一個 99,000 個 token 的請求和一個 101,000 個 token 的請求,在跨過那條線的 token 上並非相差 2%;它們在所有這些 token 上相差五倍。這個級距直接承襲自 Anthropic 的定價表,而 Copilot 的點數制度並不會把它抹平。

接下來是點數。Copilot 的使用量計費會將模型用量轉換為 AI 點數,費率為每點數 0.01 美元(有官方文件記載),而每項方案都包含每月的點數池:
• Copilot Pro,每月 $10 — 1,500 點數,標示為 1,000 基本加上 500 彈性 • Copilot Pro+,每月 $39 — 7,000 點數,標示為 3,900 基本加上 3,100 彈性 • Copilot Max,每月 $100 — 20,000 點數,標示為 10,000 基本加上 10,000 彈性 • Copilot Business,每席位每月 $19 — 每位使用者 1,900 點數 • Copilot Enterprise,每席位每月 $39 — 每位使用者 3,900 點數 • 組織與企業的點數池是跨席位共享,而非按使用者各自獨立 • 超出點數池的用量以每點數 $0.01 計費——同樣的換算,套用於超額部分 • 程式碼補全與下一編輯建議完全不在點數計費範圍內,在付費方案上仍維持無限使用 p>把這兩者放在一起,這次發布的輪廓就具體了起來。以一個中等規模的代理步驟為例——40,000 個輸入 token、2,000 個輸出 token,沒有快取。在 Claude Haiku 5.5 的短層級上,這是 40,000 乘以每百萬 $0.10,加上 2,000 乘以每百萬 $0.50,等於 $0.005,也就是按文件所載換算的半個點數。同樣的呼叫改以 Claude Haiku 4.5 的費率計算,則是 $0.05,也就是五個點數。這裡的算術是我們自己算的,不是 GitHub 的,但所有輸入都取自公開的價目表,而結論並不含糊:Pro 訂閱者的 1,500 點數池在新 Haiku 上大約可容納 3,000 次這樣的呼叫,而在舊版上大約只能容納 300 次。訂閱不變,點數池卻延長了十倍。
這就是誠實的價值主張,而它也伴隨誠實的但書:額度池是以點數而非美元計價,因此只要費率表一變,方案的實際上限就會跟著變動。如果你把流量分散在三個模型上,某個模型降價十倍,並不會讓額度池擴增十倍。
GitHub 說該模型會做什麼,以及它尚未展示什麼
這份變更日誌裡只有一項效能宣稱,而它在報導中承擔的份量已超出它所能負荷。GitHub 寫道,在早期測試中,Claude Haiku 5.5「在許多程式設計任務上與 Claude Sonnet 5 表現相當」,同時使用「明顯更少的 token 與步驟」。
請依序閱讀這些限定條件。這是早期測試。這是 GitHub 的測試、用 GitHub 的任務,而 GitHub 正是販售這項整合的一方。沒有指名任何測試框架,沒有公開任何任務集,句子前後兩半都沒有附上數字,而「許多」並不是一個數字。這項說法很可能為真——小型模型在狹隘、工具導向的程式編寫任務上與大型模型匹敵,在 2026 年是合理可能的結果——但就目前發布的內容而言,這是廠商的斷言,每次重複時都應該如此標明。「更少 token 與步驟」那一半是兩者中較為持久的,因為它是有關效率而非能力的說法,而在 Haiku 價位上的效率,一週內就會出現在你自己的用量遙測資料中。能力那一半則需要第三方測試框架,才能放進簡報裡。
Anthropic 自家公布的數字是與 GitHub 各自獨立的說法,並帶有同樣的來源出處問題。Anthropic 表示,Claude Haiku 5.5 的平均執行成本大約便宜 75%,而且先前送往 Haiku 等級模型的需求中,約有 90% 的 token 數低於 100,000,而這正是該模型「特別物超所值」的區間。這兩者都是供應商在描述自家產品的經濟效益。它們與已公布的價目表一致——短級距大幅降價,長級距降幅較小——而且它們作為供應商指引很有用,但不應視為實測結果。
啟用它是由管理員決定,而預設為是。
Copilot Business 與 Enterprise 買家在更新日誌中應該讀兩遍的部分,就是存取控制那一段。管理員透過 Copilot 設定中的模型原則來管理模型存取,而 GitHub 記載的預設行為是:除非管理員已關閉全域預設值,或明確停用該特定模型,否則新模型會自動啟用。預設是寬鬆的;限制採退出制。
隨之而來有兩個後果。如果你的組織有嚴格的模型治理,Claude Haiku 5.5 可能已經可以被你的開發人員選用,而沒有任何人事先按名稱核准它。反之,如果你的組織已經停用全域預設值,那麼無論變更記錄怎麼說,該模型都不會出現在你面前——這很可能就是任何 Copilot 模型推出首週最常見支援問題的解釋。在你針對選擇器項目遺失進行除錯之前,先檢查模型原則。
Anthropic 的文件說明了發布文章未提及的兩項例外。
這兩者都來自 Anthropic 的平台文件,而非任何媒體報導,而且兩者影響的是你能打造什麼,而不是你要付多少錢:
• Priority Tier 不適用於 Claude Haiku 5.5——Anthropic 的服務層級文件在其明確排除清單中列出該模型,與 Claude Sonnet 5.5、Claude Opus 5.5、Claude Fable 5.1 及 Mythos 系列並列。如果你的架構假設可在低成本層級上取得佈建輸送量,那麼這個假設在此並不成立。 • 標準定價下完整的 100 萬 token 上下文視窗,是授予「Claude 4.6 及後續模型(Claude Haiku 5.5 除外)」——這個括號是 Anthropic 自己加的,而 Claude Haiku 5.5 正是目前被排除在外的唯一現行模型。該視窗在模型的規格列中仍標示為 1M,最大輸出為 128,000 token;這項排除的意義是,你不應將全面性的長上下文定價保證解讀為適用於此模型。 • 分詞器已變更。Anthropic 表示,Claude 4.7 及後續模型使用較新的分詞器,對相同文字會產生約多 30% 的 token,這意味著每 token 價格與你的文字每頁價格朝相反方向變動。Claude Haiku 5.5 的規格列將其定位列為「Fastest」、自適應思考預設為 medium、知識截止日為 2026 年 6 月,以及模型 ID 為 claude-haiku-5-5。
對 GitHub 想讓這個模型瞄準的子代理與快速編輯工作負載來說,這些都不是決定性障礙。它們的差別在於引用的是發布貼文還是文件,而後者才是經得起負載測試考驗的東西。
如果你比較想將它路由,而不是切換工具
有一個合理的理由,讓你從自己的技術堆疊呼叫 Claude Haiku 5.5,而不是只透過聊天與編輯器訂閱:你能取得原始的短層級費率,中間不必經過點數轉換,而且能把路由決策保留在自己的程式碼裡。直白地說,供應情況是:Anthropic 透過 Claude Platform,以及 Amazon Bedrock、Vertex AI 和 Microsoft Azure 販售它——而它尚未收錄在我們的目錄中。OrcaRouter 目前提供 Claude Haiku 4.5、Claude Sonnet 5.5、Claude Opus 5.5 和 Claude Fable 5.1,涵蓋的目錄略超過 200 個模型,而 Claude Haiku 5.5 並不在其中。目前若要用這個模型本身,請直接呼叫 Anthropic 或那三家雲端之一。

我們真正適合的位置,是它外圍的那一層。OrcaRouter 以零加價直接轉遞供應商的定價表價格,所以當供應商重新調整某個模型的價格——就像 Anthropic 對這個模型所做的那樣——新費率當天就在我們這邊上線,而不是等到一個計費週期之後。自動容錯移轉意味著出錯的廉價層級呼叫會落到可用的路由上,而不是讓請求失敗;對於會發出數千個小型呼叫的子代理機群來說,這比單一互動式工作階段更重要。而路由 DSL 的存在,正是為了應對這次發布所帶來的這類決策形態:把短篇、高流量的工作送到門檻以下最便宜的模型,並把長脈絡工作送到門檻以上最便宜的模型,全部從同一個端點、同一份帳單處理,而不是把這種拆分編碼進兩套整合之中。如果 Haiku 5.5 出現在型錄中,它無須修改程式碼就能套入該策略。
在下一個 Sprint 之前,該如何處理這個?
狹義的解讀是:Anthropic 目前最便宜的模型,現在已可在每一個付費 Copilot 方案層級中選用,而且每 token 大約比它在短方案層級所取代的 Haiku 便宜十倍。如果你的團隊正透過 Copilot 執行子代理或終端機形式的自動化,那麼切換模型只是一項設定變更,卻會對每月點數池能撐多久產生巨大且立即的影響。
首先值得檢查的兩件事,正是那份公告悄悄埋起來的細節。看看你請求大小的第 95 百分位數:如果它落在 100,000 個 token 以上,你實際被計費的級距就是第二級,而所謂的十倍比較其實只有五倍。另外也看看貴組織的模型政策是否已開啟全域預設值——對 Business 和 Enterprise 席位而言,光是這項設定就決定了你的開發人員究竟能不能用到這次發布的功能。
