
Claude Haiku 5.5 vs DeepSeek V4 Flash:Anthropic 剛剛砍破價格底線
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
兩年來,市場中的低價層級有著人盡皆知的格局:美國實驗室收費較高,中國實驗室收費較低,而你會據此選擇靠向哪一邊。Claude Haiku 5.5在 2026 年 10 月 7 日打破了這個格局,以每百萬輸入詞元 0.10 美元、每百萬輸出詞元 0.50 美元的價格推出——這個價格低於DeepSeek V4 Flash的公開費率,而這款模型自夏季以來一直是低價的標竿
這是一場比乍聽之下更狹隘的勝利,而背後的原因比新聞標題更值得關注。Anthropic 的費率只適用於最多 100,000 個 token 的提示。超過之後就變成 $0.50 和 $2.50,是 DeepSeek 價格的好幾倍。而 DeepSeek 自家的價目表有一種無人仿效的形態:它在兩個平日的時段會翻倍。兩家供應商,對「便宜」的定義截然不同。
每個廠商實際上發布的內容
每百萬個 token,以美元計。Anthropic 的數據來自 Anthropic 的定價文件;DeepSeek 的數據則來自 DeepSeek 自家的 Models & Pricing 頁面,該頁面是此模型最具權威性的價目表。

• 輸入 — Claude Haiku 5.5:100,000 個 token 以內 $0.10,超過則為 $0.50。DeepSeek V4 Flash:離峰時段 $0.15,尖峰時段 $0.30。
• 輸出 — Claude Haiku 5.5:10 萬個 token 以內 $0.50,超過為 $2.50。DeepSeek V4 Flash:離峰時段 $0.60,尖峰時段 $1.20。
• 快取輸入 — Claude Haiku 5.5 每 100,000 個 token 以內 $0.01,超過則 $0.05。DeepSeek V4 Flash 離峰時段 $0.003,尖峰時段 $0.006,便宜超過三倍。
• 高峰時段 — Anthropic 沒有;費率僅隨提示長度變動,別無其他因素。DeepSeek 於 UTC 週一至週五 01:00 至 04:00,以及 06:00 至 10:00 之間,費率加倍;中國公眾假期除外。
• 上下文與輸出 — Claude Haiku 5.5 為 100 萬個 token 及 128,000 最大輸出;DeepSeek V4 Flash 為 100 萬個 token 及 384,000 最大輸出。
• 模態 — Claude Haiku 5.5 接受文字與圖像;DeepSeek V4 Flash 僅支援文字,而視覺功能位於同系列的另一個模型上,而非此模型。
• 獨立評分 — Artificial Analysis Intelligence Index v4.3.2 將 Claude Haiku 5.5 (Max) 評為 43.40,在 182 個模型中排名第二;DeepSeek V4 Flash 0731 (Max) 則為 34.33,在 117 個模型中排名第十。
• 速度——同一來源測得 Claude Haiku 5.5 每秒輸出 241.9 個 token,DeepSeek V4 Flash 則為 222.0 個,在自家排行榜上排名第二快。
跨界就是整個故事
把兩張卡片並排在同一筆請求上,比較結果就會反轉兩次。
在 100,000 個 token 以下,Anthropic 在兩項計費指標與真正重要的標價上都更便宜:輸入 $0.10 對上 $0.15,輸出 $0.50 對上 $0.60。這是 Anthropic 的小型模型首次在同等基準下低於 DeepSeek Flash 的費率,而這正是那篇發布文章開頭所強調的事實。
超過 100,000 個 token 之後,情勢會急遽逆轉。Anthropic 的 $0.50 輸入價格是 DeepSeek 離峰費率的三倍以上,而 $2.50 的輸出價格則是其四倍以上。一條例行組裝 150,000 個 token 提示的檢索或長文件管線,根本不是 Claude Haiku 5.5 的客戶;它會是它原本就在使用的那個模型的客戶。
而在 DeepSeek 的兩個平日時段中,第二項比較則從另一個方向收窄,因為 DeepSeek 自身的費率翻倍,而 Anthropic 的費率則紋絲不動。抽象來看,兩家廠商的定價結構並沒有孰優孰劣。一家依你傳送多少來計價,另一家依你何時傳送來計價,而其中只有一項是你在發出請求時能掌控的。
什麼是已完成的任務,這是唯一公平的
牌價費率是以 token 計算的,而這兩個模型在處理相同工作時,輸出的 token 數量並不相同。這正是對 Anthropic 來說,發布算術開始令人棘手的地方。
Artificial Analysis 將 Claude Haiku 5.5 (Max) 的價格定為每項 Intelligence Index 任務 $0.21,並將 DeepSeek V4 Flash 0731 (Max) 定為每項任務 $0.22。輸入費率只有十分之一、視窗更寬,且 Intelligence Index 差距達 26 分——43.40 對上 34.33——但完成一項任務的實測成本,卻與它原本應該要壓低價格的模型相差不到一美分。
原因就在同一頁。在評估 Index 時,Claude Haiku 5.5 生成了 4.4 億個輸出 token,而中位數是 1 億,評估者稱它非常冗長。DeepSeek V4 Flash 生成了 2.4 億個,而中位數是 1.4 億,也被稱為非常冗長。這兩個模型都會長時間思考,兩者都把思考計為輸出,而輸出是決定帳單的計量依據。九成的輸入削減是真的,而它是計在帳單中較小的那一半。
還有第二種較不明顯的影響。Anthropic 自家的文件指出,Claude Haiku 5.5 使用與 Claude 4.7 及後續版本共用的較新分詞器,因此同一段文字所計入的 token 數,會比在 Claude Haiku 4.5 上大約多 30%。費率降至原來的十分之一;但 token 數完全沒有減少,而且在相同文字上還增加了。

DeepSeek 這個名字背後的模型也變了
任何憑著幾個月前的基準測試表來比較這兩者的人,都應該在這麼做之前先知道這件事。
DeepSeek 的定價頁面現在列出deepseek-flash作為模型名稱,背後由 DeepSeek-V4.1-Flash 支援,並表示舊有的deepseek-v4-flash識別碼仍可接受,但「對應的模型已經退役」——使用舊名稱的請求會由較新的模型提供服務,並以 Flash 的價格計費。換句話說,這個識別碼保留了它的名稱、價格以及在產品陣容中的位置,而它底下的權重已經更換了。
這不是批評;而是在警告:基準表所標註的日期究竟指向什麼。本文引用的 Artificial Analysis 條目,是針對 DeepSeek V4 Flash 在 Max 配置下的 0731 發布版,也就是他們所測量的那個模型;而這並不自動等同於對今天任何以該 id 回應者所做的陳述。相較之下,Anthropic 的 Claude Haiku 5.5 則是固定 id,沒有日期後綴,也沒有別名,而它在 Index 中的排名是按其自身發布當週來標註日期。
兩個模型,一個端點
這個比較之所以容易由你自己判斷,而不用只靠規格表來定論,是因為兩邊都能從同一個地方呼叫——不過有一個值得指出的例外。
DeepSeek V4 Flash 今天已在 OrcaRouter 目錄上,而且自動容錯移轉就位於其底層,所以這項比較中的 DeepSeek 這一段,我們今天早上就能直接呼叫,而不是只能閱讀相關資訊。有一點值得先講明,而不是留給你自己去發現:我們自己列出的這款模型費率是每百萬 token 輸入 $0.22、輸出 $0.66,這個數字高於 DeepSeek 的離峰價目,但低於其尖峰價目。請以 DeepSeek 的頁面、而非我們的頁面,作為尖峰與離峰結構的權威依據,並把我們的數字當成一個混合後的單一數字,用來啟動一輪計量測試。Claude Sonnet 5.5 與 Claude Opus 5.5 也都在目錄上。因此,在 DeepSeek Flash 這一段與 Claude 這一段之間做 A/B 測試,只需要一把金鑰和一套 SDK,而若升級邏輯屬於路由而非應用程式,路由 DSL 就會將它們組合成單一次呼叫。
Claude Haiku 5.5 尚未列入型錄。這不是模稜兩可的說法——這表示在這項比較中,Anthropic 那一方目前必須直接向 Anthropic 取得,而 DeepSeek 那一方則不必。如果你想在今天就用同一組金鑰,把 DeepSeek 系列的低價方案與你技術堆疊的其他部分一起使用,那部分已經上線。

該選哪一個
如果你的呼叫很短——分類、擷取、路由、摘要、子代理回合——而且落在 100,000 個 token 以內,那麼 Claude Haiku 5.5 現在在兩種計價標準上都更便宜,在獨立評測排行榜上也更強,理由再清楚不過。它也是這兩者中唯一能接受圖片的一個。
如果你的呼叫很長,如果你重新傳送大量共用前綴,或者你能夠自行安排時段,那麼計算結果會倒向另一邊,而且差距懸殊:DeepSeek 在離峰時段的快取輸入價格為 $0.003,比 Anthropic 的 $0.01 低了一個數量級,其輸出上限高出三倍,而且它的離峰折扣是排程問題,而不是產品限制。
這次發布真正確立的,比「Anthropic 現在很便宜」還要狹窄。它確立的是:美國實驗室在短提示情境下的定價會低於中國實驗室,而短提示情境正是大多數正式環境流量所在。至於超過 100,000 個 token 的部分,依然是另一款模型的市場。
