一張為「美國小型模型現在更便宜」生成的英雄卡片,帶有「PRICE FLOOR」徽章,眉題為「OCTOBER 7 2026」,副標題為「Claude Haiku 5.5 以 $0.10 和 $0.50 對上 DeepSeek V4 Flash——直到 100,000 個 token」。四個標籤寫著「$0.10 對 $0.15 輸入」、「$0.50 對 $0.60 輸出」、「100K 級距」和「尖峰時段」。下方兩張卡片分別標示為「UNDER 100,000 TOKENS」(「Anthropic 在兩項計費上都更便宜」)與「ABOVE IT」(「DeepSeek 便宜三到四倍」)。頁腳寫著「Vendors」公布的定價表,讀取日期為 2026 年 10 月 8 日。OrcaRouter 標誌合成於右下角。
Guides & Insights

Claude Haiku 5.5 vs DeepSeek V4 Flash:Anthropic 剛剛砍破價格底線

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

兩年來,市場中的低價層級有著人盡皆知的格局:美國實驗室收費較高,中國實驗室收費較低,而你會據此選擇靠向哪一邊。Claude Haiku 5.5在 2026 年 10 月 7 日打破了這個格局,以每百萬輸入詞元 0.10 美元、每百萬輸出詞元 0.50 美元的價格推出——這個價格低於DeepSeek V4 Flash的公開費率,而這款模型自夏季以來一直是低價的標竿

這是一場比乍聽之下更狹隘的勝利,而背後的原因比新聞標題更值得關注。Anthropic 的費率只適用於最多 100,000 個 token 的提示。超過之後就變成 $0.50 和 $2.50,是 DeepSeek 價格的好幾倍。而 DeepSeek 自家的價目表有一種無人仿效的形態:它在兩個平日的時段會翻倍。兩家供應商,對「便宜」的定義截然不同。

每個廠商實際上發布的內容

每百萬個 token,以美元計。Anthropic 的數據來自 Anthropic 的定價文件;DeepSeek 的數據則來自 DeepSeek 自家的 Models & Pricing 頁面,該頁面是此模型最具權威性的價目表。

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• 輸入 — Claude Haiku 5.5:100,000 個 token 以內 $0.10,超過則為 $0.50。DeepSeek V4 Flash:離峰時段 $0.15,尖峰時段 $0.30。

• 輸出 — Claude Haiku 5.5:10 萬個 token 以內 $0.50,超過為 $2.50。DeepSeek V4 Flash:離峰時段 $0.60,尖峰時段 $1.20。

• 快取輸入 — Claude Haiku 5.5 每 100,000 個 token 以內 $0.01,超過則 $0.05。DeepSeek V4 Flash 離峰時段 $0.003,尖峰時段 $0.006,便宜超過三倍。

• 高峰時段 — Ant​hropic 沒有;費率僅隨提示長度變動,別無其他因素。Dee​pSeek 於 UTC 週一至週五 01:00 至 04:00,以及 06:00 至 10:00 之間,費率加倍;中國公眾假期除外。

• 上下文與輸出 — Claude Haiku 5.5 為 100 萬個 token 及 128,000 最大輸出;DeepSeek V4 Flash 為 100 萬個 token 及 384,000 最大輸出。

• 模態 — Claude Haiku 5.5 接受文字與圖像;DeepSeek V4 Flash 僅支援文字,而視覺功能位於同系列的另一個模型上,而非此模型。

• 獨立評分 — Artificial Analysis Intelligence Index v4.3.2 將 Claude Haiku 5.5 (Max) 評為 43.40,在 182 個模型中排名第二;DeepSeek V4 Flash 0731 (Max) 則為 34.33,在 117 個模型中排名第十。

• 速度——同一來源測得 Claude Haiku 5.5 每秒輸出 241.9 個 token,DeepSeek V4 Flash 則為 222.0 個,在自家排行榜上排名第二快。

跨界就是整個故事

把兩張卡片並排在同一筆請求上,比較結果就會反轉兩次。

在 100,000 個 token 以下,Ant​hropic 在兩項計費指標與真正重要的標價上都更便宜:輸入 $0.10 對上 $0.15,輸出 $0.50 對上 $0.60。這是 Ant​hropic 的小型模型首次在同等基準下低於 Dee​pSeek Flash 的費率,而這正是那篇發布文章開頭所強調的事實。

超過 100,000 個 token 之後,情勢會急遽逆轉。Anthropic 的 $0.50 輸入價格是 DeepSeek 離峰費率的三倍以上,而 $2.50 的輸出價格則是其四倍以上。一條例行組裝 150,000 個 token 提示的檢索或長文件管線,根本不是 Claude Haiku 5.5 的客戶;它會是它原本就在使用的那個模型的客戶。

而在 DeepSeek 的兩個平日時段中,第二項比較則從另一個方向收窄,因為 DeepSeek 自身的費率翻倍,而 Anthropic 的費率則紋絲不動。抽象來看,兩家廠商的定價結構並沒有孰優孰劣。一家依你傳送多少來計價,另一家依你何時傳送來計價,而其中只有一項是你在發出請求時能掌控的。

什麼是已完成的任務,這是唯一公平的

牌價費率是以 token 計算的,而這兩個模型在處理相同工作時,輸出的 token 數量並不相同。這正是對 Ant​hropic 來說,發布算術開始令人棘手的地方。

Artificial Analysis 將 Claude Haiku 5.5 (Max) 的價格定為每項 Intelligence Index 任務 $0.21,並將 DeepSeek V4 Flash 0731 (Max) 定為每項任務 $0.22。輸入費率只有十分之一、視窗更寬,且 Intelligence Index 差距達 26 分——43.40 對上 34.33——但完成一項任務的實測成本,卻與它原本應該要壓低價格的模型相差不到一美分。

原因就在同一頁。在評估 Index 時,Claude Haiku 5.5 生成了 4.4 億個輸出 token,而中位數是 1 億,評估者稱它非常冗長。DeepSeek V4 Flash 生成了 2.4 億個,而中位數是 1.4 億,也被稱為非常冗長。這兩個模型都會長時間思考,兩者都把思考計為輸出,而輸出是決定帳單的計量依據。九成的輸入削減是真的,而它是計在帳單中較小的那一半。

還有第二種較不明顯的影響。Ant​hropic 自家的文件指出,Claude Haiku 5.5 使用與 Claude 4.7 及後續版本共用的較新分詞器,因此同一段文字所計入的 token 數,會比在 Claude Haiku 4.5 上大約多 30%。費率降至原來的十分之一;但 token 數完全沒有減少,而且在相同文字上還增加了。

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Dee​pSeek 這個名字背後的模型也變了

任何憑著幾個月前的基準測試表來比較這兩者的人,都應該在這麼做之前先知道這件事。

DeepSeek 的定價頁面現在列出deepseek-flash作為模型名稱,背後由 DeepSeek-V4.1-Flash 支援,並表示舊有的deepseek-v4-flash識別碼仍可接受,但「對應的模型已經退役」——使用舊名稱的請求會由較新的模型提供服務,並以 Flash 的價格計費。換句話說,這個識別碼保留了它的名稱、價格以及在產品陣容中的位置,而它底下的權重已經更換了。

這不是批評;而是在警告:基準表所標註的日期究竟指向什麼。本文引用的 Artificial Analysis 條目,是針對 DeepSeek V4 Flash 在 Max 配置下的 0731 發布版,也就是他們所測量的那個模型;而這並不自動等同於對今天任何以該 id 回應者所做的陳述。相較之下,Anthropic 的 Claude Haiku 5.5 則是固定 id,沒有日期後綴,也沒有別名,而它在 Index 中的排名是按其自身發布當週來標註日期。

兩個模型,一個端點

這個比較之所以容易由你自己判斷,而不用只靠規格表來定論,是因為兩邊都能從同一個地方呼叫——不過有一個值得指出的例外。

DeepSeek V4 Flash 今天已在 OrcaRouter 目錄上,而且自動容錯移轉就位於其底層,所以這項比較中的 DeepSeek 這一段,我們今天早上就能直接呼叫,而不是只能閱讀相關資訊。有一點值得先講明,而不是留給你自己去發現:我們自己列出的這款模型費率是每百萬 token 輸入 $0.22、輸出 $0.66,這個數字高於 DeepSeek 的離峰價目,但低於其尖峰價目。請以 DeepSeek 的頁面、而非我們的頁面,作為尖峰與離峰結構的權威依據,並把我們的數字當成一個混合後的單一數字,用來啟動一輪計量測試。Claude Sonnet 5.5 與 Claude Opus 5.5 也都在目錄上。因此,在 DeepSeek Flash 這一段與 Claude 這一段之間做 A/B 測試,只需要一把金鑰和一套 SDK,而若升級邏輯屬於路由而非應用程式,路由 DSL 就會將它們組合成單一次呼叫。

Claude Haiku 5.5 尚未列入型錄。這不是模稜兩可的說法——這表示在這項比較中,Anthropic 那一方目前必須直接向 Anthropic 取得,而 DeepSeek 那一方則不必。如果你想在今天就用同一組金鑰,把 DeepSeek 系列的低價方案與你技術堆疊的其他部分一起使用,那部分已經上線。

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

該選哪一個

如果你的呼叫很短——分類、擷取、路由、摘要、子代理回合——而且落在 100,000 個 token 以內,那麼 Claude Haiku 5.5 現在在兩種計價標準上都更便宜,在獨立評測排行榜上也更強,理由再清楚不過。它也是這兩者中唯一能接受圖片的一個。

如果你的呼叫很長,如果你重新傳送大量共用前綴,或者你能夠自行安排時段,那麼計算結果會倒向另一邊,而且差距懸殊:Dee​pSeek 在離峰時段的快取輸入價格為 $0.003,比 Ant​hropic 的 $0.01 低了一個數量級,其輸出上限高出三倍,而且它的離峰折扣是排程問題,而不是產品限制。

這次發布真正確立的,比「Ant​hropic 現在很便宜」還要狹窄。它確立的是:美國實驗室在短提示情境下的定價會低於中國實驗室,而短提示情境正是大多數正式環境流量所在。至於超過 100,000 個 token 的部分,依然是另一款模型的市場。