
Claude Haiku 5.5 mot DeepSeek V4 Flash: Anthropic har just pressat priset under golvet
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
I två år hade marknadens billiga segment en form som alla kände till: de amerikanska labben tog mer betalt och de kinesiska labben tog mindre, och man valde sida därefter. Claude Haiku 5.5 bröt det den 7 oktober 2026 genom att lanseras till $0,10 per miljon indatatoken och $0,50 per miljon utdatatoken – vilket ligger under det publicerade priset för DeepSeek V4 Flash, modellen som har varit referenspunkten för billighet sedan i somras.
Det är en snävare vinst än det låter, och skälen är värda mer än rubriken. Anthropic-priset gäller bara för prompter upp till 100 000 tokens. Över det blir det 0,50 och 2,50 dollar, vilket är flera gånger DeepSeeks pris. Och DeepSeeks eget priskort har en form som ingen kopierar: det fördubblas under två tidsfönster på vardagar. Två leverantörer, två helt olika uppfattningar om vad "billig" betyder.
Vad varje leverantör faktiskt publicerar
Per miljon tokens, i amerikanska dollar. Siffrorna för Anthropic kommer från Anthropics prisdokumentation; siffrorna för DeepSeek kommer från DeepSeeks egen sida Models & Pricing, som är den auktoritativa prislistan för modellen.

• Indata — Claude Haiku 5.5 $0.10 upp till 100 000 token, $0.50 däröver. DeepSeek V4 Flash $0.15 under lågtrafik, $0.30 i högtrafikfönstren.
• Utdata — Claude Haiku 5.5 $0,50 upp till 100 000 tokens, $2,50 därutöver. DeepSeek V4 Flash $0,60 i lågtrafik, $1,20 i högtrafik.
• Cachad indata — Claude Haiku 5.5 $0,01 upp till 100 000 token och $0,05 däröver. DeepSeek V4 Flash $0,003 i lågtrafik och $0,006 i högtrafik, vilket är mer än tre gånger billigare.
• Toppfönster – Anthropic har inga; taxan ändras med promptlängden och inget annat. DeepSeek fördubblar taxan mellan 01:00 och 04:00 och igen mellan 06:00 och 10:00 UTC, måndag till fredag, med undantag för kinesiska allmänna helgdagar.
• Kontext och utdata — 1M tokens och 128 000 maximal utdata för Claude Haiku 5.5; 1M tokens och 384 000 maximal utdata för DeepSeek V4 Flash.
• Modalitet — Claude Haiku 5.5 hanterar text och bilder; DeepSeek V4 Flash är enbart text, och vision ligger hos syskonmodellen snarare än den här.
• Oberoende poäng – Artificial Analysis Intelligence Index v4.3.2 placerar Claude Haiku 5.5 (Max) på 43,40, tvåa av 182 modeller, och DeepSeek V4 Flash 0731 (Max) på 34,33, tia av 117.
• Hastighet — samma källa mäter 241,9 utdatatokens per sekund för Claude Haiku 5.5 och 222,0 för DeepSeek V4 Flash, näst snabbast på sin egen resultattavla.
Crossovern är hela historien
Ställ upp de två korten på en enda begäran och jämförelsen inverteras två gånger.
Under 100 000 tokens är Anthropic billigare på båda mätarna och på prislappen som spelar roll: $0,10 mot $0,15 in, $0,50 mot $0,60 ut. Det är första gången en liten Anthropic-modell har kommit in under en DeepSeek Flash-taxa på jämförbara villkor, och det är det faktum som lanseringsinlägget inleder med.
Vid över 100 000 tokens vänder det tvärt. Anthropics inputpris på 0,50 USD är mer än tre gånger DeepSeeks off-peak-pris, och outputpriset på 2,50 USD är mer än fyra gånger det. En pipeline för retrieval eller långa dokument som rutinmässigt sammanställer prompter på 150 000 tokens är inte alls en kund för Claude Haiku 5.5; den är en kund för modellen den redan använde.
Och i DeepSeeks två vardagsfönster smalnar den andra jämförelsen från andra hållet, eftersom DeepSeeks egen taxa fördubblas medan Anthropics inte rör sig. Ingen av leverantörernas strukturer är bättre i abstrakt mening. Den ena prissätter efter hur mycket du skickar, den andra efter när du skickar det, och bara en av dessa ligger under din kontroll vid förfrågningstillfället.
Vad en slutförd uppgift kostar, vilket är den enda rättvisa siffran
Listpriserna är per token, och de två modellerna genererar inte samma antal tokens för samma arbete. Det är där lanseringsaritmetiken blir obehaglig för Anthropic.
Artificial Analysis sätter Claude Haiku 5.5 (Max) till $0,21 per Intelligence-uppgift och DeepSeek V4 31 (Max) till $0,21 per uppgift. En tiondel av indatapriset, en Intelligence på 26 punkter – 43,40 mot 34,33 – och den uppmätta kostnaden för att få en uppgift utförd hamnar inom en cent från modellen den var tänkt att underbjuda.
Anledningen står på samma sida. Vid utvärderingen av Index genererade Claude Haiku 5.5 440 miljoner utdatatoken mot en median på 100 miljoner, och utvärderaren kallar den mycket ordrik. DeepSeek V4 Flash genererade 240 miljoner mot en median på 140 miljoner och kallas också mycket ordrik. Båda modellerna tänker länge, båda fakturerar tänkande som utdata, och utdata är mätaren som avgör fakturan. Den nittioprocentiga indataminskningen är verklig, och den debiteras på den mindre halvan av fakturan.
Det finns en andra, tystare effekt. Anthropics egen dokumentation säger att Claude Haiku 5.5 använder den nyare tokenizern som delas med Claude 4.7 och senare, så samma text räknas som ungefär 30 % fler token än den gjorde på Claude Haiku 4.5. Taxan föll med en faktor tio; antalet token föll inte alls, och för samma text ökade det.

Modellen bakom namnet DeepSeek ändrades också
Den som jämför dessa två utifrån en månader gammal benchmark-tabell bör känna till detta innan de gör det.
DeepSeek:s prissida listar nu deepseek-flash som modellnamn, med stöd av DeepSeek-V4.1-Flash, och anger att det äldre deepseek-v4-flash id:t fortfarande accepteras men att "motsvarande modeller har tagits ur bruk" — förfrågningar under det gamla namnet hanteras av den nyare modellen och debiteras enligt Flash-priset. Med andra ord behöll id:t sitt namn, sitt pris och sin plats i sortimentet, och vikterna under det flyttades.
Det är inte en kritik; det är en varning om vad en benchmarktabell är daterad till. Posten från Artificial Analysis som den här texten citerar gäller 0731-utgåvan av DeepSeek V4 Flash i dess Max-konfiguration, vilket är modellen som resultattavlan mätte, och det är inte automatiskt ett uttalande om vad som än svarar mot det id:t i dag. Anthropics Claude Haiku 5.5 är däremot ett fast id utan datumssuffix och utan alias, och dess Index-placering är daterad till dess egen lanseringsvecka.
Två modeller, en slutpunkt
Anledningen till att den här jämförelsen är lätt att avgöra själv i stället för på ett specifikationsblad är att båda sidorna kan anropas från samma plats – med ett undantag värt att nämna.
DeepSeek V4 Flash finns i OrcaRouter-katalogen idag, och automatisk failover ligger under den, så DeepSeek-delen av den här jämförelsen går att anropa hos oss i morse i stället för att bara läsa om. En varning som är värd att nämna snarare än att lämna åt dig att upptäcka på egen hand: vår egen listade taxa för den här modellen är 0,22 USD in och 0,66 USD ut per miljon token, vilket ligger över DeepSeeks off-peak-prislista och under dess peak-prislista. Betrakta DeepSeeks sida, inte vår, som auktoriteten för peak- och off-peak-strukturen, och vår som ett enda sammanvägt tal att starta en mätkörning mot. Claude Sonnet 5.5 och Claude Opus 5.5 finns också i katalogen. Så en A/B mellan ett DeepSeek Flash-ben och ett Claude-ben är en nyckel och en SDK, och routnings-DSL:en komponerar dem till ett enda anrop om eskaleringslogiken hör hemma i routen snarare än i applikationen.
Claude Haiku 5.5 finns ännu inte i katalogen. Det är ingen undanflykt – det betyder att Anthropic-sidan i den här jämförelsen för närvarande måste nås direkt hos Anthropic, medan DeepSeek-sidan inte behöver det. Om du vill ha den billiga nivån i DeepSeek-linjen på samma nyckel som resten av din stack idag, är den delen redan live.

Vilken ska man välja?
Om dina anrop är korta – klassificering, extrahering, routning, sammanfattning, subagent-turer – och de ryms under 100 000 tokens, är Claude Haiku 5.5 nu den billigare modellen på båda mätarna och den starkare på den oberoende resultattavlan, och argumentet är enkelt. Det är också den enda av de två som tar emot en bild.
Om dina anrop är långa, om du återsänder ett stort delat prefix, eller om du kan schemalägga, pekar kalkylen i motsatt riktning – och gör det med bred marginal: DeepSeeks cachade indata på 0,003 USD i lågtrafik ligger en storleksordning under Anthropics 0,01 USD, dess utdatatak är tre gånger högre, och dess lågtrafikrabatt är ett schemaläggningsproblem snarare än en produktbegränsning.
Vad lanseringen faktiskt fastställde är snävare än "Anthropic är billigt nu." Den fastställde att de amerikanska labben kommer att prissätta lägre än de kinesiska i fallet med korta prompter, och att fallet med korta prompter är där merparten av produktionstrafiken finns. Allt över 100 000 tokens är fortfarande den andra modellens marknad.
