Ett genererat hjältekort för 'Den amerikanska lilla modellen är nu den billigare', märkt 'PRISGOLV' med överrubriken '7 OKTOBER 2026' och underrubriken 'Claude Haiku 5.5 till $0.10 och $0.50 mot DeepSeek V4 Flash – fram till 100 000 tokens.' Fyra chips visar '$0.10 vs $0.15 in', '$0.50 vs $0.60 ut', '100K steg' och 'toppfönster'. Två kort nedan är märkta 'UNDER 100 000 TOKENS' ('Anthropic är billigare på båda mätarna') och 'ÖVER DET' ('DeepSeek är tre till fyra gånger billigare'). En sidfot lyder 'Tillverkarnas publicerade listpriser avlästa 8 oktober 2026.' OrcaRouter-logotypen är inlagd i nedre högra hörnet.
Guides & Insights

Claude Haiku 5.5 mot DeepSeek V4 Flash: Anthropic har just pressat priset under golvet

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

I två år hade marknadens billiga segment en form som alla kände till: de amerikanska labben tog mer betalt och de kinesiska labben tog mindre, och man valde sida därefter. Claude Haiku 5.5 bröt det den 7 oktober 2026 genom att lanseras till $0,10 per miljon indatatoken och $0,50 per miljon utdatatoken – vilket ligger under det publicerade priset för DeepSeek V4 Flash, modellen som har varit referenspunkten för billighet sedan i somras.

Det är en snävare vinst än det låter, och skälen är värda mer än rubriken. Ant​hropic-priset gäller bara för prompter upp till 100 000 tokens. Över det blir det 0,50 och 2,50 dollar, vilket är flera gånger Dee​pSeeks pris. Och Dee​pSeeks eget priskort har en form som ingen kopierar: det fördubblas under två tidsfönster på vardagar. Två leverantörer, två helt olika uppfattningar om vad "billig" betyder.

Vad varje leverantör faktiskt publicerar

Per miljon tokens, i amerikanska dollar. Siffrorna för Anthropic kommer från Anthropics prisdokumentation; siffrorna för DeepSeek kommer från DeepSeeks egen sida Models & Pricing, som är den auktoritativa prislistan för modellen.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Indata — Claude Haiku 5.5 $0.10 upp till 100 000 token, $0.50 däröver. DeepSeek V4 Flash $0.15 under lågtrafik, $0.30 i högtrafikfönstren.

• Utdata — Claude Haiku 5.5 $0,50 upp till 100 000 tokens, $2,50 därutöver. DeepSeek V4 Flash $0,60 i lågtrafik, $1,20 i högtrafik.

• Cachad indata — Claude Haiku 5.5 $0,01 upp till 100 000 token och $0,05 däröver. DeepSeek V4 Flash $0,003 i lågtrafik och $0,006 i högtrafik, vilket är mer än tre gånger billigare.

• Toppfönster – Ant​hropic har inga; taxan ändras med promptlängden och inget annat. Dee​pSeek fördubblar taxan mellan 01:00 och 04:00 och igen mellan 06:00 och 10:00 UTC, måndag till fredag, med undantag för kinesiska allmänna helgdagar.

• Kontext och utdata — 1M tokens och 128 000 maximal utdata för Claude Haiku 5.5; 1M tokens och 384 000 maximal utdata för DeepSeek V4 Flash.

• Modalitet — Claude Haiku 5.5 hanterar text och bilder; DeepSeek V4 Flash är enbart text, och vision ligger hos syskonmodellen snarare än den här.

• Oberoende poäng – Artificial Analysis Intelligence Index v4.3.2 placerar Claude Haiku 5.5 (Max) på 43,40, tvåa av 182 modeller, och DeepSeek V4 Flash 0731 (Max) på 34,33, tia av 117.

• Hastighet — samma källa mäter 241,9 utdatatokens per sekund för Claude Haiku 5.5 och 222,0 för DeepSeek V4 Flash, näst snabbast på sin egen resultattavla.

Crossovern är hela historien

Ställ upp de två korten på en enda begäran och jämförelsen inverteras två gånger.

Under 100 000 tokens är Ant​hropic billigare på båda mätarna och på prislappen som spelar roll: $0,10 mot $0,15 in, $0,50 mot $0,60 ut. Det är första gången en liten Ant​hropic-modell har kommit in under en Dee​pSeek Flash-taxa på jämförbara villkor, och det är det faktum som lanseringsinlägget inleder med.

Vid över 100 000 tokens vänder det tvärt. Ant​hropics inputpris på 0,50 USD är mer än tre gånger Dee​pSeeks off-peak-pris, och outputpriset på 2,50 USD är mer än fyra gånger det. En pipeline för retrieval eller långa dokument som rutinmässigt sammanställer prompter på 150 000 tokens är inte alls en kund för Claude Haiku 5.5; den är en kund för modellen den redan använde.

Och i Dee​pSeeks två vardagsfönster smalnar den andra jämförelsen från andra hållet, eftersom Dee​pSeeks egen taxa fördubblas medan Ant​hropics inte rör sig. Ingen av leverantörernas strukturer är bättre i abstrakt mening. Den ena prissätter efter hur mycket du skickar, den andra efter när du skickar det, och bara en av dessa ligger under din kontroll vid förfrågningstillfället.

Vad en slutförd uppgift kostar, vilket är den enda rättvisa siffran

Listpriserna är per token, och de två modellerna genererar inte samma antal tokens för samma arbete. Det är där lanseringsaritmetiken blir obehaglig för Ant​hropic.

Artificial Analysis sätter Claude Haiku 5.5 (Max) till $0,21 per Intelligence-uppgift och DeepSeek V4 31 (Max) till $0,21 per uppgift. En tiondel av indatapriset, en Intelligence på 26 punkter – 43,40 mot 34,33 – och den uppmätta kostnaden för att få en uppgift utförd hamnar inom en cent från modellen den var tänkt att underbjuda.

Anledningen står på samma sida. Vid utvärderingen av Index genererade Claude Haiku 5.5 440 miljoner utdatatoken mot en median på 100 miljoner, och utvärderaren kallar den mycket ordrik. DeepSeek V4 Flash genererade 240 miljoner mot en median på 140 miljoner och kallas också mycket ordrik. Båda modellerna tänker länge, båda fakturerar tänkande som utdata, och utdata är mätaren som avgör fakturan. Den nittioprocentiga indataminskningen är verklig, och den debiteras på den mindre halvan av fakturan.

Det finns en andra, tystare effekt. Ant​hropics egen dokumentation säger att Claude Haiku 5.5 använder den nyare tokenizern som delas med Claude 4.7 och senare, så samma text räknas som ungefär 30 % fler token än den gjorde på Claude Haiku 4.5. Taxan föll med en faktor tio; antalet token föll inte alls, och för samma text ökade det.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Modellen bakom namnet Dee​pSeek ändrades också

Den som jämför dessa två utifrån en månader gammal benchmark-tabell bör känna till detta innan de gör det.

Dee​pSeek:s prissida listar nu deepseek-flash som modellnamn, med stöd av Dee​pSeek-V4.1-Flash, och anger att det äldre deepseek-v4-flash id:t fortfarande accepteras men att "motsvarande modeller har tagits ur bruk" — förfrågningar under det gamla namnet hanteras av den nyare modellen och debiteras enligt Flash-priset. Med andra ord behöll id:t sitt namn, sitt pris och sin plats i sortimentet, och vikterna under det flyttades.

Det är inte en kritik; det är en varning om vad en benchmarktabell är daterad till. Posten från Artificial Analysis som den här texten citerar gäller 0731-utgåvan av DeepSeek V4 Flash i dess Max-konfiguration, vilket är modellen som resultattavlan mätte, och det är inte automatiskt ett uttalande om vad som än svarar mot det id:t i dag. Ant​hropics Claude Haiku 5.5 är däremot ett fast id utan datumssuffix och utan alias, och dess Index-placering är daterad till dess egen lanseringsvecka.

Två modeller, en slutpunkt

Anledningen till att den här jämförelsen är lätt att avgöra själv i stället för på ett specifikationsblad är att båda sidorna kan anropas från samma plats – med ett undantag värt att nämna.

DeepSeek V4 Flash finns i OrcaRouter-katalogen idag, och automatisk failover ligger under den, så DeepSeek-delen av den här jämförelsen går att anropa hos oss i morse i stället för att bara läsa om. En varning som är värd att nämna snarare än att lämna åt dig att upptäcka på egen hand: vår egen listade taxa för den här modellen är 0,22 USD in och 0,66 USD ut per miljon token, vilket ligger över DeepSeeks off-peak-prislista och under dess peak-prislista. Betrakta DeepSeeks sida, inte vår, som auktoriteten för peak- och off-peak-strukturen, och vår som ett enda sammanvägt tal att starta en mätkörning mot. Claude Sonnet 5.5 och Claude Opus 5.5 finns också i katalogen. Så en A/B mellan ett DeepSeek Flash-ben och ett Claude-ben är en nyckel och en SDK, och routnings-DSL:en komponerar dem till ett enda anrop om eskaleringslogiken hör hemma i routen snarare än i applikationen.

Claude Haiku 5.5 finns ännu inte i katalogen. Det är ingen undanflykt – det betyder att Ant​hropic-sidan i den här jämförelsen för närvarande måste nås direkt hos Ant​hropic, medan Dee​pSeek-sidan inte behöver det. Om du vill ha den billiga nivån i Dee​pSeek-linjen på samma nyckel som resten av din stack idag, är den delen redan live.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Vilken ska man välja?

Om dina anrop är korta – klassificering, extrahering, routning, sammanfattning, subagent-turer – och de ryms under 100 000 tokens, är Claude Haiku 5.5 nu den billigare modellen på båda mätarna och den starkare på den oberoende resultattavlan, och argumentet är enkelt. Det är också den enda av de två som tar emot en bild.

Om dina anrop är långa, om du återsänder ett stort delat prefix, eller om du kan schemalägga, pekar kalkylen i motsatt riktning – och gör det med bred marginal: Dee​pSeeks cachade indata på 0,003 USD i lågtrafik ligger en storleksordning under Ant​hropics 0,01 USD, dess utdatatak är tre gånger högre, och dess lågtrafikrabatt är ett schemaläggningsproblem snarare än en produktbegränsning.

Vad lanseringen faktiskt fastställde är snävare än "Ant​hropic är billigt nu." Den fastställde att de amerikanska labben kommer att prissätta lägre än de kinesiska i fallet med korta prompter, och att fallet med korta prompter är där merparten av produktionstrafiken finns. Allt över 100 000 tokens är fortfarande den andra modellens marknad.