Ett genererat hero-kort för "En tiondel av taxan är inte en tiondel av fakturan", försett med etiketten "GENERATIONSKLYFTAN" med kickern "TVÅ HAIKU-MODELLER, ELVA MÅNADER MELLAN SIG" och underrubriken "Claude Haiku 5.5 mot Claude Haiku 4.5 i pris, tokens och det nya steget på 100 000 tokens." Fyra chips visar "$0.10 / $0.50", "$1.00 / $5.00", "1M kontext" och "30 % fler tokens". Två kort nedan är märkta "VAD TAXAN SÄGER" ("90 % lägre in- och utdata under 100 000 tokens") och "VAD FAKTURAN SÄGER" ("cirka 75 % billigare att köra, på omkring 30 % fler tokens"). En sidfot lyder "Leverantörens prisdokumentation läst 8 oktober 2026." OrcaRouter-logotypen är inkomponerad i det nedre högra hörnet.
Guides & Insights

Claude Haiku 5.5 vs Claude Haiku 4.5: En 90 % prissänkning är inte en 90 % besparing

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Claude Haiku 5.5 har ett pris på 0,10 USD per miljon indatatoken och 0,50 USD per miljon utdatatoken för prompter på upp till 100 000 token. Claude Haiku 4.5 kostar 1 och 5 USD, med fast pris, för hela fönstret på 200 000 token som den alltid har haft. Anthropic anger skillnaden till "90 % lägre" i en fotnot och "ungefär 75 % billigare att köra" i meningen ovanför — och glappet på elva månader mellan de två modellerna är exakt avståndet mellan dessa två tal.

Det är inte ett marknadsföringsknep. Det är den ärliga formen av en modellgeneration som ändrade sin tokenizer, sin standardinställning för tänkande och sitt kontextfönster samtidigt som sitt pris, och det innebär att den som byter modell-id och förväntar sig att räkningen ska minska med en faktor tio kommer att bli besviken på aritmetiken snarare än på produkten.

Båda modellerna, i levererat skick

Allt nedan anges per miljon tokens, i amerikanska dollar, och är hämtat från Ant​hropics egen prissättning och modelldokumentation den 2026-10-08 om inte annat anges.

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• Indata — Claude Haiku 5.5 $0.10 upp till 100 000 tokens, $0.50 därutöver; Claude Haiku 4.5 $1.00 oavsett längd.

• Utdata — Claude Haiku 5.5 $0,50 upp till 100 000 tokens, $2,50 däröver; Claude Haiku 4.5 $5,00 oavsett längd.

• Cacheläsningar — Claude Haiku 5.5 $0.01 upp till 100 000 tokens och $0.05 därutöver; Claude Haiku 4.5 $0.10. Cacheskrivningar — $0.125 och $0.625 mot $1.25.

• Kontext — 1M tokens mot 200 000. Maximal utdata — 128 000 tokens mot 64 000.

• Tänkande — Claude Haiku 5.5 är adaptivt och aktiverat som standard med ett ansträngningsreglage som som standard står på medium; Claude Haiku 4.5 använder den äldre manuella formen och har ingen ansträngningsparameter alls.

• Oberoende poäng — Artificial Analysis Intelligence Index v4.3.2 placerar Claude Haiku 5.5 (Max) på 43,40, tvåa av 182 modeller, och Claude 4.5 Haiku på 16,88, trettionde av 61 — där utvärderaren flaggar 4.5-poängen som uppskattad.

• Hastighet — samma källa mäter 242 utdatatokens per sekund för Claude Haiku 5.5 mot 89,7 för 4.5-generationen, vilket är det enda stället där den gamla modellen fortfarande ser bekväm ut.

Där berättelsen om tiondelen av priset brister

Tre saker urholkar andelen, och bara den första av dem är Anthropics egen varning.

Tokeniseraren är det stora problemet. Claude Haiku 5.5 använder den nyare tokeniserare som introducerades med Claude 4.7, och Anthropics dokumentation säger att samma text "räknas som ungefär 30 % fler tokens än på Claude Haiku 4.5." Du betalar inte en tiondel av priset för samma antal tokens; du betalar en tiondel av priset för ungefär 1,3 gånger så många tokens. Leverantörens egen migreringsguide gör detta till den andra punkten på sin checklista, före varje kodändring: räkna om dina prompter och se sedan över max_tokens och dina kostnadsuppskattningar.

Tänkande tokens faktureras som utdata-tokens, och Claude Haiku 5.5 tänker som standard. Anthropics lanseringssida säger uttryckligen att modellen är "mycket mångordig" i sig själv på diagrammen, och den oberoende mätningen bekräftar det skarpare än vad leverantören gör: vid utvärdering av Intelligence Index registrerade Artificial Analysis 440 miljoner utdata-tokens från Claude Haiku 5.5 mot en median på 100 miljoner över lag, och flaggade modellen som mycket mångordig. En billig indatataxa hjälper inte en arbetsbelastning vars faktura till största delen avser utdata.

Steget på 100 000 token är det tredje. Ovanför det är priserna $0,50 och $2,50 – hälften av vad Claude Haiku 4.5 tog för samma förfrågan, vilket är en bra deal och inte den deal som de flesta läsare har läst om. Ant​hropic säger att prompter under tröskeln stod för omkring 90 % av förfrågningarna till den tidigare Haiku-modellen, vilket är siffran som gör gränsen överlevbar som rubrik; det är också leverantörens egen trafikmix, inte din.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

Vad samma arbete kostar de två modellerna

Kostnaden per slutförd uppgift är det mått som överlever alla tre effekterna ovan, eftersom det debiterar modellen för allt den gav ifrån sig, inte bara det du skickade till den.

Artificial Analysis anger Claude Haiku 5.5 (Max) till 0,21 dollar per uppgift i Intelligence Index — den siffra som publiceras tillsammans med priser på 0,10 dollar för indata och 0,50 dollar för utdata. För 4.5-generationen publicerar den överhuvudtaget ingen siffra för kostnad per uppgift; rutan visar okänt, eftersom modellen aldrig kördes på Indexet i en resonemangskonfiguration. Det sidan däremot publicerar är en rå prislapp på 1,00 och 5,00 dollar och en annan, lägre uppmätt poäng.

Så den ärliga jämförelsen för en köpare är inte 10x på tokens utan snarare något i närheten av detta: en tiondel av indatapriset på 30 % fler tokens, halva utdatapriset när du passerar 100K, och en modell som förbrukar fler utdata-tokens per svar än sin föregångare gjorde – mot ett förmågelyft från 16,88 till 43,40 på samma oberoende resultattavla. Siffran 75 % som Ant​hropic anger för genomsnittliga arbetsbelastningar är den förnuftiga planeringssiffran. Den är också en sammanvägd leverantörsuppskattning över en trafikmix som du inte kontrollerar.

Migreringen är inte ett utbyte av model-id.

Anthropics migreringsguide innehåller tio punkter för den som lämnar Claude Haiku 4.5, och flera av dem är inte råd utan hårda fel.

• Manuellt tänkande slutar fungera — thinking: {"type": "enabled", "budget_tokens": N} returnerar ett fel. Adaptivt tänkande ersätter det, och thinking.display måste ställas in på "summarized" om du överhuvudtaget vill se resonemanget.

• Samplingsparametrar bryter — temperature, top_p och top_k måste alla tas bort från begäran.

• Assistent-prefill — ett meddelande som slutar med ett assistentsvar returnerar ett fel; avsluta det med ett användarsvar.

• Ändringar i blockordningen – ett svar kan börja med tankeblock, så kod som läser det första innehållsblocket som svaret måste välja efter typ i stället.

• Vägranssvar är nya — modellen kör säkerhetsklassificerare och kan returnera stop_reason: "refusal", och det finns ingen reservlösning på serversidan.

• Uppspelning är begränsad — tankeblock fungerar endast i det konto som skapade dem, eller ett konto som är kopplat till det.

• Priority Tier överförs inte — organisationer som har ett Priority Tier-åtagande för Claude Haiku 4.5 måste planera kapacitet separat, eftersom nivån inte stöds i Claude Haiku 5.5.

Två av dessa förtjänar mer uppmärksamhet än resten. Stopporsaken ”refusal” är en förändring i kontrollflödet i varje loop som antog att varje svar har innehåll, och de kontobundna thinking-blocken förstör varje kö som lagrar konversationer och återuppspelar dem genom en pool av autentiseringsuppgifter. Ingen av dem visar sig förrän i produktion.

Kör båda nivåerna under en och samma nyckel

Den praktiska frågan för de flesta team är inte vilken av dessa två modeller som är bättre, eftersom svaret helt och hållet beror på vilket anrop du gör. Det är huruvida den billiga delen av en kaskad kan uppgraderas oberoende av allt runtomkring.

Claude Haiku 4.5 finns i OrcaRouter-katalogen i dag till Anthropics listpris med 0 % påslag, så leverantörens pris förs vidare direkt och eventuella ändringar Anthropic gör syns hos oss samma dag. Claude Sonnet 5.5 och Claude Opus 5.5 finns också där, vilket innebär att en pipeline i två nivåer – liten modell för den rutinmässiga majoriteten, större modell för eskaleringen – kan byggas nu med en nyckel, en SDK och automatisk failover i botten, och den lilla delen byts ut mot Claude Haiku 5.5 senare som en ändring av modell-id i stället för en omskrivning.

Claude Haiku 5.5 finns ännu inte i katalogen, och det är värt att säga det rakt ut i stället för att låta det vara underförstått. Ett glapp mellan att en modell släpps och att den går att dirigera till är normalt på lanseringsdagen, och det är inget löfte om när det stängs; de modeller som går att anropa hos oss i morse är de som nämns ovan.

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

Vem bör byta, och vilket samtal bör bytas först?

Om din Haiku 4.5-trafik består av klassificering, extrahering, routning, kompaktering eller sammanfattning med prompter under 100 000 tokens, byt — priset är en tiondel, fönstret är fem gånger bredare, och ansträngningsreglaget ger dig en kostnadshävstång som den gamla modellen aldrig hade. Budgetera cirka 75 % lägre och stäm av mot dina egna tokenantal efter en vecka.

Om dina promptar rutinmässigt passerar 100 000 tokens köper du en rabatt på 50 % snarare än 90 %, och den andra nivån förändrar jämförelsen på sätt som gör det värt att jämföra priser: utdatapriset på 2,50 $ för över 100 000 tokens ligger över vad flera konkurrerande små modeller tar för hela fönstret.

Och om du kör Haiku 4.5 eftersom det var det enda billiga alternativet som rymde ett dokument på 200 000 token, notera vad som har ändrats. Fönstret är nu en miljon token, vilket är en annan produkt, och skälet att behålla den gamla modellen har i tysthet försvunnit tillsammans med skälet till att den var billig.