
Claude Haiku 5.5 vs Claude Haiku 4.5: En 90 % prissänkning är inte en 90 % besparing
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Claude Haiku 5.5 har ett pris på 0,10 USD per miljon indatatoken och 0,50 USD per miljon utdatatoken för prompter på upp till 100 000 token. Claude Haiku 4.5 kostar 1 och 5 USD, med fast pris, för hela fönstret på 200 000 token som den alltid har haft. Anthropic anger skillnaden till "90 % lägre" i en fotnot och "ungefär 75 % billigare att köra" i meningen ovanför — och glappet på elva månader mellan de två modellerna är exakt avståndet mellan dessa två tal.
Det är inte ett marknadsföringsknep. Det är den ärliga formen av en modellgeneration som ändrade sin tokenizer, sin standardinställning för tänkande och sitt kontextfönster samtidigt som sitt pris, och det innebär att den som byter modell-id och förväntar sig att räkningen ska minska med en faktor tio kommer att bli besviken på aritmetiken snarare än på produkten.
Båda modellerna, i levererat skick
Allt nedan anges per miljon tokens, i amerikanska dollar, och är hämtat från Anthropics egen prissättning och modelldokumentation den 2026-10-08 om inte annat anges.

• Indata — Claude Haiku 5.5 $0.10 upp till 100 000 tokens, $0.50 därutöver; Claude Haiku 4.5 $1.00 oavsett längd.
• Utdata — Claude Haiku 5.5 $0,50 upp till 100 000 tokens, $2,50 däröver; Claude Haiku 4.5 $5,00 oavsett längd.
• Cacheläsningar — Claude Haiku 5.5 $0.01 upp till 100 000 tokens och $0.05 därutöver; Claude Haiku 4.5 $0.10. Cacheskrivningar — $0.125 och $0.625 mot $1.25.
• Kontext — 1M tokens mot 200 000. Maximal utdata — 128 000 tokens mot 64 000.
• Tänkande — Claude Haiku 5.5 är adaptivt och aktiverat som standard med ett ansträngningsreglage som som standard står på medium; Claude Haiku 4.5 använder den äldre manuella formen och har ingen ansträngningsparameter alls.
• Oberoende poäng — Artificial Analysis Intelligence Index v4.3.2 placerar Claude Haiku 5.5 (Max) på 43,40, tvåa av 182 modeller, och Claude 4.5 Haiku på 16,88, trettionde av 61 — där utvärderaren flaggar 4.5-poängen som uppskattad.
• Hastighet — samma källa mäter 242 utdatatokens per sekund för Claude Haiku 5.5 mot 89,7 för 4.5-generationen, vilket är det enda stället där den gamla modellen fortfarande ser bekväm ut.
Där berättelsen om tiondelen av priset brister
Tre saker urholkar andelen, och bara den första av dem är Anthropics egen varning.
Tokeniseraren är det stora problemet. Claude Haiku 5.5 använder den nyare tokeniserare som introducerades med Claude 4.7, och Anthropics dokumentation säger att samma text "räknas som ungefär 30 % fler tokens än på Claude Haiku 4.5." Du betalar inte en tiondel av priset för samma antal tokens; du betalar en tiondel av priset för ungefär 1,3 gånger så många tokens. Leverantörens egen migreringsguide gör detta till den andra punkten på sin checklista, före varje kodändring: räkna om dina prompter och se sedan över max_tokens och dina kostnadsuppskattningar.
Tänkande tokens faktureras som utdata-tokens, och Claude Haiku 5.5 tänker som standard. Anthropics lanseringssida säger uttryckligen att modellen är "mycket mångordig" i sig själv på diagrammen, och den oberoende mätningen bekräftar det skarpare än vad leverantören gör: vid utvärdering av Intelligence Index registrerade Artificial Analysis 440 miljoner utdata-tokens från Claude Haiku 5.5 mot en median på 100 miljoner över lag, och flaggade modellen som mycket mångordig. En billig indatataxa hjälper inte en arbetsbelastning vars faktura till största delen avser utdata.
Steget på 100 000 token är det tredje. Ovanför det är priserna $0,50 och $2,50 – hälften av vad Claude Haiku 4.5 tog för samma förfrågan, vilket är en bra deal och inte den deal som de flesta läsare har läst om. Anthropic säger att prompter under tröskeln stod för omkring 90 % av förfrågningarna till den tidigare Haiku-modellen, vilket är siffran som gör gränsen överlevbar som rubrik; det är också leverantörens egen trafikmix, inte din.

Vad samma arbete kostar de två modellerna
Kostnaden per slutförd uppgift är det mått som överlever alla tre effekterna ovan, eftersom det debiterar modellen för allt den gav ifrån sig, inte bara det du skickade till den.
Artificial Analysis anger Claude Haiku 5.5 (Max) till 0,21 dollar per uppgift i Intelligence Index — den siffra som publiceras tillsammans med priser på 0,10 dollar för indata och 0,50 dollar för utdata. För 4.5-generationen publicerar den överhuvudtaget ingen siffra för kostnad per uppgift; rutan visar okänt, eftersom modellen aldrig kördes på Indexet i en resonemangskonfiguration. Det sidan däremot publicerar är en rå prislapp på 1,00 och 5,00 dollar och en annan, lägre uppmätt poäng.
Så den ärliga jämförelsen för en köpare är inte 10x på tokens utan snarare något i närheten av detta: en tiondel av indatapriset på 30 % fler tokens, halva utdatapriset när du passerar 100K, och en modell som förbrukar fler utdata-tokens per svar än sin föregångare gjorde – mot ett förmågelyft från 16,88 till 43,40 på samma oberoende resultattavla. Siffran 75 % som Anthropic anger för genomsnittliga arbetsbelastningar är den förnuftiga planeringssiffran. Den är också en sammanvägd leverantörsuppskattning över en trafikmix som du inte kontrollerar.
Migreringen är inte ett utbyte av model-id.
Anthropics migreringsguide innehåller tio punkter för den som lämnar Claude Haiku 4.5, och flera av dem är inte råd utan hårda fel.
• Manuellt tänkande slutar fungera — thinking: {"type": "enabled", "budget_tokens": N} returnerar ett fel. Adaptivt tänkande ersätter det, och thinking.display måste ställas in på "summarized" om du överhuvudtaget vill se resonemanget.
• Samplingsparametrar bryter — temperature, top_p och top_k måste alla tas bort från begäran.
• Assistent-prefill — ett meddelande som slutar med ett assistentsvar returnerar ett fel; avsluta det med ett användarsvar.
• Ändringar i blockordningen – ett svar kan börja med tankeblock, så kod som läser det första innehållsblocket som svaret måste välja efter typ i stället.
• Vägranssvar är nya — modellen kör säkerhetsklassificerare och kan returnera stop_reason: "refusal", och det finns ingen reservlösning på serversidan.
• Uppspelning är begränsad — tankeblock fungerar endast i det konto som skapade dem, eller ett konto som är kopplat till det.
• Priority Tier överförs inte — organisationer som har ett Priority Tier-åtagande för Claude Haiku 4.5 måste planera kapacitet separat, eftersom nivån inte stöds i Claude Haiku 5.5.
Två av dessa förtjänar mer uppmärksamhet än resten. Stopporsaken ”refusal” är en förändring i kontrollflödet i varje loop som antog att varje svar har innehåll, och de kontobundna thinking-blocken förstör varje kö som lagrar konversationer och återuppspelar dem genom en pool av autentiseringsuppgifter. Ingen av dem visar sig förrän i produktion.
Kör båda nivåerna under en och samma nyckel
Den praktiska frågan för de flesta team är inte vilken av dessa två modeller som är bättre, eftersom svaret helt och hållet beror på vilket anrop du gör. Det är huruvida den billiga delen av en kaskad kan uppgraderas oberoende av allt runtomkring.
Claude Haiku 4.5 finns i OrcaRouter-katalogen i dag till Anthropics listpris med 0 % påslag, så leverantörens pris förs vidare direkt och eventuella ändringar Anthropic gör syns hos oss samma dag. Claude Sonnet 5.5 och Claude Opus 5.5 finns också där, vilket innebär att en pipeline i två nivåer – liten modell för den rutinmässiga majoriteten, större modell för eskaleringen – kan byggas nu med en nyckel, en SDK och automatisk failover i botten, och den lilla delen byts ut mot Claude Haiku 5.5 senare som en ändring av modell-id i stället för en omskrivning.
Claude Haiku 5.5 finns ännu inte i katalogen, och det är värt att säga det rakt ut i stället för att låta det vara underförstått. Ett glapp mellan att en modell släpps och att den går att dirigera till är normalt på lanseringsdagen, och det är inget löfte om när det stängs; de modeller som går att anropa hos oss i morse är de som nämns ovan.

Vem bör byta, och vilket samtal bör bytas först?
Om din Haiku 4.5-trafik består av klassificering, extrahering, routning, kompaktering eller sammanfattning med prompter under 100 000 tokens, byt — priset är en tiondel, fönstret är fem gånger bredare, och ansträngningsreglaget ger dig en kostnadshävstång som den gamla modellen aldrig hade. Budgetera cirka 75 % lägre och stäm av mot dina egna tokenantal efter en vecka.
Om dina promptar rutinmässigt passerar 100 000 tokens köper du en rabatt på 50 % snarare än 90 %, och den andra nivån förändrar jämförelsen på sätt som gör det värt att jämföra priser: utdatapriset på 2,50 $ för över 100 000 tokens ligger över vad flera konkurrerande små modeller tar för hela fönstret.
Och om du kör Haiku 4.5 eftersom det var det enda billiga alternativet som rymde ett dokument på 200 000 token, notera vad som har ändrats. Fönstret är nu en miljon token, vilket är en annan produkt, och skälet att behålla den gamla modellen har i tysthet försvunnit tillsammans med skälet till att den var billig.
