
Claude Haiku 5.5 vs Claude Sonnet 5.5: En 20x-prislista, en 36x uppmätt faktura
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Claude Haiku 5.5 och Claude Sonnet 5.5ligger sex dagar och en nivå från varandra i samma familj, delar ett kontextfönster på en miljon token och svarar via samma API-form. På den publicerade prislistan kostar den billigare en femtedel av den dyrare i det intervall där de flesta förfrågningar hamnar. På den oberoende Artificial Analysis-tavlan är gapet större än så: $0,21 för att slutföra en uppgift i Intelligence Index på Claude Haiku 5.5 mot $7,60 på Claude Sonnet 5.5, för ett Intelligence Index på 43 mot 56. Signalen som startade den här artikeln beskrev det som att Claude Haiku 5.5 var "långt bättre än GPT-6 Luna" och "närmare Sonnet 5.5". Den första halvan av det är ungefär vad leverantörens egen jämförelseuppsättning visar. Den andra halvan är där mätningarna slutar stämma överens med marknadsföringen, och det är värt att vara precis om vilken.
Två modeller, sex dagar och en nivå ifrån varandra
Claude Haiku 5.5 släpptes den 7 oktober 2026 under modell-ID:t claude-haiku-5-5. Den är den direkta ersättaren för Claude Haiku 4.5, tar emot text och bilder och returnerar text, och är den första modellen i Haiku-klassen som Anthropic har gett en justerbar ansträngningsinställning – Låg, Medel, Hög, Xhigh och Max, med medel som API-standard. Anthropic kallar den "den billigaste, snabbaste och mest kapabla lilla modellen vi någonsin har släppt", och dess fotnot nyanserar det till att vara snabbast vid varje modells standardhastighet, fortfarande bakom Opus-modellerna när dessa körs i Fast Mode.
Claude Sonnet 5.5 lanserades sex dagar tidigare, den 28 september 2026, som claude-sonnet-5-5 – den nivå som Anthropic positionerar som den bästa kombinationen av snabbhet och intelligens, och den som företaget rekommenderar för komplex agentisk kodning. Samma fönster på en miljon token. Till skillnad från Claude Haiku 5.5 har den inget prisintervall baserat på promptlängd, vilket visar sig spela större roll än försprånget på sex dagar.
Båda är nu tillgängliga på alla plattformar, inklusive Amazon Web Services, Google Cloud och Microsoft Azure, och båda omfattas av ett åtagande om att inte avvecklas tidigare än ett år efter lansering — den 7 oktober 2027 för Claude Haiku 5.5, den 28 september 2027 för Claude Sonnet 5.5. Anthropic säger att Claude Sonnet 5.5 är tillgänglig med noll datalagring, i linje med Claude Opus 5.5 och Claude Sonnet 5.
Prislistan, båda sidorna, på ett ställe
Per miljon tokens, i amerikanska dollar, enligt Anthropics publicerade priser:
• Indata – Claude Haiku 5.5: $0,10 för prompter upp till 100 000 token, $0,50 över den gränsen; Claude Sonnet 5.5: $2,00 fast pris, inget steg.
• Utdata — Claude Haiku 5.5 $0,50 upp till 100 000 tokens, $2,50 däröver; Claude Sonnet 5.5 $10,00 fast.
• Cacheläsningar — Claude Haiku 5.5 $0.01 i det lägre intervallet och $0.05 över det; Claude Sonnet 5.5 $0.10. Anthropic halverade cacheläsningarna för Claude Sonnet 5.5 från $0.20 samtidigt som lanseringen av Haiku, och säger att eftersom cacheläsningar utgör en stor andel av den agentiska tokenanvändningen kostar Claude Sonnet 5.5 nu omkring 20 % mindre för de flesta agentiska arbetsuppgifter.
• Cache-skrivningar – Claude Haiku 5.5 $0.125 för en skrivning på fem minuter och $0.20 för en skrivning på en timme i det lägre intervallet, $0.625 och $1.00 över det; Claude Sonnet 5.5 $2.50 för en skrivning på fem minuter och $4.00 för en timme.
• Batch – Batch API har 50 % rabatt på både indata och utdata. Det gör att Claude Haiku 5.5 hamnar på $0,05 och $0,25 under 100 000-token-gränsen och $0,25 och $1,25 över den, jämfört med Claude Sonnet 5.5 på $1,00 och $5,00.
Läser man tvärs över de raderna är mönstret konsekvent: i det nedre bandet ser man ett 20x indatagap och ett 20x utdatagap; ovanför linjen, 4x och 4x. Anthropics rubrik är "cirka 75 % lägre kostnad att köra" i genomsnitt jämfört med Claude Haiku 4.5, precisierad i en fotnot till 90 % billigare under 100 000 tokens och 50 % billigare över det, med tokenizerändringen inräknad i det genomsnittet.
100 000-tokensteget är där aritmetiken vänder.
Två saker drar i motsatta riktningar, och bara en av dem står på prislistan. Priserna sjunker kraftigt i jämförelse med Claude Haiku 4.5. Samtidigt levereras Claude Haiku 5.5 med en uppdaterad tokenizer, liknande den i Claude Sonnet 5.5 och Claude Opus 5.5, som Anthropic säger "använder något fler tokens per uppgift" — så en identisk prompt anländer som ett större antal fakturerbara tokens än den skulle ha gjort i den föregående generationen. Genomsnittet på 75 % är nettoeffekten av båda, och det är en siffra från leverantören.
Gränsen på 100 000 token är det som fångar folk. Anthropic prissätter Claude Haiku 5.5 efter promptlängd: en begäran vars prompt överstiger 100 000 token betalar de högre priserna för hela begäran, inte bara för de token som ligger över tröskeln. Promptlängden räknar alla indata-token, inklusive cacheläsningar och cacheskrivningar, och varje begäran prissätts var för sig — en lång begäran betalar det högre intervallet även när en del av prompten är en cacheträff, och tidigare begäranden behåller de priser de fakturerades enligt. En hämtningspipeline som bekvämt ligger på 90 000 token betalar $0,10 och $0,50. Flytta fönstret ett snäpp och hela begäran prissätts om till $0,50 och $2,50. Claude Sonnet 5.5 gör inte detta, eftersom hela fönstret på en miljon token faktureras enligt standardpriser.
Två konsekvenser följer, riktade i motsatta riktningar. För det första inträffar inte den crossover som folk förväntar sig – lång kontext som gör den dyra modellen till den billigare: Claude Haiku 5.5 ovanför linjen är fortfarande en fjärdedel av Claude Sonnet 5.5 på prislistan. För det andra krymper gapet du räknade med från 20x till 4x precis när din arbetsbelastning blir tung, vilket är precis när absoluta siffror börjar spela roll. Steget är anledningen till att en kostnadskänslig pipeline behöver en egen budgetpost i stället för en taxa per token.
Vad varje leverantör rapporterar att den får i poäng
Allt i det här avsnittet är leverantörsrapporterat och har inte reproducerats av en tredje part. Anthropic publicerar samma jämförelseuppsättning på sina sidor för Claude Haiku 5.5 och Claude Sonnet 5.5, och där de två sidorna överlappar stämmer de överens:
• GDPval-AA v2.1, kunskapsarbete — 1 620 för Claude Haiku 5.5, mot 1 840 för Claude Sonnet 5.5, 735 för Claude Haiku 4.5 och 1 437 för GPT-6 Luna.
• AA-Briefcase v1.1 — 1 578 för Claude Haiku 5.5, mot 1 824 för Claude Sonnet 5.5, 614 för Claude Haiku 4.5 och 1 336 för GPT-6 Luna.
• OSWorld 2.1, datoranvändning, offline-delmängd — 72,4 % för Claude Haiku 5.5, mot 83,9 % för Claude Sonnet 5.5, 15,7 % för Claude Haiku 4.5 och 48,9 % för GPT-6 Luna.
• Terminal-Bench 4.0, agentisk kodning — 39,2 % för Claude Haiku 5.5, jämfört med 70,6 % för Claude Sonnet 5.5, 0,0 % för Claude Haiku 4.5 och 16,4 % för GPT-6 Luna.
• FrontierCode 1.1, Main — 46,4 % för Claude Haiku 5.5, mot 52,1 % för Claude Sonnet 5.5 vid Xhigh effort, 42,4 % för GPT-6 Luna. Anthropic påpekar också att Claude Sonnet 5.5 får lägre poäng vid Max effort än vid Xhigh i det här fallet, vilket de tillskriver att en code-review-färdighet används oftare och därmed orsakar timeouts eller ändringar utanför avsedd omfattning.
• Kartografi, visuellt resonemang utan verktyg — 46,4 % för Claude Haiku 5.5, mot 61,6 % för Claude Sonnet 5.5, 6,4 % för Claude Haiku 4.5 och 29,1 % för GPT-6 Luna.
• Humanity's Last Exam – 45,9 % utan verktyg och 57,4 % med dem för Claude Haiku 5.5; 64,5 % med verktyg för Claude Sonnet 5.5, 18,7 % för Claude Haiku 4.5 och 56,9 % utan verktyg för Claude Sonnet 5.5 på samma sida. Anthropic noterar att siffrorna för GPT-6-familjen kan vara inaktuella eftersom OpenAI åtgärdade en bugg i bildförståelsen och inte alla tredjepartsresultat hade uppdaterats.
Två av dessa rader är värda att läsas två gånger. På FrontierCode är de två modellerna verkligen nära – 46,4 % mot 52,1 % – och på Chartography, där det inte finns några verktyg att gömma sig bakom, är gapet 15 punkter. Terminal-Bench 4.0 är inte alls nära: 39,2 % mot 70,6 % är en annan kapacitetsklass, vilket är anledningen till att Anthropics Claude Sonnet 5.5-sida fortfarande hänvisar till Claude Sonnet 5.5 och Claude Opus 5.5 för komplex agentisk kodning och framställer Claude Haiku 5.5 som modellen för smalt, högvolymarbete.
Vad den oberoende styrelsen tillför
Anthropics siffror jämför dess egna modeller med varandra och med en konkurrent. En oberoende resultattavla ställer båda mot hela fältet, och den siffra den rapporterar som leverantörerna inte rapporterar är kostnaden per slutförd uppgift.
Artificial Analysis poängsätter Claude Haiku 5.5 vid Max effort med ett Intelligence Index på 43, väl över medianen på 13 bland jämförbara modeller, och genererar 440M utdatatoken i Indexet mot en median på 100M – mycket ordrik – till 0,10 USD för indata och 0,50 USD för utdata per miljon, samt 242 utdatatoken per sekund. Dess uppmätta kostnad är 0,21 USD per uppgift i Intelligence Index.
Samma resultattavla ger Claude Sonnet 5.5 56 poäng, mot en median på 26, och genererar 410M utdatatokens mot en median på 88M, till 2,00 USD för indata och 10,00 USD för utdata med 90 % cacherabatt. Dess uppmätta kostnad är 7,60 USD per Intelligence Index-uppgift.


Ställ de två raderna sida vid sida och förhållandet är hela historien. $0.21 mot $7.60 är lite över 36x, och de två modellerna ligger nästan på samma nivå när det gäller verbositet — 440M utdatatokens mot 410M — så den multiplikatorn är nästan helt och hållet prislistan som gör vad prislistan säger att den ska göra. Enligt leverantörens egen prislista är samma jämförelse 20x. Det extra kommer från sådant som ett pris per token inte kan visa: den billigare modellen når sitt svar med färre fakturerade tokens per uppgift vid den här ansträngningsinställningen, och cacheläsningar faktureras till en tiondel av priset för Claude Sonnet 5.5. Samma testramverk, samma uppgifter, oberoende mätt.

Där den billiga nivån faktiskt tar slut
De kundsiffror som Anthropic publicerar avgör fördelningen oftare än benchmarkarna gör, och de pekar alla i samma riktning. Asana rapporterar över 30 % lägre latens vid slutförda uppgifter och upp till 2,5x snabbare inferens per agentomgång. Box rapporterar en poäng 11 punkter över Claude Haiku 4.5 vid ungefär halva latensen. HubSpot rapporterar den bästa poäng det har sett i sin egen svit, 92,8 % i genomsnitt över tre körningar, med högsta träffrekvens och lägsta andel falska positiva. AlphaSense kör omkring 8M anrop i veckan genom "Ask in Document" och rapporterar en statistiskt signifikant förbättring jämfört med Claude Haiku 4.5, 0,84 mot 0,76. Cognition rapporterar att med Claude Haiku 5.5 som sidekick har dess Fusion-agent en FrontierCode-poäng på 66,2.
Ingen av dem är en agent för långa tidshorisonter. De är punktlösningar – ett väldefinierat steg som blir snabbare och billigare. Det är den form som Claude Haiku 5.5 är byggd för, och det är också den form där 36x-kostnadsfördelen är riktiga pengar snarare än ett avrundningsfel. Fördelen växer med anropsvolymen och försvinner med anropsdjupet: hundratusen klassificeringsanrop om dagen till 0,10 USD in och 0,50 USD ut är en utgiftspost som du ser försvinna, medan hundra agentturer per session, där var och en återläser ackumulerad kontext, är en utgiftspost som växer superlinjärt eftersom varje tur över tröskeln betalar för den högre prisnivån.
Claude Sonnet 5.5:s motargument är kostnad per försök snarare än kostnad per token. Anthropic säger att den körs 30 %+ snabbare än Claude Sonnet 5 och kostar upp till 30 % mindre för de flesta typer av arbete, där besparingen kommer från att färre tokens behövs snarare än från lägre priser. Tredjepartstestare sätter siffror på det: Slack rapporterar ungefär 14 % färre utdatatoken, Balyasny cirka 121k tokens per svar mot 497k, Box 2,4 gånger snabbare med 12 % färre tokens, Lovable ungefär en tredjedel färre verktygsanrop och omkring hälften så många shell-körningar, Atlassian upp till 30 % snabbare Rovo Agents, och Base44 3,6 iterationer per bygge mot 7,7 för Claude Opus 5. En omgång som lyckas slår fyra som inte gör det.
Det finns en tredje faktor som verkar i motsatt riktning. Anthropic har flyttat effort till en ratt på modellnivå i den här generationen – Claude Haiku 5.5:s effort-inställning sätts en gång per begäran i stället för att dimensioneras som en tankebudget per begäran, och det gamla budget_tokens-läget är föråldrat på 4.6-modellerna och accepteras inte på senare modeller. För en flotta som anropar ett modell-ID från många tjänster är det en förenkling. För allt som dimensionerade sitt eget resonemang per anrop är det en omskrivning.
Köra båda bakom en och samma slutpunkt
Anledningen till att det är värt att fatta det här beslutet rätt är att den felaktiga halvan av det är dyr att ångra: att koppla om en produktionsväg från ett modell-ID till ett annat innebär att röra varje anropsställe som antog det gamla modell-ID:ts beteende. Det billigare sättet att ta reda på vilken nivå en arbetsbelastning hör hemma på är att köra båda bakom en och samma slutpunkt och flytta trafik mellan dem via konfiguration i stället för via refaktorering.
Det är vad OrcaRouter är till för. Claude Sonnet 5.5 finns i katalogen som anthropic/claude-sonnet-5.5, tillsammans med Claude Sonnet 5, Claude Opus 5.5 och Claude Haiku 4.5 — den äldre Haiku-nivån finns kvar som referenspunkt medan du migrerar bort från den. Plattformen för vidare leverantörens listpris utan påslag, så de 2,00 $ och 10,00 $ som står ovan är priserna du betalar, och detsamma gäller omvänt: när en leverantör ändrar pris är det nya priset live här samma dag, vilket är hur Claude Sonnet 5.5:s sänkning av cache-läsningspriset nådde oss. Två funktioner utför det arbete som just detta beslut kräver. Automatisk failover håller en modell som du fortfarande utvärderar borta från din kritiska väg på egen hand, och routing-DSL:en låter dig skicka anrop under 100 000 token till den billiga nivån och lämna de med lång kontext eller lång horisont till den dyrare i samma anropsflöde, utan ett andra avtal eller ett andra SDK.
För att vara exakt om vad som är och inte är värdbaserat: Claude Sonnet 5.5 kan dirigeras via oss i dag. Claude Haiku 5.5 finns ännu inte i katalogen. Tills dess finns den på Anthropics eget API och de tre molnplattformar som anges ovan.
Hur man bestämmer
Välj Claude Haiku 5.5 när uppgiften är snäv, högvolymig och kontrollerbar — klassificering, extrahering, routning, sammanfattning, arbetet per tur inuti en agent som du redan har byggt. Prisklyftan på 20x är hela poängen där, steget på 100 000 token kan undvikas per konstruktion, och de oberoende uppmätta $0.21 per uppgift visar att vinsten håller även utanför leverantörens eget labb. Ställ in ansträngningsreglaget per uppgiftsklass i stället för att lämna det på standardvärdet; på en modell i Haiku-klassen är skillnaden mellan Low och Max en kostnadsmultiplikator, inte en kvalitetspreferens.
Välj Claude Sonnet 5.5 när uppgiften är långsiktig, agentisk eller overifierbar – kod som måste kompilera, datoranvändning som måste lämna skärmen i ett känt tillstånd, allt där ett felaktigt svar kostar mer än anropet. Terminal-Bench 4.0 med 70,6 % mot 39,2 % är inte en nyans, det är en annan kapacitetsklass, och den platta prislistan innebär att en lång kontext inte i tysthet ändrar priset för hela begäran. Om din arbetsbelastning verkligen ligger mitt emellan är det ärliga svaret att ingen av modellerna ännu har en bred bas av tredjepartsreproduktion bakom sig, att indexpoängen kommer från en enda testrigg och att leverantörens siffror som citeras ovan är leverantörens egna.
Vad skulle ändra det här svaret?
Tre saker är värda att hålla ögonen på, och ingen av dem är benchmark-släpp. Det första är huruvida oberoende utvärderingar av Claude Haiku 5.5 vid effort-nivåerna Low, High och Xhigh – inte bara Max – visar samma kostnad-per-uppgift-kvot, eftersom effort-reglaget är den billigaste hävstången i jämförelsen och den minst mätta. Det andra är huruvida 100 000-token-steget överlever; ett tredje band, eller inget band alls i nästa generation, skulle förändra aritmetiken för varje retrieval-pipeline vid linjen mer än någon enskild benchmark-poäng. Det tredje är tokenizern. Om en senare checkpoint tokeniserar samma text med den äldre frekvensen, blir Anthropics genomsnitt på 75 % ett golv snarare än ett mål, och gapet mot Claude Sonnet 5.5 vidgas utan att något av priserna rör sig.
Jämförda i den här artikeln3
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
