
Claude Haiku 5.5: En prissänkning på 90 %, en ny tokenizer och videon som Anthropic inte publicerade
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Någon skrev en enda mening i Claude Haiku 5.5 och fick tillbaka en färdig lanseringsfilm. Prompten, som publicerades på X på kvällen den 7 oktober 2026, lyder i sin helhet: "gör en tio gånger så banger video för din lansering som visar hur bra rörelsedesigner du är." Inläggets bildtext är tre ord lång – "One shotted this video" – och inlägget har klippet som bilaga. Inga nya försök, ingen storyboard, ingen redigerare. Om det är vad den billigaste modellen i Claude-serien gör nu, har nivån slutat vara en kompromiss.
Det är den intressanta halvan av lanseringen. Den andra halvan är aritmetik, och det är där den egentliga nyheten ligger: Claude Haiku 5.5 kostar 0,10 USD per miljon indatatokens och 0,50 USD per miljon utdatatokens för prompter på upp till 100 000 tokens, mot Claude Haiku 4.5:s fasta priser på 1 och 5 USD. Anthropics egen fotnot beskriver det som 90 % lägre i normalfallet — och säger sedan, i samma andetag, att siffran en köpare bör planera utifrån ligger närmare 75 %. Båda siffrorna är korrekta, och gapet mellan dem är det viktigaste i det här släppet.
Vad Anthropic förde till protokollet den 7 oktober
Leverantörens lanseringsinlägg och dess prisdokumentation stämmer överens om hur saken ser ut, och det är ett större steg än vad en prissänkning vanligtvis för med sig.

• Pris — 0,10 USD per miljon indatatoken och 0,50 USD per miljon utdatatoken för promptar upp till 100 000 token. Över den tröskeln debiteras samma begäran med 0,50 USD och 2,50 USD. Cacheläsningar kostar 0,01 USD per miljon upp till 100K och 0,05 USD över det; cacheskrivningar kostar 0,125 USD och 0,625 USD.
• Kontext — 1M tokens, med en maximal utdata på 128 000 tokens. Det är samma fönster och samma utdatatak som Claude Fable 5.1, Claude Opus 5.5 och Claude Sonnet 5.5 har, reproducerat på den billigaste nivån.
• Tänkande — adaptivt tänkande med effort-parametern, med medium som standard. Anthropic uppger att detta är den första Haiku-klassmodellen med en justerbar effort-inställning, vilket innebär att samma modell-id kan köras billigt eller köras försiktigt utan att något annat ändras.
• Tokenizer — den nyare tokenizern som delas med Claude 4.7 och senare, och som "producerar ungefär 30 % fler tokens för samma text." Anthropics dokumentation säger att den exakta ökningen beror på innehållet och arbetsbelastningens utformning.
• Livscykel — kunskapsgräns juni 2026, och ett utfasningsåtagande om "inte tidigare än 7 oktober 2027."
• Tillgänglighet — Claude API, Amazon Web Services, Google Cloud, Microsoft Azure och Claude Platform på AWS, allt på en gång redan från dag ett.
10x-klistermärket och 75%-verkligheten
Tio gånger billigare är siffran som kommer att spridas längst, och det är den som med störst sannolikhet hamnar på fel plats i någons budgetmodell. Det gäller prompter på upp till 100 000 tokens. Haiku 5.5 har inte den taxan under hela fönstret.
• Upp till 100 000 tokens – 0,10 USD in och 0,50 USD ut, jämfört med Haiku 4.5:s 1 USD och 5 USD. Det är en sänkning med 90 %, och Anthropic säger att 90 % av förfrågningarna till den tidigare Haiku-modellen hamnade i detta intervall.
• Över 100 000 tokens – $0,50 in och $2,50 ut. Fortfarande exakt hälften av vad Haiku 4.5 tog för samma begäran, utan något tak att slå i.
• Tokeniseraren – samma text blir ungefär 30 % fler tokens än den gjorde på Haiku 4.5, så sänkningen per token leder inte en-till-en till en lägre räkning.
• Leverantörens eget genomsnitt – Anthropic framställer kombinationen som "ungefär 75 % mindre att köra". Det är dess siffra, inte en oberoende mätning, och det är den man ska sätta i en prognos.
• Cache-ekonomi — cacheläsningar sjönk från 0,10 USD till 0,01 USD per miljon i det vanliga intervallet, vilket väger tyngre än indatapriset för varje pipeline som skickar om ett långt delat prefix.
Siffran 75 % förklarar också något som en läsare annars skulle kunna läsa som en motsägelse. De två rubriksiffrorna står inte i konflikt med varandra; den ena är en andel för en förfrågningsform, den andra är en sammanslagen uppskattning över en verklig trafikmix som inkluderar minoriteten över 100K och tokenizerns extra tokens. Om du modellerar utgifter bör du använda 75 % och kontrollera din egen promptlängdfördelning innan du tror på något bättre.
Vad videon påstår, och vad den inte påstår
Klippet är äkta, prompten citeras ordagrant ovan, och tidsstämpeln – 19:49 UTC den 7 oktober, ungefär samma dag som modellen lanserades – går att kontrollera. Tillskrivningen är till en enskild användare, inte till Anthropic.
Den distinktionen spelar roll här, eftersom Anthropics egen produktsida för Claude Haiku 5.5 inte innehåller någon inbäddad video alls: ingen spelare, ingen mediefil, bara en länk till företagets YouTube-kanal. Om en lanseringsfilm gjordes med modellen har leverantören inte sagt det. Så det korrekta påståendet är snävt: en användare rapporterar att ha genererat en lanseringsvideo i ett svep med Claude Haiku 5.5 och publicerade prompten. Huruvida det är i ett svep, vad det kostade och hur mycket av det som överlevde redigeringen är alla påståenden från en enda källa. Behandla klippet som en demonstration, inte som ett riktmärke.
Anledningen till att det ändå är värt att nämna är att videogenerering inte ingår i modellens specifikation. Haiku 5.5 tar in text och bilder och returnerar text. Ett motion-design-resultat av den kvaliteten antyder att modellen drev något annat — en kodgenererande väg, en renderingspipeline, en verktygsslinga — snarare än att den själv producerade bildrutor. Det är ett påstående om agentisk orkestrering vid $0.10 input, vilket är den egentligen förvånande delen.
Siffrorna som Anthropic publicerade
Leverantörens lanseringstabell är en före-och-efter-jämförelse mot Haiku 4.5, med GPT-6 Luna och Claude Sonnet 5.5 i samma kolumner för skala. Varje siffra nedan är Anthropics egenrapporterade utvärderingsresultat, kört i Anthropics testramverk, och återges men är inte oberoende verifierat.

• Kunskapsarbete – GDPval-AA v2.1 på 1620 mot Haiku 4.5:s 735, GPT-6 Lunas 1437 och Sonnet 5.5:s 1840. AA-Briefcase v1.1 på 1578 mot 614, 1336 och 1824.
• Datoranvändning — OSWorld 2.1 på 72,4 % i offline-delmängden, mot 15,7 % för Haiku 4.5, 48,9 % för GPT-6 Luna och 83,9 % för Sonnet 5.5.
• Multidisciplinärt resonemang – Humanity's Last Exam på 45,9 % utan verktyg och 57,4 % med dem, jämfört med 10,2 % och 18,7 % för Haiku 4.5.
• Agentisk kodning — Terminal-Bench 4.0 på 39,2 % mot 0,0 %, 16,4 % och 70,6 %. FrontierCode 1.1 (Main) på 46,4 % mot 42,4 % för GPT-6 Luna och 52,1 % för Sonnet 5.5.
• Visuellt resonemang — Chartography på 46,4 % utan verktyg, jämfört med 6,4 %, 29,1 % och 61,6 %.
Anthropic är också ovanligt direkt om var den lilla modellklassen inte vinner. Dess egen kommentar till Terminal-Bench-diagrammet säger att Sonnet 5.5 och Opus 5.5 ”förblir bättre val för komplexa agentiska kodningsuppgifter”, och positionerar i stället Haiku 5.5 för komprimering, sammanfattning och subagent-arbete. Kundcitaten i inlägget pekar i samma riktning och bär samma förbehåll – dessa är partner med tidig åtkomst som beskriver sina egna utvärderingar, inte revisioner: Asana rapporterar över 30 % lägre latens för slutförande av uppgifter och upp till 2,5 gånger snabbare inferens per agenttur; HubSpot rapporterar 92,8 % i genomsnitt över tre körningar på en CRM-portalsvit; AlphaSense rapporterar 0,84 mot 0,76 över 400 frågor i en arbetsbelastning med cirka 8 miljoner anrop i veckan; Box rapporterar 11 punkter högre än Haiku 4.5 vid ungefär halva latensen; Rogo beskriver en Haiku 5.5-subagent som drar ut en segmentsintäktsrad ur en 10-K; och Cognition rapporterar att Devin Fusion har en FrontierCode-poäng på 66,2 med Haiku 5.5 som sidekick.
Vad den oberoende styrelsen säger
Leverantörstabellerna är leverantörens. Den första placeringen utanför är det mer användbara numret för alla som ska avgöra om nivån har flyttats tillräckligt långt för att ändra en produktionspipeline.

Artificial Analysis ger Claude Haiku 5.5 betyget 43 på sitt Intelligence Index v4.3.2 i modellens Max-konfiguration, rankad som tvåa av de 182 modellerna på den listan och långt över listans median på 13. Samma sida uppmäter 242 utdatatokens per sekund – nionde av 182 – och en kostnad på 0,21 USD per uppgift i Intelligence Index.
Två saker på den sidan är värda mer än rubriken. Den första är ordrikedom: vid utvärderingen av Index registrerade Artificial Analysis 440 miljoner utdatatoken, mot en median på 100 miljoner, och beskriver modellen som "mycket ordrik." Priset tas ut per token, så en modell som tänker länge får betala för det — vilket är precis varför kostnaden per uppgift ligger på 0,21 dollar i stället för nära noll, och varför den 90-procentiga minskningen av indata inte är hela historien. Den andra är ansträngningsstegen: samma sida visar konfigurationer från Max ner till Low, och Anthropics standardinställning är medium, inte max. Siffran 43 på resultattavlan är toppen av den stegen, inte den inställning du får om du inte gör något.
Att köra nivån under den nivå du redan kan anropa
Claude Haiku 5.5 finns inte i OrcaRouters katalog, och det vore värt att säga det rakt ut i stället för att antyda något annat: gapet på lanseringsdagen mellan att en modell existerar och att en modell går att routa är vanligtvis några dagar, och ibland längre.
Det som finns i Anthropics katalog i dag är Claude Haiku 4.5, Claude Sonnet 5.5 och Claude Opus 5.5, vardera till leverantörens listpris vidarebefordrat med 0 % påslag, så varje sänkning Anthropic gör slår igenom på vår sida samma dag som den slår igenom på deras. Det är den praktiska bryggan för den som vill testa subagent-mönstret redan nu: en kaskad som skickar de rutinmässiga turerna till Haiku 4.5 och eskalerar de svåra uppåt fungerar i dag under en och samma nyckel och SDK, och att senare byta ut det lilla benet mot Haiku 5.5 är ett byte av modell-id snarare än en migrering. Automatisk failover ligger under vilka ben du än väljer, så en enda leverantörs dåliga eftermiddag tar inte med sig pipelinen.
Om du helst vill slippa vänta helt, är samma $0.10-prisband för indata redan upptaget av GPT-6 Luna, som vi faktiskt routar, och som håller den prisnivån upp till 272 000 tokens innan den trappas upp.
Vilka bör flytta, och vilka bör inte
Om din arbetsbelastning består av klassificering, extraktion, routning, komprimering eller sammanfattning i stor volym, och dina prompter ligger under 100 000 tokens, är saken enkel: kostnaden är en tiondel av vad den var, fönstret är fem gånger bredare, och reglaget för ansträngning låter dig växla åt andra hållet när en begäran kräver det. Räkna med cirka 75 % lägre, så blir du inte överraskad.
Om dina prompter rutinmässigt passerar 100 000 tokens köper du en 50-procentig prissänkning i stället för en 90-procentig, och att jämföra priser för djup kontext är fortfarande värt en eftermiddag — marknaden har flera modeller till eller under den här nivåns pris för över 100K.
Och om din utvärdering fortfarande misslyckas med Terminal-Bench-liknande arbete, är detta inte modellen som fixar det; det säger Anthropic själva, och 39,2 % mot Sonnet 5.5:s 70,6 % är det tydligaste beviset i inlägget. Den ärliga sammanfattningen av den 7 oktober är att golvet för användbar intelligens sjönk långt och taket rörde sig inte alls.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
