Ett genererat hero-kort med texten 'Daglig AI-brief — 8 oktober 2026' och ett NYHETS-märke, rubriken 'Claude Haiku 5.5 släpps, och cacheläsningar för Sonnet 5.5 halveras', samt fyra chips med texten $0.10 / $0.50 per 1M, 1M-tokenskontext, Medium som standardansträngning och cacheläsning från $0.20 till $0.10.
Engineering & Research

Daglig AI-brief, 8 okt: Claude Haiku 5.5 landar på $0,10 och cache-läsningarna för Sonnet 5.5 halveras

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Claude Haiku 5.5 släpptes den 7 oktober 2026, och det är det billigaste företaget någonsin har lagt bakom ett API: 0,10 USD per miljon indatatoken och 0,50 USD per miljon utdatatoken för prompter på upp till 100 000 token, med ett kontextfönster på 1M token och en ansträngningsratt som går från Low till Max. Samma dag, utan ett eget lanseringsinlägg, sjönk prompt-cache-läsningar på Claude Sonnet 5.5 från 0,20 USD till 0,10 USD per miljon token. En av dessa är en produkt och den andra är en radpost, och det är radposten som kommer att flytta mer pengar det här kvartalet.

Priset först, eftersom det är den del du kan agera på redan i dag. Sedan ansträngningen, som är den del som i det tysta avgör priset. Sedan cache-prissänkningen, som hälften av alla som betalar för Sonnet 5 inte får reda på förrän på nästa faktura.

Vad Claude Haiku 5.5 är, i den ordning det spelar roll

Leverantörens egen beskrivning är "den billigaste, snabbaste och mest kapabla lilla modell vi någonsin släppt", och releasedatumet är den 7 oktober 2026 – en dag före denna brief. Modell-ID:t är claude-haiku-5-5. Den tar in text och bild, och ger text ut. Kontextfönstret är 1 000 000 tokens, en ökning från 200 000 för Claude Haiku 4.5, och maximal utdata är 128 000 tokens, med ett beta-huvud i Batch-API:et som höjer det till 300 000. Träningsdatan sträcker sig till juni 2026, och Anthropic förbinder sig att inte pensionera den före den 7 oktober 2027.

Det som spelar störst roll för den som dirigerar trafik är inte kontextfönstret. Det är att detta är den första modellen i Haiku-klassen med justerbar ansträngningsnivå. Ansträngningen kan vara Low, Medium, High, Xhigh och Max, standard är Medium, och adaptivt tänkande är aktiverat som standard – en funktion från Sonnet och Opus som nu kommer en nivå ned. Lanseringsinlägget tar också upp två saker som handlar om att köpa snarare än att bygga: månatliga API-krediter för Claude Max- och Team-planer, $100 på Max 5x och $200 på Max 20x med upp till $500 samlade för Team, samt betastöd för computer-use och browser-use i SDK:erna. Säkerheten håller jämna steg med nivån: cyberskydden är strängare än Claude Haiku 4.5:s, förfrågningar om penetrationstestning blockeras fortfarande, och bioskydden matchar dem i Claude Sonnet 5, Claude Sonnet 5.5 och Claude Opus 5.

A capture of Anthropic's Claude Haiku 5.5 announcement page showing the October 7, 2026 date, the headline framing Claude Haiku 5.5 as a performance, pricing and safety upgrade, and the on-page sections for Performance, Pricing, Safety and Further updates.

Priset, och 100 000-tokenstupet mitt i det

Priset i rubriken är 0,10 USD per miljon indatatokens och 0,50 USD per miljon utdatatokens. Läs asterisken: det är priset för prompter på eller under 100 000 tokens. Över 100 000 multipliceras båda siffrorna med fem, till 0,50 USD för indata och 2,50 USD för utdata. Cacheskrivningar kostar 0,125 USD per miljon på femminutersnivån och 0,20 USD på entimmarsnivån inom det billiga intervallet, och cacheläsningar kostar 0,01 USD per miljon – en tiondel av indatapriset, vilket är den djupaste cacherabatten Anthropic har publicerat för någon modell. Batch halverar allt igen: 0,05 USD och 0,25 USD inom det billiga intervallet, 0,25 USD och 1,25 USD över det.

Jämför det med Claude Haiku 4.5, som fortfarande finns kvar på prislistan till ett fast pris på 1,00 USD för indata och 5,00 USD för utdata, utan kontextbaserad nivåindelning, en cacheläsning på 0,10 USD och ett fönster på 200 000 token. Den nya modellen kostar en tiondel så mycket för samma promptform, med fem gånger så stor kontext. Det finns ingen migrationskalkyl att göra här; aritmetiken är inte ens nära.

Stupet är den delen man måste designa kring. En prompt på 99 000 tokens kostar 99 cent per tusen anrop vid indatapriset. En prompt på 101 000 tokens kostar 5,05 dollar per tusen anrop. Två tusen tokens skillnad ger en fem gånger så hög kostnad, så allt du bygger i det billiga prisbandet bör antingen ligga bekvämt under 100 000 tokens eller medvetet och konsekvent ligga över det — det sämsta utfallet är en pipeline som ligger på båda sidor om gränsen och betalar den höga taxan för hälften av sin trafik.

Ansträngning är nu en prissättningsparameter, och standardvalet är inte det billigaste

Eftersom effort som standard är Medium och tänkande är på som standard, är prislappen och det verkliga priset inte samma siffra. Resonemangstokens faktureras som utdatatokens. I Anthropics egen publicerade körning av Artificial Analysis Intelligence Index – leverantörsrapporterad, inte reproducerad av oss – avger Claude Haiku 5.5 ungefär 162 000 tokens per uppgift, varav omkring 129 000 är resonemang. Medianmodellen i indexet avger i storleksordningen 100 miljoner tokens i hela sviten; Haiku 5.5 gör av med 440 miljoner. Med 0,50 dollar per miljon utdatatokens är den ordrikedomen överkomlig, och det är precis poängen: i Haiku 5.5:s takt är det fortfarande billigare att tänka mycket än att tänka lite på en modell som debiterar 5,00 dollar för utdata.

Ställ in effort på Low för klassificering, extrahering och routingbeslut där du vill ha ett snabbt svar snarare än ett genomtänkt, och låt det stå kvar på Medium för allt som en användare kommer att läsa. Att sänka till Low är också det pålitliga sättet att hålla en ordrik agent inom bandet på 100 000 token, eftersom det minskar antalet resonemangstoken innan det minskar svarskvaliteten.

Den tystare raden: Sonnet 5.5 cache-läsningar halverade

Claude Sonnet 5.5 läser cachad prompt för 0,10 USD per miljon tokens från och med den 7 oktober, ned från 0,20 USD. Sonnet 5.5:s inputpris är 2,00 USD och dess outputpris är 10,00 USD, så en cache-läsningsmultiplikator på 0,05x är nu samma multiplikator som Haiku 5.5 har, tillämpad på en tjugo gånger högre inputtaxa. Anthropics egen uppskattning är att detta minskar kostnaden för de flesta agentiska arbeten med omkring 20 %, vilket är ett påstående om arbetsbelastningens form snarare än ett benchmark: det håller bara om en stor andel av din input är ett stabilt prefix som du skickar igen varje tur. Om dina promptar är unika vid varje anrop kostar den här ändringen dig ingenting och sparar dig ingenting.

Värt att notera vad sänkningen innebär. Anthropic prissätter långlivade prefix aggressivt på mellanklassmodellen precis i samma stund som man lanserar en mycket billig liten modell, vilket framstår som ett argument för en tvåmodellsarkitektur: en Sonnet 5.5-del med en het cache för arbetet som kräver bedömning, och en Haiku 5.5-del för den volym som inte kräver det.

Vad de oberoende siffrorna visar, en dag in

Artificial Analysis lät poängsätta Claude Haiku 5.5 dagen efter lanseringen. Dess Intelligence Index ligger på 43 totalt, med Max-effort-konfigurationen rapporterad till 43,40, nummer två av 182 modeller på listan. Kostnaden per indexuppgift är 0,21 USD, den fyrtiosjätte billigaste. Blandpriset för en 7:2:1-mix av indata:cachad indata:utdata är 0,08 USD per miljon, vilket är siffran som får den tidigare nivåjämförelsen att kännas orättvis mot allt annat. Utdatashastigheten är 243,4 token per sekund, nionde snabbast på listan, med en rapporterad latens för första token på cirka 0,3 sekunder och 90 % cacherebatt.

Den där utdatasiffran på 440 miljoner tokens är förbehållet som är kopplat till 43:an. Poängen är verklig och oberoende framtagen; detsamma gäller mångordigheten. En modell som tänker så här mycket är billig per token och inte alltid billig per uppgift, och gapet mellan dessa två siffror är där ett routingbeslut faktiskt ligger.

För att sätta det i perspektiv placerar Anthropics egna publicerade jämförelser Claude Haiku 5.5 på 1620 i GDPval-AA v2.1 mot 735 för Claude Haiku 4.5, 72,4 % i OSWorld 2.1 mot 15,7 %, 45,9 % i Humanity's Last Exam utan verktyg mot 10,2 % och 39,2 % i Terminal-Bench 4.0 mot 0,0 %. Det är leverantörsrapporterade siffror från leverantörsvalda utvärderingar och bör läsas som riktningsvisande, men riktningen är inte subtil – detta är inte en liten uppgradering av en liten modell.

A generated single-column scoreboard titled 'Claude Haiku 5.5 — the scoreboard' listing an Artificial Analysis Intelligence Index of 43 ranked second of 182, a cost per index task of $0.21, a blended price of $0.08 per million tokens, output speed of 243.4 tokens per second, a 1M-token context window and a $0.01-per-million cache read.

Att komma åt dessa modeller utan ett andra avtal

Claude Haiku 5.5 är tillgänglig via Anthropics eget API och, därifrån, överallt där Anthropics modeller säljs vidare. I OrcaRouters katalog består Anthropic-serien i dag av anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 och anthropic/claude-fable-5.1 – vi hostar inte Claude Haiku 5.5, och den här briefen tänker inte låtsas något annat. Det vi faktiskt erbjuder är nivån över den, och OrcaRouter förmedlar leverantörens listpris vidare med 0 % påslag, vilket är varför sänkningen av priset för cache-läsning i Sonnet 5.5 dök upp i vår prissättning samma dag som Anthropic införde den, i stället för i en schemalagd omprissättningscykel.

Den praktiska versionen: om du vill prova Haiku 5.5 på en klassificeringsgren medan din bedömningsgren ligger kvar på Claude Sonnet 5.5, sitter du med två nycklar i stället för en, och det är i routinglagret som A/B-testet avgörs. Det är hela argumentet för en gateway framför en direktintegration – en slutpunkt, modellsträngar och en failover-väg när en leverantör vacklar.

A capture of the OrcaRouter models catalogue showing the filterable model list with input-modality, context-length, input-price, status and series filters, the line counting the model list and providers on one API key and one bill, and model cards carrying per-million input and output prices.

Vad att se upp för härifrån

Tre saker. Huruvida tredjepartsleverantörer börjar återförsälja Haiku 5.5 till en blandad taxa under 0,10 USD, vilket är den punkt där routningslagret börjar betala sig snarare än att bara förenkla inköp. Huruvida Anthropic utökar gränsen för 100 000-token-nivån, eftersom ett stup vid exakt 100 000 är en märklig plats för en modell med ett fönster på 1M token att ha ett. Och huruvida siffran för 440 miljoner token i verbositet sjunker i en punktrelease, eftersom det enskilda numret är det som står mellan Haiku 5.5 och att vara det självklara standardvalet för hela den nedre halvan av en produktionsstack.