
Daglig AI-brief, 8 okt: Claude Haiku 5.5 landar på $0,10 och cache-läsningarna för Sonnet 5.5 halveras
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Claude Haiku 5.5 släpptes den 7 oktober 2026, och det är det billigaste företaget någonsin har lagt bakom ett API: 0,10 USD per miljon indatatoken och 0,50 USD per miljon utdatatoken för prompter på upp till 100 000 token, med ett kontextfönster på 1M token och en ansträngningsratt som går från Low till Max. Samma dag, utan ett eget lanseringsinlägg, sjönk prompt-cache-läsningar på Claude Sonnet 5.5 från 0,20 USD till 0,10 USD per miljon token. En av dessa är en produkt och den andra är en radpost, och det är radposten som kommer att flytta mer pengar det här kvartalet.
Priset först, eftersom det är den del du kan agera på redan i dag. Sedan ansträngningen, som är den del som i det tysta avgör priset. Sedan cache-prissänkningen, som hälften av alla som betalar för Sonnet 5 inte får reda på förrän på nästa faktura.
Vad Claude Haiku 5.5 är, i den ordning det spelar roll
Leverantörens egen beskrivning är "den billigaste, snabbaste och mest kapabla lilla modell vi någonsin släppt", och releasedatumet är den 7 oktober 2026 – en dag före denna brief. Modell-ID:t är claude-haiku-5-5. Den tar in text och bild, och ger text ut. Kontextfönstret är 1 000 000 tokens, en ökning från 200 000 för Claude Haiku 4.5, och maximal utdata är 128 000 tokens, med ett beta-huvud i Batch-API:et som höjer det till 300 000. Träningsdatan sträcker sig till juni 2026, och Anthropic förbinder sig att inte pensionera den före den 7 oktober 2027.
Det som spelar störst roll för den som dirigerar trafik är inte kontextfönstret. Det är att detta är den första modellen i Haiku-klassen med justerbar ansträngningsnivå. Ansträngningen kan vara Low, Medium, High, Xhigh och Max, standard är Medium, och adaptivt tänkande är aktiverat som standard – en funktion från Sonnet och Opus som nu kommer en nivå ned. Lanseringsinlägget tar också upp två saker som handlar om att köpa snarare än att bygga: månatliga API-krediter för Claude Max- och Team-planer, $100 på Max 5x och $200 på Max 20x med upp till $500 samlade för Team, samt betastöd för computer-use och browser-use i SDK:erna. Säkerheten håller jämna steg med nivån: cyberskydden är strängare än Claude Haiku 4.5:s, förfrågningar om penetrationstestning blockeras fortfarande, och bioskydden matchar dem i Claude Sonnet 5, Claude Sonnet 5.5 och Claude Opus 5.

Priset, och 100 000-tokenstupet mitt i det
Priset i rubriken är 0,10 USD per miljon indatatokens och 0,50 USD per miljon utdatatokens. Läs asterisken: det är priset för prompter på eller under 100 000 tokens. Över 100 000 multipliceras båda siffrorna med fem, till 0,50 USD för indata och 2,50 USD för utdata. Cacheskrivningar kostar 0,125 USD per miljon på femminutersnivån och 0,20 USD på entimmarsnivån inom det billiga intervallet, och cacheläsningar kostar 0,01 USD per miljon – en tiondel av indatapriset, vilket är den djupaste cacherabatten Anthropic har publicerat för någon modell. Batch halverar allt igen: 0,05 USD och 0,25 USD inom det billiga intervallet, 0,25 USD och 1,25 USD över det.
Jämför det med Claude Haiku 4.5, som fortfarande finns kvar på prislistan till ett fast pris på 1,00 USD för indata och 5,00 USD för utdata, utan kontextbaserad nivåindelning, en cacheläsning på 0,10 USD och ett fönster på 200 000 token. Den nya modellen kostar en tiondel så mycket för samma promptform, med fem gånger så stor kontext. Det finns ingen migrationskalkyl att göra här; aritmetiken är inte ens nära.
Stupet är den delen man måste designa kring. En prompt på 99 000 tokens kostar 99 cent per tusen anrop vid indatapriset. En prompt på 101 000 tokens kostar 5,05 dollar per tusen anrop. Två tusen tokens skillnad ger en fem gånger så hög kostnad, så allt du bygger i det billiga prisbandet bör antingen ligga bekvämt under 100 000 tokens eller medvetet och konsekvent ligga över det — det sämsta utfallet är en pipeline som ligger på båda sidor om gränsen och betalar den höga taxan för hälften av sin trafik.
Ansträngning är nu en prissättningsparameter, och standardvalet är inte det billigaste
Eftersom effort som standard är Medium och tänkande är på som standard, är prislappen och det verkliga priset inte samma siffra. Resonemangstokens faktureras som utdatatokens. I Anthropics egen publicerade körning av Artificial Analysis Intelligence Index – leverantörsrapporterad, inte reproducerad av oss – avger Claude Haiku 5.5 ungefär 162 000 tokens per uppgift, varav omkring 129 000 är resonemang. Medianmodellen i indexet avger i storleksordningen 100 miljoner tokens i hela sviten; Haiku 5.5 gör av med 440 miljoner. Med 0,50 dollar per miljon utdatatokens är den ordrikedomen överkomlig, och det är precis poängen: i Haiku 5.5:s takt är det fortfarande billigare att tänka mycket än att tänka lite på en modell som debiterar 5,00 dollar för utdata.
Ställ in effort på Low för klassificering, extrahering och routingbeslut där du vill ha ett snabbt svar snarare än ett genomtänkt, och låt det stå kvar på Medium för allt som en användare kommer att läsa. Att sänka till Low är också det pålitliga sättet att hålla en ordrik agent inom bandet på 100 000 token, eftersom det minskar antalet resonemangstoken innan det minskar svarskvaliteten.
Den tystare raden: Sonnet 5.5 cache-läsningar halverade
Claude Sonnet 5.5 läser cachad prompt för 0,10 USD per miljon tokens från och med den 7 oktober, ned från 0,20 USD. Sonnet 5.5:s inputpris är 2,00 USD och dess outputpris är 10,00 USD, så en cache-läsningsmultiplikator på 0,05x är nu samma multiplikator som Haiku 5.5 har, tillämpad på en tjugo gånger högre inputtaxa. Anthropics egen uppskattning är att detta minskar kostnaden för de flesta agentiska arbeten med omkring 20 %, vilket är ett påstående om arbetsbelastningens form snarare än ett benchmark: det håller bara om en stor andel av din input är ett stabilt prefix som du skickar igen varje tur. Om dina promptar är unika vid varje anrop kostar den här ändringen dig ingenting och sparar dig ingenting.
Värt att notera vad sänkningen innebär. Anthropic prissätter långlivade prefix aggressivt på mellanklassmodellen precis i samma stund som man lanserar en mycket billig liten modell, vilket framstår som ett argument för en tvåmodellsarkitektur: en Sonnet 5.5-del med en het cache för arbetet som kräver bedömning, och en Haiku 5.5-del för den volym som inte kräver det.
Vad de oberoende siffrorna visar, en dag in
Artificial Analysis lät poängsätta Claude Haiku 5.5 dagen efter lanseringen. Dess Intelligence Index ligger på 43 totalt, med Max-effort-konfigurationen rapporterad till 43,40, nummer två av 182 modeller på listan. Kostnaden per indexuppgift är 0,21 USD, den fyrtiosjätte billigaste. Blandpriset för en 7:2:1-mix av indata:cachad indata:utdata är 0,08 USD per miljon, vilket är siffran som får den tidigare nivåjämförelsen att kännas orättvis mot allt annat. Utdatashastigheten är 243,4 token per sekund, nionde snabbast på listan, med en rapporterad latens för första token på cirka 0,3 sekunder och 90 % cacherebatt.
Den där utdatasiffran på 440 miljoner tokens är förbehållet som är kopplat till 43:an. Poängen är verklig och oberoende framtagen; detsamma gäller mångordigheten. En modell som tänker så här mycket är billig per token och inte alltid billig per uppgift, och gapet mellan dessa två siffror är där ett routingbeslut faktiskt ligger.
För att sätta det i perspektiv placerar Anthropics egna publicerade jämförelser Claude Haiku 5.5 på 1620 i GDPval-AA v2.1 mot 735 för Claude Haiku 4.5, 72,4 % i OSWorld 2.1 mot 15,7 %, 45,9 % i Humanity's Last Exam utan verktyg mot 10,2 % och 39,2 % i Terminal-Bench 4.0 mot 0,0 %. Det är leverantörsrapporterade siffror från leverantörsvalda utvärderingar och bör läsas som riktningsvisande, men riktningen är inte subtil – detta är inte en liten uppgradering av en liten modell.

Att komma åt dessa modeller utan ett andra avtal
Claude Haiku 5.5 är tillgänglig via Anthropics eget API och, därifrån, överallt där Anthropics modeller säljs vidare. I OrcaRouters katalog består Anthropic-serien i dag av anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 och anthropic/claude-fable-5.1 – vi hostar inte Claude Haiku 5.5, och den här briefen tänker inte låtsas något annat. Det vi faktiskt erbjuder är nivån över den, och OrcaRouter förmedlar leverantörens listpris vidare med 0 % påslag, vilket är varför sänkningen av priset för cache-läsning i Sonnet 5.5 dök upp i vår prissättning samma dag som Anthropic införde den, i stället för i en schemalagd omprissättningscykel.
Den praktiska versionen: om du vill prova Haiku 5.5 på en klassificeringsgren medan din bedömningsgren ligger kvar på Claude Sonnet 5.5, sitter du med två nycklar i stället för en, och det är i routinglagret som A/B-testet avgörs. Det är hela argumentet för en gateway framför en direktintegration – en slutpunkt, modellsträngar och en failover-väg när en leverantör vacklar.

Vad att se upp för härifrån
Tre saker. Huruvida tredjepartsleverantörer börjar återförsälja Haiku 5.5 till en blandad taxa under 0,10 USD, vilket är den punkt där routningslagret börjar betala sig snarare än att bara förenkla inköp. Huruvida Anthropic utökar gränsen för 100 000-token-nivån, eftersom ett stup vid exakt 100 000 är en märklig plats för en modell med ett fönster på 1M token att ha ett. Och huruvida siffran för 440 miljoner token i verbositet sjunker i en punktrelease, eftersom det enskilda numret är det som står mellan Haiku 5.5 och att vara det självklara standardvalet för hela den nedre halvan av en produktionsstack.
