
Dagelijkse AI-brief, 8 okt.: Claude Haiku 5.5 verschijnt voor $0,10 en cache-reads van Sonnet 5.5 halveren
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Claude Haiku 5.5 is uitgebracht op 7 oktober 2026, en het is het goedkoopste dat het bedrijf ooit achter een API heeft gezet: $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens bij prompts tot 100.000 tokens, met een contextvenster van 1M tokens en een effort-dial die loopt van Low tot Max. Dezelfde dag daalden, zonder eigen lanceringsbericht, de prompt-cache-reads op Claude Sonnet 5.5 van $0,20 naar $0,10 per miljoen tokens. Een van die twee is een product en de andere is een regelpost, en de regelpost is degene die dit kwartaal meer geld in beweging zal brengen.
Eerst de prijs, want dat is het deel waar je vandaag iets aan kunt doen. Dan effort, het ding dat stilletjes de prijs bepaalt. Dan de cacheverlaging, waar de helft van de mensen die voor Sonnet 5.5 betalen pas bij hun volgende factuur van hoort.
Wat Claude Haiku 5.5 is, in volgorde van belangrijkheid
De leverancier zelf omschrijft het als "het goedkoopste, snelste en meest capabele kleine model dat we ooit hebben uitgebracht", en de releasedatum is 7 oktober 2026 — één dag vóór deze briefing. Het model-ID is claude-haiku-5-5. Het is tekst en afbeelding in, tekst uit. Het contextvenster bedraagt 1.000.000 tokens, een stijging ten opzichte van 200.000 bij Claude Haiku 4.5, en de maximale uitvoer is 128.000 tokens, waarbij een bètaheader op de Batch API dat verhoogt naar 300.000. De trainingsafsluiting is juni 2026, en Anthropic belooft het model niet buiten gebruik te stellen vóór 7 oktober 2027.
Het belangrijkste punt voor iedereen die verkeer routeert, is niet het contextvenster. Het is dat dit het eerste model in de Haiku-klasse is met aanpasbare inspanning. De inspanning kent Low, Medium, High, Xhigh en Max, de standaard is Medium, en adaptief denken staat standaard aan — een functie van Sonnet en Opus die een niveau lager beschikbaar komt. De lanceringspost bevat ook twee zaken die over kopen gaan in plaats van bouwen: maandelijkse API-credits voor Claude Max- en Team-abonnementen, $100 bij Max 5x en $200 bij Max 20x met tot $500 gebundeld voor Team, en bètaondersteuning voor computer-use en browser-use in de SDK's. Veiligheid houdt gelijke tred met het niveau: de cyberwaarborgen zijn strenger dan die van Claude Haiku 4.5, waarbij penetratietestverzoeken nog steeds worden geblokkeerd, en de waarborgen voor biologie komen overeen met die van Claude Sonnet 5, Claude Sonnet 5.5 en Claude Opus 5.

De prijs, en de kloof van 100.000 tokens middenin
Het hoofdtarief is $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens. Lees het sterretje: dat is het tarief voor prompts van maximaal 100.000 tokens. Boven 100.000 worden beide getallen met vijf vermenigvuldigd, naar $0,50 voor input en $2,50 voor output. Cacheschrijfacties kosten $0,125 per miljoen op het vijfminutenniveau en $0,20 op het niveau van één uur binnen de goedkope band, en cachelezingen kosten $0,01 per miljoen — een tiende van het inputtarief, de diepste cachekorting die Anthropic voor enig model heeft gepubliceerd. Batch halveert alles nog een keer: $0,05 en $0,25 binnen de goedkope band, $0,25 en $1,25 daarboven.
Vergelijk dat met Claude Haiku 4.5, dat nog steeds op de prijslijst staat tegen een vast tarief van $1,00 voor input en $5,00 voor output, zonder contextgebaseerde staffeling, een cacheread van $0,10 en een venster van 200.000 tokens. Het nieuwe model is een tiende van de prijs bij dezelfde promptvorm, met vijf keer zoveel context. Er hoeft hier geen migratieafweging te worden gemaakt; de cijfers liggen niet eens dicht bij elkaar.
De klif is het deel waar je omheen ontwerpt. Een prompt van 99.000 tokens kost 99 cent per duizend aanroepen tegen het invoertarief. Een prompt van 101.000 tokens kost $5,05 per duizend. Tweeduizend tokens verschil betekent een 5x zo hoge rekening, dus alles wat je in de goedkope band bouwt, moet of ruim onder 100.000 tokens blijven of er bewust en consistent overheen gaan — de slechtste uitkomst is een pipeline die op de grens balanceert en op de helft van het verkeer het hoge tarief betaalt.
Inspanning is nu een prijsparameter, en de standaard is niet de goedkoopste.
Omdat inspanning standaard op Medium staat en denken standaard aan staat, zijn de stickerprijs en de werkelijke prijs niet hetzelfde bedrag. Redeneertokens worden als outputtokens gefactureerd. In Anthropics eigen gepubliceerde run van de Artificial Analysis Intelligence Index — door de leverancier gerapporteerd, niet door ons gereproduceerd — genereert Claude Haiku 5.5 ruwweg 162.000 tokens per taak, waarvan er ongeveer 129.000 redeneertokens zijn. Het mediane model in de index genereert in de orde van 100 miljoen tokens over de hele suite; Haiku 5.5 verbruikt 440 miljoen. Bij $0,50 per miljoen outputtokens is die breedsprakigheid betaalbaar, en dat is precies het punt: tegen het tarief van Haiku 5.5 is veel denken nog steeds goedkoper dan een beetje denken op een model dat $5,00 voor output rekent.
Stel effort in op Low voor classificatie-, extractie- en routeringsbeslissingen waarbij je een snel antwoord wilt in plaats van een weloverwogen antwoord, en laat het op Medium staan voor alles wat een gebruiker zal lezen. Terugschakelen naar Low is ook de betrouwbare manier om een breedsprakige agent binnen de band van 100.000 tokens te houden, omdat het redeneertokens vermindert voordat het de antwoordkwaliteit vermindert.
De stillere lijn: Sonnet 5.5 cache-reads gehalveerd
Claude Sonnet 5.5 leest een gecachte prompt tegen $0,10 per miljoen tokens per 7 oktober, tegenover $0,20 voorheen. De inputprijs van Sonnet 5.5 is $2,00 en de outputprijs is $10,00, dus een cache-leesvermenigvuldiger van 0,05x is nu dezelfde factor die Haiku 5.5 heeft, toegepast op een twintig keer zo hoog inputtarief. Anthropics eigen schatting is dat dit de kosten van de meeste agentische werkzaamheden met ongeveer 20% verlaagt, wat een bewering is over de vorm van de workload en niet over een benchmark: die geldt alleen als een groot deel van je input een stabiele prefix is die je bij elke beurt opnieuw verstuurt. Als je prompts bij elke aanroep uniek zijn, kost deze wijziging je niets en bespaart ze je niets.
De moeite waard om te vermelden wat de verlaging impliceert. Anthropic prijst langlevende prefixen agressief op het middenklassemodel precies op het moment dat het een zeer goedkoop klein model uitbrengt, wat leest als een pleidooi voor een tweemodelarchitectuur: een Sonnet 5.5-poot met een warme cache voor het werk dat beoordelingsvermogen vereist, en een Haiku 5.5-poot voor het volume dat dat niet doet.
Wat de onafhankelijke cijfers laten zien, na één dag
Artificial Analysis beoordeelde Claude Haiku 5.5 de dag na de lancering. De Intelligence Index komt uit op 43 in totaal, waarbij de Max-effortconfiguratie op 43,40 wordt gerapporteerd, tweede van 182 modellen op de ranglijst. De kosten per indextaak zijn $0,21, de zesenveertigste goedkoopste. De gemengde prijs bij een 7:2:1-mix van input tot gecachte input tot output is $0,08 per miljoen, het getal waardoor de eerdere tiervergelijking oneerlijk aanvoelt tegenover al het andere. De uitvoersnelheid is 243,4 tokens per seconde, de negende snelste op de ranglijst, met een gerapporteerde latentie voor de eerste token van ongeveer 0,3 seconden en een cachekorting van 90%.
Dat outputcijfer van 440 miljoen tokens is het voorbehoud dat aan de 43 kleeft. De score is echt en onafhankelijk uitgevoerd; dat geldt ook voor de breedsprakigheid. Een model dat zo veel nadenkt, is goedkoop per token en niet altijd goedkoop per taak, en de kloof tussen die twee getallen is waar een routeringsbeslissing in de praktijk zit.
Om een idee van de schaal te geven: Anthropics eigen gepubliceerde vergelijkingen zetten Claude Haiku 5.5 op een score van 1620 op GDPval-AA v2.1, tegenover 735 voor Claude Haiku 4.5, 72,4% op OSWorld 2.1 tegenover 15,7%, 45,9% op Humanity's Last Exam zonder tools tegenover 10,2%, en 39,2% op Terminal-Bench 4.0 tegenover 0,0%. Dat zijn door de leverancier gerapporteerde cijfers op door de leverancier gekozen evaluaties en moeten als richtinggevend worden gelezen, maar de richting is niet subtiel — dit is geen kleine upgrade voor een klein model.

Toegang krijgen tot deze modellen zonder een tweede contract
Claude Haiku 5.5 is beschikbaar via Anthropic's eigen API en van daaruit overal waar Anthropic's modellen worden doorverkocht. In de catalogus van OrcaRouter loopt de Anthropic-lijn vandaag anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 en anthropic/claude-fable-5.1 — we hosten Claude Haiku 5.5 niet, en deze brief zal niet doen alsof dat wel zo is. Wat we wél aanbieden is de laag erboven, en OrcaRouter geeft de lijstprijs van de provider door met 0% opslag, en daarom verscheen de verlaging van de cache-read-prijs van Sonnet 5.5 op dezelfde dag in onze prijzen dat Anthropic die doorvoerde, in plaats van volgens een gepland herprijzingscyclus.
De praktische versie: als je Haiku 5.5 wilt uitproberen op een classificatie-etappe terwijl je beoordelingsetappe op Claude Sonnet 5.5 blijft, heb je twee sleutels in plaats van één, en de routeringslaag is waar de A/B wordt beslist. Dat is het hele argument voor een gateway in plaats van een directe integratie — één eindpunt, modelstrings en een uitwijkpad wanneer een provider wankelt.

Wat u vanaf hier kunt kijken
Drie dingen. Of derdepartijaanbieders Haiku 5.5 beginnen door te verkopen tegen een gemengd tarief onder $0,10, het punt waarop de routeringslaag zichzelf terugverdient in plaats van alleen de inkoop te vereenvoudigen. Of Anthropic de grens van de 100.000-tokenlaag verlegt, aangezien een klif precies bij 100.000 een vreemde plek is voor een model met een 1M-tokenvenster. En of het cijfer van 440 miljoen tokens aan breedsprakigheid daalt in een pointrelease, want dat ene getal staat tussen Haiku 5.5 en de status van voor de hand liggende standaard voor de hele onderste helft van een productiestack.
