Een gegenereerde hero-kaart voor 'Een tiende van het tarief is geen tiende van de rekening', met het label 'GENERATIEKLOOF', de kicker 'TWEE HAIKU-MODELLEN, ELF MAANDEN UIT ELKAAR' en de ondertitel 'Claude Haiku 5.5 tegenover Claude Haiku 4.5 op prijs, tokens en de nieuwe stap van 100.000 tokens.' Vier chips tonen '$0.10 / $0.50', '$1.00 / $5.00', '1M context' en '30% meer tokens'. Twee kaarten eronder zijn gelabeld 'WAT HET TARIEF ZEGT' ('90% lager voor input en output onder 100.000 tokens') en 'WAT DE FACTUUR ZEGT' ('ongeveer 75% minder om te draaien, op ongeveer 30% meer tokens'). Een footer luidt 'Documentatie over leveranciersprijzen gelezen op 8 oktober 2026.' Het OrcaRouter-logo is in de rechteronderhoek samengevoegd.
Guides & Insights

Claude Haiku 5.5 vs Claude Haiku 4.5: Een prijsverlaging van 90% is geen besparing van 90%

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Haiku 5.5 kost $0,10 per miljoen invoertokens en $0,50 per miljoen uitvoertokens voor prompts tot 100.000 tokens. Claude Haiku 4.5 kost $1 en $5, vast, voor het volledige venster van 200.000 tokens dat het altijd al heeft gehad. Ant​hropic noemt het verschil "90% lager" in een voetnoot en "ongeveer 75% minder om te draaien" in de zin daarboven — en de elf maanden tussen de twee modellen is precies de afstand tussen die twee getallen.

Dat is geen marketingtruc. Het is de eerlijke vorm van een modelgeneratie die tegelijk met zijn prijs ook zijn tokenizer, zijn standaardinstelling voor redeneren en zijn contextvenster veranderde, en het betekent dat wie de model-id verwisselt en verwacht dat de rekening met een factor tien daalt, teleurgesteld zal worden door de rekensom in plaats van door het product.

Beide modellen, zoals geleverd

Alles hieronder is per miljoen tokens, in Amerikaanse dollars, en overgenomen uit Ant​hropics eigen prijs- en modeldocumentatie op 2026-10-08, tenzij anders aangegeven.

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens, $0,50 daarboven; Claude Haiku 4.5 $1,00 ongeacht de lengte.

• Uitvoer — Claude Haiku 5.5 $0,50 tot 100.000 tokens, $2,50 daarboven; Claude Haiku 4.5 $5,00 ongeacht de lengte.

• Cache-leesbewerkingen — Claude Haiku 5.5 $0,05 tot 100.000 en daarboven $0,05; Claude Haiku 4.5 $0,10. Cache-schrijfbewerkingen — $0,625 en $0,625 tegenover $1,25.

• Context — 1M tokens tegen 200.000. Maximale uitvoer — 128.000 tokens tegen 64.000.

• Denken — Claude Haiku 5.5 is adaptief en standaard ingeschakeld, met een inspanningsregelaar die standaard op medium staat; Claude Haiku 4.5 gebruikt de oudere handmatige vorm en heeft helemaal geen inspanningsparameter.

• Onafhankelijke score — Artificial Analysis Intelligence Index v4.3.2 plaatst Claude Haiku 5.5 (Max) op 43,40, tweede van 182 modellen, en Claude 4.5 Haiku op 16,88, dertigste van 61 — waarbij de beoordelaar de 4.5-score als geschat markeert.

• Snelheid — dezelfde bron meet 242 outputtokens per seconde voor Claude Haiku 5.5 tegenover 89,7 voor de 4.5-generatie, het enige punt waarop het oude model nog comfortabel oogt.

Waar het verhaal over een tiende van de prijs stukloopt

Drie dingen knagen aan de bezuiniging, en alleen de eerste daarvan is de eigen waarschuwing van Ant​hropic.

De tokenizer is het grote probleem. Claude Haiku 5.5 gebruikt de nieuwere tokenizer die met Claude 4.7 is geïntroduceerd, en volgens de documentatie van Anthropic telt dezelfde tekst "als ongeveer 30% meer tokens dan op Claude Haiku 4.5." Je betaalt geen tiende van het tarief voor hetzelfde aantal tokens; je betaalt een tiende van het tarief voor ongeveer 1,3 keer zoveel tokens. De migratiegids van de leverancier zelf zet dit als tweede punt op de checklist, vóór elke codewijziging: hertel je prompts en herbekijk daarna max_tokens en je kostenramingen.

Denktokens worden als outputtokens gefactureerd, en Claude Haiku 5.5 denkt standaard. De lanceringspagina van Anthropic is expliciet dat het model op de grafieken op zichzelf al "zeer verbose" is, en de onafhankelijke meting bevestigt dat scherper dan de leverancier dat doet: bij de evaluatie van de Intelligence Index registreerde Artificial Analysis 440 miljoen outputtokens van Claude Haiku 5.5 tegenover een mediaan van 100 miljoen over de hele linie, en bestempelde het model als zeer verbose. Een laag inputtarief helpt niet bij een workload waarvan de rekening grotendeels uit output bestaat.

De 100.000-tokenstap is de derde. Daarboven zijn de tarieven $0,50 en $2,50 — de helft van wat Claude Haiku 4.5 voor dezelfde aanvraag in rekening bracht, wat een goede deal is en niet de deal is waarover de meeste lezers zullen hebben gelezen. Anthropic zegt dat prompts onder de drempel goed waren voor ongeveer 90% van de aanvragen naar het vorige Haiku-model, het getal dat de verlaging als kop overleefbaar maakt; het is ook de eigen verkeersmix van de leverancier, niet die van jou.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

Wat hetzelfde werk de twee modellen kost

De kosten per voltooide taak zijn de maatstaf die alle drie de bovenstaande effecten overleeft, omdat die het model belast voor alles wat het heeft geproduceerd, niet alleen voor wat je ernaartoe hebt gestuurd.

Artificial Analysis zet Claude Haiku 5.5 (Max) op $0,21 per Intelligence Index-taak — het cijfer dat het publiceert naast een invoertarief van $0,10 en een uitvoertarief van $0,50. Voor de 4.5-generatie publiceert het helemaal geen cijfer voor kosten per taak; op de tegel staat onbekend, omdat het model nooit op de Index is uitgevoerd in een redeneerconfiguratie. Wat de pagina wel publiceert, is een ruwe stickerprijs van $1,00 en $5,00 en een andere, lagere gemeten score.

Dus de eerlijke vergelijking voor een koper is niet 10x op tokens, maar iets dat hier dichter bij komt: een tiende van het inputtarief bij 30% meer tokens, de helft van het outputtarief wanneer je 100K overschrijdt, en een model dat meer outputtokens per antwoord verbruikt dan zijn voorganger — tegenover een sprong in capaciteit van 16,88 naar 43,40 op dezelfde onafhankelijke benchmark. Het percentage van 75% dat Ant​hropic noemt voor gemiddelde workloads is het verstandige getal om mee te plannen. Het is ook een gemengde leveranciersschatting over een verkeersmix waarover je geen controle hebt.

De migratie is geen model-id-omwisseling.

De migratiehandleiding van Ant​hropic telt tien punten voor iedereen die van Claude Haiku 4.5 afstapt, en verschillende zijn harde fouten in plaats van advies.

• Handmatig denken werkt niet meer — thinking: {"type": "enabled", "budget_tokens": N} geeft een fout. Adaptief denken vervangt het, en thinking.display moet ingesteld worden op "summarized" als je de redenering überhaupt wilt zien.

• Sampling-parameters werken niet meer — temperature, top_p en top_k moeten allemaal uit het verzoek worden gehaald.

Assistent-prefill werkt niet — een gesprek dat eindigt op een assistentbeurt geeft een foutmelding; laat het eindigen op een gebruikersbeurt.

• Wijzigingen in de blokvolgorde — een antwoord kan beginnen met denkblokken, dus code die het eerste inhoudsblok als het antwoord leest, moet op type in plaats daarvan selecteren.

• Weigeringen zijn nieuw — het model voert veiligheidsclassificatoren uit en kan stop_reason: "refusal" retourneren, en er is geen terugvaloptie aan de serverzijde.

• Herhaling is beperkt — denkblokken werken alleen in het account dat ze heeft geproduceerd, of in een account dat daaraan is gekoppeld.

• Priority Tier wordt niet overgedragen — organisaties met een Priority Tier-toezegging voor Claude Haiku 4.5 moeten capaciteit afzonderlijk plannen, omdat de tier niet wordt ondersteund op Claude Haiku 5.5.

Twee daarvan verdienen meer aandacht dan de rest. De stopreden 'refusal' is een wijziging in de controlflow in elke lus die aannam dat elk antwoord inhoud heeft, en de accountgebonden thinking-blokken breken elke wachtrij die gesprekken opslaat en ze opnieuw afspeelt via een pool van inloggegevens. Geen van beide komt aan het licht voordat je in productie draait.

Beide niveaus onder één sleutel draaien

De praktische vraag voor de meeste teams is niet welk van deze twee modellen beter is, want het antwoord hangt volledig af van welke aanroep je doet. Het gaat erom of het goedkope deel van een cascade onafhankelijk van alles eromheen kan worden opgewaardeerd.

Claude Haiku 4.5 staat vandaag in de OrcaRouter-catalogus tegen Anthropics lijstprijs met 0% opslag, dus het tarief van de provider wordt rechtstreeks doorgegeven en elke wijziging die Anthropic daarin aanbrengt, verschijnt dezelfde dag aan onze kant. Claude Sonnet 5.5 en Claude Opus 5.5 staan er ook, wat betekent dat een tweelaagse pijplijn — klein model voor de routineuze meerderheid, groter model voor de escalatie — nu kan worden gebouwd met één sleutel, één SDK en automatische failover eronder, en het kleine deel later kan worden omgewisseld naar Claude Haiku 5.5 als een wijziging van het model-id in plaats van een herschrijving.

Claude Haiku 5.5 staat nog niet in de catalogus, en het is de moeite waard om dat ronduit te zeggen in plaats van het impliciet te laten. Een gat op de lanceerdag tussen het uitbrengen van een model en het routeerbaar zijn van een model is normaal, en het is geen belofte over wanneer dat gat wordt gedicht; de modellen die we vanochtend kunnen aanroepen, zijn de hierboven genoemde.

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

Wie moet overstappen, en welke oproep moet eerst worden overgeschakeld?

Als je Haiku 4.5-verkeer classificatie, extractie, routering, comprimering of samenvatting is met prompts onder de 100.000 tokens: stap over — het tarief is een tiende, het venster is vijf keer zo ruim, en de effort-knop geeft je een kostenhefboom die het oude model nooit had. Reken op ongeveer 75% minder en verifieer na een week aan de hand van je eigen tokentellingen.

Als je prompts regelmatig boven de 100.000 tokens uitkomen, koop je een korting van 50% in plaats van 90%, en de tweede tariefschijf verandert de vergelijking zodanig dat het de moeite loont om prijzen te vergelijken: het outputtarief van $2,50 boven 100K ligt hoger dan wat verschillende concurrerende kleine modellen voor het hele contextvenster rekenen.

En als je op Haiku 4.5 zit omdat het de enige goedkope optie was die een document van 200.000 tokens aankon, let dan op wat er is veranderd. Het venster is nu een miljoen tokens groot, wat een ander product is, en de reden om het oude model te behouden is stilletjes verdwenen, samen met de reden dat het goedkoop was.