
Claude Haiku 5.5 in OpenCode Go: wat $10 per maand daadwerkelijk oplevert
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Anthropic heeft Claude Haiku 5.5 op 7 oktober 2026 uitgebracht, en binnen een dag stond het vermeld in de Go- en Zen-catalogi van OpenCode — de abonnementen voor coding-agents die een maandelijks dollar tegoed meten in plaats van tokens te factureren. Die tweede vermelding is het deel waar het de moeite loont om even bij stil te staan, want het tegoed dat OpenCode publiceert voor Claude Haiku 5.5 is geen korting op het model. Het is een budgetmeter die is ingesteld op Anthropics eigen lijstprijs, en elk cijfer erachter kan worden gecontroleerd aan de hand van de twee pagina's die het publiceren. Als je nog steeds besluit wat je moet aanroepen in plaats van Claude Haiku 4.5, dan is het tegoed de beslissing, niet het prijskaartje.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Wat Anthropic op 7 oktober officieel heeft verklaard
De leverancier heeft dit niet stilzwijgend uitgebracht. De nieuwsruimte van Anthropic bevat een gedateerde aankondiging, een productpagina met een benchmarktabel, een systeemkaart, een prijstabel en zes citaten van met naam genoemde klanten. Er is geen repository en geen release van gewichten om te inspecteren, want er valt niets uit te brengen: Artificial Analysis registreert Claude Haiku 5.5 als propriëtair, met een niet-openbaar gemaakt aantal parameters. Wie dit beschrijft als een geleakt of onaangekondigd model, leest een repo die niet bestaat.
De eigen framing van Anthropic is een volumemodel in plaats van een frontiermodel:
• Positionering — "het goedkoopste, snelste en meest capabele kleine model dat we ooit hebben uitgebracht", gericht op samenvattingen, compacties, databasequery's en classificatie, en neergezet als een subagent die bij programmeerwerk samenwerkt met Claude Opus 5.5 en Claude Sonnet 5.5.
• Prijs — $0,10 per miljoen invoertokens en $0,50 per miljoen uitvoertokens voor prompts tot 100.000 tokens; $0,50 en $2,50 daarboven. Cache-leesbewerkingen $0,01 / $0,05, cache-schrijfbewerkingen $0,125 / $0,625.
• Context en output — een 1M-tokenvenster met een maximale output van 128.000 tokens, dezelfde envelop die de grotere 5.5-tier-modellen hebben, gereproduceerd op de goedkoopste tier.
• Effort — het eerste model in de Haiku-klasse met een instelbare effort-instelling, van Low tot Max, standaard op medium. Anthropic publiceert nauwkeurigheid-versus-kostencurves bij elke instelling in plaats van één enkel getal.
• Benchmarks, door de leverancier gerapporteerd en niet onafhankelijk gereproduceerd — GDPval-AA v2.1 1620 tegen de 735 van Claude Haiku 4.5; AA-Briefcase v1.1 1578 tegen 614; OSWorld 2.1 72,4% tegen 15,7%; Humanity's Last Exam 45,9% zonder hulpmiddelen en 57,4% met hulpmiddelen, tegen 10,2% en 18,7%; Terminal-Bench 4.0 39,2% tegen 0,0%; Chartography 46,4% tegen 6,4%.
• Het eigen plafond van de leverancier — het commentaar van Anthropic op zijn Terminal-Bench-grafiek zegt dat Claude Sonnet 5.5 en Claude Opus 5.5 "betere keuzes blijven voor complexe agentische coderingstaken." De klantcitaten in hetzelfde bericht zijn early-accesspartners die hun eigen evaluaties beschrijven, geen audits: Asana meldt meer dan 30% lagere latentie en tot 2,5x snellere inferentie per agentbeurt, HubSpot 92,8% gemiddeld over drie runs, AlphaSense 0,84 tegen 0,76 over 400 queries op een workload van ongeveer 8 miljoen calls per week, Box 11 punten hoger bij ongeveer de helft van de latentie, en Cognition een FrontierCode-score van 66,2 met Haiku 5.5 als sidekick.

Anthropic gebruikte de lancering ook om twee aanpalende prijzen te wijzigen: cache-reads op Claude Sonnet 5.5 werden gehalveerd naar $0,10 per miljoen tokens, wat Sonnet 5.5 volgens het bedrijf ongeveer 20% goedkoper maakt voor agentisch werk, en een maandelijks API-tegoed voor abonnees van Claude Max en Team. Beide zijn wijzigingen aan het abonnementsniveau en beide zijn belangrijker voor wie al op Sonnet zit dan voor wie een klein model overweegt.
De toelage is een dollarbudget, geen korting
Dit is het deel dat de aankondigingstweet niet zegt. In de Go-documentatie van OpenCode staat dat "gebruikslimieten worden gedefinieerd als maandelijkse dollarbedragen", dat de tokenprijs op beide abonnementen hetzelfde is, en dat de toegestane hoeveelheid van elk model volgens een vast schema afneemt: 20% van de maandlimiet per vijf uur, 50% per week, 100% per maand. De documentatie publiceert ook het tokenprofiel per verzoek dat zij voor dit model veronderstelt — 1.100 invoertokens, 55.000 gecachte tokens, 240 uitvoertokens.
Haal die door de lijstprijs van Anthropic en de gepubliceerde aanvraagaantallen, dan zien ze er niet meer uit als een arbitraire toewijzing:
• Kosten per verzoek tegen lijstprijs — 1.100 invoer tegen $0,10/M plus 55.000 gecachte leesbewerkingen tegen $0,01/M plus 240 uitvoer tegen $0,50/M — bedragen $0,00078.
Het maandelijkse aantal aanvragen — $15 gedeeld door $0,00078 is 19.230, het getal dat de documentatie vermeldt. Het $60-tegoed van het $40-abonnement komt uit op 76.923, en de documentatie vermeldt 76.920.
• De afbouw — 20% van 19.230 is 3.846, weergegeven als 3.850 per vijf uur; 50% is 9.615, weergegeven als 9.620 per week. Go Plus volgt dezelfde berekening bij 15.380 en 38.460.
• Wat dat in dollars betekent — het tegoed is $15 waard aan tokens tegen Anthropic-prijzen op het $10-abonnement en $60 op het $40-abonnement. Een abonnement van $10 levert daarom maximaal $15 per maand aan tokens van dit model op als je het hele tegoed besteedt aan Claude Haiku 5.5 en niets anders.
Dat is de eerlijke manier om de badge 'Nieuw' op de Go-pagina te lezen. Het abonnement is goedkoop, het model is goedkoop, en die twee feiten staan los van elkaar: het toegestane bedrag is een gemeten budget tegen het eigen tarief van de leverancier, dus het plan beperkt hoeveel je mag uitgeven in plaats van hoe weinig het model kost. Zware gebruikers lopen tegen het plafond aan en betalen Anthropic rechtstreeks — of routeren het model zelf.

Negentig procent, vijfenzeventig procent en de vijfvoudige kloof
De kop van Anthropic is dat Claude Haiku 5.5 ongeveer 90% minder kost dan Claude Haiku 4.5 voor prompts tot 100.000 tokens, en dat het gemiddeld "nu ongeveer 75% minder kost om te draaien." Beide cijfers zijn van de leverancier. Ze zijn ook allebei correct, en de kloof daartussen is het volledige prijsrisico.
• Binnen de band — $0,10 in en $0,50 uit, tegenover de vaste $1 en $5 van Haiku 4.5. Anthropic zegt dat ongeveer 90% van de verzoeken aan zijn vorige Haiku-model binnen deze band viel, en dat is waar het 90%-cijfer vandaan komt.
• Boven de band wordt hetzelfde verzoek gefactureerd tegen $0,50 voor input en $2,50 voor output, een vijfvoudige verhoging voor input. Dat is nog steeds de helft van het tarief van Haiku 4.5, maar het is lang niet een verlaging van 90%.
• De gemengde bewering — het cijfer van 75% is Anthropics eigen schatting over een echte verkeersmix, geen tariefkaart, en het is het getal dat je in een prognose moet zetten.
• De tokenizer — de nieuwere tokenizer die wordt gedeeld met Claude 4.7 en later — produceert ongeveer 30% meer tokens voor dezelfde tekst, volgens de eigen documentatie van Anthropic, dus een verlaging per token vertaalt zich niet een-op-een naar een lagere factuur.
De effort-dial versterkt dat allemaal. Omdat de standaard medium is en de gepubliceerde curves tot Max lopen, kan dezelfde prompt meerdere keren meer kosten, afhankelijk van een parameter die de meeste aanroepers nooit instellen — en OpenCode's requestschattingen gaan uit van één vast tokenprofiel bij één impliciete instelling. Als je prompts dicht bij 100.000 tokens liggen, je een subagent met begrensd gebruik draait, of je de effort-dial verzet, is de 90%-kop niet het getal dat je zult zien.
Het onafhankelijke bestuur is het eens over de score en wijst op zijn eigen rekenwerk
Artificial Analysis geeft Claude Haiku 5.5 een score van 43 op zijn Intelligence Index v4.3.2 in de Max-configuratie van het model, tegen een mediaan van 13 op het board, en meet 241,9 outputtokens per seconde tegen een mediaan van 110,9 voor vergelijkbare modellen. Dezelfde pagina stelt de kosten op $0,21 per Intelligence Index-taak en meldt dat het model tijdens de evaluatie 440 miljoen outputtokens genereerde, tegen een mediaan van 100 miljoen — waarbij het wordt omschreven als "zeer verbose".
Verbositeit is waar de twee boards op elkaar inwerken. De berekening van de toegestane hoeveelheid hierboven wordt per token in rekening gebracht, dus een model dat uitvoerig redeneert, verbruikt het budget sneller dan het aantal verzoeken doet vermoeden, en het profiel van OpenCode van 55.000 gecachte tokens per verzoek is een aanname over prompt-caching die een abonnementsgebruiker al dan niet kan reproduceren. Twee onthullingen op de pagina van Artificial Analysis zijn meer waard dan de kop: de 43 is de Max-configuratie en niet de effort-instelling die je krijgt als je niets doet, en op de pagina staat een expliciete opmerking dat Claude Haiku 5.5 "5x hogere prijzen heeft voor inputs met een langere context, wat momenteel niet wordt weerspiegeld" in de kostencijfers. De lange-contextklif is reëel, en het onafhankelijke board heeft je laten weten dat die nog niet in zijn eigen cijfers is terug te vinden.

De retentieregel die de meeste kopers zullen overslaan
De Go-documentatie van OpenCode bevat een privacytabel per model, en dit is de rij waarin Claude Haiku 5.5 afwijkt van de meeste in de catalogus. De eigen formulering van de leverancier is nul retentie, met uitzonderingen. De meeste modellen in die Go-tabel vermelden "0 dagen." Dit model vermeldt "30 dagen," met de opmerking dat verzoeken 30 dagen worden bewaard in overeenstemming met het databeleid van Anthropic — dezelfde behandeling als voor GPT-6 Luna en GPT-5.6 Luna, en het tegenovergestelde van de rijen met nul dagen die het grootste deel van de lijst vormen.
Voor een codingagent betekent dit dat prompts, bestandspaden en geplakte broncode een maand bij de upstreamleverancier kunnen blijven staan, op een plan waarvan de marketingtaal zero retention is. Dat is geen reden om het model te vermijden; het is een reden om de rij te lezen in plaats van de banner. Niets in het lanceringsmateriaal van Anthropic verandert ondertussen de positie aan de API-kant: de Claude API biedt al zero data retention, en de retentievoorwaarden van de modelkaart zijn de voorwaarden die een directe integratie bepalen.
Wat is bevestigd, en wat niet
De bevestigde set is groot en specifiek, wat ongewoon is voor een model dat zo nieuw is. Wat niet bevestigd is, is beperkter, en het is de moeite waard om het te benoemen in plaats van te verdoezelen:
• Bevestigd — het model bestaat, is alleen via API beschikbaar onder de id claude-haiku-5-5, uitgebracht op 7 oktober op de Claude API plus Amazon Web Services, Google Cloud en Microsoft Azure, tegen de bovenstaande prijzen, met een venster van 1M tokens, aanpasbare inspanning en een gepubliceerde systeemkaart.
• Bevestigd — twee platforms van derden hebben het dezelfde dag vermeld, met model-ID's, endpoints en op verbruik gebaseerde limieten.
• Niet bevestigd — geen enkele onafhankelijke benchmark die wij kunnen vinden heeft de tabel van de leverancier gereproduceerd. Elk nauwkeurigheidscijfer in de lanceringspost van Anthropic komt uit Anthropics eigen testomgeving, en elke klantquote is de zelfgerapporteerde vroege test van een partner.
• Niet bevestigd — er zijn geen gewichten, geen repository, geen checkpoint en geen licentie om te inspecteren. Het model is gesloten, en elke bewering over de architectuur of omvang is een gevolgtrekking.
• Niet bevestigd — of de schattingen van het platform voor aanvragen ook opgaan bij iets anders dan het veronderstelde tokenprofiel, en of (of wanneer) de 5x-prijsstelling voor lange contexten in de kostencijfers van de onafhankelijke boards terechtkomt.
Het naast wat je al noemt laten draaien
De praktische vraag die deze lancering oproept is niet 'is Haiku 5.5 goed' — de tabel van de leverancier zegt van wel, en niemand buiten Anthropic heeft het gecontroleerd. Het is 'wat is de factuur, en wat gebeurt er wanneer de goedkope tier niet de juiste tier is voor deze specifieke aanroep.' Beide helften zijn routeringsproblemen.
Qua kosten is de meter de tokenfactuur, niet de stickerprijs: een inputvermindering van 90% plus een 30% grotere tokenizer plus een wijdlopig redeneermodel plus een vijfvoudige long-contextstap betekent dat het aantal dat je voorspelt en het aantal dat je betaalt uiteenlopen, tenzij je je eigen promptlengteverdeling meet. Een model dat boven 100.000 tokens 5x duurder is, beloont compactie — en Haiku 5.5 wordt zelf aangeprezen als het compactiemodel, wat een opmerkelijke lus is.
Wat risico betreft: een onbewezen tier is precies het geval waarin je een productiepad er niet op moet baseren. Claude Haiku 4.5 staat al op OrcaRouter tegen Anthropics lijstprijs met 0% opslag, dus de oude tier heeft geen nieuw contract nodig, en een route die van een nieuw model terugvalt op een bekend model is een configuratiewijziging in plaats van een herschrijving. De effort-parameter is per aanroep, wat betekent dat hetzelfde endpoint een samenvatting met lage effort kan draaien en een zware extractie met hoge effort, zonder twee integraties te onderhouden — de routing-DSL bestaat precies voor dit soort beslissingen, en automatische failover is wat je in staat stelt een model dat pas een paar dagen oud is voor echt verkeer te zetten voordat je er onafhankelijke cijfers voor hebt. Wat nog niet waar is, is het voor de hand liggende: Claude Haiku 5.5 staat vandaag niet op onze routes, en als je het deze week wilt, bel je Anthropic rechtstreeks of ga je via het platform dat het heeft aangekondigd.
Wie moeten de overstap maken: teams wier volume bestaat uit samenvattingen, classificatie, compactie en subagent-werk, waar de 90%-band geldt en de 30% van de tokenizer rekenwerk is dat je kunt absorberen. Wie moeten wachten: iedereen wiens prompts regelmatig boven de 100.000 tokens uitkomen, iedereen die een onafhankelijke benchmark nodig heeft voordat hij zich vastlegt, en iedereen wiens code niet in een bewaartermijn van 30 dagen kan blijven staan. De lancering is echt en de prijzen zijn echt. Het bewijs is nog steeds van de leverancier.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
