
Claude Haiku 5.5 is nu in GitHub Copilot: wat het goedkoopste Anthropic-model kost binnen een creditbudget
- OrcaNIEUWOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 per 1 mln tokens · 71 tok/s
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
Claude Haiku 5.5 verscheen op 7 oktober 2026 in de modelkiezer van GitHub Copilot — dezelfde dag dat de leverancier het uitbracht — en de changelog-vermelding die het aankondigde, besteedt het grootste deel van zijn lengte aan oppervlakken. Visual Studio Code, Visual Studio, de Copilot CLI, de GitHub Copilot-cloudagent, de Copilot-app, github.com, GitHub Mobile op iOS en Android, de JetBrains-IDE's, Xcode, Eclipse. De zin die ertoe doet als je het budget beheert, is korter: het model wordt gefactureerd "tegen de lijstprijs van de provider onder verbruiksgebaseerde facturering." Binnen Copilot betekent dat AI-credits, en de tarieven van Claude Haiku 5.5 zijn laag genoeg dat de creditberekening het interessante deel van de lancering wordt in plaats van een bijzaak. Dit stuk maakt die berekening, scheidt wat GitHub daadwerkelijk heeft gedemonstreerd van wat het slechts heeft beweerd, en behandelt twee uitzonderingen in de eigen documentatie van de leverancier die de berichtgeving over de lancering grotendeels oversloeg.
Wat GitHub heeft uitgebracht, en aan wie
Het bericht draagt simpelweg de titel "Claude Haiku 5.5 in GitHub Copilot" en verscheen op 7 oktober om 13:12 Pacific-tijd. Het is beschikbaar voor abonnees van Copilot Pro, Pro+, Max, Business en Enterprise — oftewel elk betaald niveau, en opvallend genoeg niet het gratis niveau, waar de modelselectie nog steeds automatisch wordt afgehandeld in plaats van door de gebruiker. De uitrol verloopt geleidelijk, dus de kiezer in je editor kan dagen achterlopen op de changelog; dat staat in het bericht vermeld in plaats van dat het aan jou wordt overgelaten om het te ontdekken.
GitHub's eigen uitleg van waar het model voor dient, is het waard aandachtig te lezen, omdat die nauwer is dan die van de leverancier:
• Snel, hoogvolume werk — subagents, snelle bewerkingen en terminaltaken, in GitHub's eigen woorden • Niet gepositioneerd als vervanging voor de grote modellen in de kiezer, maar als de goedkope laag daaronder • Algemeen beschikbaar, volgens GitHub's referentie voor ondersteunde modellen, waarin Claude Haiku 5.5 als algemeen beschikbaar staat vermeld, met de status GA • Staat ook in die referentie met een rij voor de IDE-versie gemarkeerd als TBD, wat de praktische reden is dat de uitrol vanaf de editorzijde geleidelijk overkomt • Geprijsd tegen de lijstprijs van de provider onder verbruiksgebaseerde facturering, in plaats van tegen een Copilot-specifieke opslag img src="2.png"> p>De omliggende changelog-datums geven de cadanscontext die één enkele modelpagina niet kan geven. Claude Sonnet 5.5 verscheen op 28 september in Copilot, Claude Opus 5.5 op 22 september en Claude Fable 5.1 op 1 september. Anthropic levert ongeveer elke twee tot vier weken een Copilot-integratie uit en GitHub verwerkt elk ervan binnen enkele dagen. Die cadans is ook de reden dat hier een klok op staat: GitHub plaatste half september een deprecatiebericht voor "geselecteerde GitHub Copilot-modellen" medio oktober, en vervolgens op 2 oktober een follow-up ter bevestiging van de verwijderingen. Als jouw team een model vastzet in een Copilot-configuratie, is die pin nu hetgeen dat het waarschijnlijkst stukloopt, niet de prijs.

De tariefkaart, gelezen als een kredietgrootboek
Claude Haiku 5.5 rekent af volgens twee tariefniveaus, die worden bepaald door de aanvraaggrootte in plaats van door een instelling die je kiest. Alles hieronder is GitHub's eigen gepubliceerde tarievenkaart, en alles is per miljoen tokens:
• Bij of onder 100.000 tokens in — $0,10 input, $0,01 gecachte input, $0,125 cache-schrijven, $0,50 output • Boven 100.000 tokens in — $0,50 input, $0,05 gecachte input, $0,625 cache-schrijven, $2,50 output • Claude Haiku 4.5, ter vergelijking — $1,00 input, $0,10 gecachte input, $1,25 cache-schrijven, $5,00 output • Claude Sonnet 5.5, het niveau daarboven — $2,00 input, $0,10 gecachte input, $2,50 cache-schrijven, $10,00 output • Het schrijven naar cache wordt bij Anthropic-modellen apart in rekening gebracht, bovenop de input — een regelpost die niet bij elke leverancier in de selectie bestaat img src="3.png"> p>Als je die rijen leest, vallen er twee dingen op. Ten eerste is de korte tier van Claude Haiku 5.5 rond tien keer goedkoper dan Claude Haiku 4.5, zowel op input als op output, en ongeveer twintig keer goedkoper op input dan Claude Sonnet 5.5 — wat precies de reden is dat hij thuishoort in subagent-slots, waar een vloot kleine calls vermenigvuldigt wat je per call betaalt. Ten tweede is de lange-contexttier exact vijf keer de korte, en wel op alle tarieven tegelijk, bij dezelfde grens van 100.000 tokens. Een verzoek van 99.000 tokens en een verzoek van 101.000 tokens liggen niet 2 procent uit elkaar wat betreft de tokens die de grens overschreden; ze liggen vijf keer uit elkaar op alle ervan. Die stap is rechtstreeks overgenomen uit de adviesprijs van Anthropic, en het creditsysteem van Copilot vlakt die niet af.

Nu de credits. De op gebruik gebaseerde facturering van Copilot zet modelgebruik om in AI-credits tegen een gedocumenteerd tarief van $0,01 per credit, en elk abonnement bevat een maandelijkse pool:
• Copilot Pro, $10 per maand — 1.500 credits, opgegeven als 1.000 basis plus 500 flexibel • Copilot Pro+, $39 per maand — 7.000 credits, opgegeven als 3.900 basis plus 3.100 flexibel • Copilot Max, $100 per maand — 20.000 credits, opgegeven als 10.000 basis plus 10.000 flexibel • Copilot Business, $19 per gebruikersplek per maand — 1.900 credits per gebruiker • Copilot Enterprise, $39 per gebruikersplek per maand — 3.900 credits per gebruiker • Organisatie- en enterprisepools worden gedeeld over gebruikersplekken in plaats van per gebruiker afgescheiden • Gebruik boven de pool wordt gefactureerd tegen $0,01 per credit — dezelfde conversie, toegepast op overschrijding • Codeaanvullingen en suggesties voor de volgende bewerking vallen volledig buiten de creditfacturering en blijven onbeperkt op betaalde abonnementen p>Als je die twee samenvoegt, wordt de vorm van de lancering concreet. Neem een middelgrote agentstap — 40.000 inputtokens, 2.000 outputtokens, zonder caching. Op de korte tier van Claude Haiku 5.5 is dat 40.000 keer $0,10 per miljoen plus 2.000 keer $0,50 per miljoen, of $0,005, wat een halve credit is bij de gedocumenteerde conversie. De identieke aanroep tegen de tarieven van Claude Haiku 4.5 komt uit op $0,05, of vijf credits. De rekensom hier is van ons, niet van GitHub, maar de inputs komen allemaal van de gepubliceerde tariefkaart, en de conclusie is niet subtiel: de pool van 1.500 credits van een Pro-abonnee absorbeert ruwweg 3.000 zulke aanroepen op de nieuwe Haiku, waar die er op de oude ruwweg 300 absorbeerde. De pool wordt tien keer zo lang zonder dat het abonnement verandert.
Dat is de eerlijke waardepropositie, en daar hoort het eerlijke voorbehoud bij dat de pool in credits in plaats van in dollars wordt uitgedrukt, waardoor het werkelijke plafond van een abonnement meebeweegt zodra een tariefkaart verandert. Een verlaging met factor tien op één model verruimt een pool niet met factor tien als je verkeer over drie modellen is verdeeld.
Wat GitHub zegt dat het model doet, en wat het niet heeft laten zien
De changelog bevat één prestatieclaim, en die doet in de berichtgeving meer werk dan hij aankan. GitHub schrijft dat Claude Haiku 5.5 bij vroege tests "op veel coderingstaken net zo goed presteerde als Claude Sonnet 5", terwijl het "aanzienlijk minder tokens en stappen" gebruikte.
Lees de voorbehouden in volgorde. Het is vroeg testen. Het is testwerk van GitHub, op taken van GitHub, en GitHub is de partij die de integratie verkoopt. Er wordt geen testharnas genoemd, er is geen takenreeks gepubliceerd, geen cijfer begeleidt een van beide helften van de zin, en "veel" is geen getal. De bewering kan heel goed waar zijn — een klein model dat een groot model evenaart bij smalle, toolachtige programmeertaken is een plausibel resultaat in 2026 — maar zoals gepubliceerd is het een leveranciersbewering, en die zou telkens wanneer ze wordt herhaald als zodanig moeten worden bestempeld. De helft over "minder tokens en stappen" is van de twee de houdbaarste, omdat het een bewering over efficiëntie is in plaats van capaciteit, en efficiëntie op het prijspunt van Haiku is binnen een week terug te zien in je eigen gebruikstelemetrie. De capaciteitshelft wil een testharnas van een derde partij voordat die in een slide belandt.
De eigen cijfers van Anthropic zijn een afzonderlijke bewering ten opzichte van die van GitHub en kampen met hetzelfde herkomstprobleem. Anthropic stelt dat Claude Haiku 5.5 gemiddeld ongeveer 75 procent goedkoper te draaien is, en dat ongeveer 90 procent van de verzoeken die voorheen naar een model uit de Haiku-klasse werden gestuurd, onder de 100.000 tokens blijft, en dat is waar het model "bijzonder goede waarde" biedt. In beide gevallen beschrijft de leverancier de economie van zijn eigen product. Ze komen overeen met de gepubliceerde tariefkaart — een grote verlaging in de korte schijf, een kleinere in de lange — en ze zijn nuttig als richtlijn van de leverancier, niet als gemeten resultaat.
Het inschakelen ervan is een beslissing van de beheerder, en de standaardwaarde is ja.
Het deel van de changelog dat kopers van Copilot Business en Enterprise tweemaal zouden moeten lezen, is de alinea over toegangsbeheer. Beheerders beheren de toegang tot modellen via het modelbeleid in de Copilot-instellingen, en het gedocumenteerde standaardgedrag van GitHub is dat nieuwe modellen automatisch worden ingeschakeld, tenzij een beheerder de algemene standaard heeft uitgeschakeld of dat specifieke model expliciet heeft uitgeschakeld. De standaard is permissief; de beperking is opt-out.
Hieruit volgen twee consequenties. Als je organisatie strikte modelgovernance hanteert, is Claude Haiku 5.5 mogelijk al selecteerbaar voor je ontwikkelaars zonder dat iemand het model bij naam heeft goedgekeurd. En als je organisatie in plaats daarvan de globale standaard al heeft uitgeschakeld, zal het model niet voor je verschijnen, wat de changelog ook zegt — wat de meest waarschijnlijke verklaring is voor de meest voorkomende supportvraag in de eerste week van elke Copilot-modellaunch. Voordat je gaat debuggen waarom een vermelding in de picker ontbreekt, controleer je het modelbeleid.
Twee uitzonderingen die de documentatie van Anthropic wel vermeldt, maar de lanceringsposts niet
Beide komen uit de platformdocumentatie van Anthropic in plaats van uit persberichtgeving, en beide zijn van invloed op wat je kunt bouwen in plaats van op wat je betaalt:
• Priority Tier is niet beschikbaar op Claude Haiku 5.5 — de documentatie over servicelagen van Anthropic noemt het model in de expliciete uitsluitingslijst, naast Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 en de Mythos-lijn. Als uw architectuur uitgaat van provisioned throughput op de goedkope laag, gaat die aanname hier niet op. • Het volledige contextvenster van 1 miljoen tokens tegen standaardprijzen wordt toegekend aan "Claude 4.6 en latere modellen (behalve Claude Haiku 5.5)" — het haakje is van Anthropic, en Claude Haiku 5.5 is het enige huidige model dat daarvan is uitgesloten. Het venster wordt op de specificatieregel van het model nog steeds aangeprezen als 1M, met een maximale uitvoer van 128.000 tokens; wat de uitzondering betekent, is dat u de algemene prijsgarantie voor lange context niet moet opvatten als van toepassing op dit model. • De tokenizer is veranderd. Anthropic stelt dat Claude 4.7 en latere modellen een nieuwere tokenizer gebruiken die voor dezelfde tekst ongeveer 30 procent meer tokens produceert, wat betekent dat de prijs per token en de prijs per pagina van uw tekst zich in tegengestelde richtingen hebben bewogen. De specificatieregel van Claude Haiku 5.5 vermeldt "Fastest" als zijn positie, een standaardwaarde voor adaptief denken van medium, een kennisafsluitdatum van juni 2026 en een model-ID van claude-haiku-5-5.
Geen van deze is een dealbreaker voor de subagent- en quick-edit-workloads waarop GitHub het model richt. Ze vormen het verschil tussen het citeren van een lanceringsbericht en het citeren van de documentatie, en dat laatste is wat een loadtest overleeft.
Als je het liever routeert dan van tool te wisselen
Er is iets te zeggen voor het aanroepen van Claude Haiku 5.5 vanuit je eigen stack in plaats van alleen via een chat-en-editor-abonnement: je krijgt de ruwe short-tier tarieven zonder een creditconversie ertussen, en je houdt de routeringsbeslissing in je eigen code. Het beschikbaarheidsbeeld, eenvoudig gezegd, is dat Anthropic het verkoopt via het Claude Platform en via Amazon Bedrock, Vertex AI en Microsoft Azure — en het staat nog niet in onze catalogus. OrcaRouter heeft vandaag Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 en Claude Fable 5.1 in huis, in een catalogus van iets meer dan 200 modellen, en Claude Haiku 5.5 zit daar niet bij. Voor het model zelf kun je nu het beste rechtstreeks Anthropic of een van de drie clouds aanspreken.

Waar we wél passen, is de laag eromheen. OrcaRouter geeft de lijstprijs van de provider tegen nul opslag door, dus wanneer een leverancier de prijs van een model aanpast — zoals Anthropic bij dit model deed — staat het nieuwe tarief dezelfde dag nog bij ons live in plaats van pas na een factureringscyclus. Automatische failover betekent dat een aanroep in het goedkope segment die een fout geeft, op een werkende route terechtkomt in plaats van het verzoek te laten mislukken, wat belangrijker is voor een vloot subagenten die duizenden kleine aanroepen verricht dan voor één interactieve sessie. En de routing-DSL bestaat precies voor de vorm van beslissing die deze lancering creëert: stuur kort, hoogvolume werk naar welk model dan ook het goedkoopst is onder de drempel, en werk met een lange context naar welk model dan ook het goedkoopst is daarboven, vanaf één endpoint op één factuur, in plaats van die opsplitsing in twee integraties te verwerken. Als Haiku 5.5 in de catalogus verschijnt, past het in dat beleid zonder codewijziging.
Wat te doen met dit vóór de volgende sprint
De beperkte lezing is dat het goedkoopste huidige model van Anthropic nu selecteerbaar is in elke betaalde Copilot-tier en ongeveer tien keer goedkoper is per token dan de Haiku die het vervangt in de korte tier. Als je team subagenten of terminalvormige automatisering via Copilot draait, is het wisselen van model een instellingswijziging met een groot en onmiddellijk effect op hoe ver een maandelijkse creditpool reikt.
De twee dingen die je eerst moet controleren, zijn de dingen die de aankondiging begraaft. Kijk naar het 95e percentiel van je aanvraaggroottes: als dat boven 100.000 tokens ligt, is de laag waarop je daadwerkelijk wordt gefactureerd de tweede, en de tienvoudige vergelijking is een vijfvoudige. En kijk of het modelbeleid van je organisatie de globale standaard heeft ingeschakeld — voor Business- en Enterprise-seats bepaalt die ene instelling of deze lancering überhaupt beschikbaar is voor je ontwikkelaars.
