Een gegenereerde herokaart met de titel 'Claude Haiku 5.5 vs GPT-5.6 Luna' en de kicker 'HALVE PRIJS, MEER PER ANTWOORD', met Claude Haiku 5.5 op Input $0,10, Output $0,50 en Index 43,40 tegenover GPT-5.6 Luna op Input $0,20, Output $1,20 en Index 37,32, boven een balk met 'Kosten per afgeronde taak $0,21 vs $0,18'.
Engineering & Research

Claude Haiku 5.5 vs GPT-5.6 Luna: De helft van de stickerprijs, 19% meer per afgeronde taak

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

De prijsmatch waar iedereen over schreef is echt, en die is niet met dit model. Claude Haiku 5.5, die de leverancier op 7 oktober 2026 lanceerde, heeft een lijstprijs van $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens tot prompts van 100.000 tokens. GPT-5.6 Luna, het kosten geoptimaliseerde niveau van 9 juli 2026, heeft een lijstprijs van $0,20 en $1,20. De leverancier zit dus op precies de helft van het tarief van het oudere model op beide meters — en precies gelijk aan GPT-6 Luna, de opvolger die het op 22 september 2026 verving en het model waartegen de eigen lanceringspost van de leverancier benchmarkt.

Dat is een vreemde plek van waaruit je een vergelijking schrijft, dus het loont om precies te zijn over waar deze confrontatie voor dient. GPT-5.6 Luna is de enige van de twee die op het onafhankelijke board als verouderd staat, het is niet langer de Luna op OpenAI's belangrijkste tarievenkaart, en het is nog steeds de Luna die je tegenwoordig in veel integratiecode aantreft. Het vergelijken met Claude Haiku 5.5 is een kwestie van een migratie die je misschien al had moeten uitvoeren, niet de vraag welk van twee huidige modellen je moet aanroepen.

En het antwoord op de voor de hand liggende vraag is het interessante deel. In dezelfde onafhankelijke evaluatierun kost één voltooide Intelligence Index-taak $0,21 op Claude Haiku 5.5 en $0,18 op GPT-5.6 Luna. De helft van de tokenprijs, 19% meer per antwoord.

De twee tariefkaarten

Per miljoen tokens in Amerikaanse dollars. De tarieven van Anthropic en OpenAI komen uit hun eigen documentatie; de gedeelde scores zijn Artificial Analysis Intelligence Index v4.3.2, gelezen op 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs GPT-5.6 Luna — the scoreboard' with rows Index v4.3.2 43.40 against 37.32, cost per task $0.21 against $0.18, input price $0.10 against $0.20, output price $0.50 against $1.20, Terminal Bench 4.0 0.3283 against 0.1162 and status 'current, API only' against 'superseded by GPT-6 Luna', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; prices per vendor documentation.'

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens en $0,50 daarboven; GPT-5.6 Luna $0,20, verdubbelt naar $0,40 voor verzoeken van meer dan 272.000 tokens.

• Output — Claude Haiku 5.5 $0,50 tot 100.000 tokens en $2,50 daarboven; GPT-5.6 Luna $1,20, stijgend naar $1,80 op het lange-contextpad.

• Gecachte invoer — Claude Haiku 5.5 $0,01 en $0,05, een korting van 90%; GPT-5.6 Luna $0,02, ook 90%, plus een toeslag voor cacheschrijven van $0,25.

• Context — 1 mln. tokens voor Claude Haiku 5.5 en 1.050.000 voor GPT-5.6 Luna. Beide beperken een enkele respons tot 128.000 tokens, en OpenAI publiceert een kennisafsluitdatum van 16 februari 2026 voor zijn model.

• Redeneerbeheersing — Claude Haiku 5.5 biedt een inspanningsregelaar van Laag tot Max, met gemiddeld als standaard; GPT-5.6 Luna biedt zes instellingen: geen / laag / gemiddeld (standaard) / hoog / extra hoog / max.

• Onafhankelijke score — 43,40 voor Claude Haiku 5.5 (Max) tegenover 37,32 voor GPT-5.6 Luna (Max), een verschil van 6,07 punten op een ranglijst van 182 modellen.

• Status — Claude Haiku 5.5 is actueel, propriëtair en alleen via API beschikbaar. GPT-5.6 Luna heeft een deprecatiemarkering op de onafhankelijke ranglijst en heeft geen rij meer in de prijstabel voor vlaggenschipmodellen van OpenAI.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the two-tier pricing lines and 'Released October 7, 2026'.

De helft van de prijs, duurder per antwoord

De tariefkaartberekening hier is ongewoon gunstig voor Anthropic — een zuivere 2x op beide meters binnen het korte-promptregime — dus het resultaat per taak is wat uitleg behoeft.

Claude Haiku 5.5 genereert 162.164 outputtokens per taak in de Intelligence Index, verdeeld over 129.047 redeneertokens en 33.118 antwoordtokens. GPT-5.6 Luna genereert er 41.235, verdeeld over 28.098 redeneertokens en 13.136 antwoordtokens. Het model van Anthropic verbruikt 3,9 keer zoveel tokens voor dezelfde taak, en bij de helft van de outputrate komt dat neer op 19% meer kosten per afgeronde taak. Het voordeel in snelheid en het nadeel in breedsprakigheid liggen binnen een factor twee van elkaar, dus ze heffen elkaar bijna op — en het restant valt in het voordeel van OpenAI uit.

De twee kosten per taak liggen dicht bij elkaar, maar de manier waarop ze zijn samengesteld niet. De $0,1783 per taak van GPT-5.6 Luna bestaat ruwweg voor de helft uit cache-schrijfacties en voor een kwart uit output; de $0,2128 van Claude Haiku 5.5 is $0,1317 aan input — grotendeels gecachte leesbewerkingen — plus $0,0811 aan output. Geen van beide modellen is in absolute zin duur, en ze zijn op verschillende onderdelen duur, wat ervoor zorgt dat de totalen per taak convergeren terwijl de tariefkaarten een factor twee uit elkaar liggen.

Dit is hetzelfde effect dat een vergelijking per token van redeneermodellen over het algemeen onbetrouwbaar maakt, en het is de moeite waard om het ronduit te benoemen: een goedkope meter vermenigvuldigt met een zwaar tokenbudget, en het product is wat je betaalt. Anthropics eigen notities bij de lancering zijn openhartig hierover en stellen dat Claude Haiku 5.5 "bijzonder goede waar voor je geld biedt wanneer het wordt gebruikt voor taken met prompts tot 100.000 tokens, die ongeveer 90% van de verzoeken aan ons vorige Haiku-model uitmaken."

De blend-wiskunde vertelt hetzelfde verhaal vanuit de andere richting. Op de 7:2:1 input-zware blend van Artificial Analysis — de vorm die het grootste deel van het productieverkeer daadwerkelijk heeft — komt Claude Haiku 5.5 uit op $0,077 per miljoen tokens, tegenover $0,174 voor GPT-5.6 Luna. Dat is de 2,26x die je op basis van het prijskaartje zou verwachten. Pas wanneer je de outputmeter weegt zoals een redeneerworkload dat doet, convergeren de twee, en voorbij 100.000 tokens kruisen ze elkaar.

De kloof van 100.000 tokens tegenover die van 272.000 tokens

Beide leveranciers passen de prijs aan voor lange verzoeken, en de drempelwaarden liggen meer dan tweeënhalf keer uit elkaar.

Die van Anthropic ligt op 100.000 inputtokens. Daarboven worden de tarieven van Claude Haiku 5.5 $0,40 voor input en $2,50 voor output — vijf keer het tarief voor korte prompts, toegepast op het hele verzoek. Het omslagpunt van OpenAI ligt op 272.000 inputtokens. Daarboven worden de tarieven van GPT-5.6 Luna $0,40 voor input en $1,80 voor output — 2x input en 1,5x output, ook toegepast op het hele verzoek.

Het omslagpunt is dus geen langzame convergentie; het is een sprong. Een retrievalprompt van 120.000 tokens valt in de lange tariefcategorie van Anthropic en zit ruim binnen de korte tariefcategorie van OpenAI, waardoor een 2x voordeel voor Anthropic omslaat in een 1,25x voordeel voor OpenAI op invoer en een 1,39x voordeel op uitvoer. En de drempel van Anthropic is zo laag dat een documentintensieve pipeline hem regelmatig overschrijdt, terwijl die van OpenAI zo hoog is dat de meeste dergelijke pipelines hem nooit tegenkomen.

Onder 100.000 tokens verandert niets aan deze ordening. Boven 272.000 keert de ordening om en blijft omgekeerd.

Wat verving het model waarmee je het vergelijkt?

Dit is het onderdeel dat zou moeten bepalen hoeveel tijd je überhaupt aan de vergelijking besteedt.

OpenAI bracht GPT-6 Luna uit op 22 september 2026 — vijftien dagen voordat Anthropic Claude Haiku 5.5 uitbracht — tegen $0,10 voor input en $0,50 voor output, met een context van 1M tokens, een responsplafond van 128.000 tokens en dezelfde zesstapsregeling voor redeneerinspanning. Dat is exact dezelfde tariefkaart als die van Claude Haiku 5.5, op beide tariefmeters, in het regime voor korte prompts.

Op de onafhankelijke ranglijst liggen de twee dicht genoeg bij elkaar dat de gebruikelijke ordening het niet beslecht: Claude Haiku 5.5 scoort 43,40 tegenover de 38,12 van GPT Luna — nog steeds een Anthropic-voorsprong van 5,28 punten — maar de kosten per afgeronde taak zijn $0,21 tegen $0,068. Dat is een drievoudig OpenAI-voordeel op het getal dat daadwerkelijk in rekening wordt gebracht, en het bestaat om dezelfde reden van breedsprakigheid als hierboven: GPT-6 Luna produceert 50.012 outputtokens per Index-taak tegenover de 162.164 van Claude Haiku 5.5.

Anthropics lanceringsbericht maakt zelf de vergelijking, in een tabel die Haiku 5.5 tegenover "GPT-6 Luna" zet op GDPval-AA v2.1 (1620 tegen 1437), AA-Briefcase v1.1 (1578 tegen 1336), OSWorld 2.1 offline-subset (72,4% tegen 48,9%) en Terminal-Bench 4.0 (39,2% tegen 16,4%). Dat zijn Anthropics eigen cijfers en ze zijn door de leverancier gerapporteerd, maar de keuze van tegenstander verraadt het: het model dat Anthropic koos om te verslaan, is het model na het model in de titel van dit artikel.

Waar de oude Luna nog steeds wint

Drie dingen, en geen ervan is capaciteit.

Video en audio. Geen van beide modellen is video-native — Claude Haiku 5.5 leest tekst en afbeeldingen, en GPT-5.6 Luna leest tekst en afbeeldingen — dus deze rij is een gelijkspel en beide verliezen van alles met een mediapipeline.

Cache-writes. OpenAI publiceert een tarief van $0,25 per miljoen cache-writes voor GPT-5.6 Luna, en Anthropic publiceert er geen voor Claude Haiku 5.5, wat betekent dat de eerlijke formulering is dat de write-kosten vervat zitten in Anthropics inputmeter van $0,10 in plaats van dat ze ontbreken. Een prefix-zware workload met een kortlevende cache betaalt dat verschil bij elke beurt.

En het long-contextpad zelf, waar OpenAI's hogere drempel een echt structureel voordeel is dat niets te maken heeft met welk model slimmer is.

A capture of the OrcaRouter model page for GPT-5.6 Luna under openai/gpt-5.6-luna, showing a 128K maximum output, text, image and file input, public benchmarks by OpenAI dated 2026-07-09, a p50 time to first token, and the page's own description of the model as the fast, cost-efficient tier of OpenAI's GPT-5.6 series with a 1.05M-token context window.

Beide zijn aanroepbaar, een van hen is niet van ons.

GPT-5.6 Luna staat vandaag in de OrcaRouter-catalogus tegen openai/gpt-5.6-luna — $0,20 in, $1,20 uit, $0,25 voor cache-schrijven, een context van 1.050.000 tokens en een antwoordplafond van 128.000 tokens, waarbij de long-context-tier van 272.000 tokens als een aparte stap in het prijsrecord wordt opgenomen in plaats van weggemiddeld. Doorgegeven tegen OpenAI's lijstprijs met 0% markup, en automatische failover eronder, wat iets specifieks waard is voor een bewust ingehaald model: als OpenAI's eigen capaciteit ervoor krapper wordt, verschuift de route voordat je foutbudget dat doet.

Claude Haiku 5.5 staat niet in de catalogus. Het is bereikbaar via de API van Anthropic en via AWS, Google Cloud en Microsoft Azure, en dat is de juiste manier om het te zeggen. Wat de catalogus wel van Anthropic bevat, is Claude Sonnet 5.5 en Claude Opus 5.5, dus het escalatiepad van een goedkope classificatielaag naar een agentische middenlaag is een routeringsinstelling in plaats van een integratie — en dezelfde catalogus bevat GPT-6 Luna tegen exact dezelfde tariefkaart als Claude Haiku 5.5 gebruikt, waardoor de eerlijke A/B voor dit prijspunt een wijziging van twee strings is in plaats van een inkooptraject.

Wat te doen met deze vergelijking

Als je integratie de naam gpt-5.6-luna vermeldt, is de nuttige conclusie niet dat Claude Haiku 5.5 het met zes indexpunten verslaat. Het is dat je op een model zit dat je leverancier al twee keer heeft vervangen binnen zijn eigen flash-tier — eerst door de generatie van Terra, daarna door GPT-6 Luna, dat Anthropic zelf beschouwt als de huidige concurrent in deze prijsklasse. Overstappen naar GPT-6 Luna is een match qua tariefkaart en een drievoudige daling van de kosten per afgeronde taak bij dezelfde onafhankelijke meting.

Als je op basis van capaciteit kiest tussen Claude Haiku 5.5 en de Luna-lijn, wint Anthropic op de samengestelde score, op de terminal- en coderijen en op computergebruik, en dat zegt Anthropics eigen leverancierstabel ook. Als je op basis van de factuur kiest, heeft de Luna-lijn elke versie van deze vergelijking met een ruime marge gewonnen, en de reden is één getal: 162.164 outputtokens per taak tegenover 41.235.

Wat deze krachtmeting feitelijk beslecht, is dat een twee keer goedkopere meter minder waard is dan een vier keer zuiniger model. Anthropic heeft de prijs van Claude Haiku 5.5 gelijkgetrokken met die van GPT-6 Luna, en dat lukte — exact, op beide meters — en het kost nog steeds drie keer zoveel om er een antwoord uit te krijgen.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt