Een gegenereerde hero-kaart met de titel 'Claude Haiku 5.5 vs Gemini 3.6 Flash' en de bovenkop '7,5x DE KOSTEN PER ANTWOORD', met Claude Haiku 5.5 tegen Invoer $0,10, Uitvoer $0,50 en Index 43,40 versus Gemini 3.6 Flash tegen Invoer $0,75, Uitvoer $3,75 en Index 33,98, boven een balk met de tekst 'Kosten per afgeronde taak $0,21 vs $1,60'.
Engineering & Research

Claude Haiku 5.5 vs Gemini 3.6 Flash: 7,5x de kosten per antwoord, een model dat negen punten lager scoort

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Haiku 5.5 en Gemini 3.6 Flash zitten in dezelfde categorie van hun respectievelijke line-ups — de kleine, snelle, goedkope — en daar houdt de gelijkenis op. Op Artificial Analysis Intelligence Index v4.3.2 scoort Claude Haiku 5.5 43,40 in de Max-configuratie, tegenover 33,98 voor Gemini 3.6 Flash in de High-configuratie. In dezelfde run kost één voltooide Index-taak $0,21 op Claude Haiku 5.5 en $1,60 op Gemini 3.6 Flash.

Lees dat paar in samenhang, want elk afzonderlijk misleidt. Het goedkopere model is niet marginaal goedkoper; het is 7,5 keer goedkoper per voltooide taak. En het model dat het verslaat is niet marginaal zwakker; het is 9,42 indexpunten zwakker, wat op een ranglijst van 182 modellen de afstand is tussen het bovenste kwartiel en het midden.

Beide feiten komen uit dezelfde onafhankelijke run, wat van belang is omdat de leverancierskaarten hier je geen van beide vertellen. Anthropic lanceerde Claude Haiku 5.5 op 7 oktober 2026; Google bracht Gemini 3.6 Flash uit op 21 juli 2026. De drie maanden ertussen zijn het interessante deel.

De twee kaarten, naast elkaar

Per miljoen tokens in Amerikaanse dollars. De tarieven van Anthropic en Google komen uit hun eigen prijsdocumentatie; de gedeelde rijen zijn Artificial Analysis Intelligence Index v4.3.2. Gecached op 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.6 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 33.98, cost per task $0.21 against $1.60, input price $0.10 against $0.75, output tokens per task 162,164 against 41,606, Terminal Bench 4.0 0.3283 against 0.0707 and input modality 'text, image' against 'text, image, video, audio', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; Gemini 3.6 Flash is flagged deprecated on the board.'

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens en $0,50 daarboven; Gemini 3.6 Flash vandaag $0,75 vast, stijgend naar $1,50 op 1 januari 2027.

• Uitvoer — Claude Haiku 5.5 $0,50 tot 100.000 tokens en $2,50 daarboven; Gemini 3.6 Flash vandaag vast $3,75, stijgend naar $7,50 op dezelfde datum.

• Gecachte invoer — Claude Haiku 5.5 $0,01 en $0,05; Gemini 3.6 Flash $0,075, plus opslagkosten van $0,50 per miljoen tokens per uur.

• Context- en uitvoerplafond — 1 mln tokens voor beide. Claude Haiku 5.5 beperkt een antwoord tot 128.000 tokens; Gemini 3.6 Flash tot 65.536.

• Modaliteit — Claude Haiku 5.5 accepteert tekst en afbeeldingen. Gemini 3.6 Flash accepteert tekst, afbeeldingen, video, audio en bestanden. Dit is de enige rij waarin de kant van Google onbetwist vooroploopt, en voor een pipeline voor mediabegrip kan dat de hele kwestie beslissen.

• Onafhankelijke score — 43.40 voor Claude Haiku 5.5 (Max) tegenover 33.98 voor Gemini 3.6 Flash (High).

• Kosten per voltooide taak — $0,21 tegenover $1,60, in dezelfde evaluatierun.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

Waarom per taak, niet per token, het getal is dat je moet gebruiken

De tariefkaart-multiple ziet er op input al uit als 7,5 en op output ook als 7,5, dus het getal per taak is hier geen verrassing — maar het is de moeite waard om te laten zien waarom de twee modellen op de ene maatstaf op hetzelfde punt uitkomen en op de andere zo ver uit elkaar liggen, want dezelfde rekensom pakt in de andere matchups van deze batch de andere kant op uit.

Gemini 3.6 Flash is de minder uitgebreide van de twee. Het produceert 41.606 outputtokens per Intelligence Index-taak — 20.061 redenering en 21.545 antwoord — tegenover 162.164 van Claude Haiku 5.5, verdeeld over 129.047 redenering en 33.118 antwoord. Het model van Anthropic verbruikt bijna vier keer zoveel tokens voor hetzelfde werk, en het is degene wiens outputsnelheid een zevende van die van Google is, dus de tokenkloof en de snelheidskloof versterken elkaar in plaats van elkaar op te heffen.

Die combinatie — goedkoop tarief maal intensief gebruik — is de eerlijke beschrijving van de economie van Claude Haiku 5.5, en Anthropics eigen launchbericht erkent de andere kant ervan: het model is "bijzonder voordelig bij gebruik voor taken met prompts tot 100.000 tokens, die ongeveer 90% van de aanvragen voor ons vorige Haiku-model uitmaken." Boven 100.000 tokens wordt het invoertarief $0,50 en het uitvoertarief $2,50, waarmee het veelvoud ten opzichte van Gemini 3.6 Flash terugloopt tot ongeveer 1,5x.

Wat Googles eigen niveau deed terwijl deze vergelijking stilstond

Hier houdt het stuk op een vergelijking tussen twee modellen te zijn en wordt het een waarschuwing over met welke Gemini je eigenlijk vergelijkt.

Google heeft de Flash-prijs gedurende drie generaties gelijk gehouden. Gemini 3.6 Flash, Gemini 3.7 Flash en Gemini 3.8 Flash staan allemaal vermeld tegen $0,75 voor invoer en $3,75 voor uitvoer in de eigen prijsdocumentatie van Google, met hetzelfde cachetarief van $0,075 en dezelfde verhoging op 1 januari 2027 naar $1,50 en $7,50. In de kaart van Google voor de 3.6-lijn wordt het beschreven als 'ons Flash-model van de vorige generatie', wat de eigen woorden van de leverancier ervoor zijn.

Wat veranderde, was de score, niet de prijs. Op de onafhankelijke ranglijst scoort Gemini 3.6 Flash 33,98, Gemini 3.7 Flash 39,06 en Gemini 3.8 Flash 40,93 — allemaal in hun meest intensieve gepubliceerde configuratie. In zes weken kwamen er binnen de flash-tier van Google negen indexpunten bij, zonder dat het tarief veranderde.

De consequentie voor iedereen die midden in een evaluatie zit, is concreet: als je deze match-up drie weken geleden hebt gebenchmarkt tegen Gemini 3.7 Flash, is je resultaat verouderd, en als je het tegen Gemini 3.8 Flash benchmarkt, neemt de kloof met Claude Haiku 5.5 af tot 2,47 punten. Gemini 3.6 Flash is de versie van deze vergelijking die Anthropic het meest vleit, en het is ook de versie waarbij Google het verst van een verkoop af staat.

Artificial Analysis markeert de vermelding van 3.6 als verouderd. De prijsdocumentatie van Google publiceert het tarief nog steeds, en de modellenlijst verwijst nog altijd naar een 3.6-sectie, dus de eerlijke lezing is niet "verdwenen" maar "binnen tien weken tweemaal opgevolgd binnen zijn eigen familie" — en dat is een feit over hoe snel deze tier beweegt, geen reden om de vergelijking over te slaan.

Voor wie dit nu eigenlijk beslist

Er is een echt argument voor Gemini 3.6 Flash, en dat is niet de score.

Als je audio of video in de prompt nodig hebt, kan Claude Haiku 5.5 dat helemaal niet — het leest tekst en afbeeldingen en niets anders. Gemini 3.6 Flash leest tekst, afbeeldingen, video, audio en bestanden, en onze eigen catalogus registreert het op een gemeten 582 outputtokens per seconde met een mediane tijd tot het eerste token van 4,1 seconden over de afgelopen week, wat een snel model is, zelfs naar Flash-maatstaven. Voor een pipeline voor mediabegrip is de modaliteitenlijst de hele beslissing en is de indexkloof een voetnoot.

Als je werk uit tekst en afbeeldingen bestaat, liggen de cijfers niet dicht genoeg bij elkaar om erover te twisten. Bij een inputzware mix van 7:2:1 — de vorm die het gros van het productieverkeer heeft — komt Claude Haiku 5.5 uit op $0,077 per miljoen tokens tegenover $0,63 voor Gemini 3.6 Flash. Bij een miljoen gemengde tokens per dag is dat 77 cent tegen $6,30, en het tweede getal wordt op 1 januari 2027 slechter, terwijl het eerste niet beweegt.

De 100.000-tokenklif is de enige voorwaarde die de uitkomst doet omslaan. Een retrieval- of langdocumentpijplijn die routinematig prompts van 150.000 tokens samenstelt, betaalt het tarief van Anthropic van $0,50/$2,50 over de hele aanvraag, en op dat punt liggen de twee modellen qua prijs binnen een factor 1,5 van elkaar, terwijl Gemini 3.6 Flash nog steeds wint op modaliteit en op het percentage van 91,8% dat Google publiceert voor multi-needle retrieval bij een gemiddelde van 128k. Dat is door de leverancier gerapporteerd en niet gereproduceerd, en het hoort precies in die framing thuis.

A capture of the OrcaRouter model page for Gemini 3.6 Flash under google/gemini-3.6-flash, showing a 65K maximum output, text, image, video, file and audio input, public benchmarks published by Google dated 2026-07-21, a p50 time to first token of 4.1 seconds, and the page's own description of the model as Google's fast, cost-efficient multimodal model in the Gemini 3 family with a 1M-token context window.

Beide aanroepen, of één aanroepen

Gemini 3.6 Flash staat vandaag in de OrcaRouter-catalogus op google/gemini-3.6-flash, tegen de listprijs van Google met 0% opslag — $0,75 en $3,75 met een cache-read van $0,075, doorgegeven zoals de provider het in rekening brengt. Dat is van belang voor dit specifieke model, omdat de verhoging van Google per 1 januari een tariefwijziging is, en een pass-through-catalogus neemt die over op de dag dat die ingaat in plaats van bij de volgende contractverlenging. Met één API-sleutel en één SDK-aanroep bereik je ofwel dit model ofwel een van de ruim 200 andere in de catalogus, dus een A/B tussen een Google-arm en een Anthropic-arm is een wijziging van de model-string met automatische failover eronder, in plaats van een tweede integratie.

Claude Haiku 5.5 staat niet in de catalogus. Het model van Anthropic is bereikbaar via de eigen API van Anthropic en via AWS, Google Cloud en Microsoft Azure, en dat is het hele eerlijke antwoord. Wat we uit die reeks wél aanbieden is Claude Sonnet 5.5 en Claude Opus 5.5 — wat ervoor zorgt dat het escalatiepad van een goedkope classificatieaanroep tot een agentische aanroep uit het middensegment een routeringsbeslissing is in plaats van een project.

Dat maakt het oordeel eenvoudig genoeg om ronduit te stellen. Voor tekst- en beeldwerk bij korte promptlengtes wint Claude Haiku 5.5 op elk vlak, behalve het antwoordplafond. Voor alles waar audio of video in zit, is Gemini 3.6 Flash de enige van de twee die überhaupt kan antwoorden — en als je toch Googles tarief voor die capaciteit gaat betalen, vraag dan voor welke Gemini je dat betaalt, want op dit niveau kun je voor hetzelfde geld negen indexpunten meer krijgen van een nieuwer broertje of zusje.

Eén API voor meer dan 200 modellen, één sleutel, automatische failover eronder, zodat een A/B tussen een Google-tak en een Anthropic-tak een wijziging van de modelstring is in plaats van een tweede integratie.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt