Een gegenereerde herokaart voor 'Zes keer de kosten voor twee punten index', met de badge 'KOSTEN PER TAAK' en de kicker 'TWEE FLASH-TIER MODELLEN, ÉÉN SCOREBOARD' en de ondertitel 'Claude Haiku 5.5 op 43.40 tegenover Gemini 3.8 Flash op 40.93 op Intelligence Index v4.3.2.' Vier chips tonen '43.40 vs 40.93', '$0.21 vs $1.24', '$0.10 vs $0.75' en 'stijgt 1 jan 2027'. Twee kaarten eronder zijn gelabeld 'VOORDEEL VAN ANTHROPIC' ('hoger op het gedeelde scorebord, en zes keer goedkoper per afgeronde taak') en 'VOORDEEL VAN GOOGLE' ('spraak- en video-invoer, en een vast tarief over het hele venster'). Een voettekst luidt 'Onafhankelijke metingen van Artificial Analysis; lijstprijzen afgelezen op 8 oktober 2026.' Het OrcaRouter-logo is in de rechteronderhoek gecompositeerd.
Guides & Insights

Claude Haiku 5.5 vs Gemini 3.8 Flash: twee punten op de index, zes keer de kosten per taak

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Haiku 5.5 en Gemini 3.8 Flash liggen qua gemeten capaciteit dichter bij elkaar dan enig ander paar in deze prijsklasse — 43,40 tegenover 40,93 op de Artificial Analysis Intelligence Index v4.3.2, beide binnen de topvijftig van een ranglijst van 225 modellen. Wat hen onderscheidt, is wat een van die indexpunten kost. Bij dezelfde onafhankelijke meting kost een voltooide Intelligence Index-taak $0,21 bij Claude Haiku 5.5 en $1,24 bij Gemini 3.8 Flash.

Dat is een zesvoudig verschil bij een verschil in score van tweeënhalf punt, en dat is het getal dat deze vergelijking zou moeten beslissen. Al het andere — de tarieven op het prijskaartje, de lijst met modaliteiten, de deadlines die aan Google's prijsstelling hangen — is een discussie over de randen.

Beide modellen, op de cijfers die ertoe doen

Per miljoen tokens in Amerikaanse dollars, uit de eigen prijsdocumentatie van Ant​hropic en Google, met de onafhankelijke metingen toegeschreven aan Artificial Analysis. Gecacht op 2026-10-08.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens en $0,50 daarboven; Gemini 3.8 Flash $0,75 vast, stijgend naar $1,50 op 1 januari 2027.

• Uitvoer — Claude Haiku 5.5 $0,50 tot 100.000 tokens en $2,50 daarboven; Gemini 3.8 Flash $3,75 vast, stijgend naar $7,50 op dezelfde datum.

• Gecachte invoer — Claude Haiku 5.5 $0,01 en $0,05; Gemini 3.8 Flash $0,075, plus opslagkosten van $0,50 per miljoen tokens per uur.

• Context — 1M tokens voor beide. Maximale output — 128.000 tokens voor Claude Haiku 5.5 tegenover 65.536 voor Gemini 3.8 Flash.

• Invoermodaliteit — tekst en afbeeldingen voor Claude Haiku 5.5; tekst, afbeeldingen, spraak en video voor Gemini 3.8 Flash. Dit is de enige regel waarop de lijst van Google strikt langer is.

• Onafhankelijke score — 43,40 voor {{1}}Claude Haiku 5.5{{/1}} (Max) tegenover 40,93 voor {{1}}Gemini 3.8 Flash{{/1}} (High), op Intelligence Index v4.3.2.

• Onafhankelijke kosten per taak — € 0,21 tegenover € 1,24 op hetzelfde bord.

• Snelheid — 241,9 outputtokens per seconde tegenover 125,2, beide gemeten door Artificial Analysis.

Waar het zesvoudige cijfer vandaan komt

Het verschil in kosten per taak is groter dan het verschil op het prijskaartje, en dat is het interessante deel, want het betekent dat de tariefkaart het op zichzelf niet verklaart.

De rekensom op het prijskaartje is simpel genoeg: $0,10 tegenover $0,75 voor invoer is zeven en een half keer goedkoper, en $0,50 tegenover $3,75 voor uitvoer is dezelfde verhouding. Als beide modellen dezelfde tokens voor hetzelfde werk zouden genereren, zou die verhouding rechtstreeks doorwerken op de factuur.

Het zet zich niet door, en beide effecten spelen in het voordeel van Google. Claude Haiku 5.5 is breedsprakig op een manier die de leverancier zelf toegeeft: Artificial Analysis registreerde 440 miljoen outputtokens tijdens het draaien van de Index, tegen een mediaan van 100 miljoen, en noemt het model zeer breedsprakig. Gemini 3.8 Flash genereerde 170 miljoen tegen een mediaan van 81 miljoen — ook bestempeld als breedsprakig, maar slechts een derde van het tokenaantal. De eigen documentatie van Anthropic voegt daar het tweede effect aan toe: Claude Haiku 5.5 gebruikt de nieuwere tokenizer die het deelt met Claude 4.7 en later, waardoor dezelfde tekst neerkomt op ongeveer 30% meer tokens dan bij het model dat het vervangt.

Alles bij elkaar genomen luidt de eerlijke versie van de prijsclaim als volgt: een voordeel van tien tegen een op het invoertarief en een voordeel van zeven en een half tegen een op het uitvoertarief, deels tenietgedaan door een model dat meer tokens per antwoord schrijft, wat uitkomt op een voordeel van zes tegen een bij de meting die de hele klus in rekening brengt. Nog steeds een afstraffing, en een kleinere dan de tariefkaart suggereert.

Op de prijs van Google staat een datum

Het allerbruikbaarste op Google's prijzenpagina is één zin die de meeste vergelijkingstabellen weglaten.

Gemini 3.8 Flash staat vermeld tegen $0,75 voor invoer en $3,75 voor uitvoer "tot en met 31 december 2026", en tegen $1,50 en $7,50 "met ingang van 1 januari 2027". Gecachte invoer gaat op dezelfde datum van $0,075 naar $0,15. Dat is een introductietarief met een vervaldatum ernaast, ongeveer elf weken vanaf het moment van schrijven.

Niets op de kaart van Ant​hropic staat zo. De tarieven van Claude Haiku 5.5 worden als de tarieven vermeld, met een tweetrapsstructuur die gekoppeld is aan promptlengte in plaats van aan een kalender, en een toezegging tot uitfasering niet eerder dan 7 oktober 2027. Als je een pipeline modelleert die doorloopt tot volgend jaar, dan is de stap van Google in januari een verdubbeling en die hoort in het model; die van Ant​hropic heeft geen equivalent evenement om voor te plannen.

Dat snijdt aan twee kanten, en de eerlijke lezing is niet "de ene leverancier is eerlijk en de andere niet." Een promotietarief is een echt tarief zolang het duurt, en Google mag een lancering zo prijzen. Het is simpelweg een feit over de vergelijking dat de schijnbaar goedkopere kant van de januaricijfers degene met de deadline is.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

Wat zijn twee indexpunten waard?

Een verschil van 2,47 punten op een index die tot in de zestig loopt, is geen afrondingsfout en het is geen kloof. Beide modellen zitten in dezelfde werkband, en de praktische vraag is of het verschil opduikt bij de taken die je daadwerkelijk uitvoert.

Volgens de eigen cijfers van de leveranciers worden de twee niet op hetzelfde testharnas gemeten, dus ze kunnen niet direct naast elkaar worden gelegd — Ant​hropic publiceert resultaten voor GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 en FrontierCode voor Claude Haiku 5.5, en Google publiceert zijn eigen set voor Gemini 3.8 Flash, en geen van beide leveranciers heeft de testsuite van de ander uitgevoerd. De enige beschikbare vergelijking van appels met appels is de onafhankelijke ranglijst, en daar luidt het antwoord dat Ant​hropic voorligt met een meetbare maar kleine marge.

Het verschil in capaciteiten dat voor sommige teams zwaarder zal wegen, ligt op het vlak van modaliteit. Gemini 3.8 Flash accepteert spraak- en video-invoer; Claude Haiku 5.5 accepteert tekst en afbeeldingen. Een pipeline die gespreksopnamen of schermopnamen native verwerkt, kiest helemaal niet op prijs tussen deze twee modellen — een van beide kan de taak niet uitvoeren zonder een transcriptie- of frame-extractiestap ervoor, en die stap heeft zijn eigen kosten en zijn eigen faalwijzen.

De goedkopere kant van het paar draaien

Gemini 3.8 Flash staat in de OrcaRouter-catalogus tegen Google's lijstprijs met 0% opslag, wat hier meer dan anders van belang is: het tarief van de provider wordt doorgegeven in plaats van gemengd, dus als je wilt zien wat de stap van januari daadwerkelijk met een factuur doet, beweegt het getal mee met dat van Google. Claude Sonnet 5.5 en Claude Opus 5.5 staan ook in de catalogus, waardoor een routingtest met drie routes — de Flash-route van Google, een Ant​hropic-middenklasse en later een Ant​hropic-kleinere tier — een configuratie is in plaats van een project. Eén sleutel, één SDK, automatische failover eronder, en de routing-DSL als je de escalatie liever in de route dan in applicatiecode uitdrukt.

Claude Haiku 5.5 zelf staat nog niet in de catalogus, en het is beter om dat te zeggen dan het vaag te laten. Het Ant​hropic-deel van deze vergelijking is momenteel alleen bereikbaar bij Ant​hropic, terwijl het Google-deel vandaag bij ons kan worden opgevraagd tegen de hierboven getoonde prijs.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Welke, en voor wie?

Als je werk tekst in en tekst uit is, je prompts onder de 100.000 tokens blijven en je per token betaalt voor echt volume, dan is Claude Haiku 5.5 volgens elke maatstaf in dit stuk het goedkopere model en het hoger scorende model op de enige gedeelde ranglijst — met de kanttekening dat het voordeel zesvoudig is qua kosten per taak, in plaats van het tienvoudige dat de sticker suggereert.

Als je audio of video als invoer nodig hebt, of een 65K-plus antwoord nodig hebt, of je prompts regelmatig lang zijn, verandert de afweging: Gemini 3.8 Flash accepteert invoer die de kleine tier van Ant​hropic niet aankan, en boven 100.000 tokens is de eigen tweede tier van Ant​hropic aanzienlijk duurder dan het vaste tarief van Google.

Het enige waar je aan vast moet houden, zijn de datums. Google's tarief is geldig tot het einde van het jaar en verdubbelt daarna. Ant​hropic's tarief wordt als vast opgegeven, met een lengtestaffel. Aan welke kant van die afweging je ook uitkomt, bouw de kalender in de spreadsheet voordat je de pipeline bouwt.