
Claude Haiku 5.5 vs Gemini 3.8 Flash: twee punten op de index, zes keer de kosten per taak
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Claude Haiku 5.5 en Gemini 3.8 Flash liggen qua gemeten capaciteit dichter bij elkaar dan enig ander paar in deze prijsklasse — 43,40 tegenover 40,93 op de Artificial Analysis Intelligence Index v4.3.2, beide binnen de topvijftig van een ranglijst van 225 modellen. Wat hen onderscheidt, is wat een van die indexpunten kost. Bij dezelfde onafhankelijke meting kost een voltooide Intelligence Index-taak $0,21 bij Claude Haiku 5.5 en $1,24 bij Gemini 3.8 Flash.
Dat is een zesvoudig verschil bij een verschil in score van tweeënhalf punt, en dat is het getal dat deze vergelijking zou moeten beslissen. Al het andere — de tarieven op het prijskaartje, de lijst met modaliteiten, de deadlines die aan Google's prijsstelling hangen — is een discussie over de randen.
Beide modellen, op de cijfers die ertoe doen
Per miljoen tokens in Amerikaanse dollars, uit de eigen prijsdocumentatie van Anthropic en Google, met de onafhankelijke metingen toegeschreven aan Artificial Analysis. Gecacht op 2026-10-08.

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens en $0,50 daarboven; Gemini 3.8 Flash $0,75 vast, stijgend naar $1,50 op 1 januari 2027.
• Uitvoer — Claude Haiku 5.5 $0,50 tot 100.000 tokens en $2,50 daarboven; Gemini 3.8 Flash $3,75 vast, stijgend naar $7,50 op dezelfde datum.
• Gecachte invoer — Claude Haiku 5.5 $0,01 en $0,05; Gemini 3.8 Flash $0,075, plus opslagkosten van $0,50 per miljoen tokens per uur.
• Context — 1M tokens voor beide. Maximale output — 128.000 tokens voor Claude Haiku 5.5 tegenover 65.536 voor Gemini 3.8 Flash.
• Invoermodaliteit — tekst en afbeeldingen voor Claude Haiku 5.5; tekst, afbeeldingen, spraak en video voor Gemini 3.8 Flash. Dit is de enige regel waarop de lijst van Google strikt langer is.
• Onafhankelijke score — 43,40 voor {{1}}Claude Haiku 5.5{{/1}} (Max) tegenover 40,93 voor {{1}}Gemini 3.8 Flash{{/1}} (High), op Intelligence Index v4.3.2.
• Onafhankelijke kosten per taak — € 0,21 tegenover € 1,24 op hetzelfde bord.
• Snelheid — 241,9 outputtokens per seconde tegenover 125,2, beide gemeten door Artificial Analysis.
Waar het zesvoudige cijfer vandaan komt
Het verschil in kosten per taak is groter dan het verschil op het prijskaartje, en dat is het interessante deel, want het betekent dat de tariefkaart het op zichzelf niet verklaart.
De rekensom op het prijskaartje is simpel genoeg: $0,10 tegenover $0,75 voor invoer is zeven en een half keer goedkoper, en $0,50 tegenover $3,75 voor uitvoer is dezelfde verhouding. Als beide modellen dezelfde tokens voor hetzelfde werk zouden genereren, zou die verhouding rechtstreeks doorwerken op de factuur.
Het zet zich niet door, en beide effecten spelen in het voordeel van Google. Claude Haiku 5.5 is breedsprakig op een manier die de leverancier zelf toegeeft: Artificial Analysis registreerde 440 miljoen outputtokens tijdens het draaien van de Index, tegen een mediaan van 100 miljoen, en noemt het model zeer breedsprakig. Gemini 3.8 Flash genereerde 170 miljoen tegen een mediaan van 81 miljoen — ook bestempeld als breedsprakig, maar slechts een derde van het tokenaantal. De eigen documentatie van Anthropic voegt daar het tweede effect aan toe: Claude Haiku 5.5 gebruikt de nieuwere tokenizer die het deelt met Claude 4.7 en later, waardoor dezelfde tekst neerkomt op ongeveer 30% meer tokens dan bij het model dat het vervangt.
Alles bij elkaar genomen luidt de eerlijke versie van de prijsclaim als volgt: een voordeel van tien tegen een op het invoertarief en een voordeel van zeven en een half tegen een op het uitvoertarief, deels tenietgedaan door een model dat meer tokens per antwoord schrijft, wat uitkomt op een voordeel van zes tegen een bij de meting die de hele klus in rekening brengt. Nog steeds een afstraffing, en een kleinere dan de tariefkaart suggereert.
Op de prijs van Google staat een datum
Het allerbruikbaarste op Google's prijzenpagina is één zin die de meeste vergelijkingstabellen weglaten.
Gemini 3.8 Flash staat vermeld tegen $0,75 voor invoer en $3,75 voor uitvoer "tot en met 31 december 2026", en tegen $1,50 en $7,50 "met ingang van 1 januari 2027". Gecachte invoer gaat op dezelfde datum van $0,075 naar $0,15. Dat is een introductietarief met een vervaldatum ernaast, ongeveer elf weken vanaf het moment van schrijven.
Niets op de kaart van Anthropic staat zo. De tarieven van Claude Haiku 5.5 worden als de tarieven vermeld, met een tweetrapsstructuur die gekoppeld is aan promptlengte in plaats van aan een kalender, en een toezegging tot uitfasering niet eerder dan 7 oktober 2027. Als je een pipeline modelleert die doorloopt tot volgend jaar, dan is de stap van Google in januari een verdubbeling en die hoort in het model; die van Anthropic heeft geen equivalent evenement om voor te plannen.
Dat snijdt aan twee kanten, en de eerlijke lezing is niet "de ene leverancier is eerlijk en de andere niet." Een promotietarief is een echt tarief zolang het duurt, en Google mag een lancering zo prijzen. Het is simpelweg een feit over de vergelijking dat de schijnbaar goedkopere kant van de januaricijfers degene met de deadline is.

Wat zijn twee indexpunten waard?
Een verschil van 2,47 punten op een index die tot in de zestig loopt, is geen afrondingsfout en het is geen kloof. Beide modellen zitten in dezelfde werkband, en de praktische vraag is of het verschil opduikt bij de taken die je daadwerkelijk uitvoert.
Volgens de eigen cijfers van de leveranciers worden de twee niet op hetzelfde testharnas gemeten, dus ze kunnen niet direct naast elkaar worden gelegd — Anthropic publiceert resultaten voor GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 en FrontierCode voor Claude Haiku 5.5, en Google publiceert zijn eigen set voor Gemini 3.8 Flash, en geen van beide leveranciers heeft de testsuite van de ander uitgevoerd. De enige beschikbare vergelijking van appels met appels is de onafhankelijke ranglijst, en daar luidt het antwoord dat Anthropic voorligt met een meetbare maar kleine marge.
Het verschil in capaciteiten dat voor sommige teams zwaarder zal wegen, ligt op het vlak van modaliteit. Gemini 3.8 Flash accepteert spraak- en video-invoer; Claude Haiku 5.5 accepteert tekst en afbeeldingen. Een pipeline die gespreksopnamen of schermopnamen native verwerkt, kiest helemaal niet op prijs tussen deze twee modellen — een van beide kan de taak niet uitvoeren zonder een transcriptie- of frame-extractiestap ervoor, en die stap heeft zijn eigen kosten en zijn eigen faalwijzen.
De goedkopere kant van het paar draaien
Gemini 3.8 Flash staat in de OrcaRouter-catalogus tegen Google's lijstprijs met 0% opslag, wat hier meer dan anders van belang is: het tarief van de provider wordt doorgegeven in plaats van gemengd, dus als je wilt zien wat de stap van januari daadwerkelijk met een factuur doet, beweegt het getal mee met dat van Google. Claude Sonnet 5.5 en Claude Opus 5.5 staan ook in de catalogus, waardoor een routingtest met drie routes — de Flash-route van Google, een Anthropic-middenklasse en later een Anthropic-kleinere tier — een configuratie is in plaats van een project. Eén sleutel, één SDK, automatische failover eronder, en de routing-DSL als je de escalatie liever in de route dan in applicatiecode uitdrukt.
Claude Haiku 5.5 zelf staat nog niet in de catalogus, en het is beter om dat te zeggen dan het vaag te laten. Het Anthropic-deel van deze vergelijking is momenteel alleen bereikbaar bij Anthropic, terwijl het Google-deel vandaag bij ons kan worden opgevraagd tegen de hierboven getoonde prijs.

Welke, en voor wie?
Als je werk tekst in en tekst uit is, je prompts onder de 100.000 tokens blijven en je per token betaalt voor echt volume, dan is Claude Haiku 5.5 volgens elke maatstaf in dit stuk het goedkopere model en het hoger scorende model op de enige gedeelde ranglijst — met de kanttekening dat het voordeel zesvoudig is qua kosten per taak, in plaats van het tienvoudige dat de sticker suggereert.
Als je audio of video als invoer nodig hebt, of een 65K-plus antwoord nodig hebt, of je prompts regelmatig lang zijn, verandert de afweging: Gemini 3.8 Flash accepteert invoer die de kleine tier van Anthropic niet aankan, en boven 100.000 tokens is de eigen tweede tier van Anthropic aanzienlijk duurder dan het vaste tarief van Google.
Het enige waar je aan vast moet houden, zijn de datums. Google's tarief is geldig tot het einde van het jaar en verdubbelt daarna. Anthropic's tarief wordt als vast opgegeven, met een lengtestaffel. Aan welke kant van die afweging je ook uitkomt, bouw de kalender in de spreadsheet voordat je de pipeline bouwt.
