Een titelkaart voor de vergelijking tussen Gemini 3.7 Flash en Claude Opus 5, met een snelle sprinterkaart gelabeld Gemini 3.7 Flash met een $0,75 / $3,75-tag, een hoge torenkaart gelabeld Claude Opus 5 met een $5 / $25-tag, en een klein 1/6-breukpictogram ertussen.
Guides & Insights

Gemini 3.7 Flash vs Claude Opus 5: Wat een werkpaard je oplevert voor een zesde van de prijs

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Hier is het getal dat deze vergelijking de moeite waard maakt: Claude Opus 5, Anthropics vlaggenschip, scoort 61 op de Artificial Analysis Intelligence Index, terwijl Gemini 3.7 Flash, Googles werkpaard dat op 13 augustus 2026 is uitgebracht, 56 scoort. Vijf punten. En tegen het promotietarief dat Google tot het einde van het jaar hanteert, kost Gemini 3.7 Flash $0,75 per miljoen invoertokens en $3,75 per miljoen uitvoertokens — ongeveer een zesde van Claude Opus 5's $5,00 / $25,00. De kloof die vroeger "werkpaard" van "vlaggenschip" scheidde, is zo nauw geworden dat de eerlijke vraag niet langer is of het goedkope model goed is, maar wat het dure model nog steeds kan wat het goedkope niet kan.

De framing is belangrijk, want dit is geen gelijkwaardige vergelijking en doen alsof dat wel zo is, zou je misleiden. Claude Opus 5, uitgebracht op 24 juli 2026, is Anthrop​ics meest capabele algemeen beschikbare model: een redeneermodel met een context van 1M tokens en een outputplafond van 128K, ontworpen voor de moeilijkste technische, onderzoeks- en computergebruikstaken. Gemini 3.7 Flash is Go​ogles werkpaard voor hoge volumes: 1M context, 64K output, tekst/beeld/audio/video-input, en een ontwerpopdracht die het tegenovergestelde is van die van Opus — zoveel mogelijk tokens streamen, zo goedkoop mogelijk, voor de 95% van het verkeer dat routine is. Hen vergelijken op één enkel getal is hoe je bij een verkeerd antwoord uitkomt; hen vergelijken op de vorm van het werk dat je daadwerkelijk draait, is hoe je een nuttig antwoord krijgt.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Vijf punten, uitgepakt

De Intelligence Index is geen lineaire schaal, en het verschil tussen 56 en 61 weegt bij sommige taken zwaarder dan bij andere. De 61 van Opus 5 komt doordat het vooroploopt op de moeilijkste onderdelen van de index — de 30,2 op ARC-AGI-3, 43,3 op FrontierBench en 79,2 op SWE-bench Pro zijn allemaal door de leverancier gerapporteerd, maar het zijn wel resultaten op het gebied van frontier-redeneren waar geen enkel model uit de Flash-klasse aan kan tippen. De 56 van Gemini 3.7 Flash komt anders tot stand: de door Go​ogle gerapporteerde cijfers (65,3 op DeepSWE v1.1, 1588 Elo op WebDev Arena, 30,4 op AutomationBench) laten een model zien dat uitblinkt in begrensde, grootschalige engineering en agents, maar niet in nieuw, open-eindig redeneren. Vijf indexpunten beschrijven dus een echte capaciteitsklif, ook al lijkt de afstand in de kop klein.

• Intelligence Index — 56 voor Gemini 3.7 Flash versus 61 voor Claude Opus 5 (maximale inspanning), volgens Artificial Analysis.

• Uitvoersnelheid — ~340 tokens/s voor Gemini 3.7 Flash versus ~53 tokens/s voor Claude Opus 5, beide volgens Artificial Analysis. Een 6,4x verschil.

• Contextvenster — 1M tokens voor beide, maar het outputplafond van Claude Opus 5 is 128K tegenover 64K van Gemini 3.7 Flash.

• Inputprijs — $0,75 (promotioneel, tot en met 2026) versus $5,00 — een 6,7x verschil.

• Outputprijs — $3,75 (promotioneel) versus $25,00 — een verschil van 6,7x.

• Multimodale invoer — Gemini 3.7 Flash verwerkt tekst, beeld, audio en video; Claude Opus 5 ondersteunt alleen tekst en beeld.

A comparison scoreboard for Gemini 3.7 Flash and Claude Opus 5: Claude Opus 5 leads 61 to 56 on the AA Index and 128K to 64K on max output, but Gemini 3.7 Flash leads ~340 to ~53 tokens per second, $0.75 to $5.00 input and $3.75 to $25.00 output, with both at 1M context.

Waar Claude Opus 5 zijn prijs nog steeds waard is

Het verhaal van het vlaggenschip is geen nostalgie, het is de staart van de taakverdeling. Autonome engineering over een lange horizon — een model dat een uur alleen wordt gelaten met een codebase om te plannen, te bewerken, te testen en te itereren — is waar de gerapporteerde voorsprong van Opus 5 het grootst is, en de computergebruik-resultaten (71 op OSWorld, door de leverancier gerapporteerd) plaatsen het in een klasse waar Gemini 3.7 Flash niet in komt. Teams die overstappen van Claude Opus 4.8 moeten ook weten dat Opus 5 adaptief denken standaard inschakelt met herijkte inspanningsniveaus, en dat het uitschakelen van denken is beperkt tot hoge inspanning — gedragsveranderingen die bestaande pipelines kunnen verbreken. Niets daarvan maakt het de verkeerde keuze voor zwaar werk; het maakt het de juiste keuze voor een smaller deel van het werk dan de prijs doet vermoeden.

Het andere dat Opus 5 verkoopt, is de platformeconomie van Anthrop​ic. De prompt-caching kan de effectieve invoerkosten tot 90% verlagen bij cache-hits, en de batch-tier halveert de prijs voor asynchroon verkeer — dus een workload met veel cache en veel batch op Opus 5 factureert veel dichter bij de schaduw van het prijskaartje dan de kop van $5 / $25 doet vermoeden. De echte prijs van het vlaggenschip is afhankelijk van de workload; die van het werkpaard niet.

Waar Gemini 3.7 Flash de slimmere aankoop is

Voor alles wat streamt, batched of zich voedt met lange context, is het werkpaard niet alleen goedkoper, het staat structureel beter gepositioneerd. Een 6,4x output-snelheidsvoordeel verandert wat je kunt bouwen: interactieve code-aanvulling, live samenvatting van een volledige repository, agent-loops die veel aanroepen per minuut nodig hebben — al deze dingen stuiten lang voordat ze de kwaliteitsmuur raken op de doorvoermuur van een 53-token/s-model. Gemini 3.7 Flash accepteert ook audio- en video-invoer, wat gebruiksscenario's opent (vergadertranscriptie, videoframe-begrip) die geen enkel Claude-model op die invoeras doet. En het instelbare denkniveau betekent dat je het met lage inspanning kunt draaien voor goedkoop routinewerk en met hoge inspanning voor de moeilijkere subset, waarbij je alleen betaalt voor de redenering die je gebruikt.

Het koppelingsdraaiboek

De mensen in het veld zien dit grotendeels niet meer als een of/of-kwestie, en het patroon dat steeds weer opduikt is een verdeel-en-heers-lus: Claude Opus 5 verzorgt de planning en het ontwerp, Gemini 3.7 Flash de grootschalige implementatie, en Opus 5 doet de review. Elk model wordt ingezet waar de verhouding tussen kwaliteit en kosten het gunstigst is, en de gecombineerde pipeline is zowel goedkoper als sneller dan het draaien van een van beide afzonderlijk. Een routinglaag maakt dat patroon praktisch in plaats van louter architectonisch: Claude Opus 5 is live op OrcaRouter tegen de lijstprijs van Anthropic met 0% opslag, en de routing-DSL laat je één enkele aanroep samenstellen die de planner naar Opus 5 stuurt en de uitvoerder verdeelt over de Flash-klasse-modellen achter één OpenAI-compatibel endpoint — met modelfusie als volgende stap, waarbij beide modellen dezelfde vraag beantwoorden en een scheidsrechter de twee uitspraken met elkaar verzoent.

The OrcaRouter model page for Claude Opus 5, showing Anthropic's $5.00 per million input and $25.00 per million output list pricing and a 1M-token context window.

Het wetsvoorstel, naast elkaar

Zet er concrete cijfers op. Een dag van 10 miljoen inputtokens en 1 miljoen outputtokens — een zware maar normale agentische pipeline — kost $75 + $375 = $450 tegen het standaardtarief van Claude Opus 5. Hetzelfde verkeer kost tegen het promotietarief van Gemini 3.7 Flash $7,50 + $37,50 = $45, precies een tiende. Zelfs als je Opus' cachekortingen op de input meerekent, is het verschil een orde van grootte, en dat is de reden dat 'flash voor de bulk, opus voor de lastige staart' de standaard productievorm is geworden in plaats van een exotische vorm. Wanneer de promotie afloopt, verdubbelt het inputtarief van Gemini 3.7 Flash naar $1,50 — nog steeds een derde van dat van Opus, en nog steeds goedkoop genoeg om de rekenkunde van de combinatie intact te houden.

De eerlijke lezing

{{1}}De vijfpuntskloof is reëel en zit precies waar je het zou verwachten: bij het moeilijkste werk met de langste tijdshorizon.{{/1}} {{2}}Als je werkbelasting wordt gedomineerd door die staart — grensverleggend onderzoek, urenlang autonome engineering, computergebruik — dan rechtvaardigt Claude Opus 5 zijn prijs en moet je er niet te veel over nadenken.{{/2}} {{3}}Als je werkbelasting wordt gedomineerd door volume, latentie of lange context, dan is Gemini 3.7 Flash tegen de actieprijs een orde van grootte betere koop, en de kloof met het vlaggenschip is één benchmarkniveau, geen afgrond.{{/3}} {{4}}De modellen convergeren, en het praktische antwoord voor de meeste teams is niet langer 'welke' maar 'welke delen van het werk naar welk model gaan.'{{/4}}

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt