
Gemini 3.7 Flash vs Gemini 3.1 Pro: Heeft Googles Flash-laag zijn eigen vlaggenschip achterhaald gemaakt?
- AlibabaNIEUWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.3 Flash2026-08-2658Intelligentie72Coderen
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
Er schuilt een ongemakkelijke vraag in het modellengamma van Google voor 2026, en die is gericht op elk team dat momenteel betaalt voor Gemini 3.1 Pro: waarom scoort het goedkope Flash-model beter dan het vlaggenschip op de onafhankelijke index? Gemini 3.7 Flash, uitgebracht op 13 augustus 2026 tegen $0,75 per miljoen invoertokens en $3,75 per miljoen uitvoertokens, scoort 56 op de Artificial Analysis Intelligence Index bij hoge redeneerinspanning. Gemini 3.1 Pro, de preview die Google op 19 februari 2026 uitbracht tegen $2,00 / $12,00 — en $4,00 / $18,00 bij een context boven 200K — scoort vandaag in de hoge 40 op dezelfde index. Het vlaggenschip dat bij de lancering bovenaan de index stond, is ingehaald door zijn eigen werkpaardvariant, en dit artikel gaat over wat dat betekent voor de twee modellen, en voor de teams die daartussen moeten kiezen.
De premisse: het vlaggenschipniveau van Google zit vast in preview.
De context is belangrijker dan de cijfers. Gemini 3.1 Pro is sinds februari 2026 in preview — zeven maanden op het moment van schrijven — en zijn opvolger, Gemini 3.5 Pro, werd in mei op Google I/O aangekondigd als “komt volgende maand”, maar miste daarna juni, juli en augustus. Begin september heeft de flagship-tier geen uitgebrachte opvolger en geen releasedatum, en er zijn berichten over een mogelijke annulering. Ondertussen bracht de Flash-tier in hetzelfde tijdsbestek drie generaties uit: Gemini 3.6 Flash op 21 juli, Gemini 3.7 Flash op 13 augustus, en de agentische functionaliteit voor videobegrip, die op 1 september voor beide modellen beschikbaar kwam. De vergelijking is niet echt “Pro versus Flash”. Het is “de tier die Google uitbrengt” tegenover “de tier die Google niet meer uitbrengt”.
Het specificatiecontrast
• Prijs — Gemini 3.7 Flash $0,75 / $3,75 per 1M tokens (promotie tot en met 31 december 2026, daarna $1,50 / $7,50) versus Gemini 3.1 Pro $2,00 / $12,00 bij een context tot 200K, oplopend tot $4,00 / $18,00 boven 200K. Drie tot vier keer goedkoper tegen de lijstprijs, vóórdat de extra prijzen voor reasoning-tiers worden meegerekend.
• Context / max. output — 1M / 64K vs 1M / 64K. Identieke limieten.
• Invoer — zowel tekst, beeld, audio, video als PDF. Het multimodale oppervlak is hetzelfde; het verschil zit in wat het model met video doet (hieronder).
• Redeneringscontrole — Gemini 3.7 Flash laag / gemiddeld / hoog denken. Gemini 3.1 Pro laag / gemiddeld / hoog met dynamisch denken standaard ingeschakeld.
• Onafhankelijke score — Gemini 3.7 Flash 56 op de Artificial Analysis Intelligence Index versus Gemini 3.1 Pro in de hoge 40 op de huidige indexversie (bij de lancering scoorde het 57 op de vorige versie).
• Uitvoersnelheid — Gemini 3.7 Flash ongeveer 285 tokens/sec bij hoog redeneervermogen versus Gemini 3.1 Pro ongeveer 112–125 tokens/sec — ongeveer tweeënhalf keer zo snel.
• Status — Gemini 3.7 Flash stabiel, GA. Gemini 3.1 Pro in preview, met het korte deprecatievenster van de preview.
De index, en de benchmarkrotzooi eronder.
De kop is de index: Artificial Analysis, de onafhankelijke cross-vendor-evaluator, zet Gemini 3.7 Flash nu op 56 en Gemini 3.1 Pro in de hoge 40 — het werkpaard vóór het vlaggenschip, een omkering van de posities bij de lancering van 3.1 Pro, toen de 57 bovenaan de index stond. Dat is het allerbelangrijkste feit in deze vergelijking, en het is onafhankelijk verkregen in plaats van door de leverancier gerapporteerd.
Onder de index is het benchmarkregister een warboel van onderling niet-vergelijkbare testomgevingen, en wie het naïef leest, krijgt het verkeerde antwoord. De gepubliceerde resultaten van Gemini 3.1 Pro — 80,6% op SWE-bench Verified, 77,1% op ARC-AGI-2, 94,3% op GPQA Diamond, een Elo van 2887 op LiveCodeBench Pro — zijn door Google gerapporteerd bij de lancering in februari, zijn gebaseerd op andere benchmarkversies dan de Flash-cijfers en zijn nooit op uniforme wijze gereproduceerd. De 43,6% van Gemini 3.7 Flash op FrontierCode 1.1, de 65,3% op DeepSWE v1.1 en de 1588 Elo in de webontwikkelingsarena zijn eveneens door de leverancier gerapporteerd op de nieuwere testomgevingen. Waar de twee elkaar overlappen in een onafhankelijke samengestelde index — de AA Index — wint de Flash. Wie je vertelt dat "Pro de Flash verslaat op SWE-bench", vergelijkt twee versies van twee verschillende tests en zegt er niet bij dat hij dat doet.


De videocapaciteitskloof
De mogelijkheid die de vergelijking zo scheef doet aanvoelen, is video. De nieuwe agentische modus van Google voor videobegrip — aangekondigd op 1 september 2026 — geldt voor Gemini 3.7 Flash, Gemini 3.6 Flash en Gemini 3.5 Flash-Lite. Gemini 3.1 Pro staat niet op de lijst. Het Flash-model leest video op de manier waarop de nieuwe modus 'video lezen' definieert: het model bepaalt zelf wat het bekijkt, met welke snelheid, en via frames, audio of transcript, en laadt alleen de relevante segmenten, met door de leverancier gerapporteerde besparingen van tot 66% op kosten en 88% op tokens. Gemini 3.1 Pro accepteert technisch gezien video-invoer, maar gebruikt het oudere statische samplingtraject en krijgt geen van de nieuwe tools. Voor gebruikers van het vlaggenschip wordt de nieuwste videomogelijkheid in de Gemini-familie eerst op het goedkopere model uitgebracht, en voor de Pro-laag is er geen datum aangekondigd waarop die beschikbaar komt.
Snelheid, en het preview-risicoprobleem
Snelheid vergroot het prijsverschil op dezelfde manier als bij elke Gemini 3.7 Flash-vergelijking: ongeveer drie keer de outputsnelheid op een model dat al een derde van de prijs kost. Maar het tweede verschil is het punt dat teams vergeten mee te prijzen: status. Gemini 3.1 Pro is een preview, en previews kennen een korte opzegtermijn voor uitfasering zodra de opvolger verschijnt. Een productieworkload op een previewmodel is een voortdurend risico dat de model-ID verandert, de prijzen wijzigen of de functionaliteit verschuift met weinig waarschuwing vooraf. Gemini 3.7 Flash is GA — stabiel, gedocumenteerd en niet gepland om zomaar te worden vervangen, ook al betekent Google's vrijwel maandelijkse Flash-cadans dat een 3.8 Flash snel zou kunnen volgen. Het uitfaseringsrisico van de 3.1 Pro-preview is niet hypothetisch; het is de huidige staat van een categorie waarvan de opvolger al drie maanden op zich laat wachten.
Waar Gemini 3.1 Pro nog steeds wint
De eerlijke argumentatie voor 3.1 Pro heeft drie pijlers, en geen daarvan is ruwe capaciteit. Ten eerste het endpoint voor custom tools: Gemini 3.1 Pro wordt aangeboden met een speciaal API-oppervlak voor bash/custom-tools dat Flash niet evenaart, en teams die er hun agenttooling op hebben gebouwd, draaien vandaag al een werkend systeem. Ten tweede afgestemde workloads: een pipeline die al is afgestemd op de dynamic-thinking-standaardinstellingen, cachepatronen en evalscores van 3.1 Pro is een bewegend doelwit, en overstappen kost echte technische tijd, zelfs als de bestemming sneller en goedkoper is. Ten derde de specifieke taken waarvoor Pro's langere productieverleden nog geen Flash-equivalent kent — de benchmarks uit de lanceergeneratie zoals GPQA en ARC-AGI-2, waar Flash nooit op is gemeten. Als jouw workload een van die taken is, beslecht ‘Flash staat hoger gerangschikt dan Pro op de index’ je vraag niet; alleen een test op je eigen eval doet dat.
Het oordeel: wat de overname van de Flash-tier betekent
De richting is ondubbelzinnig. Voor een nieuwe workload is Gemini 3.7 Flash vandaag de betere standaard-Gemini: goedkoper, sneller, GA-stabiel, hoger op de onafhankelijke index, en het krijgt als eerste de nieuwe videomogelijkheid. Gemini 3.1 Pro behoudt een echte maar beperkte achterban — gebruikers van aangepaste tools, afgestemde pipelines en taken waar de oudere benchmarkresultaten nog steeds gelden. Het bredere verhaal is dat het vlaggenschipniveau van Google stagneert, terwijl de daadwerkelijke concurrentie zich afspeelt op het werkpaardniveau — en de teams die nog steeds vlaggenschipprijzen voor 3.1 Pro betalen, betalen voor een status die het bedrijf zelf niet meer verdedigt.

Voor teams die willen migreren zonder een project, is de overstap tussen Gemini-modellen een wijziging van de modelnaam in plaats van een integratie. Gemini 3.1 Pro wordt aangeboden op OrcaRouter tegen de lijstprijs van $2,00 / $12,00, doorgegeven met 0% opslag, naast Gemini 3.6 Flash en de rest van de routeerbare Gemini-laag achter één sleutel — zodat een workload een deel van het verkeer naar een Flash-model kan sturen, 3.1 Pro als fallback kan houden voor de taken waarbij het nog steeds wint, en automatische failover het risico kan opvangen dat een van beide Google-modellen verandert. Gemini 3.7 Flash zelf is beschikbaar via Google's eigen API en verschillende platforms van derden. De routing-DSL en modelfusie zijn precies hoe je een gelijke vergelijking tussen de twee Gemini-modellen zou uitvoeren op je eigen evaluatie voordat je overstapt. De keuze waar de line-up je naartoe duwt is duidelijk: kies standaard voor de Flash-laag, en houd Pro alleen voor de beperkte gevallen waarin het aantoonbaar zijn premie waard is.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
