
Wat is Gemini 3.1 Pro? De Pro-tier van Google is al zeven maanden niet veranderd
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Gemini 3.1 Pro is het enige live Pro-tier-model in zijn eigen familie. Het werd aangekondigd op 19 februari 2026, en zeven maanden later plaatst de eigen modeldocumentatie van de leverancier het nog steeds onder “Preview” bij het endpoint gemini-3.1-pro-preview — geen algemene beschikbaarheid, geen afsluitdatum, geen opvolger uitgebracht. In dezelfde zeven maanden bracht de leverancier vijf Flash-releases uit, en de nieuwste daarvan, Gemini 3.8 Flash, scoort nu elf punten hoger op de onafhankelijke index die de meeste mensen citeren. Dat verschil is de reden dat een pagina die uitlegt wat Gemini 3.1 Pro is, moet openen met wat het niet is.
Als je alleen de versie van twee zinnen wilt: Gemini 3.1 Pro is een closed-weights, native multimodaal redeneermodel gemaakt door Google DeepMind, dat tekst, afbeeldingen, video, audio en pdf's leest en tekst schrijft. Je roept het aan via Google's eigen API's of via een router die het aanbiedt, het accepteert tot 1.048.576 tokens aan invoer, en het kost $2,00 per miljoen invoertokens en $12,00 per miljoen uitvoertokens onder een prompt van 200.000 tokens. Het houdt stand als een multimodaal werkpaard voor lange context. Het is niet langer het model dat je kiest omdat het het slimste beschikbare model is.
Waar het staat binnen zijn eigen familie
Dit is het deel dat de meeste artikelen overslaan, en het is het deel dat er het meest toe doet. De Gemini 3-familie is niet één ladder met een Pro bovenaan. Het zijn twee ladders die niet langer vergelijkbaar zijn.
De Flash-ladder is degene die is opgeschoven. In de modeldocumentatie van Google, gelezen op 23 september 2026, worden Gemini 3.8 Flash, Gemini 3.8 Live en Gemini 3.8 Live Extended Thinking genoemd als nieuwe stabiele releases, terwijl Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash en Gemini 3.5 Flash-Lite daarachter nog steeds stabiel zijn. Gemini 3.8 Flash verscheen op 2 september 2026 — de derde Flash-release in zes weken.
De Pro-ladder is degene die het niet deed. Er is geen Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro of 3.8 Pro in de documentatie van Google. Gemini 3 Pro, het model dat Gemini 3.1 Pro moest vervangen, staat als stopgezet vermeld. Gemini 2.5 Pro bestaat nog, maar de toegang is beperkt tot eerdere gebruikers. Daardoor blijft Gemini 3.1 Pro over als het enige Gemini 3-endpoint op Pro-niveau dat je vandaag kunt aanroepen — niet omdat het een race won, maar omdat niemand anders eraan meedeed.
Het door Google in februari aangekondigde plan was dat de preview lang genoeg zou duren om “deze updates te valideren” en gebieden zoals ambitieuze agentische workflows vooruit te helpen voordat het model “binnenkort algemeen beschikbaar” zou worden. Dat zijn de woorden van Google in de aankondiging van februari. Zeven maanden later is dat niet gebeurd, en het is de moeite waard om de berichtgeving rond de vertraging duidelijk als berichtgeving te presenteren, niet als feit: SemiAnalysis concludeerde dat de inspanning rond Gemini 3.5 Pro stilletjes was geannuleerd, en de Wall Street Journal, zoals geciteerd door secundaire media, meldde dat de interne 3.5 Pro-kandidaat werd geschrapt omdat deze de Flash-serie niet kon overtreffen. De officiële lijn van Google is dat 3.5 Pro zich nog steeds in beperkte partnertests bevindt, zonder bevestigde maand. We konden geen verklaring van Google vinden die de annulering bevestigt of ontkent, en we gaan niet voor hen partij kiezen.
De praktische consequentie is een valkuil in de naamgeving. Als je op zoek gaat naar “de nieuwste Gemini Pro”, is het meest recente model in de Pro-klasse dat je zult vinden van februari, terwijl de versienummers aan de Flash-kant zijn opgelopen tot 3.8. Versienummers zeggen hier niets over de capaciteiten tussen de niveaus; het zijn twee afzonderlijke releasesporen.
De specs die ertoe doen
Elk cijfer hieronder is afkomstig uit Googles eigen Gemini API-documentatie van 23 september 2026, tenzij anders vermeld.
• Invoercontext — 1.048.576 tokens, hetzelfde venster van een miljoen tokens dat Google sinds de 2.5-generatie heeft uitgebracht. De uitvoer is afzonderlijk beperkt tot 65.536 tokens, wat een bovengrens is voor het antwoord, niet voor het gesprek.
• Invoermodaliteiten — tekst, afbeelding, video, audio en PDF. Uitvoermodaliteiten — alleen tekst. Geen audiosynthese, geen beeldgeneratie, geen Live API, dus dit is niet het model voor een realtime spraakagent of een beeldpijplijn. Google levert aparte Gemini 3.x Flash-varianten voor dat soort taken.
• Redeneren — ondersteund, met controle op denkniveau. Denktokens worden gefactureerd tegen het outputtarief, daarom is de outputprijs het getal dat je factuur domineert.
• Hulpmiddelen — caching, code-uitvoering, function calling, Search-grounding, Maps-grounding, gestructureerde uitvoer, URL-context, de Batch API, flex-inference en priority-inference worden allemaal als ondersteund vermeld. File search wordt alleen in AI Studio als ondersteund vermeld.
• Licentie en gewichten — propriëtair. Er zijn geen open gewichten, geen downloadbaar checkpoint en geen selfhostingpad. Elke route naar dit model is een gehoste API.
• Eindpunten — gemini-3.1-pro-preview is de modelcode. Google vermeldt ook een gemini-3.1-pro-preview-customtools variant. Een preview-eindpunt kan onder je vandaan worden herzien zonder een versieverhoging, wat de standaardreden is om in productie exacte model-ID's vast te pinnen in plaats van aliassen.
• Gedocumenteerde updatdatum — op de modelpagina staat "Laatste update: februari 2026." We konden geen kennisafsluitdatum vinden die op de eigen modelpagina van Google wordt vermeld; vermeldingen van derden zeggen januari 2025, en we markeren dat als onbevestigd in plaats van het als feit te herhalen.
Wat het kost
Gemini 3.1 Pro kent een plotselinge prijssprong, en het is het soort detail dat een ogenschijnlijk goedkope raming verandert in een factuur die twee keer zo hoog is. De gepubliceerde ontwikkelaarstarieven van Google zijn opgesplitst op basis van promptgrootte in plaats van op modelversie.
• Standaardniveau, prompts tot 200.000 tokens — $2,00 per miljoen invoertokens, $12,00 per miljoen uitvoertokens, waarbij denktokens als uitvoer meetellen.
• Standaardlaag, prompts van meer dan 200.000 tokens — $4,00 voor invoer en $18,00 voor uitvoer. Beide tarieven verdubbelen bij dezelfde drempel. Dit is de valkuil: een workload met lange context betaalt tweemaal het gepubliceerde tarief, juist omdat die gebruikmaakt van de functie waarvoor het model is gekocht.
Contextcaching — $0,20 of $0,40 per miljoen gecachte tokens, afhankelijk van aan welke kant van de drempel van 200.000 u zich bevindt, plus cacheopslag die wordt gefactureerd tegen $4,50 per miljoen tokens per uur.
• Batch- en flexniveaus — $1,00 invoer en $6,00 uitvoer onder 200.000 tokens, $2,00 en $9,00 daarboven. Ongeveer de helft van de prijs voor werk dat kan wachten.
• Prioriteitsniveau — $3,60 invoer en $21,60 uitvoer onder de drempel, $7,20 en $32,40 daarboven.
• Gratis abonnement — niet beschikbaar voor dit model. Er is geen gratis limiet om tegen te prototypen.
Er zijn twee dingen die je moet weten over hoe betrouwbaar die cijfers zijn. De eigen prijzenpagina van Google is hier de autoriteit en we hebben die rechtstreeks gelezen, dus de bovenstaande cijfers zijn actueel per 23 september 2026. Maar vermeldingen door derden van dit model zijn echt inconsistent — de ene tracker vermeldt een tarief van $2,50 / $15,00, de andere een gemengd tarief van $4,50 — en dat komt door de indeling in niveaus. Als een pagina je één enkel getal noemt voor Gemini 3.1 Pro zonder te vermelden op welke band voor promptgrootte dat van toepassing is, dan is dat getal niet bruikbaar voor een echte schatting.
Waar het meetbaar goed in is, en meetbaar niet.
Begin met wat Google beweert, maar houd dat gescheiden van wat onafhankelijke evaluatoren hebben gemeten, want die twee zijn sinds februari sterk uiteen komen te liggen.
De eigen aankondiging van Google bevat precies één benchmarkcijfer: een 'geverifieerde score van 77,1%' op ARC-AGI-2, wat Google omschrijft als meer dan het dubbele van de redeneerprestaties van Gemini 3 Pro. Dat is het cijfer van de leverancier zelf, overgenomen uit Googles eigen bericht, en het is het enige dat we daar konden bevestigen. De berichtgeving rond de lancering circuleerde een veel grotere reeks — GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity's Last Exam — maar die cijfers komen niet voor in Googles eigen aankondiging, en de secundaire berichten spreken elkaar tegen over de exemplaren die we hebben gecontroleerd (GPQA Diamond verschijnt zowel als 94,1 en 94,3, afhankelijk van wie je leest). We drukken ze niet af als vaststaande resultaten.
Het onafhankelijke beeld is waar het verhaal een wending neemt. Op de versie van de Artificial Analysis Intelligence Index die op 23 september 2026 live stond, scoort Gemini 3.1 Pro Preview 30 en staat op de 81e plaats van de 212 modellen in die klasse. Het mediane model in de klasse scoort 25, dus het zit boven het gemiddelde — en de koploper in dezelfde grafiek, Claude Opus 5 op zijn maximale redeneerinstelling, scoort 58. De index zelf is veeleer een meetlat met versies dan een vaste meetlat: Artificial Analysis herzag hem na de lancering in februari, en in zijn eigen revisienotities staat dat er nieuwe evaluaties aan de samengestelde index zijn toegevoegd. Gemini 3.1 Pro werd bij de lancering in februari gemeld als de onbetwiste koploper op de index zoals die toen stond, met 57 punten. Dat is niet dezelfde meetlat als de 30, en we gaan de twee cijfers niet naast elkaar zetten alsof ze een daling laten zien.
Wat de huidige mapping wel laat zien, is een waarachtig profiel, en het is een scheef profiel:
• Intelligentie — 30 op de index, rang 81 van 212. Boven de mediaan, ver van de frontier verwijderd.
• Snelheid — 116,5 outputtokens per seconde, rang 38 van 212. Opvallend snel voor een redeneermodel.
• Kosten — $0,67 om één Intelligence Index-taak uit te voeren, rang 31 van 212. Dat is goedkoop per eenheid werk, omdat het model zuinig is met denk-tokens.
• Uitvoerigheid — 67M outputtokens om de index te voltooien, tegenover een klasse-mediaan van 88M. Rang 39 van 212; Artificial Analysis noemt het “redelijk beknopt”. Ter vergelijking: Gemini 3.8 Flash verbruikt bij hoge reasoning 170M tokens op dezelfde suite en kost $1,24 per taak — meer dan Gemini 3.1 Pro, ondanks een lagere prijs per token.
De eerlijke lezing is dus niet “het oude model wordt overal verslagen.” Gemini 3.1 Pro is snel en token-efficiënt, en op basis van kosten per taak verslaat het zijn eigen nieuwere zustermodel. Wat het verliest, is het hoogste prestatieniveau, en bij elke workload waar kwaliteit de bindende beperking is, is dat de enige as die telt.

De vraag over de beschikbaarheid in september
Er is één actuele ontwikkeling rond dit model, en het is een vraag in plaats van een release. Sinds 18 september 2026 melden gebruikers op Google's eigen AI Studio-ontwikkelaarsforum dat Gemini 3.1 Pro uit de modelselector van AI Studio is verdwenen — de titel van de thread dateert de wijziging op 2026-09-18 — waarbij betalende gebruikers zeggen dat ze naar Gemini 3.8 Flash zijn overgezet en van daaruit naar 3.7 en 3.6 Flash. Geen enkele Google-medewerker had gereageerd in de thread die we lazen, er is geen deprecation notice en er is geen oorzaak vermeld. Het model stond nog steeds vermeld en was nog steeds aanroepbaar via de Gemini API en via onze eigen catalogus toen we dit op 23 september 2026 controleerden.
We markeren dit als onopgeloste gebruikersmeldingen op Google's eigen forum, niet als een buitengebruikstelling en niet als een storing. Maar als je productiepad specifiek van dit model afhankelijk is, is het een reden om een fallback geconfigureerd te hebben in plaats van aan te nemen dat een preview-endpoint een vast gegeven is.
Wie moet het kiezen, en wie niet
Kies Gemini 3.1 Pro als je probleem lang en multimodaal is. Het venster van één miljoen tokens met native video-, audio- en PDF-invoer is nog steeds de reden om hier te zijn, en niets aan de leeftijd van het model verandert dat. Concreet: het analyseren van volledige repositories, het auditen van uren opgenomen vergaderingen of beeldmateriaal, het extraheren van gestructureerde data uit documentensets met gemengde media, of elke pipeline waarin één enkele prompt met recht voorbij 200.000 tokens komt en het alternatief een retrievallaag is die je zou moeten bouwen en evalueren. De tokenefficiëntie is een echt tweede argument — het rondt een takenreeks af in 67M outputtokens, terwijl Gemini 3.8 Flash 170M verbruikt, dus een factuur per taak kan lager uitvallen, ook al lijkt het tarief per token hoger.
Kies in drie gevallen iets anders. Als je het huidige beste antwoord van Google wilt op een moeilijke redeneer- of langetermijncoderingsvraag, scoort Gemini 3.8 Flash beter dan Gemini 3.1 Pro op de huidige onafhankelijke index, is het algemeen beschikbaar in plaats van preview, kost het $0,75 per miljoen input en $3,75 per miljoen output tot en met 31 december 2026, en heeft het een gratis tier die Gemini 3.1 Pro niet heeft. Het verbruikt meer denktokens om daar te komen — dat is de afweging, en het is een echte. Als je de absolute frontier nodig hebt, is dat momenteel geen Google-model: op dezelfde indexgrafiek leidt Claude Opus 5 bij maximaal redeneren met 58 tegen 30 van Gemini 3.1 Pro. En als je workload latentie- of kostengevoelig en ondiep is — classificatie, extractie, routering, korte samenvatting — dan doet een Flash-Lite-tier of een klein open-weights-model het werk voor een fractie van $2,00 per miljoen inputtokens, en Pro-tarieven daarvoor betalen is gewoon verspilling.
Wat we niet zouden doen, is Gemini 3.1 Pro kiezen omdat het de nieuwste Pro van Google is. Het is niet nieuw, en sinds deze maand heeft Google er geen opvolger voor uitgebracht.
Het aanroepen zonder je stack te vergokken op een preview-endpoint
Het lastige aan een preview van zeven maanden is dat die goed genoeg is om op voort te bouwen, maar niet stabiel genoeg om er zonder meer van uit te gaan. Twee mitigerende maatregelen zijn het vermelden waard.
Zet de exacte modelcode vast in plaats van een alias. Een preview-endpoint kan ter plaatse worden herzien, dus gemini-3.1-pro-preview in een configuratiebestand is veiliger dan een zwevende verwijzing naar “latest Pro”, en het maakt een stille wijziging zichtbaar in een diff.
Houd de routering boven het model. Op OrcaRouter is Gemini 3.1 Pro google/gemini-3.1-pro-preview, geleverd via dezelfde sleutel en hetzelfde endpoint als elk ander model dat we aanbieden, inclusief een native /v1beta/models/{model}:generateContent-vorm voor code die tegen de Gemini SDK is geschreven en een OpenAI-compatibele /v1/chat/completions voor al het overige. Omdat de prijsstelling een pass-through met 0% opslag, is de $2,00 / $12,00 op Google's tariefkaart het bedrag dat u hier betaalt, en een prijswijziging van de leverancier is dezelfde dag live in plaats van bij de volgende factuurcyclus. De reden dat dit specifiek voor een previewmodel belangrijk is, is failover: een geconfigureerde fallback-keten betekent dat op de dag dat Gemini 3.1 Pro niet beschikbaar is, uw nieuwe poging bij het volgende model in de keten terechtkomt voordat het antwoord begint, in plaats van nadat uw gebruikers het merken. Dat is het verschil tussen een preview waarop u kunt shippen en een preview die u alleen kunt demoën.
Onze eigen catalogusvermelding voor het model bevat de specificaties zoals wij ze leveren — een context van een miljoen tokens, een maximale uitvoer van 65.536 tokens, audio-/bestand-/afbeelding-/tekst-/video-invoer, tekstuitvoer, en een mediane time-to-first-token van 10,00 seconden over de afgelopen zeven dagen, wat goed is om te weten voordat je aanneemt dat dit een model met chatlatentie is. Dat is het niet.

Wat is er nog open?
Drie dingen die we niet konden afronden, en die we liever benoemen dan verdoezelen. Google heeft niet gezegd of Gemini 3.1 Pro ooit algemeen beschikbaar zal worden, en er is hoe dan ook geen gepubliceerde stopdatum. De AI Studio-rapporten zijn vijf dagen later nog steeds onverklaard, en we hebben geen enkele reactie van de leverancier kunnen vinden. En de vraag naar een opvolger is alleen ontkennend te beantwoorden: de Pro-pagina van Google adverteert al maanden met een aanstaande Pro-release, de berichtgeving zegt dat de interne kandidaat is geschrapt omdat hij de Flash-lijn niet wist te verslaan, en op 23 september 2026 is er nog niets uitgebracht. Als er een Gemini 3.5 Pro of een Gemini 4 Pro komt, verandert de positie van Gemini 3.1 Pro in deze familie voor het eerst sinds februari — en dat, niet de oorspronkelijke lancering, is de gebeurtenis die het volgen waard is.

Gemini 3.1 Pro staat op OrcaRouter tegen Google's lijstprijs, achter dezelfde sleutel als al het andere dat we aanbieden. Bekijk de modelpagina van Gemini 3.1 Pro voor actuele prijzen, contextlimieten en een fallback-keten die je kunt configureren voordat de volgende preview-revisie verschijnt.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
