Een gegenereerde hero-kaart voor GPT-6.1 Sol vs Gemini 3.1 Pro met als kop 'Zeven maanden preview, acht dagen op de markt', met twee infokaarten met de tekst 'Gemini 3.1 Pro: aangekondigd op 19 februari 2026, nog steeds een preview-endpoint, Intelligence Index 29,7' en 'GPT-6.1 Sol: uitgebracht op 29 september 2026, een leverbaar product, Intelligence Index 51,8', een voettekst met 'Indexcijfers volgens Artificial Analysis, Intelligence Index v4.3.2; prijzen volgens Google en OpenAI.', en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

GPT-6.1 Sol vs Gemini 3.1 Pro: zeven maanden preview tegenover acht dagen uitlevering

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Gemini 3.1 Pro staat al zevenenhalve maand op de prijslijst van de leverancier en heeft de previewstatus nooit verlaten. Aangekondigd op 19 februari 2026, vandaag gedocumenteerd op een endpoint dat eindigt op -preview, zonder toezegging voor algemene beschikbaarheid en — veelzeggender — ook geen stopdatum. GPT-6.1 Sol is acht dagen oud, uitgebracht op 29 september 2026 voor $2,00 per miljoen inputtokens en $10,00 per miljoen outputtokens. Zet ze naast elkaar op de Artificial Analysis Intelligence Index en de zeven maanden oude preview is niet alleen concurrerend, maar zit binnen 22 punten van het nieuwere model op de nieuwste indexrevisie — 29,7 tegen 51,8 op v4.3.2 — terwijl hij 1,8× meer kost per indextaak, $1,30 tegen $0,72. Die combinatie is de reden dat deze vergelijking interessant is en geen formaliteit: in deze ranglijst loopt het oudere model zowel achter op capaciteit als voor op kosten, wat precies verkeerd om is voor een preview die zou moeten afstuderen. Maar het voorbehoud over de indexrevisie is hier belangrijker dan waar dan ook in deze reeks, want een 29,7 en een 53 worden beide op dezelfde site genoemd en dat zijn niet dezelfde meting.

Beide zijn grote multimodale modellen met contextvensters van de 1M-klasse. Gemini 3.1 Pro accepteert tekst, afbeeldingen, video, audio en pdf's met een uitvoerplafond van 65.536 tokens en een prijsklasse van 200.000 tokens waarboven het tarief verdubbelt. GPT-6.1 Sol accepteert tekst, afbeeldingen en bestanden met een venster van 1.050.000 tokens, een uitvoerplafond van 128.000 tokens, vijf niveaus voor reasoning-inspanning en een long-contextniveau boven 272.000 prompttokens. Het ene is een product dat al wordt geleverd, met een ondersteuningsbelofte. Het andere is een preview met een open einde qua levenscyclus, en dat verschil blijkt meer waard te zijn dan het indexverschil.

Het indexnummer moet voorzien worden van de bijbehorende revisie

Artificial Analysis voert zijn suite opnieuw uit en publiceert scores opnieuw onder de huidige indexrevisie, wat betekent dat hetzelfde model twee verschillende cijfers kan hebben, afhankelijk van wanneer je leest. Voor Gemini 3.1 Pro is die kloof ongewoon groot: eerdere eigen berichtgeving over dit model meldde 57 op een oudere revisie, terwijl de pagina zoals die er vandaag staat 29,7 op v4.3.2 vermeldt, de versie met tien evaluaties die ook de 51,8 van GPT-6.1 Sol bevat. Beide cijfers zijn echt en staan beide op dezelfde website.

Wat dit betekent voor een vergelijking is beperkt en belangrijk. Alleen getallen van dezelfde revisie kunnen van elkaar worden afgetrokken. Een 29,7 en een 51,8 uit v4.3.2 leveren een verschil van 22 punten op; een 57 en een 51,8 leveren een verschil van vijf punten op in de andere richting. Het cijfer van 22 punten is het cijfer dat hier gebruikt moet worden, omdat dit het cijfer is waarbij beide modellen door dezelfde suite op dezelfde schaal zijn gemeten — en omdat de kosten-per-taakcijfers, $1,30 tegen $0,72, uit diezelfde run komen.

• Intelligentie-index, v4.3.2 — GPT-6.1 Sol 51,8 vs. Gemini 3.1 Pro 29,7

• Kosten per indextaak — GPT-6.1 Sol $0,72 vs Gemini 3.1 Pro $1,30

• Kosten om de volledige suite te draaien — GPT-6.1 Sol $1.082 vs Gemini 3.1 Pro $1.935

• Contextvenster — GPT-6.1 Sol 1.050.000 tokens vs Gemini 3.1 Pro 1.000.000 tokens

• Maximale uitvoer — GPT-6.1 Sol 128.000 tokens vs Gemini 3.1 Pro 65.536 tokens

• Invoermodaliteiten — tekst, afbeelding en bestand op beide, plus video, audio en PDF op Gemini 3.1 Pro

Twee van die regels pleiten voor de preview en verdienen het ronduit gezegd te worden. Gemini 3.1 Pro accepteert video en audio, wat GPT-6.1 Sol niet doet; als je pipeline een schermopname of een call opneemt, is dat een capaciteitskloof die geen enkele score dicht. En het outputplafond van 65.536 tokens is de helft van dat van GPT-6.1 Sol, wat belangrijk is voor het genereren van lange teksten, maar zelden een beperking vormt in agentisch werk, waar de output kort is en er veel beurten zijn.

Waarom het nieuwere nummer bepalend zou moeten zijn voor je beslissing

De prijskwestie is interessanter dan de indexkwestie.

De tariefkaart van Gemini 3.1 Pro bedraagt $2,00 voor invoer en $12,00 voor uitvoer per miljoen tokens, met gecachte invoer tegen $0,20 en cache-schrijfacties tegen $0,375, en een niveaugrens bij 200.000 prompttokens waarboven de tarieven $4,00 en $18,00 worden. GPT-6.1 Sol kost $2,00 voor invoer en $10,00 voor uitvoer, met gecachte invoer tegen $0,10, cache-schrijfacties tegen $2,50, en een grens bij 272.000 tokens waarboven de tarieven $4,00 en $15,00 worden. De belangrijkste invoerprijs is identiek. De uitvoerprijs ligt 20% lager bij GPT-6.1 Sol, en de tariefstap voor lange context is lager op beide assen. Het punt waarop de twee tariefkaarten uiteenlopen, is caching: $0,10 tegenover $0,20 per miljoen gecachte invoertokens, waarbij het previewmodel de cache goedkoper schrijft: $0,375 tegenover $2,50.

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, credited to Google and dated 2026-02-19, showing the -preview model identifier, text, image, video, audio and file input with text output, a 1M-token context window with a 65K maximum output, and a rate row reading $2.00 input and $12.00 output per million tokens alongside a 10.60-second median time to first token and an 11.3M seven-day traffic figure.

Dat laatste paar keert de oppervlakkige lezing om. Als je workload cache-intensief is — een lange, vaste systeemprompt die elke beurt opnieuw wordt verzonden, of een document dat tijdens een sessie opnieuw wordt gelezen — dan is de cache-write-regel van Gemini 3.1 Pro dramatisch goedkoper en is de cache-read-regel twee keer zo duur. Welk model wint, hangt af van hoe vaak je herleest wat je hebt geschreven, en dat is een getal dat je eigen logs bevatten en dat geen enkele benchmark publiceert. Wat niet ambigu is, zijn de indexkosten: bij identiek evaluatiewerk kwam het acht dagen oude model 33% goedkoper uit, en de zeven maanden oude preview kwam in totaal 79% duurder uit dan het nieuwere model.

De preview-badge is het operationele feit.

Dit is het deel van de vergelijking dat een scoretabel niet kan weergeven, en voor een productie-implementatie weegt het zwaarder dan alles hierboven.

Gemini 3.1 Pro is sinds februari in preview, zonder aankondiging van algemene beschikbaarheid en zonder stopzettingsdatum. Beide afwezigheden zijn van belang en wijzen in tegengestelde richtingen. Geen GA betekent geen levenscyclusverplichting: preview-eindpunten vallen niet onder dezelfde voorwaarden voor deprecatieaankondigingen als algemeen beschikbare eindpunten, en kunnen onder een aanroeper worden herzien zonder versieverhoging, wat de standaardreden is om in productie een exacte model-ID vast te pinnen in plaats van een alias. Geen stopzettingsdatum betekent dat je ook geen migratievenster kunt plannen — het model heeft het kwartaal waarin iedereen verwachtte dat het de overstap naar algemene beschikbaarheid zou maken al overleefd, en deze familie heeft eerder een Pro-model stopgezet.

De positie van GPT-6.1 Sol is het spiegelbeeld. Het is acht dagen oud, wat betekent dat het onafhankelijke evaluatierecord ervan slechts één configuratie diep is en dat de faalmodi niet gedocumenteerd zijn; er is geen corpus van praktijkmensen om te raadplegen wanneer het zich misdraagt. De release zelf was de release, en het wordt geleverd onder een ondersteuningsstructuur die de preview niet heeft.

Dat zijn verschillende risico's, niet verschillende hoeveelheden risico. Kies je de preview, dan wed je erop dat de leverancier een endpoint blijft bedienen zonder daartoe contractueel verplicht te zijn. Kies je het acht dagen oude model, dan wed je erop dat één benchmarkrun en acht dagen beschikbaarheid genoeg bewijs zijn voor jouw workload. De index zal bij geen van beide helpen.

Het enige dat dit makkelijk zou maken

Een aankondiging van algemene beschikbaarheid voor Gemini 3.1 Pro, met een modelidentificatie uit de -preview naamruimte en een gepubliceerde levenscyclustoezegging, zou het meeste hiervan oplossen. Het zou noch de indexkloof van 22 punten, noch de kostenkloof van 1,8× per taak dichten, maar het zou het depreciatierisico wegnemen dat de vergelijking momenteel scheef maakt, en het zou een team in staat stellen om het model te adopteren zonder een preview-identificatie vast te pinnen en maar te hopen.

Het uitblijven van die aankondiging, na zevenenhalve maand, is op zichzelf al informatie. Een preview die updates moest valideren voordat deze "binnenkort" GA zou worden, in de bewoording van de leverancier in februari, heeft daar twee volledige kwartalen de tijd voor gehad. Ofwel is de validatie nog gaande, ofwel is de preview het product — en een aanroeper kan van buitenaf niet zien welke van de twee het is. Wat een aanroeper kan doen, is de onzekerheid inprijzen en daarop routeren.

Beide op één sleutel, zodat het antwoord per workload kan zijn

A screenshot of OpenAI's developer model page for GPT-6.1 Sol, headed 'GPT-6.1 Sol' with the tagline 'Near-Astra performance for complex work at a lower cost', showing a 1,050,000-token context window with 128,000 max output tokens and an Apr 30, 2026 knowledge cutoff, a price row reading $2 input and $10 output per million tokens, and the note that reasoning.effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.

Gemini 3.1 Pro staat op OrcaRouter tegen zijn eigen vermelde tarieven — $2,00 / $12,00, oplopend naar $4,00 / $18,00 boven 200.000 prompttokens, met cache-reads tegen $0,20. GPT-6.1 Sol staat op OrcaRouter tegen $2,00 / $10,00, oplopend naar $4,00 / $15,00 boven 272.000 prompttokens, met cache-reads tegen $0,10. Lijstprijs van de provider voor beide, niets toegevoegd, één sleutel en één factuur.

Dat maakt de ongemakkelijke delen van deze vergelijking goedkoop op te lossen. Video- en audio-inname blijft op de preview, omdat niets anders in het tweetal dit accepteert; het tekst- en codeerwerk met een hoog volume gaat naar het nieuwere model, dat goedkoper is per taak en 33% goedkoper bij identiek evaluatiewerk. Als het preview-endpoint wordt herzien of ingetrokken, verplaatst automatische failover die aanroepen naar een andere route in plaats van ze te laten falen — precies de hedge waar het levenscyclusrisico van een preview om vraagt. En omdat beide achter één OpenAI-compatibel endpoint zitten, kan de prijsvergelijking die er echt toe doet in een middag op je eigen verkeer worden uitgevoerd in plaats van te worden beargumenteerd op basis van een tariefkaart.

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 3.1 Pro — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 29.7 on v4.3.2; cost per index task $0.72 against $1.30; input price $2.00 against $2.00; output price $10.00 against $12.00; maximum output 128,000 against 65,536 tokens; lifecycle released September 29, 2026 against a preview running since February 19, 2026. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; prices per OpenAI and Google as listed on OrcaRouter.'

De verdedigbare lezing is dan ook niet welk model beter is. Het is dat deze twee bijna hetzelfde geprijsd zijn, terwijl ze zeven maanden uit elkaar liggen qua volwassenheid van de levenscyclus en 22 punten uit elkaar liggen op de huidige onafhankelijke ranglijst, en dat de echte voordelen van het previewmodel — video- en audio-invoer, goedkope cache-schrijfacties — smal en specifiek zijn. Als je workload die modaliteiten nodig heeft, is Gemini 3.1 Pro de enige van de twee en is het indexverschil de toegangsprijs. Zo niet, dan krijg je een preview-endpoint met een open-einde-toekomst aangeboden tegen een kostprijs per taak die 80% hoger is dan die van een model dat vorige week is uitgeleverd, en ligt de bewijslast andersom.