Hero-titelkaart met de tekst 'GPT-6 Sol Pro vs Gemini 3.1 Pro Preview' en de ondertitel 'Zeven maanden preview, en wat dat kost', met het echte OrcaRouter-logo rechtsonder.
Guides & Insights

GPT-6 Sol Pro vs Gemini 3.1 Pro Preview: zeven maanden preview, en wat dat jou kost

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Gemini 3.1 Pro Preview is al zeven maanden een preview. De aanbieder publiceerde het op 19 februari 2026 voor $2,00 per miljoen inputtokens en $12,00 per miljoen outputtokens, en sinds deze week beschrijft de modelkaart het nog steeds als "aangeboden in previewvorm", waarschuwt dat het "beperkingen kan hebben in stabiliteit of beschikbaarheid vergeleken met stabiele releases", en stelt dat het "zonder kennisgeving wijzigingen of stopzetting kan ondergaan". Er staat geen datum voor algemene beschikbaarheid en geen uitschakeldatum in de deprecatietabel. GPT-6 Sol Pro — de configuratie van GPT-6 Sol, het model dat op 22 september 2026 algemeen beschikbaar kwam voor $2,00 input en $10,00 output — is het tegenovergestelde arrangement: een productie-API met gepubliceerde prijzen, een gedocumenteerde effort-dial, en een aanbieder die zich aan dat nummer heeft gecommitteerd.

De interessante vergelijking tussen deze twee modellen is niet de benchmarktabel, maar wat elke leverancier je over het volgende kwartaal heeft beloofd.

Twee prijsregels, waarvan één een voorbeeld is

Beide zijn leverancierslijsten. De eigen cijfers van Google en OpenAI, ongewijzigd doorgegeven door de platforms die ze hosten.

• Input — GPT-6 Sol $2,00 per miljoen tokens vs Gemini 3.1 Pro Preview $2,00 per miljoen tokens

• Uitvoer — GPT-6 Sol $10,00 per miljoen tokens vs. Gemini 3.1 Pro Preview $12,00 per miljoen tokens

• Lange context — Gemini 3.1 Pro Preview herprijst input naar $4,00 en output naar $18,00 per miljoen tokens boven een drempel van 200.000 tokens; GPT-6 Sol past zijn eigen herprijzing voor lange context toe boven een hogere inputdrempel

• Cacheread — GPT-6 Sol $0,20 per miljoen tokens vs Gemini 3.1 Pro Preview $0,20 per miljoen tokens

• Contextvenster — GPT-6 Sol 1.050.000 tokens vs Gemini 3.1 Pro Preview 1.000.000 tokens

• Maximale output — GPT-6 Sol 128.000 tokens vs Gemini 3.1 Pro Preview 65.000 tokens

• Invoermodaliteiten — GPT-6 Sol tekst en afbeelding vs Gemini 3.1 Pro Preview tekst, afbeelding, audio, video en bestand

• Beschikbaarheidsstatus — GPT-6 Sol algemeen beschikbaar sinds 22 september 2026 versus Gemini 3.1 Pro Preview in preview sinds 19 februari 2026, zonder aangekondigde GA-datum

De hoofdtarieven liggen dicht genoeg bij elkaar dat ze niet de beslissing zijn. De input is identiek. De output verschilt met 20%. De echte verschillen zitten in de laatste twee regels: Gemini ondersteunt vier extra inputmodaliteiten en een twee keer zo hoge outputlimiet in de andere richting — 65.000 tokens tegenover 128.000 — en is al het grootste deel van een jaar als preview beschikbaar.

A two-column scoreboard card titled 'GPT-6 Sol vs Gemini 3.1 Pro Preview - the scoreboard'. Left column 'GPT-6 Sol': AA Index, current 48; index at Feb 2026 not scored; price in/out $2 / $10; cost per index task $1.06; max output 128K; input modalities text + image. Right column 'Gemini 3.1 Pro Preview': AA Index, current 30; index at Feb 2026 57, retired index; price in/out $2 / $12; cost per index task $0.67; max output 65K; input modalities text, image, audio, video. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

De previewstatus is een echte operationele eigenschap

De eigen catalogustekst van Google vertelt bouwers om rekening te houden met het uitfaseren van previews. Die zin doet heel wat werk, en het loont om hem als een technische beperking te lezen in plaats van als een disclaimer.

Een previewmodel is er een waarop je kunt bouwen, maar waarop je geen planning kunt baseren. Daaruit volgen drie consequenties, en geen ervan staat in een prijstabel.

• Geen stabiliteitsbelofte. Op de kaart staat duidelijk dat het model beperkingen kan hebben op het gebied van stabiliteit in vergelijking met stabiele releases, en dat OrcaRouter geen specifieke latentiegaranties biedt voor dit previewmodel. Onze eigen telemetrie op de modelpagina toont de p50- en p95-tijd tot het eerste token beide op 10,00 seconden over de afgelopen week, wat de bovenkant van het weergavebereik is in plaats van een gemeten mediaan.

• Geen deprecatiedatum. Een model met een stopdatum kan uit een roadmap worden gepland. Een model met noch een GA-datum noch een stopdatum kan helemaal niet worden gepland, in geen van beide richtingen — je weet niet wanneer het veilig wordt om er afhankelijk van te zijn, en je weet niet wanneer het ophoudt te werken.

• Geen positie op de roadmap. Google heeft nieuwere Flash-modellen in dezelfde familie uitgebracht die nu beter scoren dan Gemini 3.1 Pro op onafhankelijke samengestelde benchmarks, waaronder Gemini 3.8 Flash op 2 september 2026. De 3.5 Pro-generatie werd uitgesteld en naar verluidt terzijdegeschoven. Er is geen Gemini 3.8 Pro. Het model dat de Pro-naam draagt, is niet langer het best scorende model van zijn leverancier, en het is nog steeds een preview.

Dat is de eerlijke manier om het te bekijken voor iedereen die tussen deze twee moet kiezen. GPT-6 Sol is zes dagen oud en heeft een vaste, gepubliceerde, permanente prijs. Gemini 3.1 Pro Preview is zeven maanden oud en heeft een statusregel in plaats van een roadmap.

Wat het onafhankelijke verslag laat zien, en waarom het versielabel het hele argument is

Artificial Analysis publiceert een directe vergelijkingspagina voor precies dit paar op de huidige index, waardoor dit een van de weinige confrontaties in deze batch is waarin de neutrale cijfers echt gelijkwaardig zijn. GPT-6 Sol scoort bij maximale inspanning 48 tegen $1,06 per indextaak. Gemini 3.1 Pro Preview scoort 30 tegen $0,67 per indextaak.

Achttien punten is een grote kloof, en het is niet de kloof die het model in februari had. Bij de lancering zette Artificial Analysis Gemini 3.1 Pro Preview op de eerste plaats in zijn Intelligence Index met 57. Het model is sindsdien niet veranderd. De index wel — hij werd op 19 september 2026 opnieuw gescoord, en hetzelfde onveranderde model staat nu op 30. Beide cijfers zijn van Artificial Analysis; geen van beide is fout; ze naast elkaar zetten zonder de versie is de meest voorkomende fout in de berichtgeving over dit model, en het is de reden waarom zo veel vergelijkingspagina's een leider uit februari als een gelijke uit september beschrijven.

De kosten per taak vertellen een tweede verhaal waar het de moeite waard is om de rekensom op te maken. Gemini is goedkoper per taak — $0,67 tegen $1,06 — maar scoort lager. De kosten per indexpunt komen uit op $0,022 voor GPT-6 Sol en $0,022 voor Gemini. Op die maatstaf zijn de twee aan elkaar gewaagd, wat de duidelijkste manier is om te zeggen wat hier feitelijk gebeurt: Gemini is geen goedkopere manier om dezelfde intelligentie te kopen, het is een goedkopere manier om er minder van te kopen.

Twee andere onafhankelijke cijfers horen daarnaast, beide gelabeld. Op OSWorld-Verified, de benchmark voor computergbruik, vermeldt Googles eigen evaluatiepagina 76,2% voor Gemini 3.1 Pro. Dat cijfer staat op Googles materialen en in samenvattingen daarvan door derden, en het komt niet voor op het onafhankelijk geverifieerde OSWorld-bord, dat andere Gemini-modellen vermeldt — 3.6 Flash met 83%, 3.5 Flash met 78,4% — en helemaal geen rij voor 3.1 Pro. Op het moeilijkere OSWorld 2.0-bord scoort het model 30,6%. En op GDPval-AA staat het model op ongeveer 1.316 Elo, achter Claude Sonnet 4.6 en Claude Opus 4.6.

Dit is geen beschuldiging van kwade trouw; zelfgerapporteerde cijfers zijn normaal en beide leveranciers publiceren ze. Het is een uitspraak over wat een zeven maanden oude preview je daadwerkelijk oplevert: genoeg tijd voor een door een leverancier gerapporteerd cijfer om wijdverbreid de ronde te doen, en niet genoeg onafhankelijke replicatie om het cijfer te kunnen controleren. De neutrale staat van dienst van GPT-6 Sol is daarentegen kort, ondubbelzinnig en zes dagen oud.

Een kennislacune van vijftien maanden die niemand noemt

Gemini 3.1 Pro Preview heeft een kennisafsluitdatum van januari 2025. Die van GPT-6 Sol is 20 april 2026 — vijftien maanden later.

Dat gat ontbreekt op elke vergelijkingspagina over deze matchup, en het is belangrijker dan het verschil in outputprijs voor een specifieke klasse van werk: alles wat te maken heeft met recente API's, recente bibliotheekversies, recente gebeurtenissen of recente organisatorische feiten. Een model met een kennisafsluitdatum van januari 2025 zal met vertrouwen antwoorden over een wereld die inmiddels een jaar en een kwart jaar verder is, en de faalwijze is geen foutmelding — het is een plausibel verkeerd antwoord. Voor retrieval-augmented werk is de kennisafsluitdatum bijna irrelevant, omdat de context de feiten bevat. Voor alles wat op parametrische kennis leunt, is het de eerste beperking die je moet controleren en de laatste die iemand controleert.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

De modaliteitskloof is het sterkste argument voor Gemini, en die is reëel.

Het zou gemakkelijk zijn om deze confrontatie als een simpele overwinning voor het nieuwere model te beschrijven. Dat is het niet, en de reden is de invoerregel.

Gemini 3.1 Pro Preview accepteert tekst-, afbeeldings-, audio-, video- en bestandsinvoer native op hetzelfde endpoint. GPT-6 Sol accepteert tekst en afbeeldingen. Voor een workload die draait om videobegrip, vergadertranscriptie of documentverwerking die formaten overspant, is dat geen verschil in functionaliteit — het is het verschil tussen één API-aanroep en een pijplijn van drie, waarbij de tussenstappen apart worden gefactureerd en de faalmodi zich vermenigvuldigen.

Het eerlijke voorbehoud daarbij: een previewmodel met een foutpercentage van 77,6% dat op zijn gehoste modelpagina wordt weergegeven, is een previewmodel waarvan het multimodale voordeel moet worden afgewogen tegen de vraag of het antwoordt. Dat cijfer staat zoals weergegeven op de pagina, en het is hoog genoeg om verificatie te rechtvaardigen voordat iemand erop voortbouwt — en dat is precies het punt. Na zeven maanden luidt het eerlijke advies over dit model nog steeds "meet het zelf", en dat is een zin die niemand over een GA-release schrijft.

Waar een routeringslaag de rekening verandert

Gemini 3.1 Pro Preview staat in de catalogus van OrcaRouter voor $2,00 invoer, $12,00 uitvoer en $0,20 per miljoen tokens voor het lezen van de cache, met een contextvenster van 1.000.000 tokens, een limiet van 65.000 tokens voor de uitvoer, de endpoints /v1/chat/completions en /v1beta/models/{model}:generateContent, en een p50-tijd tot het eerste token van 10,00 seconden, zoals gemeten op onze eigen modelpagina over de afgelopen week. De lijstprijzen van de provider worden doorgegeven met geen enkele extra opslag.

GPT-6 Sol is geen van onze routes, dus niets hier is een bewering over de prijs ervan via ons.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 23 September 2026, showing Vision, Audio, Tools, JSON and Reasoning header badges, 'by Google — 2026-02-19', a 65K-token maximum output, an input price of $2.00 and an output price of $12.00 per million tokens, a p50 time to first token of 10.00 seconds, and both the /v1/chat/completions and /v1beta/models/{model}:generateContent endpoints.

Een previewmodel is het schoolvoorbeeld van routeren in plaats van je eraan vastleggen. Zowel de reden om Gemini 3.1 Pro Preview te proberen als de reden om er geen productiepad op te bouwen is dezelfde eigenschap — het kan zonder kennisgeving veranderen — en één endpoint met automatische failover is hoe je het eerste neemt zonder het tweede te accepteren. De requestvorm verandert niet wanneer het onderliggende model verandert, dus de fallbackroute is een configuratieregel in plaats van een migratie. Dat maakt hier meer uit dan bij de meeste match-ups, want het model dat dit het waarschijnlijkst in een fallbackketen zal vervangen, is een nieuwere Flash van dezelfde leverancier, op dezelfde sleutel, tegen een fractie van het outputtarief.

De beslissingsregel

• Video-, audio- of gemengde-formaatinvoer in één aanroep — Gemini 3.1 Pro Preview. Niets in de GPT-6 Sol-kolom accepteert een videobestand, en geen enkel prijsverschil weegt op tegen een ingestiepijplijn die je zelf moet bouwen.

• Alles waaraan een beschikbaarheidstoezegging vastzit — GPT-6 Sol. Zes dagen oud, algemeen beschikbaar, met een gepubliceerde prijs die als permanent wordt beschreven, en een gedocumenteerde inspanningsregelaar. Zo ziet planbaar eruit.

• Lange generaties — GPT-6 Sol, op het outputplafond in plaats van het tarief. 128.000 tokens tegenover 65.000 is de beperking die bij synthesewerk het eerst toeslaat, en die slaat eerder toe dan het verschil van 20% in outputprijs.

• Gemini 3.1 Pro Preview evalueren — doe het achter een failoverpad, en meet het foutpercentage zelf voordat je de workload dimensioneert. Zeven maanden preview met een weergegeven foutpercentage van 77,6% op de gehoste pagina is geen uitgekristalliseerd instrument.

• Als je plan ervan afhangt dat dit model volgend kwartaal goedkoop is — geen van beide. De preview van Gemini kan zonder kennisgeving een andere prijs krijgen of worden stopgezet, en de prijs van GPT-6 Sol is alleen permanent in de zin dat OpenAI dat deze week heeft gezegd. Een vast tarief is een toezegging, geen garantie; het is simpelweg een sterkere toezegging dan een preview-kaart geeft.

Vergeleken in dit artikel3

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt