Ett genererat hero-kort för GPT-6.1 Sol vs Gemini 3.1 Pro med rubriken 'Sju månader av förhandsvisning, åtta dagar av leverans', med två infokort som lyder 'Gemini 3.1 Pro: tillkännagavs 19 februari 2026, fortfarande en förhandsvisningsendpoint, Intelligence Index 29,7' och 'GPT-6.1 Sol: släpptes 29 september 2026, levererad produkt, Intelligence Index 51,8', en sidfot som lyder 'Indexsiffror enligt Artificial Analysis, Intelligence Index v4.3.2; priser enligt Google och OpenAI.', och OrcaRouter-logotypen i nedre högra hörnet.
Guides & Insights

GPT-6.1 Sol vs Gemini 3.1 Pro: Sju månaders förhandsvisning mot åtta dagars leverans

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Gemini 3.1 Pro har funnits på leverantörens prislista i sju och en halv månad och har aldrig lämnat förhandsversionen. Det tillkännagavs den 19 februari 2026, dokumenteras i dag på en slutpunkt som slutar på -preview, utan något åtagande om allmän tillgänglighet och – mer talande – inte heller något avvecklingsdatum. GPT-6.1 Sol är åtta dagar gammal och släpptes den 29 september 2026 för 2,00 dollar per miljon indatatoken och 10,00 dollar per miljon utdatatoken. Ställ dem sida vid sida på Artificial Analysis Intelligence Index, och den sju månader gamla förhandsversionen är inte bara konkurrenskraftig – den ligger inom 22 poäng från den nyare modellen på den senaste indexrevideringen, 29,7 mot 51,8 i v4.3.2 – samtidigt som den kostar 1,8× mer per indextask, 1,30 dollar mot 0,72 dollar. Den kombinationen är anledningen till att den här jämförelsen är intressant och inte en formalitet: på den här tavlan ligger den äldre modellen både efter i kapacitet och före i kostnad, vilket är bakvänt för en förhandsversion som var tänkt att gå vidare. Men förbehållet om indexrevideringen spelar större roll här än någon annanstans i den här uppsättningen, eftersom både en 29,7 och en 53 citeras på samma webbplats och de är inte samma mätning.

Båda är stora multimodala modeller med kontextfönster i 1M-klassen. Gemini 3.1 Pro tar text, bilder, video, ljud och PDF:er med ett tak för utdata på 65 536 token och en prisnivå vid 200 000 token över vilken taxan fördubblas. GPT-6.1 Sol tar text, bilder och filer med ett fönster på 1 050 000 token, ett tak för utdata på 128 000 token, fem nivåer för resonemangsansträngning och en långkontextnivå över 272 000 prompttokens. Den ena är en lanserad produkt med ett supportåtagande. Den andra är en förhandsversion med en livscykel utan fast slut, och den skillnaden visar sig vara värd mer än indexgapet.

Indexnumret behöver sin revision bifogad

Artificial Analysis kör om sin testsvit och publicerar om poäng under den aktuella indexrevisionen, vilket innebär att samma modell kan uppvisa två olika siffror beroende på när du läser. För Gemini 3.1 Pro är den skillnaden ovanligt stor: tidigare bevakning av denna modell från redaktionen rapporterade 57 i en äldre revision, medan sidan som den ser ut i dag rapporterar 29,7 i v4.3.2, versionen med tio utvärderingar som också har GPT-6.1 Sols 51,8. Båda siffrorna är verkliga och båda finns på samma webbplats.

Vad detta innebär för en jämförelse är snävt och viktigt. Endast siffror från samma revision är subtraherbara. Ett 29,7 och ett 51,8 från v4.3.2 ger en skillnad på 22 punkter; ett 57 och ett 51,8 ger en skillnad på fem punkter i motsatt riktning. Siffran på 22 punkter är den som bör användas här, eftersom det är den där båda modellerna mättes av samma testsvit på samma skala – och eftersom siffrorna för kostnad per uppgift, 1,30 $ mot 0,72 $, kommer från samma körning.

• Intelligensindex, v4.3.2 — GPT-6.1 Sol 51,8 mot Gemini 3.1 Pro 29,7

• Kostnad per indexeringsuppgift — GPT-6.1 Sol $0,72 mot Gemini 3.1 Pro $1,30

• Kostnad för att köra hela sviten — GPT-6.1 Sol $1 082 vs Gemini 3.1 Pro $1 935

• Kontextfönster — GPT-6.1 Sol 1 050 000 tokens mot Gemini 3.1 Pro 1 000 000 tokens

• Maximal utdata — GPT-6.1 Sol 128 000 tokens mot Gemini 3.1 Pro 65 536 tokens

• Indatatyper – text, bild och fil för båda, plus video, ljud och PDF för Gemini 3.1 Pro

Två av dessa rader talar för förhandsversionen och förtjänar att sägas rakt ut. Gemini 3.1 Pro accepterar video och ljud, vilket GPT-6.1 Sol inte gör; om din pipeline tar emot en skärminspelning eller ett samtal är det ett kapacitetsgap som inga poäng kan överbrygga. Och dess utdatatak på 65 536 token är hälften av GPT-6.1 Sols, vilket spelar roll för långformatsgenerering men sällan är begränsande i agentiskt arbete, där utdata är korta och turerna många.

Varför det nyare numret är det som bör påverka ditt beslut

Prisfrågan är mer intressant än indexfrågan.

Gemin 3.1 Pros prislista är 2,00 USD in och 12,00 USD ut per miljon tokens, med cachad indata till 0,20 USD och cache-skrivningar till 0,375 USD, samt en nivågräns vid 200 000 prompt-tokens över vilken priserna blir 4,00 USD och 18,00 USD. GPT-6.1 Sol är 2,00 USD in och 10,00 USD ut, med cachad indata till 0,10 USD, cache-skrivningar till 2,50 USD och en gräns vid 272 000 tokens över vilken priserna blir 4,00 USD och 15,00 USD. Rubrikpriset för indata är identiskt. Utdatapriset är 20 % lägre för GPT-6.1 Sol, och långkontextsteget är lägre på båda axlarna. Där de två prislistorna skiljer sig åt är vid cachning: 0,10 USD mot 0,20 USD per miljon cachade indata-tokens, där förhandsvisningsmodellen skriver cache billigare, till 0,375 USD mot 2,50 USD.

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, credited to Google and dated 2026-02-19, showing the -preview model identifier, text, image, video, audio and file input with text output, a 1M-token context window with a 65K maximum output, and a rate row reading $2.00 input and $12.00 output per million tokens alongside a 10.60-second median time to first token and an 11.3M seven-day traffic figure.

Det sista paret inverterar den vardagliga tolkningen. Om din arbetsbelastning är cache-tung – en lång fast systemprompt som skickas igen varje tur, eller ett dokument som läses om under en session – är Gemini 3.1 Pro:s rad för cacheskrivning dramatiskt billigare och dess rad för cacheläsning dubbelt så dyr. Vilken modell som vinner beror på hur många gånger du läser om det du har skrivit, och det är en siffra som dina egna loggar innehåller och som ingen benchmark publicerar. Det som inte är tvetydigt är indexkostnaden: vid identiskt utvärderingsarbete landade den åtta dagar gamla modellen 33 % billigare, och den sju månader gamla förhandsversionen landade 79 % dyrare än den nyare modellen totalt.

Förhandsgranskningsmärket är det operativa faktumet

Detta är den del av jämförelsen som en poängtabell inte kan förmedla, och för en produktionsdriftsättning väger den tyngre än allt ovanstående.

Gemini 3.1 Pro har varit i förhandsversion sedan februari utan något besked om allmän tillgänglighet och utan något avvecklingsdatum. Båda frånvarona spelar roll och de pekar i motsatta riktningar. Ingen GA betyder inget åtagande om livscykel: förhandsversionens slutpunkter omfattas inte av samma villkor för aviseringsfrister vid utfasning som allmänt tillgängliga sådana, och kan ändras under en anropare utan att versionsnumret höjs, vilket är det vanliga skälet att låsa en exakt modellidentifierare i produktion i stället för ett alias. Inget avvecklingsdatum betyder att du inte heller kan planera ett migreringsfönster — modellen har redan överlevt det kvartal då alla förväntade sig att den skulle ta steget upp, och den här familjen har stängt av en Pro-modell tidigare.

GPT-6.1 Sols position är spegelbilden. Den är åtta dagar gammal, vilket innebär att dess oberoende utvärderingsregister är en konfiguration djupt och att dess felmoder är odokumenterade; det finns ingen praktikerkorpus att konsultera när den missköter sig. Dess lansering var i sig nyheten, och den levereras under en supportstruktur som förhandsversionen inte har.

Det är olika risker, inte olika stora risker. Väljer du förhandsversionen satsar du på att leverantören fortsätter att betjäna en slutpunkt utan avtalsenlig skyldighet att göra det. Väljer du den åtta dagar gamla modellen satsar du på att en enda benchmarkkörning och åtta dagars tillgänglighet är tillräckliga bevis för din arbetsbelastning. Indexet kommer inte att hjälpa med något av detta.

Det enda som skulle göra detta enkelt

Ett tillkännagivande om allmän tillgänglighet för Gemini 3.1 Pro, med en modellidentifierare utanför namnrymden för -preview och ett publicerat livscykelåtagande, skulle lösa det mesta av detta. Det skulle inte stänga indexgapet på 22 punkter eller kostnadsgapet på 1,8× per uppgift, men det skulle ta bort utfasningsrisken som för närvarande gör jämförelsen sned, och det skulle låta ett team införa modellen utan att låsa en förhandsversionsidentifierare och hoppas.

Frånvaron av det tillkännagivandet, efter sju och en halv månad, är i sig information. En förhandsversion som var avsedd att validera uppdateringar innan den blir GA "snart", enligt leverantörens formulering i februari, har haft två hela kvartal på sig att göra det. Antingen pågår valideringen, eller så är förhandsversionen produkten — och en uppringare kan inte avgöra vilket utifrån. Vad en uppringare kan göra är att prissätta osäkerheten och rutta därefter.

Båda på en nyckel, så svaret kan vara per arbetsbelastning

A screenshot of OpenAI's developer model page for GPT-6.1 Sol, headed 'GPT-6.1 Sol' with the tagline 'Near-Astra performance for complex work at a lower cost', showing a 1,050,000-token context window with 128,000 max output tokens and an Apr 30, 2026 knowledge cutoff, a price row reading $2 input and $10 output per million tokens, and the note that reasoning.effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.

Gemini 3.1 Pro finns på OrcaRouter till sina egna listade priser – $2.00 / $12.00, som stiger till $4.00 / $18.00 över 200 000 prompt-tokens, med cacheläsningar på $0.20. GPT-6.1 Sol finns på OrcaRouter för $2.00 / $10.00, som stiger till $4.00 / $15.00 över 272 000 prompt-tokens, med cacheläsningar på $0.10. Leverantörens listpris på båda, inget tillagt, en nyckel och en faktura.

Det gör att de besvärliga delarna i den här jämförelsen kan lösas billigt. Video- och ljudintag stannar på förhandsversionen eftersom inget annat i paret accepterar det; det volymtunga text- och kodningsarbetet går till den nyare modellen, som är billigare per uppgift och 33 % billigare för identiskt utvärderingsarbete. Om förhandsversionsslutpunkten revideras eller dras tillbaka flyttar automatisk redundansväxling dessa anrop till en annan rutt i stället för att låta dem misslyckas — vilket är den specifika säkring som livscykelrisken med en förhandsversion kräver. Och eftersom båda ligger bakom en och samma OpenAI-kompatibla slutpunkt kan den prisjämförelse som faktiskt spelar roll köras på din egen trafik på en eftermiddag i stället för att argumenteras utifrån en prislista.

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 3.1 Pro — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 29.7 on v4.3.2; cost per index task $0.72 against $1.30; input price $2.00 against $2.00; output price $10.00 against $12.00; maximum output 128,000 against 65,536 tokens; lifecycle released September 29, 2026 against a preview running since February 19, 2026. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; prices per OpenAI and Google as listed on OrcaRouter.'

Den försvarbara tolkningen är alltså inte vilken modell som är bättre. Det är att dessa två är prissatta som nästan likvärdiga trots att de skiljer sig med sju månader i livscykelmognad och 22 punkter från varandra på den aktuella oberoende resultattavlan, och att förhandsvisningsmodellens verkliga fördelar – video- och ljudinmatning, billiga cacheskrivningar – är snäva och specifika. Om din arbetsbelastning behöver dessa modaliteter är Gemini 3.1 Pro det enda alternativet av de två, och indexgapet är inträdespriset. Om så inte är fallet erbjuds du en förhandsvisningsslutpunkt med en öppen framtid till en kostnad per uppgift som är 80 % högre än för en modell som släpptes förra veckan, och bevisbördan ligger åt andra hållet.