
GPT-6 Sol Pro vs Gemini 3.1 Pro Preview: Sju månader av förhandsversion – och vad det kostar dig
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
Gemini 3.1 Pro Preview har varit en förhandsversion i sju månader. Leverantören publicerade modellen den 19 februari 2026 till ett pris av 2,00 USD per miljon indatatokens och 12,00 USD per miljon utdatatokens, och i den här veckan beskriver modellkortet den fortfarande som "erbjuds i förhandsversionsform", varnar för att den "kan ha begränsningar i stabilitet eller tillgänglighet jämfört med stabila versioner" och säger att den "kan komma att ändras eller avvecklas utan meddelande". Det finns inget datum för allmän tillgänglighet och inget nedläggningsdatum i avvecklingstabellen. GPT-6 Sol Pro — konfigurationen av GPT-6 Sol, modellen som nådde allmän tillgänglighet den 22 september 2026 till ett pris av 2,00 USD för indata och 10,00 USD för utdata — är det motsatta upplägget: ett produktions-API med publicerad prissättning, en dokumenterad ansträngningsinställning och en leverantör som har förbundit sig till siffran.
Den intressanta jämförelsen mellan dessa två modeller är inte benchmarktabellen. Det är vad varje leverantör har lovat dig om nästa kvartal.
Två prisrader, varav en är en förhandsvisning
Båda är leverantörslistor. Googles och OpenAIs egna siffror, vidarebefordrade oförändrade av plattformarna som är värdar för dem.
• Indata – GPT-6 Sol 2,00 USD per miljon tokens mot Gemini 3.1 Pro Preview 2,00 USD per miljon tokens
• Utdata – GPT-6 Sol $10,00 per miljon tokens jämfört med Gemini 3.1 Pro Preview $12,00 per miljon tokens
Lång kontext — Gemini 3.1 Pro Preview prissätter om indata till $4,00 och utdata till $18,00 per miljon tokens över en tröskel på 200 000 tokens; GPT-6 Sol tillämpar sin egen omprissättning för lång kontext över en högre tröskel för indata
• Cacheläsning — GPT-6 Sol $0.20 per miljon token jämfört med Gemini 3.1 Pro Preview $0.20 per miljon token
• Kontextfönster — GPT-6 Sol 1 050 000 tokens vs Gemini 3.1 Pro Preview 1 000 000 tokens
• Maximal utdata – GPT-6 Sol 128 000 tokens mot Gemini 3.1 Pro Preview 65 000 tokens
• Inmatningsmodaliteter — GPT-6 Sol text och bild jämfört med Gemini 3.1 Pro Preview text, bild, ljud, video och fil
• Tillgänglighetsstatus — GPT-6 Sol allmänt tillgänglig sedan 22 september 2026 jämfört med Gemini 3.1 Pro Preview i förhandsversion sedan 19 februari 2026 utan meddelat GA-datum
De angivna priserna ligger tillräckligt nära varandra för att inte vara avgörande. Indata är identisk. Utdata skiljer sig med 20 %. De verkliga skillnaderna finns på de två sista raderna: Gemini tar fyra fler indatamodaliteter och har funnits som förhandsversion under större delen av ett år, medan den andra har dubbelt så högt utdatatak åt andra hållet – 65 000 tokens mot 128 000.

Förhandsgranskningsstatusen är en verklig operativ egenskap
Googles egen katalogtext uppmanar byggare att planera för avveckling av förhandsversioner. Den meningen utför en hel del arbete, och den är värd att läsas som en teknisk begränsning snarare än en ansvarsfriskrivning.
En förhandsversionsmodell är en du kan bygga på men inte planera utifrån. Tre konsekvenser följer, och ingen av dem förekommer i en pristabell.
• Inget stabilitetsåtagande. Kortet säger klart och tydligt att modellen kan ha begränsningar i stabilitet jämfört med stabila utgåvor, och att OrcaRouter inte ger några specifika latensgarantier för den här förhandsversionsmodellen. Vår egen telemetri på modellsidan visar att p50 och p95 för tid till första token båda ligger på 10,00 sekunder under den senaste veckan, vilket är toppen av visningsintervallet snarare än ett uppmätt medianvärde.
• Inget utfasningsdatum. En modell med ett nedstängningsdatum kan planeras bort från en färdplan. En modell som varken har ett GA-datum eller ett nedstängningsdatum kan inte planeras alls, i någon riktning – du vet inte när det blir säkert att bero på den, och du vet inte när den slutar fungera.
• Ingen position på färdplanen. Google har släppt nyare Flash-modeller i samma familj som nu får högre resultat än Gemini 3.1 Pro i oberoende sammanställningar, inklusive Gemini 3.8 Flash den 2 september 2026. 3.5 Pro-generationen försenades och ska enligt uppgift ha lagts åt sidan. Det finns ingen Gemini 3.8 Pro. Modellen som bär namnet Pro är inte längre sin leverantörs bäst presterande modell, och den är fortfarande en förhandsversion.
Det är den ärliga inramningen för alla som väljer mellan dessa två. GPT-6 Sol är sex dagar gammal och har ett fast, publicerat och permanent pris. Gemini 3.1 Pro Preview är sju månader gammal och har en statusrad i stället för en färdplan.
Vad den oberoende dokumentationen visar, och varför versionsbeteckningen är hela argumentet
Artificial Analysis publicerar en direkt jämförelsesida för just detta par på det aktuella indexet, vilket gör det till en av få matchningar i den här omgången där de neutrala siffrorna verkligen är jämförbara på lika villkor. GPT-6 Sol med maximal ansträngning får 48 poäng till $1.06 per indexuppgift. Gemini 3.1 Pro Preview får 30 poäng till $0.67 per indexuppgift.
Arton poäng är ett stort gap, och det är inte gapet som modellen hade i februari. Vid lanseringen placerade Artificial Analysis Gemini 3.1 Pro Preview på första plats i sitt Intelligence Index med 57. Modellen har inte ändrats sedan dess. Indexet har det — det ompoängsattes den 19 september 2026, och samma oförändrade modell visar nu 30. Båda siffrorna är från Artificial Analysis; ingen av dem är fel; att ställa dem bredvid varandra utan versionen är det enskilt vanligaste felet i bevakningen av den här modellen, och det är därför så många jämförelsesidor beskriver en februariledare som en jämlike i september.
Kostnaden per uppgift berättar en andra historia som är värd att räkna på. Gemini är billigare per uppgift – 0,67 dollar mot 1,06 dollar – men får lägre poäng. Kostnaden per indexpoäng landar på 0,022 dollar för GPT-6 Sol och 0,022 dollar för Gemini. Enligt det måttet är de två ett dött lopp, vilket är det tydligaste sättet att säga vad som faktiskt händer här: Gemini är inte ett billigare sätt att köpa samma intelligens, det är ett billigare sätt att köpa mindre av den.
Två andra oberoende siffror hör hemma bredvid dem, båda märkta. På OSWorld-Verified, riktmärket för datoranvändning, rapporterar Googles egen utvärderingssida 76,2 % för Gemini 3.1 Pro. Den siffran förekommer i Googles material och i tredjepartssammanfattningar av dem, och den förekommer inte i den oberoende verifierade OSWorld-tavlan, som listar andra Gemini-modeller – 3.6 Flash med 83 %, 3.5 Flash med 78,4 % – och ingen rad för 3.1 Pro alls. På den svårare OSWorld 2.0-tavlan får modellen 30,6 %. Och på GDPval-AA ligger modellen på ungefär 1 316 Elo, efter Claude Sonnet 4.6 och Claude Opus 4.6.
Detta är inte en anklagelse om ond tro; självrapporterade siffror är normala och båda leverantörerna publicerar dem. Det är ett påstående om vad en sju månader gammal förhandsvisning faktiskt ger dig: tillräckligt med tid för att en leverantörsrapporterad siffra ska spridas brett, och inte tillräckligt med oberoende replikering för att siffran ska kunna kontrolleras. GPT-6 Sols neutrala historik är däremot kort, entydig och sex dagar gammal.
Ett kunskapsglapp på femton månader som ingen nämner
Gemini 3.1 Pro Preview har en kunskapsgräns i januari 2025. GPT-6 Sols är den 20 april 2026 – femton månader senare.
Det gapet saknas på varje jämförelsesida för den här matchningen, och det spelar större roll än skillnaden i utpris för en specifik typ av arbete: allt som involverar nya API:er, nya biblioteksversioner, nya händelser eller nya organisatoriska fakta. En modell med en kunskapsgräns i januari 2025 kommer självsäkert att svara om en värld som har gått vidare med ett och ett kvarts år, och felmoden är inte ett felmeddelande – den är ett trovärdigt felaktigt svar. För hämtningsförstärkt arbete är kunskapsgränsen nästan irrelevant eftersom kontexten bär fakta. För allt som bygger på parametrisk kunskap är den den första begränsningen att kontrollera och den sista som någon kontrollerar.

Modalitetsgapet är det starkaste argumentet för Gemini, och det är verkligt
Det skulle vara enkelt att skriva den här jämförelsen som en enkel seger för den nyare modellen. Det är det inte, och anledningen är inmatningsraden.
Gemini 3.1 Pro Preview tar emot text, bild, ljud, video och filindata inbyggt på samma slutpunkt. GPT-6 Sol tar emot text och bild. För en arbetsbelastning som är uppbyggd kring videoförståelse, mötestranskribering eller dokumentbehandling som spänner över flera format är det inte en skillnad i funktioner – det är skillnaden mellan ett API-anrop och en pipeline i tre steg, där mellanstegen faktureras separat och fellägena multipliceras.
Den ärliga brasklappen som hör till det: en förhandsvisningsmodell med en felfrekvens på 77,6 % som visas på dess värdbaserade modellsida är en förhandsvisningsmodell vars multimodala fördel måste vägas mot huruvida den kommer att svara. Den siffran är som den visas på sidan och den är tillräckligt hög för att motivera verifiering innan någon bygger vidare på den — vilket är precis poängen. Efter sju månader är det ärliga rådet om den här modellen fortfarande ”mät det själv”, och det är en mening som ingen skriver om en GA-lansering.
Där ett routningslager ändrar matematiken
Gemini 3.1 Pro Preview finns i OrcaRouters katalog till 2,00 $ för input, 12,00 $ för output och 0,20 $ för cache-läsning per miljon tokens, med ett kontextfönster på 1 000 000 tokens, en utdatagräns på 65 000 tokens, ändpunkterna /v1/chat/completions och /v1beta/models/{model}:generateContent, och p50-tid till första token på 10,00 sekunder mätt på vår egen modellsida under den senaste veckan. Leverantörens prissättning går igenom utan något påslag.
GPT-6 Sol är inte en av våra rutter, så inget här är ett påstående om dess pris via oss.

En förhandsvisningsmodell är skolboksexemplet på routing snarare än att binda sig. Både anledningen att prova Gemini 3.1 Pro Preview och anledningen att inte bygga en produktionsväg på den är samma egenskap – den kan ändras utan förvarning – och en enda slutpunkt med automatisk redundansväxling är hur du tar det första utan att acceptera det andra. Förfrågans form ändras inte när modellen bakom gör det, så reservvägen är en konfigurationspost snarare än en migrering. Det spelar större roll här än i de flesta jämförelser, eftersom modellen som med störst sannolikhet ersätter denna i en reservkedja är en nyare Flash från samma leverantör, med samma nyckel, till en bråkdel av utdatahastigheten.
Beslutsregeln
• Video, audio eller blandat format som indata i ett enda anrop – Gemini 3.1 Pro Preview. Inget i kolumnen för GPT-6 Sol accepterar en videofil, och ingen prisskillnad kompenserar för en inmatningspipeline som du måste bygga.
• Allt med ett tillgänglighetsåtagande kopplat till sig — GPT-6 Sol. Sex dagar gammalt, allmänt tillgängligt, publicerat pris som beskrivs som permanent, och en dokumenterad ansträngningsratt. Så ser schemaläggningsbart ut.
• Långa genereringar – GPT-6 Sol, när det gäller utdatataket snarare än taxan. 128 000 tokens mot 65 000 är den begränsning som biter först vid syntesarbete, och den biter innan den 20-procentiga skillnaden i utdatapris gör det.
• Utvärdera Gemini 3.1 Pro Preview – gör det bakom en redundansväg och mät felprocenten själv innan du dimensionerar arbetsbelastningen. Sju månader av förhandsversion med en visad felprocent på 77,6 % på den hostade sidan är inte ett etablerat instrument.
• Om din plan bygger på att den här modellen är billig nästa kvartal – inget av dem. Geminis förhandsversion kan prissättas om eller avvecklas utan varsel, och priset för GPT-6 Sol är permanent bara i den meningen att OpenAI har sagt det den här veckan. Ett fast pris är ett åtagande, inte en garanti; det är helt enkelt ett starkare åtagande än vad ett förhandsversionskort innebär.
Jämförda i den här artikeln4
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
