
Vad är Gemini 3.1 Pro? Googles Pro-nivå har inte rört sig på sju månader
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Gemini 3.1 Pro är den enda levande modellen på Pro-nivå i sin egen familj. Den tillkännagavs den 19 februari 2026, och sju månader senare placerar leverantörens egen modelldokumentation den fortfarande under ”Preview” vid slutpunkten gemini-3.1-pro-preview — ingen allmän tillgänglighet, inget nedstängningsdatum, ingen efterträdare lanserad. Under samma sju månader släppte leverantören ut fem Flash-utgåvor, och den nyaste av dem, Gemini 3.8 Flash, får nu elva poäng högre på det oberoende index som de flesta citerar. Den klyftan är anledningen till att en sida som förklarar vad Gemini 3.1 Pro är måste inledas med vad den inte är.
Om du bara vill ha versionen med två meningar: Gemini 3.1 Pro är en resonemangsmodell med slutna vikter och inbyggd multimodighet, skapad av Google DeepMind, som läser text, bilder, video, ljud och PDF-filer och skriver text. Du anropar den via Googles egna API:er eller via en router som förmedlar den, den tar upp till 1 048 576 token som indata, och den kostar 2,00 USD per miljon indata-token och 12,00 USD per miljon utdata-token under en prompt på 200 000 token. Den håller måttet som en multimodal arbetshäst för långa kontexter. Det är inte längre modellen du väljer för att den är den smartaste som finns tillgänglig.
Var den placerar sig i sin egen familj
Det här är delen som de flesta artiklar hoppar över, och det är den del som spelar störst roll. Gemini 3-familjen är inte en enda stege med en Pro högst upp. Det är två stegar som inte längre är jämförbara.
Flash-stegen är den som har förflyttats. Googles modelldokumentation, läst den 23 september 2026, listar Gemini 3.8 Flash, Gemini 3.8 Live och Gemini 3.8 Live Extended Thinking som nya stabila versioner, med Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash och Gemini 3.5 Flash-Lite fortfarande stabila bakom dem. Gemini 3.8 Flash lanserades den 2 september 2026 – den tredje Flash-lanseringen på sex veckor.
Pro-trappan är den som inte gjorde det. Det finns ingen Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro eller 3.8 Pro i Googles dokumentation. Gemini 3 Pro, modellen som Gemini 3.1 Pro byggdes för att ersätta, listas som nedstängd. Gemini 2.5 Pro finns kvar, men åtkomsten är begränsad till tidigare användare. Det lämnar Gemini 3.1 Pro som den enda Gemini 3-slutpunkten på Pro-nivå som du kan anropa i dag – inte för att den vann ett lopp, utan för att ingen annan ställde upp.
Googles uttalade plan i februari var att förhandsvisningen skulle pågå tillräckligt länge för att ”validera dessa uppdateringar” och föra områden som ambitiösa agentiska arbetsflöden framåt innan modellen blev ”allmänt tillgänglig inom kort”. Det är Googles egna ord i februarimeddelandet. Sju månader senare har det inte hänt, och rapporteringen kring förseningen förtjänar att klart uttryckas som just rapportering snarare än fakta: SemiAnalysis drog slutsatsen att satsningen på Gemini 3.5 Pro tyst hade lagts ned, och Wall Street Journal rapporterade, såsom citerat av sekundära medier, att den interna 3.5 Pro-kandidaten skrotades eftersom den inte kunde överträffa Flash-serien. Googles egen linje är att 3.5 Pro fortfarande är i begränsad partnertestning utan bekräftad månad. Vi kunde inte hitta något Google-uttalande som bekräftar eller förnekar nedläggningen, och vi tänker inte välja sida åt dem.
Den praktiska konsekvensen är en namnfälla. Om du letar efter ”den nyaste Gemini Pro” är den färskaste modellen i Pro-klassen från februari, medan versionsnumren på Flash-sidan har klättrat till 3.8. Versionsnummer rangordnar inte kapacitet mellan nivåer här; de är två separata utgivningsspår.
Specifikationerna som spelar roll
Samtliga siffror nedan är hämtade från Googles egen dokumentation för Gemini API den 23 september 2026, om inget annat anges.
• Indatakontext — 1 048 576 tokens, samma fönster på en miljon tokens som Google har levererat sedan 2.5-generationen. Utdata begränsas separat till 65 536 tokens, vilket är ett tak för svaret, inte för konversationen.
• Indatamodaliteter – text, bild, video, ljud och PDF. Utdatamodaliteter – endast text. Ingen ljudgenerering, ingen bildgenerering, inget Live API, så detta är inte modellen för en realtidsröstagent eller en bildpipeline. Google erbjuder separata Gemini 3.x Flash-varianter för dessa uppgifter.
• Resonemang – stöds, med styrning av tankenivån. Tänk-token debiteras enligt utpriset, vilket är anledningen till att utpriset är siffran som dominerar din faktura.
• Verktyg – cachelagring, kodexekvering, funktionsanrop, Search grounding, Maps grounding, strukturerade utdata, URL-kontext, Batch API, flexinferens och prioritetsinferens listas alla som stödda. Filsökning listas som stödd endast i AI Studio.
{{1}}Licens och vikter{{/1}} — {{2}}proprietär{{/2}}. Det finns inga {{3}}öppna vikter{{/3}}, ingen {{4}}nedladdningsbar checkpoint{{/4}} och ingen {{5}}väg för egen hosting{{/5}}. Varje väg till den här modellen är ett {{6}}hostat API{{/6}}.
• Slutpunkter — gemini-3.1-pro-preview är modellkoden. Google listar även en gemini-3.1-pro-preview-customtools variant. En förhandsversionsslutpunkt kan revideras under dig utan att versionsnumret höjs, vilket är det vanliga skälet att låsa exakta modell-ID:n i produktion i stället för alias.
• Dokumenterat uppdateringsdatum – modellsidan anger ”Senast uppdaterad: februari 2026.” Vi kunde inte hitta något angivet kunskapsavskärningsdatum på Googles egen modellsida; listningar från tredje part uppger januari 2025, och vi flaggar det som obekräftat i stället för att upprepa det som ett faktum.
Vad det kostar
Gemini 3.1 Pro har en prisklippa, och det är den typ av detalj som förvandlar en uppskattning som ser billig ut till en fördubblad faktura. Googles publicerade utvecklarprissättning delas upp efter promptstorlek snarare än efter modellversion.
• Standardnivå, promptar upp till 200 000 tokens – 2,00 USD per miljon indatatokens, 12,00 USD per miljon utdatatokens, där tänktokens räknas som utdata.
• Standardnivå, promptar över 200 000 tokens – 4,00 USD för indata och 18,00 USD för utdata. Båda priserna fördubblas vid samma tröskel. Detta är fällan: en arbetsbelastning med lång kontext betalar dubbelt så mycket som det annonserade priset, just för att den använder funktionen som den köpte modellen för.
• Kontextcachning – $0,20 eller $0,40 per miljon cachade tokens beroende på vilken sida av tröskelvärdet på 200 000 du befinner dig på, plus cache-lagring som debiteras med $4,50 per miljon tokens per timme.
• Batch- och flexnivåer — 1,00 USD för indata och 6,00 USD för utdata under 200 000 token, 2,00 och 9,00 USD över det. Ungefär halva priset för arbete som kan vänta.
• Prioritetsnivå — 3,60 $ för indata och 21,60 $ för utdata under tröskelvärdet, 7,20 $ och 32,40 $ över det.
• Gratisnivå – inte tillgänglig för den här modellen. Det finns ingen gratis frekvensgräns att bygga prototyp mot.
Två saker är värda att känna till när det gäller hur tillförlitliga de siffrorna är. Googles egen prissida är den auktoritativa källan här, och vi läste den direkt, så siffrorna ovan är aktuella per den 23 september 2026. Men tredjepartslistningar för den här modellen är verkligen inkonsekventa – en bevakningstjänst listar en taxa på 2,50 USD / 15,00 USD, en annan en blandad taxa på 4,50 USD – och nivåindelningen är orsaken. Om en sida anger ett enda nummer för Gemini 3.1 Pro utan att tala om vilket intervall för promptstorlek det avser, är det numret inte användbart för en verklig uppskattning.
Vad det är mätbart bra på, och vad det mätbart inte är
Börja med vad Google påstår, håll det sedan åtskilt från vad oberoende utvärderare mätte, eftersom de två har divergerat kraftigt sedan februari.
Googles eget tillkännagivande innehåller exakt en enda prestandasiffra: en "verifierad poäng på 77,1 %" på ARC-AGI-2, vilket Google beskriver som mer än dubbelt så bra resonemangsprestanda som Gemini 3 Pro. Det är leverantörens siffra, hämtad från Googles eget inlägg, och det är den enda vi kunde bekräfta där. Lanseringstäckningen spred en mycket större uppsättning – GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity's Last Exam – men dessa siffror förekommer inte i Googles eget tillkännagivande, och de sekundära rapporterna motsäger varandra om dem vi kontrollerade (GPQA Diamond förekommer som både 94,1 och 94,3 beroende på vem man läser). Vi publicerar dem inte som etablerade resultat.
Den oberoende bilden är där berättelsen vänder. I versionen av Artificial Analysis Intelligence Index som var live den 23 september 2026 får Gemini 3.1 Pro Preview 30 poäng och rankas som 81:a av 212 modeller i den klassen. Medianmodellen i klassen får 25 poäng, så den ligger över genomsnittet — och ledaren i samma diagram, Claude Opus 5 vid sin maximala resonemangsinställning, får 58 poäng. Indexet i sig är en versionshanterad linjal snarare än en fast: Artificial Analysis reviderade det efter februarilanseringen, och dess egna revisionsanteckningar dokumenterar nya utvärderingar som ansluter till kompositen. Gemini 3.1 Pro rapporterades som den uttalade ledaren på indexet som det såg ut vid dess februarilansering, med 57 poäng. Det är inte samma linjal som 30:an, och vi kommer inte att ställa de två siffrorna sida vid sida som om de spårade en nedgång.
Vad den nuvarande kartläggningen faktiskt visar är en genuin profil, och en skev sådan:
• Intelligens – 30 på indexet, plats 81 av 212. Över medianen, långt ifrån framkanten.
• Hastighet — 116,5 utdatatokens per sekund, rankad 38 av 212. Anmärkningsvärt snabb för en resonemangsmodell.
• Kostnad — $0,67 för att köra en Intelligence Index-uppgift, rang 31 av 212. Det är billigt per arbetsenhet, eftersom modellen är sparsam med tanketokens.
Verbositeten – 67 miljoner utdatatokens för att slutföra indexet, mot en klassmedian på 88 miljoner. Rang 39 av 212; Artificial Analysis kallar den ”ganska koncis”. Som jämförelse bränner Gemini 3.8 Flash vid hög resonemangsnivå 170 miljoner tokens i samma svit och kostar 1,24 dollar per uppgift – mer än Gemini 3.1 Pro, trots billigare pris per token.
Så den ärliga tolkningen är inte ”den gamla modellen är slagen överallt”. Gemini 3.1 Pro är snabb och tokeneffektiv, och sett till kostnad per uppgift slår den sitt eget nyare syskon. Det den förlorar är den högsta kapacitetsnivån, och i varje arbetsbelastning där kvalitet är den bindande begränsningen är det den enda axeln som räknas.

Frågan om tillgängligheten i september
Det finns en aktuell utveckling kring den här modellen, och det är en fråga snarare än en lansering. Sedan den 18 september 2026 har användare på Googles eget utvecklarforum för AI Studio rapporterat att Gemini 3.1 Pro försvann från modellväljaren i AI Studio — trådrubriken daterar ändringen till 2026-09-18 — medan betalande användare säger att de flyttades över till Gemini 3.8 Flash och därifrån till 3.7 och 3.6 Flash. Ingen Google-anställd hade svarat i tråden vi läste, det finns inget meddelande om utfasning, och ingen orsak har angetts. Modellen var fortfarande listad och fortfarande anropbar via Gemini API och via vår egen katalog när vi kontrollerade den 23 september 2026.
Vi flaggar detta som olösta användarrapporter på Googles eget forum, inte som en avveckling och inte som ett avbrott. Men om din produktionsväg är beroende av just den här modellen är det en anledning att ha en reservlösning konfigurerad snarare än att anta att en förhandsvisningsendpoint är beständig.
Vem bör välja det, och vem bör inte göra det
Välj Gemini 3.1 Pro om ditt problem är långt och multimodalt. Fönstret på en miljon token med inbyggd video-, ljud- och PDF-indata är fortfarande anledningen att vara här, och inget med modellens ålder ändrar på det. Konkret: analys av ett helt kodförråd, granskning av timmar av inspelade möten eller filmmaterial, extrahering av strukturerad data ur dokumentsamlingar med blandade medier, eller vilken pipeline som helst där en enda prompt legitimt går över 200 000 token och alternativet är ett retrieval-lager som du skulle behöva bygga och utvärdera. Dess token-effektivitet är ett verkligt andra argument – den slutför en uppgiftssvit på 67M utdatatokens där Gemini 3.8 Flash gör av med 170M, så en kostnad per uppgift kan bli lägre även om priset per token ser högre ut.
Välj något annat i tre fall. Om du vill ha Googles nuvarande bästa svar på en svår resonemangs- eller långsiktig kodningsfråga får Gemini 3.8 Flash högre poäng än Gemini 3.1 Pro i det aktuella oberoende indexet, är allmänt tillgänglig i stället för förhandsversion, kostar 0,75 USD per miljon indata-tokens och 3,75 USD per miljon utdata-tokens fram till 31 december 2026, och har en gratisnivå som Gemini 3.1 Pro inte har. Den förbrukar fler tanketokens för att komma dit – det är avvägningen, och den är verklig. Om du behöver den absoluta frontlinjen är det inte en Google-modell just nu: i samma indexdiagram leder Claude Opus 5 med maximalt resonemang på 58 mot Gemini 3.1 Pro:s 30. Och om din arbetsbelastning är latens- eller kostnadskänslig och ytlig – klassificering, extrahering, routning, kort sammanfattning – klarar en Flash-Lite-nivå eller en liten modell med öppna vikter jobbet för en bråkdel av 2,00 USD per miljon indata-tokens, och att betala Pro-priser för det är bara slöseri.
Det vi inte skulle göra är att välja Gemini 3.1 Pro för att det är Googles nyaste Pro-modell. Den är inte ny, och från och med denna månad har Google ingen lanserad efterträdare till den.
Att anropa den utan att satsa din stack på en förhandsgransknings-endpoint
Det besvärliga med en sju månader lång förhandsversion är att den är tillräckligt bra att bygga vidare på men inte tillräckligt stabil för att tas för given. Två mildrande åtgärder är värda att nämna.
Lås den exakta modellkoden i stället för ett alias. En förhandsvisningsslutpunkt kan revideras på plats, så gemini-3.1-pro-preview i en konfigurationsfil är säkrare än en flytande ”senaste Pro”-referens, och det gör en tyst ändring synlig i en diff.
Behåll routningen ovanför modellen. På OrcaRouter är Gemini 3.1 Pro google/gemini-3.1-pro-preview, serverad från samma nyckel och samma endpoint som alla andra modeller vi erbjuder, inklusive ett inbyggt /v1beta/models/{model}:generateContent-format för kod skriven mot Gemini SDK och ett OpenAI-kompatibelt /v1/chat/completions för allt annat. Eftersom prissättningen är genomfakturering med 0 % påslag, är $2.00 / $12.00 på Googles prislista summan du betalar här, och en leverantörsprisändring gäller samma dag i stället för vid nästa faktureringscykel. Anledningen till att det spelar roll specifikt för en förhandsmodell är failover: en konfigurerad reservkedja innebär att den dag Gemini 3.1 Pro inte är tillgänglig landar ditt återförsök på nästa modell i kedjan innan svaret börjar, i stället för efter att dina användare har märkt det. Det är skillnaden mellan en förhandsversion du kan driftsätta med och en förhandsversion du bara kan demonstrera.
Vår egen katalogpost för modellen innehåller specifikationerna så som vi tillhandahåller dem – kontext på en miljon token, maximal utdata på 65 536 token, indata i form av ljud/fil/bild/text/video, textutdata, och en mediantid till första token på 10,00 sekunder under de senaste sju dagarna, vilket är värt att veta innan du antar att detta är en modell för chattlatens. Det är det inte.

Vad är fortfarande öppet?
Tre saker som vi inte kunde avsluta, och som vi hellre konstaterar än sopar under mattan. Google har inte sagt huruvida Gemini 3.1 Pro någonsin kommer att nå allmän tillgänglighet, och det finns inget publicerat nedstängningsdatum åt någotdera hållet. AI Studio-rapporterna är fortfarande oförklarade fem dagar senare, utan något svar från leverantören som vi kunde hitta. Och frågan om efterträdaren kan bara besvaras nekande: Googles Pro-sida har i månader annonserat om en kommande Pro-lansering, rapporteringen säger att den interna kandidaten skrotades för att den inte kunde slå Flash-linjen, och per den 23 september 2026 har ingenting släppts. Om en Gemini 3.5 Pro eller en Gemini 4 Pro kommer, förändras positionen för Gemini 3.1 Pro i den här familjen för första gången sedan februari — och det, inte dess ursprungliga lansering, är händelsen värd att bevaka.

Gemini 3.1 Pro finns på OrcaRouter till Googles listpris, bakom samma nyckel som allt annat vi erbjuder. Se modellsidan för Gemini 3.1 Pro för aktuell prissättning, kontextgränser och en reservkedja som du kan konfigurera innan nästa förhandsversion lanseras.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
