Scheda del titolo per l'explainer di Gemini 3.1 Pro che riporta «Gemini 3.1 Pro» con il sottotitolo «Ancora un'anteprima, sette mesi dopo», sopra quattro pillole di specifiche che riportano input da 1M di token, output da 65K, 2 $ / 12 $ per 1M, e Annunciato il 19 febbraio 2026.
Guides & Insights

Che cos'è Gemini 3.1 Pro? Il tier Pro di Google non si è mosso da sette mesi

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Gemini 3.1 Pro è l'unico modello attivo di fascia Pro della sua famiglia. È stato annunciato il 19 febbraio 2026 e, sette mesi dopo, la documentazione del modello dello stesso fornitore lo classifica ancora alla voce “Preview” all'endpoint gemini-3.1-pro-preview — nessuna disponibilità generale, nessuna data di dismissione, nessun successore rilasciato. Negli stessi sette mesi il fornitore ha pubblicato cinque release Flash, e la più recente, Gemini 3.8 Flash, ora totalizza undici punti in più sull'indice indipendente che la maggior parte delle persone cita. Questo divario è il motivo per cui una pagina che spiega cos'è Gemini 3.1 Pro deve aprirsi con ciò che non è.

Se vuoi la versione in due frasi: Gemini 3.1 Pro è un modello di ragionamento nativamente multimodale a pesi chiusi, realizzato da Google DeepMind, che legge testo, immagini, video, audio e PDF e scrive testo. Lo si chiama tramite le API di Google o tramite un router che lo supporta, accetta fino a 1.048.576 token di input e costa 2,00 $ per milione di token di input e 12,00 $ per milione di token di output al di sotto di un prompt di 200.000 token. Si conferma un cavallo di battaglia multimodale per contesti lunghi. Non è più il modello che scegli perché è il più intelligente disponibile.

Dove si colloca nella propria famiglia

Questa è la parte che la maggior parte degli articoli salta, ed è la parte che conta di più. La famiglia Gemini 3 non è un'unica scala con un Pro in cima. Sono due scale che hanno smesso di essere paragonabili.

È la scala Flash quella che si è mossa. La documentazione dei modelli di Google, consultata il 23 settembre 2026, elenca Gemini 3.8 Flash, Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking come nuove versioni stabili, con Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash e Gemini 3.5 Flash-Lite ancora stabili dietro di loro. Gemini 3.8 Flash è arrivato il 2 settembre 2026 — la terza release Flash in sei settimane.

La scala Pro è quella che non ce l'ha fatta. Non esiste Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro o 3.8 Pro nella documentazione di Google. Gemini 3 Pro, il modello che Gemini 3.1 Pro doveva sostituire, è indicato come disattivato. Gemini 2.5 Pro sopravvive, ma l'accesso è limitato agli utenti precedenti. Ciò lascia Gemini 3.1 Pro come l'unico endpoint Gemini 3 di livello Pro che puoi chiamare oggi — non perché abbia vinto una gara, ma perché nessun altro vi ha partecipato.

Il piano dichiarato da Google a febbraio era che l’anteprima sarebbe durata abbastanza a lungo da “convalidare questi aggiornamenti” e far progredire ambiti come flussi di lavoro agentici ambiziosi prima che il modello diventasse “disponibile a livello generale a breve”. Queste sono le parole di Google nell’annuncio di febbraio. Sette mesi dopo, ciò non è accaduto, e le notizie sul ritardo vanno presentate chiaramente come notizie, non come fatti: SemiAnalysis ha concluso che lo sforzo su Gemini 3.5 Pro era stato silenziosamente cancellato, e il Wall Street Journal, come citato da testate secondarie, ha riportato che il candidato interno 3.5 Pro è stato abbandonato perché non riusciva a superare la serie Flash. La versione di Google è che 3.5 Pro resta in test ristretti con i partner, senza un mese confermato. Non abbiamo trovato una dichiarazione di Google che confermi o neghi la cancellazione, e non prenderemo posizione al posto loro.

La conseguenza pratica è una trappola di denominazione. Se cerchi “il Gemini Pro più recente”, il modello di fascia Pro più nuovo che troverai è di febbraio, mentre i numeri di versione sul fronte Flash sono saliti alla 3.8. Qui i numeri di versione non classificano le capacità tra le fasce; sono due binari di rilascio separati.

Le specifiche che contano

Ogni cifra riportata di seguito è tratta dalla documentazione ufficiale dell'API Gemini di Google, datata 23 settembre 2026, salvo diversa indicazione.

• Contesto di input — 1.048.576 token, la stessa finestra da un milione di token che Google ha rilasciato sin dalla generazione 2.5. L'output è limitato separatamente a 65.536 token, un tetto massimo per la risposta, non per la conversazione.

• Modalità di input — testo, immagine, video, audio e PDF. Modalità di output — solo testo. Nessuna generazione audio, nessuna generazione di immagini, nessuna Live API, quindi questo non è il modello per un agente vocale in tempo reale o una pipeline di immagini. Google distribuisce varianti separate di Gemini 3.x Flash per questi compiti.

• Ragionamento — supportato, con controllo del livello di pensiero. I token di pensiero vengono fatturati alla tariffa di output, motivo per cui il prezzo di output è il numero che domina la tua fattura.

• Strumenti — caching, esecuzione del codice, chiamata di funzioni, Search grounding, Maps grounding, output strutturati, contesto URL, l'API Batch, l'inferenza flex e l'inferenza prioritaria sono tutti elencati come supportati. La ricerca file è elencata come supportata solo in AI Studio.

• Licenza e pesi — proprietari. Non esistono pesi aperti, né checkpoint scaricabili, né alcun percorso di self-hosting. Ogni via verso questo modello è un'API ospitata.

• Endpoint — gemini-3.1-pro-preview è il codice del modello. Google elenca anche una gemini-3.1-pro-preview-customtools variante. Un endpoint di anteprima può essere modificato sotto di te senza un incremento di versione, che è il motivo standard per fissare ID di modello esatti in produzione anziché alias.

• Data di aggiornamento documentata — la pagina del modello riporta “Ultimo aggiornamento: febbraio 2026”. Non siamo riusciti a trovare una data di knowledge cutoff indicata sulla pagina del modello di Google; gli elenchi di terze parti dicono gennaio 2025, e lo segnaliamo come non confermato anziché ripeterlo come un fatto.

Quanto costa

Gemini 3.1 Pro ha un salto di prezzo, ed è il tipo di dettaglio che trasforma una stima dall'aria economica in una fattura raddoppiata. Il listino prezzi per sviluppatori pubblicato da Google si basa sulla dimensione del prompt anziché sulla versione del modello.

• Livello standard, prompt fino a 200.000 token — 2,00 $ per milione di token di input, 12,00 $ per milione di token di output, con i token di ragionamento conteggiati come output.

• Livello standard, prompt oltre 200.000 token — 4,00 $ in input e 18,00 $ in output. Entrambe le tariffe raddoppiano alla stessa soglia. Questa è la trappola: un carico di lavoro a contesto lungo paga il doppio della tariffa di listino proprio perché sta usando la funzionalità per cui ha acquistato il modello.

• Cache del contesto — $0,20 o $0,40 per milione di token memorizzati nella cache, a seconda che ci si trovi al di sotto o al di sopra della soglia di 200.000, più l'archiviazione della cache fatturata a $4,50 per milione di token all'ora.

• Livelli Batch e Flex — 1,00 $ di input e 6,00 $ di output sotto i 200.000 token, 2,00 $ e 9,00 $ oltre. Circa la metà del prezzo per il lavoro che può attendere.

• Fascia prioritaria — $3,60 di input e $21,60 di output sotto la soglia, $7,20 e $32,40 sopra di essa.

• Piano gratuito — non disponibile per questo modello. Non esiste un limite di frequenza gratuito su cui fare prototipazione.

Due cose è utile sapere sull'affidabilità di quei numeri. La pagina dei prezzi di Google stessa è l'autorità in materia e l'abbiamo letta direttamente, quindi le cifre sopra sono aggiornate al 23 settembre 2026. Ma gli elenchi di terze parti di questo modello sono davvero incoerenti — un tracker indica una tariffa di $2,50 / $15,00, un altro una tariffa mista di $4,50 — e la suddivisione in livelli è il motivo. Se una pagina ti cita un singolo numero per Gemini 3.1 Pro senza dirti a quale fascia di dimensione del prompt si applica, quel numero non è utilizzabile per una stima reale.

In cosa è misurabilmente bravo, e in cosa misurabilmente no

Inizia con ciò che Google dichiara, poi tienilo separato da ciò che hanno misurato i valutatori indipendenti, perché le due cose si sono allontanate nettamente da febbraio.

L'annuncio di Google stesso contiene esattamente un dato di benchmark: un “punteggio verificato del 77,1%” su ARC-AGI-2, che Google descrive come più del doppio delle prestazioni di ragionamento di Gemini 3 Pro. È il numero del fornitore, letto dal post di Google stesso, ed è l'unico che abbiamo potuto confermare lì. La copertura del lancio ha fatto circolare una serie molto più ampia — GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity’s Last Exam — ma quei dati non compaiono nell'annuncio di Google stesso, e i resoconti secondari non concordano tra loro su quelli che abbiamo verificato (GPQA Diamond compare sia come 94,1 sia come 94,3 a seconda di chi lo riporta). Non li pubblichiamo come risultati consolidati.

Il quadro indipendente è il punto in cui la storia cambia. Sulla versione dell'Artificial Analysis Intelligence Index in vigore il 23 settembre 2026, Gemini 3.1 Pro Preview ottiene un punteggio di 30 e si classifica 81° su 212 modelli di quella classe. Il modello mediano della classe ottiene 25, quindi si colloca sopra la media — e il leader sullo stesso grafico, Claude Opus 5 alla sua impostazione di ragionamento massima, ottiene 58. L'indice stesso è un righello versionato più che fisso: Artificial Analysis lo ha rivisto dopo il lancio di febbraio, e le sue stesse note di revisione registrano nuove valutazioni che si aggiungono al composito. Gemini 3.1 Pro è stato riportato come leader assoluto sull'indice così com'era al momento del suo lancio di febbraio, con 57 punti. Non è lo stesso righello del 30, e non metteremo i due numeri fianco a fianco come se tracciassero un declino.

Ciò che la mappatura attuale mostra è un profilo autentico, e per giunta sbilanciato:

• Intelligenza — 30 nell'indice, posizione 81 su 212. Sopra la mediana, ben lontano dalla frontiera.

• Velocità — 116,5 token di output al secondo, 38° posto su 212. Notevolmente veloce per un modello di ragionamento.

• Costo — 0,67 $ per eseguire un’attività dell’Intelligence Index, 31º posto su 212. È economico per unità di lavoro, perché il modello è parsimonioso con i token di pensiero.

• Verbosità — 67M token di output per completare l'indice, rispetto a una mediana di classe di 88M. Posizione 39 su 212; Artificial Analysis lo definisce “piuttosto conciso.” Per confronto, Gemini 3.8 Flash con ragionamento elevato consuma 170M token sulla stessa suite e costa $1,24 per attività — più di Gemini 3.1 Pro, nonostante un prezzo per token più basso.

Quindi la lettura onesta non è “il vecchio modello viene battuto ovunque”. Gemini 3.1 Pro è veloce ed efficiente in termini di token e, su base costo per attività, batte il suo stesso fratello più recente. Ciò che perde è la fascia alta delle capacità e, su qualsiasi carico di lavoro in cui la qualità è il vincolo determinante, quello è l’unico asse che conta.

Screenshot of the Artificial Analysis model page for Gemini 3.1 Pro Preview, showing the headline tiles Intelligence 30 (rank 81 out of 212 models), Speed 116.5 output tokens per second (rank 38 out of 212), Cost $0.67 to run one Intelligence Index task (rank 31 out of 212) and Verbosity 67M output tokens (rank 39 of 212), alongside a panel comparing Gemini 3.1 Pro Preview against Claude Opus 5 at maximum reasoning.

La questione della disponibilità di settembre

C'è un unico sviluppo in corso attorno a questo modello, e si tratta più di una domanda che di un rilascio. Dal 18 settembre 2026, gli utenti sul forum per sviluppatori di AI Studio di Google segnalano che Gemini 3.1 Pro è scomparso dal selettore dei modelli di AI Studio — il titolo del thread colloca il cambiamento al 2026-09-18 — con gli utenti a pagamento che affermano di essere stati spostati su Gemini 3.8 Flash e, da lì, su 3.7 e 3.6 Flash. Nessun dipendente Google aveva risposto nel thread che abbiamo letto, non c'è alcun avviso di deprecazione e non è stata indicata alcuna causa. Il modello era ancora elencato e ancora richiamabile tramite la Gemini API e tramite il nostro catalogo quando abbiamo verificato il 23 settembre 2026.

Stiamo segnalando questo come segnalazioni degli utenti non risolte sul forum di Google stesso, non come un ritiro e non come un'interruzione. Ma se il tuo percorso di produzione dipende specificamente da questo modello, è un motivo per avere un fallback configurato anziché presumere che un endpoint di anteprima sia una presenza fissa.

Chi dovrebbe sceglierlo e chi no

Scegli Gemini 3.1 Pro se il tuo problema è lungo e multimodale. La finestra da un milione di token con input nativo video, audio e PDF resta il motivo per cui essere qui, e nulla riguardo all'età del modello cambia questo. Concretamente: analisi dell'intero repository, verifica di ore di riunioni registrate o filmati, estrazione di dati strutturati da insiemi di documenti multimediali, o qualsiasi pipeline in cui un singolo prompt supera legittimamente i 200.000 token e l'alternativa è un livello di retrieval che dovresti costruire e valutare. La sua efficienza in termini di token è un secondo argomento concreto: completa una suite di attività con 67M token di output, mentre Gemini 3.8 Flash ne spende 170M, quindi il costo per attività può risultare inferiore anche se la tariffa per token sembra più alta.

Scegli qualcos'altro in tre casi. Se vuoi la migliore risposta attuale di Google a una domanda difficile di ragionamento o di coding a lungo termine, Gemini 3.8 Flash supera Gemini 3.1 Pro sull'attuale indice indipendente, è in disponibilità generale anziché in anteprima, costa $0,75 per milione di token in input e $3,75 per milione in output fino al 31 dicembre 2026, e ha un livello gratuito che Gemini 3.1 Pro non ha. Consuma più token di pensiero per arrivarci — questo è il compromesso, ed è reale. Se ti serve la frontiera assoluta, al momento non è un modello Google: sullo stesso grafico dell'indice, Claude Opus 5 al massimo livello di ragionamento è in testa con 58 contro il 30 di Gemini 3.1 Pro. E se il tuo carico di lavoro è sensibile alla latenza o ai costi ed è superficiale — classificazione, estrazione, routing, riepilogo breve — un livello Flash-Lite o un piccolo modello open-weights farà il lavoro per una frazione di $2,00 per milione di token in input, e pagare tariffe Pro per questo è solo uno spreco.

Quello che non faremmo è scegliere Gemini 3.1 Pro perché è il Pro più recente di Google. Non è nuovo e, a partire da questo mese, Google non ha un successore già distribuito.

Chiamarlo senza puntare tutto il tuo stack su un endpoint di anteprima

La parte scomoda di un'anteprima di sette mesi è che è abbastanza buona per costruirci sopra, ma non abbastanza stabile da darla per scontata. Vale la pena menzionare due mitigazioni.

Fissa il codice esatto del modello invece di un alias. Un endpoint di anteprima può essere modificato sul posto, quindi gemini-3.1-pro-preview in un file di configurazione è più sicuro di un riferimento fluttuante "latest Pro", e rende visibile in un diff una modifica silenziosa.

Tieni il routing sopra il modello. Su OrcaRouter, Gemini 3.1 Pro è google/gemini-3.1-pro-preview, servito dalla stessa chiave e dallo stesso endpoint di ogni altro modello che offriamo, inclusa una forma nativa /v1beta/models/{model}:generateContent per il codice scritto per l'SDK Gemini e una /v1/chat/completions compatibile con OpenAI per tutto il resto. Poiché il prezzo è pass-through con 0% di ricarico, i 2,00 $ / 12,00 $ del listino di Google sono la cifra che paghi qui, e una variazione di prezzo del fornitore è attiva lo stesso giorno anziché al ciclo di fatturazione successivo. Il motivo per cui questo conta specificamente per un modello in anteprima è il failover: una catena di fallback configurata significa che il giorno in cui Gemini 3.1 Pro non è disponibile, il tuo nuovo tentativo ricade sul modello successivo della catena prima che la risposta inizi, anziché dopo che i tuoi utenti se ne accorgono. È la differenza tra un'anteprima su cui puoi fare rilascio in produzione e un'anteprima che puoi solo mostrare in demo.

La nostra voce di catalogo per il modello riporta le specifiche così come le forniamo — contesto da un milione di token, output massimo di 65.536 token, input audio/file/immagine/testo/video, output testo, e un tempo mediano al primo token di 10,00 secondi negli ultimi sette giorni, cosa che è utile sapere prima di pensare che questo sia un modello con latenza da chat. Non lo è.

Generated comparison scoreboard titled 'Gemini 3.1 Pro vs Gemini 3.8 Flash — the scoreboard'. Left column, Gemini 3.1 Pro: AA Index 30, cost per index task $0.67, tokens per index run 67M, output speed 116 tok/s, output price $12.00 / 1M, status Preview. Right column, Gemini 3.8 Flash: AA Index 41, cost per index task $1.24, tokens per index run 170M, output speed 287 tok/s, output price $3.75 / 1M, status Stable. Footer reads 'Index per Artificial Analysis v4.3.2; prices and status per Google docs, 23 Sep 2026.'

Cosa è ancora aperto?

Tre cose che non abbiamo potuto chiudere, e che preferiamo dichiarare piuttosto che nascondere. Google non ha detto se Gemini 3.1 Pro raggiungerà mai la disponibilità generale, e non c'è alcuna data di chiusura pubblicata, in un senso o nell'altro. I rapporti di AI Studio sono ancora inspiegati dopo cinque giorni, senza alcuna risposta del fornitore che siamo riusciti a trovare. E alla questione del successore si può rispondere solo in negativo: la pagina Pro di Google pubblicizza da mesi un prossimo rilascio Pro, la stampa riferisce che il candidato interno è stato scartato perché non è riuscito a battere la linea Flash, e al 23 settembre 2026 non è stato rilasciato nulla. Se arriverà un Gemini 3.5 Pro o un Gemini 4 Pro, la posizione di Gemini 3.1 Pro in questa famiglia cambierà per la prima volta da febbraio — e quello, non il suo lancio originale, è l'evento da tenere d'occhio.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the model identifier google/gemini-3.1-pro-preview, Flagship and Featured badges, the byline 'by Google · 2026-02-19', capability tags for Vision, Audio, Tools, JSON and Reasoning, a 1M-token context and 65K maximum output, input modalities listed as audio, file, image, text and video with text-only output, and pricing tiles reading $2.00 per 1M input tokens and $12.00 per 1M output tokens.

Gemini 3.1 Pro è su OrcaRouter al prezzo di listino di Google, dietro la stessa chiave di tutto il resto che offriamo. Vedi la pagina del modello Gemini 3.1 Pro per prezzi in tempo reale, limiti di contesto e una catena di fallback che puoi configurare prima che arrivi la prossima revisione in anteprima.

Confrontati in questo articolo3

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno