{{1}}Scheda titolo hero per l'articolo 'Gemini 3.7 Flash vs Gemini 3.1 Pro' con il sottotitolo 'Il livello Flash di Google ha reso obsoleto il suo stesso flagship?', badge a pillola con scritto 'AA Index 56 vs 48', '/bin/bash.75 / .75 vs / 2', 'Stable vs preview' e il logo OrcaRouter in basso a destra.{{/1}}
Guides & Insights

Gemini 3.7 Flash vs Gemini 3.1 Pro: Il livello Flash di Google ha reso obsoleto il suo stesso prodotto di punta?

Autore

Magnus Corvin

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

C'è una domanda scomoda che si annida nella gamma di modelli 2026 di Google, ed è rivolta a ogni team che attualmente paga per Gemini 3.1 Pro: perché il modello Flash economico supera il modello di punta nell'indice indipendente? Gemini 3.7 Flash, rilasciato il 13 agosto 2026 a $0,75 per milione di token in input e $3,75 per milione in output, ottiene 56 punti sull'Artificial Analysis Intelligence Index con ragionamento avanzato. Gemini 3.1 Pro, l'anteprima che Google ha rilasciato il 19 febbraio 2026 a $2,00 / $12,00 — e a $4,00 / $18,00 oltre i 200K di contesto — oggi si colloca nella parte alta dei 40 sullo stesso indice. Il modello di punta che dominava l'indice al lancio è stato superato dal suo stesso livello operativo, e questo articolo parla di cosa significhi per i due modelli e per i team che devono scegliere tra loro.

La premessa: il livello di punta di Google è bloccato in anteprima.

Il contesto conta più dei numeri. Gemini 3.1 Pro è in preview da febbraio 2026 — sette mesi al momento in cui scrivo — e il suo successore, Gemini 3.5 Pro, è stato annunciato al Google I/O di maggio come «in arrivo il mese prossimo», salvo poi non uscire né a giugno, né a luglio, né ad agosto. A inizio settembre, il livello di punta non ha un successore rilasciato, nessuna data, e si parla di una possibile cancellazione. Nel frattempo, il livello Flash ha distribuito tre generazioni nello stesso arco di tempo: Gemini 3.6 Flash il 21 luglio, Gemini 3.7 Flash il 13 agosto, e la capacità di comprensione video agentica su entrambi il 1° settembre. Il confronto non è davvero «Pro vs Flash». È «il livello che Google sta distribuendo» contro «il livello che Google ha smesso di distribuire».

Il contrasto delle specifiche

• Prezzo — {{1}}Gemini 3.7 Flash a $0.75 / $3.75 per 1 milione di token{{/1}} {{2}}(promo fino al 31 dicembre 2026, poi $1.50 / $7.50){{/2}} rispetto a {{3}}Gemini 3.1 Pro a $2.00 / $12.00 con contesto inferiore a 200K{{/3}}, {{4}}che sale a $4.00 / $18.00 oltre 200K{{/4}}. {{5}}Da tre a quattro volte più economico a prezzo di listino, prima dei controlli del livello di ragionamento.{{/5}}

• Contesto / output massimo — 1M / 64K vs 1M / 64K. Massimali identici.

• Input — sia testo, immagine, audio, video, PDF. La superficie multimodale è la stessa; la differenza sta in ciò che il modello fa con il video (vedi sotto).

• Controllo del ragionamento — Gemini 3.7 Flash: pensiero basso / medio / alto. Gemini 3.1 Pro: pensiero basso / medio / alto, con pensiero dinamico attivo per impostazione predefinita.

• Punteggio indipendente — Gemini 3.7 Flash 56 sull'Artificial Analysis Intelligence Index rispetto a Gemini 3.1 Pro nella parte alta degli anni 40 nella versione attuale dell'indice (ha ottenuto 57 al lancio con la versione precedente).

• Velocità di output — Gemini 3.7 Flash genera circa 285 token/sec con ragionamento elevato, rispetto ai circa 112–125 token/sec di Gemini 3.1 Pro — circa due volte e mezzo più veloce.

• Stato — Gemini 3.7 Flash stabile, GA. Gemini 3.1 Pro in anteprima, con la breve finestra di deprecazione dell'anteprima.

L'indice, e il pasticcio di benchmark sottostante.

La notizia principale è l'indice: Artificial Analysis, il valutatore indipendente che confronta i modelli dei diversi fornitori, ora colloca Gemini 3.7 Flash a 56 punti e Gemini 3.1 Pro nella fascia alta dei 40 — il cavallo di lavoro davanti al modello di punta, un'inversione delle posizioni rispetto al lancio di Gemini 3.1 Pro, quando il suo 57 era in vetta all'indice. È il fatto più importante in assoluto di questo confronto, e arriva da una fonte indipendente, non dal fornitore.

Sotto l'indice, il registro dei benchmark è un guazzabuglio di harness non confrontabili, e leggerlo con ingenuità produce la risposta sbagliata. Il record pubblicato di Gemini 3.1 Pro — 80,6% su SWE-bench Verified, 77,1% su ARC-AGI-2, 94,3% su GPQA Diamond, 2887 Elo su LiveCodeBench Pro — è stato riportato da Google al lancio di febbraio, usa versioni dei benchmark diverse da quelle dei numeri di Flash e non è mai stato riprodotto in modo uniforme. Il 43,6% di Gemini 3.7 Flash su FrontierCode 1.1, il 65,3% su DeepSWE v1.1 e i 1588 Elo nell'arena di sviluppo web sono anch'essi dichiarati dal fornitore sui nuovi harness. Dove i due si sovrappongono in un aggregato indipendente — l'AA Index — vince Flash. Chiunque ti dica «Pro batte Flash su SWE-bench» sta confrontando due versioni di due test diversi senza dirlo.

A two-column scoreboard titled 'Gemini 3.7 Flash vs Gemini 3.1 Pro — the scoreboard'. Left column 'Gemini 3.7 Flash': 'Price /bin/bash.75 / .75 (promo)', 'AA Index 56', 'Speed ~285 tok/s (high)', 'Status stable, GA', 'Agentic video understanding: yes', 'Released Aug 13, 2026'. Right column 'Gemini 3.1 Pro': 'Price .00 / 2.00 ( / 8 above 200K)', 'AA Index upper-40s (57 at launch)', 'Speed ~112-125 tok/s', 'Status preview', 'Agentic video understanding: no', 'Released Feb 19, 2026'. Footer: 'AA figures per Artificial Analysis; component benchmarks vendor-reported, unreproduced.'Screenshot of the Artificial Analysis model page for Gemini 3.7 Flash at high reasoning, showing an Intelligence Index of 56 (ranked #20 of 187 models), an output speed of 285 tokens per second in the high-reasoning configuration, and a price of /bin/bash.75 per 1M input and .75 per 1M output tokens.

Il divario nelle capacità video

La funzionalità che rende il confronto sbilanciato è il video. La nuova modalità agentica di comprensione video di Google — annunciata il 1° settembre 2026 — si applica a Gemini 3.7 Flash, Gemini 3.6 Flash e Gemini 3.5 Flash-Lite. Gemini 3.1 Pro non è nella lista. Il modello Flash legge i video secondo la definizione della nuova modalità: il modello decide cosa guardare, a quale velocità, e tramite fotogrammi, audio o trascrizione, caricando solo i segmenti pertinenti, con risparmi dichiarati dal fornitore fino al 66% sui costi e all'88% sui token. Gemini 3.1 Pro tecnicamente accetta input video, ma utilizza il vecchio percorso di campionamento statico e non riceve nessuno dei nuovi strumenti. Per gli utenti del modello di punta, la più recente funzionalità video della famiglia Gemini sta arrivando prima sul modello più economico, e il livello Pro non ha una data annunciata per riceverla.

Velocità e il problema del rischio di anteprima.

La velocità amplifica il divario di prezzo allo stesso modo in cui lo fa in ogni confronto con Gemini 3.7 Flash: circa tre volte la velocità di output su un modello che costa già un terzo del prezzo. Ma la seconda differenza è quella che i team dimenticano di mettere in conto: lo status. Gemini 3.1 Pro è un'anteprima, e le anteprime hanno una breve finestra di preavviso di deprecazione quando arriva il successore. Un carico di lavoro in produzione su un modello in anteprima è un rischio permanente che l'ID del modello cambi, che i prezzi cambino o che le funzionalità si spostino con poco preavviso. Gemini 3.7 Flash è GA — stabile, documentato e non destinato a essere sostituito per un capriccio, anche se la cadenza quasi mensile dei modelli Flash di Google significa che un modello 3.8 Flash potrebbe seguire a breve. Il rischio di deprecazione dell'anteprima di Gemini 3.1 Pro non è ipotetico: è lo stato attuale di un livello il cui successore è in ritardo da tre mesi.

Dove Gemini 3.1 Pro vince ancora

La ragione onesta a favore di 3.1 Pro poggia su tre pilastri, e nessuno di essi è la capacità grezza. Primo, l'endpoint per strumenti personalizzati: Gemini 3.1 Pro è disponibile con una superficie API dedicata a bash/strumenti personalizzati che Flash non eguaglia, e i team che hanno costruito strumenti per agenti su questa base oggi hanno un sistema funzionante. Secondo, i carichi di lavoro ottimizzati: una pipeline già calibrata sui default di dynamic-thinking di 3.1 Pro, sui pattern di cache e sui punteggi eval è un bersaglio mobile, e il passaggio costa tempo di ingegneria reale anche quando la destinazione è più veloce ed economica. Terzo, i compiti specifici in cui il più lungo storico produttivo di Pro non ha ancora un equivalente in Flash — i benchmark della generazione di lancio come GPQA e ARC-AGI-2 su cui Flash non è mai stato misurato. Se il tuo carico di lavoro è uno di questi, "Flash supera Pro nell'indice" non risolve la questione; solo un test sul tuo eval lo fa.

Il verdetto: cosa significa l'acquisizione del livello Flash

La direzione è inequivocabile. Per un nuovo carico di lavoro oggi, Gemini 3.7 Flash è il Gemini predefinito migliore: più economico, più veloce, stabile in GA, più in alto nell'indice indipendente, e riceve per primo la nuova capacità video. Gemini 3.1 Pro conserva una base di utenti reale ma ristretta — utenti di strumenti personalizzati, pipeline ottimizzate, e attività in cui il suo precedente record nei benchmark è ancora valido. Il quadro più ampio è che il livello di punta di Google è in stallo, mentre il suo livello operativo è dove l'azienda sta realmente competendo — e i team che ancora pagano prezzi da livello di punta per 3.1 Pro stanno pagando per uno status che l'azienda stessa ha smesso di difendere.

Screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview showing a 1M-token context window, .00 per 1M input and 2.00 per 1M output tokens, and Vision/Audio/Tools/JSON/Reasoning capability chips.

Per i team che vogliono migrare senza un progetto, il passaggio da un modello Gemini all'altro è un cambio di nome del modello, non un'integrazione. Gemini 3.1 Pro è servito su OrcaRouter al prezzo di listino di $2.00 / $12.00, applicato senza markup, insieme a Gemini 3.6 Flash e al resto del livello Gemini instradabile dietro un'unica chiave — quindi un workload può instradare una parte del traffico verso un modello Flash, tenere 3.1 Pro come fallback per le attività in cui è ancora lui a vincere, e lasciare che il failover automatico assorba il rischio che uno dei due modelli Google cambi. Gemini 3.7 Flash, da parte sua, è disponibile tramite l'API di Google e diverse piattaforme di terze parti. Il DSL di routing e la fusione dei modelli sono esattamente ciò che utilizzeresti per fare un confronto alla pari tra i due modelli Gemini sulla tua eval prima di fare il passaggio. La scelta verso cui la gamma ti spinge è chiara: punta sul livello Flash come default e tieni Pro solo per i casi circoscritti in cui dimostra di meritare il suo sovrapprezzo.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube