
Gemini 3.7 Flash vs Gemini 3.1 Pro: Il livello Flash di Google ha reso obsoleto il suo stesso prodotto di punta?
- AlibabaNUOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiNUOVOZ.ai: GLM 5.3 Flash2026-08-2658Intelligenza72Codice
- DeepSeekNUOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1860Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1552Intelligenza68Codice
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
C'è una domanda scomoda che si annida nella gamma di modelli 2026 di Google, ed è rivolta a ogni team che attualmente paga per Gemini 3.1 Pro: perché il modello Flash economico supera il modello di punta nell'indice indipendente? Gemini 3.7 Flash, rilasciato il 13 agosto 2026 a $0,75 per milione di token in input e $3,75 per milione in output, ottiene 56 punti sull'Artificial Analysis Intelligence Index con ragionamento avanzato. Gemini 3.1 Pro, l'anteprima che Google ha rilasciato il 19 febbraio 2026 a $2,00 / $12,00 — e a $4,00 / $18,00 oltre i 200K di contesto — oggi si colloca nella parte alta dei 40 sullo stesso indice. Il modello di punta che dominava l'indice al lancio è stato superato dal suo stesso livello operativo, e questo articolo parla di cosa significhi per i due modelli e per i team che devono scegliere tra loro.
La premessa: il livello di punta di Google è bloccato in anteprima.
Il contesto conta più dei numeri. Gemini 3.1 Pro è in preview da febbraio 2026 — sette mesi al momento in cui scrivo — e il suo successore, Gemini 3.5 Pro, è stato annunciato al Google I/O di maggio come «in arrivo il mese prossimo», salvo poi non uscire né a giugno, né a luglio, né ad agosto. A inizio settembre, il livello di punta non ha un successore rilasciato, nessuna data, e si parla di una possibile cancellazione. Nel frattempo, il livello Flash ha distribuito tre generazioni nello stesso arco di tempo: Gemini 3.6 Flash il 21 luglio, Gemini 3.7 Flash il 13 agosto, e la capacità di comprensione video agentica su entrambi il 1° settembre. Il confronto non è davvero «Pro vs Flash». È «il livello che Google sta distribuendo» contro «il livello che Google ha smesso di distribuire».
Il contrasto delle specifiche
• Prezzo — {{1}}Gemini 3.7 Flash a $0.75 / $3.75 per 1 milione di token{{/1}} {{2}}(promo fino al 31 dicembre 2026, poi $1.50 / $7.50){{/2}} rispetto a {{3}}Gemini 3.1 Pro a $2.00 / $12.00 con contesto inferiore a 200K{{/3}}, {{4}}che sale a $4.00 / $18.00 oltre 200K{{/4}}. {{5}}Da tre a quattro volte più economico a prezzo di listino, prima dei controlli del livello di ragionamento.{{/5}}
• Contesto / output massimo — 1M / 64K vs 1M / 64K. Massimali identici.
• Input — sia testo, immagine, audio, video, PDF. La superficie multimodale è la stessa; la differenza sta in ciò che il modello fa con il video (vedi sotto).
• Controllo del ragionamento — Gemini 3.7 Flash: pensiero basso / medio / alto. Gemini 3.1 Pro: pensiero basso / medio / alto, con pensiero dinamico attivo per impostazione predefinita.
• Punteggio indipendente — Gemini 3.7 Flash 56 sull'Artificial Analysis Intelligence Index rispetto a Gemini 3.1 Pro nella parte alta degli anni 40 nella versione attuale dell'indice (ha ottenuto 57 al lancio con la versione precedente).
• Velocità di output — Gemini 3.7 Flash genera circa 285 token/sec con ragionamento elevato, rispetto ai circa 112–125 token/sec di Gemini 3.1 Pro — circa due volte e mezzo più veloce.
• Stato — Gemini 3.7 Flash stabile, GA. Gemini 3.1 Pro in anteprima, con la breve finestra di deprecazione dell'anteprima.
L'indice, e il pasticcio di benchmark sottostante.
La notizia principale è l'indice: Artificial Analysis, il valutatore indipendente che confronta i modelli dei diversi fornitori, ora colloca Gemini 3.7 Flash a 56 punti e Gemini 3.1 Pro nella fascia alta dei 40 — il cavallo di lavoro davanti al modello di punta, un'inversione delle posizioni rispetto al lancio di Gemini 3.1 Pro, quando il suo 57 era in vetta all'indice. È il fatto più importante in assoluto di questo confronto, e arriva da una fonte indipendente, non dal fornitore.
Sotto l'indice, il registro dei benchmark è un guazzabuglio di harness non confrontabili, e leggerlo con ingenuità produce la risposta sbagliata. Il record pubblicato di Gemini 3.1 Pro — 80,6% su SWE-bench Verified, 77,1% su ARC-AGI-2, 94,3% su GPQA Diamond, 2887 Elo su LiveCodeBench Pro — è stato riportato da Google al lancio di febbraio, usa versioni dei benchmark diverse da quelle dei numeri di Flash e non è mai stato riprodotto in modo uniforme. Il 43,6% di Gemini 3.7 Flash su FrontierCode 1.1, il 65,3% su DeepSWE v1.1 e i 1588 Elo nell'arena di sviluppo web sono anch'essi dichiarati dal fornitore sui nuovi harness. Dove i due si sovrappongono in un aggregato indipendente — l'AA Index — vince Flash. Chiunque ti dica «Pro batte Flash su SWE-bench» sta confrontando due versioni di due test diversi senza dirlo.


Il divario nelle capacità video
La funzionalità che rende il confronto sbilanciato è il video. La nuova modalità agentica di comprensione video di Google — annunciata il 1° settembre 2026 — si applica a Gemini 3.7 Flash, Gemini 3.6 Flash e Gemini 3.5 Flash-Lite. Gemini 3.1 Pro non è nella lista. Il modello Flash legge i video secondo la definizione della nuova modalità: il modello decide cosa guardare, a quale velocità, e tramite fotogrammi, audio o trascrizione, caricando solo i segmenti pertinenti, con risparmi dichiarati dal fornitore fino al 66% sui costi e all'88% sui token. Gemini 3.1 Pro tecnicamente accetta input video, ma utilizza il vecchio percorso di campionamento statico e non riceve nessuno dei nuovi strumenti. Per gli utenti del modello di punta, la più recente funzionalità video della famiglia Gemini sta arrivando prima sul modello più economico, e il livello Pro non ha una data annunciata per riceverla.
Velocità e il problema del rischio di anteprima.
La velocità amplifica il divario di prezzo allo stesso modo in cui lo fa in ogni confronto con Gemini 3.7 Flash: circa tre volte la velocità di output su un modello che costa già un terzo del prezzo. Ma la seconda differenza è quella che i team dimenticano di mettere in conto: lo status. Gemini 3.1 Pro è un'anteprima, e le anteprime hanno una breve finestra di preavviso di deprecazione quando arriva il successore. Un carico di lavoro in produzione su un modello in anteprima è un rischio permanente che l'ID del modello cambi, che i prezzi cambino o che le funzionalità si spostino con poco preavviso. Gemini 3.7 Flash è GA — stabile, documentato e non destinato a essere sostituito per un capriccio, anche se la cadenza quasi mensile dei modelli Flash di Google significa che un modello 3.8 Flash potrebbe seguire a breve. Il rischio di deprecazione dell'anteprima di Gemini 3.1 Pro non è ipotetico: è lo stato attuale di un livello il cui successore è in ritardo da tre mesi.
Dove Gemini 3.1 Pro vince ancora
La ragione onesta a favore di 3.1 Pro poggia su tre pilastri, e nessuno di essi è la capacità grezza. Primo, l'endpoint per strumenti personalizzati: Gemini 3.1 Pro è disponibile con una superficie API dedicata a bash/strumenti personalizzati che Flash non eguaglia, e i team che hanno costruito strumenti per agenti su questa base oggi hanno un sistema funzionante. Secondo, i carichi di lavoro ottimizzati: una pipeline già calibrata sui default di dynamic-thinking di 3.1 Pro, sui pattern di cache e sui punteggi eval è un bersaglio mobile, e il passaggio costa tempo di ingegneria reale anche quando la destinazione è più veloce ed economica. Terzo, i compiti specifici in cui il più lungo storico produttivo di Pro non ha ancora un equivalente in Flash — i benchmark della generazione di lancio come GPQA e ARC-AGI-2 su cui Flash non è mai stato misurato. Se il tuo carico di lavoro è uno di questi, "Flash supera Pro nell'indice" non risolve la questione; solo un test sul tuo eval lo fa.
Il verdetto: cosa significa l'acquisizione del livello Flash
La direzione è inequivocabile. Per un nuovo carico di lavoro oggi, Gemini 3.7 Flash è il Gemini predefinito migliore: più economico, più veloce, stabile in GA, più in alto nell'indice indipendente, e riceve per primo la nuova capacità video. Gemini 3.1 Pro conserva una base di utenti reale ma ristretta — utenti di strumenti personalizzati, pipeline ottimizzate, e attività in cui il suo precedente record nei benchmark è ancora valido. Il quadro più ampio è che il livello di punta di Google è in stallo, mentre il suo livello operativo è dove l'azienda sta realmente competendo — e i team che ancora pagano prezzi da livello di punta per 3.1 Pro stanno pagando per uno status che l'azienda stessa ha smesso di difendere.

Per i team che vogliono migrare senza un progetto, il passaggio da un modello Gemini all'altro è un cambio di nome del modello, non un'integrazione. Gemini 3.1 Pro è servito su OrcaRouter al prezzo di listino di $2.00 / $12.00, applicato senza markup, insieme a Gemini 3.6 Flash e al resto del livello Gemini instradabile dietro un'unica chiave — quindi un workload può instradare una parte del traffico verso un modello Flash, tenere 3.1 Pro come fallback per le attività in cui è ancora lui a vincere, e lasciare che il failover automatico assorba il rischio che uno dei due modelli Google cambi. Gemini 3.7 Flash, da parte sua, è disponibile tramite l'API di Google e diverse piattaforme di terze parti. Il DSL di routing e la fusione dei modelli sono esattamente ciò che utilizzeresti per fare un confronto alla pari tra i due modelli Gemini sulla tua eval prima di fare il passaggio. La scelta verso cui la gamma ti spinge è chiara: punta sul livello Flash come default e tieni Pro solo per i casi circoscritti in cui dimostra di meritare il suo sovrapprezzo.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
