Una scheda titolo per il confronto tra Gemini 3.7 Flash e Grok 4.6, che mostra un'etichetta di prezzo con il 50% di sconto e un fulmine sul lato Gemini 3.7 Flash, di fronte a uno scudo con un segno di spunta sul lato Grok 4.6.
Guides & Insights

Gemini 3.7 Flash vs Grok 4.6: la guerra dei prezzi di Google contro l'agente di auto-verifica di SpaceXAI

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Tre settimane dopo il sostanziale flop di Gemini 3.6 Flash, Go​ogle ha dimezzato il prezzo e ha lanciato Gemini 3.7 Flash — una mossa che la maggior parte delle testate ha letto come un attacco diretto a Grok 4.6, il modello di punta ottimizzato per agenti che SpaceXAI aveva lanciato il giorno prima a $2 e $6. Il tempismo è la notizia: due modelli vicini alla frontiera, a un giorno di distanza, entrambi rivolti allo stesso acquirente — un team che vuole codifica agentica senza pagare prezzi di frontiera — e con prezzi basati su filosofie opposte. Go​ogle sta comprando la risposta con una promozione di cinque mesi. SpaceXAI sta vendendo fiducia per task a un prezzo di listino fisso.

Grok 4.6, rilasciato il 12 agosto 2026, è l'affinamento di SpaceXAI della sua base Grok 4.5 da 1,5 trilioni di parametri, progettato per agenti di lunga durata che verificano il completamento dei propri sottocompiti, con una finestra di contesto di 500K, input di testo e immagini, e una tariffa di $2/$6 che raddoppia oltre i 200K token di input. Gemini 3.7 Flash, rilasciato il 13 agosto 2026, è l'affinamento algoritmico di Go​ogle di Gemini 3.6 Flash — contesto da 1M, input multimodale inclusi video e audio, e una tariffa promozionale di $0.75/$3.75 che raddoppia a $1.50/$7.50 il 1° gennaio 2027. Nell'indipendente Artificial Analysis Intelligence Index, Grok 4.6 si attesta a 61, un netto passo avanti rispetto alle prime rilevazioni di circa 56 per Gemini 3.7 Flash.

La guerra dei prezzi, una riga per dimensione

Prezzo per 1M di input — Gemini 3.7 Flash $0.75 (promo) vs Grok 4.6 $2.00. Google costa oltre il 60% in meno.

Prezzo per 1M di output — Gemini 3.7 Flash $3,75 (prezzo di lancio) vs Grok 4.6 $6,00.

Dopo il 1° gennaio 2027Gemini raddoppia a $1.50/$7.50, mentre Grok resta invariato a $2/$6.

Finestra di contesto — Gemini 3.7 Flash 1M vs Grok 4.6 500K.

Fatturazione per input lunghi — Gemini applica una tariffa fissa su tutta la sua finestra; Grok raddoppia arrivando a $4/$12 con input pari o superiori a 200K.

Token di ragionamento — Gemini li fattura come output; il costo di Grok è compreso in un importo di ~$0.84 per attività, misurato in modo indipendente.

Il succo in una riga: Gemini 3.7 Flash oggi costa meno su ogni voce del listino, ma gran parte di quel vantaggio svanisce il 1° gennaio. Grok 4.6 costa ad agosto quanto costerà a marzo.

A comparison scoreboard for Gemini 3.7 Flash and Grok 4.6: Gemini at AA Index ~56, $0.75/$3.75 intro pricing, 1M context, Google-reported GDPVal-AA v2 of 1,525 and per-task cost not yet measured, versus Grok 4.6 at AA Index 61, $2/$6, 500K context, GDPVal-AA v2 of 1,753 and about $0.84 per task per Artificial Analysis, both proprietary.

Dove sono finiti i soldi di Gemini 3.7 Flash

Le cifre stesse di {{1}}Go​ogle{{/1}} riportano salti notevoli per Gemini 3.7 Flash rispetto a 3.6 Flash: 65,3% su DeepSWE v1.1 (in aumento dal 49,0%), 43,6% su FrontierCode 1.1 Main (in aumento dal 34,4%), 85,8% su Terminal-bench 2.1 (in aumento dal 78,0%) e un Elo WebDev Arena di 1588 (in aumento da 1538). Sono numeri dichiarati dal fornitore e non riprodotti — il tipo di dato che misura una traiettoria, non un verdetto tra fornitori. Ma la traiettoria è il punto: le correzioni sono arrivate tre settimane dopo un lancio che i recensori avevano ampiamente bocciato, il che ti dice che {{2}}Go​ogle{{/2}} tratta il livello Flash come campo di battaglia, non come ammiraglia.

L'altra cosa che la promozione di Go​ogle fa è comprimere la finestra di acquisto. A $0.75/$3.75 il modello è abbastanza economico da essere testato in volume; a $1.50/$7.50 è ancora competitivo ma non è più un'arma della guerra dei prezzi. Qualsiasi team di produzione che lo adotti nella finestra di introduzione dovrebbe rivalutare la propria economia a dicembre, non dando per scontato che il numero si muova con loro.

Dove sono finiti i soldi di Grok 4.6

La proposta di Grok 4.6 è diversa: non token più economici, ma meno token sprecati. È stato addestrato a verificarsi da solo — a controllare che una sottoattività sia effettivamente completata prima di passare oltre — e una misurazione indipendente conferma l'effetto: Artificial Analysis stima il suo costo a circa $0,84 per attività, con un GDPVal-AA v2 di 1.753 e un Intelligence Index di 61. Queste sono cifre di terze parti e sono il dato più forte in questo confronto, perché catturano ciò che il prezzo per token non coglie: un modello che impiega meno passaggi per completare un lavoro è più conveniente per lavoro completato anche a un prezzo per token più alto.

Il compromesso è proprio dove il modello più economico ha margine di miglioramento. Il contesto da 500K di Grok 4.6 è la metà di quello da 1M di Gemini 3.7 Flash, e la sua tariffa di $2/$6 raddoppia oltre i 200K di input — quindi i carichi di lavoro con contesto lungo e input elevato sono esattamente il punto in cui il prezzo di listino di Grok 4.6 smette di essere competitivo con la tariffa promozionale di Gemini.

L'economia per attività

Al prezzo di lancio, la tariffa mista di Gemini 3.7 Flash con una ripartizione 80/20 input/output è di circa $1,35 per milione di token; quella di Grok 4.6 allo stesso rapporto è di $2,80 per milione prima della penalità per input lunghi. Su carta il modello Go​ogle sembra il vincitore in termini di volume, e di larga misura. La complicazione è che i token di pensiero di Gemini vengono fatturati come output, le sue affermazioni sui benchmark risalgono a una settimana fa, e la sua efficienza per attività non è ancora stata misurata in modo indipendente — mentre quella di Grok 4.6 sì. Token economici più passaggi sprecati possono costare più di token costosi che portano a termine il compito, e in questo confronto una delle due parti ha dati su questa questione e l'altra no.

Scommettere sul nuovo modello senza scommettere sulla pipeline

Grok 4.6 è su OrcaRouter al prezzo di listino di $2/$6 di SpaceXAI con ricarico 0%, incluso lo scaglione 2x oltre 200K, che la pagina del modello recupera in tempo reale dallo strato di routing. Gemini 3.7 Flash ha un giorno di vita ed è sull'API di Go​ogle stessa; il suo predecessore Gemini 3.6 Flash è su OrcaRouter al prezzo di listino di Go​ogle.

The OrcaRouter model page for grok/grok-4.6, showing the New and Featured badges, the $2.00 per million input and $6.00 per million output pricing, a 500K-token context window, and the released August 12, 2026 label.The OrcaRouter model page for google/gemini-3.6-flash, showing the $1.50 per million input and $7.50 per million output pricing and the 1M-token context window.

Se la domanda che questo confronto sta davvero ponendo è "dovrei scommettere la mia pipeline di agenti sul nuovo modello economico", il livello di routing è la copertura: una regola di failover che fa girare l'agente su Grok 4.6 oggi e passa a Gemini 3.7 Flash il giorno in cui arriva, oppure un pannello di fusione in cui entrambi rispondono e un giudice li riconcilia — il tipo di configurazione per cui esiste il DSL di routing, e una che non richiede di scegliere da che parte stare prima che le prove siano disponibili.

La lettura onesta

Se vuoi il token più economico oggi e ti fidi dei tempi di consegna di tre settimane, Gemini 3.7 Flash è la scommessa aggressiva: la guerra dei prezzi è reale, i guadagni nei benchmark sono riportati e la finestra di lancio è un vero sconto. Se vuoi un modello la cui efficienza degli agenti è misurata in modo indipendente, il cui prezzo non si muove a gennaio e il cui ciclo di auto-verifica è progettato per lavori di lunga durata, Grok 4.6 è la scelta conservativa, e i dati AA gli danno un vantaggio sul costo per attività completata. Da un lato c'è una vendita con conto alla rovescia; dall'altro un prezzo con uno storico affidabile. Entrambe le opzioni sono difendibili — ed è questo che rende il confronto reale, non una formalità.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube