
Gemini 4 vs Gemini 4 Argon: Uno di questi due modelli non esiste
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 221 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 110 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Google ha annunciato un modello frontier il 30 settembre 2026. Non è quello che la maggior parte delle persone immagina. Gemini 4 Argon è un nome reale legato a un annuncio reale, a una tariffa reale e a una serie di benchmark pubblicati. Gemini 4 è il prefisso di famiglia sotto cui quel nome si colloca — e, in base a quanto risulta oggi, non è un prodotto. Non esiste un ID modello, né un endpoint, né una model card, né un prezzo per milione di token. Quindi questo non è un confronto tra due sistemi. È il confronto tra un modello annunciato e un nome che molte persone, incluso questo blog, trattano come un modello da mesi.
Quella distinzione ha un valore economico. Gemini 4 Argon prevede una tariffa introduttiva di $2 per milione di token di input e $10 per milione di token di output, per poi passare a $4 e $20 dopo un periodo introduttivo che Google non ha definito. Sono cifre dichiarate dal fornitore nel post di annuncio di Google stesso. Se stai predisponendo il budget per una migrazione al livello pro nel 2026, $2/$10 è il numero su cui puoi basare la pianificazione, e "qualunque cosa costi Gemini 4" non è affatto un numero — non è stato pubblicato nulla al riguardo, perché non c'è ancora nulla da pubblicare.
Che cos'è realmente "Gemini 4" ufficialmente
Cerca una pagina prodotto di Gemini 4 e troverai un solo documento: il post di Google stesso intitolato Gemini 4 Argon: la nostra prossima era di intelligenza di frontiera, pubblicato il 30 settembre 2026, alle 20:00 UTC e attribuito a Koray Kavukcuoglu. Leggilo con attenzione e "Gemini 4" non compare mai come modello a sé stante. Ogni affermazione sulle capacità, ogni prezzo e ogni benchmark nel post è legato al nome completo. La forma nuda compare solo dove il nome è usato come prefisso — "le capacità di Gemini 4 Argon" — che è lo stesso slot grammaticale che occupava Gemini 3 prima che Gemini 3 Pro, Gemini 3.1 Pro e quattro varianti Flash diventassero ciascuno un'entità a sé.
La storia generazionale supporta questa lettura. La call sugli utili di Alphabet del 23 luglio ha messo nero su bianco questa impostazione: Sundar Pichai ha affermato che la prossima generazione di modelli di frontiera «richiede modelli base molto più grandi», e ha indicato il coding e il coding agentico come le aree da migliorare. Il 23 settembre, a un evento organizzato da The Information, Kavukcuoglu ha dichiarato che il pre-training era terminato e che il modello era nelle prime fasi di post-training, che il team aveva visto i risultati e che sperava di rilasciare una versione post-training preliminare ben prima della fine dell'anno. Business Insider ha descritto l'annuncio del 30 settembre come il primo modello della serie 4 — una serie, che è l'indizio. Tutte e tre sono dichiarazioni del fornitore sul lavoro del fornitore stesso, riportate da terzi.
Che cosa significa in pratica: "Gemini 4" è la generazione, e la generazione ha un solo membro con nome. La struttura a livelli che Google propone da due anni — una Pro in cima, una Flash sotto, una variante Cyber accessibile solo tramite lo stesso programma — non è ancora stata popolata per la generazione 4. Un "Gemini 4 Pro" o un "Gemini 4 Ultra" è un'inferenza basata sullo schema di denominazione di Google stesso, non una fuga di notizie né un elemento della roadmap. Considera qualsiasi articolo che confronti Gemini 4 Argon con "Gemini 4" come un confronto tra un modello e il suo stesso cognome.
Cos'è davvero Gemini 4 Argon
Gemini 4 Argon è stato annunciato il 30 settembre 2026 sul blog di Google, e quella sera stessa Demis Hassabis ha annunciato lo stesso modello, con parole sue, su X. Il rilascio è a fasi, e solo la prima ha una data: Argon arriva per primi ai difensori informatici verificati tramite il Fairwind Program, il livello accessibile solo su richiesta che Google ha creato per i governi e le autorità nazionali di cybersicurezza, gli operatori di infrastrutture critiche e le piattaforme tecnologiche di base. Il post di Hassabis stesso diceva che l'azienda lo stava distribuendo «a partire da oggi con i governi e i difensori informatici di fiducia tramite il nostro Fairwind Program». Dopodiché, la formulazione di Google mette al posto successivo i clienti con API a pagamento e gli abbonati a Google AI Ultra, poi sviluppatori, imprese e consumatori. Nessuna di quelle fasi successive riporta una data.
Ciò che non è in quell'elenco è la parte che conta per chiunque pianifichi un lavoro: una data di disponibilità generale, un ID modello, una finestra di contesto, un numero di parametri, una model card o una system card. Google ha pubblicato un limite di output, non una finestra di contesto. È di 1 milione di token, in aumento rispetto al tetto di 64K usato dalla precedente famiglia Gemini, e Google lo definisce ai vertici del settore. Un aumento di un ordine di grandezza nella quantità che una singola chiamata può restituire è un vero cambiamento per le lunghe traiettorie degli agenti e per il rendering in un'unica passata, ed è l'unico dato tecnico nell'annuncio privo di ambiguità.

Il set di benchmark è ampio e del tutto non replicato. Google riporta DeepSWE v1.1 al 77,9%, il primo posto su AutomationBench al 51,3%, LVBench al 91,7%, un pari merito per il primo posto su CWE-bench v1 al 68%, risultati di vertice sul Vals Index, sul suo Vals Finance Agent v2, sul Legal Agent Benchmark di Harvey e la prestazione più forte sul benchmark Indirect Prompt Injection di Gray Swan. Ognuno di questi è un dato del fornitore stesso, pubblicato dal fornitore, e nessuno è stato riprodotto in modo indipendente. Un altro insieme di cifre diffuso a settembre, presentato come benchmark previsti di Gemini 4 con un punteggio AutomationBench del 48,7%, si è rivelato riciclato da un lancio non correlato e non è una pubblicazione di Google. Il dato effettivo riportato da Google per AutomationBench è 51,3%, un numero diverso proveniente da una fonte diversa.
Il tabellone che i due nomi producono
Metti i due fianco a fianco sulle sei dimensioni su cui questo abbinamento verte realmente, e la forma del problema è ovvia:
• Esiste come prodotto con un nome — Gemini 4: no. Gemini 4 Argon: sì, annunciato il 2026-09-30.
• Richiamabile oggi — Gemini 4: non esiste alcun ID modello né endpoint. Gemini 4 Argon: non esiste alcun ID modello né endpoint nemmeno in questo caso; l'accesso è vincolato a Fairwind e solo su richiesta.
• Prezzo — Gemini 4: nessuno pubblicato. Gemini 4 Argon: $2 / $10 per milione di token in fase introduttiva, poi $4 / $20. Dato dichiarato dal fornitore.
• Output massimo — Gemini 4: nessuno pubblicato. Gemini 4 Argon: 1 milione di token, rispetto ai 64K della generazione precedente. Dichiarato dal fornitore.
• Indice di intelligenza — Gemini 4: non valutato. Gemini 4 Argon: 53 sull'Intelligence Index di Artificial Analysis con sforzo di ragionamento elevato, con un costo di 1,99 $ per attività dell'indice. Secondo Artificial Analysis.
• Posizione indipendente in classifica — Gemini 4: non classificato. Gemini 4 Argon: primo sul Vals Index al 68,90% con un costo di $15,68 per test, su 13,40 miliardi di token di input e 142,01 milioni di token di output. Secondo Vals.

Leggi insieme le ultime due righe e ottieni l'unico disaccordo davvero interessante di questo confronto. Artificial Analysis colloca Gemini 4 Argon a 53, allo stesso livello di Claude Fable 5.1 e GPT-6 Astra, e cinque punti dietro Claude Opus 5.5 a 58. Vals lo mette al primo posto in assoluto. Entrambi sono indipendenti, entrambi misurano qualcosa di reale, e stanno misurando cose diverse: l'indice di AA pondera un insieme fisso di dieci valutazioni tra coding, ragionamento e lavoro intellettuale, mentre il Vals Index pondera quattro settori in base alla loro quota del valore aggiunto dell'economia statunitense. Un modello può primeggiare in uno e non nell'altro senza che nessuna delle due classifiche sia sbagliata.
C'è una seconda cosa da notare nella riga di Vals, ed è quella che dovrebbe interessare a un acquirente enterprise. Vals registra il tariffario di Argon come $4/$20 — il prezzo successivo a quello introduttivo — mentre l'annuncio di Google stesso indica $2/$10. Se il costo di $15.68 per test è stato calcolato a $4/$20, allora un acquirente che accetta la tariffa introduttiva vedrebbe un numero sostanzialmente inferiore per lo stesso lavoro, e un acquirente che perde la finestra introduttiva no. Google non ha detto quanto dura quella finestra. Quella singola variabile indefinita sposta la cifra più rilevante per le decisioni dell'intero lancio.
Cosa puoi chiamare oggi
Niente sotto il nome Gemini 4, e questo include noi. Abbiamo controllato il catalogo: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro e google/gemini-3.8-flash-cyber restituiscono tutti "model not found", e lo stesso vale per ogni altra piattaforma di routing, perché nessuna di esse ha un ID di modello da instradare. La lista dei modelli della stessa Gemini API — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — non contiene alcuna voce Gemini 4 di alcun tipo. Finché Argon non supera la coda Fairwind e ottiene un identificatore, non esiste alcun prezzo fatturato né alcun endpoint da nessuna parte.
Il tier pro live di Google è un'altra storia. Gemini 3.1 Pro Preview è nel nostro catalogo dal 19 febbraio 2026 a 2,00 $ di input e 12,00 $ di output per milione di token, con una finestra di contesto di 1.048.576 token, un output massimo di 65.536 token e input multimodale su testo, immagine, audio, video e file. A otto mesi di distanza, è ancora etichettato Preview nell'elenco dei modelli della stessa Gemini API, il che è di per sé l'argomento per cui Argon esiste. Superati i 200.000 token di input, la tariffa raddoppia a 4 $ e 18 $.

Quello è l'unico punto in cui questo confronto ha una risposta operativa. Gemini 3.1 Pro Preview è attivo dietro lo stesso endpoint compatibile con OpenAI degli altri oltre 200 modelli che instradiamo, al prezzo di listino del provider e senza ricarichi — quindi quando Google pubblicherà un identificatore e una tariffa fatturata per Gemini 4 Argon, e poi un fratello di livello Pro se lo schema di denominazione regge, il pass-through fa sì che quelle tariffe compaiano dalla nostra parte lo stesso giorno in cui compaiono su Google. Nel frattempo, se volete misurare il livello pro invece di limitarvi a leggerne, quello è il modello da misurare. Se volete provare un modello il cui comportamento è ancora in fase di caratterizzazione, il failover automatico tra provider è il modo per farlo senza puntare un percorso di produzione su una preview che Google stessa descrive come in fase di introduzione graduale.
Un'avvertenza che va detta insieme al prezzo
Bloomberg ha riportato il 30 settembre che alcuni dipendenti Google con accesso diretto ad Argon affermano che se la cava meno bene nel lavoro reale di quanto implichino i punteggi di benchmark, con il design front-end citato specificamente e due dipendenti che usano il termine "benchmaxxing". Google contesta la caratterizzazione. Vale la pena tenerlo accanto all'elenco dei benchmark proprio perché l'elenco dei benchmark è l'intera base di prove pubbliche per questo modello. Quando ci sono i numeri di un solo fornitore e non c'è modo di riprodurli, un rapporto secondo cui i numeri non raccontano tutta la storia non è una nota a piè di pagina. È metà delle prove.
Chi dovrebbe scegliere cosa
Se stai scegliendo tra questi due nomi, in realtà non stai ancora scegliendo nulla, e il consiglio onesto è di pianificare tenendo conto di questo anziché di un confronto.
• Se ti serve un modello Google di fascia pro in produzione questo trimestre, la risposta è Gemini 3.1 Pro Preview. È invocabile, ha un prezzo definito, ed è il livello di cui Argon viene posizionato come sostituto. Aspettare Argon significa aspettare in una coda a cui non puoi unirti.
• Se fai parte del pubblico per cui Argon è ad accesso riservato — un'autorità governativa per la cybersicurezza, un operatore di infrastrutture critiche, un manutentore di software — il Fairwind Program è l'unica via, e la specificità di tale accesso riservato è un fatto riguardante le capacità del modello, non marketing. Google lo ha addestrato per l'individuazione e la correzione delle vulnerabilità e non lo ha distribuito in generale.
• Se stai pianificando il budget per una migrazione nel 2026, usa $2/$10 per la finestra introduttiva e $4/$20 per tutto ciò che viene dopo. Non usare un'unica cifra ponderata e non usare il costo per test di $15,68 di Vals senza verificare con quale listino tariffario è stato calcolato.
• Se stai aspettando "Gemini 4", aspetta un ID di modello. Il nome ne otterrà uno — lo schema di denominazione di Google attraverso tre generazioni dice che il livello Pro e il livello Flash ottengono i propri identificatori — ma lo schema non è un annuncio, e non è stato pubblicato nulla su cosa sarebbe un Gemini 4 senza qualificatori, quanto costerebbe o cosa farebbe.
Il punto più ampio è uno che questo blog ha già dovuto sostenere e che presumibilmente dovrà sostenere di nuovo: un nome di generazione non è un modello. Gemini 4 Argon è l'unica cosa dietro cui Google ha messo un nome, un prezzo, un set di benchmark e un piano di accesso. Il resto della famiglia è uno schema, e uno schema è qualcosa che puoi prevedere ma non qualcosa a cui puoi dare un nome.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
