
Claude Haiku 5.5 vs Gemini 3.6 Flash: costo per risposta 7,5 volte superiore, nove punti in meno nel modello
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Claude Haiku 5.5 e Gemini 3.6 Flash si collocano nello stesso livello delle rispettive gamme — quello piccolo, veloce ed economico — ed è qui che finisce la somiglianza. Su Artificial Analysis Intelligence Index v4.3.2, Claude Haiku 5.5 ottiene 43,40 nella sua configurazione Max contro 33,98 di Gemini 3.6 Flash nella sua configurazione High. Nella stessa esecuzione, una singola attività dell'Indice completata costa 0,21 $ su Claude Haiku 5.5 e 1,60 $ su Gemini 3.6 Flash.
Leggi quella coppia insieme, perché ciascuno dei due da solo trae in inganno. Il modello più economico non è marginalmente più economico; è 7,5 volte più economico per attività completata. E il modello che sta battendo non è marginalmente più debole; è più debole di 9,42 punti indice, il che su una classifica di 182 modelli è la distanza tra il quartile superiore e la metà.
Entrambi i fatti provengono dalla stessa esecuzione indipendente, il che conta perché le schede dei fornitori qui non ti dicono né l'uno né l'altro. Anthropic ha lanciato Claude Haiku 5.5 il 7 ottobre 2026; Google ha rilasciato Gemini 3.6 Flash il 21 luglio 2026. I tre mesi tra loro sono la parte interessante.
Le due carte, fianco a fianco
Per milione di token in dollari statunitensi. Le tariffe di Anthropic e Google provengono dalla rispettiva documentazione sui prezzi; le righe condivise sono Artificial Analysis Intelligence Index v4.3.2. Memorizzato nella cache il 2026-10-08.

• Input — Claude Haiku 5.5 $0,10 fino a 100.000 token e $0,50 oltre; Gemini 3.6 Flash $0,75 fisso oggi, che salirà a $1,50 il 1º gennaio 2027.
• Output — Claude Haiku 5.5 $0,50 fino a 100.000 token e $2,50 oltre; Gemini 3.6 Flash $3,75 fissi oggi, che salgono a $7,50 alla stessa data.
• Input in cache — Claude Haiku 5.5 $0,01 e $0,05; Gemini 3.6 Flash $0,075, più un costo di archiviazione di $0,50 per milione di token all'ora.
• Contesto e limite di output — 1M token per entrambi. Claude Haiku 5.5 limita una risposta a 128.000 token; Gemini 3.6 Flash a 65.536.
• Modalità — Claude Haiku 5.5 accetta testo e immagini. Gemini 3.6 Flash accetta testo, immagini, video, audio e file. Questa è l'unica riga in cui il fronte di Google è inequivocabilmente in vantaggio, e per una pipeline di comprensione dei media può decidere l'intera questione.
• Punteggio indipendente — 43.40 per Claude Haiku 5.5 (Max) contro 33.98 per Gemini 3.6 Flash (High).
• Costo per attività completata — 0,21 $ contro 1,60 $, sulla stessa esecuzione di valutazione.

Perché il numero da usare è per attività, non per token
Il moltiplicatore della rate card sembra già attestarsi a 7,5 sull'input e 7,5 sull'output, quindi la cifra per attività non è una sorpresa qui — ma vale la pena mostrare perché i due modelli si collocano nello stesso punto su una misura e sono così distanti sull'altra, perché la stessa aritmetica gioca nella direzione opposta negli altri confronti di questo batch.
Gemini 3.6 Flash è il meno prolisso dei due. Emette 41.606 token di output per attività dell'Intelligence Index — 20.061 di ragionamento e 21.545 di risposta — contro i 162.164 di Claude Haiku 5.5, divisi in 129.047 di ragionamento e 33.118 di risposta. Il modello di Anthropic spende quasi quattro volte tanti token per svolgere lo stesso lavoro, ed è quello il cui tasso di output è un settimo di quello di Google, quindi il divario dei token e quello del tasso si moltiplicano anziché annullarsi.
Quella combinazione — tariffa economica moltiplicata per un uso intenso — è la descrizione onesta dell'economia di Claude Haiku 5.5, e il post di lancio di Anthropic stessa riconosce l'altro lato della medaglia: il modello è «particolarmente conveniente se usato per attività con prompt fino a 100.000 token, che costituiscono circa il 90% delle richieste al nostro precedente modello Haiku». Oltre i 100.000 token, la tariffa di input diventa $0,50 e quella di output $2,50, a quel punto il multiplo rispetto a Gemini 3.6 Flash si riduce a circa 1,5x.
Che cosa ha fatto il tier di Google mentre questo confronto restava immobile
Qui è il punto in cui il pezzo smette di essere un confronto tra due modelli e diventa un avvertimento su quale Gemini stai effettivamente confrontando.
Google ha mantenuto il prezzo di Flash fisso attraverso tre generazioni. Gemini 3.6 Flash, Gemini 3.7 Flash e Gemini 3.8 Flash sono tutti elencati a $0.75 input e $3.75 output nella documentazione dei prezzi di Google, con lo stesso costo cache di $0.075 e lo stesso aumento del 1° gennaio 2027 a $1.50 e $7.50. La scheda di Google per la linea 3.6 lo descrive come "il nostro modello Flash della generazione precedente", che sono le parole del fornitore stesso.
Ciò che è cambiato è stato il punteggio, non il prezzo. Nella classifica indipendente, Gemini 3.6 Flash ottiene 33,98, Gemini 3.7 Flash 39,06 e Gemini 3.8 Flash 40,93 — tutti nella loro configurazione pubblicata a intensità massima. Nove punti indice sono arrivati all'interno della fascia Flash di Google in sei settimane, senza alcuna variazione della tariffa.
La conseguenza per chiunque sia nel mezzo di una valutazione è concreta: se hai confrontato questo scontro tre settimane fa con Gemini 3.7 Flash, il tuo risultato è obsoleto, e se lo confronti con Gemini 3.8 Flash, il divario rispetto a Claude Haiku 5.5 si riduce a 2,47 punti. Gemini 3.6 Flash è la versione di questo confronto che lusinga di più Anthropic, ed è anche la versione che Google è più lontana dal vendere.
Artificial Analysis segnala la voce 3.6 come deprecata. La documentazione sui prezzi di Google pubblica ancora la tariffa, e il suo elenco di modelli rimanda ancora a una sezione 3.6, quindi la lettura onesta non è "scomparsa" ma "superata due volte all'interno della propria famiglia in dieci settimane" — e questo è un fatto su quanto rapidamente si muova questa fascia, non una ragione per saltare il confronto.
Per chi decide davvero questo
C'è un vero argomento a favore di Gemini 3.6 Flash, e non è il punteggio.
Se nel prompt servono audio o video, Claude Haiku 5.5 non è in grado di gestirli affatto: legge testo e immagini e nient'altro. Gemini 3.6 Flash legge testo, immagini, video, audio e file, e il nostro catalogo lo registra a una velocità misurata di 582 token di output al secondo con una mediana di 4,1 secondi al primo token nell'ultima settimana, il che lo rende un modello veloce anche per gli standard di Flash. Per una pipeline di comprensione dei media l'elenco delle modalità è l'intera decisione e il divario nell'indice è una nota a piè di pagina.
Se il tuo lavoro è fatto di testo e immagini, l'aritmetica non è abbastanza vicina per discuterne. Con una miscela 7:2:1 a prevalenza di input — la forma che ha la maggior parte del traffico di produzione — Claude Haiku 5.5 arriva a $0.077 per milione di token contro $0.63 di Gemini 3.6 Flash. Su un milione di token misti al giorno, sono 77 centesimi contro $6.30, e il secondo numero peggiora il 1° gennaio 2027 mentre il primo non si muove.
Il salto dei 100.000 token è l'unica condizione che ribalta la situazione. Una pipeline di retrieval o per documenti lunghi che assembla abitualmente prompt da 150.000 token paga il tier da $0,50/$2,50 di Anthropic sull'intera richiesta, e a quel punto i due modelli sono entro 1,5x l'uno dall'altro sul prezzo, mentre Gemini 3.6 Flash vince ancora sulla modalità e sul dato del 91,8% che Google pubblica per il retrieval multi-needle a una media di 128k. Si tratta di un dato riportato dal fornitore e non riprodotto, e rientra esattamente in quella cornice.

Chiamare entrambi, o chiamarne uno
Gemini 3.6 Flash è oggi nel catalogo di OrcaRouter su google/gemini-3.6-flash, al prezzo di listino di Google con 0% di ricarico — $0,75 e $3,75 con una lettura cache da $0,075, applicati esattamente come li addebita il provider. Questo conta per questo modello in particolare perché l'aumento del 1° gennaio di Google è una variazione tariffaria, e un catalogo pass-through la recepisce il giorno stesso in cui avviene, anziché al successivo rinnovo contrattuale. Una sola chiave API e una sola chiamata SDK sia per questo modello sia per uno qualsiasi degli oltre 200 altri sul catalogo, quindi un A/B tra una variante Google e una variante Anthropic è un cambio della stringa del modello con failover automatico sotto, anziché una seconda integrazione.
Claude Haiku 5.5 non è nel catalogo. Il modello di Anthropic è raggiungibile tramite l'API di Anthropic stessa e tramite AWS, Google Cloud e Microsoft Azure, e questa è tutta la risposta onesta. Quello che invece offriamo di quella gamma è Claude Sonnet 5.5 e Claude Opus 5.5 — il che rende il percorso di escalation da una chiamata di classificazione economica fino a una chiamata agentica di fascia media una decisione di routing anziché un progetto.
Il che rende il verdetto abbastanza semplice da enunciare chiaramente. Per lavori su testo e immagini con prompt brevi, Claude Haiku 5.5 vince su ogni asse tranne che sul tetto di risposta. Per qualsiasi cosa con audio o video, Gemini 3.6 Flash è l'unico dei due che possa rispondere del tutto — e se hai intenzione di pagare la tariffa di Google per quella capacità, chiediti per quale Gemini la stai pagando, perché su questo livello puoi ottenere nove punti indice in più per gli stessi soldi da un modello gemello più recente.
Un'unica API per oltre 200 modelli, un'unica chiave, failover automatico sotto, così un A/B tra un ramo Google e un ramo Anthropic è un cambio di stringa del modello anziché una seconda integrazione.
Confrontati in questo articolo2
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
