
Claude Haiku 5.5 vs Gemini 3.8 Flash: Due punti di indice, sei volte il costo per attività
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Claude Haiku 5.5 e Gemini 3.8 Flash sono più vicini in capacità misurata di qualsiasi altra coppia in questa fascia di prezzo — 43,40 contro 40,93 sull'Artificial Analysis Intelligence Index v4.3.2, ed entrambi si collocano tra i primi cinquanta di una classifica di 225 modelli. Ciò che li distingue è quanto costa uno di quei punti dell'indice. Sulla stessa misurazione indipendente, un'attività completata dell'Intelligence Index costa $0,21 su Claude Haiku 5.5 e $1,24 su Gemini 3.8 Flash.
Si tratta di un divario di sei volte per una differenza di punteggio di due punti e mezzo, ed è il numero che dovrebbe decidere questo confronto. Tutto il resto — le tariffe di listino, l'elenco delle modalità, le scadenze associate ai prezzi di Google — è una discussione sui margini.
Entrambi i modelli, sui numeri che contano
Per milione di token in dollari USA, dalla documentazione ufficiale sui prezzi di Anthropic e Google, con le misurazioni indipendenti attribuite ad Artificial Analysis. Cache del 2026-10-08.

• Input — Claude Haiku 5.5 $0.10 fino a 100.000 token e $0.50 oltre; Gemini 3.8 Flash $0.75 fisso, che sale a $1.50 il 1º gennaio 2027.
• Output — Claude Haiku 5.5 $0,50 fino a 100.000 token e $2,50 oltre; Gemini 3.8 Flash $3,75 fisso, che sale a $7,50 alla stessa data.
• Input in cache — Claude Haiku 5.5 $0,01 e $0,05; Gemini 3.8 Flash $0,075, più un costo di archiviazione di $0,50 per milione di token all'ora.
• Contesto — 1M token per entrambi. Output massimo — 128.000 token per Claude Haiku 5.5 contro 65.536 per Gemini 3.8 Flash.
• Modalità di input — testo e immagini per Claude Haiku 5.5; testo, immagini, parlato e video per Gemini 3.8 Flash. Questa è l'unica riga in cui l'elenco di Google è strettamente più lungo.
• Punteggio indipendente — 43,40 per Claude Haiku 5.5 (Max) contro 40,93 per Gemini 3 Flash (High), su Intelligence Index v4.3.2.
• Costo indipendente per attività — 0,21 $ contro 1,24 $ sulla stessa scheda.
• Velocità — 241,9 token di output al secondo contro 125,2, entrambi misurati da Artificial Analysis.
Da dove proviene la cifra delle sei volte
Il divario nel costo per attività è più grande del divario nel prezzo di listino, ed è questa la parte interessante, perché significa che il tariffario da solo non basta a spiegarlo.
L'aritmetica dei prezzi di listino è abbastanza semplice: $0,10 contro $0,75 sull'input è sette volte e mezzo più economico, e $0,50 contro $3,75 sull'output è lo stesso rapporto. Se entrambi i modelli generassero gli stessi token per lo stesso lavoro, quel rapporto si ripercuoterebbe direttamente sulla fattura.
Non si trasferisce, ed entrambi gli effetti vanno a favore di Google. Claude Haiku 5.5 è verboso in un modo che il suo stesso fornitore riconosce: Artificial Analysis ha registrato 440 milioni di token di output mentre eseguiva l'Index, contro una mediana di 100 milioni, e definisce il modello molto verboso. Gemini 3.8 Flash ha generato 170 milioni rispetto a una mediana di 81 milioni — anch'esso segnalato come verboso, ma con un terzo del numero di token. La documentazione di Anthropic stessa aggiunge il secondo effetto: Claude Haiku 5.5 usa il tokenizer più recente condiviso con Claude 4.7 e versioni successive, perciò lo stesso testo viene conteggiato come circa il 30% di token in più rispetto al modello che sostituisce.
Mettendo insieme il tutto, la versione onesta dell'affermazione sui prezzi è questa: un vantaggio di dieci a uno sulla tariffa di input e un vantaggio di sette e mezzo a uno sulla tariffa di output, in parte eroso da un modello che scrive più token per risposta, arrivando a un vantaggio di sei a uno nella misurazione che addebita l'intero lavoro. Resta comunque una vittoria schiacciante, anche se più contenuta di quanto suggerisca il listino.
Il prezzo di Google riporta una data.
La cosa più utile in assoluto sulla pagina dei prezzi di Google è una frase che la maggior parte delle tabelle di confronto omette.
Gemini 3.8 Flash è indicato a $0.75 per l'input e $3.75 per l'output "fino al 31 dicembre 2026", e a $1.50 e $7.50 "a partire dal 1º gennaio 2027". L'input in cache passa da $0.075 a $0.15 alla stessa data. Si tratta di una tariffa introduttiva con una scadenza stampata accanto, a circa undici settimane dal momento in cui scriviamo.
Nella scheda di Anthropic non c'è nulla che si legga in quel modo. Le tariffe di Claude Haiku 5.5 sono indicate come tariffe, con una struttura a due livelli legata alla lunghezza del prompt anziché a un calendario, e un impegno al ritiro non prima del 7 ottobre 2027. Se stai modellando una pipeline che prosegue fino all'anno prossimo, lo step di gennaio di Google è un raddoppio e va incluso nel modello; Anthropic non ha un evento equivalente da pianificare.
Questo vale in entrambe le direzioni, e la lettura equa non è "un fornitore è onesto e l'altro no". Una tariffa promozionale è una tariffa reale finché dura, e Google ha il diritto di prezzare un lancio in quel modo. È semplicemente un fatto della comparazione che il lato all'apparenza più economico dei numeri di gennaio sia quello con la scadenza.

Quanto valgono due punti di indice?
Un divario di 2,47 punti su un indice che arriva fino ai sessanta non è un errore di arrotondamento e non è un abisso. Entrambi i modelli si collocano nella stessa fascia operativa, e la domanda pratica è se il divario si manifesta nei compiti che esegui effettivamente.
Secondo i dati forniti dai produttori stessi, i due non vengono misurati sullo stesso harness, quindi non possono essere confrontati direttamente — Anthropic pubblica i risultati di GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 e FrontierCode per Claude Haiku 5.5, mentre Google pubblica i propri per Gemini 3.8 Flash, e nessuno dei due produttori ha eseguito la suite dell'altro. L'unico confronto realmente omogeneo disponibile è la classifica indipendente, e lì la risposta è che Anthropic è avanti di un margine misurabile ma piccolo.
La differenza di capacità che conterà di più per alcune squadre riguarda l'aspetto delle modalità. Gemini 3.8 Flash accetta input vocali e video; Claude Haiku 5.5 accetta testo e immagini. Una pipeline che acquisisce nativamente registrazioni di chiamate o catture dello schermo non sta affatto scegliendo tra questi due modelli in base al prezzo: uno dei due non può svolgere il lavoro senza uno step di trascrizione o di estrazione dei fotogrammi davanti a sé, e quello step ha i suoi costi e le sue modalità di errore.
Eseguendo il lato più economico della coppia
Gemini 3.8 Flash è nel catalogo di OrcaRouter al prezzo di listino di Google con 0% di ricarico, il che qui conta più del solito: la tariffa del provider viene passata così com'è invece di essere combinata, quindi se vuoi vedere cosa fa realmente la variazione di gennaio su una fattura, il numero si muove quando si muove quello di Google. Anche Claude Sonnet 5.5 e Claude Opus 5.5 sono nel catalogo, il che rende un test di routing a tre vie — la gamba Flash di Google, un tier medio di Anthropic e, più avanti, un tier piccolo di Anthropic — una configurazione anziché un progetto. Una chiave, un SDK, failover automatico sotto, e il DSL di routing se preferisci esprimere l'escalation nella rotta anziché nel codice dell'applicazione.
Claude Haiku 5.5 stesso non è ancora nel catalogo, ed è meglio dirlo che lasciare l'ambiguità. La parte Anthropic di questo confronto è attualmente raggiungibile solo presso Anthropic, mentre il ramo Google può essere chiamato da noi oggi al prezzo mostrato sopra.

Quale, e per chi?
Se il tuo lavoro è testo in input e testo in output, i tuoi prompt restano sotto i 100.000 token e paghi per token su volumi reali, Claude Haiku 5.5 è il modello più economico per ogni metrica presa in esame in questo articolo e quello con il punteggio più alto nell'unica classifica condivisa — con l'avvertenza che il vantaggio è di sei volte sul costo per attività, anziché di dieci volte come lascia intendere il prezzo di listino.
Se hai bisogno di input audio o video, o ti serve una risposta da oltre 65K, o i tuoi prompt sono regolarmente lunghi, il calcolo cambia: Gemini 3.8 Flash accetta input che il tier small di Anthropic non è in grado di accettare, e oltre 100.000 token persino il secondo tier di Anthropic costa ben più della tariffa fissa di Google.
L'unica cosa a cui tenere sono le date. La tariffa di Google è valida fino alla fine dell'anno e raddoppia dopo. Quella di Anthropic è dichiarata fissa con uno scatto legato alla durata. Qualunque sia la tua posizione in merito, inserisci il calendario nel foglio di calcolo prima di costruire la pipeline.
