Una hero card generata per 'Sei volte il costo per due punti di indice', con il badge 'COSTO PER ATTIVITÀ', l'occhiello 'DUE MODELLI DI FASCIA FLASH, UNA CLASSIFICA' e il sottotitolo 'Claude Haiku 5.5 a 43,40 contro Gemini 3.8 Flash a 40,93 sull'Intelligence Index v4.3.2.' Quattro chip riportano '43,40 vs 40,93', '$0,21 vs $1,24', '$0,10 vs $0,75' e 'aumenta il 1° gennaio 2027'. Due card sotto sono etichettate 'IL VANTAGGIO DI ANTHROPIC' ('più in alto nella classifica condivisa e sei volte più economico per attività completata') e 'IL VANTAGGIO DI GOOGLE' ('input vocale e video, e una tariffa fissa per l'intera finestra'). Un footer recita 'Misurazioni indipendenti di Artificial Analysis; prezzi di listino rilevati l'8 ottobre 2026.' Il logo OrcaRouter è compositato nell'angolo in basso a destra.
Guides & Insights

Claude Haiku 5.5 vs Gemini 3.8 Flash: Due punti di indice, sei volte il costo per attività

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Claude Haiku 5.5 e Gemini 3.8 Flash sono più vicini in capacità misurata di qualsiasi altra coppia in questa fascia di prezzo — 43,40 contro 40,93 sull'Artificial Analysis Intelligence Index v4.3.2, ed entrambi si collocano tra i primi cinquanta di una classifica di 225 modelli. Ciò che li distingue è quanto costa uno di quei punti dell'indice. Sulla stessa misurazione indipendente, un'attività completata dell'Intelligence Index costa $0,21 su Claude Haiku 5.5 e $1,24 su Gemini 3.8 Flash.

Si tratta di un divario di sei volte per una differenza di punteggio di due punti e mezzo, ed è il numero che dovrebbe decidere questo confronto. Tutto il resto — le tariffe di listino, l'elenco delle modalità, le scadenze associate ai prezzi di Google — è una discussione sui margini.

Entrambi i modelli, sui numeri che contano

Per milione di token in dollari USA, dalla documentazione ufficiale sui prezzi di Anthropic e Google, con le misurazioni indipendenti attribuite ad Artificial Analysis. Cache del 2026-10-08.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• Input — Claude Haiku 5.5 $0.10 fino a 100.000 token e $0.50 oltre; Gemini 3.8 Flash $0.75 fisso, che sale a $1.50 il 1º gennaio 2027.

• Output — Claude Haiku 5.5 $0,50 fino a 100.000 token e $2,50 oltre; Gemini 3.8 Flash $3,75 fisso, che sale a $7,50 alla stessa data.

• Input in cache — Claude Haiku 5.5 $0,01 e $0,05; Gemini 3.8 Flash $0,075, più un costo di archiviazione di $0,50 per milione di token all'ora.

• Contesto — 1M token per entrambi. Output massimo — 128.000 token per Claude Haiku 5.5 contro 65.536 per Gemini 3.8 Flash.

• Modalità di input — testo e immagini per Claude Haiku 5.5; testo, immagini, parlato e video per Gemini 3.8 Flash. Questa è l'unica riga in cui l'elenco di Google è strettamente più lungo.

• Punteggio indipendente — 43,40 per Claude Haiku 5.5 (Max) contro 40,93 per Gemini 3 Flash (High), su Intelligence Index v4.3.2.

• Costo indipendente per attività — 0,21 $ contro 1,24 $ sulla stessa scheda.

• Velocità — 241,9 token di output al secondo contro 125,2, entrambi misurati da Artificial Analysis.

Da dove proviene la cifra delle sei volte

Il divario nel costo per attività è più grande del divario nel prezzo di listino, ed è questa la parte interessante, perché significa che il tariffario da solo non basta a spiegarlo.

L'aritmetica dei prezzi di listino è abbastanza semplice: $0,10 contro $0,75 sull'input è sette volte e mezzo più economico, e $0,50 contro $3,75 sull'output è lo stesso rapporto. Se entrambi i modelli generassero gli stessi token per lo stesso lavoro, quel rapporto si ripercuoterebbe direttamente sulla fattura.

Non si trasferisce, ed entrambi gli effetti vanno a favore di Google. Claude Haiku 5.5 è verboso in un modo che il suo stesso fornitore riconosce: Artificial Analysis ha registrato 440 milioni di token di output mentre eseguiva l'Index, contro una mediana di 100 milioni, e definisce il modello molto verboso. Gemini 3.8 Flash ha generato 170 milioni rispetto a una mediana di 81 milioni — anch'esso segnalato come verboso, ma con un terzo del numero di token. La documentazione di Anthropic stessa aggiunge il secondo effetto: Claude Haiku 5.5 usa il tokenizer più recente condiviso con Claude 4.7 e versioni successive, perciò lo stesso testo viene conteggiato come circa il 30% di token in più rispetto al modello che sostituisce.

Mettendo insieme il tutto, la versione onesta dell'affermazione sui prezzi è questa: un vantaggio di dieci a uno sulla tariffa di input e un vantaggio di sette e mezzo a uno sulla tariffa di output, in parte eroso da un modello che scrive più token per risposta, arrivando a un vantaggio di sei a uno nella misurazione che addebita l'intero lavoro. Resta comunque una vittoria schiacciante, anche se più contenuta di quanto suggerisca il listino.

Il prezzo di Google riporta una data.

La cosa più utile in assoluto sulla pagina dei prezzi di Google è una frase che la maggior parte delle tabelle di confronto omette.

Gemini 3.8 Flash è indicato a $0.75 per l'input e $3.75 per l'output "fino al 31 dicembre 2026", e a $1.50 e $7.50 "a partire dal 1º gennaio 2027". L'input in cache passa da $0.075 a $0.15 alla stessa data. Si tratta di una tariffa introduttiva con una scadenza stampata accanto, a circa undici settimane dal momento in cui scriviamo.

Nella scheda di Anthropic non c'è nulla che si legga in quel modo. Le tariffe di Claude Haiku 5.5 sono indicate come tariffe, con una struttura a due livelli legata alla lunghezza del prompt anziché a un calendario, e un impegno al ritiro non prima del 7 ottobre 2027. Se stai modellando una pipeline che prosegue fino all'anno prossimo, lo step di gennaio di Google è un raddoppio e va incluso nel modello; Anthropic non ha un evento equivalente da pianificare.

Questo vale in entrambe le direzioni, e la lettura equa non è "un fornitore è onesto e l'altro no". Una tariffa promozionale è una tariffa reale finché dura, e Google ha il diritto di prezzare un lancio in quel modo. È semplicemente un fatto della comparazione che il lato all'apparenza più economico dei numeri di gennaio sia quello con la scadenza.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

Quanto valgono due punti di indice?

Un divario di 2,47 punti su un indice che arriva fino ai sessanta non è un errore di arrotondamento e non è un abisso. Entrambi i modelli si collocano nella stessa fascia operativa, e la domanda pratica è se il divario si manifesta nei compiti che esegui effettivamente.

Secondo i dati forniti dai produttori stessi, i due non vengono misurati sullo stesso harness, quindi non possono essere confrontati direttamente — Ant​hropic pubblica i risultati di GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 e FrontierCode per Claude Haiku 5.5, mentre Google pubblica i propri per Gemini 3.8 Flash, e nessuno dei due produttori ha eseguito la suite dell'altro. L'unico confronto realmente omogeneo disponibile è la classifica indipendente, e lì la risposta è che Ant​hropic è avanti di un margine misurabile ma piccolo.

La differenza di capacità che conterà di più per alcune squadre riguarda l'aspetto delle modalità. Gemini 3.8 Flash accetta input vocali e video; Claude Haiku 5.5 accetta testo e immagini. Una pipeline che acquisisce nativamente registrazioni di chiamate o catture dello schermo non sta affatto scegliendo tra questi due modelli in base al prezzo: uno dei due non può svolgere il lavoro senza uno step di trascrizione o di estrazione dei fotogrammi davanti a sé, e quello step ha i suoi costi e le sue modalità di errore.

Eseguendo il lato più economico della coppia

Gemini 3.8 Flash è nel catalogo di OrcaRouter al prezzo di listino di Google con 0% di ricarico, il che qui conta più del solito: la tariffa del provider viene passata così com'è invece di essere combinata, quindi se vuoi vedere cosa fa realmente la variazione di gennaio su una fattura, il numero si muove quando si muove quello di Google. Anche Claude Sonnet 5.5 e Claude Opus 5.5 sono nel catalogo, il che rende un test di routing a tre vie — la gamba Flash di Google, un tier medio di Ant​hropic e, più avanti, un tier piccolo di Ant​hropic — una configurazione anziché un progetto. Una chiave, un SDK, failover automatico sotto, e il DSL di routing se preferisci esprimere l'escalation nella rotta anziché nel codice dell'applicazione.

Claude Haiku 5.5 stesso non è ancora nel catalogo, ed è meglio dirlo che lasciare l'ambiguità. La parte Ant​hropic di questo confronto è attualmente raggiungibile solo presso Ant​hropic, mentre il ramo Google può essere chiamato da noi oggi al prezzo mostrato sopra.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Quale, e per chi?

Se il tuo lavoro è testo in input e testo in output, i tuoi prompt restano sotto i 100.000 token e paghi per token su volumi reali, Claude Haiku 5.5 è il modello più economico per ogni metrica presa in esame in questo articolo e quello con il punteggio più alto nell'unica classifica condivisa — con l'avvertenza che il vantaggio è di sei volte sul costo per attività, anziché di dieci volte come lascia intendere il prezzo di listino.

Se hai bisogno di input audio o video, o ti serve una risposta da oltre 65K, o i tuoi prompt sono regolarmente lunghi, il calcolo cambia: Gemini 3.8 Flash accetta input che il tier small di Ant​hropic non è in grado di accettare, e oltre 100.000 token persino il secondo tier di Ant​hropic costa ben più della tariffa fissa di Google.

L'unica cosa a cui tenere sono le date. La tariffa di Google è valida fino alla fine dell'anno e raddoppia dopo. Quella di Anthropic è dichiarata fissa con uno scatto legato alla durata. Qualunque sia la tua posizione in merito, inserisci il calendario nel foglio di calcolo prima di costruire la pipeline.