Una hero card generata per «Il piccolo modello americano è ora quello più economico», con il badge «PREZZO MINIMO», il kicker «7 OTTOBRE 2026» e il sottotitolo «Claude Haiku 5.5 a $0,10 e $0,50 contro DeepSeek V4 Flash - fino a 100.000 token». Quattro chip recitano «$0,10 vs $0,15 in ingresso», «$0,50 vs $0,60 in uscita», «passo di 100K» e «finestre di picco». Due card sottostanti sono etichettate «SOTTO I 100.000 TOKEN» («Anthropic è più economica su entrambi i contatori») e «AL DI SOPRA» («DeepSeek costa da tre a quattro volte meno»). Un footer recita «Le tariffe di listino pubblicate dai fornitori sono quelle rilevate l'8 ottobre 2026». Il logo OrcaRouter è composto nell'angolo in basso a destra.
Guides & Insights

Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic ha appena battuto il prezzo

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Per due anni il segmento economico del mercato ha avuto una forma che tutti conoscevano: i laboratori americani facevano pagare di più e quelli cinesi di meno, e ognuno sceglieva la propria parte di conseguenza. Claude Haiku 5.5ha infranto questo schema il 7 ottobre 2026, lanciandosi a 0,10 $ per milione di token in input e 0,50 $ per milione di token in output — una cifra inferiore alla tariffa pubblicata di DeepSeek V4 Flash, il modello che dall'estate è il punto di riferimento per il low-cost.

È una vittoria più limitata di quanto sembri, e le ragioni valgono più del titolo. La tariffa di Ant​hropic vale solo per prompt fino a 100.000 token. Oltre quella soglia diventa $0,50 e $2,50, cioè diverse volte il prezzo di Dee​pSeek. E la carta di Dee​pSeek ha una forma che nessuno copia: raddoppia durante due finestre nei giorni feriali. Due fornitori, due idee completamente diverse di cosa significhi "economico".

Cosa pubblica effettivamente ciascun fornitore

Per milione di token, in dollari statunitensi. I dati di Anthropic provengono dalla documentazione sui prezzi di Anthropic; i dati di DeepSeek provengono dalla pagina Models & Pricing di DeepSeek stessa, che rappresenta la scheda autorevole per il modello.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Input — Claude Haiku 5.5: 0,10 $ fino a 100.000 token, 0,50 $ oltre. DeepSeek V4 Flash: 0,15 $ fuori dalle ore di punta, 0,30 $ nelle fasce di punta.

• Output — Claude Haiku 5.5 $0.50 fino a 100.000 token, $2.50 oltre. DeepSeek V4 Flash $0.60 fuori dalle ore di punta, $1.20 nelle ore di punta.

• Input in cache — Claude Haiku 5.5 $0,01 fino a 100.000 token e $0,05 oltre. DeepSeek V4 Flash $0,003 fuori picco e $0,006 in periodo di picco, il che lo rende più economico di oltre tre volte.

• Finestre di picco — Ant​hropic non ne ha; la tariffa cambia con la lunghezza del prompt e nient'altro. Dee​pSeek raddoppia la tariffa tra le 01:00 e le 04:00 e di nuovo tra le 06:00 e le 10:00 UTC, dal lunedì al venerdì, esclusi i giorni festivi cinesi.

• Contesto e output — 1M token e 128.000 di output massimo per Claude Haiku 5.5; 1M token e 384.000 di output massimo per DeepSeek V4 Flash.

• Modalità — Claude Haiku 5.5 accetta testo e immagini; DeepSeek V4 Flash è solo testo, e la visione risiede sul modello gemello anziché su questo.

• Punteggio indipendente — Artificial Analysis Intelligence Index v4.3.2 colloca Claude Haiku 5.5 (Max) a 43,40, secondo su 182 modelli, e DeepSeek V4 Flash 0731 (Max) a 34,33, decimo su 117.

• Velocità — la stessa fonte misura 241,9 token di output al secondo per Claude Haiku 5.5 e 222,0 per DeepSeek V4 Flash, il secondo più veloce nella propria classifica.

Il crossover è tutto

Allinea le due carte su un'unica richiesta e il confronto si inverte due volte.

Sotto i 100.000 token, Ant​hropic è più economico su entrambi i contatori e sul cartellino che conta: $0,10 contro $0,15 in input, $0,50 contro $0,60 in output. È la prima volta che un modello piccolo di Ant​hropic scende sotto una tariffa di Dee​pSeek Flash a parità di condizioni, ed è il fatto con cui apre il post di lancio.

Oltre 100.000 token, si inverte bruscamente. L'input da 0,50 $ di Anthropic è più di tre volte la tariffa off-peak di DeepSeek, e l'output da 2,50 $ è più di quattro volte quella. Una pipeline di retrieval o per documenti lunghi che assembla abitualmente prompt da 150.000 token non è affatto un cliente per Claude Haiku 5.5; è un cliente per il modello che stava già usando.

E nelle due finestre feriali di Dee​pSeek il secondo confronto si restringe dalla direzione opposta, perché la tariffa di Dee​pSeek raddoppia mentre quella di Ant​hropic non cambia. In astratto, nessuna delle due strutture dei fornitori è migliore. Uno fissa il prezzo in base a quanto invii, l'altro in base a quando lo invii, e solo uno dei due è sotto il tuo controllo al momento della richiesta.

Quanto costa un'attività completata, che è l'unico numero equo

Le tariffe di listino sono per token, e i due modelli non emettono lo stesso numero di token per lo stesso lavoro. È qui che l'aritmetica del lancio diventa scomoda per Anthropic.

Artificial Analysis colloca Claude Haiku 5.5 (Max) a 0,21 $ per attività dell'Intelligence Index e DeepSeek V4 Flash 0731 (Max) a 0,22 $ per attività. Un decimo della tariffa di input, una finestra più ampia e un divario di 26 punti nell'Intelligence Index — 43,40 contro 34,33 — e il costo misurato per portare a termine una singola attività si attesta entro un centesimo dal modello che avrebbe dovuto battere sul prezzo.

Il motivo è sulla stessa pagina. Valutando l'Indice, Claude Haiku 5.5 ha generato 440 milioni di token di output contro una mediana di 100 milioni, e il valutatore lo definisce molto prolisso. DeepSeek V4 Flash ha generato 240 milioni contro una mediana di 140 milioni ed è considerato molto prolisso anche lui. Entrambi i modelli pensano a lungo, entrambi fatturano il pensiero come output, e l'output è il contatore che decide la fattura. Il taglio del novanta percento sull'input è reale ed è addebitato sulla metà più piccola della fattura.

C'è un secondo effetto, più silenzioso. La documentazione di Anthropic stessa afferma che Claude Haiku 5.5 usa il tokenizer più recente, condiviso con Claude 4.7 e versioni successive, quindi lo stesso testo conta all'incirca il 30% di token in più rispetto a Claude Haiku 4.5. La tariffa è calata di un fattore dieci; il numero di token non è calato affatto, anzi sullo stesso testo è aumentato.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Anche il modello dietro il nome Dee​pSeek è cambiato

Chiunque confronti questi due sulla base di una tabella di benchmark vecchia di mesi dovrebbe saperlo prima di farlo.

La pagina dei prezzi di Dee​pSeek ora elenca deepseek-flash come nome del modello, supportato da Dee​pSeek-V4.1-Flash, e afferma che l'id legacy deepseek-v4-flash è ancora accettato ma che "i modelli corrispondenti sono stati ritirati" — le richieste sotto il vecchio nome sono servite dal modello più recente e fatturate al prezzo Flash. In altre parole, l'id ha mantenuto il suo nome, il suo prezzo e il suo posto nella gamma, e i pesi sottostanti si sono spostati.

Non è una critica; è un avvertimento su a cosa è datata una tabella di benchmark. La voce di Artificial Analysis citata in questo articolo si riferisce alla release 0731 di DeepSeek V4 Flash nella sua configurazione Max, ovvero il modello che la board ha misurato, e non è automaticamente un'affermazione su qualunque cosa oggi risponda a quell'id. Claude Haiku 5.5 di Anthropic, al contrario, è un id fisso senza suffisso di data e senza alias, e la sua posizione nell'Index è datata alla settimana del suo lancio.

Due modelli, un endpoint

Il motivo per cui è facile risolvere questo confronto da soli invece che su una scheda tecnica è che entrambe le parti sono richiamabili dallo stesso punto — con un'eccezione che vale la pena menzionare.

DeepSeek V4 Flash è oggi nel catalogo di OrcaRouter, e il failover automatico gli sta sotto, così il ramo DeepSeek di questo confronto lo possiamo chiamare noi stamattina, invece di limitarci a leggerne. Una cautela che vale la pena dichiarare anziché lasciare che la scopra tu: la nostra tariffa pubblicata per questo modello è 0,22 $ in ingresso e 0,66 $ in uscita per milione di token, che si colloca sopra la tariffa off-peak di DeepSeek e sotto quella di picco. Considera la pagina di DeepSeek, non la nostra, come autorità sulla struttura peak e off-peak, e la nostra come un unico numero misto da cui partire per un'esecuzione a consumo. Anche Claude Sonnet 5.5 e Claude Opus 5.5 sono nel catalogo. Quindi un A/B tra un ramo DeepSeek Flash e un ramo Claude richiede una sola chiave e un solo SDK, e il DSL di routing li comporrà in un'unica chiamata se la logica di escalation appartiene alla route anziché all'applicazione.

Claude Haiku 5.5 non è ancora nel catalogo. Non è un modo di glissare: significa che il lato Ant​hropic di questo confronto, al momento, deve essere raggiunto direttamente su Ant​hropic, mentre il lato Dee​pSeek no. Se vuoi il livello economico della linea Dee​pSeek sulla stessa chiave del resto del tuo stack già da oggi, quella parte è già attiva.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Quale scegliere?

Se le tue chiamate sono brevi — classificazione, estrazione, instradamento, riepilogo, turni di subagente — e rientrano sotto i 100.000 token, Claude Haiku 5.5 è ora il modello più economico su entrambi i contatori e il più forte sulla classifica indipendente, e la scelta è semplice. È anche l'unico dei due che accetta un'immagine.

Se le tue chiamate sono lunghe, se reinvii un ampio prefisso condiviso o se puoi pianificare, l'aritmetica punta nella direzione opposta e lo fa con un ampio margine: l'input in cache di Dee​pSeek a $0,003 fuori picco è un ordine di grandezza inferiore agli $0,01 di Ant​hropic, il suo tetto di output è tre volte più alto e il suo sconto fuori picco è un problema di pianificazione più che un limite del prodotto.

Ciò che il lancio ha stabilito è più limitato di «Anthropic ora costa meno». Ha stabilito che i laboratori americani praticheranno prezzi inferiori a quelli del caso dei prompt brevi, e il caso dei prompt brevi è quello in cui si concentra la maggior parte del traffico. Tutto ciò che supera i 100.000 resta ancora il mercato dell'altro modello.