
Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic ha appena battuto il prezzo
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Per due anni il segmento economico del mercato ha avuto una forma che tutti conoscevano: i laboratori americani facevano pagare di più e quelli cinesi di meno, e ognuno sceglieva la propria parte di conseguenza. Claude Haiku 5.5ha infranto questo schema il 7 ottobre 2026, lanciandosi a 0,10 $ per milione di token in input e 0,50 $ per milione di token in output — una cifra inferiore alla tariffa pubblicata di DeepSeek V4 Flash, il modello che dall'estate è il punto di riferimento per il low-cost.
È una vittoria più limitata di quanto sembri, e le ragioni valgono più del titolo. La tariffa di Anthropic vale solo per prompt fino a 100.000 token. Oltre quella soglia diventa $0,50 e $2,50, cioè diverse volte il prezzo di DeepSeek. E la carta di DeepSeek ha una forma che nessuno copia: raddoppia durante due finestre nei giorni feriali. Due fornitori, due idee completamente diverse di cosa significhi "economico".
Cosa pubblica effettivamente ciascun fornitore
Per milione di token, in dollari statunitensi. I dati di Anthropic provengono dalla documentazione sui prezzi di Anthropic; i dati di DeepSeek provengono dalla pagina Models & Pricing di DeepSeek stessa, che rappresenta la scheda autorevole per il modello.

• Input — Claude Haiku 5.5: 0,10 $ fino a 100.000 token, 0,50 $ oltre. DeepSeek V4 Flash: 0,15 $ fuori dalle ore di punta, 0,30 $ nelle fasce di punta.
• Output — Claude Haiku 5.5 $0.50 fino a 100.000 token, $2.50 oltre. DeepSeek V4 Flash $0.60 fuori dalle ore di punta, $1.20 nelle ore di punta.
• Input in cache — Claude Haiku 5.5 $0,01 fino a 100.000 token e $0,05 oltre. DeepSeek V4 Flash $0,003 fuori picco e $0,006 in periodo di picco, il che lo rende più economico di oltre tre volte.
• Finestre di picco — Anthropic non ne ha; la tariffa cambia con la lunghezza del prompt e nient'altro. DeepSeek raddoppia la tariffa tra le 01:00 e le 04:00 e di nuovo tra le 06:00 e le 10:00 UTC, dal lunedì al venerdì, esclusi i giorni festivi cinesi.
• Contesto e output — 1M token e 128.000 di output massimo per Claude Haiku 5.5; 1M token e 384.000 di output massimo per DeepSeek V4 Flash.
• Modalità — Claude Haiku 5.5 accetta testo e immagini; DeepSeek V4 Flash è solo testo, e la visione risiede sul modello gemello anziché su questo.
• Punteggio indipendente — Artificial Analysis Intelligence Index v4.3.2 colloca Claude Haiku 5.5 (Max) a 43,40, secondo su 182 modelli, e DeepSeek V4 Flash 0731 (Max) a 34,33, decimo su 117.
• Velocità — la stessa fonte misura 241,9 token di output al secondo per Claude Haiku 5.5 e 222,0 per DeepSeek V4 Flash, il secondo più veloce nella propria classifica.
Il crossover è tutto
Allinea le due carte su un'unica richiesta e il confronto si inverte due volte.
Sotto i 100.000 token, Anthropic è più economico su entrambi i contatori e sul cartellino che conta: $0,10 contro $0,15 in input, $0,50 contro $0,60 in output. È la prima volta che un modello piccolo di Anthropic scende sotto una tariffa di DeepSeek Flash a parità di condizioni, ed è il fatto con cui apre il post di lancio.
Oltre 100.000 token, si inverte bruscamente. L'input da 0,50 $ di Anthropic è più di tre volte la tariffa off-peak di DeepSeek, e l'output da 2,50 $ è più di quattro volte quella. Una pipeline di retrieval o per documenti lunghi che assembla abitualmente prompt da 150.000 token non è affatto un cliente per Claude Haiku 5.5; è un cliente per il modello che stava già usando.
E nelle due finestre feriali di DeepSeek il secondo confronto si restringe dalla direzione opposta, perché la tariffa di DeepSeek raddoppia mentre quella di Anthropic non cambia. In astratto, nessuna delle due strutture dei fornitori è migliore. Uno fissa il prezzo in base a quanto invii, l'altro in base a quando lo invii, e solo uno dei due è sotto il tuo controllo al momento della richiesta.
Quanto costa un'attività completata, che è l'unico numero equo
Le tariffe di listino sono per token, e i due modelli non emettono lo stesso numero di token per lo stesso lavoro. È qui che l'aritmetica del lancio diventa scomoda per Anthropic.
Artificial Analysis colloca Claude Haiku 5.5 (Max) a 0,21 $ per attività dell'Intelligence Index e DeepSeek V4 Flash 0731 (Max) a 0,22 $ per attività. Un decimo della tariffa di input, una finestra più ampia e un divario di 26 punti nell'Intelligence Index — 43,40 contro 34,33 — e il costo misurato per portare a termine una singola attività si attesta entro un centesimo dal modello che avrebbe dovuto battere sul prezzo.
Il motivo è sulla stessa pagina. Valutando l'Indice, Claude Haiku 5.5 ha generato 440 milioni di token di output contro una mediana di 100 milioni, e il valutatore lo definisce molto prolisso. DeepSeek V4 Flash ha generato 240 milioni contro una mediana di 140 milioni ed è considerato molto prolisso anche lui. Entrambi i modelli pensano a lungo, entrambi fatturano il pensiero come output, e l'output è il contatore che decide la fattura. Il taglio del novanta percento sull'input è reale ed è addebitato sulla metà più piccola della fattura.
C'è un secondo effetto, più silenzioso. La documentazione di Anthropic stessa afferma che Claude Haiku 5.5 usa il tokenizer più recente, condiviso con Claude 4.7 e versioni successive, quindi lo stesso testo conta all'incirca il 30% di token in più rispetto a Claude Haiku 4.5. La tariffa è calata di un fattore dieci; il numero di token non è calato affatto, anzi sullo stesso testo è aumentato.

Anche il modello dietro il nome DeepSeek è cambiato
Chiunque confronti questi due sulla base di una tabella di benchmark vecchia di mesi dovrebbe saperlo prima di farlo.
La pagina dei prezzi di DeepSeek ora elenca deepseek-flash come nome del modello, supportato da DeepSeek-V4.1-Flash, e afferma che l'id legacy deepseek-v4-flash è ancora accettato ma che "i modelli corrispondenti sono stati ritirati" — le richieste sotto il vecchio nome sono servite dal modello più recente e fatturate al prezzo Flash. In altre parole, l'id ha mantenuto il suo nome, il suo prezzo e il suo posto nella gamma, e i pesi sottostanti si sono spostati.
Non è una critica; è un avvertimento su a cosa è datata una tabella di benchmark. La voce di Artificial Analysis citata in questo articolo si riferisce alla release 0731 di DeepSeek V4 Flash nella sua configurazione Max, ovvero il modello che la board ha misurato, e non è automaticamente un'affermazione su qualunque cosa oggi risponda a quell'id. Claude Haiku 5.5 di Anthropic, al contrario, è un id fisso senza suffisso di data e senza alias, e la sua posizione nell'Index è datata alla settimana del suo lancio.
Due modelli, un endpoint
Il motivo per cui è facile risolvere questo confronto da soli invece che su una scheda tecnica è che entrambe le parti sono richiamabili dallo stesso punto — con un'eccezione che vale la pena menzionare.
DeepSeek V4 Flash è oggi nel catalogo di OrcaRouter, e il failover automatico gli sta sotto, così il ramo DeepSeek di questo confronto lo possiamo chiamare noi stamattina, invece di limitarci a leggerne. Una cautela che vale la pena dichiarare anziché lasciare che la scopra tu: la nostra tariffa pubblicata per questo modello è 0,22 $ in ingresso e 0,66 $ in uscita per milione di token, che si colloca sopra la tariffa off-peak di DeepSeek e sotto quella di picco. Considera la pagina di DeepSeek, non la nostra, come autorità sulla struttura peak e off-peak, e la nostra come un unico numero misto da cui partire per un'esecuzione a consumo. Anche Claude Sonnet 5.5 e Claude Opus 5.5 sono nel catalogo. Quindi un A/B tra un ramo DeepSeek Flash e un ramo Claude richiede una sola chiave e un solo SDK, e il DSL di routing li comporrà in un'unica chiamata se la logica di escalation appartiene alla route anziché all'applicazione.
Claude Haiku 5.5 non è ancora nel catalogo. Non è un modo di glissare: significa che il lato Anthropic di questo confronto, al momento, deve essere raggiunto direttamente su Anthropic, mentre il lato DeepSeek no. Se vuoi il livello economico della linea DeepSeek sulla stessa chiave del resto del tuo stack già da oggi, quella parte è già attiva.

Quale scegliere?
Se le tue chiamate sono brevi — classificazione, estrazione, instradamento, riepilogo, turni di subagente — e rientrano sotto i 100.000 token, Claude Haiku 5.5 è ora il modello più economico su entrambi i contatori e il più forte sulla classifica indipendente, e la scelta è semplice. È anche l'unico dei due che accetta un'immagine.
Se le tue chiamate sono lunghe, se reinvii un ampio prefisso condiviso o se puoi pianificare, l'aritmetica punta nella direzione opposta e lo fa con un ampio margine: l'input in cache di DeepSeek a $0,003 fuori picco è un ordine di grandezza inferiore agli $0,01 di Anthropic, il suo tetto di output è tre volte più alto e il suo sconto fuori picco è un problema di pianificazione più che un limite del prodotto.
Ciò che il lancio ha stabilito è più limitato di «Anthropic ora costa meno». Ha stabilito che i laboratori americani praticheranno prezzi inferiori a quelli del caso dei prompt brevi, e il caso dei prompt brevi è quello in cui si concentra la maggior parte del traffico. Tutto ciò che supera i 100.000 resta ancora il mercato dell'altro modello.
