Una hero card generata per 'Claude Haiku 5.5 costa un decimo', con il badge 'IL CLAUDE PIÙ ECONOMICO', l'occhiello 'ANTHROPIC, 7 OTTOBRE 2026' e il sottotitolo 'Un taglio del 90% delle tariffe, un tokenizer che aggiunge circa il 30% di token in più e un video di lancio che Anthropic non ha pubblicato.' Quattro chip recitano '$0,10 in ingresso', '$0,50 in uscita', 'contesto 1M' e 'risparmio reale del 75%'. Due card sottostanti sono etichettate 'COSA È SCESO' ('input da $1,00 a $0,10, output da $5,00 a $0,50 sotto i 100.000 token') e 'COSA È SALITO' ('lo stesso testo conta circa il 30% di token in più rispetto a prima'). Un footer recita 'Documentazione sui prezzi del fornitore consultata l'8 ottobre 2026.' Il logo OrcaRouter è composto nell'angolo in basso a destra.
Guides & Insights

Claude Haiku 5.5: un taglio di prezzo del 90%, un nuovo tokenizer e il video che Anthropic non ha pubblicato

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Qualcuno ha digitato una frase in Claude Haiku 5.5 e ha ricevuto indietro un film di lancio finito. Il prompt, pubblicato su X la sera del 7 ottobre 2026, recita integralmente: "crea un video dieci volte più esplosivo per il tuo lancio che mostri quanto sei bravo come motion designer." La didascalia del post è lunga tre parole — "Fatto con un solo tentativo questo video" — e porta la clip come allegato. Nessun tentativo, nessuno storyboard, nessun montatore. Se questo è ciò che il modello più economico della linea Claude fa adesso, il livello ha smesso di essere un compromesso.

Questa è la metà interessante del lancio. L'altra metà è aritmetica, ed è lì che risiede la notizia vera: Claude Haiku 5.5 costa 0,10 $ per milione di token di input e 0,50 $ per milione di token di output per prompt fino a 100.000 token, contro Claude Haiku 4.5, che ha un prezzo fisso di 1 $ e 5 $. La nota a piè di pagina di Anthropic definisce quel valore inferiore del 90% nel caso comune — e poi dice, nello stesso respiro, che il numero su cui un acquirente dovrebbe pianificare è più vicino al 75%. Entrambi i numeri sono corretti, e il divario tra loro è la cosa più importante di questo rilascio.

Cosa ha messo a verbale Ant​hropic il 7 ottobre

Il post di lancio del fornitore e la sua documentazione sui prezzi concordano sulla natura della cosa, e si tratta di un passo più ampio di quello che di solito accompagna un taglio di prezzo.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• Prezzo — $0,10 per milione di token di input e $0,50 per milione di token di output per prompt fino a 100.000 token. Oltre questa soglia, la stessa richiesta viene fatturata a $0,50 e $2,50. Le letture dalla cache costano $0,01 per milione fino a 100K e $0,05 oltre; le scritture nella cache sono $0,125 e $0,625.

• Contesto — 1M token, con un output massimo di 128.000 token. È la stessa finestra e lo stesso tetto di output di Claude Fable 5.1, Claude Opus 5.5 e Claude Sonnet 5.5, riprodotti sul tier più economico.

• Thinking — pensiero adattivo con il parametro effort, con valore predefinito medium. Anthropic afferma che questo è il primo modello di classe Haiku con un'impostazione effort regolabile, il che significa che lo stesso ID modello può essere eseguito in modo economico o in modo accurato senza cambiare nient'altro.

• Tokenizer — il tokenizer più recente condiviso con Claude 4.7 e versioni successive, che "produce circa il 30% in più di token per lo stesso testo". La documentazione di Anthropic afferma che l'aumento esatto dipende dal contenuto e dalla forma del carico di lavoro.

• Ciclo di vita — data di cutoff delle conoscenze: giugno 2026, e un impegno alla dismissione di "non prima del 7 ottobre 2027."

• Disponibilità — l'API Claude, Amazon Web Services, Goo​gle Cloud, Microsoft Azure e Claude Platform on AWS, tutti disponibili contemporaneamente fin dal primo giorno.

L'adesivo 10x e la realtà del 75%

Dieci volte più economico è il numero che arriverà più lontano, ed è quello che con ogni probabilità finirà nel modello di budget di qualcuno nel posto sbagliato. Si applica a prompt fino a 100.000 token. Haiku 5.5 non mantiene quella tariffa per l'intera finestra.

• Fino a 100.000 token — 0,10 $ in ingresso e 0,50 $ in uscita, contro gli 1 $ e i 5 $ di Haiku 4.5. È il taglio del 90%, e Ant​hropic afferma che il 90% delle richieste al precedente modello Haiku rientrava in questa fascia.

Oltre 100.000 token — $0,50 in ingresso e $2,50 in uscita. Ancora esattamente la metà di quanto addebitava Haiku 4.5, sulla stessa richiesta, senza alcun tetto da raggiungere.

• Il tokenizer — lo stesso testo diventa circa il 30% di token in più rispetto a Haiku 4.5, quindi la riduzione per token non si traduce uno a uno in una fattura più bassa.

• La media del fornitore stesso — Ant​hropic presenta la combinazione come «circa il 75% in meno da eseguire». Questo è il suo dato, non una misurazione indipendente, ed è quello da mettere in una previsione.

• Economia della cache — le letture dalla cache sono scese da $0,10 a $0,01 per milione nella fascia comune, un fattore che conta più della tariffa di input per qualsiasi pipeline che invii nuovamente un lungo prefisso condiviso.

Il dato del 75% spiega anche qualcosa che un lettore potrebbe altrimenti interpretare come una contraddizione. I due numeri principali non sono in conflitto; uno è un tasso su una forma di richiesta, l'altro è una stima combinata su un mix di traffico reale che include la minoranza oltre i 100K e i token aggiuntivi del tokenizer. Se stai modellando la spesa, usa il 75% e controlla la tua distribuzione della lunghezza dei prompt prima di credere che sia meglio.

Che cosa sostiene il video, e che cosa no

La clip è reale, il prompt è citato testualmente qui sopra, e il timestamp — 19:49 UTC del 7 ottobre, più o meno lo stesso giorno in cui il modello è stato reso disponibile — è verificabile. L'attribuzione è a un singolo utente, non ad Ant​hropic.

Qui la distinzione conta, perché la pagina di prodotto di Anthropic per Claude Haiku 5.5 non contiene alcun video incorporato: nessun player, nessun file multimediale, solo un link al canale YouTube dell'azienda. Se sia stato realizzato un film di lancio con il modello, il fornitore non lo ha detto. Quindi l'affermazione accurata è limitata: un utente riferisce di aver generato un video di lancio in un solo tentativo con Claude Haiku 5.5 e ha pubblicato il prompt. Se sia stato un solo tentativo, quanto sia costato e quanta parte sia sopravvissuta al montaggio sono tutte affermazioni provenienti da un'unica fonte. Considera la clip una dimostrazione, non un benchmark.

Il motivo per cui vale comunque la pena menzionarlo è che la generazione video non rientra nelle specifiche del modello. Haiku 5.5 accetta in input testo e immagini e restituisce testo. Un risultato di motion design di quella qualità implica che il modello stesse pilotando qualcos'altro — un percorso di generazione di codice, una pipeline di rendering, un ciclo di strumenti — invece di produrre fotogrammi da sé. Questa è una dichiarazione sull'orchestrazione agentica con input a $0.10, che è la parte effettivamente sorprendente.

I numeri pubblicati da Anthropic

La tabella di lancio del fornitore è un confronto prima/dopo rispetto a Haiku 4.5, con GPT-6 Luna e Claude Sonnet 5.5 nelle stesse colonne per dare un riferimento di scala. Ogni dato riportato di seguito è il risultato di valutazione dichiarato da Anthropic stessa, eseguito sull'harness di Anthropic, ed è riprodotto ma non verificato in modo indipendente.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• Lavoro intellettuale — GDPval-AA v2.1 a 1620 contro 735 di Haiku 4.5, 1437 di GPT-6 Luna e 1840 di Sonnet 5.5. AA-Briefcase v1.1 a 1578 contro 614, 1336 e 1824.

• Uso del computer — OSWorld 2.1 al 72,4% sul sottoinsieme offline, contro il 15,7% di Haiku 4.5, il 48,9% di GPT-6 Luna e l'83,9% di Sonnet 5.5.

• Ragionamento multidisciplinare — Humanity's Last Exam al 45,9% senza strumenti e al 57,4% con essi, rispetto al 10,2% e al 18,7% di Haiku 4.5.

• Codifica agentica — Terminal-Bench 4.0 al 39,2% contro 0,0%, 16,4% e 70,6%. FrontierCode 1.1 (Main) al 46,4% contro 42,4% di GPT-6 Luna e 52,1% di Sonnet 5.5.

• Ragionamento visivo — Chartography al 46,4% senza strumenti, contro 6,4%, 29,1% e 61,6%.

Anthropic è anche insolitamente diretta su dove la fascia piccola non vince. Il suo stesso commento al grafico di Terminal-Bench afferma che Sonnet 5.5 e Opus 5.5 «restano scelte migliori per compiti complessi di coding agentico», e posiziona invece Haiku 5.5 per la compattazione, il riassunto e il lavoro da subagente. Le citazioni dei clienti nel post vanno nella stessa direzione e portano la stessa avvertenza — si tratta di partner in accesso anticipato che descrivono le proprie valutazioni, non audit: Asana riporta oltre il 30% in meno di latenza per il completamento delle attività e un'inferenza fino a 2,5 volte più veloce per turno di agente; HubSpot riporta il 92,8% in media su tre esecuzioni su una suite di portali CRM; AlphaSense riporta 0,84 contro 0,76 su 400 query in un carico di lavoro che effettua circa 8 milioni di chiamate a settimana; Box riporta 11 punti in più rispetto a Haiku 4.5 con circa la metà della latenza; Rogo descrive un subagente Haiku 5.5 che estrae una voce di ricavi di segmento da un 10-K; e Cognition riporta che Devin Fusion mantiene un punteggio FrontierCode di 66,2 con Haiku 5.5 come spalla.

Cosa dice il consiglio indipendente

Le tabelle del fornitore sono del fornitore. Il primo posizionamento esterno è il numero più utile per chiunque debba decidere se la fascia si è spostata abbastanza da cambiare una pipeline di produzione.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis attribuisce a Claude Haiku 5.5 un punteggio di 43 nel suo Intelligence Index v4.3.2, nella configurazione Max del modello, posizionandolo secondo tra i 182 modelli di quella classifica e ben al di sopra della mediana di 13 della classifica. La stessa pagina misura 242 token di output al secondo — nono su 182 — e un costo di 0,21 $ per attività dell'Intelligence Index.

Due cose in quella pagina valgono più del titolo. La prima è la verbosità: valutando l'Index, Artificial Analysis ha registrato 440 milioni di token di output, contro una mediana di 100 milioni, e descrive il modello come "molto verboso". Il prezzo di listino si paga per token, quindi un modello che pensa a lungo lo paga — ed è esattamente il motivo per cui la cifra del costo per attività si attesta su $0,21 anziché vicino a zero, e per cui il taglio del 90% dell'input non è tutta la storia. La seconda è la scala dell'effort: la stessa pagina mostra configurazioni da Max a Low, e il default di Anthropic è medium, non max. Il 43 della board è in cima a quella scala, non l'impostazione che ottieni se non fai nulla.

Eseguire il tier sotto il tier che puoi già chiamare

Claude Haiku 5.5 non è presente nel catalogo di OrcaRouter, e varrebbe la pena dirlo chiaramente anziché lasciar intendere il contrario: il divario, il giorno del lancio, tra l'esistenza di un modello e la possibilità di instradarlo è di solito di qualche giorno, e talvolta anche di più.

Ciò che oggi è a catalogo di Ant​hropic è Claude Haiku 4.5, Claude Sonnet 5.5 e Claude Opus 5.5, ciascuno al prezzo di listino del fornitore, trasferito con 0% di ricarico, così qualsiasi taglio di prezzo faccia Ant​hropic arriva dalla nostra parte lo stesso giorno in cui arriva dalla loro. Questo è il ponte pratico per chiunque voglia testare subito il pattern dei subagent: una cascata che manda i turni di routine a Haiku 4.5 e fa salire di livello quelli difficili funziona già oggi con una sola chiave e un solo SDK, e sostituire il ramo piccolo con Haiku 5.5 in un secondo momento è un cambio di model-id, non una migrazione. Il failover automatico sta alla base di qualunque ramo tu scelga, così un pomeriggio storto di un singolo fornitore non si porta dietro la pipeline.

Se preferisci non aspettare affatto, la stessa fascia di input da $0,10 è già occupata da GPT-6 Luna, che noi instradiamo, e che mantiene quella tariffa fino a 272.000 token prima di aumentare.

Chi dovrebbe muoversi, e chi no

Se il tuo carico di lavoro consiste in classificazione, estrazione, routing, compattazione o sintesi ad alto volume, e i tuoi prompt restano sotto i 100.000 token, il caso è semplice: la tariffa è un decimo di quella di prima, la finestra è cinque volte più ampia e il selettore dello sforzo ti permette di fare il compromesso opposto quando una richiesta ne ha bisogno. Prevedi un budget inferiore di circa il 75% e non avrai sorprese.

Se i tuoi prompt superano regolarmente i 100.000 token, stai ottenendo uno sconto del 50% anziché del 90%, e confrontare le offerte per il contesto profondo vale ancora la pena di dedicarci un pomeriggio — il settore ha diversi modelli a una tariffa pari o inferiore a quella over-100K di questo livello.

E se la tua eval continua a fallire su compiti modellati su Terminal-Bench, questo non è il modello che lo risolve; lo dice Anthropic stessa, e il 39,2% contro il 70,6% di Sonnet 5.5 è la prova più chiara nel post. Il riassunto onesto del 7 ottobre è che il livello minimo dell'intelligenza utile è calato parecchio e il tetto non si è mosso affatto.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno