
Claude Haiku 5.5 in OpenCode Go: cosa ti dà davvero 10 $ al mese
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Anthropic ha rilasciato Claude Haiku 5.5il 7 ottobre 2026 e nel giro di un giorno è stato inserito nei cataloghi Go e Zen di OpenCode — gli abbonamenti per agenti di coding che misurano una quota mensile in dollari invece di fatturare a token. È proprio su questo secondo inserimento che vale la pena soffermarsi, perché la quota che OpenCode pubblica per Claude Haiku 5.5non è uno sconto sul modello. È un contatore di budget impostato al prezzo di listino di Anthropic, e ogni cifra che ci sta dietro può essere verificata sulle due pagine che la pubblicano. Se stai ancora decidendo cosa usare al posto di Claude Haiku 4.5, la quota è la decisione, non il cartellino del prezzo.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Cosa ha messo a verbale Anthropic il 7 ottobre
Il fornitore non l'ha lanciato in sordina. La newsroom di Anthropic contiene un annuncio datato, una pagina prodotto con una tabella di benchmark, una system card, una tabella dei prezzi e sei citazioni di clienti con nome e cognome. Non c'è alcun repository né alcun rilascio di pesi da esaminare, perché non c'è nulla da rilasciare: Artificial Analysis registra Claude Haiku 5.5 come proprietario, con il numero di parametri non divulgato. Chiunque lo descriva come un modello trapelato o non annunciato sta leggendo un repository che non esiste.
L'inquadramento di Anthropic stesso è quello di un modello di volume anziché di frontiera:
• Posizionamento — "il modello piccolo più economico, veloce e capace che abbiamo mai rilasciato", pensato per riassunti, compattazioni, query su database e classificazione, e proposto come subagente che si affianca a Claude Opus 5.5 e Claude Sonnet 5.5 nel lavoro di programmazione.
• Prezzo — 0,10 $ per milione di token di input e 0,50 $ per milione di token di output per prompt fino a 100.000 token; 0,50 $ e 2,50 $ oltre tale soglia. Letture dalla cache 0,01 $ / 0,05 $, scritture nella cache 0,125 $ / 0,625 $.
• Contesto e output — una finestra da 1M di token con un output massimo di 128.000 token, lo stesso envelope dei modelli di fascia 5.5 più grandi, riprodotto sul livello più economico.
• Effort — il primo modello della classe Haiku con un'impostazione di effort regolabile, da Low a Max, con valore predefinito medium. Anthropic pubblica curve accuratezza-costo per ciascuna impostazione anziché un unico numero.
• Benchmark, dichiarati dal fornitore e non riprodotti in modo indipendente — GDPval-AA v2.1 1620 contro i 735 di Claude Haiku 4.5; AA-Briefcase v1.1 1578 contro 614; OSWorld 2.1 72,4% contro 15,7%; Humanity's Last Exam 45,9% senza strumenti e 57,4% con essi, contro 10,2% e 18,7%; Terminal-Bench 4.0 39,2% contro 0,0%; Chartography 46,4% contro 6,4%.
• Il tetto del fornitore stesso — il commento di Anthropic sul suo grafico Terminal-Bench dice che Claude Sonnet 5.5 e Claude Opus 5.5 "rimangono scelte migliori per compiti complessi di coding agentico". Le citazioni dei clienti nello stesso post sono partner con accesso anticipato che descrivono le proprie valutazioni, non audit: Asana riporta una latenza inferiore di oltre il 30% e un'inferenza fino a 2,5 volte più veloce per turno di agente, HubSpot 92,8% in media su tre esecuzioni, AlphaSense 0,84 contro 0,76 su 400 query su un carico di lavoro di circa 8 milioni di chiamate a settimana, Box 11 punti in più a circa metà della latenza, e Cognition un punteggio FrontierCode di 66,2 con Haiku 5.5 come spalla.

Anthropic ha inoltre approfittato del lancio per ritoccare due prezzi adiacenti: le letture dalla cache su Claude Sonnet 5.5 sono state dimezzate a $0.10 per milione di token, il che, secondo l'azienda, rende Sonnet 5.5 circa il 20% più economico sulla maggior parte del lavoro agentico, e un nuovo credito API mensile per gli abbonati a Claude Max e Team. Entrambi sono cambiamenti al tier superiore, ed entrambi contano di più per un team già standardizzato su Sonnet che per chiunque cerchi un modello piccolo.
L'indennità è un budget in dollari, non uno sconto
Ecco la parte che il tweet di annuncio non dice. La documentazione Go di OpenCode afferma che «i limiti di utilizzo sono definiti come importi mensili in dollari», che il prezzo dei token è lo stesso su entrambi i piani e che la quota di ciascun modello si riduce secondo un programma fisso: 20% del limite mensile ogni cinque ore, 50% a settimana, 100% al mese. La documentazione pubblica anche il profilo di token per richiesta che presume per questo modello — 1.100 token di input, 55.000 token in cache, 240 token di output.
Fai passare quei dati per il prezzo di listino di Anthropic e i conteggi delle richieste pubblicati smettono di sembrare un'allocazione arbitraria:
• Costo per richiesta al prezzo di listino — 1.100 input a $0,10/M più 55.000 letture dalla cache a $0,01/M più 240 output a $0,50/M ammonta a $0,00078.
• Il conteggio mensile delle richieste — 15 $ diviso per 0,00078 $ dà 19.230, che è il numero riportato dalla documentazione. La quota di 60 $ del piano da 40 $ dà come risultato 76.923, mentre la documentazione riporta 76.920.
• La riduzione graduale — il 20% di 19.230 è 3.846, indicato come 3.850 ogni cinque ore; il 50% è 9.615, indicato come 9.620 a settimana. Go Plus segue la stessa aritmetica con 15.380 e 38.460.
• Cosa significa in dollari: la quota vale 15 $ di token al prezzo di Anthropic sul piano da 10 $ e 60 $ sul piano da 40 $. Un abbonamento da 10 $ acquista quindi al massimo 15 $ al mese di token di questo modello se spendi l'intera quota su Claude Haiku 5.5 e nient'altro.
È questo il modo onesto di leggere il badge "Nuovo" sulla pagina Go. L'abbonamento costa poco, il modello costa poco, e i due fatti sono indipendenti: la quota è un budget a consumo alla tariffa del fornitore stesso, quindi il piano limita quanto puoi spendere, non quanto poco costa il modello. Gli utenti intensivi raggiungono il tetto e pagano direttamente Anthropic — oppure instradano il modello da soli.

Novanta per cento, settantacinque per cento e il precipizio delle cinque volte
Il titolo di Anthropic è che Claude Haiku 5.5 costa circa il 90% in meno rispetto a Claude Haiku 4.5 per prompt fino a 100.000 token, e che in media "ora costa circa il 75% in meno da eseguire". Entrambi i numeri sono del fornitore. Sono anche entrambi corretti, e il divario tra loro costituisce l'intero rischio di prezzo.
All'interno della fascia — $0.0 in input e $0.50 in output, rispetto ai $1 e $5 fissi di Haiku 4.5. Anthropic afferma che circa il 90% delle richieste al suo modello Haiku rientrava in questa fascia, da cui deriva il dato del 90%.
• Al di sopra della fascia — la stessa richiesta viene fatturata a $0,50 in input e $2,50 in output, un balzo di cinque volte sull'input. Resta comunque la metà della tariffa di Haiku 4.5, ma non è neanche lontanamente un taglio del 90%.
• L'affermazione combinata — il dato del 75% è una stima propria di Anthropic su un mix reale di traffico, non un listino prezzi, ed è il numero da inserire in una previsione.
• Il tokenizer — il tokenizer più recente, condiviso con Claude 4.7 e versioni successive, produce circa il 30% in più di token per lo stesso testo, secondo la documentazione di Anthropic stessa, quindi un taglio per token non si traduce uno a uno in una bolletta più bassa.
Il selettore dell'effort amplifica tutto questo. Poiché il valore predefinito è medium e le curve pubblicate arrivano fino a Max, lo stesso prompt può costare diverse volte tanto a seconda di un parametro che la maggior parte dei chiamanti non imposta mai — e le stime delle richieste di OpenCode presuppongono un unico profilo di token fisso a un'unica impostazione implicita. Se i tuoi prompt si aggirano intorno ai 100.000 token, esegui un subagent a utilizzo limitato oppure sposti il selettore dell'effort, il 90% del titolo non è il numero che vedrai.
Il consiglio indipendente concorda sul punteggio e segnala i propri calcoli.
Artificial Analysis assegna un punteggio a Claude Haiku 5.5 di 43 sul suo Intelligence Index v4.3.2 nella configurazione Max del modello, rispetto a una mediana della classifica di 13, e misura 241,9 token di output al secondo rispetto a una mediana di 110,9 per modelli comparabili. La stessa pagina colloca il costo a 0,21 $ per attività dell'Intelligence Index e riporta che il modello ha generato 440 milioni di token di output durante la valutazione, contro una mediana di 100 milioni, descrivendolo come «molto verboso».
La verbosità è il punto in cui le due classifiche interagiscono. Il calcolo della quota indicato sopra viene addebitato per token, quindi un modello che ragiona a lungo consuma il budget più rapidamente di quanto suggerisca il conteggio delle richieste, e il profilo per richiesta di OpenCode di 55.000 token in cache è un'assunzione sul prompt caching che un utente con abbonamento può o non può riprodurre. Due informazioni rivelate nella pagina di Artificial Analysis valgono più del suo titolo: il 43 è la configurazione Max anziché l'impostazione di sforzo che si ottiene non facendo nulla, e la pagina riporta una nota esplicita secondo cui Claude Haiku 5.5 "ha un prezzo 5 volte più alto sugli input a contesto più lungo, che al momento non sono riflessi" nelle sue cifre di costo. Il precipizio del contesto lungo è reale, e la classifica indipendente ti ha detto che non è ancora nei suoi stessi numeri.

La riga sulla retention che la maggior parte degli acquirenti salterà
La documentazione Go di OpenCode contiene una tabella sulla privacy per modello, e questa è la riga in cui Claude Haiku 5.5 si differenzia dalla maggior parte del catalogo. La formulazione del fornitore stesso parla di conservazione zero con eccezioni. La maggior parte dei modelli in quella tabella Go riporta "0 giorni". Questo riporta "30 giorni", con la nota che le richieste vengono conservate per 30 giorni in conformità con le politiche sui dati di Anthropic — lo stesso trattamento che riserva a GPT-6 Luna e GPT-5.6 Luna, e l'opposto delle righe a zero giorni che costituiscono la maggior parte dell'elenco.
Per un agente di programmazione, ciò significa che prompt, percorsi dei file e codice sorgente incollato possono rimanere presso il fornitore upstream per un mese, su un piano il cui linguaggio di marketing è «zero retention». Non è un motivo per evitare il modello; è un motivo per leggere la riga invece del banner. Nel frattempo, nulla nei materiali di lancio di Anthropic cambia la posizione lato API: l'API Claude offre la zero data retention, e i termini di conservazione della model card sono quelli che disciplinano un'integrazione diretta.
Cosa è confermato, e cosa no.
L'insieme confermato è ampio e specifico, il che è insolito per un modello così nuovo. Ciò che non è confermato è più ristretto, e vale la pena nominarlo anziché sorvolare:
Confermato — il modello esiste, è disponibile esclusivamente via API con l'id claude-haiku-5-5, rilasciato il 7 ottobre sulla Claude API, oltre che su Amazon Web Services, Google Cloud e Microsoft Azure, ai prezzi sopra indicati, con una finestra di 1M di token, effort regolabile e una system card pubblicata.
• Confermato — due piattaforme di terze parti lo hanno in elenco con ID dei modelli, endpoint e quote a consumo lo stesso giorno.
• Non confermato — non abbiamo trovato alcun benchmark indipendente che abbia riprodotto la tabella del fornitore. Ogni cifra di accuratezza nel post di lancio di Anthropic proviene dall'harness di Anthropic stesso, e ogni citazione di cliente è una testimonianza autodichiarata di un partner relativa ai primi test.
• Non confermato — non ci sono pesi, né repository, né checkpoint né licenza da esaminare. Il modello è chiuso, e qualsiasi affermazione sulla sua architettura o dimensione è un'inferenza.
• Non confermato — se le stime delle richieste della piattaforma valgono per qualcosa di diverso dal profilo di token ipotizzato, e se (o quando) il prezzo 5x per il contesto lungo entra nelle cifre di costo delle classifiche indipendenti.
Eseguirlo accanto a ciò che già chiami
La domanda pratica che questo lancio crea non è «Haiku 5.5 è buono?» — la tabella del fornitore dice di sì, e nessuno al di fuori di Anthropic ha verificato. È «qual è il conto, e cosa succede quando il livello economico non è il livello giusto per questa particolare chiamata». Entrambe le metà sono problemi di routing.
Sul costo, il metro è la bolletta dei token, non il prezzo di listino: un taglio del 90% dell'input più un tokenizer più grande del 30% più un modello di ragionamento verboso più un passo di contesto lungo quintuplicato significa che il numero che prevedi e il numero che paghi divergono a meno che tu non misuri la tua distribuzione della lunghezza dei prompt. Un modello che costa 5 volte tanto oltre i 100.000 token premia la compattazione — e Haiku 5.5 è esso stesso presentato come il modello di compattazione, il che è un loop che vale la pena notare.
Sul rischio, un tier non comprovato è esattamente il caso in cui non conviene puntare su di esso un percorso di produzione. Claude Haiku 4.5 è già su OrcaRouter al prezzo di listino di Anthropic con 0% di markup, quindi il vecchio tier non richiede un nuovo contratto, e una route che fa fallback da un nuovo modello a uno noto è una modifica di configurazione, non una riscrittura. Il parametro effort è per chiamata, il che significa che lo stesso endpoint può eseguire un riassunto a effort basso e un'estrazione complessa a effort alto senza mantenere due integrazioni — il DSL di routing esiste proprio per questo tipo di decisione, e il failover automatico è ciò che ti permette di mettere un modello vecchio di giorni davanti al traffico reale prima di avere dati indipendenti su di esso. Ciò che non è ancora vero è la cosa ovvia: Claude Haiku 5.5 non è sulle nostre route oggi, e se lo vuoi questa settimana stai chiamando Anthropic direttamente o passando attraverso la piattaforma che l'ha annunciato.
Chi dovrebbe passare: i team il cui volume è fatto di riepiloghi, classificazione, compattazione e lavoro di subagenti, dove si applica la fascia del 90% e il 30% del tokenizer è aritmetica che potete assorbire. Chi dovrebbe aspettare: chiunque abbia prompt che superano abitualmente i 100.000 token, chiunque abbia bisogno di un benchmark indipendente prima di impegnarsi e chiunque abbia codice che non può stare in una finestra di conservazione di 30 giorni. Il lancio è reale e il prezzo è reale. La prova è ancora del fornitore.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
