
Claude Haiku 5.5 è ora in GitHub Copilot: quanto costa il modello Anthropic più economico all'interno di un budget di crediti
- OrcaNUOVOOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 per 1M di token · 71 tok/s
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 389 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
Claude Haiku 5.5 è apparso nel selettore dei modelli di GitHub Copilot il 7 ottobre 2026 — lo stesso giorno in cui il fornitore lo ha rilasciato — e la voce del changelog che lo ha annunciato dedica gran parte della sua lunghezza alle superfici. Visual Studio Code, Visual Studio, Copilot CLI, l'agente cloud di GitHub Copilot, l'app Copilot, github.com, GitHub Mobile su iOS e Android, gli IDE JetBrains, Xcode, Eclipse. La frase che conta se gestisci il budget è più breve: il modello viene fatturato «al prezzo di listino del fornitore con fatturazione basata sull'utilizzo». All'interno di Copilot, questo significa crediti AI, e le tariffe di Claude Haiku 5.5 sono così basse che l'aritmetica dei crediti diventa la parte interessante del lancio anziché un dettaglio secondario. Questo articolo esegue quel calcolo, separa ciò che GitHub ha effettivamente dimostrato da ciò che ha soltanto asserito, e copre due eccezioni nella documentazione dello stesso fornitore che i resoconti del lancio hanno in gran parte trascurato.
Cosa ha rilasciato GitHub, e a chi
La voce è intitolata, semplicemente, "Claude Haiku 5.5 in GitHub Copilot", ed è stata pubblicata alle 13:12 ora del Pacifico del 7 ottobre. È disponibile per gli abbonati a Copilot Pro, Pro+, Max, Business ed Enterprise — vale a dire tutti i livelli a pagamento, e in particolare non il livello gratuito, dove la selezione del modello è ancora gestita automaticamente anziché dall'utente. Il rilascio è graduale, quindi il selettore nel tuo editor può arrivare con giorni di ritardo rispetto al changelog; questo è dichiarato nella voce anziché essere lasciato a te da scoprire.
Il modo in cui GitHub stessa inquadra lo scopo del modello merita una lettura attenta, perché è più ristretto di quello del fornitore:
• Lavoro rapido e ad alto volume — subagent, modifiche rapide e attività da terminale, per usare le parole di GitHub • Non è posizionato come sostituto dei modelli di grandi dimensioni nel selettore, ma come il livello economico al di sotto di essi • Disponibile a livello generale, secondo il riferimento dei modelli supportati di GitHub, che elenca Claude Haiku 5.5 come disponibile a livello generale, con stato GA • Compare anche in quel riferimento con una riga relativa alla versione IDE contrassegnata come TBD, ed è questo il motivo pratico per cui il rollout appare graduale dal lato dell'editor • Prezzo al listino del provider con fatturazione basata sull'utilizzo, anziché con un ricarico specifico di Copilot img src="2.png"> p>Le date del changelog circostanti forniscono il contesto sulla cadenza che una singola pagina di modello non può dare. Claude Sonnet 5.5 è arrivato in Copilot il 28 settembre, Claude Opus 5.5 il 22 settembre e Claude Fable 5.1 il 1° settembre. Anthropic rilascia un'integrazione con Copilot all'incirca ogni due-quattro settimane e GitHub ne completa ciascuna nel giro di pochi giorni. È anche per questa cadenza che qui c'è un conto alla rovescia: a metà settembre GitHub ha pubblicato un avviso di deprecazione per «modelli GitHub Copilot selezionati» a metà ottobre, e poi un seguito il 2 ottobre che confermava le rimozioni. Se il tuo team fissa un modello in una configurazione di Copilot, ora è il pin la cosa che rischia più probabilmente di rompersi, non il prezzo.

Il listino prezzi, letto come un registro dei crediti
Claude Haiku 5.5 viene fatturato su due fasce, attivate in base alla dimensione della richiesta anziché a un'impostazione scelta da te. Tutto ciò che segue è il tariffario pubblicato da GitHub stesso, e tutto è espresso per milione di token:
• A 100.000 token o meno in input — $0,10 input, $0,01 input in cache, $0,125 scrittura cache, $0,50 output • Oltre 100.000 token in input — $0,50 input, $0,05 input in cache, $0,625 scrittura cache, $2,50 output • Claude Haiku 4.5, per contrasto — $1,00 input, $0,10 input in cache, $1,25 scrittura cache, $5,00 output • Claude Sonnet 5.5, il livello superiore — $2,00 input, $0,10 input in cache, $2,50 scrittura cache, $10,00 output • Le scritture in cache vengono fatturate separatamente sui modelli Anthropic, in aggiunta all'input in cache — una voce che non esiste per tutti i fornitori nel selettore img src="3.png"> p>Due cose emergono leggendo quelle righe insieme. Primo, il livello breve di Claude Haiku 5.5 è esattamente dieci volte più economico di Claude Haiku 4.5 sia sull'input sia sull'output, e circa venti volte più economico sull'input rispetto a Claude Sonnet 5.5 — che è l'intera ragione per cui appartiene agli slot dei subagent, dove una flotta di piccole chiamate moltiplica qualunque cosa si paghi per chiamata. Secondo, il livello a contesto lungo è esattamente cinque volte quello breve su ogni tariffa contemporaneamente, alla stessa soglia di 100.000 token. Una richiesta da 99.000 token e una da 101.000 token non sono distanti del 2 percento sui token che hanno superato la soglia; sono distanti cinque volte su tutti quanti. Quel salto è ereditato direttamente dal prezzo di listino di Anthropic, e il sistema di crediti di Copilot non lo attenua.

Ora i crediti. La fatturazione basata sull'utilizzo di Copilot converte l'utilizzo dei modelli in crediti AI a un tasso documentato di 0,01 $ per credito, e ogni piano include una dotazione mensile:
• Copilot Pro, 10 $ al mese — 1.500 crediti, indicati come 1.000 di base più 500 flessibili • Copilot Pro+, 39 $ al mese — 7.000 crediti, indicati come 3.900 di base più 3.100 flessibili • Copilot Max, 100 $ al mese — 20.000 crediti, indicati come 10.000 di base più 10.000 flessibili • Copilot Business, 19 $ per posto al mese — 1.900 crediti per utente • Copilot Enterprise, 39 $ per posto al mese — 3.900 crediti per utente • I pool di organizzazione e impresa sono condivisi tra i posti anziché suddivisi in silos per utente • L'utilizzo oltre il pool viene fatturato a 0,01 $ per credito — la stessa conversione, applicata all'eccedenza • I completamenti di codice e i suggerimenti di modifica successiva restano del tutto fuori dalla fatturazione a crediti e rimangono illimitati nei piani a pagamento p>Mettendo insieme le due cose, la forma del lancio diventa concreta. Prendiamo un passo di agente di dimensioni moderate — 40.000 token di input, 2.000 token di output, nessuna cache. Sul livello breve di Claude Haiku 5.5 sono 40.000 per 0,10 $ al milione più 2.000 per 0,50 $ al milione, ovvero 0,005 $, che secondo la conversione documentata corrisponde a mezzo credito. La stessa identica chiamata con le tariffe di Claude Haiku 4.5 arriva a 0,05 $, ovvero cinque crediti. L'aritmetica qui è nostra, non di GitHub, ma gli input provengono tutti dal listino prezzi pubblicato, e la conclusione non è sottile: il pool di 1.500 crediti di un abbonato Pro assorbe all'incirca 3.000 chiamate di questo tipo con il nuovo Haiku, mentre con quello vecchio ne assorbiva all'incirca 300. Il pool diventa dieci volte più capiente senza che l'abbonamento cambi.
Questa è la proposta di valore onesta, e comporta l'avvertenza altrettanto onesta che il pool è espresso in crediti anziché in dollari, per cui il tetto reale di un piano si sposta ogni volta che cambia un listino. Una riduzione di dieci volte su un modello non estende di dieci volte un pool se il tuo traffico è distribuito su tre.
Ciò che GitHub afferma che il modello faccia, e ciò che non ha mostrato
Il changelog contiene un'unica affermazione sulle prestazioni, e nella copertura sta facendo più lavoro di quanto possa reggere. GitHub scrive che nei primi test Claude Haiku 5.5 «ha eguagliato Claude Sonnet 5 su molti compiti di programmazione» pur usando «significativamente meno token e passaggi».
Leggi i qualificatori in ordine. Si tratta di test preliminari. Sono test di GitHub, su attività di GitHub, e GitHub è la parte che vende l'integrazione. Non viene nominato alcun harness, non viene pubblicato alcun set di attività, nessuna cifra accompagna nessuna delle due metà della frase, e "many" non è un numero. L'affermazione potrebbe benissimo essere vera — un modello piccolo che eguaglia uno grande su attività di coding ristrette e modellate sugli strumenti è un risultato plausibile nel 2026 — ma così come pubblicata è un'asserzione di un fornitore, e dovrebbe essere etichettata come tale ogni volta che viene ripetuta. La metà "meno token e passaggi" è la più duratura delle due, perché è un'affermazione sull'efficienza più che sulla capacità, e l'efficienza al prezzo di Haiku si manifesta nella tua telemetria d'uso entro una settimana. La metà sulla capacità richiede un harness di terze parti prima di finire in una slide.
I numeri di Anthropic sono un'affermazione distinta da quella di GitHub e presentano lo stesso problema di provenienza. Anthropic afferma che Claude Haiku 5.5 costa in media circa il 75% in meno da eseguire e che circa il 90% delle richieste precedentemente inviate a un modello della classe Haiku rientra sotto i 100.000 token, dove il modello è «particolarmente conveniente». In entrambi i casi è il fornitore che descrive l'economia del proprio prodotto. Sono coerenti con il listino prezzi pubblicato — un forte taglio per il livello breve, uno minore per quello lungo — e sono utili come indicazioni del fornitore più che come risultato misurato.
Attivarlo è una decisione dell'amministratore, e l'impostazione predefinita è sì.
La parte del changelog che gli acquirenti di Copilot Business ed Enterprise dovrebbero leggere due volte è il paragrafo sul controllo degli accessi. Gli amministratori gestiscono l'accesso ai modelli tramite i criteri dei modelli nelle impostazioni di Copilot, e il comportamento predefinito documentato da GitHub è che i nuovi modelli vengono abilitati automaticamente, a meno che un amministratore non abbia disattivato l'impostazione predefinita globale o disabilitato esplicitamente quel modello specifico. L'impostazione predefinita è permissiva; la restrizione è di tipo opt-out.
Ne conseguono due cose. Se la tua organizzazione ha una governance rigorosa dei modelli, Claude Haiku 5.5 potrebbe già essere selezionabile dai tuoi sviluppatori senza che nessuno l'abbia approvato per nome. E se invece la tua organizzazione ha già disabilitato il default globale, il modello non ti apparirà, qualunque cosa dica il changelog — che è la spiegazione più probabile per la domanda di supporto più comune nella prima settimana di qualsiasi lancio di un modello Copilot. Prima di fare debug di una voce mancante nel selettore, controlla la policy del modello.
Due eccezioni che la documentazione di Anthropic riporta e che i post di lancio non riportavano.
Entrambi questi elementi provengono dalla documentazione della piattaforma di Anthropic anziché da qualsiasi copertura giornalistica, ed entrambi influiscono su ciò che puoi costruire anziché su ciò che paghi:
• Priority Tier non è disponibile su Claude Haiku 5.5 — la documentazione di Anthropic sui livelli di servizio nomina il modello nella sua lista di esclusione esplicita, insieme a Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 e la linea Mythos. Se la tua architettura presuppone throughput con provisioning sul livello economico, questa ipotesi non vale qui. • L'intera finestra di contesto da 1 milione di token al prezzo standard è concessa a "Claude 4.6 e modelli successivi (tranne Claude Haiku 5.5)" — la parentesi è di Anthropic, e Claude Haiku 5.5 è l'unico modello attuale escluso. La finestra è ancora pubblicizzata nella riga delle specifiche del modello come 1M, con un output massimo di 128.000 token; ciò che l'esclusione significa è che non devi interpretare la garanzia globale di prezzo per contesto lungo come applicabile a questo modello. • Il tokenizer è cambiato. Anthropic afferma che i modelli Claude 4.7 e successivi usano un tokenizer più recente che produce circa il 30% in più di token per lo stesso testo, il che significa che il prezzo per token e il prezzo per pagina del tuo testo si sono mossi in direzioni opposte. La riga delle specifiche di Claude Haiku 5.5 elenca "Fastest" come sua posizione, un'impostazione predefinita di adaptive thinking su medio, una data di cutoff delle conoscenze giugno 2026 e un ID del modello claude-haiku-5-5.
Nessuno di questi rappresenta un ostacolo insormontabile per i carichi di lavoro di subagent e di modifica rapida ai quali GitHub sta indirizzando il modello. Sono la differenza tra il citare un post di lancio e il citare la documentazione, e la seconda è ciò che sopravvive al contatto con un test di carico.
Se preferisci instradarlo anziché cambiare strumento
C'è un buon motivo per chiamare Claude Haiku 5.5 dal proprio stack invece che solo tramite un abbonamento chat-and-editor: si ottengono le tariffe grezze dello short-tier senza una conversione in crediti nel mezzo, e si mantiene la decisione di routing nel proprio codice. Il quadro della disponibilità, detto in parole semplici, è che Anthropic lo vende tramite la Claude Platform e attraverso Amazon Bedrock, Vertex AI e Microsoft Azure — e non è ancora nel nostro catalogo. OrcaRouter include oggi Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 e Claude Fable 5.1 in un catalogo di 200 modelli, e Claude Haiku 5.5 non è tra questi. Per il modello in sé, al momento, chiama Anthropic o una delle tre cloud direttamente.

Dove ci inseriamo è il livello attorno a esso. OrcaRouter trasferisce il prezzo di listino del provider senza alcun ricarico, quindi quando un fornitore ha riprezzato un modello — come ha fatto Anthropic su questo — la nuova tariffa è attiva dalla nostra parte lo stesso giorno, invece che dopo un ciclo di fatturazione. Il failover automatico fa sì che una chiamata di fascia economica che genera errore finisca su una rotta funzionante invece di far fallire la richiesta, il che conta più per una flotta di subagent che effettua migliaia di piccole chiamate che per una singola sessione interattiva. E il DSL di routing esiste proprio per il tipo di decisione che questo lancio crea: inviare lavoro breve e ad alto volume al modello più economico sotto la soglia e lavoro a contesto lungo a quello più economico sopra di essa, da un unico endpoint su un'unica fattura, invece di codificare quella separazione in due integrazioni. Se Haiku 5.5 arriva nel catalogo, si inserisce in quella policy senza modifiche al codice.
Cosa fare con questo prima del prossimo sprint
La lettura più ristretta è che il modello attuale più economico di Anthropic è ora selezionabile in ogni livello a pagamento di Copilot ed è circa dieci volte più economico per token rispetto all'Haiku che sostituisce nel livello breve. Se il tuo team esegue subagenti o automazioni in stile terminale tramite Copilot, cambiare modello è una modifica alle impostazioni con un effetto ampio e immediato su quanto può durare un pool di crediti mensile.
Le due cose che vale la pena verificare per prime sono quelle che l'annuncio seppellisce. Guarda il 95° percentile delle dimensioni delle tue richieste: se si colloca sopra i 100.000 token, il tier su cui vieni effettivamente fatturato è il secondo, e il confronto di dieci volte è in realtà di cinque. E controlla se la policy modelli della tua organizzazione ha l'impostazione predefinita globale attivata — per le licenze Business ed Enterprise, quella singola impostazione decide se questo lancio è disponibile o meno per i tuoi sviluppatori.
trasferisce il prezzo di listino del fornitore senza alcun ricarico
