Una hero card generata intitolata 'Claude Haiku 5.5 vs GPT-5.6 Luna' con il kicker 'METÀ DEL PREZZO, PIÙ PER RISPOSTA', che mostra Claude Haiku 5.5 a Input $0.10, Output $0.50 e Indice 43.40 contro GPT-5.6 Luna a Input $0.20, Output $1.20 e Indice 37.32, su una barra che riporta 'Costo per attività completata $0.21 vs $0.18'.
Engineering & Research

Claude Haiku 5.5 vs GPT-5.6 Luna: metà del prezzo di listino, 19% in più per attività completata

Autore

Magnus Corvin

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

L'allineamento di prezzo di cui tutti hanno scritto è reale, e non è con questo modello. Claude Haiku 5.5, che il fornitore ha lanciato il 7 ottobre 2026, ha un prezzo di listino di 0,10 $ per milione di token di input e 0,50 $ per milione di token di output fino a prompt da 100.000 token. GPT-5.6 Luna, il livello ottimizzato per i costi del 9 luglio 2026, ha un prezzo di listino di 0,20 $ e 1,20 $. Quindi la tariffa del fornitore è esattamente la metà di quella del modello più vecchio su entrambe le metriche — ed è esattamente uguale a GPT-6 Luna, il successore che lo ha sostituito il 22 settembre 2026 e che è il modello rispetto al quale il post di lancio dello stesso fornitore esegue i benchmark.

È uno strano punto di osservazione da cui scrivere un confronto, quindi vale la pena essere precisi su a cosa serva questo confronto. GPT-5.6 Luna è l'unico dei due a essere deprecato sulla board indipendente, non è più la Luna nel listino prezzi di punta di OpenAI, ed è ancora la Luna che troverai in molto codice di integrazione oggi. Confrontarlo con Claude Haiku 5.5 è una questione che riguarda una migrazione che potresti già dover fare, non una questione su quale dei due modelli attuali chiamare.

E la risposta alla domanda ovvia è la parte interessante. Nella stessa esecuzione di valutazione indipendente, un task completato dell'Intelligence Index costa 0,21 $ su Claude Haiku 5.5 e 0,18 $ su GPT-5.6 Luna. Metà del prezzo per token, il 19% in più per risposta.

Le due schede tariffarie

Per milione di token in dollari statunitensi. Le tariffe di Anthropic e OpenAI provengono dalla loro documentazione; i punteggi condivisi sono Artificial Analysis Intelligence Index v4.3.2, letti in data 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs GPT-5.6 Luna — the scoreboard' with rows Index v4.3.2 43.40 against 37.32, cost per task $0.21 against $0.18, input price $0.10 against $0.20, output price $0.50 against $1.20, Terminal Bench 4.0 0.3283 against 0.1162 and status 'current, API only' against 'superseded by GPT-6 Luna', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; prices per vendor documentation.'

• Input — Claude Haiku 5.5: 0,10 $ fino a 100.000 token e 0,50 $ oltre; GPT-5.6 Luna: 0,20 $, che raddoppia a 0,40 $ per richieste superiori a 272.000 token.

• Output — Claude Haiku 5.5 0,50 $ fino a 100.000 token e 2,50 $ oltre; GPT-5.6 Luna 1,20 $, che sale a 1,80 $ sul percorso a contesto lungo.

• Input in cache — Claude Haiku 5.5 $0.01 e $0.05, uno sconto del 90%; GPT-5.6 Luna $0.02, anch'esso del 90%, più un costo di scrittura in cache di $0.25.

• Contesto — 1M token per Claude Haiku 5.5 e 1.050.000 per GPT-5.6 Luna. Entrambi limitano una singola risposta a 128.000 token, e OpenAI pubblica una data limite delle conoscenze al 16 febbraio 2026 per il suo modello.

• Controllo del ragionamento — Claude Haiku 5.5 espone un selettore dell'impegno da Low a Max, con medium come impostazione predefinita; GPT-5.6 Luna espone sei impostazioni, none / low / medium (predefinita) / high / xhigh / max.

• Punteggio indipendente — 43,40 per Claude Haiku 5.5 (Max) contro 37,32 per GPT-5.6 Luna (Max), un divario di 6,07 punti su una classifica di 182 modelli.

• Stato — Claude Haiku 5.5 è attuale, proprietario, solo API. GPT-5.6 Luna riporta un flag di deprecazione sulla board indipendente e non occupa più una riga nella tabella dei prezzi di punta di OpenAI.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the two-tier pricing lines and 'Released October 7, 2026'.

Metà del prezzo, più caro per risposta

L'aritmetica del listino qui è insolitamente favorevole ad Anthropic — un netto 2x su entrambi i contatori nel regime dei prompt brevi — quindi è il risultato per singolo compito quello che va spiegato.

Claude Haiku 5.5 emette 162.164 token di output per attività dell'Indice di Intelligenza, divisi in 129.047 di ragionamento e 33.118 di risposta. GPT-5.6 Luna ne emette 41.235, divisi in 28.098 di ragionamento e 13.136 di risposta. Il modello di Anthropic spende 3,9 volte tanti token per lo stesso lavoro e, a metà della velocità di output, questo lo rende il 19% più costoso per attività completata. Il vantaggio di velocità e lo svantaggio di verbosità sono entro un fattore due l'uno dall'altro, quindi si annullano quasi del tutto — e il residuo va a favore di OpenAI.

I due costi per attività sono vicini, ma il modo in cui ciascuno è composto non lo è. I 0,1783 $ per attività di GPT-5.6 Luna sono composti all'incirca per metà da scritture in cache e per un quarto da output; i 0,2128 $ di Claude Haiku 5.5 sono 0,1317 $ di input — in gran parte letture dalla cache — più 0,0811 $ di output. Nessuno dei due modelli è costoso in termini assoluti, e lo sono in punti diversi, ed è questo che fa convergere i totali per attività mentre i listini tariffari distano di un fattore due.

Questo è lo stesso effetto che rende in generale inaffidabile un confronto per token dei modelli di ragionamento, e vale la pena dirlo chiaramente: un contatore economico si moltiplica con un budget di token elevato, e il prodotto è ciò che paghi. Le stesse note di lancio di Anthropic sono schiette su questo, affermando che Claude Haiku 5.5 è "particolarmente conveniente se utilizzato per attività con prompt fino a 100.000 token, che costituiscono circa il 90% delle richieste al nostro precedente modello Haiku".

La matematica del mix racconta la stessa storia dalla direzione opposta. Sul mix 7:2:1 a prevalenza di input di Artificial Analysis — la conformazione che ha realmente la maggior parte del traffico di produzione — Claude Haiku 5.5 arriva a $0,077 per milione di token contro $0,174 per GPT-5.6 Luna. È il 2,26x che ci si aspetterebbe dal prezzo di listino. È solo quando si pesa il contatore dell'output come fa un carico di lavoro di ragionamento che i due convergono, e oltre i 100.000 token si incrociano.

Il limite dei 100.000 token contro quello dei 272.000 token

Entrambi i fornitori riprezzano le richieste lunghe, e le soglie differiscono di più di due volte e mezzo.

La soglia di Anthropic è a 100.000 token di input. Oltre tale soglia, le tariffe di Claude Haiku 5.5 diventano $0,50 in input e $2,50 in output — cinque volte la tariffa per prompt brevi, applicata all'intera richiesta. La soglia di OpenAI è a 272.000 token di input. Oltre tale soglia, le tariffe di GPT-5.6 Luna diventano $0,40 in input e $1,80 in output — 2x l'input e 1,5x l'output, anch'esse applicate all'intera richiesta.

Quindi il crossover non è una convergenza lenta; è un salto. Un prompt di retrieval da 120.000 token ricade nella fascia lunga di Anthropic e si colloca comodamente nella fascia breve di OpenAI, il che ribalta un vantaggio di 2x a favore di Anthropic in un vantaggio di 1,25x a favore di OpenAI sull'input e di 1,39x sull'output. E la soglia di Anthropic è così bassa che una pipeline a forte componente documentale la supera regolarmente, mentre quella di OpenAI è così alta che la maggior parte di tali pipeline non la raggiunge mai.

Sotto i 100.000 token nulla di tutto ciò cambia l'ordinamento. Oltre i 272.000 l'ordinamento si inverte e resta invertito.

Cosa ha sostituito il modello con cui lo stai confrontando?

Questa è la parte che dovrebbe decidere se dedicare tempo al confronto, e quanto.

OpenAI ha rilasciato GPT-6 Luna il 22 settembre 2026 — quindici giorni prima che Anthropic rilasciasse Claude Haiku 5.5 — a 0,10 $ in input e 0,50 $ in output, con un contesto da 1M di token, un tetto di risposta di 128.000 token e lo stesso controllo dello sforzo di ragionamento a sei passaggi. È lo stesso identico listino prezzi di Claude Haiku 5.5, su entrambi i contatori, nel regime dei prompt brevi.

Sulla classifica indipendente i due sono abbastanza vicini che l'ordinamento composito non lo risolve: Claude Haiku 5.5 segna 43,40 contro il 38,12 di GPT-6 Luna — ancora un vantaggio di 5,28 punti per Anthropic — ma il costo per attività completata è di $0,21 contro $0,068. Questo è un triplo vantaggio di OpenAI sul numero che conta davvero, ed esiste per la stessa ragione di verbosità di cui sopra: GPT-6 Luna emette 50.012 token di output per attività Index contro i 162.164 di Claude Haiku 5.5.

Il post di lancio di Anthropic fa da sé il confronto, in una tabella che mette Haiku 5.5 contro "GPT-6 Luna" su GDPval-AA v2.1 (1620 contro 1437), AA-Briefcase v1.1 (1578 contro 1336), il sottoinsieme offline di OSWorld 2.1 (72,4% contro 48,9%) e Terminal-Bench 4.0 (39,2% contro 16,4%). Quelli sono numeri di Anthropic stessa e sono dichiarati dall'azienda, ma la scelta dell'avversario è il dettaglio rivelatore: il modello che Anthropic ha scelto di battere è quello successivo a quello nel titolo di questo articolo.

Dove la vecchia Luna vince ancora

Tre cose, e nessuna di esse è la capacità.

Video e audio. Nessuno dei due modelli è nativo per il video — Claude Haiku 5.5 legge testo e immagini, e GPT-5.6 Luna legge testo e immagini — quindi questa riga è un pareggio ed entrambi perdono contro qualsiasi cosa con una pipeline multimediale.

Scritture in cache. OpenAI pubblica una tariffa di scrittura in cache di 0,25 $ per milione per GPT-5.6 Luna e Anthropic pubblica un Claude Haiku 5, il che significa che, per essere onesti, il costo di scrittura è dentro il contatore di input da 0,10 $ di Anthropic anziché assente. Un carico di lavoro con molti prefissi e una cache di breve durata paga quella differenza a ogni turno.

E il percorso a contesto lungo stesso, dove la soglia più alta di OpenAI è un autentico vantaggio strutturale che non ha nulla a che vedere con quale modello sia più intelligente.

A capture of the OrcaRouter model page for GPT-5.6 Luna under openai/gpt-5.6-luna, showing a 128K maximum output, text, image and file input, public benchmarks by OpenAI dated 2026-07-09, a p50 time to first token, and the page's own description of the model as the fast, cost-efficient tier of OpenAI's GPT-5.6 series with a 1.05M-token context window.

Entrambi sono chiamabili, uno di essi non è nostro.

GPT-5.6 Luna è oggi nel catalogo OrcaRouter su openai/gpt-5.6-luna — $0,20 in ingresso, $1,20 in uscita, $0,25 per la scrittura della cache, contesto da 1.050.000 token e tetto di risposta di 128.000 token, con il livello di contesto lungo da 272.000 token riportato come voce separata nel record di prezzo anziché essere mediato. Passato al prezzo di listino di OpenAI con markup dello 0%, e failover automatico alla base, che vale qualcosa di specifico per un modello deliberatamente superato: se la capacità di OpenAI per esso si restringe, la rotta si sposta prima che lo faccia il tuo budget di errori.

Claude Haiku 5.5 non è a catalogo. È raggiungibile tramite l'API di Anthropic e tramite AWS, Google Cloud e Microsoft Azure, ed è questo il modo accurato di dirlo. Ciò che il catalogo offre di Anthropic è Claude Sonnet 5.5 e Claude Opus 5.5, quindi il percorso di escalation da un livello di classificazione economico a uno agentico di fascia media è un'impostazione di routing più che un'integrazione — e lo stesso catalogo contiene GPT-6 Luna esattamente alla tariffa che usa Claude Haiku 5.5, il che rende l'onesto confronto A/B per questo prezzo un cambio di due stringhe anziché un esercizio di approvvigionamento.

Cosa fare con questo confronto

Se la tua integrazione indica gpt-5.6-luna, la conclusione utile non è che Claude Haiku 5.5 lo superi di sei punti indice. È che ti trovi su un modello che il tuo fornitore ha già superato due volte nel suo stesso tier flash — prima con la generazione di Terra, poi con GPT-6 Luna, che Anthropic stessa considera il concorrente attuale a questo prezzo. Migrare a GPT-6 Luna è una corrispondenza di listino e un calo di tre volte del costo per attività completata sulla stessa misurazione indipendente.

Se scegli tra Claude Haiku 5.5 e la linea Luna in base alla capacità, Anthropic vince sul composito, sulle righe terminale-e-codice e sull'uso del computer, e la sua stessa tabella di fornitore lo dice. Se scegli in base alla fattura, la linea Luna ha vinto ogni versione di questo confronto con un ampio margine, e il motivo è un singolo numero: 162.164 token di output per attività contro 41.235.

Ciò che questo confronto stabilisce davvero è che un contatore due volte più economico vale meno di un modello quattro volte più snello. Anthropic ha fissato il prezzo di Claude Haiku 5.5 per allinearlo a GPT-6 Luna e ci è riuscita — esattamente, su entrambi i contatori — eppure ottenerne una risposta costa ancora tre volte tanto.