
Claude Sonnet 5.5: il default di fascia media, completamente specificato
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
Claude Sonnet 5.5 è il modello di fascia media della linea Claude, rilasciato il 28 settembre 2026, e il prezzo è l'intera ragione per cui merita una pagina: 2 $ per milione di token in input e 10 $ per milione di token in output, contro 4 $ e 20 $ per Claude Opus 5.5, il flagship uscito sei giorni prima. È metà del prezzo di output in cambio di 1,62 punti dell'Artificial Analysis Intelligence Index — 56,00 per il modello di fascia media contro 57,62 per il flagship, entrambi i valori misurati da Artificial Analysis sulla revisione v4.3.2 dell'indice, non da noi e non dal fornitore. Al di sopra di entrambi si colloca Claude Fable 5.1, a 10 $ / 50 $ e 53,35 sulla stessa revisione: più caro del flagship e dietro di esso. Allo stesso prezzo di listino di 2 $ / 10 $ di Claude Sonnet 5.5 c'è quello di OpenAI: GPT-6.1 Sol, a 51,83 — 417 centesimi di indice dall'altra parte della linea, che è il confronto che un lettore che valuta il modello di fascia media deve effettivamente fare.
Questa pagina è un riferimento, e sono le date a dirne il perché, più che la freschezza. Claude Sonnet 5.5 compie dieci giorni l'8 ottobre 2026, il che lo colloca fuori dalla finestra di sette giorni entro cui questo blog riporta notizie. Ciò che rientra in quella finestra è un evento di sei giorni fa: due post su X datati 2 ottobre 2026, che sostengono che un modello successore di questa famiglia batta un rivale che il suo stesso fornitore ha completato e trattenuto. Quella affermazione non ha alcun model id, alcun rate card, alcuna context window e alcun benchmark alle spalle in nessun registro raggiungibile da qui, e non è l'argomento di questa pagina — la catena delle fonti, il controllo di assenza sulla superficie del fornitore e la distribuzione dell'indice sui cinque modelli sono interamente di pertinenza dell'articolo che questo blog ha già pubblicato con il titolo Claude Fable 5.5 batte GPT-6.1 Astra prima che esista — e questa è la parte interessante, datato 3 ottobre 2026. Ciò che quella affermazione ha prodotto, invece, è una fila di lettori che chiedono su quale modello Claude già rilasciato standardizzarsi mentre aspettano, e quella domanda richiede una pagina sul modello che esiste. Questa è quella pagina.
Cosa è stato rilasciato il 28 settembre 2026
La documentazione del fornitore stesso fornisce direttamente la specifica, ed è una continuazione del tier anziché una nuova forma. Tutto quanto segue è stato tratto dalla documentazione di Claude Platform di Anthropic in data 8 ottobre 2026, quindi è la specifica di Anthropic, non un test indipendente della stessa.
• Rilasciato — 28 settembre 2026. La pagina di documentazione ufficiale del modello si apre con la frase "Ultima versione. Rilasciato il 28 settembre 2026."
• Posizionamento — "La migliore combinazione di velocità e intelligenza", con la latenza comparativa indicata come Veloce rispetto a Moderata per Claude Opus 5.5, Più lento per Claude Fable 5.1 e Il più veloce per la fascia piccola.
• ID modello — claude-sonnet-5-5 su Claude API, Google Cloud, Microsoft Foundry e Claude Platform on AWS; anthropic.claude-sonnet-5-5 su Amazon Bedrock. Ogni ID modello di Claude è uno snapshot fissato, quindi la stringa non è un puntatore che cambia sotto di te.
• Contesto e output — 1.000.000 di token di contesto e 128.000 token di output sincrono sull'API Messages, che salgono a 300.000 con l'output-300k-2026-03-24 header beta sull'API Message Batches.
• Thinking — adattivo, sempre attivo per impostazione predefinita, con uno sforzo predefinito di high. L'impostazione più bassa è between_tools, che disattiva il pensiero anticipato ed è accettata a un valore di high o inferiore per lo sforzo. Impostare temperature, top_p o top_k a qualsiasi valore diverso da quello predefinito restituisce un errore 400, quindi una richiesta migrata da un modello Claude precedente con una temperatura regolata fallirà in modo evidente anziché in modo silenzioso.
• Data limite delle conoscenze — giugno 2026, sia per il limite affidabile sia per il limite dei dati di addestramento.
• Ciclo di vita — Attivo (più recente), con un impegno di dismissione non prima del 28 settembre 2027 sulle piattaforme gestite da Anthropic. Amazon Bedrock e Google Cloud stabiliscono le proprie date.
La presentazione del lancio da parte del fornitore vale la pena di essere citata perché è un'affermazione e non una misurazione: l'annuncio di Anthropic descrive Claude Sonnet 5.5 come "un chiaro miglioramento rispetto a Sonnet 5, che è più veloce del 30% e costa fino al 30% in meno per la maggior parte del lavoro". Quella frase è del fornitore, non riprodotta da noi, ed è il tipo di affermazione che dipende interamente da quale lavoro gli si mette davanti. C'è anche un costo di migrazione legato al rilascio di cui questa pagina non è il posto adatto: cinque breaking changes riguardano codice già in esecuzione su Claude Sonnet 5, e una sesta altera la forma della risposta senza far fallire nessuna richiesta. Quel resoconto appartiene all'articolo sul rollout che questo blog ha pubblicato nella settimana del rilascio, ed è la prima cosa da leggere se oggi avete Sonnet 5 in produzione.

I 1,62 punti, e il prezzo dimezzato
I punteggi indipendenti per questo modello provengono da un'unica fonte, e portano con sé un numero che decide la questione. Artificial Analysis misura Claude Sonnet 5.5 a 56.00 sul suo Intelligence Index, revisione v4.3.2, nella configurazione che la pagina indica come "Claude Sonnet 5.5 (Max, Default Fallback)". Abbiamo consultato quella pagina il 2026-10-08. Sulla stessa revisione, lo stesso giorno:
• Claude Opus 5.5 — 57,62, rilasciato il 2026-09-22, 4 $ / 20 $
• Claude Sonnet 5.5 — 56.00, rilasciato il 2026-09-28, $2 / $10
• Claude Fable 5.1 — 53.35, rilasciato il 2026-09-01, 10 $ / 50 $
• GPT-6 Astra — 52,67, rilasciato il 2026-09-03, $10 / $50, con un livello a contesto lungo oltre 272.000 token di prompt a $20 / $75
• GPT-6.1 Sol — 51.83, rilasciato il 2026-09-29, $2 / $10
Indicare quale revisione, perché un punteggio di una versione dell'indice non è confrontabile con un punteggio di un'altra: la v4.3.2 incorpora dieci valutazioni — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Human's Last Exam, GDP.pdf, CritPt, AA-Omniscience e AA-LCR v1.1 — e la composizione di tale insieme è cambiata nel corso delle revisioni. Tutti e cinque i valori sopra riportati provengono dalla stessa revisione, motivo per cui possono essere confrontati tra loro e per cui nessuno di essi può essere confrontato con un numero citato da una versione precedente.
Il confronto dei prezzi è la parte che decide il comportamento. La tariffa di output di Claude Sonnet 5.5 è la metà di quella di Claude Opus 5.5, e la sua tariffa di input è a sua volta la metà; sul listino del fornitore stesso, il modello di fascia media costa $2 / $10 mentre il modello di punta costa $4 / $20. Metti insieme i due numeri pubblicati e il rapporto è netto: per ogni dollaro di prezzo di listino dell'output, Claude Sonnet 5.5 porta 5,60 punti indice e Claude Opus 5.5 ne porta 2,88 — quasi il doppio dell'indice per dollaro di output, sul tariffario di Anthropic stessa e sulla misurazione di Artificial Analysis stessa. Questa è aritmetica su due cifre pubblicate, non la misurazione di qualcosa, ed è la forma onesta dell'argomento a favore della fascia media. Non è nemmeno un verdetto: un punto indice non è un'unità di correttezza, e il senso del resto di questa pagina è di che cosa è fatto e non è fatto l'1,62.

Il listino tariffe, e le due voci che si muovono di più
Listino prezzi completo di Anthropic, consultato l'8 ottobre 2026. Ogni cifra in questa sezione è del fornitore.
• Input — $2,00 per milione di token. Output — $10,00 per milione, e i token di pensiero vengono fatturati come output, il che non è sopprimibile qui perché il pensiero adattivo è attivo per impostazione predefinita.
• Lettura cache — $0.10 per milione, che Anthropic documenta come il 5 percento del prezzo base di input. È lo stesso sconto proporzionale applicato da Claude Opus 5.5, quindi la cache non cambia la classifica tra i due, e significa che una lunga esecuzione di un agente che mantiene un prefisso stabile paga un decimo della tariffa di input su tutto ciò che rilegge.
• Scrittura cache — 2,50 $ per milione per la cache da cinque minuti, 4,00 $ per quella da un'ora. La lunghezza minima del prompt memorizzabile nella cache è di 512 token, quindi i prompt brevi non possono usufruire affatto dello sconto.
• Batch API — sconto del 50% in entrambe le direzioni, quindi 1,00 $ in input e 5,00 $ in output per il lavoro che può attendere.
• Nessun sovrapprezzo per il contesto lungo — Anthropic fattura l'intera finestra da 1 milione di token alla tariffa standard per token su questo modello, quindi una richiesta da 900.000 token costa, per token, quanto una da 9.000. È una differenza concreta rispetto a GPT-6 Astra, il cui livello long-context oltre i 272.000 token di prompt sale a 20 $ / 75 $ — vale la pena menzionarlo perché è l'unico punto in cui i numeri di punta dei due fornitori divergono nettamente quando un prompt diventa lungo.
Sono due voci a decidere la maggior parte delle fatture, più della tariffa di facciata: lo sconto per la lettura della cache nell'arco di una lunga esecuzione di un agente e lo sconto batch per tutto ciò che è asincrono. Il $2 / $10 di facciata è ciò che viene confrontato in una classifica; le voci relative a cache e batch sono ciò da cui si costruisce effettivamente una fattura mensile.
Che cosa significa e che cosa non significa il divario
L'Intelligence Index è un singolo numero calcolato su un insieme fisso di attività, e proprio questa sua caratteristica spiega gran parte della confusione che lo circonda. Le dieci valutazioni alla base della v4.3.2 includono il coding agentico e il lavoro da terminale, il ragionamento scientifico di livello universitario, un insieme di software engineering, un insieme di automazione agentica e un insieme di recupero a contesto lungo, ponderati in un indice composito. Un modello che è 1,62 punti dietro un altro è indietro su quel composito, non sul tuo carico di lavoro, che potrebbe ponderare quelle dieci attività in proporzioni del tutto diverse e potrebbe contenere compiti che nessuna di esse rappresenta.
In pratica, questo significa una divisione basata sulla forma del lavoro anziché sul prestigio della fascia. Il selettore di modelli di Anthropic stesso rende esplicita la divisione, e vale la pena leggerlo perché non lusinga la fascia intermedia: la documentazione dice ai lettori di «partire da Claude Opus 5.5 per la maggior parte dei carichi di lavoro» e di ricorrere a Claude Fable 5.1 «per ragionamenti impegnativi e lavoro agentico su lungo orizzonte, o quando le vostre eval su Claude Opus 5.5 con sforzo maggiore restano comunque insufficienti». Claude Sonnet 5.5 non è il modello con cui inizia quella frase. È il modello che la stessa documentazione descrive come la migliore combinazione di velocità e intelligenza, con la latenza comparativa più rapida al di fuori della fascia piccola — il che è un argomento diverso, e più ristretto.
Quindi la lettura onesta è questa. Il livello intermedio è di solito la risposta giusta per lavoro ben definito e ad alto volume: funzionalità e correzioni di bug su una base di codice nota, estrazione e classificazione con una forma di output definita, cicli di chiamata di strumenti in cui la parte difficile è l'harness piuttosto che il ragionamento, e qualsiasi cosa in cui un primo token veloce e un basso costo per chiamata contino più dell'ultimo 2% di capacità. Il modello di punta si guadagna la sua tariffa quando il lavoro è davvero a lungo orizzonte — esecuzioni di agenti che durano ore, refactoring che spaziano su file che il prompt non può contenere in una volta sola, e valutazioni sul livello intermedio che, a sforzo più alto, restano misurabilmente al di sotto. Quest'ultima condizione è quella del fornitore stesso, ed è verificabile: aumenta il livello di sforzo sul livello intermedio, esegui la tua valutazione e vedi se colma il divario. Se lo fa, l'1,62 non era determinante per te. Se non lo fa, ti sei comprato la risposta con i tuoi numeri invece che con il composito di qualcun altro.
Ciò che il divario non significa è che 1,62 punti non contino nulla. È l'intero margine tra due modelli e, su un harness fisso valutato in condizioni identiche, è un ordinamento reale. È semplicemente un ordinamento di uno specifico mix di attività, al massimo sforzo con fallback predefinito, e non dice nulla su quale dei due sia il migliore acquisto per un carico di lavoro sul quale nessuno dei due è stato benchmarkato.
La trappola del nome: quale pagina di Claude Sonnet 5.5 è questa
Un lettore che cerca il nome di questo modello si imbatte in diverse pagine di questo blog che sembrano questa, ma non lo sono. Quella datata 2026-09-24 è la pagina di anticipazione: è stata scritta prima del rilascio del modello, e il suo argomento era un singolo post su X che rivendicava un test stealth, ricostruito rispetto ai numeri del modello che avrebbe sostituito. Quella pubblicata nella settimana del rilascio è il resoconto del rollout: il suo argomento sono le cinque breaking change che interessano il codice già in esecuzione su Claude Sonnet 5, più la sesta modifica che altera la forma della risposta senza generare un errore. C'è anche una serie di pagine di confronto che contrappongono il nome di questo modello a modelli di altri fornitori, e una pagina applicata su ciò che copre la promozione del rilascio.
Nessuna di esse è la pagina del modello, ed è proprio il vuoto che questo articolo colma. Questa pagina è il riferimento a cui arriva un lettore dopo aver cercato il nome stesso del modello: che cos'è, quanto costa, cosa misura e quali lavori gli appartengono. I dettagli sulla migrazione della pagina di rollout e la critica alle fonti della pagina di anticipazione restano dove sono; se hai codice Sonnet 5 in produzione, la pagina di rollout è il tuo primo clic, e questa pagina è ciò che ti dice se il modello verso cui stai migrando è quello che vuoi.
Una abitudine di denominazione vale la pena correggerla finché siamo in argomento, perché di per sé è fuorviante. Un suffisso 5.5 indica una generazione, non un rango. Claude Sonnet 5.5 e Claude Opus 5.5 sono la stessa generazione della stessa famiglia, e il numero davanti al punto è il livello. Nulla, nel suffisso, ti dice quale dei due vince un benchmark.
Disponibilità, datata
Claude Sonnet 5.5 è su OrcaRouter da quando è stato rilasciato, come anthropic/claude-sonnet-5.5, al prezzo di listino di Anthropic senza alcun ricarico aggiuntivo: $2.00 in input e $10.00 in output per milione di token, le due cifre lette dal nostro endpoint del modello in data 2026-10-08 e corrispondenti riga per riga al listino del fornitore. La nostra pagina dedicata riporta la stessa finestra di contesto da 1M di token e un output massimo di 128K, elenca testo, immagine e file come tipi di input accettati e testo come unico output, lo contrassegna come rilasciato il 2026-09-28 e non deprecato, e mostra che è raggiungibile sia tramite l'endpoint chat-completions compatibile con OpenAI sia tramite l'endpoint messages di Anthropic — il che lo rende una modifica drop-in per un'integrazione che parla già l'uno o l'altro.
Tutto il resto nello stesso catalogo è raggiungibile dalla stessa chiave: un'unica API per oltre 200 modelli, con il prezzo di listino del fornitore passato con markup 0% così un taglio di prezzo del fornitore raggiunge il cliente il giorno stesso in cui viene annunciato, failover automatico quando un endpoint si degrada, e un DSL di routing per i casi in cui vuoi fissare un modello o comporne diversi in un'unica risposta. È questa combinazione a rendere la domanda su questa pagina economica da rispondere anziché costosa. Entrambi i modelli nel confronto qui sopra sono dietro le stesse credenziali, quindi il prezzo con cui ti confronti è quello pubblicato dal fornitore stesso anziché quello di un rivenditore, e il test di versione costa un'esecuzione di eval anziché un progetto di migrazione: indirizza una porzione di traffico verso anthropic/claude-sonnet-5.5, mantieni il resto sul flagship e lascia che i tuoi numeri di costo per attività completata decidano quale dovrebbe essere il default.

La versione breve
Claude Sonnet 5.5 è un modello di fascia media con numeri vicini a quelli del flagship e metà del prezzo di output del flagship, e i tre fatti che decidono se sarà il tuo default sono questi. Si colloca 1,62 punti dietro Claude Opus 5.5 sull'indice v4.3.2 di Artificial Analysis, a 56,00 contro 57,62, con entrambi i valori misurati sulla stessa revisione e nella stessa configurazione a sforzo massimo con fallback predefinito. Costa $2 / $10 contro i $4 / $20 del flagship, con gli sconti per cache e batch proporzionali anziché diversi, così il divario di prezzo sopravvive a ogni sconto offerto da entrambi i modelli. E il suo valore predefinito è high effort, mentre il flagship usa medium, il che significa che un'impostazione ereditata dal flagship qui gira un livello più in alto anziché più in basso, e il costo di questo tocca a te misurarlo anziché darlo per scontato.
Il selettore di Anthropic stesso parte ancora da Claude Opus 5.5 per la maggior parte dei carichi di lavoro, e vale la pena saperlo prima di standardizzare su qualunque cosa. Ma per la maggior parte dei lettori che arrivano a questa pagina cercando il nome di questo modello, la fascia media è il default sensato e il modello di punta è l'eccezione che compri quando sono le tue stesse valutazioni a richiederlo — lavoro ben circoscritto in grandi volumi, bassa latenza, una finestra da un milione di token senza sovrapprezzo per il contesto lungo e una tariffa che dimezza la voce di costo dell'output. Entrambi sono a una sola chiave di distanza su OrcaRouter, e la valutazione che decide tra i due costa un pomeriggio anziché una migrazione.
Confrontati in questo articolo4
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
