
Claude Opus 5.5 vs Claude Sonnet 5: Metà del Prezzo, Venti Punti Indice e un Punto Cieco di Cinque Mesi
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 177 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1323 tok/s
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
Se vuoi solo la regola: esegui Claude Sonnet 5 per impostazione predefinita e passa a Claude Opus 5.5 quando un compito fallisce, perché il modello più economico costa davvero la metà ed è davvero di una classe di capacità diversa. I due numeri dietro a ciò sono 38 e 58 — i punteggi di Sonnet 5 e Opus 5.5 sull'Artificial Analysis Intelligence Index, sullo stesso valutatore, nella stessa famiglia di configurazioni. Un divario di venti punti su quell'indice non è uno spareggio, ed è la separazione più ampia in qualsiasi confronto Claude contro Claude che puoi attualmente costruire: Claude Opus 5.5 è classificato #1 su 210 modelli e Claude Sonnet 5 è classificato #54, e la differenza di prezzo tra loro è di $2 per milione di token di input.
Quella è la metà facile. La metà difficile è che un'escalation selettiva richiede di sapere quali compiti falliscono, e i due modelli sono in disaccordo sul mondo dopo gennaio 2026 in un modo che nessuna valutazione farà emergere come errore.
Il divario di venti punti, nel contesto

Artificial Analysis esegue ogni modello in un'unica configurazione pubblicata, e questi due condividono un'etichetta di famiglia — "Adaptive Reasoning, Max Effort" — il che rende il confronto insolitamente pulito:
• Indice di Intelligenza — Claude Opus 5.5 58, classificato #1 su 210 contro Claude Sonnet 5 38, classificato #54
• Prezzo — Claude Opus 5.5 $4.00 in ingresso / $20.00 in uscita per milione vs Claude Sonnet 5 $2.00 / $10.00
• Velocità di output — Claude Sonnet 5 79,3 token/sec vs Claude Opus 5.5 non ancora pubblicato sulla classifica
• Tempo al primo token — Claude Sonnet 5 150,02s rispetto a una mediana della classifica di 3,83s
• Sforzo predefinito — Claude Opus 5.5 medio vs Claude Sonnet 5 alto
• Data limite delle conoscenze — giugno 2026 per Claude Opus 5.5 vs gennaio 2026 per Claude Sonnet 5
• Contesto e output — contesto da 1M e output massimo di 128K su entrambi
La colonna delle posizioni è la parte su cui vale la pena soffermarsi. Venti punti dell'indice non sono quattro posizioni in una classifica; sono quarantanove. In una classifica di 210 modelli, Opus 5.5 e Sonnet 5 non sono vicini separati da una differenza di prezzo — sono in fasce diverse, e il divario di 2 $ per milione compra un vero salto di capacità, non un distintivo. Chiunque abbia letto i resoconti di questa settimana come «Anthropic ha lanciato un Opus più economico» e abbia dato per scontato che il livello Sonnet lo abbia assorbito dovrebbe guardare quella coppia di posizioni: la pagina dei prezzi di Anthropic stessa elenca ancora Claude Sonnet 5 come prodotto attuale, e la sua posizione nella classifica indipendente non è cambiata.
Due avvertenze mantengono la questione onesta. Entrambi i punteggi sono stati ottenuti al massimo sforzo, e il default di distribuzione di nessuno dei due modelli è il massimo — Sonnet 5 usa come default high, mentre Opus 5.5 medium. E le righe sulla velocità complicano il quadro a favore di Sonnet 5: 79,3 token al secondo con un primo token a 150 secondi è un profilo di latenza reale e misurato, ed è l'unico dei due a comparire nella tabella. La velocità e la latenza di Opus 5.5 non sono state pubblicate da Artificial Analysis, il che significa che l'affermazione "più veloce" in questo confronto poggia attualmente su materiale del fornitore anziché su una misurazione.
La nota a piè di pagina che cambia il prezzo di Sonnet 5
La cosa più concreta emersa nell'ultimo mese per Claude Sonnet 5 è una frase che gran parte della copertura ha saltato. Quando il modello è stato lanciato il 30 giugno 2026, la sua tariffa di $2 / $10 è stata annunciata come prezzo introduttivo fino al 31 agosto, con un aumento programmato a $3 / $15 il 1° settembre. Nella pagina dei prezzi attuale di Anthropic, la nota a piè di pagina dice che il prezzo di $2/$10 «è ora il prezzo standard» e che l'aumento «non avverrà».
La cosa è importante per due motivi. Quello ovvio è che un aumento del 50% annunciato e poi annullato è una voce di costo su cui ora puoi pianificare — Sonnet 5 non è una tariffa promozionale per cui devi modellare una scadenza. Quello meno ovvio è che sistema l'aritmetica dell'escalation. Con Sonnet 5 permanente a $2/$10 e Opus 5.5 a $4/$20, il rapporto tra i due livelli è esattamente 2x in entrambe le direzioni, ed è stabile. Una regola di escalation che manda, diciamo, un quinto del tuo traffico a Opus 5.5 ha un costo che puoi calcolare una volta sola e smettere di ricalcolare.
Le tariffe batch e cache si muovono insieme, ed è ciò che rende utile il confronto sull'intera tabella: Sonnet 5 in batch costa $1,00 / $5,00 contro i $2,00 / $10,00 di Opus 5.5, ed entrambi fatturano le letture della cache a $0,20 per milione. Quest'ultimo dato è un vero pareggio — Opus 5.5 ha ridotto la lettura della cache da $0,50 a $0,20, e Sonnet 5 era già a quel livello. Se il tuo carico di lavoro è dominato dalla rilettura di un ampio contesto in cache anziché dalla generazione di nuovo output, il vantaggio di prezzo del modello più economico è molto minore di quanto suggerisca il rapporto nominale, perché l'unica voce su cui concordano è quella su cui spendi di più.
Il cutoff è la parte che fallisce in silenzio

Claude Opus 5.5 ha una data di cut-off delle conoscenze di giugno 2026. Quella di Claude Sonnet 5 è gennaio 2026. Sono cinque mesi di differenza, ed è l'unica dimensione di questo confronto che non si fa notare. Un modello che non è a conoscenza di un evento non è più lento né meno accurato su di esso in un modo che il tuo sistema di gestione degli errori riesca a rilevare: risponde con sicurezza da un mondo che è andato avanti, e il fallimento si presenta come una risposta sbagliata plausibile anziché come un rifiuto.
Per alcuni carichi di lavoro questo è irrilevante: il refactoring di una base di codice le cui convenzioni sono stabili, il riassunto di documenti che fornisci, la trasformazione di dati strutturati. Per altri è di per sé squalificante, indipendentemente dai venti punti di indice o dal prezzo. Qualsiasi cosa che tocchi software rilasciato nella seconda metà del 2026, qualsiasi cosa che risponda a domande su eventi recenti, qualsiasi cosa che dipenda da un'API o da una versione di libreria cambiata dopo gennaio — quelle attività non possono essere portate in escalation a Opus 5.5, devono partire da lì. I cinque mesi non sono una differenza di qualità; sono una restrizione di ambito, e appartiene alla regola di instradamento piuttosto che alla valutazione.
Entrambi i modelli condividono il resto dell'envelope, il che limita quanto si possa aggirare il cutoff. Entrambi accettano 1M token di contesto e restituiscono fino a 128K, entrambi eseguono un ragionamento adattivo che non può essere disattivato, ed entrambi espongono la profondità solo tramite il parametro effort. Non esiste alcuna configurazione in cui a Sonnet 5 venga fornito un documento più lungo per compensare.
Eseguire lo split
La versione pratica di questo confronto è una scelta predefinita e un'eccezione, e l'eccezione dev'essere definita da qualcosa di diverso dai "compiti difficili". Lo schema che regge si basa sulla classe di compito anziché sulla difficoltà: Sonnet 5 per il lavoro ad alto volume, dove il suo cutoff è irrilevante e il suo profilo di latenza è accettabile; Opus 5.5 per qualsiasi cosa attuale, qualsiasi cosa a lungo termine o qualsiasi cosa in cui un tentativo fallito costa più della differenza di token.
Questa è una configurazione di routing, non una riscrittura, ed è qui che un singolo endpoint si guadagna il suo posto. Claude Sonnet 5 è su OrcaRouter agli stessi $2.00 / $10.00 di Anthropic, e Claude Opus 5.5 è lì a $4.00 / $20.00 — prezzo di listino del provider passato con markup allo 0%, quindi il rapporto di costo nella tua regola di escalation è il rapporto di costo pubblicato da Anthropic, senza alcun livello di markup che lo alteri. Entrambi stanno dietro un'unica chiave, il che significa che il percorso di escalation è una modifica a una regola invece di una seconda integrazione, il failover automatico impedisce che un primario guasto trascini con sé la richiesta, e il confronto che determina le tue soglie è qualcosa che puoi eseguire all'interno del tuo stesso traffico anziché ricostruire da due tabelle di fornitori.

Chi dovrebbe muoversi, e chi dovrebbe aspettare
Se stai già usando Claude Sonnet 5 e funziona, l'argomento a favore della sua sostituzione è debole: il modello costa la metà, la sua tariffa ora è permanente, e il divario nell'indice conta solo sui compiti in cui sta fallendo. L'argomento a favore di aggiungere Claude Opus 5.5 al di sopra è forte, a condizione che tu riesca a indicare il trigger — e il trigger di solito è o un fallimento del cutoff o un compito che le esecuzioni a sforzo massimo di Sonnet 5 continuano a sbagliare.
Se stai scegliendo il tuo primo modello Claude, la risposta è meno equilibrata di quanto il rapporto dei prezzi lasci pensare. Un divario di venti punti nell'indice e cinque mesi di conoscenza in più per il doppio dei token sono un compromesso che la maggior parte dei carichi di lavoro di produzione accetterà su una minoranza di chiamate e che quasi nessuno accetterà su tutte. L'errore da evitare in entrambe le direzioni è considerare i due come intercambiabili e passare dall'uno all'altro solo in base al costo, perché il fallimento che ne consegue non è una risposta peggiore — è una risposta sicura su un mondo che è finito a gennaio.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
