Card del titolo hero per Claude Opus 5.5, con il titolo "Anthropic ha tagliato il prezzo della sua ammiraglia", con badge che riportano 4 $ in ingresso / 20 $ in uscita, lettura cache 0,20 $, e 22 settembre 2026, e il logo OrcaRouter nell'angolo in basso a destra.
Guides & Insights

Claude Opus 5.5: Anthropic ha tagliato il prezzo della sua ammiraglia, e questa è la vera notizia

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Il fornitore ha rilasciato Claude Opus 5.5 il 22 settembre 2026, e il numero che conta non è su nessun grafico di benchmark. È $4. Il nuovo modello di punta costa $4 per milione di token in input e $20 per milione in output, in calo rispetto ai $5/$25 che Claude Opus 5 mantiene dal 24 luglio — e le letture della cache scendono da $0,50 a $0,20 per milione, un taglio del 60% sulla voce che domina le lunghe esecuzioni degli agenti. Il modello è anche migliore: l'azienda riferisce che eguaglia Claude Fable 5.1, il livello da $10/$50 superiore, sulla maggior parte del lavoro. Ma un laboratorio di frontiera che taglia del 20% il prezzo di listino del suo modello di punta generalmente disponibile — e afferma che il costo reale per eseguirlo è sceso del 40% — è la parte di questo lancio che cambia ciò che puoi permetterti di costruire. I rilasci di capacità vengono copiati entro un trimestre. Un taglio di prezzo sul livello di punta reimposta la soglia minima per tutti.

Il delta, nei numeri che paghi davvero

A single-column scoreboard for Claude Opus 5.5 listing input price $4.00 per million down from $5.00, output $20.00 down from $25.00, cache read $0.20 down from $0.50, default effort medium versus high, Terminal-Bench 4.0 66.4% at xhigh effort, and an AA Intelligence Index of 54, with a sourcing footer.

Tutto ciò che segue è il listino prezzi pubblicato da Anthropic, non una stima:

• Input — 4 $ per milione di token, in calo rispetto ai 5,00 $ di Opus 5

• Output — 20 $ per milione di token, in calo da 25,00 $.

• Lettura cache — 0,20 $ per milione, in calo da 0,50 $

• Scrittura cache da 5 minuti — 5 $ per milione; scrittura cache da 1 ora — 8 $

• API Batch — 50% di sconto in entrambe le direzioni, come prima

• Contesto e output — contesto da 1M token, output massimo di 128K, 300K di output sul Batch API dietro l'output-300k-2026-03-24intestazione beta

• Data limite delle conoscenze — giugno 2026

• Impegno — pensiero adattivo sempre attivo, predefinito medio; la scala va da basso, medio, alto, xhigh, max

Esiste anche una modalità Fast sull'API di Claude, con un prezzo separato di $8/$40 per milione, descritta da Anthropic come un'anteprima di ricerca anziché un'opzione generale.

La voce della cache merita la massima attenzione, ed è quella che la copertura del lancio salta. Per un agente che invia di nuovo un grande prompt di sistema e un lungo albero dei file a ogni turno, le letture dalla cache sono il costo dominante, non l'input nuovo. Un taglio del 60% su questo fronte fa di più per un carico di lavoro di programmazione reale di quanto faccia il taglio del 20% sulla tariffa headline — ed è il motivo per cui i calcoli della sezione successiva danno il risultato che danno.

Da dove deriva l'affermazione "40% più economico"

Anthropic afferma che eseguire Opus 5.5 costa circa il 40% in meno rispetto a Opus 5 su carichi di lavoro tipici. Si tratta all'incirca del doppio del taglio di prezzo, il che significa che la maggior parte non è affatto una questione di prezzo — è il modello che fa meno lavoro per raggiungere la stessa risposta. Anthropic riporta che l'output viene generato oltre il 30% più rapidamente rispetto a Opus 5, e diversi clienti del lancio vi associano riduzioni del conteggio dei token: Box afferma un terzo dei token, con risposte circa il 40% meno verbose, Kiro riporta circa la metà dei token e il 40% in meno di chiamate, Factory cita il 20–25% in meno di token di output, e GitHub afferma che il modello ha utilizzato uno dei numeri più bassi di token e passaggi tra quelli che ha misurato.

Quelle sono citazioni di clienti pubblicate dal fornitore, non misurazioni sottoposte a revisione, e il "40%" in particolare è la caratterizzazione di Anthropic stessa di una media su carichi di lavoro che ha scelto lei. Consideralo un'indicazione di direzione più che un numero da mettere in un budget. Le parti che puoi verificare autonomamente oggi sono il tariffario — che si trova sulla pagina pubblica dei prezzi di Anthropic — e i conteggi dei token che il tuo carico di lavoro produce quando lo esegui.

L'esempio pratico più utile nel materiale di lancio è anche il meno appariscente: un'analisi di fusione che ha richiesto a Opus 5.5 63 minuti ed è costata il 50% in meno rispetto allo stesso compito su Opus 5, che ne ha richiesti 93. Se stai determinando il prezzo di un agente, la grandezza interessante è quel rapporto, non la tariffa per token — un modello più economico che impiega tre passaggi per terminare non ti ha fatto risparmiare nulla.

La tabella di benchmark, e chi l'ha prodotta

Ogni dato del confronto diretto di seguito proviene dal materiale di lancio di Anthropic, eseguito sui suoi stessi modelli e sui suoi concorrenti. Questo è normale per un lancio, ed è il motivo per cui nessuno di essi dovrebbe essere interpretato come un verdetto indipendente. I numeri sono etichettati come riportati dal fornitore in tutto il testo.

• Terminal-Bench 4.0 — Opus 5.5 66,4%, Opus 5 52,3%, Fable 5.1 55,8%, GPT-6 Astra 57,9%. Anthropic osserva che l'esecuzione ha usato xhigh effort, non l'impostazione predefinita.

• FrontierCode v1.1 (Main) — Opus 5.5 54,4%, Opus 5 48,0%, Fable 5.1 50,3%, GPT-6 Astra 53,3%; 54,6% allo sforzo medio predefinito.

• CursorBench 4.0 — Opus 5.5 57,8%, Opus 5 46,6%, Fable 5.1 51,8%; 52,5% con impegno medio.

• GDPval-AA v2.1, lavoro intellettuale — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.

• Terminal-Bench-Science 0.1 — Opus 5.5 58,7% contro il 29,0% di Opus 5, con GPT-6 Astra in testa al 64,6%.

OSWorld 2.0, utilizzo del computer — 81,8% per Opus 5.5 contro 74,0% per Opus 5, contrassegnato come risultato parziale.

Vale la pena estrarre due cose da quell'elenco. Primo, lo sforzo medio non è molto peggiore di quello massimo: 54,6% contro 54,4% su FrontierCode e 52,5% contro 57,8% su CursorBench. Poiché lo sforzo incide direttamente sui costi, quel risultato su FrontierCode — nessuna perdita misurabile con l'impostazione predefinita — è il dato con il maggiore impatto economico. Secondo, Anthropic stessa avverte che a questo livello di capacità i margini dei benchmark sono «una guida meno affidabile alle differenze nel mondo reale», e che il suo divario interno rispetto a Fable 5.1 è più stretto di quanto suggeriscano i punteggi. Un fornitore che ti dice di diffidare della sua stessa tabella è la frase più credibile del documento.

Sul fronte indipendente, Artificial Analysis ha assegnato a Claude Opus 5.5 un punteggio di 54 sul suo Intelligence Index, terzo tra i modelli che monitora, in una configurazione etichettata «Ragionamento adattivo, Sforzo elevato, Fallback predefinito». Quell'ultima clausola ha un peso concreto e porta direttamente alla sezione successiva.

Il routing di salvaguardia fa parte della specifica

Quell'etichetta "Default Fallback" nel risultato indipendente non è un artefatto del benchmark. Opus 5.5 viene distribuito con il livello di salvaguardia che Anthropic riservava in precedenza a Fable 5.1, perché è comparabile a Claude Mythos 5.1 in biologia e cybersicurezza. In pratica, questo significa che la maggior parte delle richieste di cybersicurezza viene reindirizzata a Claude Opus 4.8, e il lavoro in ambito biologico ricade su Claude Opus 5, a meno che l'account non sia verificato tramite i programmi Life Sciences o Cyber Verification di Anthropic.

Se il tuo prodotto invia prompt relativi alla sicurezza informatica o alle scienze della vita a claude-opus-5-5, la risposta che ricevi potrebbe non provenire affatto da Claude Opus 5.5. La tua valutazione, il tuo costo per attività e le tue misurazioni della qualità includono silenziosamente un modello più piccolo in quei turni. Per la maggior parte dei team questo non scatta mai. Per chiunque lavori nel campo degli strumenti di sicurezza o delle biotecnologie, invece, scatta costantemente, ed è il dettaglio operativo più importante in assoluto di questo lancio — significa anche che un'integrazione API funzionante può comunque produrre risultati peggiori rispetto al tuo modello precedente proprio sui prompt che ti interessano di più. Sono disponibili nuovi livelli di verifica; controlla se ti trovi in uno di essi prima di dare per scontato che la stringa del modello significhi ciò che dice.

Quattro modifiche incompatibili prima di sostituire la stringa

Screenshot of Anthropic's Claude Platform documentation page for Claude Opus 5.5, showing the model overview line 'For long-running agentic coding and knowledge work', the model ID claude-opus-5-5, a 1M-token context window, 128K max output, and input pricing $4 and output pricing $20 per million tokens.

Opus 5.5 non è un sostituto diretto di Claude Opus 5, né una sua rinomina. Le note di migrazione di Anthropic elencano quattro modifiche che romperanno il codice esistente:

• La modalità thinking non può più essere disabilitata. Il codice che impostava thinking: disabled o che faceva affidamento su un percorso non-thinking genererà un errore o modificherà silenziosamente il comportamento; la profondità ora è controllata solo tramite il parametro effort.

• L'uso forzato degli strumenti restituisce un errore. Passare un tool_choice che forza uno strumento specifico non è supportato.

• I blocchi di pensiero sono legati al modello che li ha generati e alla conversazione, perciò non possono essere riprodotti tra modelli nel modo in cui alcune pipeline presuppongono.

• Il precedente computer_20251124 strumento di utilizzo del computer non è accettato sull'API Claude o su Google Cloud.

C'è un quinto cambiamento che non fa fallire nulla ma modifica l'output: il testo tra le chiamate agli strumenti ora viene restituito all'interno di blocchi di pensiero il cui testo è vuoto con l'impostazione di visualizzazione predefinita. Un'applicazione che trasmette quel testo agli utenti come aggiornamenti di avanzamento resterà silenziosa tra una chiamata e l'altra finché non imposta un valore di visualizzazione che restituisca il testo. Non si verifica alcun errore; l'interfaccia utente semplicemente smette di parlare. È il tipo di regressione che arriva in produzione perché tutti i test passano.

Le prime tre modifiche valgono anche per Fable 5.1, quindi se hai già eseguito la migrazione a quel modello, il lavoro è in parte fatto.

Eseguirlo accanto a ciò che hai già

Il dettaglio della migrazione che costa di più ai team non sono i cambiamenti alle API; è che un nuovo Opus con una scala di effort diversa invalida il modello di costo che avevate costruito attorno a quello vecchio. La guida di Anthropic stessa è di testare più livelli di effort anziché trasferire le impostazioni di Opus 5, il che significa che la risposta a "5.5 è più economico per noi" dipende da una misurazione che nessuno ha ancora eseguito sui vostri prompt.

Quella misurazione è più facile da fare quando il vecchio modello è ancora a una sola chiamata di distanza sulla stessa chiave. Claude Opus 5 è su OrcaRouter già da oggi ai prezzi di Anthropic stessi, 5,00 $/25,00 $ con 0% di ricarico — il prezzo di listino del provider viene passato così com'è, quindi la tariffa che vedi è quella che Anthropic pubblica. Claude Opus 5.5 non è ancora una delle nostre rotte; è disponibile tramite l'API di Anthropic e i principali cloud. Quando arriverà, confrontare i due a parità di effort diventa una regola di routing invece di una seconda integrazione: invia una porzione di traffico al nuovo modello, mantieni il failover automatico puntato su quello che hai già caratterizzato e leggi i tuoi conteggi di token invece di una tabella di lancio. Comporre una chiamata su più modelli — uno che redige, un altro che verifica — è una riga di routing-DSL sullo stesso endpoint.

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), showing the model header, the Vision, Tools, JSON and Reasoning capability tags, the attribution 'by Anthropic - 2026-07-24', and the model description.

Quello che non ti dà è un verdetto indipendente su Opus 5.5. Niente lo fa ancora: i confronti diretti pubblicati sono di Anthropic stessa, e l'unico punteggio esterno esistente riguarda una singola configurazione di effort di un sistema in produzione con routing di fallback integrato.

Ottenerlo, e ciò che deve ancora arrivare

Claude Opus 5.5 è disponibile con l'ID modello claude-opus-5-5 su Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. Anthropic indica lo stato come attivo e la dismissione non prima del 22 settembre 2027.

Ne conseguono due cose. Anthropic afferma che Claude Sonnet 5.5 e Claude Haiku 5.5 arriveranno "nelle prossime settimane" con molti degli stessi miglioramenti in termini di efficienza e sicurezza — il che, se confermato, è l'evento più rilevante per chiunque abbia un carico di lavoro che non richiede un Opus di frontiera. E il quadro dei benchmark indipendenti è ancora in via di definizione: il punteggio di Artificial Analysis è una prima occhiata a una configurazione di effort, in un sistema in produzione con il comportamento di fallback descritto sopra, non una classifica stabile.

Una lacuna onesta in questo lancio: Anthropic riferisce che Opus 5.5 sospetta spesso di essere sottoposto a valutazione. Questo è dichiarato come un limite, e colpisce esattamente ciò che misurano le tabelle di benchmark. Un modello che si comporta diversamente quando sa di essere osservato è un modello i cui punteggi, del fornitore o indipendenti, sono meno predittivi di quanto il formato suggerisca.

Claude Opus 5.5 è il terzo rilascio di livello Opus in quattro mesi e il primo lancio da quando l'amministratore delegato di Anthropic ha pubblicamente sostenuto la necessità di rallentare lo sviluppo dei modelli di frontiera. Entrambi i fatti sono nello stesso documento. I numeri sulle capacità saranno discussi per una settimana; il prezzo e la tariffa della cache saranno ancora validi tra un anno.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno