Scheda del titolo per Claude Opus 5.5 con la dicitura: rilasciato il 22 settembre 2026; contesto da 1M e output massimo di 128K; 4 $ in input e 20 $ in output per milione di token.
Guides & Insights

Claude Opus 5.5: il modello di punta di Anthropic, completamente specificato

Autore

Gideon Frost

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Claude Opus 5.5 è l'attuale modello di punta del fornitore, rilasciato il 22 settembre 2026, e si colloca al centro della linea Claude così come il fornitore la documenta oggi: più economico e più rapido di Claude Fable 5.1 che sta sopra di esso, più caro e più lento di Claude Sonnet 5.5 che sta sotto, e successore diretto di Claude Opus 5 in cima alla linea Opus. Il selettore di modelli dello stesso fornitore offre il più breve riassunto utile di dove si colloca: partire da Claude Opus 5.5 "per la maggior parte dei carichi di lavoro", e rivolgersi a Claude Fable 5.1 "per ragionamenti impegnativi e lavoro agentico a lungo orizzonte, o quando le valutazioni su Claude Opus 5.5 con sforzo più elevato restano comunque insufficienti". Questa pagina è il riferimento per il modello a cui punta quella guida — l'inviluppo, la scheda tariffaria completa, l'impostazione di sforzo dietro ogni punteggio pubblicato, la lettura indipendente e dove viene effettivamente eseguito. Dove un lettore desidera approfondire uno di questi aspetti, questa pagina indirizza anziché ripetere: l'aritmetica della scheda tariffaria, il foglio completo dei benchmark con le sue colonne comparative tra modelli e i dettagli di migrazione vivono ciascuno su una pagina dedicata.

Che cos'è Claude Opus 5.5 e dove si colloca nella gamma

Anthropic descrive Claude Opus 5.5 come creato "per il coding agentico e il knowledge work di lunga durata", e lo presenta come "il primo modello della nostra nuova famiglia Claude 5.5". Sostituisce Claude Opus 5 come modello di punta in disponibilità generale dell'azienda; Claude Opus 5 rimane elencato come modello legacy ed è ancora erogato. La linea di quattro modelli, così come la presenta la stessa panoramica dei modelli di Anthropic, è abbastanza breve da poter essere contenuta in un'unica passata:

• Claude Fable 5.1 — 10 $ in input e 50 $ in output per milione di token, latenza comparativa indicata come più lenta, pensiero adattivo sempre attivo, impegno predefinito alto, contesto da 1M token, output massimo 128K, data di riferimento affidabile delle conoscenze giugno 2026. Anthropic lo posiziona al di sopra del modello di punta e ne adegua il prezzo di conseguenza.

• Claude Opus 5.5 — 4 $ di input e 20 $ di output per milione, latenza comparativa moderata, pensiero adattivo sempre attivo, sforzo predefinito medio, contesto di 1M token, output massimo 128K, data limite delle conoscenze giugno 2026. È l'unico modello della gamma che supporta il parametro sforzo e non ha come impostazione predefinita high, e questo dettaglio conta più di quanto sembri — vedi la sezione sullo sforzo di seguito.

• Claude Sonnet 5.5 — $2 input e $10 output per milione, latenza comparativa rapida, pensiero adattivo, impegno predefinito alto, contesto di 1M token, output massimo di 128K, cutoff affidabile delle conoscenze: giugno 2026, dismissione non prima del 28 settembre 2027.

• Claude Haiku 4.5 — 1 $ per input e 5 $ per output per milione, latenza comparativa: la più veloce, pensiero esteso, nessun parametro effort, contesto di 200K token, output massimo di 64K, ritiro non prima del 15 ottobre 2026.

Due letture di quella tabella sono sbagliate abbastanza spesso da meritare un nome. La prima riguarda la direzione della variazione di prezzo: Claude Opus 5.5 è più economico del modello che ha sostituito, non più costoso — $4/$20 contro i $5/$25 di Claude Opus 5 — ed è più economico di Claude Fable 5.1 di un fattore due e mezzo sull'input. La seconda riguarda cosa significa il divario rispetto a Claude Fable 5.1. Anthro​pic riferisce che Claude Opus 5.5 eguaglia o supera Fable 5.1 in diverse attività pubblicate a un quinto o a un terzo del costo per attività, pur continuando a indirizzare verso l'alto il lavoro di ragionamento davvero impegnativo; questa è un'affermazione sul costo per attività relativa a grafici specifici, non un'affermazione generale secondo cui il modello più economico sia quello più forte, e la pagina dei benchmark mantiene visibile la distinzione. Anthro​pic dice anche cosa verrà dopo: «Claude Sonnet 5.5 e Claude Haiku 5.5 seguiranno nelle prossime settimane», con «molti degli stessi miglioramenti in termini di prestazioni, efficienza e sicurezza». Quella frase si è in parte risolta nel frattempo: Claude Sonnet 5.5 è stato rilasciato il 28 settembre 2026, mentre Claude Haiku 5.5 non è ancora comparso — la panoramica dei modelli di Anthro​pic elenca ancora Claude Haiku 4.5 come il modello piccolo attuale, verificato il 7 ottobre 2026.

Rilasciato il 22 settembre 2026 — e perché la data non è la cosa importante qui

La data di rilascio è documentata due volte sulle superfici di Anthro​pic stessa: la pagina dell'annuncio è datata 22 settembre 2026, e la pagina del modello riporta la riga «Ultimo. Rilasciato il 22 settembre 2026». I valori delle specifiche in questo articolo sono stati letti il 28 settembre 2026 dalla documentazione di Anthro​pic stessa, da Artificial Analysis o dalla nostra API del modello, e per ciascuno è indicato da quale di queste fonti provenga; le affermazioni nella sezione sulla disponibilità riguardo a ciò che è attuale oggi sono state ricontrollate su quelle stesse superfici il 7 ottobre 2026, e lì sono datate.

Anthropic si impegna a supportare Claude Opus 5.5 "non prima del 22 settembre 2027" sulle piattaforme che gestisce direttamente; Amazon Bedrock e Google Cloud stabiliscono le proprie date del ciclo di vita. Ogni ID di modello Claude è uno snapshot bloccato, compresi gli ID senza data utilizzati a partire dalla generazione 4.6 in poi, quindi claude-opus-5-5 non è un puntatore che si sposterà sotto di te.

Perché questa pagina è un riferimento, e non una seconda storia di lancio

Vale la pena dirlo chiaramente, perché la lettura ovvia di una pagina dedicata a un modello pubblicato il 22 settembre 2026 è che si tratti di copertura del lancio, e non lo è. Questa è la pagina di riferimento canonica per un modello che oggi è disponibile nel nostro catalogo: la pagina a cui un lettore arriva dopo aver cercato il nome stesso del modello, anziché dopo aver letto un feed di notizie. Il suo fondamento è la domanda di ricerca costante che abbiamo misurato con dati first-party, non la freschezza di un lancio, e la data di uscita del 22 settembre compare qui come un fatto che colloca temporalmente il modello, non come un evento che questo pezzo riporta.

Questa distinzione è portante. Nell'archivio di questo blog ci sono già post di lancio, un articolo su una fuga di notizie, pagine di confronto e diversi pezzi applicativi su Claude Opus 5.5, e un ulteriore annuncio sarebbe un duplicato di un lavoro già esistente. Ciò che finora non esisteva era la pagina che sta sotto tutte loro: l'orientamento di cui un lettore ha bisogno prima che qualsiasi pagina specializzata sia utile. Così i pezzi che possiedono davvero un argomento — prezzi, benchmark e la superficie API — sono collegati da qui anziché essere rielaborati, e questa pagina si attiene al proprio compito.

La busta

Dalla pagina del modello Claude Opus 5.5 di Anthro e dalla relativa panoramica dei modelli, entrambe consultate il 28 settembre 2026:

• Finestra di contesto — 1.000.000 di token. Anthropic non pubblica alcun conteggio di parole per la finestra, ma solo una conversione approssimativa per il testo inglese: "1 token corrisponde all'incirca a 4 caratteri o 0,75 parole", con il conteggio esatto che varia in base alla lingua e al tipo di contenuto. Accanto a quel numero va posta un'avvertenza sul tokenizer: Claude 4.7 e i modelli successivi, incluso Claude Opus 5.5, utilizzano un tokenizer più recente che genera circa il 30 per cento in più di token per lo stesso input, quindi un prompt dimensionato su un modello Claude precedente non riempirà la stessa finestra.

• Output massimo — 128.000 token in modo sincrono sull'API Messages. Sull'API Message Batches sale a 300.000 token dietro l'output-300k-2026-03-24 header beta.

• Modalità — Anthropic documenta l'input come testo e immagini, l'output come testo, ed elenca capacità di visione, utilizzo di strumenti e capacità multilingue nell'intera gamma attuale. La nostra scheda di catalogo per il modello accetta inoltre un tipo di input file, che la pagina del fornitore non enumera.

• Limiti di conoscenza — cutoff di conoscenza affidabile giugno 2026; anche il cutoff dei dati di addestramento è giugno 2026.

• ID dei modelli — claude-opus-5-5 sull'API Claude, su Google Cloud, su Microsoft Foundry e su Claude Platform on AWS; anthropic.claude-opus-5-5 su Amazon Bedrock.

• Stato — Attivo (più recente), con un impegno di ritiro non prima del 22 settembre 2027 sulle piattaforme gestite da Anthro​pic.

Anthropic's Claude Opus 5.5 model page, showing the Latest line and Released September 22, 2026, the model ID claude-opus-5-5, a 1M-token context window with 128K max output, input pricing $4 per MTok and output pricing $20 per MTok, the four-model How it compares table across Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 and Claude Haiku 4.5, and a note that adaptive thinking is always on and cannot be turned off.

Il tariffario, completo

Tutto quanto segue è il listino prezzi pubblicato da Anthro​pic, consultato il 28 settembre 2026. I prezzi sono per milione di token.

• Input — 4,00 $

• Output — $20.00. I token di thinking vengono fatturati come token di output e il thinking adattivo di Claude Opus 5.5 non può essere disattivato, quindi il thinking non è una voce separata che puoi sopprimere.

• Lettura cache — $0,20, che Anthro​pic documenta come 0,05x il prezzo base di input. Tale moltiplicatore è una deroga per questo modello: la tariffa standard nel listino è 0,1x, e solo Claude Fable 5.1 e Claude Mythos 5.1 si collocano più in basso, a 0,025x.

• Scrittura in cache di 5 minuti — 5,00 $, il moltiplicatore standard di 1,25x sull'input di base.

• Scrittura cache di 1 ora — 8,00 $, il moltiplicatore standard di 2x. La lunghezza minima del prompt memorizzabile in cache è di 512 token.

• Batch API — 50% di sconto su entrambe le direzioni: $2.00 in input e $10.00 in output.

• Fast mode — 8,00 $ in input e 40,00 $ in output, esattamente 2 volte lo standard, descritta da Anthro​pic come anteprima di ricerca. Funziona esclusivamente sull'API Claude di prima parte, non è offerta su Claude Platform on AWS né sui cloud partner e non è disponibile con la Batch API.

• Inferenza solo USA — impostando inference_geo su "us" si applica un moltiplicatore di 1,1x a input, output, scritture in cache e letture dalla cache. Il routing globale, l'impostazione predefinita, utilizza la tariffazione standard.

• Nessun sovrapprezzo per il contesto lungo — Anthro​pic dichiara che i modelli Claude 4.6 e successivi includono la finestra completa da 1M di token al prezzo standard, quindi una richiesta da 900.000 token viene fatturata alla stessa tariffa per token di una da 9.000 token.

• Prompt di sistema per l'uso degli strumenti — la tabella di conteggio dei token di Anthro​pic stessa indica che il prompt di sistema per l'uso degli strumenti di Claude Opus 5.5 è di 286 token quando la scelta degli strumenti è auto o none.

La domanda sui costi che un lettore ha davvero non riguarda il listino prezzi ma la fattura, e questo è l'argomento di un'altra pagina: la pagina dei prezzi esamina il costo per attività completata, che cosa fa la linea di cache nel corso di una lunga esecuzione dell'agente e fino a che punto la descrizione del fornitore, «circa il 40% in meno per l'esecuzione», possa essere verificata dal foglio.

Impegno, pensiero e il contesto dietro ogni punteggio pubblicato.

Questa è la parte della specifica che gran parte dei resoconti di lancio tralascia, ed è la parte che cambia il significato di un numero di benchmark. Il pensiero adattivo di Claude Opus 5.5 è sempre attivo e non può essere disattivato — Anthropic afferma che le richieste che impostano thinking: {"type": "disabled"} restituiscono un errore 400 a ogni livello di effort, non solo a quelli alti. Il pensiero esteso, la modalità manuale budget_tokens, è il meccanismo precedente: Anthropic lo documenta come deprecato su Claude Opus 4.6 e Claude Sonnet 4.6 e non accettato sui modelli successivi. Su Claude Opus 5.5 il controllo è quindi output_config.effort, e nient'altro.

Esistono cinque livelli: low, medium, high, xhigh e max. Claude Opus 5.5 li supporta tutti e cinque. Il suo valore predefinito è medium — l'unico modello che supporta il parametro e non ha high come valore predefinito — il che significa che una richiesta migrata da Claude Opus 5 senza un valore effort esplicito viene eseguita un livello più in basso rispetto a prima, e la guida di Anthro​pic è di eseguire una nuova sweep di effort sulle proprie eval anziché trasferire le impostazioni. Impostare l'effort al valore predefinito del modello produce esattamente lo stesso comportamento dell'omissione del parametro. L'effort governa tutti i token nella risposta, incluso il thinking, e Anthro​pic è esplicita nel dire che è "un segnale comportamentale, non un rigido budget di token". Le modifiche a metà conversazione sono supportate tramite un header beta per l'effort a livello di singolo messaggio, mid-conversation-output-config-2026-07-01, che mantiene intatta la cache del prompt — una modifica a livello superiore tra una richiesta e l'altra non lo fa.

Il motivo per cui lo sforzo va inserito in una pagina di riferimento è che i risultati pubblicati da Anthropic non sono tutti eseguiti con un'unica impostazione. L'annuncio riporta una nota permanente — «Salvo diversa indicazione, tutti i risultati di Claude Opus 5.5 usano il pensiero adattivo al massimo sforzo» — e poi segnala diversamente, benchmark per benchmark. Letta in questo modo, la scheda appare così:

• Terminal-Bench 4.0 — 66,4%, riportato con sforzo xhigh. Questa è una delle eccezioni, ed è un'eccezione a doppio taglio: Anthropic riporta GPT-6 Astra ad elevato sforzo sullo stesso grafico e afferma che entrambi i valori "rappresentano il punteggio più alto di ciascun modello". Un confronto in cui un modello è a xhigh e l'altro a sforzo elevato non è un confronto a parità di sforzo, ed è la stessa nota a piè di pagina di Anthropic a dirtelo.

• FrontierCode v1.1 (Main) — 54,6%, con impegno predefinito (medio). Anthro​pic nota che batte il punteggio massimo di GPT-6 Astra del 53,3% per circa un quinto del costo per attività.

• CursorBench 4.0 — 52,5%, con impegno predefinito (medio). Contro il 51,8% di Claude Fable 5.1 con impegno massimo e il 46,6% di Claude Opus 5 con impegno massimo. Nota di nuovo l'asimmetria: il numero di Claude Opus 5.5 è prodotto un livello sotto il miglior risultato degli altri due modelli.

• GDPval-AA v2.1 — 1846 Elo, al massimo sforzo. Claude Fable 5.1 ottiene 1735 e Claude Opus 5 ottiene 1708 sullo stesso grafico.

• Tutto il resto pubblicato — al massimo impegno, secondo la nota permanente. Questo comprende le cifre di OSWorld 2.0 e Chartography, le cui etichette ("parziale" e "con strumenti") descrivono come è stato valutato il task anziché quale livello di impegno l'ha prodotto; nessuno dei due grafici riporta un override, quindi entrambi rientrano nella frase globale invece di sfuggirvi.

Due ulteriori avvertenze appartengono accanto a quei numeri anziché in una nota a piè di pagina. Anthropic pubblica gli errori standard — ±2,6 punti per Claude Opus 5.5 su Terminal-Bench 4.0, da ±1,6 a 2 punti per gli altri modelli Claude, e da ±3,5 a 5 punti per modello su Terminal-Bench-Science 0.1 — e verifica due risultati rispetto alle classifiche pubbliche, riproducendo il 51,8% pubblicato di Claude Opus 5 al 52,3% e il suo 30,0% pubblicato al 29,0%. Separatamente, le sue cifre di AutomationBench sono state prodotte senza modelli di fallback, una condizione dell'harness diversa da quella di un deployment che li prevede. Chiunque legga trasversalmente tra i modelli ha bisogno di avere quei tre fatti a portata di mano. Anche la posizione indipendente di Claude Fable 5.1 è misurata su una revisione dell'indice diversa da quella di Claude Opus 5.5, quindi i due non sono direttamente confrontabili, e la pagina del benchmark è il luogo in cui tutto ciò viene affrontato apertamente.

A six-row scoreboard titled Claude Opus 5.5, the effort behind each score. Rows read: Terminal-Bench 4.0, 66.4 percent at xhigh effort; FrontierCode v1.1 Main, 54.6 percent at default effort, medium; CursorBench 4.0, 52.5 percent at default effort, medium; GDPval-AA v2.1, 1846 Elo at max effort; all other published results at max effort; default effort on the Claude API, medium. Footer reads: Anthropic's published results, read 2026-09-28, vendor-reported.

La lettura indipendente

I numeri di Anthropic sono dichiarati dal fornitore, e il foglio qui sopra è citato come tale. Esiste una misurazione indipendente di Claude Opus 5.5, e proviene da un solo posto: Artificial Analysis, la cui pagina live dei modelli abbiamo consultato il 28 settembre 2026.

Artificial Analysis assegna a Claude Opus 5.5 un punteggio di 58 sull'Artificial Analysis Intelligence Index, revisione v4.3.2, posizionandolo al primo posto su 211 modelli in quella revisione. La configurazione in cui viene misurato è indicata nella pagina — "Claude Opus 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" — e quell'etichetta è la parte importante: il dato indipendente è un valore a sforzo massimo, con fallback alla configurazione predefinita, quindi non è direttamente confrontabile con alcun numero della scheda del fornitore che sia stato prodotto a livello medio. Accanto all'indice, la stessa pagina riporta una velocità di output di 95,5 token al secondo, un costo di 5,98 $ per eseguire l'Intelligence Index per modello, una verbosità di 260 milioni di token di output, uno sconto cache del 95%, una finestra di contesto di 1M di token e un prezzo misto di 2,94 $ per milione di token su una miscela 7:2:1 di cache-hit/input/output. Artificial Analysis non pubblica alcuna variante Fable 5.1 accanto ad esso, né una seconda configurazione di Claude Opus 5.5, quindi i due modelli non sono stati confrontati testa a testa in quella sede a parità di sforzo e di harness. Questa è una lacuna nelle prove, non un risultato, ed è per questo che questa pagina non pubblica un proprio confronto tra Opus 5.5 e Fable 5.1.

Una discrepanza merita di essere registrata perché si risolverà da sola e un lettore potrebbe vedere entrambe le versioni. La nostra API del modello, il cui valore di Artificial Analysis memorizzato nella cache è datato 22 settembre 2026, riporta 57,6 per lo stesso indice. La pagina live di Artificial Analysis riporta 58 sulla revisione attuale. La pagina live è il dato di riferimento; il 57,6 è un'istantanea scattata il giorno del rilascio, sulla revisione allora in vigore. Dove questa pagina indica un unico numero, è 58.

La nostra telemetria è un terzo e diverso tipo di misurazione, e non è un benchmark. Nei sette giorni che terminano il 28 settembre 2026, le richieste instradate a anthropic/claude-opus-5.5 attraverso il nostro playground hanno mostrato un tempo al primo token p50 di 4,69 secondi, un p95 di 10,00 secondi, 97,8 token di output al secondo e un tasso di errore del 5,59%, con 62,7 milioni di token instradati in quella finestra. Queste descrivono il nostro comportamento di servizio, non la capacità del modello, e sono citate qui affinché nessuno le interpreti come il risultato di un benchmark.

Disponibilità e il test della versione

Anthropic afferma che Claude Opus 5.5 è "ora disponibile su tutte le piattaforme, incluse Amazon Web Services, Google Cloud e Microsoft Azure", e la pagina del modello elenca Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. Claude Opus 5.5 è inoltre attivo su OrcaRouter come anthropic/claude-opus-5.5, al prezzo di listino di Anthropic senza alcun ricarico aggiuntivo — 4,00 $ input, 20,00 $ output, 0,20 $ lettura cache e 5,00 $ scrittura cache, le quattro cifre lette dal nostro endpoint del modello il 28 settembre 2026, identiche riga per riga al listino del fornitore. La nostra pagina dedicata riporta la stessa finestra da 1M token e un output massimo di 128K, elenca testo, immagine e file tra i tipi di input accettati e testo come unico output, e contrassegna il modello come rilasciato il 2026-09-22, in evidenza e non deprecato.

Tutto il resto nello stesso catalogo è raggiungibile dalla stessa chiave: un'unica API per più di 200 modelli, prezzo di listino del provider passato con markup allo 0%, failover automatico quando un endpoint si degrada, e un DSL di routing per i casi in cui vuoi fissare un modello o combinarne diversi in una sola risposta. Per un test di versione, questa è la proprietà utile. Poiché il markup è zero, il prezzo con cui ti confronti è lo stesso che pubblica Anthro​pic, e poiché vengono serviti sia l'endpoint chat-completions compatibile con OpenAI sia l'endpoint messages di Anthro​pic, un client Claude esistente può essere puntato al nuovo ID cambiando due valori — la stringa del modello e, se vuoi una profondità di ragionamento diversa, il livello di effort. Esegui la stessa eval a medium e a xhigh, confronta il costo per attività completata anziché il costo per richiesta, e lascia che siano i tuoi numeri a decidere se il flagship o il modello sopra di esso sia il default giusto per il lavoro che hai davanti. La guida API copre le parti che non falliranno in modo evidente quando scambi la stringa; quattro modifiche incompatibili si applicano al codice già in esecuzione con Claude Opus 5, e un'ulteriore modifica altera la forma della risposta senza generare alcun errore.

The OrcaRouter model page for anthropic/claude-opus-5.5, showing a 1M-token context window, 128K maximum output, text plus image plus file input and text output, a release date of 2026-09-22, capability chips reading Vision, Tools, JSON and Reasoning, and a stat strip listing $4.00 input and $20.00 output per million tokens with p50 time to first token 4.68 seconds.

Claude Opus 5.5 è ancora al vertice della linea Claude, e la data di questa affermazione è il 7 ottobre 2026. Nulla di superiore è stato pubblicato nella famiglia: la panoramica dei modelli di Anthropic elenca esattamente quattro modelli attuali — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 e Claude Haiku 4.5 — senza alcuna quinta voce, la pagina di documentazione di Claude Opus 5.5 riporta ancora la parola Latest accanto al suo nome, e non esiste alcun identificatore di successore nella sitemap del fornitore, nella sua tabella delle deprecazioni, in questo catalogo o su Artificial Analysis. Lo stesso vale nella direzione opposta: la classifica dei modelli di Artificial Analysis, consultata lo stesso giorno, colloca ancora Claude Opus 5.5 al primo posto. Un lettore che arriva qui cercando il prossimo modello di punta di Claude sta cercando qualcosa che non ha ancora un nome, e la risposta pratica è quella che questa sezione fornisce già: Claude Opus 5.5 è ciò che si può chiamare oggi ai prezzi del fornitore, 4 $ per l'input e 20 $ per l'output per milione di token, e Claude Fable 5.1 resta il gradino superiore per i carichi di lavoro per cui Anthropic lo consiglia.

Un'ultima cosa ha il suo posto qui, perché un lettore che cerca un modello Claude che non esiste ancora incontra i numeri di versione prima dei nomi. Un suffisso 5.5 non significa il vertice della gamma; significa la generazione. Claude Sonnet 5.5 è il vero 5.5 che è stato distribuito: rilasciato il 28 settembre 2026, con prezzo del fornitore di $2 in input e $10 in output per milione di token, e misurato da Artificial Analysis a 56,00 sulla stessa revisione dell'Intelligence Index, v4.3.2, che colloca Claude Opus 5.5 al primo posto — quindi un numero che suona più alto su un livello inferiore resta comunque un livello inferiore. La stringa «Claude Fable 5.5», al contrario, è un'etichetta basata su voci piuttosto che un numero di versione. L'affermazione che vi sta dietro è stata fatta in due post sui social il 2 ottobre 2026, e la catena si ferma lì: allo stato attuale non esiste alcun id di modello, alcun listino prezzi, alcuna finestra di contesto, alcuna data di rilascio né alcun benchmark per esso nella documentazione del fornitore, in questo catalogo o su Artificial Analysis. Il vertice rilasciato della linea Fable è Claude Fable 5.1, e l'articolo su questo blog dal titolo Claude Fable 5.5 ha battuto GPT-6.1 Astra prima ancora di esistere — e questa è la parte interessante è il luogo in cui viene esaminata la catena di fonti di quell'etichetta; la distinzione di cui questa pagina ha bisogno è più ristretta: un suffisso che segna una generazione contrapposto a un nome che segna una rivendicazione.

La versione breve

Claude Opus 5.5 è il modello a cui rivolgersi per impostazione predefinita nella gamma attuale di Anthropic, e i tre fatti che decidono se sia quello giusto per un dato compito sono questi. Per impostazione predefinita usa l'impegno medio, mentre i modelli che gli stanno intorno usano l'impegno alto, quindi un'impostazione migrata cambia silenziosamente il comportamento. I suoi valori di benchmark pubblicati sono prodotti a livelli di impegno diversi, e i due più citati — Terminal-Bench 4.0 e CursorBench 4.0 — non sono confrontabili con i numeri che stanno loro accanto senza leggere le note. E il suo punteggio indipendente, 58 sull'indice v4.3.2 di Artificial Analysis, al primo posto su 211, è una misurazione a impegno massimo, il che lo rende il tetto del modello anziché ciò che eseguirai.

Sotto quei tre, il quadro pratico è semplice: una finestra da un milione di token senza sovrapprezzo per il contesto lungo, 128K di output sincrono, un listino che batte il modello che ha sostituito, un pensiero adattivo che non può essere disattivato e un impegno al ritiro tra due anni. Tutto ciò che è specifico — l'aritmetica di quanto costa un carico di lavoro, il foglio completo dei benchmark con le sue colonne comparative tra modelli e la posizione indipendente di ciascun modello, e i dettagli di migrazione per il codice già in esecuzione su Claude Opus 5 — si trova rispettivamente nelle pagine prezzi, benchmark e API, e quei tre sono i prossimi clic da qui.

Confrontati in questo articolo3

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno