
Claude Opus 5: Il modello quasi-frontiera di Anthropic a metà prezzo di Fable 5
- DeepSeekNUOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M di token
- z-aiNUOVOZ.ai: GLM 5.32026-08-1860Intelligenza75Codice
- obsidianNUOVOQwen3.8 27B2026-08-1552Intelligenza68Codice
- qwenNUOVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNUOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenza69Codice
- grokNUOVOSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenza77Codice
Il 24 luglio 2026, Anthropic ha rilasciato Claude Opus 5 — e nel giro di un giorno ha fatto qualcosa di raro per un modello "più economico": è salito in cima alle classifiche indipendenti. Anthropic ha presentato Opus 5 come vicino all'intelligenza di frontiera di Claude Fable 5 a metà prezzo, ed è stato lanciato lo stesso giorno su Claude.ai, Claude API, Claude Code e Claude Cowork. Da allora, Artificial Analysis lo ha classificato come il modello #1 nel suo Intelligence Index. Questa guida spiega cosa sia realmente Opus 5, cosa sia stato verificato indipendentemente rispetto a quanto riportato dal fornitore, il suo nuovo quadrante di sforzo e la postura di sicurezza, quanto costa in pratica e chi dovrebbe passare a questo modello.
Ogni figura sottostante è etichettata per fonte, perché a questa velocità la storia cambia ogni giorno: ciò che il giorno del lancio indicava "nessun punteggio indipendente ancora" ora è "indipendentemente #1." I benchmark e i prezzi si muovono — verifica prima di impegnare il budget.
TL;DR. Claude Opus 5 costa $5 per 1M token in input e $25 per 1M in output — identico aOpus 4.8e esattamente la metà dei $10/$50 di Fable 5. Nell'Artificial Analysis Intelligence Index ora è in testa con 61 (massimo sforzo), il miglior modello tra 170 valutati, superando Fable 5 (60) e uguagliando la sua classe a metà del costo. I benchmark di lancio di Anthropic lo confermano: Frontier-Bench v0.1 43,3% (contro il 33,7% di Fable 5), più il primato su Zapier's AutomationBench e il benchmark di utilizzo del computer OSWorld 2.0. Due cose lo rendono più di un semplice taglio di prezzo: un selettore di sforzo (basso/medio/alto/massimo) che scambia costo per capacità per richiesta, e la postura di sicurezza più forte di qualsiasi Opus finora. Se già sviluppi su Claude, l'aggiornamento è a basso rischio e non aumenta la tua fattura; se stai scegliendo tra modelli di punta, Opus 5 è ora il leader in rapporto qualità-prezzo — verificalo sul tuo carico di lavoro.
Punti chiave
• Ora indipendentemente #1. Artificial Analysis elenca Claude Opus 5 (massimo sforzo) a 61 sul suo Intelligence Index — il modello con il punteggio più alto, davanti a Fable 5 (60).
Metà del prezzo di Fable 5. $5 / $25 per 1 milione di token, lo stesso di Opus 4.8 e la metà di $10 / $50 di Fable 5 — qualità all'avanguardia a un prezzo di fascia media.
• Nuovo quadrante dello sforzo. Le impostazioni basso/medio/alto/massimo scambiano gettoni (costo) per capacità; "massimo" è ciò che è in cima alla classifica, le impostazioni più economiche superano ancora la maggior parte dei rivali.
• Progettato per agenti e uso tramite computer. Anthropic enfatizza il completamento di attività multi-step (AutomationBench) e la guida di un'interfaccia utente reale (OSWorld 2.0), non solo risposte singole.
• L'Opus più sicuro finora. Anthropic lo definisce "il modello Opus più allineato", prevedendo che i suoi classificatori cibernetici intervengano circa l'85% meno spesso rispetto a Fable 5 — meno falsi rifiuti su lavori legittimi.
• Ampia e immediata disponibilità. Modello predefinito su Claude Max, il più potente su Claude Pro, e disponibile dal primo giorno su API, Claude Code e Claude Cowork.
Una nota sulla lettura di questo brief: tutto ciò che è attribuito ad Anthropic è un'affermazione del fornitore tratta dai materiali di lancio; le cifre indipendenti (l'Intelligence Index) sono attribuite ad Artificial Analysis. Laddove un numero non è ancora stato pubblicato (un punteggio SWE-bench Verified separato), lo diciamo anziché indovinare.
Cosa sia realmente Claude Opus 5
Opus 5 è il nuovo membro della linea Opus di Anthropic — il livello "pesante" sopra Sonnet e Haiku. Si colloca al di sopra di Opus 4.8 e, nell'indipendente Intelligence Index, ha ora superato Fable 5, il flagship di frontiera di Anthropic del giugno 2026. Ciò che lo rende notevole non è un modesto aumento di capacità ma la combinazione: intelligenza quasi al vertice a un prezzo da cavallo di battaglia. Anthropic lo descrive come un modello "premuroso e proattivo" pensato per la programmazione, i flussi di lavoro agentici e il lavoro d'ufficio quotidiano delle imprese.
Concretamente, Opus 5 costa $5 per 1M token in input e $25 per 1M token in output. È lo stesso di Opus 4.8, e la metà di Fable 5 che costa $10 / $50. È il modello predefinito su Claude Max e l'opzione più potente su Claude Pro, ed è disponibile tramite Claude API, Claude Code (per la programmazione) e Claude Cowork (per il lavoro collaborativo con agenti) dal giorno del lancio. La finestra di contesto è della famiglia Opus da 1M.
Cosa c'è effettivamente di nuovo
Il segnale più chiaro del giorno del lancio è stato Frontier-Bench v0.1 di Anthropic, una suite impegnativa di ragionamento e compiti: Opus 5 ottiene il 43,3%, contro il 33,7% di Fable 5 e il 18,7% di Opus 4.8. In quel benchmark, il nuovo modello più economico di Anthropic supera il suo stesso fiore all'occhiello più costoso — un'affermazione che è stata poi confermata da valutazioni indipendenti.
Due ulteriori benchmark di fornitori completano la narrazione di "costruito per lavoro reale". Su AutomationBench di Zapier, che misura se un modello porta a termine un'attività lavorativa anziché semplicemente iniziarla, Anthropic afferma che il tasso di superamento di Opus 5 è circa 1,5 volte quello del modello più vicino a parità di costo, e che persino la sua impostazione di sforzo più economica supera il miglior risultato di ogni concorrente. Su OSWorld 2.0, un benchmark per l'uso del computer, Anthropic riporta che Opus 5 supera i rivali a ogni livello di prezzo e supera il punteggio massimo di Fable 5 utilizzando circa un terzo del budget. Opus 5 migliora anche rispetto a Opus 4.8 in ogni valutazione di scienze della vita monitorata da Anthropic, con il salto più grande — oltre 10 punti percentuali — in compiti di chimica organica come la lettura della struttura molecolare da dati spettroscopici.
Il selettore dello sforzo: pagare solo per la capacità di cui hai bisogno
La caratteristica principale — e quella su cui la maggior parte dei recensori si concentra — è l'impostazione dello sforzo. Opus 5 ti permette di scegliere quanto impegno il modello dedica a una richiesta: basso, medio, alto o massimo. Uno sforzo maggiore significa più token di ragionamento interni (quindi costo e latenza più elevati) e una qualità superiore; uno sforzo minore conserva i token per risposte più veloci ed economiche. Di fatto, è un parametro per regolare la tua bolletta dell'IA.
Ecco perché Artificial Analysis elenca diverse versioni di Opus 5 (medium, high, xhigh, max): ogni livello di impegno rappresenta un punto diverso sulla curva costo-qualità. L'impostazione "max" è quella che attualmente guida l'Intelligence Index a 61; le impostazioni inferiori sacrificano un po' di qualità per un costo per attività significativamente più basso, e persino queste, secondo Anthropic, superano i migliori risultati della concorrenza. In pratica, ciò significa che un singolo modello può servire sia le chiamate sensibili alla latenza e ad alto volume (low/medium) sia i tuoi compiti di ragionamento più complessi (high/max): si regola per ogni richiesta invece di cambiare modello.

Approfondimento sul benchmark: cosa misurano realmente questi test
Aiuta sapere cosa significhi ogni numero prima di fidarsene. L'Artificial Analysis Intelligence Index è un composto di molte valutazioni indipendenti (ragionamento, matematica, coding, conoscenza) eseguite da una terza parte; un punteggio di 61 che colloca Opus 5 al primo posto su 170 modelli è il segnale singolo più credibile qui, proprio perché Anthropic non l'ha eseguito. Frontier-Bench v0.1 (43.3% per Opus 5) è il set difficile di Anthropic — un segnale relativo che Opus 5 supera problemi più difficili di Fable 5 (33.7%) o Opus 4.8 (18.7%), non "43% corretto" in senso scolastico.
AutomationBench e OSWorld 2.0 contano più di un singolo punteggio di ragionamento se il tuo caso d'uso sono gli agenti. AutomationBench premia il completamento dei task — la differenza tra un agente che abbozza un'email e uno che effettivamente archivia la nota spese — e OSWorld 2.0 premia la guida di un'interfaccia utente reale. L'affermazione di Anthropic che Opus 5 eguaglia il picco di OSWorld di Fable 5 a un terzo del costo è, ora che l'Intelligence Index conferma la sua posizione generale, un forte argomento per spostare i carichi di lavoro agentici su Opus 5. L'unica lacuna: non esiste ancora una cifra separata e verificata in modo indipendente per Opus 5 su SWE-bench Verified (Fable 5 è al 95.0%, Opus 4.8 al 88.6%), quindi per una citazione pura di accuratezza di codifica, attendi quel numero.

Quanto costa in pratica
I prezzi per token sono astratti; ciò che incide sulla tua fattura è il costo per attività. Prendiamo un singolo passo di un agente rappresentativo con 20.000 token in input e 3.000 token in output. Opus 5 (e Opus 4.8): input 20k × $5/1M = $0,10, output 3k × $25/1M = $0,075, quindi circa $0,175 per chiamata. Fable 5 a $10 / $50: $0,20 input + $0,15 output = circa $0,35 — circa il doppio. Su 100.000 chiamate simili al mese, si tratta di circa $17.500 su Opus 5 contro circa $35.000 su Fable 5. Poiché l'Intelligence Index ora colloca Opus 5 davanti a Fable 5, non si tratta di "quasi-Fable-5 a meno" — ma di qualità di prim'ordine per circa la metà della bolletta mensile.
Il selettore di impegno cambia di nuovo i calcoli. Una pipeline di supporto ad alto volume può gestire la maggior parte delle chiamate con impegno basso o medio — più economico rispetto ai numeri sopra — e riservare l'impegno massimo per la manciata di ticket veramente complessi. L'impostazione di Anthropic è che anche le configurazioni economiche battono il meglio dei rivali, quindi raramente paghi per capacità che non usi. Modella la tua specifica combinazione di livelli di impegno invece di supporre che ogni chiamata operi al massimo.
Come accedere e utilizzare Claude Opus 5
Opus 5 è disponibile immediatamente in cinque luoghi: Claude.ai (dove è l'opzione predefinita sul piano Max e la più potente su Pro), l'API Claude (ID modello nei documenti di Anthropic), Claude Code (per la codifica da terminale e IDE) e Claude Cowork (per lavoro collaborativo e multi-step degli agenti). Gli utenti dell'API impostano il livello di sforzo come parametro, quindi il compromesso costo-capacità è programmabile per richiesta. Se già utilizzi Opus 4.8, il passaggio è un cambio di ID modello allo stesso prezzo — l'aggiornamento a basso attrito che Anthropic ha rilasciato da un po'.
A chi è rivolto: tre scenari
1. Pipeline agentiche e di uso del computer
Se il tuo prodotto esegue agenti multi-step o guida un browser o un desktop, i risultati di AutomationBench e OSWorld 2.0 di Opus 5 sono mirati proprio a te — ora supportati da un indipendente Intelligence Index #1. Esegui la maggior parte dei passaggi con uno sforzo medio e scala ad alto/massimo per quelli difficili; testa sulle tue tracce di agenti prima di impegnarti.
2. Team di sviluppo che monitorano il budget
Opus 5 è in Claude Code fin dal primo giorno al prezzo di Opus 4.8. Con il vantaggio dell'Intelligence Index è un codificatore predefinito forte; l'unica citazione mancante è un numero SWE-bench Verified indipendente (Fable 5 detiene ancora quel record al 95,0%). Per i team già su Claude, l'aggiornamento è a basso rischio e senza aumento di prezzo.
3. Imprese che standardizzano su un unico modello
Ampia disponibilità, contesto di classe 1M, il profilo di allineamento Opus più sicuro e un quadrante dello sforzo che copre sia il lavoro bulk economico che il ragionamento complesso rendono Opus 5 un singolo default plausibile per lavoro misto da ufficio e ingegneria — a un costo molto più facile da difendere rispetto a un flagship di frontiera.

Sicurezza e allineamento
Anthropic posiziona Opus 5 come la sua release Opus più sicura: "il modello Opus più allineato" e "il meno suscettibile di essere indotto a un uso improprio". Una conseguenza pratica è rilevante per le implementazioni reali: Anthropic prevede che i classificatori informatici di Opus 5 intervengano circa l'85% in meno rispetto a quelli di Fable 5. In parole povere, ciò dovrebbe significare meno falsi rifiuti su lavori legittimi di sicurezza, codifica o ricerca — una frustrazione comune con i modelli di frontiera pesantemente protetti — continuando a bloccare gli usi impropri reali. Come sempre, è bene validare in base ai propri contenuti e requisiti di conformità, invece di accettare la posizione per fede.
The Fable 5 export-control story is now in the system prompt
Fable 5’s launch was anything but smooth, and that context matters for anyone comparing Claude Opus 5 against it. Three days after Claude Fable 5 and Claude Mythos 5 shipped on June 9, 2026, Anthropic suspended both models to comply with a U.S. Commerce Department export-control order; the controls were lifted on June 30 and access was restored on July 1. That sequence is documented history — Simon Willison watched the Anthropic API start returning errors in real time, and Anthropic published its own statement about the suspension and restoration.
What is new is how Opus 5 handles questions about it. The model’s training cutoff is May 2026, so the shutdown and its reversal fall outside what it learned. The roughly 200,000-character Claude Opus 5 system prompt that red-teamer Pliny the Liberator posted on July 25 — a document Anthropic has not confirmed matches production — records the full timeline and instructs the model to answer questions about the suspension plainly rather than deny it, pointing users to Anthropic’s official statement when it cannot confirm the current status. It is a concrete example of a vendor writing post-cutoff history into the prompt so the model does not improvise about its own family.
Quando non usarlo
Non cercare Opus 5 quando hai bisogno specificamente di un numero di codifica SWE-bench Verified verificato in modo indipendente da citare oggi — quella cifra non è ancora pubblicata, e Fable 5 (95.0%) la possiede ancora. Non dare per scontato che ogni impostazione di sforzo sia la #1; il 61 in cima alla classifica è l'impostazione massima, e le impostazioni inferiori scambiano un po' di qualità per costo, quindi fai un benchmark del livello di sforzo che effettivamente utilizzerai. E per testo puro ad alto volume e sensibile alla latenza senza necessità di ragionamento, un modello di livello efficienza più economico (per esempio Gemini 3.6 Flash a $1.50 / $7.50) sarà comunque più economico per token — Opus 5 è un modello di ragionamento e agente, non un modello per testo voluminoso.
Domande frequenti
Quanto costa Claude Opus 5?
$5 per 1 milione di token in input e $25 per 1 milione di token in output — gli stessi di Opus 4.8, e la metà dei $10/$50 di Fable 5. [Anthropic]
Opus 5 è davvero il modello #1?
Nell'Artificial Analysis Intelligence Index, sì, al momento in cui scriviamo: Claude Opus 5 (massimo sforzo) è in testa con 61 su 170 modelli, davanti a Fable 5 (60). Si tratta di un punteggio indipendente, non di una dichiarazione del fornitore. Altre classifiche e il tuo carico di lavoro personale potrebbero classificare diversamente, e le classifiche cambiano man mano che vengono aggiunti modelli.
Cos'è l'effort dial?
Un'impostazione per richiesta (bassa/media/alta/max) che scambia token — e quindi costo e latenza — per capacità. Max è in cima alla classifica; le impostazioni più economiche superano ancora la maggior parte dei rivali secondo Anthropic. Gli utenti API la impostano come parametro.
Opus 5 è meglio di Fable 5?
Sull'indipendente Intelligence Index (61 vs 60) e su Anthropic's Frontier-Bench v0.1 (43.3% vs 33.7%), sì — a metà prezzo. Fable 5 guida ancora il SWE-bench Verified misurato indipendentemente (95.0%), quindi per citazioni di pura accuratezza di codifica, Fable 5 mantiene quella specifica corona.
Come si confronta Opus 5 con Opus 4.8?
Stesso prezzo di $5/$25, benchmark del fornitore materialmente più alti (Frontier-Bench v0.1 43.3% vs 18.7%) e miglioramenti in ogni valutazione di scienze della vita monitorata, più il nuovo quadrante dello sforzo e un allineamento più sicuro. Per gli utenti esistenti della versione 4.8 si tratta di un aggiornamento gratuito senza aumento di prezzo.
Quanto è sicuro?
Anthropic lo definisce il modello Opus più allineato e il meno suscettibile ad abusi, e prevede che i suoi classificatori informatici interverranno circa l'85% meno spesso rispetto a quelli di Fable 5 — tipicamente meno rifiuti falsi su lavori legittimi.
Dove posso usare Claude Opus 5?
Claude.ai (predefinito su Max, il più potente su Pro), l'API Claude, Claude Code e Claude Cowork — disponibili dal 24 luglio 2026.
Qual è la finestra di contesto?
Classe Opus-family da 1M token (Opus 4.8 è 1M senza sovrapprezzo per contesto lungo). Anthropic non ha separatamente specificato una cifra per Opus 5, quindi considerare come classe 1M finché non viene confermato.
Supporta immagini o video?
Opus 5 è principalmente un modello di ragionamento per testo e strumenti. Per la comprensione multimodale pesante (immagine/video), un modello come Gemini 3.1 Pro è costruito appositamente; usa Opus 5 per testo, codice e agenti.
Il risultato finale
Claude Opus 5 si è rivelato essere più di una mossa di prezzo. Ha un prezzo da cavallo di battaglia — $5/$25, la metà di Fable 5 e lo stesso di Opus 4.8 — ma ora guida l'indipendente Artificial Analysis Intelligence Index con 61 (massimo sforzo), supportato da robusti benchmark dei fornitori (Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0), un quadrante dello sforzo genuinamente utile e il profilo di allineamento più sicuro di qualsiasi Opus. L'unica avvertenza è un numero ancora mancante da SWE-bench Verified indipendente, dove Fable 5 (95.0%) mantiene la citazione per l'accuratezza del codice. Per gli utenti esistenti di Claude, l'aggiornamento è a basso rischio e non aumenta la bolletta; per tutti gli altri, Opus 5 è ora il modello da battere in termini di qualità-prezzo — validalo sul tuo carico di lavoro e instradalo insieme a ogni concorrente tramite un endpoint compatibile con OpenAI su OrcaRouter.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
