
Prezzi API di Claude Opus 5: $5 / $25 per 1M token, cache a $0,50, e quanto costa davvero
- DeepSeekNUOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M di token
- z-aiNUOVOZ.ai: GLM 5.32026-08-1860Intelligenza75Codice
- obsidianNUOVOQwen3.8 27B2026-08-1552Intelligenza68Codice
- qwenNUOVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNUOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenza69Codice
- grokNUOVOSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenza77Codice
Claude Opus 5 costa $5,00 per milione di token in input e $25,00 per milione di token in output sull'API di Claude Opus 5 — la stessa tariffa che il modello ha sulla directory OrcaRouter, verificata il 2026-08-18, senza alcun ricarico. Questo lo rende la metà del prezzo di Claude Fable 5 ed esattamente quanto costava Claude Opus 4.8, e la scheda tariffaria sulla pagina live del modello Claude Opus 5 è quella su cui basare il budget. Le leve contano più del prezzo di punta: l'input riutilizzato viene fatturato a $0,50 per milione tramite la cache dei prompt, il batch scende a $2,50 / $12,50, e la beta fast-mode è a $10 / $50. Questa pagina è il riferimento dei prezzi per il modello — la scheda tariffaria esatta, quanto costa realmente una richiesta, come il prezzo si confronta con la concorrenza, quando non è l'acquisto giusto e come chiamarlo tramite un unico endpoint compatibile con OpenAI con la propria chiave.
I prezzi sono per milione di token (input / output), al 18 agosto 2026. Le cifre in dollari sono lette dalle tariffe API pubblicate da Anthropic e incrociate con la pagina del modello OrcaRouter per Claude Opus 5; le tariffe per cache, batch e modalità veloce sono annunciate da Anthropic. I prezzi cambiano: verifica prima di creare.
Il prezzo esatto, verificato oggi
Ecco la scheda tariffaria completa per Claude Opus 5, verificata il 2026-08-18:

• Input — $5,00 per 1M token in caso di cache miss.
• Output — $25.00 per 1 milione di token.
• Scrittura della cache del prompt — $6,25 per 1M con un TTL di 5 minuti, $10,00 per 1M con un TTL di 1 ora.
• Lettura cache prompt — $0,50 per 1 milione di token, uno sconto del 90% su qualsiasi input che reinvii.
• Batch API — $2.50 in input / $12.50 in output, uno sconto fisso del 50%, asincrona.
• Fast mode — $10 in input / $50 in output, un sovrapprezzo del 2x per una velocità di output fino a circa 2,5x, beta di Anthropic.
• Finestra di contesto — 1M token, fino a 128K di output.
OrcaRouter trasmette la tariffa del provider senza alcun ricarico, quindi l'importo mostrato nella directory è quello che paghi. Nella pagina del modello live, la scheda riporta $5.00 / $25.00 per 1M, lettura cache $0.500, scrittura cache $10.00 (la tariffa TTL di 1 ora), con i badge Vision, Tools, JSON e Reasoning.
Le leve che modificano il prezzo effettivo
La tariffa base è solo il punto di partenza. Tre modificatori cambiano quanto Opus 5 ti costa effettivamente:
• Cache dei prompt — il contesto riusato costa $0,50 per milione invece di $5 per quello fresco. La lunghezza minima del prefisso memorizzabile in cache è scesa a circa 512 token su Opus 5, quindi anche un system prompt stabile e modesto è idoneo. Per qualsiasi agente o chat che rinvia un grande prefisso a ogni turno, la cache è la leva più grande sulla fattura — e poiché Anthropic associa la cache alla singola chiave API, rimanere su una sola chiave (un solo canale) è ciò che fa sì che i cache hit vadano a segno.
• Batch — L'API batch di Anthropic esegue i job in modo asincrono, con risultati generalmente disponibili entro 24 ore, a metà prezzo esatto: $2,50 / $12,50. Si combina con la cache dei prompt ed è adatta per eval, classificazione in blocco e generazione offline dove la latenza non è rilevante.
• Modalità veloce — $10 / $50 per un throughput di output fino a ~2.5x, utile per lavori ad alto output con requisiti critici di latenza. Non è combinabile con l'API batch ed è una beta di prima parte di Anthropic; la tariffa di pass-through standard da un router è quella base di $5 / $25.
Quanto costa realmente una richiesta
I prezzi per token sono astratti, quindi ecco alcuni esempi concreti alle tariffe attuali:
• Singola chiamata chat, 50K input + 20K output — $0.25 + $0.50 = $0.75.
• 1M input + 1M output — $5 + $25 = $30.
• Turno agentico, 200K di contesto in cache + 20K di input nuovo + 30K di output — $0.10 + $0.10 + $0.75 = $0.95. Lo stesso turno con cache fredda — 220K di input nuovo a $1.10 — ammonta a $1.85. La cache quasi lo dimezza.
• Un mese da 10M di token con una ripartizione 70% input / 30% output, con l'80% dell'input servito dalla cache: 1.4M di input fresco ($7.00) + 5.6M in cache ($2.80) + 3M di output ($75) ≈ $85. Senza cache, lo stesso mese costa $110.
Due avvertenze fanno salire il tasso effettivo. Opus 5 è un modello pensante: il pensiero adattivo è attivo per impostazione predefinita, e i token di pensiero vengono fatturati come output a 25 dollari al milione. Un prompt difficile con un livello di impegno elevato può spendere una grande parte del suo budget di output in ragionamento, quindi il costo effettivo dell'output su lavoro complesso supera di gran lunga una stima approssimativa. Inoltre, il tokenizer attuale di Anthropic è più verboso rispetto a quello della generazione precedente, quindi lo stesso testo inglese costa più token (e più denaro) rispetto ai modelli Claude più vecchi. Abbassa il livello di impegno per le chiamate semplici e limita l'output dove puoi.
Come i prezzi di Opus 5 si confrontano con la concorrenza

Confrontato con i prezzi di listino pubblicati il 2026-08-18:
• Claude Opus 4.8 — $5 / $25. Stesso prezzo della generazione precedente. Opus 5 ha lo stesso costo per il modello più recente, che è il caso facile per l'aggiornamento.
• Claude Fable 5 — $10 / $50. Opus 5 costa la metà del livello di punta di Anthropic, con lo stesso contesto da 1 milione di token.
• Claude Sonnet 5 — $3 / $15 standard ($2 / $10 prezzo di lancio fino al 31 agosto 2026). Il livello Sonnet è più economico del 40% su input e output — la scelta naturale quando non serve il ragionamento di livello Opus.
• GPT-5.6 Sol — $5 / $30. Stesso prezzo di input, output più economico su Opus 5.
• GPT-5.6 Terra — $2 / $12. La fascia media di volume per lavori ad alto volume non di frontiera.
• Gemini 3.6 Flash — $1.50 / $7.50. Un modello di livello Flash per traffico multimodale economico e veloce.
• Kimi K3 — $3 / $15. Un'ammiraglia open-weights a circa metà delle tariffe di Opus.
• DeepSeek V4 Pro — $0,44 / $0,88 fuori punta (le fasce di punta lo raddoppiano). Il flagship economico open-weights, un universo di prezzi completamente diverso.
L'inquadramento onesto: Opus 5 non è un modello economico — è un modello di punta al prezzo di metà del livello superiore (Claude Fable 5) e esattamente quanto costava la generazione precedente. Vince sul prezzo per contesto lungo e sul prezzo per ragionamento complesso, non sulla tariffa assoluta. Se il tuo traffico è composto da prompt brevi e compiti semplici, un Sonnet da $3 o un modello DeepSeek da $0.44 sono la scelta più economica.
Quando Opus 5 è la scelta sbagliata
Quattro casi in cui questo prezzo non è quello che desideri:
Prompt brevi e semplici. Al di sotto di circa 20K token senza ragionamento profondo, il premium di Opus è uno spreco. Claude Sonnet 5 a $3 / $15 (o $2 / $10 tramite la finestra di lancio) gestisce il livello di volume a un costo inferiore del 40%, e un modello di classe Gemini Flash o DeepSeek costa ancora molto meno.
Volume ad alta intensità di ragionamento. Poiché il pensiero viene fatturato come output, un prompt complesso ad alto sforzo può costare ben più della tariffa di output nominale. Se il tuo carico di lavoro è costituito da molte chiamate difficili, misura i token di output effettivi prima di impegnarti: la tariffa effettiva può sorprenderti.
Prezzo per token come unico obiettivo. Se un punteggio benchmark di frontiera o il contesto da 1M non è un requisito imprescindibile, i flagship più economici (GPT-5.6 Terra, DeepSeek V4 Pro) o i modelli di fascia Flash (Gemini 3.6 Flash) offrono tariffe per token molto più basse per la stragrande maggioranza del traffico.
Budget di latenza rigorosi. Opus 5 è un grande modello di ragionamento — p50 del time-to-first-token di circa 7 secondi nella misurazione di 7 giorni di OrcaRouter. Per le chat in tempo reale dove il TTFT sub-secondo è importante, è il modello sbagliato a prescindere dal prezzo.
Come chiamarlo su OrcaRouter

Claude Opus 5 è ospitato su OrcaRouter come ID modello anthropic/claude-opus-5, servito tramite l'endpoint compatibile OpenAI all'indirizzo api.orcarouter.ai/v1 alla tariffa del provider con zero ricarico. Se hai già un client OpenAI, la migrazione è un cambio di base URL e ID modello — nient'altro. La stessa chiave e lo stesso endpoint supportano oltre 200 modelli, quindi Opus 5 si trova accanto a Claude Sonnet 5, Claude Haiku 4.5, i livelli GPT-5.6, la famiglia Gemini e i modelli open-weight che vorresti confrontare con esso, e puoi instradare in base alla difficoltà invece di re-integrare ciascuno di essi.
Due caratteristiche specifiche di OrcaRouter da menzionare in una pagina dei prezzi. BYOK: porta la tua chiave Anthropic e Anthropic ti fattura direttamente alle sue tariffe — OrcaRouter aggiunge $0 per token e mantiene intatti i limiti di frequenza e i crediti del tuo provider. Guardrails: il PII Shield e la policy sui contenuti vengono eseguiti prima della fatturazione, quindi una richiesta bloccata restituisce un 400 pulito e non viene mai addebitata, e l'Agent Firewall valuta le chiamate a tool e MCP prima che vengano eseguite.
La nota di onestà che conta per una pagina di prezzi: instradiamo il modello, non fissiamo il suo prezzo. La cifra di $5 / $25 è la tariffa di Anthropic passata direttamente, e quando Anthropic la modifica l'elenco si aggiorna di conseguenza — che è esattamente il motivo per cui questa pagina riporta la data. Se chiami Anthropic direttamente ottieni la stessa tariffa; OrcaRouter esiste per il percorso a chiave singola e zero ricarichi, se vuoi un unico endpoint per tutta la linea di modelli.
Fonti e data
Tutti i prezzi sopra riportati sono stati verificati il 18 agosto 2026. Le cifre relative a Claude provengono dai listini API pubblicati da Anthropic e sono state incrociate con la pagina del modello OrcaRouter per Claude Opus 5 (controllata lo stesso giorno). I prezzi GPT-5.6 post-taglio sono le tariffe pubblicate da OpenAI; le cifre per Gemini, Kimi e DeepSeek sono le attuali voci della directory OrcaRouter, con DeepSeek V4 Pro indicato alla tariffa fuori punta (le fasce di punta la raddoppiano). I prezzi di Anthropic sono rimasti stabili dal lancio di Opus 5 il 24 luglio 2026, ma possono cambiare: se trovi una pagina precedente sui "prezzi di Opus 5", verificane la data. I numeri qui riportati sono aggiornati a oggi.
Ogni prezzo sopra riportato è il tasso live sulla pagina del modello Claude Opus 5 — verificato il 2026-08-18 a margine zero, pronto per la tua chiave.
Confrontati in questo articolo4
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
