
Le demo di Claude Opus 5.5 costano da 3 a 26 dollari: come interpretare i primi giorni di build
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 495 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 186 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
Due cifre risalenti alla prima settimana di Claude Opus 5.5 descrivono lo stesso modello e divergono di un ordine di grandezza. Uno sviluppatore riporta un laboratorio interattivo sulle lenti ormai completo — una pagina in cui trascini un anello di messa a fuoco e osservi un piano di fuoco luminoso che spazza una valle — con una spesa API di $25.66 e un'ora e 26 minuti di tempo effettivo. Una rassegna molto condivisa delle demo di lancio valuta un'animazione di un castello in Blender costruita proceduralmente, completa di fuochi d'artificio e riflesso sul lago, $13.30 e 35 minuti. Un thread che è arrivato in prima pagina su r/ClaudeAI parla di $3.21. Il fornitore ha rilasciato Claude Opus 5.5 il 22 settembre 2026 a $4 per milione di token in input e $20 per milione in output, e nessuna di queste tre cifre è sbagliata. Misurano cose diverse, e se stai pianificando il budget basandoti su di esse devi sapere quali.
Il divario non è rumore. È la differenza tra ciò che un'esecuzione di un agente produce e ciò che consuma, e negli ultimi quattro giorni ha prodotto una quantità notevole di quest'ultimo con ben poca rendicontazione al riguardo. Quindi ecco l'aritmetica che nessuno ha pubblicato accanto alle demo, poi la parte del lancio che è effettivamente su un listino prezzi e può essere verificata.
Cosa ha effettivamente comprato $25.66
L'estremità costosa dell'intervallo è quella più utile, perché il costruttore ha pubblicato sia l'artefatto sia il conto.
Il laboratorio di lenti di Ryan Sael, intitolato "Il piano di messa a fuoco," è una singola pagina interattiva costruita da un unico prompt in una sola sessione. Mette una lente fotografica sullo schermo, ti permette di trascinare la ghiera di messa a fuoco e ti mostra la cosa che ogni fotografo conosce ma che quasi nessuno ha visto: il sottile foglio nel mondo in cui una foto diventa davvero nitida. Ruota la ghiera e il foglio si sposta, gli elementi in vetro scorrono avanti o indietro dentro il barilotto per mostrare il perché, e una console riporta la distanza, l'apertura e la zona nitida — 60 cm, f/2, 1,9 cm di profondità, con le impostazioni con cui la pagina si apre. Chiudi il diaframma da f/2 a f/16 e la zona nitida si allarga mentre il cono di luce si restringe. Una vista esplosa separa gli elementi in vetro. Non c'è alcun modello di immagine da nessuna parte nella pipeline, né risorse scaricate: ogni elemento è disegnato e animato nel codice, ed è per questo che l'intera dimostrazione del cerchio di confusione è una simulazione dal vivo anziché un diagramma.
Questo è un explainer davvero valido, e l'affermazione che lo accompagna è insolitamente precisa: un solo tentativo, 1 ora e 26 minuti, 25,66 dollari di utilizzo API, con la pagina attiva su lens.lab.sael.net quando l'ho letta. La cifra è autodichiarata e non verificabile, ma è anche l'unico costo di una demo in circolazione che viene accompagnato da una durata di sessione per cui dividere.
Fai i conti sul listino prezzi. Ai prezzi pubblicati di Claude Opus 5.5, 4 $ per milione di token in input e 20 $ per milione in output, 25,66 $ corrispondono a un quantitativo compreso tra 1,28 milioni e 6,4 milioni di token a seconda della miscela: il limite superiore se l'esecuzione fosse stata fatta solo di input, quello inferiore se fosse stata fatta solo di output. Una build agentica come questa si colloca più o meno nel mezzo, e il motivo per cui resta più vicina al limite inferiore è la voce che quasi tutti trascurano: le letture dalla cache su Claude Opus 5.5 costano 0,20 $ per milione, un quarantesimo della tariffa di input, perciò una sessione lunga che continua a rileggere lo stesso codebase in crescita paga quasi nulla per quel traffico. Dieci milioni di token di input in cache costano 2 $. Il lato output è dove si accumula un'ora e mezza di un modello che scrive codice, ragiona e lo riscrive: a 20 $ per milione, un milione di token di output fa 20 $, e i token di ragionamento vengono fatturati come output. Il numero di Sael è coerente con un'esecuzione che ha prodotto nell'ordine di un milione di token di output a fronte di un lato input ampio, economico e in cache: esattamente l'aspetto che ha una build non presidiata di 86 minuti.
Ne derivano due cose. Primo: il taglio del prezzo di listino che ha attirato l’attenzione il giorno del lancio, da $5/$25 a $4/$20, è una variazione del 20% per token e, di per sé, non avrebbe reso economica questa esecuzione; il taglio del costo di lettura della cache da $0,50 a $0,20 è la voce che ha reso sostenibile un ciclo di 90 minuti. Secondo, e meno rassicurante: nulla nel report da $25,66 ti dice se l’esecuzione è andata bene. Un one-shot ben eseguito e una sessione che ha annaspato per un’ora e mezza per poi riuscire producono la stessa fattura.
La cifra di 13,30 dollari non regge alla propria aritmetica.
La parte centrale della fascia è istruttiva per un motivo diverso. Una rassegna di demo di lancio pubblicata il 23 settembre riporta un confronto diretto in cui è stato chiesto a Claude Opus 5.5 di costruire proceduralmente un'animazione Blender di dieci secondi partendo da un solo prompt — castello, riflesso sul lago, fuochi d'artificio — contro GPT-6 Astra, senza editing manuale, e riporta 35 minuti e 199.600 token di output per circa 13,30 $, contro 28 minuti e circa 14,50 $ per GPT-6 Astra. Il conteggio dei token è la parte interessante, perché non quadra con il prezzo.
199.600 token di output al costo di 20 $ per milione di Claude Opus 5.5 fanno 3,99 $, non 13,30 $. Per arrivare a 13,30 $ solo sull'output, servirebbero 665.000 token. Il denaro mancante è nelle altre colonne: input a 4 $ per milione, scritture in cache a 5 $ per milione per un breakpoint di cinque minuti e 8 $ per milione per un'ora, ed eventuali ritentativi. Non è una contraddizione nel report — è il report che è onesto su un conteggio di token che conta una cosa e una fattura che ne conta quattro, che è la confusione più comune in assoluto nei discorsi sui costi della settimana di lancio. Se devi prendere un solo numero da una demo pubblicata, prendi la cifra in dollari e considera qualsiasi conteggio di token accanto ad essa come una descrizione parziale dell'esecuzione.
Nella fascia più economica, la contabilità si assottiglia ancora di più. Il thread su r/ClaudeAI che riporta 3,21 $ di utilizzo API per una build finita è tipico del genere: un titolo, un video e nessuna ripartizione. È plausibilmente una sessione più breve, un artefatto più piccolo o molto input in cache. Non è qualcosa su cui pianificare un budget, e non ho potuto verificarne un solo dollaro.
Perché ognuno di questi numeri è un limite inferiore
Il problema qui non è che chi costruisce dissimula. È la selezione. Le demo che circolano sono quelle che hanno funzionato, pubblicate dalle persone per cui hanno funzionato, e i quattro tentativi che hanno prodotto una pagina rotta sono costati quanto quello che non l’ha fatto. La rassegna che ha compilato il confronto con Blender lo dice apertamente — che nessuno pubblica i fallimenti — e la sua voce più dettagliata ne è un esempio lampante: un sito di un marchio di orologi che ha mancato il brief e ha usato un font illeggibile al primo tentativo, e ha avuto bisogno di un secondo per diventare la versione che è stata mostrata.
Anche "One shot" sta facendo un lavoro silenzioso in quel vocabolario. Descrive una singola sessione, non un singolo tentativo, e a una sessione è consentito contenere tutta l'autocorrezione che il modello riesce a generare — che, in un'esecuzione di 86 minuti, è parecchia. Il modello che riscrive il proprio codice due volte all'interno di un'unica finestra di contesto è un one shot e due tentativi.
Quindi, la lettura onesta dei primi quattro giorni si articola in tre livelli di evidenza, e non bisogna farne una media:
• Costo autodichiarato con una durata della sessione — utilizzabile per l'ordine di grandezza, non verificabile. I $25.66 di Sael su 1h26m sono l'elemento più solido di questo livello.
• Costo autodichiarato con un conteggio di token — il più delle volte internamente incoerente, come dimostra la cifra di $13.30.
• Una cifra in dollari senza nulla a supporto — un segnale che qualcuno ha costruito qualcosa, e niente di più.
La parte del lancio che è su un listino prezzi
Elimina le rivendicazioni della demo e il quadro verificabile è ristretto e chiaro. Tutte le cifre riportate di seguito sono le tariffe pubblicate da Anthropic, lette dalla documentazione del modello e dall'annuncio della stessa azienda del 25 settembre 2026:
• Input — $4 per milione di token. Output — $20 per milione, con i token di pensiero fatturati come output, e il pensiero adattivo di Claude Opus 5.5 sempre attivo e impossibile da disattivare.
• Letture dalla cache — $0,20 per milione, un moltiplicatore di 0,05x. Scritture sulla cache — $5 per milione alla soglia dei cinque minuti, $8 per milione a un'ora. Batch API — sconto del 50% in entrambe le direzioni, $2 e $10.
• Modalità veloce — $8 input e $40 output per milione, fino a 2,5 volte la velocità, e Anthropic continua a etichettarla come anteprima di ricerca.
• Envelope — contesto da 1M di token, 128K token di output in sincrono e 300K sulla Batch API con un header beta, knowledge cutoff affidabile di giugno 2026, sforzo predefinito medio anziché l'alto predefinito di Claude Opus 5.
• Disponibilità — l'API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS, con dismissione garantita non prima del 22 settembre 2027.
Le dichiarazioni sulle prestazioni del fornitore stesso, etichettate come dichiarazioni: Claude Opus 5.5 si colloca al livello di Claude Fable 5.1 nella maggior parte delle attività, costa circa il 40% in meno da eseguire rispetto a Claude Opus 5 e genera output più del 30% più velocemente. Il 40% è una media dei carichi di lavoro scelta dal fornitore, non un numero da listino, e i due non dovrebbero essere citati come se fossero lo stesso tipo di fatto.
Il controllo indipendente è più esiguo della tabella del fornitore e indica la stessa direzione con un margine minore. Artificial Analysis assegna a Claude Opus 5.5 un punteggio di 57,6 sul suo Intelligence Index, insieme a 61,4 su Humanity's Last Exam, 66,9 su SciCode e 84,7 sul recall su contesto lungo nelle cifre riportate dalla pagina del suo modello. Sulla stessa misurazione dell'agente di codifica della stessa pubblicazione, che riporta il costo per attività anziché il costo per token, il numero si muove nella direzione opposta: allo sforzo massimo il costo per attività sale a circa 13,04 $, contro 10,79 $ per Claude Opus 5 nello stesso harness. Un token più economico di cui il modello consuma di più non è un'attività più economica. È la stessa lezione che stanno insegnando le bollette della demo, in arrivo da una terza parte.
Cosa fare diversamente nella seconda settimana
Se il numero di $25,66 è quello che ti ha fatto venire voglia di provare questo, la mossa utile non è preventivare $25,66 — è fare in modo che la tua esecuzione produca un numero che puoi spiegare.
Imposta esplicitamente l'effort invece di accettare il valore predefinito, perché è la manopola che fa variare i token per attività più di quanto faccia la scelta del modello, e il valore predefinito su questo modello è cambiato rispetto a Claude Opus 5. Metti deliberatamente in cache il prefisso stabile: il prompt minimo memorizzabile in cache su Claude Opus 5.5 è di 512 token, in calo rispetto a 1.024, quindi i prefissi condivisi brevi che prima non venivano mai messi in cache ora lo fanno. Concedi a qualsiasi job di lunga durata un margine in max_tokens, dato che il thinking fa parte di quel budget e non può più essere disattivato — le stesse linee guida di migrazione di Anthropic suggeriscono di partire da 64K per il lavoro ai livelli di effort più alti e di calibrare da lì. E strumenta l'esecuzione alla fine, non all'inizio: leggi il campo model di primo livello su ogni risposta, perché sui prompt che i suoi classificatori segnalano, Anthropic reindirizza la richiesta all'interno della stessa chiamata, e la stringa del modello che hai inviato non descrive ciò che ha risposto.
Quest'ultimo punto è il momento in cui un router smette di essere una comodità. Una build che gira in modo non presidiato per un'ora e mezza attraverso un confine di salvaguardia può tornare indietro avendo silenziosamente completato alcuni turni su un modello più piccolo, e l'unico modo per scoprirlo è guardare. Claude Opus 5.5 è su OrcaRouter al listino prezzi di Anthropic stesso con 0% di ricarico — la tariffa del provider passata direttamente, quindi una variazione di prezzo del fornitore è attiva qui lo stesso giorno in cui viene pubblicata — e questa è la cosa meno interessante che il routing fa qui. La cosa interessante è che un'unica API per oltre 200 modelli mette l'intero esperimento su una sola chiave, così «eseguilo sul modello di frontiera e fai fallback invece di fallire» è una riga di configurazione anziché un secondo contratto e una riscrittura. Il failover automatico è ciò che rende sicuro mettere un modello poco familiare su un percorso a cui tieni, e un rifiuto che puoi aggirare è un rifiuto che non conclude la tua esecuzione al minuto 70.
Il numero che si muoverà dopo
Anthropic ha dichiarato che Claude Sonnet 5.5 e Claude Haiku 5.5 arriveranno «nelle prossime settimane», e questo ridefinirà il prezzo di ognuna di queste demo senza cambiarne la forma: una tariffa per token più bassa rispetto a un conteggio di token che nessuno può prevedere in anticipo. La stessa incertezza che ha reso inutilizzabili i numeri della prima settimana varrà anche per quelli della prossima generazione: è il motivo per costruire l’abitudine ora, anziché dopo che il taglio di prezzo sarà arrivato di nuovo.
Per il momento, il riepilogo onesto è breve. Claude Opus 5.5 è reale, disponibile a livello generale, e ha un prezzo di 4 e 20 dollari, con le letture in cache più economiche che la linea abbia mai offerto. Le demo che ha prodotto nei suoi primi quattro giorni sono notevoli, e i loro cartellini del prezzo sono aneddoti. Se vuoi un costo per il tuo carico di lavoro, l'unico strumento che lo misura è la tua esecuzione, con un tetto di spesa, leggendo la fattura dopo.



Confrontati in questo articolo2
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
