
Claude Opus 5.5 esegue, Claude Fable 5.1 consiglia: il prezzo del ciclo di advisor di Claude Code
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Fable 5.1 scrive il piano di progettazione. Claude Opus 5.5 lo esegue in un ciclo. Fable 5.1 torna come consulente e accetta o rifiuta il risultato. Questo è lo schema che X/@dotey ha pubblicato il 22 settembre 2026 — il giorno in cui il fornitore ha rilasciato Claude Opus 5.5 — presentandolo come un assetto per risparmiare token, raggiunto sotto la pressione dei costi: impostare il consulente su Fable, eseguire Opus e lasciare che il modello costoso parli solo nei punti decisionali. Quello che stanno usando non è più un trucco sui prompt né una configurazione di subagent. È lo strumento consulente integrato di Claude Code, una funzionalità lato server fatturata alle tariffe del modello consulente, in aggiunta a tutto ciò che spende il modello principale. E il consiglio è la parte economica. Rileggere la conversazione per produrlo non lo è — il contesto dell'esecutore è diventato economico da rileggere, quello del consulente non lo è mai stato. Questa singola asimmetria decide se vale la pena eseguire il ciclo, ed è ciò che il resto di questo articolo quantifica in termini di costi.
Cos'è in realtà il loop
Lo strumento advisor abbina il tuo modello principale a un secondo modello, di solito più potente, che Claude consulta nei momenti chiave — prima di adottare un approccio, quando un errore continua a ripetersi o prima di dichiarare completata un'attività. L'advisor riceve l'intera conversazione, incluse tutte le chiamate agli strumenti e i relativi risultati, e restituisce indicazioni che il modello principale applica poi. Non chiama mai strumenti e non produce mai output rivolto all'utente. Sei tu a scegliere quale modello fornisce consulenza; Claude decide quando chiamarlo.
Quest'ultima parte è ciò che distingue questo dal pattern orchestratore-e-subagenti che la comunità di Claude Code stava facendo circolare ad agosto. I subagenti sono delega: un pianificatore scompone il lavoro e lo smista ai worker, e configuri esplicitamente il modello di ciascuna corsia. L'advisor è escalation: un solo modello guida l'intera attività, e il modello costoso viene chiamato in causa a metà esecuzione per una decisione che il modello alla guida non può prendere da solo. Non c'è alcun pool di worker, nessun grafo dei task e nessun prompt di orchestrazione da mantenere. Il ciclo pratico descritto da @dotey — pianifica, esegui, verifica, ripeti — è l'aspetto che quel meccanismo assume quando punti l'advisor su Fable 5.1 e gli lasci presidiare la condizione di uscita del ciclo.
La stessa formulazione di Anthropic della strategia è schietta riguardo alla forma della vittoria: l’advisor "può solo trasferire la capacità che l’executor non possiede". Tutto ciò che segue dipende da quanta capacità manchi effettivamente, e da quanto spesso l’executor lo ammetta.
Perché Claude Opus 5.5 ha cambiato l'aritmetica

Listino prezzi pubblicato da Anthropic, per milione di token. Queste sono cifre del fornitore, non stime:
• Claude Opus 5.5 — $4 input, $20 output, $0,20 lettura cache, $5 per una scrittura cache da 5 minuti
• Claude Opus 5 — $5 input, $25 output, $0,50 lettura cache, $6,25 per una scrittura cache di 5 minuti
Claude Fable 5.1 — 10 $ per l'input, 50 $ per l'output, 0,25 $ per la lettura della cache, 12,50 $ per una scrittura della cache di 5 minuti
Due dettagli in quell'elenco contano più dei prezzi di richiamo. Primo, le letture dalla cache su Opus 5.5 sono il 5% dell'input di base, secondo la nota di Anthropic stessa, mentre la maggior parte dei modelli Claude si attesta al 10% e Fable 5.1 al 2,5%. Fable 5.1 ha il moltiplicatore migliore e perde comunque sui dollari assoluti — 0,20 $ contro 0,25 $ — perché la sua tariffa di input di base è due volte e mezzo più alta.
Secondo, e questo è il meccanismo su cui si basa il loop: attivare o disattivare l'advisor in Claude Code non invalida la cache dei prompt del modello principale, così il contesto lungo e reinviato ripetutamente dell'executor resta economico a 0,20 $ per milione. La lettura della conversazione da parte dell'advisor stesso non viene messa in cache. Ogni consultazione elabora da capo l'intera trascrizione, alla tariffa di input di Fable 5.1 di 10 $ per milione. Un executor che rilegge dieci volte un contesto di 500K token paga letture dalla cache; un advisor consultato dieci volte paga dieci nuovi addebiti di input su una trascrizione che continua a crescere. Più il contesto del tuo executor diventa economico, più la lettura non in cache dell'advisor risalta — e Opus 5.5 ha appena reso il contesto dell'executor il 60% più economico di quello di Opus 5.
Configurarlo in Claude Code
L'advisor è sperimentale e Anthropic lo dichiara nel banner di sessione — "Advisor Tool (sperimentale) è attivo e può utilizzare più token". Comportamento, prezzi e disponibilità possono cambiare. Fatta questa premessa, la meccanica è documentata:

• Attivalo con /advisor fable, oppure esegui /advisor senza argomenti per un selettore. La scelta viene salvata nell'impostazione advisorModel nelle tue impostazioni utente e persiste tra le sessioni. /advisor off lo disattiva.
• Per una singola sessione senza modificare il valore predefinito salvato, avvia con claude --advisor fable. Il flag non è elencato in claude --help, e Claude Code esce all'avvio se l'abbinamento non è valido anziché partire con un advisor ignorato silenziosamente.
• Imposta un valore predefinito persistente nel tuo file di impostazioni con {"advisorModel": "fable"}.
• Per disattivarlo completamente, imposta CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — il comando /advisor scompare e qualsiasi advisorModel configurato viene ignorato.
• L'abbinamento deve essere almeno altrettanto capace del modello principale. Claude Opus 5.5 accetta Fable e Opus 5 o versioni successive come consulenti. Un consulente Opus 4.6 o Sonnet viene rifiutato da Claude Code; un consulente Opus 4.7 o Opus 4.8 viene associato e poi rifiutato dall'API. Fable 5.1 come modello principale accetta solo Fable 5.1.
• Versioni minime: lo strumento advisor richiede Claude Code v2.1.98 o successiva; Fable come modello principale o come advisor richiede v2.1.170 o successiva; Fable 5.1 richiede v2.1.257 o successiva. La forma con token di /advisor — quella che funziona in -p, nell'Agent SDK, nell'app desktop e nel Remote Control — richiede v2.1.260 o successiva.
L'advisor è disponibile solo tramite Anthropic-API. Non è disponibile su Amazon Bedrock, Claude Platform on AWS, Agent Platform di Google Cloud o Microsoft Foundry, e dipende dal recupero dei feature flag, quindi una sessione con una variabile come DISABLE_TELEMETRY impostata lo tiene disattivato.
• Nei piani in cui l'utilizzo di Fable viene addebitato sui crediti di utilizzo, Fable come advisor viene addebitato allo stesso modo e richiede un consenso una tantum. Finché non lo accetti, /advisor fable non viene salvato e claude --advisor fable esce all'avvio indirizzandoti invece verso /model fable.
Subagenti ereditano qualunque consulente tu abbia configurato e rieseguono lo stesso controllo di abbinamento sul proprio modello. Questa è l'unica interazione tra questo pattern e il pattern dei subagenti: un subagente che esegue un modello più piccolo può essere autorizzato ad avere un consulente che il suo genitore non ha.
La forma dei costi, analizzata nel dettaglio
Nulla di quanto segue è una misurazione. La forma dei token è inventata per rendere visibile l'aritmetica; i prezzi sono le tariffe pubblicate da Anthropic. Supponi una sessione dell'executor che legge 1M di token di input nuovi e genera 500K token di output, e tre consulenze con l'advisor, ciascuna delle quali rilegge una trascrizione di 200K token e restituisce circa 600 token di indicazioni — all'incirca le due o tre consulenze per attività che lo stesso system prompt di Anthropic richiede.
• Esecutore su Claude Opus 5.5 — 1M di input a $4,00 più 500K di output a $10,00 = $14,00
• Consulente su Claude Fable 5.1 — 600K in input a $6,00 più circa 1.800 token in output a circa $0,09 = $6,09
• Il circuito, totale — circa 20,09 $
• Lo stesso scenario eseguito end-to-end su Fable 5.1 — $10,00 di input più $25,00 di output = $35,00
• La stessa configurazione sul solo Opus 5.5 — $14.00
Il loop si colloca tra i due, che è esattamente dove Anthropic lo posiziona: circa il 43% più economico rispetto a eseguire Fable 5.1 dall'inizio alla fine, e circa il 44% più costoso rispetto al solo executor. Interpreta il secondo numero come quello onesto. L'advisor non è un risparmio; è l'acquisto di un giudizio di livello Fable su tre decisioni, e conviene solo se quelle tre decisioni cambiano l'esito. Porta la trascrizione alla finestra di contesto da 1M e ogni consulto costa 10 $ da solo. Lascia che l'executor inizi a chiedere sulla maggior parte dei compiti invece che su pochi, e stai pagando le tariffe dell'advisor su tutto il carico di lavoro — a quel punto, come dice Anthropic, eseguire il modello stesso dell'advisor è la via più economica per ottenere lo stesso punteggio.
Cosa dicono le misurazioni di Anthropic stessa
Anthropic ha pubblicato risultati misurati per questo pattern, e sono riportati dal fornitore: eseguiti dall'azienda che vende entrambi i modelli, sul proprio harness di benchmark. Sono ancora gli unici numeri del loro genere, e includono il caso contro il pattern, motivo per cui vale la pena leggerli attentamente.
• Opus 5 come esecutore con Fable 5.1 come consulente ha ottenuto $7,69 per tentativo sul benchmark interno di Anthropic per l'agentic coding — la configurazione più accurata misurata da Anthropic. Sono 3,5 punti in più rispetto a Opus 5 da solo con l'impostazione predefinita, a un costo leggermente inferiore, e circa 2,5 punti in più rispetto a Fable 5.1 da solo, a un costo pari a circa una volta e mezza. Il divario di 3,5 punti è stato distinto dal rumore tra esecuzioni con cinque tentativi per attività.
• La stessa combinazione sulla lettura di grafici ha eguagliato Fable 5.1 da solo a sforzo medio entro il margine di rumore — 65,0 contro 67,5 — a un costo per attività pari a circa 2,6 volte, perché il consulente veniva interpellato su quasi ogni attività.
• Su GPQA Diamond, il guadagno segue quasi perfettamente il divario di capacità: un esecutore Haiku 4.5 ha guadagnato moltissimo, un esecutore Sonnet 5 qualche punto, e un esecutore di frontiera quasi nulla.
• Il tasso di consultazione è la variabile fragile. Un esecutore Sonnet 5 a basso sforzo ha guadagnato 23 punti su DeepSWE con un advisor, poi ha smesso del tutto di chiedere su SWE-bench Pro e non ha guadagnato nulla.
• Latenza: circa due chiamate extra a modelli frontier per attività, ciascuna sul percorso critico.
Due cose di quelle prove hanno un peso diretto sul ciclo così com'è questa settimana. Le misurazioni usavano Opus 5 come esecutore, perché Opus 5.5 non esisteva quando sono state eseguite. E Anthropic riferisce che Opus 5.5 si comporta al livello di Fable 5.1 nella maggior parte dei lavori, pur costando il 40% in meno per l'esecuzione — entrambe affermazioni del fornitore, nessuna delle due riprodotta in modo indipendente. Se il divario tra esecutore e consulente è ciò che il consulente viene pagato per colmare, allora un divario più stretto è un acquisto più piccolo. Il modello non è peggiorato quando Opus 5.5 è stato rilasciato; ciò che vende è diventato meno scarso.
Le modalità di guasto che incontrerai davvero
Questi sono comportamenti documentati, non congetture, e il primo è il motivo per cui leggere questa sezione prima di eseguire il debug di qualsiasi cosa:
• Un advisor silenziosamente assente. Se l'API rifiuta l'abbinamento con l'advisor, Claude Code lo allega, l'API lo rifiuta e Claude Code invia di nuovo la richiesta senza l'advisor. Il resto della conversazione prosegue quindi senza advisor e senza alcun messaggio di errore. Rimane disattivato fino a /clear o /compact, anche dopo che passi a un modello principale compatibile.
• Un caso rifiutato in silenzio. Per gli abbinamenti che Claude Code stesso rifiuta, l'advisor semplicemente non viene mai associato alle richieste del modello principale. L'output di /advisor e una notifica te lo comunicano — ma nulla fallisce, quindi una sessione che pensavi stesse ricevendo consulenza potrebbe non averla mai ricevuta.
• Consenso non fornito. Con Fable selezionato come advisor su un piano che richiede il consenso ai crediti di utilizzo, le richieste vengono inviate senza l'advisor finché non lo accetti. Una sessione in background avviata con --advisor fable parte senza un advisor anziché uscire.
• Un elenco di autorizzati che non controlli. Se l'elenco di autorizzati availableModels della tua organizzazione esclude il modello advisor, Claude Code non lo invocherà e dovrai scegliere un modello consentito con /advisor.
• Ovunque non esista. Solo tramite l'API di Anthropic: niente Bedrock, niente Claude Platform on AWS, niente Google Cloud Agent Platform, niente Microsoft Foundry. Attraverso un gateway, la disponibilità dipende dal fatto che il gateway inoltri la richiesta intatta all'API di Anthropic — il che è una proprietà del gateway, non qualcosa che si possa dare per scontato.
Dove si inserisce OrcaRouter
Entrambi i modelli in questo ciclo sono su OrcaRouter oggi al prezzo di listino di Anthropic con 0% di ricarico — il prezzo di listino del provider viene passato tal quale, quindi la tariffa che vedi è la tariffa che Anthropic pubblica. Claude Fable 5.1 si colloca a anthropic/claude-fable-5.1 e Claude Opus 5 a anthropic/claude-opus-5, dietro un'unica chiave API. Claude Opus 5.5 non è ancora una delle nostre route; è disponibile tramite l'API di Anthropic stessa e i principali cloud, e lo diremo anziché lasciar intendere il contrario.

Quello che una sola chiave ti offre qui è la possibilità di cambiare idea a basso costo. L'economia del loop dipende dal rapporto di prezzo tra esecutore e advisor, e quel rapporto si è mosso due volte in sette settimane — da Opus 5 a Opus 5.5 il 22 settembre, e da Fable 5 a Fable 5.1 il 1° settembre, il che ha ridotto la lettura della cache di quel modello da 1,00 $ a 0,25 $ per milione. Ognuno di questi cambiamenti modifica la risposta a «l'advisor vale la pena?», e verificare quella risposta non dovrebbe richiedere un secondo contratto. Failover automatico è l'altra metà: ti permette di indirizzare una porzione di traffico verso un modello che non hai ancora caratterizzato, con un fallback su quello che già conosci, invece di scommettere un percorso di produzione su una tabella di lancio. E se stai costruendo il pattern da solo anziché usare lo strumento integrato di Claude Code, il DSL di routing compone più modelli in un'unica chiamata — uno step di pianificazione su un modello seguito da step di esecuzione su un altro, dietro un unico endpoint.
Una nota di onestà sull'ambito: lo strumento advisor stesso è uno strumento lato server che gira sull'API di Anthropic, quindi un livello di routing non può sostituirlo. Quello che possiamo fare è rendere i modelli disponibili a una chiave di distanza, al prezzo di listino, così la decisione di mantenere o eliminare l'advisor spetta a te, da prendere sui tuoi numeri.
Come decidere per il proprio carico di lavoro
La guida di Anthropic stessa è il punto di partenza giusto ed è piacevolmente priva di sentimentalismi: esegui la tua suite di valutazione su tre configurazioni — l'esecutore da solo, l'esecutore con un consulente, e il modello del consulente da solo a basso sforzo — e ricontrolla a ogni rilascio di modello, perché i rilasci spostano sia il divario di capacità sia il rapporto prezzo. L'ultima delle tre è la baseline da battere. Se il modello del tuo consulente da solo a basso sforzo ottiene lo stesso punteggio del ciclo per meno denaro, hai la tua risposta.
Le due variabili da tenere d'occhio sono quelle a cui Anthropic dà un nome. Il divario di capacità: un ampio divario tra esecutore e consulente è il punto in cui il consulente guadagna il suo compenso, e Opus 5.5 ha ridotto quel divario dal basso. Il tasso di consultazione: i guadagni lo seguono quasi uno a uno, ed è abbastanza sensibile al prompt da crollare — un esecutore a sforzo basso può smettere di accorgersi di essere bloccato, e un abbinamento che consulta sulla maggior parte dei task a sforzo predefinito può scendere quasi a zero. Il system prompt fornito da Anthropic richiede una chiamata al consulente prima del lavoro sostanziale e una prima di terminare, il che si traduce in due o tre consulti per task; l'abbinamento di coding che ha prodotto il guadagno di 3,5 punti operava a quella cadenza. Prevedi un budget per questo, fissane un limite massimo, e considera ogni consulto al di sopra di esso come un segnale che il tuo esecutore è mal configurato, piuttosto che che il task fosse difficile.
Per il loop specifico di questo articolo, tre impostazioni concrete fanno la maggior parte del lavoro. Mantieni Claude Opus 5.5 al suo sforzo medio predefinito invece di puntare a high, perché lo sforzo incide direttamente sui costi e i dati di Opus 5.5 di Anthropic mostrano che medium rinuncia a molto poco. Imposta l'advisor con /advisor fable e verifica che il banner compaia davvero — un banner mancante significa un advisor silenziosamente assente. E prima di scalare il pattern, misura i token per attività completata anziché il prezzo per token, perché è quello il numero che il loop dovrebbe muovere.
Domande frequenti
Il consulente consuma la stessa quota Fable di una sessione Fable?
Nella fatturazione API, i token dell'advisor vengono fatturati alle tariffe di input e output proprie di Fable 5.1, e i limiti di frequenza dell'advisor attingono allo stesso bucket per modello delle chiamate dirette a quel modello: di conseguenza, una chiamata all'advisor soggetta a limiti di frequenza si presenta come un errore all'interno del risultato dello strumento anziché far fallire la tua richiesta. Nei piani in abbonamento, l'utilizzo dell'advisor rientra nei limiti di utilizzo del tuo piano, tranne per il fatto che un advisor Fable viene addebitato sui crediti di utilizzo nei piani in cui l'utilizzo di Fable lo è. La conseguenza pratica è che l'advisor non è un budget separato che puoi spendere liberamente; compete con tutto il resto che fai su quel modello.
Che cosa può realmente vedere il consulente?
L'intera conversazione, inclusi ogni chiamata di strumento e ogni risultato di strumento — contenuti dei file, output dei comandi, messaggi di errore, tutto quanto. Viene eseguita con un proprio prompt di sistema fornito da Anthropic e restituisce un piano, una correzione o un segnale di arresto. Da ciò derivano due dettagli. Primo, ogni consultazione rilegge l'intera trascrizione, ed è per questo che il costo cresce con il ciclo anziché rimanere costante. Secondo, se la tua sessione tocca materiale che non invieresti a un secondo modello al livello di prezzo del consulente, il consulente è un secondo modello che legge tutto quanto.
Cosa cambierebbe la risposta
Due cose, ed entrambe sono più vicine di quanto sembrino. Se valutatori indipendenti pubblicano un'esecuzione a sforzo comparabile di Opus 5.5 contro Fable 5.1 e confermano il restringimento che Anthropic sostiene, il margine rimanente del consulente sulla maggior parte dei compiti è esiguo — e il loop diventa uno strumento per la coda difficile invece che un'impostazione predefinita. Se invece il tasso di consultazione rimane stabile e il divario di capacità resta ampio su lavori agentici lunghi, l'aritmetica di cui sopra è ciò tra cui stai scegliendo, e 6$ di consulenza su un'esecuzione da 14$ sono un'opzione a buon mercato per non rilasciare la cosa sbagliata.
Ciò che non cambierà è il meccanismo in cima a questo pezzo. Il contesto dell'executor è memorizzato in cache ed economico; il contesto dell'advisor non è né l'uno né l'altro. Qualsiasi ciclo che consulti un modello più costoso nel mezzo di un'attività eredita quell'asimmetria, qualunque cosa dica il listino prezzi il mese prossimo.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
