Card del titolo hero generata per Claude Sonnet 5.5 vs Claude Fable 5.1, con sottotitolo 'Il modello economico è tre punti avanti', che mostra $2.00 di input e $10.00 di output per milione di token a sinistra contro $10.00 e $50.00 a destra, con sotto le cifre 56 e 53 dell'Artificial Analysis Intelligence Index v4.3, e il logo OrcaRouter composto nell'angolo in basso a destra.
Guides & Insights

Claude Sonnet 5.5 vs Claude Fable 5.1: il modello economico è avanti di tre punti

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Claude Sonnet 5.5 è arrivato il 28 settembre 2026 a 2,00 $ per milione di token di input e 10,00 $ per milione di token di output. Claude Fable 5.1, il modello della classe Mythos che il fornitore ha rilasciato il 1° settembre, si colloca a 10,00 $ e 50,00 $ sulle stesse due voci. La sintesi allettante è che Fable 5.1 sia quello costoso e quindi quello migliore, ma sull'Artificial Analysis Intelligence Index l'ordine è invertito: Claude Sonnet 5.5 ottiene 56 e Claude Fable 5.1 ottiene 53. Non è un artefatto di arrotondamento, e non è nemmeno tutta la storia, perché lo stesso valutatore li colloca a meno di tre centesimi per attività l'uno dall'altro sulla stessa suite — 7,60 $ contro 7,63 $. Una differenza di cinque volte nel tariffario è quasi svanita nel momento in cui un'attività viene completata. Ciò che resta è un insieme di differenze nella forma più che nel punteggio, e scegliere tra questi due è soprattutto una questione di quale forma abbia il tuo carico di lavoro.

Due listini tariffari, e l'unica riga in cui il divario non è quintuplo

Il confronto per token è netto e non richiede interpretazione.

• Input — Claude Sonnet 5.5 a $2,00 per milione di token contro Claude Fable 5.1 a $10,00, una differenza di cinque volte

• Output — $10,00 rispetto a $50,00 per milione, ancora esattamente cinque volte

• Lettura cache — 0,20 $ contro 0,25 $ per milione. È la voce che sostiene le lunghe esecuzioni degli agenti, e lo sconto crolla da 5× al 20%

• Scrittura cache — $2,50 contro $12,50 per milione per la finestra standard di cinque minuti, il divario singolo più ampio su entrambe le schede

• Batch — La modalità batch di Anthropic non si applica a nessuna di queste schede come si applica a quella di Fable 5.1: Fable 5.1 è stato lanciato con prezzi batch dimezzati a 5,00 $ per l'input e 25,00 $ per l'output. Leggi la riga relativa al batch direttamente dalla pagina dei prezzi di Anthropic prima di dare per scontato che valga per tutta la famiglia

• Contesto e limite massimo — 1.000.000 di token di contesto e 128.000 token di output massimo su entrambi. Sull'API Message Batches, Claude Sonnet 5.5 supporta fino a 300.000 token di output dietro l'header beta output-300k-2026-03-24, che per la generazione in blocco è una differenza reale di limite massimo, non una trovata di marketing

C'è un modesto punto a favore di Claude Sonnet 5.5 che il listino prezzi sottostima. Anthropic riferisce che il modello richiede tipicamente molti meno token per svolgere lo stesso lavoro rispetto al suo predecessore, il che, a suo dire, si traduce in un costo per attività inferiore fino al 30%. Questa è un'affermazione del fornitore su un confronto diverso — Sonnet 5.5 contro Sonnet 5 — e non è una prova su questo confronto. È, tuttavia, il meccanismo che spiega ciò che ha rilevato la misurazione indipendente.

Dove va a finire il divario di prezzo quintuplo

Artificial Analysis ha eseguito entrambi i modelli il 29 settembre 2026 sotto un unico harness e un'unica etichetta di configurazione, "Adaptive Reasoning, Max Effort, Default Fallback", su Intelligence Index v4.3. Le due cifre principali sono 56 per Claude Sonnet 5.5 e 53 per Claude Fable 5.1 — il modello più economico in vantaggio di circa tre punti su una scala in cui lo stesso valutatore colloca il modello mediano a 26. Entrambi sono etichettati come modelli con nome del fornitore sulla stessa pagina, quindi questo è un unico strumento e un'unica istantanea, non due.

Poi la colonna dei costi, e il motivo per cui questo abbinamento è interessante anziché ovvio. Nella stessa esecuzione dell'indice, Claude Sonnet 5.5 costa $7.602633 per attività e Claude Fable 5.1 costa $7.629706. Ventisette millesimi di dollaro di differenza. La scomposizione è dove la cosa si fa strana: il solo lato input di Claude Fable 5.1 è di $3.73 per attività rispetto alla componente di input sostanzialmente più piccola di Sonnet 5.5, e i suoi soli token di ragionamento costano $2.36 per attività. Il modello che è cinque volte più economico per token non è affatto più economico per attività completata.

La causa è il volume, e i due modelli falliscono in direzioni opposte.

• Token di output in tutta la suite dell'indice — Claude Sonnet 5.5 ha generato 410.577.501 contro i 188.465.663 di Claude Fable 5.1, su una suite in cui la mediana monitorata è di 88 milioni. Entrambi sono ben al di sopra della mediana; Sonnet 5.5 è più del doppio di Fable 5.1 e quasi cinque volte la mediana

• Token di output per attività — 192.838 per Sonnet 5.5 contro 78.111 per Fable 5.1, con la quota di ragionamento di 142.386 contro 47.240. Sonnet 5.5 ragiona all’incirca tre volte più a lungo per attività

• Token di input in tutta la suite di indici — 18,5 miliardi per Sonnet 5.5 contro 5,6 miliardi per Fable 5.1. Sonnet 5.5 ne ha letti tre volte tanto, ed è il numero più sommesso della coppia nonché quello che consuma la tariffa di input più economica

• Prezzo misto con un mix 7:2:1 di input, lettura cache e output — $1,54 per Sonnet 5.5 contro $7,17 per Fable 5.1. Questa è la voce che corrisponde al listino tariffario, ed è la voce che descrive un carico di lavoro con output brevi e ben delimitati

Mettendo insieme questi elementi, l'affermazione onesta è questa: il divario di prezzo aggregato è reale e quello per attività no. Quale dei due numeri descriva la tua bolletta dipende interamente dal fatto che le tue attività terminino o si dilunghino, e la suite di indici è progettata per lasciarle dilungare.

La scala dello sforzo è la vera decisione

Entrambi i modelli espongono un parametro effort — low, medium, high, xhigh, max — ed entrambi sono stati misurati a ogni livello il 2026-09-29. Questa è la parte del confronto che nessun listino prezzi può esprimere, perché il modello economico a un livello inferiore batte il modello costoso a un livello inferiore con un ampio margine e il modello costoso si distingue solo vicino ai livelli più alti.

• Sforzo ridotto — Claude Sonnet 5.5 ottiene 35,84 a 0,41 $ per attività; Claude Fable 5.1 ottiene 46,82 a 2,37 $. All'ultimo gradino il modello costoso è avanti di undici punti, per quasi sei volte il costo

• Sforzo medio — 40,74 a 0,59 $ contro 48,92 a 2,98 $. Fable 5.1 mantiene un vantaggio di otto punti a cinque volte il costo

• Alto sforzo — 46,74 a 1,08 $ contro 51,15 a 3,91 $. Il divario si restringe a quattro punti e mezzo; il rapporto dei costi resta a circa 3,6×

• Sforzo Xhigh — 51,85 a 2,74 $ contro 53,20 a 5,98 $. A un punto e un terzo di distanza, al 46% del prezzo

• Massimo sforzo — 55,98 a $7,60 contro 53,35 a $7,63. L'ordine si inverte e il costo converge entro mezzo punto percentuale

Leggi insieme la quarta e la quinta riga e il profilo di questo confronto emerge. Claude Sonnet 5.5 a xhigh ottiene 51,85 — a un punto e mezzo indice dal miglior punteggio di Claude Fable 5.1 a qualsiasi effort — a 2,74 $ per attività contro 7,63 $. Se il tuo lavoro deve essere vicino alla frontiera invece che sulla frontiera stessa, quella riga è la risposta completa, e fa risparmiare il 64% per attività completata. Porta Sonnet 5.5 al max e compri tre punti in più per 2,8 volte il costo, il che ti porta alla stessa bolletta del max di Fable 5.1 con un punteggio marginalmente migliore e un profilo di ragionamento molto diverso.

Quell'ultima frase merita di essere messa a fuoco, perché è abbastanza controintuitiva da richiedere una doppia verifica. A parità di sforzo massimo, il modello con un listino prezzi cinque volte più economico costa, per attività, quanto il modello con quello costoso. Ci arriva emettendo 2,5 volte più token di output, dei quali la quota di ragionamento è tre volte più grande. La documentazione di Anthropic spiega parte del meccanismo: il tokenizer è cambiato, e lo stesso testo produce circa il 30% di token in più su Claude Sonnet 5.5 rispetto ai modelli precedenti. Questo è uno dei vari fattori che contribuiscono, ed è un utile promemoria del fatto che i conteggi dei token di output non sono confrontabili tra revisioni del tokenizer senza dichiararlo.

La latenza è il punto in cui i due smettono di assomigliarsi

La convergenza dei punteggi non si estende al tempo. Sullo stesso snapshot del 2026-09-29, Artificial Analysis riporta un tempo al primo token di 254,41 secondi per Claude Fable 5.1 e di 2,80 secondi per Claude Sonnet 5.5 sulla porzione a prompt lungo, con velocità di output mediane rispettivamente di 67,9 e 49,4 token al secondo. Si tratta di una differenza di due ordini di grandezza nel tempo che un chiamante attende prima che arrivi qualsiasi cosa, ed è il numero singolo più rilevante dal punto di vista operativo in questo confronto.

Entrambe le cifre richiedono che i rispettivi qualificatori siano dichiarati chiaramente. Il TTFT di Fable 5.1 è misurato sul tipo di prompt lungo; la fetta di prompt medio del valutatore per lo stesso modello nello stesso giorno è di 117,60 secondi, quindi la cifra di 254 secondi è la coda e non una costante. I 2,80 secondi di Sonnet 5.5 rappresentano la sua mediana complessiva, con la banda di varianza dello stesso valutatore che va da 1,91 secondi al quinto percentile a 4,23 al novantacinquesimo. La documentazione della piattaforma di Anthropic descrive la latenza comparativa di Fable 5.1 come più lenta e quella di Sonnet 5.5 come veloce, il che è coerente in termini di direzione senza costituire una misurazione.

La nostra infrastruttura offre una terza lettura, perché instradiamo Claude Fable 5.1 e misuriamo ciò che serviamo. Nei sette giorni fino al 28 settembre, sul traffico di OrcaRouter stesso, Claude Fable 5.1 registra un primo token mediano a 6.973 millisecondi con un 95° percentile a 10,0 secondi, una velocità di output di 65,8 token al secondo e un tasso di errore dello 0,349%. Quel p50 è più di cento volte più veloce del valore relativo al prompt lungo del valutatore, il che non è tanto una contraddizione quanto una definizione dei termini: un primo token rivolto agli sviluppatori su un prompt breve e un primo token di un benchmark su un prompt lungo sono misurazioni di cose diverse. Chiunque pianifichi in base al numero della classifica dovrebbe sapere quale dei due sta acquistando.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

Onestà nel sourcing, retention e la migrazione di cui nessuno parla

Le tabelle di benchmark dei fornitori e le valutazioni indipendenti sono strumenti diversi e non dovrebbero mai essere sottratte l'una dall'altra. La tabella di lancio di Anthropic per Claude Sonnet 5.5 riporta Terminal-Bench 4.0 al 70,6%. Artificial Analysis, eseguendo il proprio harness, riporta 63,6% per lo stesso modello su una valutazione con lo stesso nome. Per Claude Fable 5.1 la differenza va nella direzione opposta: Anthropic ha riportato 55,8% al lancio e l'harness indipendente registra 52,0%. Nessuna delle due coppie è una correzione dell'altra. Giudica ciascuna secondo i propri criteri, e preferisci quella indipendente quando devi decidere dove indirizzare il traffico di produzione.

Anche l'approccio alla conservazione dei dati è diverso, ed è il tipo di differenza che emerge solo in una revisione degli acquisti. Anthropic dichiara che Claude Sonnet 5.5 è disponibile con conservazione zero dei dati, lo stesso approccio adottato con Opus 5.5 e Sonnet 5. Il materiale di lancio di Claude Fable 5.1 descrive una politica incrementale sull'uso dei dati che vi si affianca e un deployment separato nell'ambito di Project Glasswing con una finestra di conservazione predefinita di 30 giorni per il monitoraggio della sicurezza, con l'accordo di conservazione zero descritto come stato temporaneo. Se il tuo team risponde a una revisione del trattamento dei dati, quella distinzione è una voce concreta, non una nota a piè di pagina, e vale la pena leggere l'attuale pagina delle policy di Anthropic anziché qualsiasi suo riassunto, compreso questo.

Il costo della migrazione è asimmetrico in un modo che raramente entra nella copertura del lancio. Passare a Claude Sonnet 5.5 non è un cambio di stringa del modello. La guida alla migrazione di Anthropic afferma che valori non predefiniti di temperature, top_p e top_k ora restituiscono un errore 400, che un tool_choice di any o di uno strumento denominato viene rifiutato in toto, e che thinking: {"type": "disabled"} deve diventare between_tools se si eseguiva con il thinking iniziale disattivato. Il tipo between_tools è accettato con effort low, medium e high e restituisce un 400 con xhigh o max. Sull'API di Claude e su Google Cloud, l'uso del computer è supportato solo tramite il toolset computer_toolset_20260801; il più vecchio computer_20251124 viene rifiutato. Nessuna di queste si applica a un passaggio a Claude Fable 5.1, che è un upgrade della stessa famiglia da Fable 5 con tre breaking change proprie. Se si stanno valutando i due come obiettivi di migrazione paralleli, il modello più economico è quello più costoso da adottare.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Quale mettere e dove

La decisione che deriva dai numeri è una decisione su quanto del tuo traffico sia ben definito.

• Lavoro circoscritto, ad alto volume e guidato dagli strumenti — Claude Sonnet 5.5, con xhigh effort se devi essere vicino alla frontiera. È indietro di un punto e mezzo indice rispetto al miglior risultato di Fable 5.1, a un costo inferiore del 64% per attività completata, restituisce il primo token in circa tre secondi e la sua voce di scrittura in cache più economica rende economicamente accessibile un prefisso di contesto ricostruito

• Lavoro a lungo orizzonte e aperto, dove una risposta sbagliata costa cara — Claude Fable 5.1. Raggiunge il punteggio massimo di Sonnet 5.5 allo stesso costo per attività, ma ci arriva con un terzo dei token di ragionamento e un quarto dell'input, il che conta quando l'attività è davvero aperta e la forma della suite di valutazione assomiglia al tuo problema

• Superfici interattive vincolate dalla latenza — Claude Sonnet 5.5, e non c'è partita. Sull'istantanea del valutatore stesso, il divario sul primo token è di due ordini di grandezza nel tipo di prompt lungo, e la lettura sul prompt medio lo riduce solo a circa 118 secondi. Una superficie di chat non può basarsi sul valore di Fable 5.1 senza batching o streaming per aggirarlo

• Generazione in blocco con output lunghi — Claude Sonnet 5.5, grazie al limite di output di 300.000 token disponibile sull'API Message Batches dietro l'header output-300k-2026-03-24, contro un limite di 128.000 token in tutti gli altri casi. Conferma il prezzo del batch prima di impegnarti; la tariffa batch non è identica tra le due schede

• Lavoro che deve estendersi su più account o passare il ragionamento tra sistemi — leggi la documentazione di Anthropic sul preserved thinking prima di entrambe le cose. I blocchi di pensiero sono legati al modello e all'account che li ha prodotti, e Sonnet 5.5 è il primo Sonnet a essere distribuito con classificatori che impediscono l'estrazione del ragionamento. È al tempo stesso una funzionalità di conformità e un vincolo

• Carichi di lavoro regolamentati o sensibili alla conservazione — consultare la policy attuale anziché la copertura di lancio. Claude Sonnet 5.5 è stato lanciato con la conservazione zero dei dati disponibile; il materiale di Fable 5.1 descrive una policy incrementale con una finestra predefinita di 30 giorni su un deployment e la conservazione zero come stato intermedio

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

Su OrcaRouter, Claude Fable 5.1 e Claude Sonnet 5 si trovano entrambi dietro un'unica credenziale al prezzo di listino del provider con 0% di ricarico, quindi la riga di lettura della cache e la modifica del tokenizer sono le uniche cose che muovono la tua fattura quando passi dall'uno all'altro. Claude Sonnet 5.5 non è ancora una route sulla nostra piattaforma — il modello ha un giorno di vita — quindi l'affermazione onesta è che oggi lo raggiungi tramite l'API di Anthropic stessa. Chiunque utilizzi Fable 5.1 tramite noi può calcolare il costo del passaggio il giorno in cui arriva senza cambiare nient'altro della propria integrazione, e nel frattempo il failover automatico tra provider è ciò che rende sicuro provare un modello così nuovo su un percorso che deve restare attivo.

Il verdetto è più ristretto di quanto il divario di prezzo lasci intendere. Claude Sonnet 5.5 è l'opzione predefinita migliore per quasi tutto ciò che è circoscritto — totalizza tre punti in più sull'indice indipendente, risponde in pochi secondi e, a xhigh, resta entro un punto e mezzo dal tetto di Fable 5.1 a ben meno della metà del costo per attività. Claude Fable 5.1 conserva un vero argomento, ed è quello che la stessa tabella comparativa di Anthropic mette in evidenza: quando il lavoro è aperto e il costo di sbagliare supera il costo di pensare più a lungo, un prezzo di input cinque volte superiore compra un modello che raggiunge lo stesso punteggio senza spendere tre volte i token di ragionamento per arrivarci. Scegli in base alla forma del compito, non alla dimensione del listino, perché in cima alla scala dello sforzo quei due modelli ti fatturano lo stesso.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno