Scheda del titolo generata con la dicitura «GPT-6 vs Claude Fable 5.1», con un chip che recita «Entrambi $10,00 in ingresso / $50,00 in uscita per milione» e un chip che recita «AA Coding: Fable 5.1 81,6 vs GPT-6 Astra 76,9», e un piè di pagina che recita «Valori dell'indice secondo Artificial Analysis; listini dalle pagine di ciascun fornitore.» Il logo OrcaRouter è sovrapposto nell'angolo in basso a destra.
Guides & Insights

GPT-6 vs Claude Fable 5.1: le tariffe coincidono, la classifica sul coding no

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

GPT-6 e Claude Fable 5.1 hanno esattamente la stessa tariffa: 10,00 $ per milione di token in input e 50,00 $ per milione in output. Questa è tutta la parte facile. I due nomi non sono lo stesso tipo di cosa — GPT-6 è una famiglia di tre modelli senza alcun gpt-6 endpoint dietro, e Claude Fable 5.1 è un unico modello pesabile con una sola scheda tariffaria — quindi la corrispondenza di prezzo non ti dice quasi nulla finché non decidi quale membro della famiglia GPT-6 sta rispondendo. Sulla classifica che conta di più per questa fascia, Fable 5.1 è primo e nessun modello GPT-6 lo è.

Quale GPT-6 si presenta a questo confronto?

Partiamo dalla denominazione, perché è ciò che determina la risposta. OpenAI distribuisce la generazione GPT-6 come tre id di modello separati: GPT-6 Astra in cima, GPT-6 Sol nel mezzo e GPT-6 Luna in fondo. Non esiste alcun modello chiamato GPT-6 che tu possa chiamare. Se chiedi openai/gpt-6 su qualsiasi gateway ottieni un 404, non una completion.

Solo uno dei tre presenta il listino da $10,00 / $50,00 che corrisponde a Claude Fable 5.1, e cioè Astra. Sol costa un quinto, a $2,00 / $10,00, e Luna un centesimo, a $0,10 / $0,50. Quindi «GPT-6 vs Claude Fable 5.1» in realtà è «GPT-6 Astra vs Claude Fable 5.1», se si insiste nel confrontare listini omogenei — e quello specifico confronto non è più quello interessante, per una ragione emersa solo alla fine di settembre.

Sul fronte di Anthropic non c'è una simile ambiguità. Claude Fable 5.1 è un singolo modello, rilasciato il 1º settembre 2026, con una finestra di contesto di 1.000.000 di token, un limite di output di 128.000 token e input di testo, immagini e file. Viene fornito con l'ID del modello anthropic/claude-fable-5.1. Citare un prezzo per «Fable 5.1» è inequivocabile in un modo in cui citare un prezzo per «GPT-6» non lo è mai.

Dove Fable 5.1 è effettivamente in vantaggio, e di quanto

Il divario che decide questo confronto non è l'indice generale. È la classifica del coding. Letto da Artificial Analysis e riportato nella voce del catalogo OrcaRouter per ciascun modello l'8 ottobre 2026:

• AA Coding Index — Claude Fable 5.1 81.6, classificato 1º tra i modelli di quella classifica; GPT-6 Astra 76.9, classificato 4º
• AA Intelligence Index — Claude Fable 5.1 53.4, posizione 8; GPT-6 Astra 52.7, posizione 9
• GPQA Diamond — Claude Fable 5.1 93.7 vs GPT-6 Astra 96.1
• Humanity's Last Exam — Claude Fable 5.1 59.1 vs GPT-6 Astra 54.7
• SciCode — Claude Fable 5.1 63.1 vs GPT-6 Astra 56.5
• Terminal-Bench v2.1 — Claude Fable 5.1 91.4 vs GPT-6 Astra 88.4
• Terminal-Bench v4.0 — Claude Fable 5.1 52.0 vs GPT-6 Astra 59.1
• Recall su contesto lungo — Claude Fable 5.1 85.3 vs GPT-6 Astra 80.7
• Contesto e output — 1,000,000 token in ingresso per Fable 5.1 contro 1,050,000 per Astra; 128,000 token in uscita per entrambi

Lo schema non è "un modello è migliore". Fable 5.1 vince le due classifiche che corrispondono alla scrittura e al lavoro software a lungo termine — SciCode e Terminal-Bench 2.1 — e Astra vince Terminal-Bench 4.0 e GPQA Diamond. Fable 5.1 ha un vantaggio di 4,4 punti su Humanity's Last Exam e di 4,6 punti sul recall a contesto lungo. Nell'indice generale i due sono distanti 0,7 punti, che rientra nel rumore che ci si aspetterebbe da un aggiornamento del benchmark.

Una precisazione vale per ogni numero di confronto tra modelli in questo pezzo e vale la pena dichiararla anziché nasconderla: Artificial Analysis non garantisce che due pagine di modelli siano visualizzate in base alla stessa revisione dell'indice nello stesso giorno, e ora suddivide i suoi gruppi di pari — i modelli open-weights sono classificati rispetto a modelli open-weights della stessa classe dimensionale, i modelli proprietari rispetto a una fascia di prezzo proprietaria. Un punteggio letto da una pagina e un punteggio letto da un'altra sono indicativi, non una misurazione controllata. Entrambe le cifre sopra provengono dallo stesso valutatore, ma considerate le differenze inferiori a un punto come direzione anziché precisione.

La complicazione che è arrivata il 29 settembre

Se avessi valutato questo confronto un mese fa, avresti schierato Astra, accettato un deficit di 4,7 punti nella codifica e pagato 10,00 $ / 50,00 $ per farlo. Non è più la mossa ovvia, perché GPT-6.1 Sol esiste — rilasciato il 29 settembre 2026, tre settimane dopo Astra e una settimana dopo il resto della famiglia.

GPT-6.1 Sol ottiene 51.8 sullo stesso Artificial Analysis Intelligence Index, contro il 52.7 di Astra, e ha un prezzo di listino di $2,00 / $10,00 — un quinto del listino di Astra. Non è nemmeno al vertice delle classifiche di coding; eredita la stessa forma a un punto di distanza da Astra invece di colmare il divario con Fable 5.1. Ma cambia l'economia della decisione. Se il motivo per cui cercavi un modello da $50 in output era "mi serve un ragionamento di frontiera su un compito difficile", ora GPT-6.1 Sol risponde alla maggior parte di questa esigenza a un decimo del costo di output. Se il motivo era specificamente "mi serve il miglior indice di coding disponibile", nessuno dei due modelli GPT-6 risponde, e il consiglio onesto è tenere Fable 5.1.

Vale la pena precisarlo esplicitamente: OpenAI non ha mai pubblicato un confronto diretto tra GPT-6 Astra e Claude Fable 5.1, e neppure Anthropic ha pubblicato un confronto tra Fable-5.1 e GPT-6. Ogni numero tra fornitori diversi in questo articolo è o il dato di un valutatore indipendente o il benchmark che un fornitore ha realizzato sul proprio modello. Qui non c'è alcun testa a testa condotto da nessuna delle due parti.

Il conto, piuttosto che l'adesivo.

Listini identici non producono fatture identiche, perché i contatori sottostanti differiscono.

• Input in cache, Fable 5.1 — 0,25 $ per milione nella scheda OrcaRouter, uno sconto del 97,5% sulla tariffa di input
• Input in cache, GPT-6 Astra — 1,00 $ per milione, uno sconto del 90%
• Scritture in cache — Fable 5.1 12,50 $ per milione, GPT-6 Astra 12,50 $ per milione, un pareggio netto
• Oltre 272.000 token di input — Astra ricalcola l'intera richiesta a 20,00 $ in / 75,00 $ out; Fable 5.1 non ha uno scaglione equivalente sul dato riportato nel catalogo
• Traffico, ultimi 7 giorni — Fable 5.1 1,73 milioni di token; GPT-6 Astra 76,2 milioni di token
• Tempo mediano al primo token — Fable 5.1 4.055 ms; GPT-6 Astra 3.500 ms
• Velocità mediana di output — Fable 5.1 90,1 token/s; GPT-6 Astra 70,4 token/s

La voce della cache è quella che sposta i soldi su un carico di lavoro a forma di Fable 5.1. Una lunga esecuzione di un agente che rinvia venti volte lo stesso contesto di repository da 200.000 token paga $0.25 per milione sulla porzione in cache invece di $10.00 — un ordine di grandezza in meno rispetto alla lettura in cache di Astra a $1.00. Su quella forma di richiesta, la scheda di intestazione identica non è affatto identica, e il vantaggio di Fable 5.1 nel coding si accompagna a un modo più economico di sfruttarlo.

Lo scaglione dei 272K per Astra fa l'opposto. Qualsiasi richiesta che lo superi viene ricalcolata a partire dal primo token, quindi un prompt di 300.000 token su Astra viene fatturato a $20,00 / $75,00 per l'intero importo, non solo per i 28.000 token oltre la soglia. Su un modello economico quello scaglione è un errore di arrotondamento; con un input da $10,00 è la differenza tra una richiesta da $3,00 e una da $6,00.

Eseguire entrambi senza scegliere in anticipo un vincitore

La versione pratica di questo confronto è che probabilmente li vuoi entrambi, e vuoi poter passare dall'uno all'altro per richiesta anziché per trimestre. Sia Claude Fable 5.1 sia ogni modello GPT-6 attivo si trovano nello stesso catalogo OrcaRouter — un'unica API davanti a oltre 200 modelli, il prezzo di listino del fornitore trasferito con markup 0%, così un cambiamento di prezzo di un fornitore è effettivo qui lo stesso giorno invece che alla tua prossima fattura — e il DSL di routing ti consente di suddividere il traffico in base alla dimensione della richiesta o alla quota di traffico. La configurazione che si adatta a questa coppia è una suddivisione per dimensione: invia le richieste brevi, di tipo coding, a Claude Fable 5.1 e instrada il lavoro a contesto lungo che farebbe scattare il passo da 272K di Astra verso un modello il cui listino non prevede alcun passo, poi amplia la fetta che le tue valutazioni favoriscono.

Il failover automatico tra provider è l'altra metà della questione. Nessuno di questi due modelli è immune a una brutta giornata, e una route che si degrada a metà esecuzione non è certo qualcosa che vuoi scoprire dal reclamo di un cliente.

A generated two-column comparison scoreboard titled "GPT-6 Astra vs Claude Fable 5.1 — the scoreboard". The left column, GPT-6 Astra, reads Input $10.00, Output $50.00, AA Intelligence 52.7, AA Coding 76.9, Context 1,050,000, Cached input $1.00. The right column, Claude Fable 5.1, reads Input $10.00, Output $50.00, AA Intelligence 53.4, AA Coding 81.6, Context 1,000,000, Cached input $0.25. A footer line reads "Index figures per Artificial Analysis; rate cards per each vendor page, read 8 Oct 2026." The OrcaRouter logo is composited in the bottom-right corner.

A cosa serve ciascun lato, in una riga ciascuno

Claude Fable 5.1 è il miglior modello per il coding sulla classifica indipendente ed è prezzato come fascia premium, con le letture in cache più economiche di qualsiasi modello in questa fascia. La famiglia GPT-6 non ha un membro che lo superi sul coding, e il membro della famiglia che condivide la sua scheda tariffaria — Astra — è quello che ora avete meno probabilità di scegliere, perché GPT-6.1 Sol offre prestazioni entro un punto dall'indice di Astra per un quinto del prezzo.

Quindi la risposta a «GPT-6 vs Claude Fable 5.1» dipende interamente da quale GPT-6 intendevi. Se intendevi il modello di punta della famiglia, Fable 5.1 vince la classifica di coding e perde sul costo per risposta contro un modello di un livello inferiore. Se intendevi la famiglia nel suo complesso, allora il miglior rapporto qualità-prezzo attuale sul fronte OpenAI di questo confronto è GPT-6.1 Sol a 2,00 $ / 10,00 $ — e non è ancora il leader nel coding. I listini corrispondono. Le classifiche no.

Screenshot of the OrcaRouter model page for anthropic/claude-fable-5.1, showing the Anthropic vendor label, a 2026-09-01 catalogue release date, a 1,000,000-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $10.00 per million input, $50.00 per million output, a 4.05 s median time to first token, a 10.00 s p95, and 1.7M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the OpenAI vendor label, a 2026-09-04 catalogue release date, a 1,050,000-token context window (shown as ctx 1M tokens), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, a 'Best for reasoning, coding, agentic' tag row, and a rate strip reading $10.00 per million input, $50.00 per million output, a 3.50 s median time to first token, a 10.00 s p95, and 76.2M tokens routed in seven days.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno