
Qwen 3.8 vs Claude Fable 5: la build 0902 prende il comando nel coding
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligenza76Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Quando Alibaba ha presentato in anteprima Qwen3.8-Max a Shanghai il 19 luglio 2026, ha fatto un'affermazione più forte di tutte le altre: questo modello da 2,4 trilioni di parametri è vicino al livello frontier e dietro solo a Claude Fable 5. All'epoca era impossibile valutarla. Non c'erano listini prezzi, né tabelle di benchmark, né licenze: solo una dichiarazione di posizionamento.
Il 3 agosto 2026, Qwen3.8-Max è stato reso generalmente disponibile — un vero tariffario a $2 / $6 per milione di token, una tabella di benchmark con i numeri, un endpoint compatibile con OpenAI e DashScope. Il 2 settembre Alibaba ha rilasciato il passo successivo senza cambiare il numero di versione: Qwen3.8-Max-0902, un aggiornamento post-addestramento pensato per la programmazione e il lavoro agentico, che ha debuttato al #1 nella classifica Code Arena: WebDev con 1.691 Elo. Claude Fable 5, il modello subito dietro al quale Alibaba ha passato luglio a posizionarsi, si attesta a 1.628 nella stessa classifica. La domanda di luglio si è fatta più tagliente: Qwen 3.8 è ancora "secondo solo a Fable 5", o l'asse della programmazione si è già ribaltato?
Una nota per gli sviluppatori — il modo più rapido per risolvere una questione come questa è eseguire entrambi i modelli sui tuoi prompt. OrcaRouter mette a disposizione oltre 200 modelli dietro un unico endpoint compatibile con OpenAI, così puoi mettere a confronto Qwen 3.8 Max con Fable 5 sullo stesso compito senza dover configurare due SDK.
Verdetto in breve. Qwen3.8-Max-0902 è la versione più forte finora del modello di punta da 2,4T di Alibaba, e il nuovo elemento a suo favore non è più solo auto-dichiarato: ha debuttato al #1 nella classifica indipendente Code Arena: WebDev con 1.691 Elo, sopra Claude Fable 5 (1.628, #8) in quella classifica. Il prezzo è invariato e resta decisivo — a $2 / $6 fissi su 1M di token, Qwen costa circa 5× in meno sull'input e 8× in meno sull'output rispetto ai $10 / $50 di Fable 5. Ciò che non si è colmato è il divario per l'uso generale: Artificial Analysis assegna a Qwen3.8-Max un punteggio di 56 nel suo Intelligence Index contro il 62 di Claude Fable 5, e nell'ultima settimana pubblicata della classifica generale Arena (24–30 ago) Fable 5 è al #1 (1.508 Elo) mentre Qwen3.8-Max è al #20 (1.479). Due verdetti, quindi: sul coding, il refresh 0902 di Qwen ora ha un arbitro e una vittoria; sul ragionamento ampio e verificato, Claude Fable 5 — e il più recente Claude Fable 5.1 di Anthropic, che guida l'indice AA con 66 — mantengono ancora il campo.
Punti chiave
• Qwen3.8-Max ha raggiunto la GA il 3 agosto 2026 e il suo aggiornamento 0902 è seguito il 2 settembre — nessun cambio di versione, stesse tariffe di $2 / $6, stesso contesto da 1M token.
• Il divario di prezzo è enorme: Qwen a $2 / $6 per 1M contro Fable 5 a $10 / $50. Ciò significa ~5× in input e ~8× in output, e la tariffa di Qwen è fissa su tutto il contesto di 1M di token, senza sovrapprezzo per i prompt lunghi.
• Entrambi i lati ora hanno punteggi indipendenti — e puntano in direzioni diverse. Qwen3.8-Max misura 56 sull'Artificial Analysis Intelligence Index (Claude Fable 5: 62), e la sua build 0902 è in cima a Code Arena: WebDev con 1.691 Elo contro 1.628 di Fable 5.
• La tabella dei benchmark di Qwen è ancora solida e ancora prodotta dal fornitore stesso. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — ma l'aggiornamento del 2 settembre è il primo risultato Qwen che un'arena indipendente ha classificato al primo posto.
• La lacuna sull’architettura nella scheda tecnica è colmata. Qwen3.8-2.4T-A95B ha ~95B di parametri attivi su un totale di 2.4T, distribuiti su 512 esperti — come reso noto con il rilascio open-weights del 12 agosto. L’architettura di Fable 5 rimane non divulgata.
• I pesi aperti sono stati rilasciati, non promessi. Qwen3.8-2.4T-A95B (BF16 e FP8) è arrivato su Hugging Face e ModelScope il 12 agosto con la licenza personalizzata Qwen3.8-Max, mentre Qwen3.8-27B è seguito il 14 agosto con Apache 2.0. Fable 5 è chiuso e disponibile solo tramite API, in modo permanente.
Nota sull'accuratezza: i dati della tabella benchmark di Alibaba restano dichiarati dal fornitore e non replicati in modo indipendente. I dati indipendenti qui riportati sono timestampati e di terze parti: l'Artificial Analysis Intelligence Index (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), il Code Arena: WebDev Elo listing e il general Arena weekly board — i punteggi Arena fluttuano con l'accumularsi dei voti, e il primo posto della build 0902 è secondo l'annuncio di Alibaba di una classifica riferita a un momento specifico. Il 95,0% SWE-bench Verified di Fable 5 è dichiarato da Anthropic; il prezzo di Qwen è la tariffa GA di Alibaba Model Studio.
Specifiche e prezzo, fianco a fianco
Ecco i dati concreti, con ogni cifra attribuita alla sua fonte.
• Produttore / stato — Qwen3.8-Max: Alibaba; GA 3 agosto 2026; aggiornamento 0902 del 2 settembre 2026. Claude Fable 5: Anthropic; ammiraglia GA
• Architettura — Qwen3.8-Max: 2,4T totali / ~95B attivi, MoE sparsa, 512 esperti (divulgato il 12 agosto); Fable 5: non divulgato
• Finestra di contesto — Qwen3.8-Max: 1M token (983.616 con ragionamento; output massimo 131.072); Fable 5: ammiraglia a contesto lungo
• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1 set): 66, in testa
• SWE-bench Verified — Qwen3.8-Max: Non riportato (Alibaba riporta invece FrontierSWE 73.5); Fable 5: 95.0% (Anthropic / buildfastwithai)
• Punti di forza indipendenti e dichiarati dal fornitore — Qwen3.8-Max: Code Arena WebDev #1 con 1.691 (0902, indipendente); tabella del fornitore: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%
• Prezzi (in / out) — Qwen3.8-Max: $2.00 / $6.00 per 1M, fisso su 1M di contesto; input in cache $0.25; Fable 5: $10 / $50 per 1M
• Pesi aperti — Qwen3.8-Max: rilasciato il 12 agosto 2026 (licenza personalizzata, non Apache); Qwen3.8-27B sotto Apache 2.0 il 14 agosto. Fable 5: no — chiuso / solo API
• Multimodalità — Qwen3.8-Max: testo, immagine, video in input → testo in output; Fable 5: modello di punta multimodale
Two things frame the whole comparison. The first changed on August 3 and still holds; the second changed again on September 2. Due cose inquadrano l'intero confronto. La prima è cambiata il 3 agosto e vale ancora; la seconda è cambiata di nuovo il 2 settembre.
Prima, la colonna dei prezzi è ora l'elemento più vistoso della pagina. A luglio, il vantaggio di costo di Qwen era un coupon di sconto: 90% di sconto sui crediti, temporaneo, senza una tariffa per token su cui pianificare. Ora è un tariffario, e il divario è strutturale, non promozionale. Con un output a 6 $ contro i 50 $ di Fable, puoi effettuare circa otto chiamate Qwen al prezzo di una chiamata Fable. Per qualsiasi carico di lavoro in cui si paga per il volume anziché per la singola risposta più difficile, quel rapporto cambia l'architettura di ciò che costruisci.
Secondo, la colonna dei benchmark ha smesso di essere a senso unico. Per la maggior parte di agosto la lettura onesta era limitata: Alibaba ha riportato FrontierSWE 73,5 e una tabella di risultati auto-calcolati, Anthropic ha riportato un 95,0% su SWE-bench Verified controllato da terze parti, e nessun valutatore indipendente aveva ancora assegnato un punteggio a Qwen. La build 0902 ha messo fine a tutto ciò. Code Arena: WebDev è un'arena di voto umano a coppie alla cieca — il progetto precedentemente noto come WebDev Arena, non gestito da alcun membro di Alibaba — e Qwen3.8-Max-0902 vi è entrato al #1 con 1.691 Elo, sopra Claude Opus 5 (1.688), Kimi K3 (1.674) e Claude Fable 5 (1.628, #8). Due avvertenze rendono onesto il quadro: è un'unica classifica, che misura lo sviluppo front-end agentico piuttosto che la capacità generale, e “debuttato al #1” è l'annuncio di Alibaba di una posizione in classifica in un dato momento. Ma l'affermazione che Qwen non ha alcun arbitro non è più vera, e questo cambia il confronto più di qualsiasi singolo numero su quella classifica.

Cosa ti dà realmente la differenza di prezzo
Gli esempi astratti sono meno utili di un esempio svolto, quindi eccone uno. Prendete un agente di revisione del codice che invia 150.000 token di contesto del repository e genera 6.000 token di revisione per chiamata.
• Qwen3.8-Max: 0,15M × $2 = $0,30, più 0,006M × $6 = $0,036. ≈ $0,34 per chiamata.
• Claude Fable 5: 0.15M × $10 = $1.50, più 0.006M × $50 = $0.30. ≈ $1.80 per chiamata.
• A 2.000 chiamate/giorno: Qwen ≈ $672 al giorno; Fable ≈ $3.600 al giorno. In un mese, ciò equivale a circa $20.000 contro $108.000.
• Con la cache di prompt su un contesto di repository stabile, l'input nella cache di Qwen a $0.25/1M riduce il lato input da $0.30 a meno di $0.04, portando la chiamata a ≈ $0.08 — circa 22 volte più economico di Fable per chiamata.
Non è un risparmio marginale; è la differenza tra far girare un revisore su ogni pull request e farlo girare solo su quelle rischiose. E il contesto a tariffa fissa di Qwen rafforza questo effetto man mano che i prompt crescono: poiché Alibaba non applica alcun sovrapprezzo per prompt lunghi, inviare un contesto da 900.000 token costa lo stesso per token di uno da 5.000 token.
Il giusto contrappeso è che il prezzo per token non è il prezzo per compito risolto. Se Fable 5 risolve un problema in un'unica passata dove un modello più economico richiede tre tentativi più correzione umana, il modello più economico potrebbe costare di più in aggregato — e sui compiti di ragionamento più difficili, il ranking #1 certificato di Fable è la migliore evidenza disponibile che risolve di più in un'unica passata. L'argomento del costo a favore di Qwen è più forte su carichi di lavoro ad alto volume e tolleranti, e più debole su quelli a basso volume e ad alta posta in gioco.
Nomenclatura 0902: le capacità sono balzate in avanti, il numero di versione no.
La cosa notevole del 2 settembre è ciò che Alibaba non ha fatto: rilasciare Qwen 3.9. Il miglioramento è stato distribuito come checkpoint datato con lo stesso nome del modello — Qwen3.8-Max-0902 — e l'API lo ha servito con lo stesso nome e allo stesso prezzo. Questa è la direzione verso cui sta andando il settore: quando un salto di capacità non garantisce più un nuovo numero di versione, "quale modello dovrei usare" diventa una questione di build e date, non solo di nomi di famiglia.
Significa anche che un punteggio benchmark associato a “Qwen3.8-Max” ha una scadenza: un punteggio misurato sulla build di luglio o agosto potrebbe non descrivere il modello che l'API restituisce oggi. Controlla l'identificativo della build sull'endpoint che chiami effettivamente: il numero 0902 è la differenza tra un modello che restava indietro rispetto a Claude Fable 5 e uno che lo supera su Code Arena: WebDev.
Prova, e perché decide ancora questo matchup
Le prove pratiche più citate per Qwen3.8-Max provengono da una recensione del periodo di anteprima (thomas-wiegold.com) che ha sottoposto il modello a quattro build reali. I risultati sono stati davvero impressionanti: Qwen ha risolto al primo colpo una simulazione di poker Go — solo il terzo modello in assoluto a superare quel prompt in un'unica passata, insieme a Fable 5 e Grok 4.5 — e su un prompt per un sito web di torrefazione ha prodotto il miglior output che il recensore avesse mai visto da quel test, aggiungendo un carrello non richiesto, una sezione all'ingrosso e l'integrazione con Instagram per pura meticolosità.
Il problema era la velocità: 30+ minuti sul sito web e 1 ora e 20 minuti sulla simulazione di poker, il che lo rendeva il modello più lento che quel recensore avesse mai usato. Questa constatazione richiede una precisazione che a luglio non era necessaria. È stata misurata su infrastruttura di anteprima, da un singolo recensore, su esecuzioni agentiche insolitamente lunghe. Il serving GA è un sistema diverso. Per quel che vale, la telemetria a 7 giorni di OrcaRouter attualmente mostra un p50 time-to-first-token di 1,64 secondi per Qwen3.8-Max — una misurazione di prima parte, anche se TTFT e throughput end-to-end su build di un'ora sono quantità diverse. La posizione onesta è che il rilievo di lentezza in anteprima andrebbe ritestato piuttosto che ripetuto come dato attuale.
Ciò che sopravvive all'aggiornamento 0902 è che le prove più forti di entrambe le parti provengono ancora da luoghi diversi. Il primo posto di Qwen3.8-Max-0902 su Code Arena: WebDev è un risultato indipendente basato su votazioni alla cieca, ma misura una sola classifica, e la tabella dei benchmark di Alibaba rimane un artefatto del fornitore: i laboratori scelgono quali benchmark riportare, e il numero più debole dichiarato da Alibaba (IFBench 82.8, istruzioni seguite) coincide ancora con la critica emersa in anteprima secondo cui il modello produce più del richiesto e ignora il perimetro. Le prove a favore di Claude Fable 5 sono più ampie e perlopiù di terze parti: 62 sull'AA Intelligence Index, primo posto nella classifica generale dell'Arena, 95.0% SWE-bench Verified — e il più recente Claude Fable 5.1 di Anthropic è in testa all'indice AA a 66 dal 1° settembre. Su “quale modello gestirà il lavoro che non posso permettermi di sbagliare”, la risposta generale rimane invariata. Su “quale modello offre il miglior front-end a un decimo del prezzo”, la risposta si è ribaltata il 2 settembre.

Apertura: l'asse che Qwen ha già vinto
Fable 5 non sarà mai auto-ospitabile. Qwen3.8-Max lo è già: il 12 agosto i pesi di Qwen3.8-2.4T-A95B — BF16 e una variante FP8 ufficiale — sono stati pubblicati su Hugging Face e ModelScope, rendendolo il primo Qwen di classe Max scaricabile da chiunque. Due avvertenze meritano uguale considerazione.
Il primo è legale. La release è distribuita sotto una licenza personalizzata “Qwen3.8-Max”, non Apache 2.0: i fornitori che gestiscono attività model-as-a-service o di assistente AI per il lavoro, con ricavi superiori a 50 milioni di dollari negli ultimi dodici mesi, devono negoziare una licenza separata con Qwen; e i prodotti commerciali che superano 100 milioni di utenti attivi mensili o 20 milioni di dollari di ricavi mensili devono mostrare il nome del modello. Per l'uso interno e per le startup, le soglie raramente sono vincolanti — ma non è un liberi tutti.
Il secondo è fisico. Un MoE da 2,4T di parametri totali occupa circa 4,9 TB in BF16 (circa la metà nel checkpoint ufficiale FP8) contro circa 141 GB di memoria per H200 — quindi ospitare da sé il modello di punta significa avere un rack di acceleratori prima ancora di servire un token. I ~95B di parametri attivi dichiarati permettono almeno di stimare cosa possa comprare quel rack. Per quasi ogni team, l'API ospitata a $2 / $6 è la strada pratica.
È per questo che Qwen3.8-27B — i cui pesi Apache-2.0 sono arrivati il 14 agosto e che, secondo quanto riportato, gira in ~17 GB di VRAM — resta la versione self-host di importanza pratica. Se il motivo per cui preferisci Qwen a Fable 5 è la residenza dei dati o il controllo on-premise piuttosto che la capacità grezza, la 27B è il modello che lo offre davvero — e da entrambi i lati il confronto sull'apertura non è più teorico.
Domande frequenti
Qwen 3.8 è migliore di Claude Fable 5?
Ora dipende dall'asse, un vero cambiamento rispetto ad agosto. Nel coding, Qwen3.8-Max-0902 è in testa: #1 su Code Arena: WebDev con 1.691 Elo contro gli 1.628 di Claude Fable 5, a $2/$6 contro i $10/$50 di Fable 5. Sulla qualità complessiva e verificata, Fable 5 è ancora in testa: 62 sull'AA Intelligence Index contro i 56 di Qwen, 95,0% su SWE-bench Verified e #1 nella classifica generale di Arena. Per i lavori in cui una risposta sbagliata è costosa, Fable 5 è la scelta meglio documentata; per il coding ad alto volume e il lavoro web agentico, la più recente Qwen è sia più economica sia più avanti in classifica Arena.
È vera l'affermazione "dietro solo a Fable 5"?
Il posizionamento di Alibaba è stato comunicato senza punteggi indipendenti, e da allora la build 0902 ha cambiato forma. Qwen3.8-Max-0902 si classifica davanti a Claude Fable 5 su Code Arena: WebDev (1.691 contro 1.628), ma dietro di esso sull'AA Intelligence Index (56 contro 62) e sulla classifica generale dell'Arena (Qwen #20 con Elo 1.479; Fable 5 #1 con 1.508). Così "secondo solo a Fable 5" è diventato "davanti a Fable 5 sulla classifica di coding a cui puntava questo aggiornamento, dietro di esso sulle ampie classifiche generaliste".
Quanto è più economico Qwen 3.8 rispetto a Fable 5?
Sostanzialmente, ed è ora una tariffa reale piuttosto che uno sconto. Qwen3.8-Max costa $2 / $6 per 1M di token contro i $10 / $50 di Fable 5 — circa 5× più economico in input e 8× in output. La tariffa di Qwen è anche piatta su tutto il contesto di 1M, e l'input in cache a $0,25/1M rende i carichi di lavoro con contesto ripetuto ancora più convenienti.
Qwen 3.8 Max è uscito dall'anteprima?
Sì. Ha raggiunto la disponibilità generale il 3 agosto 2026 con un listino prezzi pubblicato e un endpoint compatibile con OpenAI e DashScope. La campagna crediti Qoder e la presentazione dell'anteprima con sconto del 90% circolate a luglio non descrivono più come viene venduto il modello.
Qwen 3.8 è ancora il modello più lento, come dicevano le prime recensioni?
Questo risultato è emerso da un revisore su un'infrastruttura di anteprima che eseguiva build agentiche di un'ora, e dovrebbe essere ritestato contro il servizio GA piuttosto che essere trattato come un fatto attuale. La telemetria di OrcaRouter su 7 giorni mostra un p50 del tempo al primo token di 1,64 secondi, sebbene ciò misuri la latenza del primo token e non la produttività su build molto lunghe.
Posso auto-ospitare Qwen 3.8 invece di pagare per Fable 5?
Sì per Qwen, con riserve. Qwen3.8-2.4T-A95B è scaricabile dal 12 agosto con una licenza personalizzata (non Apache 2.0), e Qwen3.8-27B con Apache 2.0 dal 14 agosto. La barriera pratica è l'hardware: un MoE da 2,4T complessivi richiede circa 4,9 TB in BF16 — un rack di acceleratori — quindi la maggior parte dei team continuerà a usare l'API ospitata a $2/$6 piuttosto che servire il modello di punta. Fable 5 è chiuso definitivamente.
Quale dovrei usare oggi?
Per il lavoro generico in cui una risposta sbagliata è costosa — ragionamento complesso, percorsi di produzione ad alto rischio — Claude Fable 5 è ancora la scelta meglio documentata, e la Claude Fable 5.1 di Anthropic estende questo vantaggio. Per la programmazione ad alto volume e lo sviluppo web agentico, Qwen3.8-Max-0902 ha ora il primato nell'arena indipendente e un prezzo di output circa 8 volte inferiore: revisione di codice in blocco, generazione di front-end, analisi di documenti lunghi. Molti team dovrebbero usare entrambi e instradare in base al compito.
Il risultato finale
Qwen 3.8 vs Claude Fable 5 è un confronto diverso da quello di un mese fa, e ancora diverso da quello di una settimana fa. Qwen3.8-Max è un modello generalmente disponibile con una scheda tariffaria che sottocosta Fable 5 di 5× in input e 8× in output, piatta per un milione di token — e dal 2 settembre lo stesso nome si riferisce alla build 0902, che un'arena indipendente ora colloca al primo posto per lo sviluppo web agentico, sopra Fable 5 in quella classifica.
Ora nessuno dei due modelli possiede l’intero confronto. Claude Fable 5 — e la Claude Fable 5.1 di Anthropic, che guida l’AA Intelligence Index a 66 dal 1° settembre — mantengono il terreno generale, ampio e certificato, mentre la tabella di benchmark di Alibaba resta un artefatto del fornitore. Ma il motivo per cui questo confronto era sbilanciato a luglio — cioè che Qwen non aveva alcun arbitro indipendente — è scaduto il 2 settembre: Qwen3.8-Max-0902 è il modello numero 1 su Code Arena: WebDev. La risposta sensata è ancora quella di distinguere in base alla posta in gioco e al compito — Fable 5 per il ragionamento generale dove sbagliare costa caro, Qwen3.8-Max per la codifica ad alto volume dove il divario di prezzo e il vantaggio in arena giocano entrambi a suo favore — e di testare entrambi sui propri prompt.

Confrontati in questo articolo3
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
