Una hero card generata intitolata 'Dots vs Qwen 3.8 Max', con sottotitolo 'La differenza sta in dove ti è consentito spostarlo'. Una linea verticale divide la card: il pannello sinistro, etichettato 'Dots', recita 'un solo posto in cui può essere eseguito'; quello destro, etichettato 'Qwen 3.8 Max', recita 'tre formati wire - cinque regioni - $2,00 / $6,00'. Il logo OrcaRouter è sovrapposto nell'angolo in basso a destra.
Guides & Insights

Dots vs Qwen 3.8 Max: La differenza sta in dove ti è permesso spostarlo

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Qwen 3.8 Max è stato pubblicato il 3 agosto 2026 ed è il livello di capacità più alto di Alibaba fino a oggi: nativamente multimodale, accetta testo, immagini e video e restituisce testo, su una finestra di contesto di 1.000.000 di token, servito tramite tre formati di protocollo — compatibile con OpenAI, compatibile con Anthropic e DashScope nativo — da Pechino, Singapore, Tokyo, Francoforte e Virginia, a 2,00 $ per milione di token di input e 6,00 $ per milione di token di output, con letture dalla cache a 0,25 $. Dots è l'agente sempre attivo dell'azienda, annunciato al DevDay il 29 settembre 2026: dispone di un proprio computer cloud e browser, raggiunge più di 4.000 app, funziona su GPT-6 Astra ed è incluso con Pro e Business Premium. Mettendoli a confronto, la domanda interessante non è quale dei due sia più capace. È in quanti luoghi a ciascuno è consentito trovarsi, e chi decide.

Non è una distinzione astratta. È quella che decide se uno strumento è disponibile nel tuo mercato, se può essere sottoposto ad audit dal tuo team di conformità e se il lavoro che costruisci su di esso sopravvive a una modifica dei termini. La capacità è la parte facile di questo confronto; la portabilità è la parte che si definisce tardi e a caro prezzo.

Tre modi per chiamare un unico modello

Un formato di trasmissione sembra un piccolo dettaglio ingegneristico finché non devi spostare un'applicazione da un fornitore all'altro. La superficie compatibile con OpenAI significa che le librerie client esistenti funzionano senza un livello di traduzione. Quella compatibile con Anthropic significa che un codebase scritto per la forma dei messaggi di un altro fornitore non deve essere riscritto. L'interfaccia nativa DashScope espone l'intero set di funzionalità, incluso il toggle thinking. Tre superfici per un solo modello significano che il costo del passaggio è un base URL e una chiave, non un refactoring.

Quello conta soprattutto quando è assente. Nulla di un dot offre un formato, un URL o una chiave, perché un dot non è qualcosa che chiami — è qualcosa con cui parli dentro l’interfaccia di qualcun altro. Spostare altrove la logica del tuo agente significa ricostruirlo, poi ricollegare i quattromila connettori da cui dipendeva, poi scoprire quali di essi si comportavano in modi che non avevi messo per iscritto.

• Cosa stai acquistando — un worker ospitato all'interno di ChatGPT, Slack e Teams (Dots) rispetto a un endpoint del modello che puoi chiamare da qualsiasi luogo (Qwen 3.8 Max)

• Interfacce — nessuna pubblicata per un punto, rispetto alle superfici compatibili con OpenAI, compatibili con Anthropic e native DashScope (Qwen 3.8 Max)

• Dove viene eseguito — il computer cloud di OpenAI con il proprio browser (Dots) contro cinque regioni servite in Asia, Europa e Nord America (Qwen 3.8 Max)

• Controllo del ragionamento — non esposto per un punto, rispetto a un enable_thinking toggle, o reasoning.effort sull'API Responses (Qwen 3.8 Max)

• Costo per unità — il primo punto è incluso con Pro o Business Premium, quota non pubblicata (Dots) contro $2,00 per milione di input e $6,00 per milione di output, letture dalla cache $0,25 (Qwen 3.8 Max)

• Prove indipendenti — demo dei fornitori e dichiarazioni di capacità, nessun benchmark, neppure un punto, a fronte di un Artificial Analysis Intelligence Index di 45,4 al quindicesimo posto su 145 modelli misurati e 92,8 su GPQA Diamond (Qwen 3.8 Max)

Dove si colloca il modello, in numeri che puoi verificare

Il profilo pubblicato di Qwen 3.8 Max è quello di un modello di fascia medio-frontier, e vale la pena leggerlo con precisione anziché in modo impressionistico. Un AA Intelligence Index di 45.4, che lo colloca al quindicesimo posto su 145 modelli misurati, lo pone nel dieci per cento migliore senza collocarlo in cima. Un AA Coding Index di 76.2, al nono posto su 138, è più forte, e 88.8 su Terminal-Bench 2.1 è un valore di esecuzione agentica davvero elevato — superiore all'88.0 di GPT-5.6 Sol sulla stessa classifica. Dove è relativamente più debole è nel recall su contesto lungo, a 80.3, che si colloca sotto l'88.7 di Kimi K3 e l'83 di MiniMax M3 nonostante una dimensione della finestra comparabile, e in SciCode a 52.1.

Il posizionamento di Alibaba stessa, nella sua guida alla migrazione, mette il modello direttamente a confronto con GPT-5.5, Claude Opus 4.7 e Gemini 3.1 Pro, e la lettura onesta dei numeri indica che questo è un modello a cui ricorrere quando un mix di forte esecuzione agentica e input multimodale conta più che essere primi nella classifica dell'intelligenza. Tutte quelle cifre sono misurazioni di terze parti accompagnate dalle loro fonti nel nostro catalogo, anziché dichiarazioni del fornitore — ed è per questo che valgono più di una presentazione di lancio.

Un numero manca e dovrebbe essere detto ad alta voce anziché essere inserito: il nostro catalogo non elenca una lunghezza massima dell'output per questo modello. È documentato un contesto da un milione di token; un tetto di output per risposta no.

A screenshot of the OrcaRouter model page for Qwen3.8 Max, showing the identifier 'qwen/qwen3.8-max' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-03, a description of it as Alibaba's newest flagship with a 1M-token context window served through OpenAI-compatible, Anthropic-compatible and native DashScope interfaces across multiple regions, a side panel reading 1M tokens of context over text, image and video input, and a price strip reading $2.00 and $6.00 with a p50 time to first token of 2.44 seconds.

Cosa Dots non ti dice, e perché è una scelta di design

OpenAI ha pubblicato una sola frase su quanto costa un punto e non contiene un numero: il primo punto è incluso con Pro e Business Premium, con limiti estesi nel primo mese e nessun consumo dei limiti di utilizzo di ChatGPT per le conversazioni con esso. Oltre a ciò, non esiste una cifra di franchigia, né un prezzo per il secondo punto, né una tariffa per capacità aggiuntiva, né un costo per attività. Il livello Pro 500 da 500 $ al mese è una quota di utilizzo più la modalità Ultrafast, piuttosto che una tariffa per punto, quindi anche il piano più costoso non si traduce in un costo per unità di lavoro dell'agente.

È allettante leggerlo come una lacuna nella documentazione. È più accurato leggerlo come la categoria: un prodotto con prezzo a postazione non può avere un prezzo unitario, perché il punto stesso di una postazione è che il costo marginale del suo utilizzo è invisibile. Questo è davvero comodo per il lavoro esplorativo e davvero scomodo per qualsiasi cosa tu debba attribuire a un progetto, a un cliente o a una voce di budget.

Nota per cosa sono ottimizzati i due prodotti. Qwen 3.8 Max è ottimizzato per essere chiamato da qualsiasi luogo, da qualsiasi cosa, in qualunque formato il chiamante già parli. Un punto è ottimizzato per essere usato in un unico posto, da un'unica interfaccia, con l'infrastruttura nascosta. Entrambi sono progetti coerenti; rispondono semplicemente a domande diverse, e uno dei due risponde «posso spostarlo più tardi» con un no.

A generated scoreboard titled 'Dots vs Qwen 3.8 Max - reach and reversibility', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; interfaces none published; regions OpenAI's cloud computer; connectors 4,000+ apps; independent benchmark none. The right column, 'Qwen 3.8 Max', lists: context 1,000,000 tokens; input text, image, video; interfaces OpenAI-compatible, Anthropic-compatible, DashScope; regions five; price $2.00 in / $6.00 out per 1M; AA Intelligence Index 45.4, 15th of 145. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Qwen 3.8 Max figures from independent listings as carried in the OrcaRouter catalogue.'

Due risposte a "e se questo fornitore cambia"

La questione della portabilità diventa concreta nel momento in cui un fornitore modifica un prezzo, depreca un identificatore o cambia ciò che include un abbonamento. Per un modello a consumo con tre formati di comunicazione, la risposta è meccanica: basta puntare il client a un URL di base diverso, oppure cambiare una stringa del modello, e l'applicazione continua a funzionare. Non c'è nient'altro da portare, perché il modello non è mai stato altro che una chiamata.

Per un dot, la risposta a un cambiamento dei termini è fermarsi. Il computer, il browser, i connettori e la quota appartengono tutti a OpenAI, e nessuno di essi può essere esportato. Non è una critica al prodotto; è l'onesta descrizione di cosa significhi affittare. Ma significa che il lavoro che costruisci interamente dentro un dot ha un percorso di migrazione che passa per una riscrittura, e questo è un fatto da mettere in conto prima di costruire qualcosa su cui intendi fare affidamento per un anno.

OrcaRouter è progettato per il primo caso. Qwen 3.8 Max viene instradato come qwen/qwen3.8-max al prezzo di listino del provider Alibaba, trasferito con ricarico dello 0%, in lo stesso catalogo di oltre 200 altri modelli dietro un'unica chiave, con failover automatico tra provider upstream e un DSL di routing per comporre diversi modelli in un'unica richiesta. È questo che rende la questione delle tre regioni risolvibile dalla tua parte anziché da quella del fornitore: lo stesso identificatore raggiunge il modello ovunque venga servito, e una variazione di tariffa da Alibaba arriva sulla tua fattura lo stesso giorno invece che al rinnovo successivo. Ciò che non raggiunge è qualunque cosa all'interno di un punto — non esiste un endpoint per un punto, né un identificatore, né un'intelligenza sostitutiva da inserire.

La domanda da porsi prima di impegnarsi

Chiedi cosa succede al tuo lavoro il giorno in cui il fornitore cambia qualcosa che non puoi controllare. Se la risposta è «cambiamo una stringa e andiamo avanti», stai comprando un modello, e quello a consumo è l'acquisto migliore. Se la risposta è «dovremmo ricostruirlo», stai comprando un prodotto, e dovresti comprarlo deliberatamente — sapendo che la comodità che stai pagando si paga in reversibilità.

Nessuna delle due risposte è sbagliata. Comprare portabilità che non userai mai è tanto uno spreco quanto comprare comodità da cui dovrai fuggire. L'errore è non sapere quale delle due hai comprato.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno