Una scheda titolo che riporta 'Qwen3.8-27B' con sottotitolo 'I pesi aperti arriveranno questa settimana', sopratitolo 'Alibaba Qwen - Cosa sappiamo finora' e una riga con la data 'Settimana del 10 agosto 2026' accanto a un'icona di scatola aperta e a un'icona di calendario.
Guides & Insights

Qwen3.8-27B Open Weights: il Max è uscito, il 27B no — Cosa sappiamo ora

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Il 13 agosto 2026, la settimana open-weights che Alibaba aveva promesso per la sua generazione Qwen3.8 si è divisa in due. I pesi dell'ammiraglia di classe Max — Qwen3.8-2.4T-A95B, un modello sparso mixture-of-experts da 2,4 trilioni di parametri e la prima release Qwen di livello Max mai resa scaricabile — sono stati effettivamente pubblicati su Hugging Face e ModelScope, con l'annuncio arrivato a tarda notte del giorno precedente tramite la community di ModelScope. Il modello più piccolo di cui tratta questa pagina, Qwen3.8-27B, invece no: promesso per la stessa settimana del 10 agosto, non ha ancora un repository ufficiale, una model card, un file di licenza o benchmark propri, e i tracker di terze parti ora descrivono il suo rilascio come ritardato, senza una nuova data. La domanda a cui questa pagina "cosa sappiamo finora" doveva rispondere — "quando uscirà davvero la 27B?" — è diventata due: perché i pesi della Max sono arrivati prima, e cosa è successo alla 27B?

Questo resta un pezzo su ciò che sappiamo finora, non una recensione. Qwen3.8-Max, il prodotto di punta dell'API, è disponibile dal 3 agosto a 2$/6$ per milione di token; la sua base open-weights sottostante, Qwen3.8-2.4T-A95B, è diventata scaricabile il 13 agosto; e i pesi Qwen3.8-27B non sono ancora stati pubblicati. Ogni affermazione di seguito è etichettata come confermata, riportata dal fornitore o stimata dalla comunità, a seconda dei casi.

Il segnale, e ciò che la settimana ha effettivamente consegnato

Il primo segnale è stato un post su X di @kimmonismus, che indicava "la prossima settimana" come quella da tenere d'occhio: "Q​wen-3.8 27b - Grok 4.6," con Astra notevolmente assente dalla lista. La metà Grok di quella settimana è stata rilasciata il 12 agosto. La metà Q​wen si è divisa in due. Ciò che il post catturava era l'umore tra le persone che seguono i rilasci dei modelli per professione — il rilascio dei pesi aperti di Qwe​n3.8 era l'evento in calendario, e la settimana è arrivata con i dettagli ancora da definire. Una settimana dopo, i dettagli si sono in parte chiariti: uno dei due rilasci di pesi aperti promessi è arrivato, e non era quello indicato nel post.

Cosa è confermato

• La famiglia è reale e ufficialmente annunciata.Alibaba ha presentato la famiglia di modelli base Qwe​n3.8 il 3 agosto 2026, dopo un'iterazione di anteprima a metà luglio.

• Qwen3.8-Max è stato lanciato lo stesso giorno.Il fiore all'occhiello dell'API — un modello mixture-of-experts da 2,4 trilioni di parametri con circa 95 miliardi di parametri attivi, una finestra di contesto di 1 milione di token e input di testo, immagini e video — è andato live sull'API Q​wen al prezzo di $2/$6 per milione di token. È inoltre disponibile tramite OrcaRouter allo stesso prezzo di listino, con un ricarico dello 0%.

• I pesi open di Max sono stati rilasciati il 13 agosto.Qwen3.8-2.4T-A95B — il modello base su cui è costruita l'API Qwen3.8-Max — è diventato scaricabile da Hugging Face e ModelScope, con una versione quantizzata FP8 al suo fianco. Questa è la prima release open-weights di livello Max di Q​wen in assoluto. Il modello scaricabile è solo testo con modalità di pensiero forzata, ha un contesto nativo di 256K token espandibile a circa 1M, ed è implementabile su SGLang, vLLM e TokenSpeed.

• Qwen3.8-27B è il modello open-weight più piccolo della famiglia — non ancora rilasciato. Alibaba lo ha posizionato come il percorso realistico per la distribuzione locale e on-premise e ha impegnato i suoi pesi su Hugging Face e ModelScope insieme a quelli del Max. Al 13 agosto non esiste ancora un repository ufficiale per Qwen3.8-27B. L'impegno era reale; la consegna non è ancora avvenuta.

• Esiste il primo punteggio indipendente per la generazione. Artificial Analysis colloca Qwen3.8-Max a un Intelligence Index di 56 a circa $1.14 per attività — davvero buono, con le riserve che qualsiasi ammiraglia appena lanciata si porta dietro.

Cosa sappiamo realmente del 27B

Il riassunto onesto è che "Qwen3.8-27B" è ancora per lo più un nome e un numero di parametri. I fatti confermati sono che si tratta di un modello con circa 27 miliardi di parametri, che è il membro open-weights della generazione Qwe​n3.8, e che è dimensionato per il lavoro su singola GPU e on-premise, piuttosto che per un cluster con centinaia di GPU. Daniel Han di Unsloth riferisce che al rilascio dovrebbe entrare in circa 17GB di VRAM — una singola scheda prosumer.

Tutto il resto non è confermato. Alibaba non ha pubblicato se il 27B è un modello denso o un mixture-of-experts, la sua finestra di contesto, quali modalità accetta, né punteggi benchmark propri. Ciò che è cambiato questa settimana è la tempistica: il Max e il 27B erano stati promessi per la stessa settimana, ma è arrivato solo il Max. I tracker di terze parti ora segnalano il 27B come ritardato senza una nuova data — una lettura della community, non una dichiarazione ufficiale di Alibaba, ed è possibile che la repository venga comunque pubblicata prima che la settimana promessa sia del tutto trascorsa. Ma al momento in cui scriviamo, l'organizzazione ufficiale Q​wen su Hugging Face non elenca alcun Qwen3.8-27B, e le poche repository "Qwen3.8-27B-FP8", "-GGUF" e "-MLX" che emergono dalla ricerca sono schede segnaposto della community con conteggi di download a una cifra, non il rilascio ufficiale.

Il punto di riferimento utile è ancora il 27B della generazione precedente: Qwen3.5-27B, un modello denso a pesi aperti con una finestra di contesto di 32K. È un limite inferiore ragionevole per ciò che il Qwen3.8-27B deve superare, e un promemoria che i modelli Q​wen di classe 27B sono stati storicamente costruiti per essere eseguiti su hardware che uno sviluppatore possiede davvero.

Il Max è il punto di riferimento per ciò che il 27B potrebbe ereditare.

A comparison scoreboard for Qwen3.8-Max and Qwen3.8-27B, contrasting the Max's 2.4T MoE total parameters, ~95B active params, 1M-token context, / pricing and AA Index 56 with the 27B's ~27B params, TBD context, TBD architecture, self-host and no independent score yet.

Il 27B non raggiungerà il tetto massimo del Max, ma i numeri del Max — ora pubblicati in una vera model card — stabiliscono le aspettative su come appaiono i miglioramenti di questa generazione. Nelle valutazioni di Alibaba sul modello a pesi aperti, Qwen3.8-2.4T-A95B ottiene 93.0 su PaperBench, 86.1 su OSworld-Verified, 91.5 su CAD parametrico, 67.7 su SWE-bench Pro e 86.6 su Terminal-Bench 2.1, con il vendor che dichiara parità con Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol e Gemini 3.1 Pro. Questi sono dati dichiarati dal vendor, pubblicati nei materiali di rilascio e non ancora riprodotti da un laboratorio indipendente. Il guadagno agentico rivendicato dal lancio dell'API — FrontierSWE che salta da 40.7 a 73.5 in una singola generazione — è presente negli stessi materiali di rilascio. Anche solo una parte di quel miglioramento, se arrivasse al 27B, ridefinirebbe il significato di "buon modello locale di coding" nella sua classe.

Una sfumatura da tenere a mente: il Max scaricabile non è identico al Max API. Qwen3.8-2.4T-A95B è solo testo con la modalità di pensiero forzata, mentre l'API Qwen3.8-Max aggiunge input visivo, una modalità senza pensiero e un contesto predefinito di 1M token. Questo divario è esattamente il tipo di cosa che un 27B è probabile che erediti — e vale la pena ricordarlo quando si leggono i titoli dei benchmark "Qwe​n3.8" senza controllare quale variante descrivono.

Il prezzo è il punto in cui Max è più difendibile: $2/$6 per milione di token su tutto il contesto di 1M di token nell'API, senza sovrapprezzo per prompt lunghi. È aggressivo per un'API di frontiera, ed è importante per il calcolo del routing — con questi numeri, la generazione 3.8 diventa un'opzione per carichi di lavoro che prima usavano modelli di punta più costosi.

Cosa può effettivamente eseguirlo

A hardware reality-check card for Qwen3.8-27B showing community-projected VRAM requirements: Q4_K_M ~16GB, Q3_K_M ~13GB, Q6_K ~21GB, FP8 ~27GB, full precision H100 80GB, with a footer noting these are community projections based on Qwen 3.6-27B quant sizes.

Per la 27B, Alibaba non ha ancora pubblicato i requisiti hardware, quindi i numeri in circolazione restano proiezioni della community basate sulla tabella quant di Q​wen 3.6-27B — stime, non specifiche. Gli intervalli di lavoro attorno a cui la maggior parte delle persone sta pianificando sono invariati:

• Q4_K_M quant, ~16GB VRAM — una RTX 4090 o equivalente, il punto ottimale a cui mirerà la maggior parte degli sviluppatori locali.

• Q3_K_M quant, ~13GB VRAM — si adatta a una scheda da 12GB come la RTX 3060 con qualità ridotta.

• Q6_K quant, ~21 GB di VRAM — quasi lossless su schede da 24 GB.

• Serving FP8, ~27GB di VRAM — una singola L40S, come da proiezione precedente, per inferenza di livello produttivo.

• Piena precisione, H100 80GB — il percorso di qualità da benchmark, e non qualcosa che la maggior parte dei team eseguirà.

La novità è che «ora puoi auto-ospitare la generazione Qwen3.8» è vero, ma non per il modello attorno a cui si stava pianificando. I pesi aperti del Max appartengono a una classe hardware completamente diversa: il modello BF16 a piena precisione pesa circa 4,9 TB, e la quantizzazione selettiva a strati da 1 bit di Unsloth lo riduce a circa 397 GB — eseguibile, ma solo con 410 GB o più di RAM e VRAM combinate. È infrastruttura seria, non una scheda prosumer. È esattamente il divario che il 27B è pensato per colmare, e la sua continua assenza è il motivo per cui il percorso locale su singola GPU per questa generazione non esiste ancora.

La questione della licenza: la Max ha appena stabilito il precedente

La questione della licenza per il 27B è ancora senza risposta, ma "come sarebbe" non è più un'ipotesi. I pesi aperti di Max sono stati rilasciati con una licenza personalizzata etichettata "qwen3.8-max" — non Apache 2.0. Come riportato nella scheda del modello, è generalmente gratuita per l'uso commerciale e l'hosting, ma attiva requisiti aggiuntivi su larga scala: i prodotti con più di 100 milioni di utenti attivi mensili o più di 20 milioni di dollari di fatturato mensile devono mostrare il nome del modello, e le aziende con più di 50 milioni di dollari di fatturato annuo che offrono servizi di modello-come-servizio o assistenti AI per il lavoro necessitano di una licenza separata. L'affermazione che circola secondo cui la licenza vieta l'uso negli Stati Uniti, nell'UE, nel Regno Unito e in Corea è falsa — la licenza non contiene restrizioni territoriali.

Per quanto riguarda specificamente il 27B, non è stata indicata alcuna licenza. Ma il Max è stato distribuito con una licenza Q​wen personalizzata anziché Apache 2.0, il che rende Apache 2.0 una supposizione poco valida anche per il modello gemello. La vecchia licenza Tongyi Qianwen — con la sua clausola sui 100 milioni di MAU — non è quella che ha ricevuto il Max; quella del Max è una nuova licenza a livelli di scala. Leggi il file LICENSE nel repository effettivo prima di fare piani basati su di essa, e aspettati che quella del 27B venga decisa solo quando il suo repository verrà pubblicato.

Tempistiche della toolchain: supporto day-one appena dimostrato

I motori di servizio si sono mossi veloci quanto previsto — per il modello pubblicato. Qwen3.8-2.4T-A95B è stato lanciato con supporto funzionante in SGLang, vLLM e TokenSpeed, che è ciò che significa "servibile via API quasi immediatamente" per un rilascio open-weights di grandi dimensioni. Per il 27B, gli stessi motori sono i primi ad arrivare con maggiore probabilità quando il suo repository apparirà, e la copertura dal primo giorno del Max rende ragionevole l'aspettativa che il 27B erediti quel supporto. Le quantizzazioni GGUF e AWQ della community solitamente restano indietro di una o due settimane, quindi l'esperienza "tira e gira" stile Ollama probabilmente non esisterà ancora il giorno del rilascio del 27B — una configurazione manuale con vLLM o llama.cpp è il probabile percorso locale iniziale.

Cosa c'è ancora di sconosciuto

Un onesto pezzo di fuga di notizie si ferma a ciò che è effettivamente pubblico, e il confine è più ampio di quanto non fosse una settimana fa in una direzione e più stretto in un'altra: le domande di Max hanno avuto risposta, quelle dei 27B no.

• La nuova data di rilascio."La settimana del 10 agosto" era l'impegno; la settimana è quasi finita e il repo non è ancora apparso. I tracker di terze parti segnalano un ritardo senza una nuova data, ma Alibaba non ha rilasciato alcuna dichiarazione ufficiale.

• Architettura. Dense o MoE per il 27B, e se MoE, il numero dei parametri attivi.

• La scheda tecnica.Finestra di contesto, modalità, limiti di output, modalità di ragionamento.

• Benchmark. Il 27B non ha punteggi ufficiali né valutazioni indipendenti.

• La licenza. Da decidere finché il repository del 27B non sarà pubblicato; la licenza personalizzata di Max è il precedente da tenere d'occhio.

• Rischio mirror. Il problema dei placeholder è ora visibile in natura — esistono card della community "Qwen3.8-27B-FP8", "-GGUF" e "-MLX" con zero file ufficiali. Finché l'organizzazione ufficiale Q​wen non pubblica il repository, scarica solo dalla pagina ufficiale dell'organizzazione.

Cosa significa per i costruttori

La suddivisione pratica per la generazione Qwe​n3.8 è ora tripla invece che doppia. Se vuoi l'API all'avanguardia oggi, Qwen3.8-Max è disponibile tramite OrcaRouter al prezzo di listino di $2/$6 del provider, trasmesso con un margine dello 0% — il prezzo che vedi è quello fissato da Alibaba. Se vuoi auto-ospitare il modello di classe Max, i pesi aperti sono scaricabili ora, ma hai bisogno dell'hardware per un modello a piena precisione di circa 4.9TB o uno quantizzato di circa 397GB. E se vuoi la distribuzione locale su singola GPU che questa generazione avrebbe dovuto offrire, stai ancora aspettando Qwen3.8-27B, che non è stato rilasciato. Una chiave compatibile con OpenAI copre il lato API oggi, e quando l'hosting del 27B si assesta, la stessa chiave può instradare le richieste verso di esso.

Screenshot of the OrcaRouter model page for Qwen3.8-Max, showing model id qwen/qwen3.8-max, .00/1M input token pricing, a 1M-token context window, and an OpenAI-compatible Python code sample.

Quell'ultima parte è il punto più generale, ed è esattamente ciò di cui un rilascio open-weight non provato e ritardato è il banco di prova. Un modello che non è ancora stato distribuito non ha precedenti, né suite di benchmark indipendenti, né cronologia di incidenti — e quando arriverà, sarà completamente nuovo. Il routing è il modo per provarlo senza scommettere su un percorso rivolto ai clienti: invia il traffico che può tollerare sorprese, esegui il failover automatico verso un modello collaudato quando si comporta male, e sposta l'intero carico di lavoro una volta che ha guadagnato la fiducia. Il layer di routing è anche ciò che rende onesti i calcoli sui prezzi — quando Alibaba taglia il prezzo di un modello che chiami tramite un endpoint, la modifica è attiva lo stesso giorno, perché il prezzo di listino passa direttamente.

Cosa guardare

• Se il repository della 27B compaia del tutto. Una pubblicazione nell'organizzazione ufficiale Qwen su Hugging Face o ModelScope è l'evento che pone fine al ritardo — e la settimana del 10 agosto si è quasi chiusa senza che ciò accadesse.

• Il file di licenza del 27B. Il Max è stato distribuito con una licenza personalizzata a livelli di scala, non Apache 2.0. Se il 27B seguirà quel precedente è la riga più decisiva del suo futuro annuncio.

• Architettura e lunghezza del contesto. Dense-vs-MoE e la finestra di contesto determinano a cosa serve il 27B.

• Il primo benchmark indipendente. Il 56 della Max sull'Artificial Analysis Intelligence Index ha alzato l'asticella; la prima valutazione esterna della 27B ti dirà quanti dei guadagni della generazione sopravvivono a livello consumer.

• Copertura della toolchain.Se il 27B eredita il supporto day-one per SGLang/vLLM/TokenSpeed della Max, e quanto rapidamente seguono le quantizzazioni della community.

Domande frequenti

È già stato rilasciato Qwen3.8-27B?

No. Alibaba lo ha annunciato il 3 agosto 2026 e ha pubblicato i pesi su Hugging Face e ModelScope per la settimana del 10 agosto, ma al 13 agosto non esiste ancora un repository ufficiale di Qwen3.8-27B, né una model card o una licenza. I pesi open della classe Max — Qwen3.8-2.4T-A95B — sono stati rilasciati il 13 agosto; il modello 27B no, e i tracker di terze parti lo segnalano come ritardato, senza una nuova data.

Di quale hardware ho bisogno per eseguire {{1}}Qwen3.8-27B{{/1}}?

Non confermato, ma le proiezioni della community basate sulla tabella dei quant di Q​wen 3.6-27B indicano una quantizzazione Q4_K_M a circa 16GB di VRAM (una RTX 4090), una Q3_K_M a circa 13GB (schede da 12GB), una Q6_K a circa 21GB (schede da 24GB) e un serving FP8 a circa 27GB (una singola L40S). Daniel Han di Unsloth riporta circa 17GB al rilascio. Trattate questi come stime finché la scheda ufficiale del modello non pubblicherà le indicazioni hardware.

Qwen3.8-27B è disponibile tramite OrcaRouter?

Non ancora. Qwen3.8-27B è un modello open-weight, self-host, e non è sulla piattaforma oggi. Il modello di punta della stessa famiglia — Qwen3.8-Max — è disponibile ora tramite OrcaRouter al prezzo di listino del provider di $2/$6 per milione di token con margine dello 0%, e quando l'hosting del 27B si stabilizza può essere aggiunto alla stessa chiave compatibile con OpenAI.

Dovrei aspettare Qwen3.8-27B o usare Qwen3.8-Max oggi?

Dipende da dove viene eseguito il carico di lavoro. Se hai bisogno di un'API all'avanguardia ora, Qwen3.8-Max è disponibile e ha un prezzo aggressivo di $2/$6 per milione di token. Se vuoi auto-ospitare la classe Max oggi, Qwen3.8-2.4T-A95B è scaricabile ora, ma richiede hardware importante — circa 4.9TB per il modello a piena precisione, o circa 397GB quantizzato, con 410GB+ di RAM e VRAM combinate. Se hai bisogno di un modello locale o on-premise su una singola scheda consumer, Qwen3.8-27B è ancora quello da aspettare — è il percorso realistico per l'auto-hosting in questa generazione, e la sua uscita è ora la domanda aperta piuttosto che una data fissa.

La settimana promessa è quasi giunta al termine, e metà di essa non è arrivata. {{1}}Qwen3.8-2.4T-A95B è scaricabile, con licenza e utilizzabile;{{/1}} {{2}}Qwen3.8-27B è confermato esistere, ancora impegnato su pesi aperti, e ancora senza repository, licenza, benchmark o nuova data.{{/2}} {{3}}Osservate se la repo del 27B arriva prima che la settimana promessa sia del tutto conclusa,{{/3}} {{4}}cosa dice il suo file di licenza accanto a quello del Max,{{/4}} {{5}}e come lo valutano le prime valutazioni indipendenti.{{/5}} {{6}}Questi tre segnali vi diranno se si tratta di un rilascio di pesi aperti in due fasi di routine con il modello più piccolo ancora in arrivo, o di un ritardo attorno a cui pianificare.{{/6}}

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno