
Data di rilascio di Qwen3.8-27B: tutto ciò che sappiamo finora
- deepseekNUOVODeepSeek: DeepSeek V4 Pro 08132026-08-12$0.44 / $0.88 per 1M di token · 72 tok/s
- grokNUOVOSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaNUOVOMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenNUOVOQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token · 2304 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenza77Codice
- grokxAI: Grok 4.52026-07-0856Intelligenza72Codice
- tencentTencent: Hy32026-07-0642Intelligenza59Codice
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligenza42Codice
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligenza39Codice
Alibaba ha promesso i pesi aperti di Qwen3.8-27B per la settimana del 10 agosto 2026, e quella finestra è arrivata e passata. Ora il ritardo ha un obiettivo concreto: la pagina ufficiale di Qwen su ModelScope mostra un conto alla rovescia fino alla mezzanotte del 15 agosto 2026 — 00:00 JST, come riportato da PC Watch il 13 agosto a proposito del teaser. I pesi non sono ancora apparsi sull'organizzazione ufficiale di Qwen su Hugging Face ad oggi, ma la questione della data di rilascio ora ha una risposta per la prima volta dall'annuncio del 3 agosto. Ecco cosa è confermato, cosa non è ancora verificato e cosa tenere d'occhio.
Cosa è confermato
Alibaba ha annunciato la generazione Qwen3.8 il 3 agosto 2026. Quel giorno sono successe due cose: Qwen3.8-Max, il modello di punta mixture-of-experts da 2,4 trilioni di parametri, è stato lanciato con un'API a pagamento, e Alibaba si è impegnata a rendere disponibili i pesi aperti sia per Max che per il più piccolo Qwen3.8-27B "entro circa una settimana". Molte testate indipendenti (36Kr, TrendForce, C114) hanno riportato lo stesso impegno: Hugging Face e ModelScope, la settimana del 10 agosto.
Il 27B è il membro auto-ospitabile della generazione — Alibaba lo ha posizionato come dimensionato per il lavoro su singola GPU e on-premise, il successore diretto del molto utilizzato Qwen3.6-27B. Questa discendenza è importante. Qwen3.6-27B è diventato uno dei modelli di codifica locale più popolari della sua generazione, e la versione 3.8 eredita quella base consolidata di domande: quanto costa eseguirlo, è migliore con gli agenti, quando posso scaricarlo.
Ciò che oggi è indipendentemente verificabile è l'ammiraglia, e questo ora include anche i pesi aperti. Qwen3.8-Max è disponibile su API, e i suoi repository — Qwen3.8-2.4T-A95B (BF16 completo) e una quantizzazione FP8 ufficiale — sono stati pubblicati sull'organizzazione ufficiale Qwen su Hugging Face nella settimana del 10 agosto, la prima volta che Alibaba ha reso open-source un'ammiraglia di classe Max. È già stata anche valutata: Artificial Analysis colloca il suo Intelligence Index a 58, il risultato più vicino mai ottenuto da un laboratorio cinese alla vetta di quella classifica, il suo Coding Index a 71.8, e il suo prezzo a $2.00 per milione di token di input e $6.00 per milione di token di output.

Che aspetto ha realmente un "rilascio" per un modello a pesi aperti
Una domanda sulla data su un modello chiuso è semplice — l'API si attiva da sola. Per un modello open-weights, "rilasciato" ha più livelli, e ogni livello arriva a distanza di giorni:
I pesi grezzi appaiono come un repository Hugging Face e ModelScope, con una scheda del modello e un file LICENSE.
• I framework di inferenza seguono — vLLM e SGLang dovrebbero aggiungere il supporto entro pochi giorni, il che è il segnale che un modello è pronto per essere servito piuttosto che solo scaricato.
• Le quantizzazioni della community (GGUF, AWQ) in genere sono in ritardo di una o due settimane, ovvero quando gli utenti di Ollama, LM Studio e llama.cpp possono effettivamente scaricarlo ed eseguirlo.
Quindi, se la domanda è "quando posso scaricare i pesi," la risposta è un repository che appare nell'organizzazione ufficiale di Qwen. Se la domanda è "quando posso eseguirlo con un comando," aggiungi da una a due settimane. La promessa del 3 agosto mirava al primo di questi per la settimana del 10 agosto — e quel livello è ora arrivato per un membro della generazione: Qwen3.8-2.4T-A95B è stato caricato su Hugging Face quella settimana. Per quanto riguarda specificamente il 27B, non è ancora arrivato su Hugging Face — ma il conto alla rovescia di ModelScope ora indica un obiettivo: 15 agosto 2026 alle 00:00 JST.
Cosa è ancora non verificato
Tutto il resto sulla 27B è speculativo finché il repository non viene pubblicato. Non lasciare che una copertura sicura trasformi le proiezioni in specifiche — nessuna delle seguenti è confermata al momento della stesura:
• Architettura — densa o miscela di esperti, e il conteggio dei parametri attivi se MoE.
• Finestra di contesto, limiti di output e se sia solo testo o multimodale. Il teaser di ModelScope, secondo PC Watch, descrive un supporto nativo multimodale e multilingue per immagini e video — dichiarato dal fornitore nel teaser, ancora non verificato finché non verranno rilasciati i pesi.
• La licenza. Apache 2.0 non è un'ipotesi sicura; le recenti versioni open di Qwen sono state distribuite sotto la licenza Tongyi Qianwen, che contiene una clausola sui 100 milioni di utenti attivi mensili che innesca una discussione commerciale oltre tale soglia.
• Qualsiasi punteggio benchmark. Ogni dato in circolazione per la generazione 3.8 è dichiarato dal fornitore per il Max; la 27B non ha alcuna valutazione pubblica.
• Dimensioni quantizzate esatte. Le cifre VRAM in circolazione sono proiezioni riprese da Qwen3.6-27B, non misurazioni del modello 3.8.

Perché la licenza conta più della data
La data di rilascio determina quando puoi iniziare i test. La licenza determina se puoi distribuire il prodotto. Un modello Qwen con licenza Tongyi Qianwen è gratuito da usare al di sotto di 100 milioni di utenti attivi mensili — oltre quella soglia, devi discutere i termini commerciali. Per un modello locale che i team integreranno in prodotti e agenti, quella soglia può essere raggiunta più velocemente di quanto sembri. Il primo file da aprire nel repository è la LICENZA, prima della scheda del modello e prima del README.
Come intercettare il calo prima che lo facciano i post del blog.
L'organizzazione ufficiale Qwen su Hugging Face è la verità di riferimento — quando un repository chiamato Qwen3.8-27B compare lì, o su ModelScope, il rilascio è avvenuto. Il meccanismo ha già dimostrato la sua validità questa settimana: Qwen3.8-2.4T-A95B e la sua variante FP8 sono comparsi sull'organizzazione esattamente in quel modo, quindi il repository 27B sarà altrettanto inconfondibile. Su ModelScope, una pagina di countdown per Qwen3.8-27B è già online, che punta alla mezzanotte del 15 agosto — la cosa più vicina a una data ufficiale finora. Tre segnali precedenti sono da tenere d'occhio:
• Una pull request su vLLM o SGLang che menziona Qwen3.8-27B. Le PR dei framework sono spesso la prima traccia pubblica del rilascio dei pesi, perché il lavoro di integrazione inizia nel momento in cui il repository viene preparato.
• I canali del team Qwen (X, WeChat, il blog qwen.ai), che tendono ad annunciare il rilascio stesso.
• Quantizzatori della community — Unsloth e altri di solito pubblicano file quantizzati e misurazioni reali della VRAM entro pochi giorni, il che converte le proiezioni sopra in numeri misurabili.
Un avvertimento vale in ogni momento: prima che l'organizzazione ufficiale pubblichi, qualsiasi "Qwen3.8-27B" che puoi scaricare è o un segnaposto o un caricamento di terze parti. Il nome da solo non significa autenticità.
Cosa puoi usare oggi
Il 27B è il modello da aspettare, non l'unica opzione di questa generazione. Qwen3.8-Max è disponibile proprio ora — e anche auto-ospitabile, dato che i suoi pesi sono scaricabili — e su OrcaRouter viene fatturato al prezzo di listino del fornitore, $2.00 per milione di token in input e $6.00 per milione di token in output, con margine zero, quindi il prezzo che vedi sulla pagina prezzi del fornitore è quello che paghi. Una sola chiave lo copre, e quando il 27B uscirà e si guadagnerà la fiducia nei benchmark pubblici, la stessa chiave instraderà anche verso di esso. Per un team che vuole sviluppare su questa generazione oggi mantenendo l'opzione di un 27B auto-ospitato in futuro, questo è il percorso meno vincolante in assoluto.

Il riepilogo diretto: la risposta sulla data di rilascio è più chiara di una settimana fa. La finestra che Alibaba aveva indicato — la settimana del 10 agosto 2026 — è arrivata e passata. Ha consegnato i pesi del modello di punta: Qwen3.8-2.4T-A95B e la sua quantizzazione FP8 ufficiale sono ora su Hugging Face. Non ha consegnato quelli del 27B — ma ora il ritardo ha un obiettivo: il conto alla rovescia di ModelScope arriva alla mezzanotte del 15 agosto 2026 (00:00 JST, secondo PC Watch). Segui l'organizzazione ufficiale Qwen su Hugging Face e la pagina Qwen su ModelScope, leggi la LICENZA nel momento in cui il repository del 27B viene pubblicato, e tratta ogni specifica e numero di VRAM in circolazione come una proiezione finché i pesi non li renderanno misurabili.
