Una card del titolo per l'articolo 'Qwen3.8-27B: Data di rilascio' che mostra un calendario con la settimana del 10 agosto 2026 evidenziata come finestra di rilascio promessa, un badge 'stato: in sospeso', un sottotitolo che riporta l'annuncio del 3 agosto 2026 e una grafica a livelli di modello impilati.
Guides & Insights

Qwen3.8-27B Data di rilascio: Pesi rilasciati il 14 agosto

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Alibaba ha pubblicato i pesi aperti di Qwen3.8-27B la sera del 14 agosto 2026, caricando il repository su Hugging Face e ModelScope con licenza Apache 2.0. Ciò chiude la questione della data di rilascio che questo post seguiva sin dall'annuncio del 3 agosto, e introduce il primo dato sulla disponibilità delle API: il modello è stato messo online su un marketplace API commerciale lo stesso giorno. Qwen3.8-27B è il membro denso e auto-ospitabile della generazione Qwen3.8 — il gemello che Alibaba ha posizionato contro l'ammiraglia Qwen3.8-Max da 2,4 trilioni di parametri, e il successore del molto utilizzato Qwen3.6-27B.

Cosa ha confermato il calo del 14 agosto

La generazione Qwen3.8 è stata annunciata il 3 agosto 2026. Quel giorno, Qwen3.8-Max, l'ammiraglia a miscela di esperti, è stata resa disponibile con un'API a pagamento, e Alibaba ha promesso pesi aperti sia per la Max che per la più piccola Qwen3.8-27B "entro circa una settimana". La finestra si è allungata, per poi acquisire un obiettivo concreto quando un teaser di ModelScope ha mostrato un conto alla rovescia fino alla mezzanotte del 15 agosto (00:00 JST). Il rilascio è avvenuto secondo quel programma: sera del 14 agosto, ora di Pechino, sia su Hugging Face che su ModelScope.

Il set di specifiche confermato: {{1}}Qwen3.8-27B è un modello denso da 27 miliardi di parametri{{/1}}, nativamente multimodale (testo, immagini, video, diagrammi, documenti), con una finestra di contesto nativa di 262.000 token che si estende a 1 milione di token tramite YaRN, e una modalità reasoning_effort configurabile che regola la profondità del pensiero per risparmiare potenza di calcolo. Queste sono specifiche dichiarate dal produttore nei materiali di rilascio — {{2}}ora verificabili direttamente nei pesi pubblici{{/2}} piuttosto che prese per buone.

Nelle valutazioni interne di Alibaba, il 27B supera il suo predecessore e persino il più grande Qwen3.7-Plus: SWE-bench Pro 61.7 (contro 53.5 per Qwen3.6-27B), coding terminale agentico 73.0 (contro 63.4) e JobBench 33.4 (contro 21.8). Si tratta di numeri dichiarati dal fornitore — nessun benchmark indipendente ha ancora pubblicato un punteggio per il 27B, quindi considerateli come l'affermazione che la comunità ora proverà a riprodurre.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Quali layer di una release sono stati pubblicati

Per un modello a pesi aperti, il “rilascio” ha strati, e arrivano a giorni di distanza. I pesi grezzi sono lo strato uno — è arrivato il 14 agosto. Il supporto dei framework di inferenza è lo strato due: vLLM e SGLang in genere aggiungono il supporto entro giorni dalla pubblicazione dei pesi, e questo è il segnale che un modello è pronto per essere servito, non solo scaricato. Le quantizzazioni della community sono lo strato tre — build GGUF e AWQ, e con esse il percorso a un comando di Ollama, LM Studio e llama.cpp, di solito una o due settimane dopo.

Quindi, alla domanda “quando posso scaricare i pesi” la risposta è: ora. Alla domanda “quando posso eseguirlo con un solo comando” rispondono il framework e i layer di quantizzazione, che sono ancora in fase di rilascio.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

La questione della licenza è risolta.

{{1}}La licenza era la questione aperta che contava più della data, e il rilascio l'ha risolta.{{/1}} {{2}}Qwen3.8-27B viene distribuito con Apache 2.0 — una licenza permissiva senza tetto al numero di utenti e senza clausole che facciano scattare discussioni commerciali.{{/2}} {{3}}La preoccupazione iniziale che un rilascio open di Qwen sarebbe stato soggetto alla licenza Tongyi Qianwen, con la sua clausola sui 100 milioni di MAU, non si è concretizzata per il 27B.{{/3}} {{4}}Ciò rimuove il principale ostacolo legale all'integrazione del modello in prodotti e agenti fin dal primo giorno.{{/4}}

Il primo punto dati sulla disponibilità delle API

La release ha anche prodotto il primo dato sulla disponibilità API per il 27B: entro poche ore dal rilascio dei pesi, il modello è apparso su un marketplace API commerciale come endpoint live e operativo. La inserzione è verificabile in modo indipendente — una voce di catalogo di terze parti, non una rivendicazione del fornitore — ed è la prima prova che il modello non è solo scaricabile, ma anche distribuibile tramite API gestite.

È qui che entra in gioco OrcaRouter per il calcolo dei costi. Il membro instradabile della generazione oggi è {{1}}Qwen3.8-Max{{/1}}, servito su OrcaRouter al prezzo di listino del provider — $2.00 per milione di token in input e $6.00 per milione di token in output, senza alcun ricarico, quindi il prezzo del fornitore è il prezzo che paghi. Una sola chiave API copre questo modello e i 200+ modelli del catalogo, con failover automatico. Quando {{2}}Qwen3.8-27B{{/2}} si guadagnerà un posto sul router, la stessa chiave instraderà verso di esso; fino ad allora, i pesi Apache 2.0 sono liberi di essere self-hostati per la valutazione.

Cosa verificare dopo

Il drop risponde alla domanda sulla data, ma non ancora a quella sulla qualità. Tre cose meritano attenzione nelle prossime settimane:

• Supporto per framework di inferenza — pull request di vLLM e SGLang che menzionano Qwen3.8-27B, il segnale che il modello è pronto per essere servito su larga scala piuttosto che semplicemente eseguito dal repository.

• Quantizzazioni della community con misurazioni VRAM reali — Unsloth e altri di solito pubblicano build GGUF e memoria misurata entro pochi giorni, trasformando le proiezioni pre-rilascio in numeri su cui puoi fare affidamento per il deployment.

• Benchmark indipendenti — i punteggi di Artificial Analysis e LMArena per il 27B, quando arriveranno, sono ciò che dovrebbe guidare una decisione di produzione, non le valutazioni di Alibaba.

Cosa puoi usare oggi

Qwen3.8-27B è scaricabile ora — è questo il punto di un rilascio Apache 2.0. Per i team che vogliono sviluppare su questa generazione tramite un'API gestita oggi, Qwen3.8-Max è disponibile su OrcaRouter al prezzo di listino del fornitore ($2,00 per milione di token in input, $6,00 per milione di token in output, zero ricarico), con failover automatico e una sola chiave per l'intero catalogo. Fino a quando benchmark indipendenti non confermeranno i punteggi del fornitore, l'hosting autonomo dei pesi 27B per la valutazione è la soluzione a basso rischio.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

La questione della data di rilascio è chiusa: Qwen3.8-27B è stato pubblicato il 14 agosto 2026, con licenza Apache 2.0, con una finestra di contesto nativa di 262K e un dato di disponibilità API lo stesso giorno. Le domande che restano sono quelle misurabili: come serve, come si quantizza e se le valutazioni indipendenti riproducono i punteggi di Alibaba. Leggi la LICENZA, scarica i pesi e attendi il supporto dei framework e le build della community prima di scommetterci un percorso di produzione.