
Qwen3.8-27B Data di rilascio: Pesi rilasciati il 14 agosto
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 383 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 209 tok/s
- OrcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Alibaba ha pubblicato i pesi aperti di Qwen3.8-27B la sera del 14 agosto 2026, caricando il repository su Hugging Face e ModelScope con licenza Apache 2.0. Ciò chiude la questione della data di rilascio che questo post seguiva sin dall'annuncio del 3 agosto, e introduce il primo dato sulla disponibilità delle API: il modello è stato messo online su un marketplace API commerciale lo stesso giorno. Qwen3.8-27B è il membro denso e auto-ospitabile della generazione Qwen3.8 — il gemello che Alibaba ha posizionato contro l'ammiraglia Qwen3.8-Max da 2,4 trilioni di parametri, e il successore del molto utilizzato Qwen3.6-27B.
Cosa ha confermato il calo del 14 agosto
La generazione Qwen3.8 è stata annunciata il 3 agosto 2026. Quel giorno, Qwen3.8-Max, l'ammiraglia a miscela di esperti, è stata resa disponibile con un'API a pagamento, e Alibaba ha promesso pesi aperti sia per la Max che per la più piccola Qwen3.8-27B "entro circa una settimana". La finestra si è allungata, per poi acquisire un obiettivo concreto quando un teaser di ModelScope ha mostrato un conto alla rovescia fino alla mezzanotte del 15 agosto (00:00 JST). Il rilascio è avvenuto secondo quel programma: sera del 14 agosto, ora di Pechino, sia su Hugging Face che su ModelScope.
Il set di specifiche confermato: {{1}}Qwen3.8-27B è un modello denso da 27 miliardi di parametri{{/1}}, nativamente multimodale (testo, immagini, video, diagrammi, documenti), con una finestra di contesto nativa di 262.000 token che si estende a 1 milione di token tramite YaRN, e una modalità reasoning_effort configurabile che regola la profondità del pensiero per risparmiare potenza di calcolo. Queste sono specifiche dichiarate dal produttore nei materiali di rilascio — {{2}}ora verificabili direttamente nei pesi pubblici{{/2}} piuttosto che prese per buone.
Nelle valutazioni interne di Alibaba, il 27B supera il suo predecessore e persino il più grande Qwen3.7-Plus: SWE-bench Pro 61.7 (contro 53.5 per Qwen3.6-27B), coding terminale agentico 73.0 (contro 63.4) e JobBench 33.4 (contro 21.8). Si tratta di numeri dichiarati dal fornitore — nessun benchmark indipendente ha ancora pubblicato un punteggio per il 27B, quindi considerateli come l'affermazione che la comunità ora proverà a riprodurre.

Quali layer di una release sono stati pubblicati
Per un modello a pesi aperti, il “rilascio” ha strati, e arrivano a giorni di distanza. I pesi grezzi sono lo strato uno — è arrivato il 14 agosto. Il supporto dei framework di inferenza è lo strato due: vLLM e SGLang in genere aggiungono il supporto entro giorni dalla pubblicazione dei pesi, e questo è il segnale che un modello è pronto per essere servito, non solo scaricato. Le quantizzazioni della community sono lo strato tre — build GGUF e AWQ, e con esse il percorso a un comando di Ollama, LM Studio e llama.cpp, di solito una o due settimane dopo.
Quindi, alla domanda “quando posso scaricare i pesi” la risposta è: ora. Alla domanda “quando posso eseguirlo con un solo comando” rispondono il framework e i layer di quantizzazione, che sono ancora in fase di rilascio.

La questione della licenza è risolta.
{{1}}La licenza era la questione aperta che contava più della data, e il rilascio l'ha risolta.{{/1}} {{2}}Qwen3.8-27B viene distribuito con Apache 2.0 — una licenza permissiva senza tetto al numero di utenti e senza clausole che facciano scattare discussioni commerciali.{{/2}} {{3}}La preoccupazione iniziale che un rilascio open di Qwen sarebbe stato soggetto alla licenza Tongyi Qianwen, con la sua clausola sui 100 milioni di MAU, non si è concretizzata per il 27B.{{/3}} {{4}}Ciò rimuove il principale ostacolo legale all'integrazione del modello in prodotti e agenti fin dal primo giorno.{{/4}}
Il primo punto dati sulla disponibilità delle API
La release ha anche prodotto il primo dato sulla disponibilità API per il 27B: entro poche ore dal rilascio dei pesi, il modello è apparso su un marketplace API commerciale come endpoint live e operativo. La inserzione è verificabile in modo indipendente — una voce di catalogo di terze parti, non una rivendicazione del fornitore — ed è la prima prova che il modello non è solo scaricabile, ma anche distribuibile tramite API gestite.
È qui che entra in gioco OrcaRouter per il calcolo dei costi. Il membro instradabile della generazione oggi è {{1}}Qwen3.8-Max{{/1}}, servito su OrcaRouter al prezzo di listino del provider — $2.00 per milione di token in input e $6.00 per milione di token in output, senza alcun ricarico, quindi il prezzo del fornitore è il prezzo che paghi. Una sola chiave API copre questo modello e i 200+ modelli del catalogo, con failover automatico. Quando {{2}}Qwen3.8-27B{{/2}} si guadagnerà un posto sul router, la stessa chiave instraderà verso di esso; fino ad allora, i pesi Apache 2.0 sono liberi di essere self-hostati per la valutazione.
Cosa verificare dopo
Il drop risponde alla domanda sulla data, ma non ancora a quella sulla qualità. Tre cose meritano attenzione nelle prossime settimane:
• Supporto per framework di inferenza — pull request di vLLM e SGLang che menzionano Qwen3.8-27B, il segnale che il modello è pronto per essere servito su larga scala piuttosto che semplicemente eseguito dal repository.
• Quantizzazioni della community con misurazioni VRAM reali — Unsloth e altri di solito pubblicano build GGUF e memoria misurata entro pochi giorni, trasformando le proiezioni pre-rilascio in numeri su cui puoi fare affidamento per il deployment.
• Benchmark indipendenti — i punteggi di Artificial Analysis e LMArena per il 27B, quando arriveranno, sono ciò che dovrebbe guidare una decisione di produzione, non le valutazioni di Alibaba.
Cosa puoi usare oggi
Qwen3.8-27B è scaricabile ora — è questo il punto di un rilascio Apache 2.0. Per i team che vogliono sviluppare su questa generazione tramite un'API gestita oggi, Qwen3.8-Max è disponibile su OrcaRouter al prezzo di listino del fornitore ($2,00 per milione di token in input, $6,00 per milione di token in output, zero ricarico), con failover automatico e una sola chiave per l'intero catalogo. Fino a quando benchmark indipendenti non confermeranno i punteggi del fornitore, l'hosting autonomo dei pesi 27B per la valutazione è la soluzione a basso rischio.

La questione della data di rilascio è chiusa: Qwen3.8-27B è stato pubblicato il 14 agosto 2026, con licenza Apache 2.0, con una finestra di contesto nativa di 262K e un dato di disponibilità API lo stesso giorno. Le domande che restano sono quelle misurabili: come serve, come si quantizza e se le valutazioni indipendenti riproducono i punteggi di Alibaba. Leggi la LICENZA, scarica i pesi e attendi il supporto dei framework e le build della community prima di scommetterci un percorso di produzione.
