Ett titelkort för artikeln 'Qwen3.8-27B Release Date' som visar en kalender där veckan den 10 augusti 2026 är markerad som det utlovade släppfönstret, med en 'status: väntande'-märkning, en undertext som noterar tillkännagivandet den 3 augusti 2026, och en grafisk bild av staplade modellager.
Guides & Insights

Qwen3.8-27B Releasedatum: Allt vi vet hittills

Författare

Jim Song

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Alibaba lovade att de öppna vikterna för Qwen3.8-27B skulle släppas under veckan den 10 augusti 2026, och det fönstret kom och gick. Nu har förseningen ett konkret mål: den officiella Qwe​n-sidan på ModelScope kör en nedräkning till midnatt den 15 augusti 2026 – 00:00 JST, enligt PC Watchs rapport den 13 augusti om teasern. Hittills har vikterna inte dykt upp på den officiella Qwe​n-organisationen på Hugging Face, men frågan om släppdatum har nu fått ett svar för första gången sedan tillkännagivandet den 3 augusti. Här är vad som är bekräftat, vad som fortfarande är overifierat och vad man ska hålla utkik efter.

Vad är bekräftat?

Alibaba tillkännagav Qwe​n3.8-generationen den 3 augusti 2026. Två saker hände den dagen: Qwen3.8-Max, flaggskeppet med 2,4 biljoner parametrar och mixture-of-experts-arkitektur, lanserades med en prissatt API, och Alibaba förband sig att öppna vikterna för både Max och den mindre Qwen3.8-27B "inom ungefär en vecka." Flera oberoende publikationer (36Kr, TrendForce, C114) rapporterade samma åtagande: Hugging Face och ModelScope, veckan den 10 augusti.

27B är den medlem av generationen som kan självhostas — Alibaba positionerade den som anpassad för arbete med en enda GPU och lokala installationer, den direkta efterträdaren till den vida använda Qwen3.6-27B. Den här härstamningen betyder något. Qwen3.6-27B blev en av de mest populära lokala kodmodellerna i sin generation, och 3.8-versionen ärver den installerade basen av frågor: vad kostar det att köra, är den bättre på agenter, när kan jag ladda ner den.

Det som är oberoende verifierbart idag är flaggskeppet, och det inkluderar nu öppna vikter. Qwen3.8-Max är live på API, och dess två repository – Qwen3.8-2.4T-A95B (full BF16) och en officiell FP8-kvantisering – lades upp på den officiella Qwen-organisationen på Hugging Face under veckan den 10 augusti, första gången Alibaba har släppt ett Max-klass-flaggskepp som öppen källkod. Det har redan betygsatts också: Artificial Analysis sätter dess Intelligence Index till 58, det närmaste ett kinesiskt labb har kommit till toppen av den tabellen, dess Coding Index till 71,8 och priset till 2,00 USD per miljon input-tokens och 6,00 USD per miljon output-tokens.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Hur en "release" faktiskt ser ut för en open-weights-modell

För en sluten modell är en datumfråga enkel — API:et slås på. För en modell med öppna vikter har "released" flera lager, och varje lager landar med dagars mellanrum:

• De råa vikterna finns som en Hugging Face- och ModelScope-repository, med ett modellkort och en LICENSE-fil.

• Inferensramverk följer efter — vLLM och SGLang förväntas lägga till stöd inom dagar, vilket är signalen att en modell är redo att serveras snarare än bara laddas ner.

• Community-kvantiseringar (GGUF, AWQ) ligger vanligtvis en till två veckor efter, vilket är när Ollama-, LM Studio- och llama.cpp-användare faktiskt kan hämta och köra den.

Så om frågan är "när kan jag ladda ner vikterna" är svaret ett repository som dyker upp på den officiella Qwen org. Om frågan är "när kan jag köra det med ett enda kommando" lägger du till en till två veckor. Löftet den 3 augusti gällde den första av dessa för veckan den 10 augusti — och det lagret har nu landat för en medlem i generationen: Qwen3.8-2.4T-A95B lades upp på Hugging Face den veckan. För 27B specifikt har det fortfarande inte landat på Hugging Face — men ModelScopes nedräkning anger nu ett mål: 15 augusti 2026 klockan 00:00 JST.

Vad är fortfarande overifierat

Allt annat om 27B är spekulativt tills repot släpps. Låt inte självsäkra nyhetsrapporter omvandla prognoser till specifikationer — inget av följande är bekräftat vid skrivande stund:

• Arkitektur — dense eller mixture-of-experts, och antalet aktiva parametrar om MoE.

• Kontextfönster, utdatabegränsningar och om det är textbaserat eller multimodalt. ModelScope-teasern, enligt PC Watch, beskriver inbyggt multimodalt och flerspråkigt stöd för bilder och video – uppgifter från leverantören på teasern, fortfarande obekräftade tills vikterna släpps.

• Licensen. Apache 2.0 är inte en säker utgångspunkt; de senaste öppna Qwe​n-utgåvorna släpptes under Tongyi Qianwen-licensen, som innehåller en klausul om 100 miljoner månatliga aktiva användare, vilket utlöser kommersiell diskussion över den tröskeln.

• Alla benchmarkresultat. Varje siffra som cirkulerar för 3.8-generationen är leverantörsrapporterad för Max; 27B har inga offentliga utvärderingar alls.

• Exakta kvantiserade storlekar. VRAM-siffrorna som cirkulerar är projektioner som förts över från Qwen3.6-27B, inte mätningar av 3.8-modellen.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Varför licensen spelar större roll än datumet

Släppdatumet avgör när du kan börja testa. Licensen avgör om du kan leverera. En Qwe​n-modell under Tongyi Qianwen-licensen är gratis att använda under 100 miljoner aktiva användare per månad — över det förväntas du diskutera kommersiella villkor. För en lokal modell som team kommer att koppla in i produkter och agenter kan den tröskeln nås snabbare än det låter. Den första filen att öppna i arkivet är LICENSE, före modellkortet och före README.

Så fångar du droppen innan blogginläggen gör det.

Den officiella Qwe​n-organisationen på Hugging Face är den grundläggande sanningen – när ett repo som heter Qwen3.8-27B dyker upp där, eller på ModelScope, har releasen skett. Mekanismen har redan bevisat sig denna vecka: Qwen3.8-2.4T-A95B och dess FP8-syskon dök upp på organisationen på exakt det sättet, så 27B-repot kommer att vara lika omisskännligt. På ModelScope finns redan en nedräkningssida för Qwen3.8-27B, som pekar mot midnatt den 15 augusti – det närmaste ett officiellt datum vi sett hittills. Tre tidigare signaler är värda att bevaka:

• En vLLM- eller SGLang-pull request som nämner Qwen3.8-27B. Framework-PR:er är ofta det första offentliga spåret av ett viktsläpp, eftersom integrationsarbetet börjar i samma ögonblick som repot är förberett.

• Qwen-teamets egna kanaler (X, WeChat, qwen.ai-bloggen), som brukar tillkännage själva lanseringen.

• Communitykvantiserare — Unsloth och andra brukar lägga upp kvantfiler och verkliga VRAM-mätningar inom dagar, vilket gör ovanstående uppskattningar till mätbara siffror.

En varning gäller hela tiden: innan den officiella organisationen publicerar, är alla "Qwen3.8-27B" du kan ladda ner antingen en platshållare eller en tredjepartsuppladdning. Namnet i sig är inte äkthet.

Vad du kan använda idag

27B är modellen att vänta på, inte det enda alternativet från denna generation. Qwen3.8-Max är live just nu — och även självhostningsbar, eftersom vikterna går att ladda ner — och på OrcaRouter faktureras den till leverantörens listpris, 2,00 USD per miljon inmatningstokens och 6,00 USD per miljon utmatningstokens, utan påslag. Priset på leverantörens egen prissida är således priset du betalar. En nyckel täcker den, och när 27B släpps och vinner förtroende på offentliga benchmarks, kommer samma nyckel att dirigera till den också. För ett team som vill bygga mot generationen idag samtidigt som man behåller möjligheten till en självhostad 27B senare, är det den minst inlåsande väg som finns.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Den raka sammanfattningen: svaret på releasedatumet är tydligare än det var för en vecka sedan. Fönstret som Alibaba gav — veckan den 10 augusti 2026 — kom och gick. Det levererade flaggskeppets vikter: Qwen3.8-2.4T-A95B och dess officiella FP8-kvantisering finns nu på Hugging Face. Det levererade inte 27B:ns — men förseningen har nu ett mål: ModelScopes nedräkning löper till midnatt den 15 augusti 2026 (00:00 JST, enligt PC Watch). Håll koll på den officiella Qwe​n-organisationen på Hugging Face och Qwe​n-sidan på ModelScope, läs LICENSE så fort 27B-repot landar, och betrakta alla specar och VRAM-siffror i omlopp som projektioner tills vikterna gör dem mätbara.

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

Kontakta oss

Gå med i vår community

DiscordEmailXGitHubYouTube