
Qwen3.8-27B öppna vikter: Max släpptes, 27B gjorde det inte — Vad vi vet nu
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 36 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 181 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
Den 13 augusti 2026 delades den öppna viktveckan som Alibaba utlovat för sin Qwen3.8-generation i två. Max-klassens flaggskeppsvikter — Qwen3.8-2.4T-A95B, en gles mixture-of-experts-modell med 2,4 biljoner parametrar och den första Max-nivå Qwen-utgåvan som någonsin gjorts nedladdningsbar — släpptes faktiskt, på Hugging Face och ModelScope, och tillkännagavs sent föregående natt genom ModelScope-communityt. Den mindre modellen som den här sidan handlar om, Qwen3.8-27B, släpptes inte: den var utlovad till samma vecka som 10 augusti, men har fortfarande inget officiellt repository, modellkort, licensfil eller något eget benchmark, och tredjepartsspårare beskriver nu releasen som försenad utan att något nytt datum getts. Frågan som den här "vad vi vet hittills"-sidan byggdes för att besvara — "när släpps 27B egentligen?" — har blivit två: varför släpptes Max-vikterna först, och vad hände med 27B?
Detta förblir en genomgång av vad vi vet hittills, inte en recension. Qwen3.8-Max, API-flaggsskeppet, har varit live sedan den 3 augusti till $2/$6 per miljon tokens; dess underliggande basmodell med öppna vikter, Qwen3.8-2.4T-A95B, blev nedladdningsbar den 13 augusti; och vikterna för Qwen3.8-27B är fortfarande opublicerade. Varje påstående nedan är märkt som bekräftat, leverantörsrapporterat eller community-uppskattat.
Signalen, och vad veckan faktiskt levererade
Den tidiga signalen var ett inlägg på X av @kimmonismus, som pekade ut "nästa vecka" som den att hålla ögonen på: "Qwen-3.8 27b - Grok 4.6," med Astra påfallande frånvarande från listan. Grok-delen av den veckan släpptes den 12 augusti. Qwen-delen delades i två. Det inlägget fångade stämningen bland dem som bevakar modellsläpp på heltid — Qwen3.8-släppet med öppna vikter var kalenderhändelsen, och när veckan kom var detaljerna fortfarande inte spikade. En vecka senare har detaljerna delvis klarnat: ett av de två utlovade släppen med öppna vikter har landat, och det var inte det som inlägget nämnde.
Vad är bekräftat?
• Familjen är verklig och officiellt tillkännagiven. Alibaba presenterade Qwen3.8-basmodellfamiljen den 3 augusti 2026, efter en förhandsversion i mitten av juli.
• Qwen3.8-Max släpptes samma dag. API-flagskeppet — en mixture-of-experts-modell med 2,4 biljoner parametrar, cirka 95 miljarder aktiva parametrar, ett kontextfönster på 1 miljon tokens samt stöd för text-, bild- och videoinmatning — gick live på Qwen API för 2/6 dollar per miljon tokens. Den är också tillgänglig via OrcaRouter till samma listpris, med 0 % påslag.
• Max' öppna vikter släpptes den 13 augusti. Qwen3.8-2.4T-A95B — basmodellen som Qwen3.8-Max API:t bygger på — blev nedladdningsbar från Hugging Face och ModelScope, tillsammans med en FP8-kvantiserad version. Detta är den allra första Max-nivå-utgåvan av Qwen med öppna vikter. Den nedladdningsbara modellen är textbaserad, har tankeläget alltid aktiverat samt ett nativt kontextfönster på 256K tokens som kan utökas till cirka 1M, och kan köras med SGLang, vLLM och TokenSpeed.
• Qwen3.8-27B är familjens mindre open-weight-modell — ännu inte släppt. Alibaba positionerade den som den realistiska vägen för lokal och on-premise-drift och publicerade sina vikter på Hugging Face och ModelScope tillsammans med Max-modellens. Per den 13 augusti finns det fortfarande inget officiellt Qwen3.8-27B-repository. Åtagandet var verkligt; leveransen har ännu inte skett.
• Den första oberoende poängen för generationen finns. Artificial Analysis ger Qwen3.8-Max ett Intelligence Index på 56 till cirka 1,14 USD per uppgift — genuint bra, med de förbehåll som ett dagar gammalt flaggskepp för med sig.
Vad vi faktiskt vet om 27B
Den ärliga sammanfattningen är att "Qwen3.8-27B" fortfarande mest är ett namn och ett parameterantal. De bekräftade fakta är att det är en modell med cirka 27 miljarder parametrar, att den är den med öppna vikter i Qwen3.8-generationen, och att den är dimensionerad för arbete på en enda GPU och lokalt (on-premise) snarare än för ett kluster med flera hundra GPU:er. Unsloths Daniel Han rapporterar att den bör rymmas i cirka 17 GB VRAM vid lanseringen — ett enda prosumer-kort.
Allt annat är obekräftat. Alibaba har inte offentliggjort huruvida 27B är en tät modell eller en blandning av experter, dess kontextfönster, vilka modaliteter den tar emot, eller några egna benchmarkresultat. Det som ändrades den här veckan är tajmingen: Max och 27B utlovades till samma vecka, och bara Max kom. Tredjepartsspårare rapporterar nu att 27B är försenad utan nytt datum – en communitytolkning, inte ett officiellt uttalande från Alibaba, och det är möjligt att repot fortfarande landar innan den utlovade veckan är helt slut. Men när detta skrivs listar den officiella Qwen-organisationen på Hugging Face ingen Qwen3.8-27B, och de få "Qwen3.8-27B-FP8", "-GGUF" och "-MLX"-arkiv som dyker upp i sökningen är community-platshållarkort med ensiffriga nedladdningsantal, inte den officiella releasen.
Den användbara referenspunkten är fortfarande föregående generations 27B: Qwen3.5-27B, en tät modell med öppna vikter och ett 32K-kontextfönster. Det är en rimlig nedre gräns för vad Qwen3.8-27B måste överträffa, och en påminnelse om att Qwen 27B-klassmodeller historiskt har byggts för att köras på hårdvara som en utvecklare faktiskt äger.
Max är referenspunkten för vad 27B kan komma att ärva.

27B-modellen kommer inte att nå Max-modellens råa tak, men Max-siffrorna – nu publicerade i ett riktigt modellkort – sätter förväntningarna för hur generationens förbättringar ser ut. I Alibabas egna utvärderingar av den öppna viktmodellen får Qwen3.8-2.4T-A95B 93,0 på PaperBench, 86,1 på OSworld-Verified, 91,5 på parametrisk CAD, 67,7 på SWE-bench Pro och 86,6 på Terminal-Bench 2.1, där leverantören gör anspråk på paritet med Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol och Gemini 3.1 Pro. Dessa är leverantörsrapporterade siffror, publicerade i lanseringsmaterialet och ännu inte reproducerade av ett oberoende labb. Den agentiska vinst som API-lanseringen gjorde anspråk på – FrontierSWE som hoppar från 40,7 till 73,5 i en enda generation – återfinns i samma lanseringsmaterial. Om ens en del av den förbättringen sipprar ner till en 27B-modell skulle det återdefiniera vad "bra lokal kodningsmodell" betyder i dess klass.
En nyans att hålla fast vid: den nedladdningsbara Max är inte identisk med API Max. Qwen3.8-2.4T-A95B är textbaserad med tankeläge forcerat på, medan Qwen3.8-Max API lägger till visuell input, ett icke-tänkande läge och en standardkontext på 1M-token. Den luckan är precis den typ av sak som en 27B sannolikt kommer att ärva – och värd att komma ihåg när du läser rubriker om ”Qwen3.8” benchmarkresultat utan att kontrollera vilken variant de beskriver.
Priset är där Max är mest försvarbart: $2/$6 per miljon tokens över hela 1M-token-kontexten på API:et, utan extra avgift för långa prompter. Det är aggressivt för ett frontier-API, och det spelar roll för routing-matematiken – vid de siffrorna blir 3.8-generationen ett alternativ för arbetsbelastningar som tidigare brukade hamna hos dyrare flaggskeppsmodeller.
Vad kan faktiskt köra det?

För 27B har Alibaba fortfarande inte publicerat hårdvarukrav, så siffrorna i omlopp är fortfarande community-uppskattningar baserade på Qwen 3.6-27B-kvantiseringstabellen — uppskattningar, inte specifikationer. De arbetsintervall som de flesta planerar utifrån är oförändrade:
• Q4_K_M-kvantisering, ~16 GB VRAM — en RTX 4090 eller motsvarande, den optimala punkten som de flesta lokala utvecklare kommer att sikta på.
• Q3_K_M quant, ~13GB VRAM — passar ett 12GB-kort som RTX 3060 med reducerad kvalitet.
• Q6_K kvantisering, ~21GB VRAM — nästan förlustfri på 24GB-kort.
• FP8 serving, ~27 GB VRAM — en enda L40S, enligt den tidigare prognosen, för inferens i produktionsklass.
• Full precision, H100 80GB — benchmarkkvalitetsvägen, och inget de flesta team kommer att köra.
Det nya kruxet är att {{1}}"du kan självhosta Qwen3.8-generationen nu"{{/1}} stämmer, men inte för den modell som folk planerade kring. Max öppna vikter är en helt annan hårdvaruklass: fullprecisions-BF16-modellen är ungefär 4,9 TB, och Unsloths 1-bitars skiktade selektiva kvantisering får ner den till cirka {{2}}397 GB{{/2}} — körbar, men bara med {{3}}410 GB eller mer{{/3}} av kombinerat RAM och VRAM. Det är seriös infrastruktur, inte ett prosumerkort. Det är exakt den lucka som {{4}}27B{{/4}} är tänkt att fylla, vilket gör att den fortsatta frånvaron av {{4}}27B{{/4}} är anledningen till att den lokala en-GPU-vägen för den här generationen ännu inte existerar.
Licensfrågan: Max har just satt prejudikatet.
Licensfrågan för 27B är fortfarande obesvarad, men "hur skulle det se ut" är inte längre en gissning. Max:s öppna vikter släpptes under en anpassad licens märkt "qwen3.8-max" — inte Apache 2.0. Enligt modellkortet är den i allmänhet gratis för kommersiell användning och hosting, men den utlöser ytterligare krav i stor skala: produkter med fler än 100 miljoner månatliga aktiva användare eller mer än 20 miljoner dollar i månatlig intäkt måste visa modellnamnet, och företag med mer än 50 miljoner dollar i årlig intäkt som erbjuder model-as-a-service eller AI-arbetsassistenttjänster behöver separat licensiering. Ett påstående som cirkulerar att licensen förbjuder användning i USA, EU, Storbritannien och Korea är falskt — licensen innehåller inga territoriella begränsningar.
För 27B specifikt har ingen licens namngetts. Men Max släpptes under en anpassad Qwen-licens snarare än Apache 2.0, vilket gör Apache 2.0 till ett dåligt antagande även för syskonmodellen. Den gamla Tongyi Qianwen-licensen – med sin klausul om 100 miljoner MAU – är inte vad Max fick; Max har en ny, skalnivåbaserad licens. Läs LICENSE-filen i det faktiska repot innan du planerar utifrån den, och förvänta dig att 27B:s licens endast beslutas när dess repo släpps.
Verktygskedjans tajming: stöd från dag ett har precis bevisats.
Serveringsmotorerna rörde sig lika snabbt som väntat — för den modell som släpptes. Qwen3.8-2.4T-A95B lanserades med fungerande stöd i SGLang, vLLM och TokenSpeed, vilket är vad "API-serverbar nästan omedelbart" innebär för en stor release med öppna vikter. För 27B-modellen är samma motorer de mest sannolika först ut när dess repo dyker upp, och tack vare Max-modellens dag-ett-täckning är det en rimlig förväntan att 27B-modellen ärver det stödet. Communityns GGUF- och AWQ-kvantiseringar brukar fortfarande ligga en till två veckor efter, så Ollama-liknande "pull and run"-upplevelse kommer troligen fortfarande inte att finnas på 27B-modellens releasedag — en manuell vLLM- eller llama.cpp-installation är troligen den lokala vägen till en början.
Vad är fortfarande okänt?
En ärlig läcka stannar vid det som faktiskt är offentligt, och gränsen är bredare än den var för en vecka sedan i en riktning och smalare i en annan: Max frågor fick svar, 27B:s fick inte det.
• Det nya släppdatumet."Veckan som börjar den 10 augusti" var löftet; veckan är nästan slut och repot har inte dykt upp. Tredjepartsspårare rapporterar en försening utan nytt datum, men Alibaba har inte gjort något officiellt uttalande.
• Arkitektur. Dense eller MoE för 27B, och om MoE, antalet aktiva parametrar.
• Specifikationsbladet. Kontextfönster, modaliteter, utdatagränser, resonemangsläge.
• Prestandatester. 27B har inga officiella resultat och ingen oberoende utvärdering.
• Licensen. Inte avgjord förrän 27B:s repository levereras; Max:s anpassade licens är prejudikatet att hålla utkik efter.
• Spegelrisk. Platshållarproblemet är nu synligt i det vilda — communityns "Qwen3.8-27B-FP8", "-GGUF" och "-MLX"-kort finns med noll officiella filer. Tills den officiella Qwen-organisationen publicerar repot, ladda bara ner från den officiella organisationssidan.
Vad det innebär för byggare
Den praktiska uppdelningen för Qwen3.8-generationen är nu tredelad istället för tvådelad. Om du vill ha frontier-API:t idag, är Qwen3.8-Max live via OrcaRouter till leverantörens listpris på $2/$6, vidarebefordrat med 0% påslag — priset du ser är det pris Alibaba har satt. Om du vill self-hosta Max-modellen är de öppna vikterna nedladdningsbara nu, men du behöver hårdvara för en ungefär 4,9 TB-modell med full precision eller en ungefär 397 GB-kvantiserad sådan. Och om du vill ha den lokala distributionen på en enda GPU som den här generationen förväntades leverera, väntar du fortfarande på Qwen3.8-27B, som inte har släppts. En OpenAI-kompatibel nyckel täcker API-sidan idag, och när värdtjänsten för 27B har satt sig, kan samma nyckel dirigera till den.

Den sista delen är den mer allmänna poängen, och det är precis vad en obevisad, försenad open-weight-utgåva är ett testfall för. En modell som inte ens har släppts ännu har ingen meritlista, ingen oberoende benchmarksvit och ingen incidenthistorik — och när den väl kommer kommer den att vara helt ny. Routing är hur du provar den utan att satsa en kundvänd väg på den: skicka den trafik som tål överraskningar, växla över automatiskt till en beprövad modell när den beter sig illa, och byt hela arbetsbelastningen när den har förtjänat förtroende. Routinglagret är också det som gör prismatematiken ärlig — när Alibaba sänker priset på en modell du anropar via en endpoint, är ändringen live samma dag, eftersom listpriset går rakt igenom.
Vad du ska titta på
• Huruvida 27B:s repo överhuvudtaget dyker upp. En notering under den officiella Qwen-organisationen på Hugging Face eller ModelScope är händelsen som avslutar fördröjningen — och veckan den 10 augusti har nästan gått till ända utan en sådan.
• 27B:ns licensfil. Max levererades med en anpassad skalnivålicens, inte Apache 2.0. Huruvida 27B följer det prejudikatet är den enskilt mest avgörande raden i dess kommande tillkännagivande.
• Arkitektur och kontextlängd. Dense-vs-MoE och kontextfönstret avgör vad 27B är till för.
• Det första oberoende riktmärket. Maxens 56 på Artificial Analysis Intelligence Index satte ribban; 27B:s första externa utvärdering kommer att berätta hur mycket av generationens vinster som överlever i konsumentstorlek.
• Verktygskedjans täckning.Huruvida 27B ärver Max dag-ett-stöd för SGLang/vLLM/TokenSpeed, och hur snabbt communityns kvantiseringar följer.
Vanliga frågor
Har Qwen3.8-27B släppts ännu?
Nej. Alibaba tillkännagav det den 3 augusti 2026 och åtog sig att publicera vikterna på Hugging Face och ModelScope för veckan den 10 augusti, men från och med den 13 augusti finns det inget officiellt Qwen3.8-27B-repository, modellkort eller licens. Max-klassens öppna vikter — Qwen3.8-2.4T-A95B — släpptes den 13 augusti; 27B gjorde det inte, och tredjepartsspårare rapporterar att den är försenad utan nytt datum.
Vilken hårdvara behöver jag för att köra Qwen3.8-27B?
Obekräftat, men communityns uppskattningar baserade på Qwen 3.6-27B-kvantiseringstabellen placerar en Q4_K_M-kvantisering på ungefär 16 GB VRAM (ett RTX 4090), en Q3_K_M-kvantisering på ungefär 13 GB (12 GB-kort), en Q6_K-kvantisering på ungefär 21 GB (24 GB-kort) och FP8-serving på ungefär 27 GB (en enda L40S). Unsloths Daniel Han rapporterar cirka 17 GB vid lansering. Betrakta dessa som uppskattningar tills det officiella modellkortet publicerar hårdvaruvägledning.
Är Qwen3.8-27B tillgänglig via OrcaRouter?
Inte ännu. Qwen3.8-27B är en självhostad modell med öppna vikter, och den finns inte på plattformen idag. Flaggskeppet i samma familj — Qwen3.8-Max — är nu tillgängligt via OrcaRouter till leverantörens listpris på $2/$6 per miljon tokens med 0% påslag, och när hostingen för 27B har stabiliserats kan den läggas till samma OpenAI-kompatibla nyckel.
Bör jag vänta på Qwen3.8-27B eller använda Qwen3.8-Max idag?
Det beror på var arbetslasten körs. Om du behöver ett frontier-API nu, så är Qwen3.8-Max live och aggressivt prissatt till 2/6 dollar per miljon tokens. Om du vill self-hosta Max-klassen idag, så är Qwen3.8-2.4T-A95B nedladdningsbar nu, men den kräver rejäl hårdvara — ungefär en 4,9 TB fullprecisionsmodell eller cirka 397 GB kvantiserad, med 410 GB+ kombinerat RAM och VRAM. Om du behöver en lokal eller on-premise-modell på ett enda konsumentkort, är Qwen3.8-27B fortfarande den att vänta på — det är den realistiska self-host-vägen i den här generationen, och dess släpp är nu den öppna frågan snarare än ett fast datum.
Den utlovade veckan har nästan löpt ut, och hälften av det utlovade kom inte fram. Qwen3.8-2.4T-A95B är nedladdningsbar, licensierad och kan serveras; Qwen3.8-27B har bekräftats existera, fortfarande förbunden till öppna vikter, och fortfarande utan repository, licens, riktmärke eller nytt datum. Se om {{1}}27B:s repository landar{{/1}} innan den utlovade veckan är helt slut, {{2}}vad dess licensfil säger{{/2}} bredvid Max:ens, och {{3}}hur de första oberoende utvärderingarna poängsätter den{{/3}}. Dessa tre signaler kommer att tala om för dig om detta är en rutinmässig tvåstegsutgivning av öppna vikter med den mindre modellen fortfarande på väg, eller en försening värd att planera för.
