
Qwen3.8-27B Releasedatum: Vikterna släpptes 14 augusti
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 383 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 209 tok/s
- OrcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- xAISpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Alibaba släppte de öppna vikterna för Qwen3.8-27B på kvällen den 14 augusti 2026, och lade upp repon på Hugging Face och ModelScope under en Apache 2.0-licens. Det avslutar frågan om releasedatum som detta inlägg har följt sedan tillkännagivandet den 3 augusti, och det ger den första datapunkten för API-tillgänglighet: modellen lades upp på en kommersiell API-marknadsplats samma dag. Qwen3.8-27B är den täta, självhostade medlemmen av Qwen3.8-generationen — syskonmodellen som Alibaba positionerade mot flaggskeppet Qwen3.8-Max med 2,4 biljoner parametrar, och efterträdaren till den mycket använda Qwen3.6-27B.
Vad släppet den 14 augusti bekräftade
Qwen3.8-generationen tillkännagavs den 3 augusti 2026. Den dagen lanserades Qwen3.8-Max, flaggskeppet med mixture-of-experts, med ett prissatt API, och Alibaba lovade öppna vikter för både Max och den mindre Qwen3.8-27B ”inom ungefär en vecka.” Det fönstret sträcktes, men fick sedan ett konkret mål när en ModelScope-teaser körde en nedräkning till midnatt den 15 augusti (00:00 JST). Släppet landade enligt det schemat: kvällen den 14 augusti, Pekingtid, på både Hugging Face och ModelScope.
De bekräftade specifikationerna: Qwen3.8-27B är en tät modell med 27 miljarder parametrar, naturligt multimodal (text, bilder, video, diagram, dokument), med ett inbyggt kontextfönster på 262 000 token som utökas till 1 miljon token via YaRN, och ett konfigurerbart reasoning_effort-läge som justerar tankedjupet för att spara beräkningskraft. Detta är leverantörsangivna specifikationer från lanseringsmaterialet — nu kontrollerbara direkt i de publika vikterna snarare än att tas på tro.
På Alibabas egna utvärderingar överträffar 27B sin föregångare och till och med den större Qwen3.7-Plus: SWE-bench Pro 61.7 (jämfört med 53.5 för Qwen3.6-27B), agentisk terminalkodning 73.0 (jämfört med 63.4) och JobBench 33.4 (jämfört med 21.8). Dessa är leverantörsrapporterade siffror — ingen oberoende benchmark har publicerat ett resultat för 27B ännu, så betrakta dem som påståendet som communityn nu kommer att försöka reproducera.

Vilka lager av en releas har landat
För en modell med öppna vikter har ”släppt” flera lager, och de landar med dagars mellanrum. Råvikterna är lager ett — det landade den 14 augusti. Stöd för inferensramverk är lager två: vLLM och SGLang lägger vanligtvis till stöd inom några dagar efter ett viktsläpp, och det är signalen att en modell är redo att serveras snarare än bara laddas ner. Community-kvantiseringar är lager tre — GGUF- och AWQ-byggen, och med dem Ollama, LM Studio och llama.cpp:s enkommandoväg, vanligtvis en till två veckor senare.
Så “när kan jag hämta vikterna” besvaras: nu. “När kan jag köra det med ett kommando” besvaras av ramverket och kvantiseringslagren, som fortfarande rullas ut.

Licensfrågan är avgjord.
{{1}}Licensen var den öppna frågan som betydde mer än datumet{{/1}}, och {{2}}släppet avgjorde den{{/2}}. Qwen3.8-27B släpps under Apache 2.0 — en tillåtande licens utan tak för antal användare och utan utlösare för kommersiella diskussioner. Den tidigare farhågan att en öppen Qwen-utgåva skulle komma under Tongyi Qianwen-licensen, med dess klausul om 100 miljoner månatliga aktiva användare, infriades inte för 27B. Det undanröjer det huvudsakliga juridiska hindret för att koppla in modellen i produkter och agenter från dag ett.
Den första datapunkten för API-tillgänglighet
Utgåvan gav också den första datapunkten för API-tillgänglighet för 27B: inom några timmar efter viktsläppet dök modellen upp på en kommersiell API-marknadsplats som en live-slutpunkt i drift. Listningen är oberoende verifierbar — en tredjepartskatalogpost, inte ett leverantörspåstående — och den är det första beviset på att modellen inte bara är nedladdningsbar utan även driftsättningsbar via hanterade API:er.
Det är här OrcaRouter kommer in i kostnadskalkylen. Generationens routningsbara medlem är idag Qwen3.8-Max, som tillhandahålls på OrcaRouter till leverantörens listpris – 2,00 USD per miljon inmatningstoken och 6,00 USD per miljon utmatningstoken, med noll påslag, så leverantörens eget pris är priset du betalar. En API-nyckel täcker den och de 200+ modellerna i katalogen, med automatisk failover. När Qwen3.8-27B förtjänar sin plats på routern, kommer samma nyckel att routa till den; tills dess är Apache 2.0-vikterna fria att självhosta för utvärdering.
Vad ska verifieras härnäst?
Fallet besvarar datumfrågan; det besvarar ännu inte kvalitetsfrågan. Tre saker är värda att bevaka under de kommande veckorna:
• Stöd för inferensramverk — vLLM- och SGLang-pull requests som namnger Qwen3.8-27B, signalen att modellen är redo att serveras i stor skala snarare än bara köras från repot.
• Community-kvantiseringar med verkliga VRAM-mätningar — Unsloth och andra brukar publicera GGUF-byggen och uppmätt minnesanvändning inom några dagar, vilket omvandlar förhandsprognoser till siffror du kan utgå ifrån vid driftsättning.
• Oberoende riktmärken — Artificial Analysis och LMArena-poäng för 27B, när de kommer, är vad som bör driva ett produktionsbeslut, inte Alibabas egna utvärderingar.
Vad du kan använda idag
Qwen3.8-27B är nedladdningsbart nu — det är hela poängen med ett Apache 2.0-släpp. För team som vill bygga mot generationen via en hanterad API idag är Qwen3.8-Max live på OrcaRouter till leverantörens listpris ($2,00 per miljon inmatningstokens, $6,00 per miljon utmatningstokens, noll påslag), med automatisk failover och en nyckel för hela katalogen. Tills oberoende benchmark bekräftar leverantörens siffror är självhosting av 27B-vikterna för utvärdering den lågriskvägen in.

Utgivningsdatumfrågan är avslutad: Qwen3.8-27B släpptes den 14 augusti 2026, under Apache 2.0, med ett inbyggt 262K kontextfönster och en API-tillgänglighetspunkt samma dag. De frågor som återstår är de mätbara — hur den serverar, hur den kvantiserar, och om oberoende utvärderingar återskapar Alibabas poäng. Läs LICENSE, hämta vikterna, och vänta på stöd i ramverk och communitybyggen innan du satsar en produktionsväg på den.
