
Qwen3.8-27B Releasedatum: Alles wat we tot nu toe weten
- deepseekNIEUWDeepSeek: DeepSeek V4 Pro 08132026-08-12$0.44 / $0.88 per 1 mln tokens · 72 tok/s
- grokNIEUWSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaNIEUWMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenNIEUWQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens · 2304 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligentie77Coderen
- grokxAI: Grok 4.52026-07-0856Intelligentie72Coderen
- tencentTencent: Hy32026-07-0642Intelligentie59Coderen
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligentie42Coderen
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligentie39Coderen
Alibaba beloofde de open gewichten van Qwen3.8-27B voor de week van 10 augustus 2026, en die termijn is inmiddels verstreken. Nu heeft de vertraging een concreet doel: de officiële Qwen-pagina op ModelScope toont een aftelling naar middernacht op 15 augustus 2026 — 00:00 JST, volgens het rapport van PC Watch van 13 augustus over de teaser. De gewichten zijn tot op heden nog steeds niet verschenen op de officiële Qwen-organisatie op Hugging Face, maar de vraag over de releasedatum heeft nu voor het eerst sinds de aankondiging van 3 augustus een antwoord. Hier is wat bevestigd is, wat nog onbevestigd is, en waar je op moet letten.
Wat is bevestigd
Alibaba kondigde de Qwen3.8-generatie aan op 3 augustus 2026. Er gebeurden die dag twee dingen: {{1}}Qwen3.8-Max, het mixture-of-experts-vlaggenschip met 2,4 biljoen parameters, ging live met een betaalde API{{/1}}, en Alibaba beloofde de gewichten openbaar te maken van zowel de Max als de kleinere Qwen3.8-27B {{2}}"binnen ongeveer een week."{{/2}} Meerdere onafhankelijke media (36Kr, TrendForce, C114) meldden dezelfde toezegging: {{3}}Hugging Face en ModelScope, in de week van 10 augustus.{{/3}}
De 27B is het zelf-hostbare lid van de generatie — Alibaba positioneerde het als geschikt voor werk op één GPU en on-premise, de directe opvolger van de veelgebruikte Qwen3.6-27B. Die afstamming doet ertoe. Qwen3.6-27B werd een van de populairste lokale codeermodellen van zijn generatie, en de 3.8-versie erft die gevestigde reeks vragen: wat kost het om te draaien, is het beter in agents, wanneer kan ik het binnenhalen?
Wat vandaag onafhankelijk verifieerbaar is, is het vlaggenschip, en dat omvat nu ook open gewichten. Qwen3.8-Max is live op de API, en de bijbehorende repositories — Qwen3.8-2.4T-A95B (volledige BF16) en een officiële FP8-kwantificatie — verschenen in de week van 10 augustus op de officiële Qwen-organisatie op Hugging Face, de eerste keer dat Alibaba een vlaggenschip van de Max-klasse als open source heeft uitgebracht. Het is ook al gescoord: Artificial Analysis plaatst de Intelligence Index op 58, het dichtst dat een Chinees lab bij de top van die tabel is gekomen, de Coding Index op 71,8, en de prijs op $2,00 per miljoen invoertokens en $6,00 per miljoen uitvoertokens.

Hoe een "release" er daadwerkelijk uitziet voor een open-weights model
Een datumvraag over een gesloten model is simpel — de API gaat aan. Voor een open-weights model heeft "released" meerdere lagen, en elke laag verschijnt met dagen ertussen:
De ruwe gewichten verschijnen als een Hugging Face- en ModelScope-repository, met een modelkaart en een LICENSE-bestand.
Inferentieframeworks volgen — vLLM en SGLang zullen naar verwachting binnen enkele dagen ondersteuning toevoegen {{1}}, wat het signaal is dat een model klaar is om te dienen in plaats van alleen te downloaden{{/1}}.
• Community-kwantisaties (GGUF, AWQ) lopen doorgaans één tot twee weken achter, en pas dan kunnen gebruikers van Ollama, LM Studio en llama.cpp het daadwerkelijk ophalen en draaien.
Dus als de vraag is "wanneer kan ik de gewichten downloaden," dan is het antwoord een repository die verschijnt op de officiële Qwen-org. Als de vraag is "wanneer kan ik het met één commando draaien," tel er dan één tot twee weken bij op. De belofte van 3 augustus mikte op de eerste daarvan voor de week van 10 augustus — en die laag is nu beschikbaar gekomen voor één lid van de generatie: Qwen3.8-2.4T-A95B verscheen die week op Hugging Face. Voor de 27B specifiek is het nog steeds niet op Hugging Face verschenen — maar de ModelScope-aftelling noemt nu een doel: 15 augustus 2026 om 00:00 JST.
Wat is nog onbevestigd?
Al het andere over de 27B is speculatief totdat de repository uitkomt. Laat zelfverzekerde berichtgeving niet van voorspellingen specificaties maken — niets van het volgende is bevestigd op het moment van schrijven:
• Architectuur — dense of mixture-of-experts, en het aantal actieve parameters indien MoE.
• Contextvenster, uitvoerlimieten, en of het alleen-tekst of multimodaal is. De ModelScope-teaser beschrijft volgens PC Watch native multimodale en meertalige ondersteuning voor afbeeldingen en video — door de leverancier vermeld op de teaser, nog steeds niet geverifieerd totdat de weights vrijkomen.
• De licentie. Apache 2.0 is geen veilige aanname; recente open releases van Qwen zijn uitgebracht onder de Tongyi Qianwen-licentie, die een clausule van 100 miljoen maandelijkse actieve gebruikers bevat die commerciële besprekingen boven die drempel in gang zet.
• Eventuele benchmarkscores. Elk getal dat voor de 3.8-generatie circuleert, is door de leverancier gerapporteerd voor de Max; de 27B heeft helemaal geen openbare evaluaties.
• Exacte gekwantiseerde formaten. De VRAM-cijfers die in omloop zijn, zijn projecties die zijn overgenomen van Qwen3.6-27B, niet metingen van het 3.8-model.

Waarom de licentie belangrijker is dan de datum
De releasedatum bepaalt wanneer je kunt beginnen met testen. De licentie bepaalt of je kunt uitbrengen. Een Qwen-model onder de Tongyi Qianwen-licentie is gratis te gebruiken onder de 100 miljoen maandelijkse actieve gebruikers — daarboven wordt verwacht dat je commerciële voorwaarden bespreekt. Voor een lokaal model dat teams in producten en agents zullen inbouwen, kan die drempel sneller bereikt worden dan het klinkt. Het eerste bestand dat je opent in de repository is de LICENSE, vóór de modelkaart en vóór de README.
Hoe de daling op te vangen voordat de blogposts dat doen.
De officiële Qwen-organisatie op Hugging Face is de grondwaarheid — wanneer een repository met de naam Qwen3.8-27B daar verschijnt, of op ModelScope, is de release gebeurd. Het mechanisme heeft zich deze week al bewezen: Qwen3.8-2.4T-A95B en zijn FP8-tegenhanger verschenen precies op die manier op de org, dus de 27B-repo zal net zo onmiskenbaar zijn. Op ModelScope is er al een aftelpagina voor Qwen3.8-27B live, die verwijst naar middernacht op 15 augustus — het dichtst bij een officiële datum tot nu toe. Drie eerdere signalen zijn het waard om in de gaten te houden:
• Een vLLM- of SGLang-pullrequest waarin Qwen3.8-27B wordt genoemd. Framework-PR's zijn vaak het eerste publieke spoor van een gewichtsrelease, omdat het integratiewerk begint zodra de repo klaarstaat.
• De eigen kanalen van het Qwen-team (X, WeChat, de qwen.ai-blog), die gewoonlijk de release zelf aankondigen.
Community-quantizers — Unsloth en anderen plaatsen meestal binnen enkele dagen quantbestanden en echte VRAM-metingen, waardoor de bovenstaande projecties worden omgezet in meetbare getallen.
Eén waarschuwing geldt de hele tijd: voordat de officiële organisatie publiceert, is elke "Qwen3.8-27B" die je kunt downloaden ofwel een placeholder ofwel een upload van een derde partij. De naam alleen is geen authenticiteit.
Wat je vandaag kunt gebruiken
De 27B is het model om op te wachten, niet de enige optie uit deze generatie. Qwen3.8-Max is nu live — en ook zelf te hosten, aangezien de gewichten downloadbaar zijn — en op OrcaRouter wordt het gefactureerd tegen de lijstprijs van de provider: $2.00 per miljoen invoertokens en $6.00 per miljoen uitvoertokens, zonder opslag, dus de prijs op de eigen prijspagina van de leverancier is de prijs die je betaalt. Eén sleutel dekt het, en wanneer de 27B uitkomt en vertrouwen wint op openbare benchmarks, zal dezelfde sleutel er ook naar routeren. Voor een team dat vandaag op de generatie wil bouwen terwijl het de optie van een zelf gehoste 27B later openhoudt, is dat het pad met de minste lock-in dat er is.

De eenvoudige samenvatting: het antwoord op de releasedatum is duidelijker dan een week geleden. Het venster dat Alibaba gaf — de week van 10 augustus 2026 — is gekomen en gegaan. Het leverde de gewichten van het vlaggenschip: Qwen3.8-2.4T-A95B en de officiële FP8-kwantificatie staan nu op Hugging Face. Het leverde niet die van de 27B — maar de vertraging heeft nu een doel: de ModelScope-aftelling loopt tot middernacht op 15 augustus 2026 (00:00 JST, volgens PC Watch). Houd de officiële Qwen-organisatie op Hugging Face en de Qwen-pagina op ModelScope in de gaten, lees de LICENSE op het moment dat de 27B-repo verschijnt, en behandel elk specificatie- en VRAM-getal dat circuleert als een projectie totdat de gewichten ze meetbaar maken.
