Een hero-titelkaart voor "Qwen 4 Max aangekondigd op Apsara 2026" met de ondertitel "Wat Alibaba bevestigde, en wat niet", drie pill-badges met de tekst "4 tiers gepreviewd", "0 specs gepubliceerd" en "22 september 2026", en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

Qwen 4 Max aangekondigd op Apsara 2026: wat Alibaba bevestigde, en wat niet

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

De Yunqi-conferentie in Hangzhou — de Apsara Conference — werd op 22 september 2026 gebruikt om vier modellen te tonen die nog niet zijn uitgebracht. De LLM-lead van het lab, Liu Da Yiheng, gaf op het podium een voorproefje van Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus en Qwen 4 27B, beschreef de familie als trainend op een nieuwe-generatiearchitectuur en zei alleen dat die binnenkort zou komen. Op het moment van schrijven is er voor geen van de vier een modelkaart, geen open gewichten, geen API-identificatie, geen contextvenster, geen prijs en geen benchmarkscore. Het nieuwste vlaggenschip dat je vandaag daadwerkelijk kunt aanroepen is Qwen3.8-Max, algemeen beschikbaar sinds 3 augustus 2026, en die afstand tussen een podiumaankondiging en een aanroepbaar eindpunt is het deel van dit verhaal dat aandachtig lezen waard is.

De vier niveaus, en wat elk ervan hoort te zijn.

De Qwen-lijn van Alibaba is sinds de Qwen 3-generatie in bekwaamheidsniveaus ingedeeld, en de aankondiging van Qwen 4 behield die vorm in plaats van die te vervangen. Wat op het podium werd getoond, was een namenlijst, niet een specificatieblad:

• Qwen 4 Max — het vlaggenschipniveau, en het model dat Alibaba tegenover het topmodel van elk ander toonaangevend lab positioneert

• Qwen 4 Flash — de hogedoorvoerlaag, gebouwd voor latentiegevoelig en hoogvolume werk in plaats van piekredeneervermogen

• Qwen 4 Plus — het gebalanceerde middelste niveau, van oudsher degene met de breedste spreiding aan multimodale ondersteuning

• Qwen 4 27B — de open-weight lokale tier, degene die wordt gedownload, fine-tuned en gekwantiseerd door mensen die nooit een gehoste API aanraken

• Architectuur — beschreven als een nieuwe generatie, en beschreven als zijnde in training, wat niet hetzelfde is als afgerond zijn

• Primaire werklast — agentische en tool-gebruikende taken, volgens de framing van de conferentie, in plaats van chat

• Beschikbaarheid — geen. Geen enkel niveau heeft een releasedatum, een prijs, een contextvenster, een lijst met modaliteiten of een gepubliceerde score

De 27B-tier is degene om in de gaten te houden, om een reden die niets met benchmarks te maken heeft. Het is de enige tier in de familie die historisch met open gewichten is uitgebracht, en de Qwen 3.8-generatie liet zien hoeveel onafhankelijk werk dat ontgrendelt: binnen dagen nadat de 27B-gewichten beschikbaar kwamen, had de community MLX-conversies, NVFP4-kwantisaties en ongecensureerde fine-tunes geproduceerd. Een aangekondigde 27B is de belofte van een heel downstream-ecosysteem, en het is het onderdeel van deze roadmap met de meest voorspelbare oplevering.

Het getal van 5 tot 10 biljoen parameters hoort niet bij Qwen 4.

De verslaggeving over de conferentie was vaag over één cijfer. Het doel van "5 tot 10 biljoen parameters" dat samen met het Qwen 4-nieuws de ronde deed, is geen Qwen 4-specificatie — het is een toekomstgerichte uitspraak over de generaties daarna, het tijdsbestek van Qwen 4.5 en Qwen 5. Alibaba heeft geen parameteraantal aan Qwen 4 Max gekoppeld, en op basis van het beschikbare bewijs zou het een fout zijn om er een af te drukken.

Dit is belangrijk omdat het aantal parameters het getal is waar lezers op afgaan en het getal dat zich verspreidt. Een bewering van 5T parameters die aan een model zonder gepubliceerde architectuur wordt gekoppeld, is in beide richtingen onfalsifieerbaar: niemand kan het bevestigen, en niemand kan het corrigeren zodra het is herhaald. Als je Qwen 4 Max deze week als een model met meerdere biljoenen parameters ziet beschreven, is het getal overgenomen van een andere dia.

Wat er eerlijk gezegd kan worden, is dat het vorige vlaggenschip een mixture-of-experts is met 2,4 biljoen parameters, met 95 miljard actieve parameters per token, bevestigd op de officiële modelkaart voor Qwen3.8-Max en op de open-weight release die daarop volgde. Wat Qwen 4 Max ook blijkt te zijn, dat is de baseline die het moet verslaan, en het is een gepubliceerd, controleerbaar getal in plaats van een ambitie op een roadmap.

A two-column scoreboard titled "Qwen 4 Max vs the model you can call today". Left column Qwen 4 Max: Release date not given, Input price not given, Output price not given, Context window not given, Open weights not given, Benchmarks not given. Right column Qwen3.8-Max: Release date August 3 2026, Input price $2.00 per 1M tokens, Output price $6.00 per 1M tokens, Context window 1M tokens, Open weights published August 12 2026, Benchmarks vendor and independent. Footer reads "Qwen 4 Max status per Alibaba's September 22 2026 conference; Qwen3.8-Max from its published model card.", with the OrcaRouter logo bottom-right.

De architectuur is geen gerucht: er is al een voorproefje van verschenen

Het nuttigste aan de aankondiging van Qwen 4 is dat een deel van de architectuur al onder een andere naam is uitgebracht. Qwen3.8-Flash-Next werd eind augustus 2026 open-source gemaakt, en op de modelkaart wordt het simpelweg aangeduid als een preview van de Qwen 4-architectuur. Daarmee is het het enige concrete bewijs dat iemand buiten Alibaba heeft over hoe de Qwen 4-familie is opgebouwd.

Het is een sparse model met 125 miljard hoofdparameters plus 51 miljard parameters aan N-gram-embeddings, dat ongeveer 6 miljard per inferentiestap activeert. Het heeft een native context van 262.000 tokens die volgens de kaart richting 1 miljoen reikt, en Alibaba meldt dat het is getraind tegen ongeveer 90 procent lagere kosten dan Qwen3.7-Plus. Op de kaart worden drie technieken genoemd:

• QSA, een Qwen-specifiek sparse-attentieschema, het mechanisme achter de bewering over goedkope training met lange context

• Gated residuele verbindingen, een stabiliteitsmaat voor diepe sparse netwerken

• N-gram-embeddings, een afzonderlijke parameteropslag van 51 miljard parameters die wordt opgezocht in plaats van dense te worden berekend

Als de Qwen 4-tiers dat ontwerp overnemen, is het interessante gevolg economisch in plaats van architectonisch. Een familie die is ontworpen om kwaliteit dicht bij de frontier te bereiken tegen ongeveer een tiende van de trainingskosten, is een familie die agressief geprijsd kan worden, en agressieve prijsstelling van Alibaba is al twee jaar de meest betrouwbare kracht in de economie van open-weightmodellen. Dat is een voorspelling, geen feit, en moet ook als zodanig worden bestempeld — maar het is de reden om deze roadmap te volgen in plaats van hem terzijde te schuiven.

Wat je kunt uitvoeren terwijl je wacht

Niets in de aankondiging van Qwen 4 verandert wat deze week beschikbaar is, en het eerlijke antwoord voor iedereen die vandaag bouwt, is de Qwen 3.8-generatie. Qwen3.8-Max is algemeen beschikbaar sinds 3 augustus 2026 voor $2,00 per miljoen inputtokens en $6,00 per miljoen outputtokens, gelijk over de volledige context van 1 miljoen tokens zonder toeslag voor lange prompts, en de gewichten werden op 12 augustus 2026 gepubliceerd als Qwen3.8-2.4T-A95B in zowel BF16 als FP8 onder een aangepaste Qwen-licentie. Het is het model waaraan de Qwen 4-tiers zullen worden afgemeten, en het verwerkt vandaag productieverkeer.

Als je de momenteel beschikbare Qwen-generatie wilt vergelijken met de rest van de frontier zonder een apart account, aparte key en aparte factuur voor elk lab te beheren, OrcaRouter voert de Qwen 3.8-familie — Qwen3.8-Max, Qwen3.8-Flash en Qwen3.8-27B — naast Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview en GLM 5.3 op één OpenAI-compatibel endpoint. Dat is één API voor bijna 200 modellen met 0% opslag, wat betekent dat de lijstprijs van de provider ongewijzigd wordt doorgegeven, zodat een prijsverlaging van een leverancier dezelfde dag op je key terechtkomt in plaats van bij de volgende factureringscyclus. Wanneer er wél een Qwen 4-tier uitkomt, is dezelfde catalogus de plek waar die zou verschijnen; vandaag is dat bij geen enkele het geval.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the on-page nav, the 1M token context badge, the model ID qwen/qwen3.8-max, multi-modality shown as text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the code-samples panel with the OpenAI-compatible Python import, the Public benchmarks and Community buzz blocks, and the opening line of the model description calling Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

De bottom line

Qwen 4 Max is een echte aankondiging en geen echt product, en beide helften van die zin doen ertoe. De line-up is bevestigd: vier niveaus, een architectuur van een nieuwe generatie, een agentische focus, en een open-weight 27B-niveau dat voor meer mensen meer zal betekenen dan het vlaggenschip. Alles wat een aankoopbeslissing nodig heeft — prijs, context, modaliteit, weights, scores, een datum — ontbreekt.

Behandel dit als een roadmapsignaal met een ongewoon goed documentatiespoor, want de release van Qwen3.8-Flash-Next geeft je de architectuurpreview gratis en Qwen3.8-Max geeft je de incumbent-baseline met gepubliceerde gewichten en een gepubliceerde prijs. Volg de 27B-tier voor het ecosysteem dat die zal creëren en de Flash-tier voor de doorvoereconomie. Publiceer het cijfer van 5 tot 10 biljoen parameters niet opnieuw als een feit over Qwen 4, en plan geen migratie rond een model zonder releasedatum — plan die rond Qwen3.8-Max, en stap over wanneer er een endpoint is om naartoe te gaan.

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.