
Qwen 4 Max vs GLM-5.3: open weights, aangepaste licenties en de tier die daadwerkelijk wordt uitgebracht
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max werd op 22 september 2026 gepresenteerd op de Yunqi-conferentie in Hangzhou als het vlaggenschip van een vierledige modellijn die ook Qwen 4 Flash, Qwen 4 Plus en een open-weight Qwen 4 27B-niveau omvat. Z.ai's GLM-5.3 staat sinds 18 augustus 2026 vermeld, alleen tekst, met een contextvenster van 1 miljoen tokens en een uitvoerplafond van 128.000 tokens, tegen $1,26 per miljoen inputtokens en $3,96 per miljoen outputtokens in onze catalogus, tegenover de lijsttarieven van $1,40 en $4,40 die Z.ai publiceert. Beide labs komen uit de open-weights-traditie en verkopen nu beiden frontier-modellen van topniveau via gehoste API's, dus de gebruikelijke framing van closed versus open is hier niet van toepassing. De as die wél van toepassing is, is degene die niemand in een vergelijkingstabel zet: wat de licentie daadwerkelijk toestaat, en welk niveau binnen elke familie het niveau is waarmee je iets interessants mag doen.
Twee labs, twee antwoorden op dezelfde vraag
Alibaba en Z.ai zijn de twee meest consistente uitgevers van open weights onder de laboratoria die aan de frontier grenzen, en ze hebben verschillende houdingen aangenomen over hoeveel van die openheid het tot de topklasse redt.
Alibaba's Qwen 3.8-generatie publiceerde op 12 augustus 2026 de gewichten voor zijn grootste model — Qwen3.8-2.4T-A95B, in BF16 en FP8. Het publiceerde ze onder een aangepaste Qwen-licentie, niet onder Apache 2.0. Dat onderscheid is precies de kern: de gewichten bestaan, wat betekent dat fine-tuning, kwantisatie en self-hosting mogelijk zijn op een manier die voor een gesloten model nooit mogelijk zal zijn, maar de voorwaarden zijn die van Alibaba zelf en het zijn niet de permissieve standaard die de uitdrukking "open weights" doorgaans impliceert.
De GLM-lijn van Z.ai komt uit een lab met een open-gewichtenverleden, en het vlaggenschip is daarop niet langer een uitzondering. De eigen gewichten van GLM-5.3 werden op 28 augustus 2026 gepubliceerd — het vlaggenschip met 743 miljard parameters, in 141 safetensors-shards — onder een aangepaste licentie die Z.ai ervoor opstelde in plaats van onder MIT. De voorwaarden zijn grofweg een MIT-toekenning met een beveiligingsreviewvoorwaarde voor model-as-a-servicebedrijven boven een hoge omzetdrempel. Let op wat dat betekent voor de familie: GLM-5.2 en GLM-5.3-Flash vallen onder MIT, en het vlaggenschip niet.
Zoals vermeld is GLM-5.3 een alleen-tekstmodel met een gepubliceerd contextvenster, een gepubliceerd uitvoerplafond en gedocumenteerd gebruik van tools, JSON-modus en redeneervermogen.
Zet de twee naast elkaar en het praktische contrast is dit:
• Flagship-gewichten — Qwen 3.8-flagship gepubliceerd onder een aangepaste Qwen-licentie versus GLM-5.3-gewichten gepubliceerd op 28 augustus 2026 onder een aangepaste Z.ai-licentie
Invoerprijs — Qwen3.8-Max $2,00 per 1 miljoen tokens tegenover GLM-5.3 $1,26 per 1 miljoen tokens in onze catalogus, $1,40 op de eigen lijst van Z.ai
• Prijs van de output — Qwen3.8-Max $6,00 per 1 mln. tokens versus GLM-5.3 $3,96 per 1 mln. tokens in onze catalogus, $4,40 op de eigen lijst van Z.ai
• Context — Qwen3.8-Max 1 miljoen tokens tegenover GLM-5.3 1 miljoen tokens
• Uitvoerplafond — Qwen3.8-Max 128K tokens versus GLM-5.3 128K tokens
• Modaliteit — Qwen3.8-Max tekst-, afbeeldings- en video-invoer versus GLM-5.3 alleen tekst, als zodanig gedocumenteerd
• Vaardigheidslabels — Qwen3.8-Max visie, tools, JSON en redenering versus GLM-5.3 tools, JSON en redenering
• Qwen 4 Max — aangekondigd op 22 september 2026, geen prijs, geen context, geen gewichten, geen datum versus GLM-5.3 dat al is uitgebracht en verkeer bedient
De multimodale rij is wat het prijsverschil betaalt. Qwen's vlaggenschip accepteert beeld- en video-invoer en rekent $2,00 voor invoer en $6,00 voor uitvoer; GLM-5.3 accepteert tekst en rekent $1,26 voor invoer en $3,96 voor uitvoer. Als je werklast tekst is, betaal je een premie voor een vision-encoder die je nooit aanspreekt, en dat is de meest concrete reden waarom een tekstspecialist qua kosten voor tekstwerk een multimodaal vlaggenschip verslaat.

Het 27B-niveau is het niveau dat dit bepaalt.
Qwen 4 Max is de headline en de 27B-tier is het verhaal. Elke Qwen-generatie heeft zijn kleine open tier uitgebracht onder voorwaarden die mensen dingen laten doen, en het bewijs uit de praktijk is ondubbelzinnig: binnen dagen nadat de Qwen 3.8 27B-gewichten beschikbaar kwamen, had het ecosysteem al MLX-conversies, NVFP4-kwantisaties en ongecensureerde fine-tunes geproduceerd, waarvan geen enkele iemands toestemming vereiste. Dat is wat een permissieve release van een klein model oplevert, en het is een vorm van distributie die geen enkele gehoste API kan evenaren.
Het topmodel is een ander verhaal. Een model met 2,4 biljoen parameters dat onder een aangepaste licentie is gepubliceerd, is open in de zin dat de bytes downloadbaar zijn en gesloten in de zin dat wat je ermee mag doen, wordt bepaald door de uitgever. Beide dingen zijn tegelijkertijd waar, en de aankondiging van Qwen 4 veranderde geen van beide. Als het Qwen 4 27B-niveau het patroon van zijn voorgangers volgt, zal het de release zijn die voor de meeste mensen belangrijk is, en het is ook de release met de meest voorspelbare opleverdatum, omdat kleine open niveaus het gemakkelijkst af te ronden onderdeel van de roadmap zijn.
Wat de vergelijking terugbrengt naar iets bruikbaars. GLM-5.3 is een gehost model tegen een gepubliceerde prijs met een gedocumenteerde set mogelijkheden, en het is nu beschikbaar. Qwen 4 Max is een naam voor een niveau. Als je wilt dat het openheidsargument concreet is in plaats van filosofisch, is het model om op te wachten de 27B, niet de Max.
De routinglaag is waar de licentiekwestie er niet meer toe doet
Er is een variant op deze beslissing die de licentiekwestie volledig omzeilt, en het loont de moeite om eerlijk te zijn dat dit een reële optie is en geen compromis. Als het je bedoeling is een model aan te roepen in plaats van er zelf een te bezitten, doet de licentie op de gewichten er niet toe, en waar het dan om gaat zijn de prijs, de latentie en het gedrag bij storingen.
OrcaRouter levert GLM-5.3 als z-ai/glm-5.3 voor $1,26 per miljoen tokens aan invoer en $3,96 aan uitvoer — onder de $1,40 en $4,40 die Z.ai publiceert, waarbij de modelpagina die lijsttarieven naast het tarief dat wij factureren toont, en zonder opslag bovenop wat wij de provider betalen. Hetzelfde OpenAI-compatibele endpoint levert de Qwen 3.8-familie, Qwen3.8-Max, Qwen3.8-Flash en Qwen3.8-27B, naast bijna 200 andere modellen, met automatische failover wanneer een providerpad verslechtert en een routing-DSL waarmee je het substitutiebeleid expliciet kunt uitdrukken in plaats van een modelstring in applicatiecode te bewerken. Wanneer een leverancier zijn tarief wijzigt, staat die wijziging dezelfde dag op je key, omdat er geen margelaag is waar die achter kan blijven steken.
Wat OrcaRouter niet aanbiedt, is Qwen 4 Max of welke Qwen 4-tier dan ook. De catalogus bevat geen vermelding voor de familie, wat de juiste status is voor een model dat op een podium is aangekondigd en nog niet is uitgeleverd. Qwen 4 Max zal bereikbaar zijn, wanneer het überhaupt bereikbaar is, via de eigen API van de leverancier en diverse platforms van derden. Tot die tijd is het Qwen-model in deze vergelijking dat je daadwerkelijk kunt aanroepen Qwen3.8-Max, en het staat in dezelfde catalogus als GLM-5.3 — waardoor de live versie van deze match-up een beslissing over routeringsbeleid wordt in plaats van een inkoopbeslissing.

Wat de licentiekwestie werkelijk beslist
GLM-5.3 is op beide assen goedkoper, zijn contextvenster en uitvoerplafond komen overeen met die van het Qwen-vlaggenschip, zijn modaliteitslimieten zijn gedocumenteerd in plaats van aan inferentie te worden overgelaten, en het verwerkt vandaag al verkeer. Qwen 4 Max heeft een conferentieslot en een tiernaam, en het enige deel van de Qwen 4-roadmap met een voorspelbare levering is de 27B-tier.
De beslissing die de lancering overleeft, is niet welk model beter is. Het is of je het ding zelf moet bezitten. Als je zelf moet hosten, fine-tunen of aanpassen, komen de vlaggenschipgewichten van beide labs met voorwaarden die je moet lezen voordat je er een bedrijf op bouwt, en de kleine open categorie is waar de permissieve opties historisch hebben geleefd. Als je een model moet aanroepen, is GLM-5.3 vandaag het goedkopere antwoord voor tekstwerk, is Qwen3.8-Max het antwoord als je beeld- of video-invoer nodig hebt, en beide zijn slechts één endpoint en één factuur verwijderd. Kom terug op de vlaggenschipkwestie wanneer Alibaba een modelkaart publiceert, en lees de licentie voordat je de benchmarktabel bekijkt.

Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
