Ett hero-titelkort för "Qwen 4 Max vs GLM-5.3" med undertexten "Öppna vikter, anpassade licenser och nivån som faktiskt levereras", tre pillerbrickor med texten "$1.26 och $3.96", "enbart text vs multimodala" och "27B är den att hålla koll på", en sidfotsrad med texten "Alibaba meddelade 22 september 2026; GLM-5.3 listades 18 augusti 2026", och OrcaRouter-logotypen i nedre högra hörnet.
Engineering & Research

Qwen 4 Max vs GLM-5.3: öppna vikter, anpassade licenser och nivån som faktiskt levereras

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Qwen 4 Max förhandsvisades på Yunqi-konferensen i Hangzhou den 22 september 2026 som flaggskeppet i en serie med fyra modeller som också omfattar Qwen 4 Flash, Qwen 4 Plus och en Qwen 4 27B-nivå med öppna vikter. Z.ai:s GLM-5.3 har listats sedan den 18 augusti 2026, endast text, med ett kontextfönster på 1 miljon token och ett utdatatak på 128 000 token, till $1,26 per miljon indata-token och $3,96 per miljon utdata-token i vår katalog, mot de listpriser på $1,40 och $4,40 som Z.ai publicerar. Båda labben har sina rötter i traditionen med öppna vikter och båda säljer nu modeller på frontier-nivå via hostade API:er, så den vanliga inramningen sluten kontra öppen gäller inte här. Den axel som faktiskt gäller är den som ingen tar med i en jämförelsetabell: vad licensen faktiskt tillåter, och vilken nivå i varje familj som är den man får göra något intressant med.

Två labb, två svar på samma fråga

Alibaba och Z.ai är de två mest konsekventa utgivarna av öppna vikter bland de frontlinjeangränsande labben, och de har intagit olika hållningar till hur mycket av den öppenheten som överlever in i flaggskeppsklassen.

Alibabas Qwen 3.8-generation publicerade vikterna för sin största modell – Qwen3.8-2.4T-A95B, i BF16 och FP8 – den 12 augusti 2026. Den publicerade dem under en anpassad Qwen-licens, inte Apache 2.0. Den distinktionen är hela poängen: vikterna finns, vilket innebär att finjustering, kvantisering och självhosting är möjliga på ett sätt som de aldrig kommer att vara för en sluten modell, men villkoren är Alibabas egna och de är inte den tillåtande standard som frasen ”öppna vikter” tenderar att antyda.

Z.ai:s GLM-linje kommer från ett labb med rötter i öppna vikter, och flaggskeppet är inte längre något undantag från det. GLM-5.3:s egna vikter publicerades den 28 augusti 2026 — flaggskeppet med 743 miljarder parametrar, i 141 safetensors-shards — under en anpassad licens som Z.ai skrev för den snarare än under MIT. Villkoren är i stort sett ett MIT-beviljande med ett bifogat villkor om säkerhetsgranskning för model-as-a-service-företag över en hög intäktströskel. Notera vad det innebär för familjen: GLM-5.2 och GLM-5.3-Flash har MIT, och flaggskeppet gör det inte.

Som angivet är GLM-5.3 en textbaserad modell med ett publicerat kontextfönster, ett publicerat utdatatak och dokumenterad verktygsanvändning, JSON-läge och resonemang.

Ställ de två sida vid sida, och den praktiska kontrasten är följande:

• Flaggskeppsvikter — Qwen 3.8-flaggskeppet publicerat under en anpassad Qwen-licens kontra GLM-5.3-vikter publicerade 28 augusti 2026 under en anpassad Z.ai-licens

• Indatapris — Qwen3.8-Max $2.00 per 1 miljon tokens jämfört med GLM-5.3 $1.26 per 1 miljon tokens i vår katalog, $1.40 på Z.ai:s egen lista

• Utdatapris — Qwen3.8-Max $6.00 per 1 miljon tokens jämfört med GLM-5.3 $3.96 per 1 miljon tokens i vår katalog, $4.40 på Z.ai:s egen lista

• Kontext — Qwen3.8-Max 1M tokens mot GLM-5.3 1M tokens

• Maximal utdata — Qwen3.8-Max 128K tokens mot GLM-5.3 128K tokens

• Modalitet — Qwen3.8-Max text-, bild- och videoinmatning kontra GLM-5.3 endast text, dokumenterat som sådant

• Kapacitetstaggar — Qwen3.8-Max vision, verktyg, JSON och resonemang kontra GLM-5.3 verktyg, JSON och resonemang

• Qwen 4 Max — tillkännagavs den 22 september 2026, inget pris, ingen kontext, inga vikter, inget datum, till skillnad från GLM-5.3 som har släppts och betjänar trafik

Den multimodala raden är det som betalar för prisskillnaden. Qwens flaggskepp tar emot bild- och videoindata och debiterar 2,00 USD in och 6,00 USD ut; GLM-5.3 tar emot text och debiterar 1,26 USD och 3,96 USD. Om din arbetsbelastning är text betalar du en visionskodarpremie som du aldrig anropar, och det är det mest konkreta skälet till att en specialist på enbart text slår ett multimodalt flaggskepp kostnadsmässigt för textarbete.

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

27B-nivån är den som avgör detta

Qwen 4 Max är huvudnyheten och 27B-nivån är berättelsen. Varje Qwen-generation har släppt sin lilla öppna nivå på villkor som låter folk göra saker, och bevisen nedströms är entydiga: inom dagar efter att Qwen 3.8 27B-vikterna hade landat hade ekosystemet tagit fram MLX-konverteringar, NVFP4-kvantiseringar och ocensurerade finjusteringar, varav ingen krävde någons tillstånd. Det är vad ett tillåtande släpp av små modeller ger, och det är en distributionsform som inget hostat API kan matcha.

Flaggskeppsnivån är en annan sak. En modell med 2,4 biljoner parametrar som publicerats under en anpassad licens är öppen i den meningen att byten är nedladdningsbara och sluten i den meningen att vad du får göra med dem definieras av utgivaren. Båda sakerna gäller samtidigt, och tillkännagivandet av Qwen 4 förändrade inte någon av dem. Om Qwen 4 27B-nivån följer mönstret från sina föregångare kommer det att vara den lansering som betyder mest för flest människor, och det är också lanseringen med det mest förutsägbara leveransdatumet, eftersom små öppna nivåer är det lättaste att slutföra på färdplanen.

Vilket gör att jämförelsen landar i något användbart igen. GLM-5.3 är en hostad modell till ett publicerat pris med en dokumenterad uppsättning förmågor, och den finns tillgänglig nu. Qwen 4 Max är ett nivånnamn. Om du vill att öppenhetsargumentet ska vara konkret snarare än filosofiskt, är modellen att vänta på 27B, inte Max.

Routningslagret är där licensfrågan slutar spela roll

Det finns en variant av detta beslut som helt undviker licensfrågan, och det är värt att vara ärlig med att det är ett verkligt alternativ snarare än en kompromiss. Om ditt krav är att anropa en modell snarare än att äga en, är licensen för vikterna irrelevant och de villkor som spelar roll är priset, latensen och beteendet vid fel.

OrcaRouter tillhandahåller GLM-5.3 som z-ai/glm-5.3 till $1,26 för indata och $3,96 för utdata per miljon tokens – under de $1,40 och $4,40 som Z.ai publicerar, där modellsidan visar dessa listpriser bredvid den taxa vi fakturerar, och inget påslag läggs ovanpå det vi betalar leverantören. Samma OpenAI-kompatibla endpoint tillhandahåller Qwen 3.8-familjen, Qwen3.8-Max, Qwen3.8-Flash och Qwen3.8-27B, tillsammans med närmare 200 andra modeller, med automatisk failover när en leverantörsväg försämras och en routing-DSL som låter dig uttrycka substitutionspolicyn explicit i stället för att redigera en modellsträng i applikationskoden. När en leverantör ändrar sin taxa hamnar ändringen på din nyckel samma dag, eftersom det inte finns något marginalager som den kan fastna bakom.

Det som OrcaRouter inte erbjuder är Qwen 4 Max eller någon Qwen 4-nivå. Katalogen har ingen post för familjen, vilket är det korrekta läget för en modell som annonserades på en scen och ännu inte har släppts. Qwen 4 Max kommer att vara nåbar, när den nu alls är nåbar, via leverantörens eget API och flera tredjepartsplattformar. Fram till dess är den Qwen-modell i den här jämförelsen som du faktiskt kan anropa Qwen3.8-Max, och den finns i samma katalog som GLM-5.3 — vilket gör den levande versionen av den här matchen till ett beslut om routningspolicy snarare än ett inköpsbeslut.

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

Vad licensfrågan faktiskt avgör

GLM-5.3 är billigare på båda axlarna, dess kontextfönster och utdatatak matchar Qwen-flaggskeppets, dess modalitetsgränser är dokumenterade i stället för att lämnas åt gissningar, och den betjänar trafik redan idag. Qwen 4 Max har en konferensslot och ett nivånamn, och den enda delen av Qwen 4-färdplanen med en förutsägbar leverans är 27B-nivån.

Beslutet som överlever lanseringen är inte vilken modell som är bättre. Det är huruvida du behöver äga saken. Om du behöver självhosta, finjustera eller modifiera kommer flaggskeppsvikterna från endera labbet med villkor som du bör läsa innan du bygger en verksamhet på dem, och den lilla öppna nivån är där de tillåtande alternativen historiskt har funnits. Om du behöver anropa en modell är GLM-5.3 det billigare svaret i dag för textarbete, Qwen3.8-Max är svaret om du behöver bild- eller videoinmatning, och båda är en slutpunkt och en faktura bort. Ta upp flaggskeppsfrågan igen när Alibaba publicerar ett modellkort, och läs licensen före benchmarktabellen.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Jämförda i den här artikeln2

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen