Karta tytułowa hero dla „Qwen 4 Max vs GLM-5.3” z podtytułem „Otwarte wagi, niestandardowe licencje i wariant, który faktycznie trafia do sprzedaży”, trzy owalne plakietki z napisami „$1.26 i $3.96”, „tylko tekst vs multimodalność” oraz „27B to ten, na którego warto zwrócić uwagę”, wiersz stopki o treści „Alibaba ogłosiła 22 września 2026 r.; GLM-5.3 wpisano 18 sierpnia 2026 r.” i logo OrcaRouter w prawym dolnym rogu.
Engineering & Research

Qwen 4 Max vs GLM-5.3: otwarte wagi, niestandardowe licencje i poziom, który faktycznie zostaje wydany

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Qwen 4 Max został zapowiedziany na konferencji Yunqi w Hangzhou 22 września 2026 r. jako flagowy model linii czterech modeli, która obejmuje także Qwen 4 Flash, Qwen 4 Plus oraz wariant Qwen 4 27B z otwartymi wagami. GLM-5.3 od Z.ai widnieje od 18 sierpnia 2026 r. jako model wyłącznie tekstowy, z oknem kontekstu wynoszącym 1 milion tokenów i górnym limitem 128 000 tokenów wyjściowych; w naszym katalogu kosztuje 1,26 USD za milion tokenów wejściowych i 3,96 USD za milion tokenów wyjściowych, podczas gdy Z.ai publikuje stawki cennikowe 1,40 USD i 4,40 USD. Oba laboratoria wywodzą się z tradycji otwartych wag i oba sprzedają obecnie modele klasy frontier przez hostowane API, więc typowe przeciwstawienie zamknięte kontra otwarte nie ma tu zastosowania. Osią, która rzeczywiście ma zastosowanie, jest ta, której nikt nie umieszcza w tabeli porównawczej: co tak naprawdę dopuszcza licencja i na którym wariancie w każdej rodzinie wolno robić coś ciekawego.

Dwa laboratoria, dwie odpowiedzi na to samo pytanie

Alibaba i Z.ai to dwa najbardziej konsekwentne podmioty publikujące otwarte wagi wśród laboratoriów z pogranicza czołówki i przyjęły odmienne postawy wobec tego, jak duża część tej otwartości przetrwa w segmencie flagowym.

Firma Alibaba opublikowała wagi swojego największego modelu z generacji Qwen 3.8 — Qwen3.8-2.4T-A95B, w BF16 i FP8 — 12 sierpnia 2026 r. Opublikowała je na własnej licencji Qwen, a nie Apache 2.0. Ta różnica jest tu kluczowa: wagi istnieją, co oznacza, że dostrajanie, kwantyzacja i samodzielne hostowanie są możliwe w sposób, w jaki nigdy nie będą możliwe w przypadku modelu zamkniętego, ale warunki są własne Alibaby i nie są tym permisywnym domyślnym standardem, który zwykle sugeruje sformułowanie „otwarte wagi”.

Linia GLM od Z.ai pochodzi z laboratorium o rodowodzie otwartych wag, a model flagowy nie jest już od tej zasady wyjątkiem. Wagi samego GLM-5.3 opublikowano 28 sierpnia 2026 r. — flagowiec o 743 miliardach parametrów, w 141 shardach formatu safetensors — na podstawie własnej licencji, którą Z.ai napisało dla niego, a nie na licencji MIT. Warunki są w przybliżeniu zezwoleniem w stylu MIT z dołączonym warunkiem przeglądu bezpieczeństwa dla firm oferujących modele jako usługę, których przychody przekraczają wysoki próg. Warto zwrócić uwagę, co to oznacza dla tej rodziny: GLM-5.2 i GLM-5.3-Flash mają licencję MIT, a flagowiec nie.

Zgodnie z podanym wykazem GLM-5.3 to model wyłącznie tekstowy z opublikowanym oknem kontekstu, opublikowanym limitem wyjścia oraz udokumentowanym użyciem narzędzi, trybem JSON i rozumowaniem.

Zestaw oba obok siebie, a praktyczny kontrast jest taki:

• Flagowe wagi — flagowy Qwen 3.8 opublikowany na niestandardowej licencji Qwen w porównaniu z wagami GLM-5.3 opublikowanymi 28 sierpnia 2026 r. na niestandardowej licencji Z.ai

• Cena wejściowa — Qwen3.8-Max 2,00 USD za 1 mln tokenów w porównaniu z GLM-5.3 1,26 USD za 1 mln tokenów w naszym katalogu, 1,40 USD na własnej liście Z.ai

• Cena za tokeny wyjściowe — Qwen3.8-Max 6,00 USD za 1 mln tokenów w porównaniu z GLM-5.3 3,96 USD za 1 mln tokenów w naszym katalogu, 4,40 USD na własnej liście Z.ai

• Kontekst — Qwen3.8-Max 1 mln tokenów kontra GLM-5.3 1 mln tokenów

• Górny limit wyjścia — Qwen3.8-Max 128K tokenów versus GLM-5.3 128K tokenów

• Modalność — Qwen3.8-Max: dane wejściowe tekstowe, obrazowe i wideo w porównaniu z GLM-5.3 obsługującym wyłącznie tekst, co zostało udokumentowane

• Tagi możliwości — Qwen3.8-Max (wizja, narzędzia, JSON i rozumowanie) kontra GLM-5.3 (narzędzia, JSON i rozumowanie)

• Qwen 4 Max — ogłoszony 22 września 2026, bez ceny, bez kontekstu, bez wag, bez daty w przeciwieństwie do GLM-5.3, który został wydany i obsługuje ruch

Wiersz multimodalny odpowiada za różnicę w cenie. Flagowy model Qwen przyjmuje dane wejściowe w postaci obrazu i wideo i pobiera 2,00 USD za wejście i 6,00 USD za wyjście; GLM-5.3 przyjmuje tekst i pobiera 1,26 USD oraz 3,96 USD. Jeśli Twoje obciążenie jest tekstowe, płacisz za dodatek związany z enkoderem wizji, którego nigdy nie używasz, i to jest najbardziej konkretny powód, dla którego specjalista tylko do tekstu bije flagowy model multimodalny pod względem kosztu pracy z tekstem.

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

Poziom 27B jest tym, który o tym decyduje.

Qwen 4 Max to nagłówek, a poziom 27B to właściwa historia. Każda generacja Qwen dostarczała swój mały otwarty poziom na warunkach, które pozwalają ludziom robić różne rzeczy, a dowody z dalszego obiegu są jednoznaczne: w ciągu kilku dni od pojawienia się wag Qwen 3.8 27B ekosystem zdążył wytworzyć konwersje MLX, kwantyzacje NVFP4 i nieocenzurowane fine-tuny, z których żadne nie wymagało niczyjej zgody. To właśnie daje permisywne wydanie małego modelu i jest to forma dystrybucji, której nie dorówna żadne hostowane API.

Flagowy segment to inna sprawa. Model o 2,4 biliona parametrów wydany na niestandardowej licencji jest otwarty w tym sensie, że bajty można pobrać, a zamknięty w tym sensie, że to, co można z nimi zrobić, określa wydawca. Obie te rzeczy są prawdziwe jednocześnie, a ogłoszenie Qwen 4 nie zmieniło żadnej z nich. Jeśli poziom Qwen 4 27B pójdzie śladem swoich poprzedników, będzie to wydanie, które ma znaczenie dla największej liczby osób, a także wydanie z najbardziej przewidywalną datą dostarczenia, ponieważ małe otwarte poziomy są najłatwiejszą rzeczą do ukończenia na mapie drogowej.

Co sprawia, że porównanie wraca do czegoś użytecznego. GLM-5.3 to model hostowany w publikowanej cenie, z udokumentowanym zestawem możliwości, i jest już dostępny. Qwen 4 Max to nazwa poziomu. Jeśli chcesz, by argument o otwartości był konkretny, a nie filozoficzny, modelem, na który warto poczekać, jest 27B, a nie Max.

Warstwa routingu to miejsce, w którym kwestia licencji przestaje mieć znaczenie.

Istnieje wersja tej decyzji, która całkowicie pozwala uniknąć kwestii licencji, i warto uczciwie przyznać, że jest to realna opcja, a nie kompromis. Jeśli Twoim wymaganiem jest wywoływanie modelu, a nie posiadanie go, licencja na wagi jest nieistotna, a warunki, które mają znaczenie, to cena, opóźnienie i zachowanie w przypadku awarii.

OrcaRouter oferuje GLM-5.3 jako z-ai/glm-5.3 w cenie 1,26 USD za wejście i 3,96 USD za wyjście za milion tokenów — poniżej 1,40 USD i 4,40 USD, które publikuje Z.ai, a strona modelu pokazuje te ceny katalogowe obok stawki, według której rozliczamy, bez doliczania marży ponad to, co płacimy dostawcy. Ten sam punkt końcowy zgodny z OpenAI obsługuje rodzinę Qwen 3.8, Qwen3.8-Max, Qwen3.8-Flash i Qwen3.8-27B, wraz z blisko 200 innymi modelami, z automatycznym przełączaniem awaryjnym, gdy ścieżka dostawcy zawodzi, oraz DSL routingu, który pozwala wyrazić politykę podstawień jawnie, zamiast edytować ciąg modelu w kodzie aplikacji. Gdy sprzedawca zmieni swoją stawkę, zmiana trafia na twój klucz tego samego dnia, ponieważ nie ma warstwy marży, za którą mogłaby utknąć.

Tym, czego OrcaRouter nie oferuje, jest Qwen 4 Max ani żaden wariant z rodziny Qwen 4. W katalogu nie ma wpisu dla tej rodziny, co jest właściwym stanem dla modelu, który został ogłoszony ze sceny, a jeszcze nie został udostępniony. Qwen 4 Max będzie dostępny — o ile w ogóle będzie — przez własne API dostawcy i kilka platform firm trzecich. Do tego czasu model Qwen w tym porównaniu, który faktycznie można wywołać, to Qwen3.8-Max, i znajduje się on w tym samym katalogu co GLM-5.3 — co sprawia, że bieżąca wersja tego starcia jest decyzją dotyczącą polityki routingu, a nie decyzją zakupową.

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

Co tak naprawdę rozstrzyga kwestia licencji

GLM-5.3 jest tańszy w obu wymiarach, jego okno kontekstowe i górny limit generowania odpowiadają flagowemu modelowi Qwen, jego ograniczenia modalności są udokumentowane, a nie pozostawione domysłom, i już dziś obsługuje ruch. Qwen 4 Max ma slot konferencyjny i nazwę poziomu, a jedyną częścią roadmapy Qwen 4 z przewidywalnym terminem dostarczenia jest poziom 27B.

Decyzja, która przetrwa premierę, nie dotyczy tego, który model jest lepszy. Chodzi o to, czy musisz mieć tę rzecz na własność. Jeśli potrzebujesz hostować model u siebie, dostrajać go lub modyfikować, flagowe wagi z któregokolwiek z laboratoriów wiążą się z warunkami, które powinieneś przeczytać, zanim zbudujesz na nich biznes, a to w małej otwartej klasie modeli historycznie żyły najbardziej permisywne opcje. Jeśli potrzebujesz wywoływać model, GLM-5.3 jest dziś tańszą odpowiedzią do pracy z tekstem, Qwen3.8-Max jest odpowiedzią, jeśli potrzebujesz wejścia obrazowego lub wideo, a oba są oddalone o jeden endpoint i jeden rachunek. Wróć do pytania o flagowca, gdy Alibaba opublikuje kartę modelu, i przeczytaj licencję, zanim spojrzysz na tabelę benchmarków.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie