Заглавная карточка для «Qwen 4 Max vs GLM-5.3» с подзаголовком «Открытые веса, кастомные лицензии и уровень, который действительно выпускается», три бейджа в виде пилюль с надписями «$1.26 и $3.96», «только текст против мультимодальности» и «27B — тот, за которым стоит следить», нижняя строка «Alibaba объявила 22 сентября 2026 года; GLM-5.3 указана 18 августа 2026 года», и логотип OrcaRouter в правом нижнем углу.
Engineering & Research

Qwen 4 Max против GLM-5.3: открытые веса, собственные лицензии и уровень, который действительно выпускается

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Qwen 4 Max был представлен на конференции Yunqi в Ханчжоу 22 сентября 2026 года как флагман линейки из четырёх моделей, которая также включает Qwen 4 Flash, Qwen 4 Plus и уровень Qwen 4 27B с открытыми весами. GLM-5.3 от Z.ai числится с 18 августа 2026 года, только текст, с окном контекста в 1 миллион токенов и потолком вывода в 128 000 токенов, по цене $1,26 за миллион входных токенов и $3,96 за миллион выходных токенов в нашем каталоге — против $1,40 и $4,40 официальных тарифов, которые публикует Z.ai. Обе лаборатории происходят из традиции открытых весов, и обе теперь продают модели уровня фронтира через хостируемые API, так что обычное противопоставление «закрытые против открытых» здесь не применимо. Ось, которая действительно применима, — та, которую никто не помещает в сравнительную таблицу: что на самом деле разрешает лицензия и какой уровень в каждом семействе — тот, с которым вам разрешено делать что-то интересное.

Две лаборатории, два ответа на один и тот же вопрос

Alibaba и Z.ai — два самых последовательных издателя открытых весов среди лабораторий, близких к переднему краю, и они заняли разные позиции относительно того, насколько эта открытость сохраняется на флагманском уровне.

Поколение Qwen 3.8 от Alibaba опубликовало веса для своей самой крупной модели — Qwen3.8-2.4T-A95B, в BF16 и FP8 — 12 августа 2026 года. Оно опубликовало их под собственной лицензией Qwen, а не Apache 2.0. В этом различии вся суть: веса существуют, а значит, дообучение, квантование и самостоятельный хостинг возможны так, как они никогда не будут возможны для закрытой модели, но условия принадлежат Alibaba, и они не являются тем разрешительным вариантом по умолчанию, который обычно подразумевает фраза «открытые веса».

Линейка GLM от Z.ai происходит из лаборатории с историей открытых весов, и флагманская модель больше не является исключением из этого. Собственные веса GLM-5.3 были опубликованы 28 августа 2026 года — флагманской модели на 743 миллиарда параметров, в 141 шарде safetensors — под индивидуальной лицензией, которую Z.ai написала для неё, а не под MIT. Условия примерно представляют собой разрешение в духе MIT с прикреплённым условием проверки безопасности для компаний, предоставляющих модели как услугу, при превышении высокого порога выручки. Обратите внимание, что это означает для семейства: GLM-5.2 и GLM-5.3-Flash распространяются под MIT, а флагманская модель — нет.

Как указано, GLM-5.3 — это модель, работающая только с текстом, с опубликованным размером контекстного окна, опубликованным пределом объёма вывода, а также задокументированной поддержкой использования инструментов, режима JSON и рассуждений.

Поставьте их рядом, и практическая разница такова:

• Флагманские веса — флагманская модель Qwen 3.8, опубликованная под собственной лицензией Qwen, в сравнении с весами GLM-5.3, опубликованными 28 августа 2026 года под собственной лицензией Z.ai

• Цена за входные данные — Qwen3.8-Max $2.00 за 1 млн токенов против GLM-5.3 $1.26 за 1 млн токенов в нашем каталоге, $1.40 в собственном прайс-листе Z.ai

• Цена вывода — Qwen3.8-Max $6.00 за 1 млн токенов против GLM-5.3 $3.96 за 1 млн токенов в нашем каталоге, $4.40 — в собственном прайс-листе Z.ai

• Контекст — Qwen3.8-Max: 1M токенов против GLM-5.3: 1M токенов

• Потолок вывода — 128K токенов у Qwen3.8-Max против 128K токенов у GLM-5.3

• Модальность — Qwen3.8-Max: ввод текста, изображений и видео, тогда как GLM-5.3 — только текст, что задокументировано.

• Теги возможностей — Qwen3.8-Max: зрение, инструменты, JSON и рассуждения против GLM-5.3: инструменты, JSON и рассуждения

• Qwen 4 Max — анонсирована 22 сентября 2026 года: ни цены, ни контекста, ни весов, ни даты, тогда как GLM-5.3 уже выпущена и обслуживает трафик.

Мультимодальная строка — вот что объясняет разрыв в цене. Флагман Qwen принимает изображения и видео на входе и взимает $2,00 за вход и $6,00 за выход; GLM-5.3 принимает текст и взимает $1,26 за вход и $3,96 за выход. Если ваша рабочая нагрузка — текст, вы платите надбавку за визуальный энкодер, который никогда не задействуете, и это самая конкретная причина, по которой специализированная текстовая модель обходит мультимодальный флагман по стоимости при работе с текстом.

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

Именно уровень 27B решает это.

Qwen 4 Max — это заголовок, а 27B-уровень — это сама история. Каждое поколение Qwen выпускало свой малый открытый уровень на условиях, которые дают людям свободу действий, и свидетельства, приходящие следом, недвусмысленны: в течение нескольких дней после появления весов Qwen 3.8 27B экосистема уже произвела конвертации в MLX, квантования NVFP4 и неотцензурированные файнтюны, и ни для одного из них ничье разрешение не требовалось. Вот что даёт выпуск небольшой модели по разрешительной лицензии, и это форма распространения, с которой не сравнится ни один хостируемый API.

Флагманский уровень — это другое дело. Модель с 2,4 трлн параметров, опубликованная по особой лицензии, открыта в том смысле, что байты можно скачать, и закрыта в том смысле, что то, что вам разрешено с ними делать, определяется издателем. Оба эти факта верны одновременно, и анонс Qwen 4 не изменил ни того, ни другого. Если уровень Qwen 4 27B повторит схему своих предшественников, именно он будет релизом, важным для наибольшего числа людей, и у него же будет самая предсказуемая дата выпуска, потому что небольшие открытые уровни — самое простое, что можно довести до готовности в дорожной карте.

Что возвращает сравнение к чему-то пригодному для использования. GLM-5.3 — это размещённая модель по опубликованной цене с документированным набором возможностей, и она уже доступна. Qwen 4 Max — это название уровня. Если вы хотите, чтобы аргумент об открытости был конкретным, а не философским, модель, которую стоит ждать, — это 27B, а не Max.

Слой маршрутизации — это место, где вопрос лицензии перестаёт иметь значение.

Есть вариант этого решения, который полностью обходит вопрос лицензии, и стоит честно признать, что это реальная альтернатива, а не компромисс. Если ваша задача — вызывать модель, а не владеть ею, лицензия на веса не имеет значения, а важны цена, задержка и поведение при сбоях.

OrcaRouter предоставляет GLM-5.3 как z-ai/glm-5.3 по цене $1,26 за ввод и $3,96 за вывод за миллион токенов — ниже $1,40 и $4,40, публикуемых Z.ai, при этом на странице модели эти прайсовые ставки показаны рядом со ставкой, по которой выставляем счёт мы, и никакой наценки сверх того, что мы платим провайдеру. Тот же OpenAI-совместимый эндпоинт предоставляет семейство Qwen 3.8, Qwen3.8-Max, Qwen3.8-Flash и Qwen3.8-27B, а также около 200 других моделей, с автоматическим переключением при деградации пути провайдера и DSL маршрутизации, который позволяет явно выразить политику подстановки, вместо того чтобы редактировать строку модели в коде приложения. Когда поставщик меняет свою ставку, изменение применяется к вашему ключу в тот же день, потому что нет слоя маржи, за которым оно могло бы застрять.

То, чего нет в OrcaRouter, — это Qwen 4 Max или любая модель уровня Qwen 4. В каталоге нет записи для этого семейства, и это правильное состояние для модели, которую анонсировали со сцены, но ещё не выпустили. Qwen 4 Max будет доступен — если вообще будет — через собственный API вендора и несколько сторонних платформ. До тех пор модель Qwen в этом сравнении, которую вы действительно можете вызвать, — это Qwen3.8-Max, и она находится в том же каталоге, что и GLM-5.3, — что делает живую версию этого противостояния решением о политике маршрутизации, а не о закупке.

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

Что на самом деле решает вопрос о лицензии

GLM-5.3 дешевле по обеим осям, его окно контекста и потолок вывода совпадают с флагманом Qwen, ограничения по модальностям задокументированы, а не оставлены на домысливание, и он уже обслуживает трафик. У Qwen 4 Max есть слот на конференции и название уровня, а единственная часть дорожной карты Qwen 4 с предсказуемым выпуском — это уровень 27B.

Решение, которое переживёт запуск, — не то, какая модель лучше. А то, нужно ли вам владеть самим продуктом. Если вам нужно развернуть у себя, дообучить или модифицировать, флагманские веса из любой из лабораторий идут с условиями, которые стоит прочитать, прежде чем строить на них бизнес, а малый открытый уровень — это то место, где исторически жили разрешительные варианты. Если вам нужно вызывать модель, GLM-5.3 — сегодня более дешёвый ответ для работы с текстом, Qwen3.8-Max — ответ, если вам нужен ввод изображений или видео, и до обоих — один эндпоинт и один счёт. Вернитесь к вопросу о флагмане, когда Alibaba опубликует карточку модели, и прочитайте лицензию прежде, чем таблицу бенчмарков.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно