Титульная карточка-баннер для «Qwen 4 Max анонсирован на Apsara 2026» с подзаголовком «Что Alibaba подтвердила, а что — нет», тремя бейджами-пилюлями с текстом «предпросмотр 4 уровней», «0 опубликованных характеристик» и «22 сентября 2026», а также логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

Qwen 4 Max анонсирован на Apsara 2026: что Alibaba подтвердила, а что — нет

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Конференция Yunqi в Ханчжоу — конференция Apsara — стала площадкой, где 22 сентября 2026 года показали четыре модели, которые ещё не выпущены. Руководитель направления LLM в лаборатории Лю Да Ихэн представил на сцене Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus и Qwen 4 27B, описал это семейство как обучаемое на архитектуре нового поколения и сказал лишь, что оно появится скоро. На момент написания этого текста ни для одной из четырёх нет карточки модели, нет открытых весов, нет идентификатора API, нет окна контекста, нет цены и нет результата бенчмарка. Новейший флагман, к которому сегодня действительно можно обратиться, — это Qwen3.8-Max, общедоступный с 3 августа 2026 года, и эта дистанция между анонсом со сцены и конечной точкой, доступной для вызова, — та часть этой истории, которую стоит внимательно прочитать.

Четыре уровня и то, чем каждый из них должен быть

Линейка Qwen от Alibaba организована в уровни возможностей начиная с поколения Qwen 3, и анонс Qwen 4 сохранил эту структуру, а не заменил её. То, что было показано на сцене, было перечнем, а не спецификацией:

• Qwen 4 Max — флагманский уровень, и именно его Alibaba противопоставляет топовой модели каждой другой передовой лаборатории

• Qwen 4 Flash — высокопроизводительный уровень, созданный для работы с чувствительными к задержкам и высоконагруженными задачами, а не для пиковой производительности рассуждений

• Qwen 4 Plus — сбалансированный средний уровень, исторически имеющий самый широкий спектр поддержки мультимодальности

• Qwen 4 27B — локальный уровень с открытыми весами, тот, который скачивают, дообучают и квантуют люди, никогда не обращающиеся к хостинговому API

• Архитектура — описывается как новое поколение и как находящаяся в процессе обучения, что не то же самое, что быть завершённой

• Основная рабочая нагрузка — агентные задачи и задачи с использованием инструментов, согласно формулировке конференции, а не чат

• Доступность — отсутствует. Ни у одного уровня нет даты выпуска, цены, контекстного окна, списка модальностей или опубликованной оценки.

За уровнем 27B стоит следить по причине, не имеющей никакого отношения к бенчмаркам. Это единственный уровень в семействе, который исторически выпускался с открытыми весами, и поколение Qwen 3.8 показало, какой объём независимой работы это открывает: в течение нескольких дней после появления весов 27B сообщество подготовило конвертации в MLX, квантования NVFP4 и нецензурированные дообученные модели. Анонсированный 27B — это обещание целой производной экосистемы, и это часть данной дорожной карты с наиболее предсказуемым выпуском.

Число в 5–10 триллионов параметров не относится к Qwen 4

Освещение конференции было небрежным в отношении одной цифры. Целевой показатель «от 5 до 10 триллионов параметров», циркулировавший вместе с новостями о Qwen 4, не является характеристикой Qwen 4 — это заявление о перспективе, касающееся последующих поколений, временного горизонта Qwen 4.5 и Qwen 5. Alibaba не указала никакого числа параметров для Qwen 4 Max, и, судя по имеющимся данным, было бы ошибкой называть какое-либо.

Это важно, потому что количество параметров — это число, на которое ориентируются читатели, и число, которое распространяется. Утверждение о 5 трлн параметров, привязанное к модели без опубликованной архитектуры, нефальсифицируемо в обоих направлениях: никто не может его подтвердить, и никто не может его исправить после того, как оно было повторено. Если на этой неделе вы увидите, что Qwen 4 Max описывают как модель с несколькими триллионами параметров, это число было позаимствовано из другого слайда.

Честно говоря, можно сказать, что предыдущий флагман — это смесь экспертов с 2,4 триллиона параметров, из которых 95 миллиардов активны на каждый токен, что подтверждено в официальной карточке модели Qwen3.8-Max и в выпуске с открытыми весами, последовавшем за ним. Каким бы ни оказался Qwen 4 Max, это тот базовый уровень, который ему предстоит превзойти, и это опубликованное, проверяемое число, а не цель из дорожной карты.

A two-column scoreboard titled "Qwen 4 Max vs the model you can call today". Left column Qwen 4 Max: Release date not given, Input price not given, Output price not given, Context window not given, Open weights not given, Benchmarks not given. Right column Qwen3.8-Max: Release date August 3 2026, Input price $2.00 per 1M tokens, Output price $6.00 per 1M tokens, Context window 1M tokens, Open weights published August 12 2026, Benchmarks vendor and independent. Footer reads "Qwen 4 Max status per Alibaba's September 22 2026 conference; Qwen3.8-Max from its published model card.", with the OrcaRouter logo bottom-right.

Архитектура — не слух: её предварительная версия уже выпущена.

Самое полезное в анонсе Qwen 4 — то, что часть архитектуры уже была выпущена под другим названием. Qwen3.8-Flash-Next был выпущен с открытым исходным кодом в конце августа 2026 года, и его карточка модели прямо обозначает его как предварительную версию архитектуры Qwen 4. Это делает его единственным конкретным доказательством, которое есть у кого-либо за пределами Alibaba, о том, как устроено семейство Qwen 4.

Это разреженная модель со 125 млрд основных параметров плюс 51 млрд параметров N-gram-эмбеддингов, активирующая примерно 6 млрд на каждом шаге инференса. Она несёт нативный контекст на 262 000 токенов, который, как указано на карточке, расширяется до 1 млн, и Alibaba сообщает, что её обучение обошлось примерно на 90 процентов дешевле, чем Qwen3.7-Plus. На карточке названы три техники:

• QSA — специфичная для Qwen схема разреженного внимания, механизм, лежащий в основе утверждения о недорогом обучении с длинным контекстом.

• Гейтированные остаточные соединения — мера стабильности для глубоких разреженных сетей

• N-граммные эмбеддинги — отдельное хранилище параметров на 51 млрд параметров, доступ к которому осуществляется посредством поиска, а не плотного вычисления

Если четыре уровня Qwen 4 унаследуют этот дизайн, интересное следствие окажется экономическим, а не архитектурным. Семейство, спроектированное для достижения качества, близкого к передовому, примерно за десятую часть стоимости обучения, — это семейство, которое можно агрессивно продавать по цене, а агрессивное ценообразование со стороны Alibaba два года было самой надёжной силой в экономике моделей с открытыми весами. Это прогноз, а не факт, и его следует обозначать именно так — но именно поэтому за этой дорожной картой стоит следить, а не отмахиваться от неё.

Что запустить, пока вы ждёте

Ничто в анонсе Qwen 4 не меняет того, что доступно на этой неделе, и честный ответ для всех, кто создаёт решения сегодня, — это поколение Qwen 3.8. Qwen3.8-Max находится в общем доступе с 3 августа 2026 года по цене $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов, единой для всего контекста в 1 миллион токенов, без надбавки за длинные промпты, а его веса были опубликованы 12 августа 2026 года как Qwen3.8-2.4T-A95B в форматах BF16 и FP8 под пользовательской лицензией Qwen. Это модель, с которой будут сравнивать уровни Qwen 4, и сегодня она обслуживает продакшен-трафик.

Если вы хотите сравнить текущее поколение Qwen с остальными передовыми моделями, не заводя отдельный аккаунт, ключ и счёт для каждой лаборатории, OrcaRouter предоставляет доступ к семейству Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash и Qwen3.8-27B — наряду с Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview и GLM 5.3 на одном OpenAI-совместимом эндпоинте. Это один API почти для 200 моделей с наценкой 0%, то есть прайс-лист провайдера передаётся без изменений, поэтому снижение цены вендором отражается на вашем ключе в тот же день, а не в следующем расчётном цикле. Когда линейка Qwen 4 действительно выйдет, именно в этом каталоге она и появится; сегодня ни одного из них там нет.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the on-page nav, the 1M token context badge, the model ID qwen/qwen3.8-max, multi-modality shown as text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the code-samples panel with the OpenAI-compatible Python import, the Public benchmarks and Community buzz blocks, and the opening line of the model description calling Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Суть

Qwen 4 Max — это настоящее анонсирование, а не реальный продукт, и обе половины этого предложения важны. Состав подтверждён: четыре уровня, архитектура нового поколения, агентная направленность и открытый 27B-уровень с открытыми весами, который будет значить больше для большего числа людей, чем флагман. Всё, что нужно для решения о покупке — цена, контекст, модальность, веса, оценки, дата — отсутствует.

Относитесь к этому как к сигналу дорожной карты с необычно хорошей доказательной базой: релиз Qwen3.8-Flash-Next бесплатно даёт предварительный обзор архитектуры, а Qwen3.8-Max даёт базовую линию действующего игрока с опубликованными весами и опубликованной ценой. Отслеживайте уровень 27B ради экосистемы, которую он создаст, и уровень Flash ради экономики пропускной способности. Не публикуйте повторно цифру в 5–10 триллионов параметров как факт о Qwen 4 и не планируйте миграцию вокруг модели, у которой нет даты релиза, — планируйте её вокруг Qwen3.8-Max и переходите, когда появится эндпоинт, на который можно перейти.

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube