
Qwen 4 Max анонсирован на Apsara 2026: что Alibaba подтвердила, а что — нет
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Конференция Yunqi в Ханчжоу — конференция Apsara — стала площадкой, где 22 сентября 2026 года показали четыре модели, которые ещё не выпущены. Руководитель направления LLM в лаборатории Лю Да Ихэн представил на сцене Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus и Qwen 4 27B, описал это семейство как обучаемое на архитектуре нового поколения и сказал лишь, что оно появится скоро. На момент написания этого текста ни для одной из четырёх нет карточки модели, нет открытых весов, нет идентификатора API, нет окна контекста, нет цены и нет результата бенчмарка. Новейший флагман, к которому сегодня действительно можно обратиться, — это Qwen3.8-Max, общедоступный с 3 августа 2026 года, и эта дистанция между анонсом со сцены и конечной точкой, доступной для вызова, — та часть этой истории, которую стоит внимательно прочитать.
Четыре уровня и то, чем каждый из них должен быть
Линейка Qwen от Alibaba организована в уровни возможностей начиная с поколения Qwen 3, и анонс Qwen 4 сохранил эту структуру, а не заменил её. То, что было показано на сцене, было перечнем, а не спецификацией:
• Qwen 4 Max — флагманский уровень, и именно его Alibaba противопоставляет топовой модели каждой другой передовой лаборатории
• Qwen 4 Flash — высокопроизводительный уровень, созданный для работы с чувствительными к задержкам и высоконагруженными задачами, а не для пиковой производительности рассуждений
• Qwen 4 Plus — сбалансированный средний уровень, исторически имеющий самый широкий спектр поддержки мультимодальности
• Qwen 4 27B — локальный уровень с открытыми весами, тот, который скачивают, дообучают и квантуют люди, никогда не обращающиеся к хостинговому API
• Архитектура — описывается как новое поколение и как находящаяся в процессе обучения, что не то же самое, что быть завершённой
• Основная рабочая нагрузка — агентные задачи и задачи с использованием инструментов, согласно формулировке конференции, а не чат
• Доступность — отсутствует. Ни у одного уровня нет даты выпуска, цены, контекстного окна, списка модальностей или опубликованной оценки.
За уровнем 27B стоит следить по причине, не имеющей никакого отношения к бенчмаркам. Это единственный уровень в семействе, который исторически выпускался с открытыми весами, и поколение Qwen 3.8 показало, какой объём независимой работы это открывает: в течение нескольких дней после появления весов 27B сообщество подготовило конвертации в MLX, квантования NVFP4 и нецензурированные дообученные модели. Анонсированный 27B — это обещание целой производной экосистемы, и это часть данной дорожной карты с наиболее предсказуемым выпуском.
Число в 5–10 триллионов параметров не относится к Qwen 4
Освещение конференции было небрежным в отношении одной цифры. Целевой показатель «от 5 до 10 триллионов параметров», циркулировавший вместе с новостями о Qwen 4, не является характеристикой Qwen 4 — это заявление о перспективе, касающееся последующих поколений, временного горизонта Qwen 4.5 и Qwen 5. Alibaba не указала никакого числа параметров для Qwen 4 Max, и, судя по имеющимся данным, было бы ошибкой называть какое-либо.
Это важно, потому что количество параметров — это число, на которое ориентируются читатели, и число, которое распространяется. Утверждение о 5 трлн параметров, привязанное к модели без опубликованной архитектуры, нефальсифицируемо в обоих направлениях: никто не может его подтвердить, и никто не может его исправить после того, как оно было повторено. Если на этой неделе вы увидите, что Qwen 4 Max описывают как модель с несколькими триллионами параметров, это число было позаимствовано из другого слайда.
Честно говоря, можно сказать, что предыдущий флагман — это смесь экспертов с 2,4 триллиона параметров, из которых 95 миллиардов активны на каждый токен, что подтверждено в официальной карточке модели Qwen3.8-Max и в выпуске с открытыми весами, последовавшем за ним. Каким бы ни оказался Qwen 4 Max, это тот базовый уровень, который ему предстоит превзойти, и это опубликованное, проверяемое число, а не цель из дорожной карты.

Архитектура — не слух: её предварительная версия уже выпущена.
Самое полезное в анонсе Qwen 4 — то, что часть архитектуры уже была выпущена под другим названием. Qwen3.8-Flash-Next был выпущен с открытым исходным кодом в конце августа 2026 года, и его карточка модели прямо обозначает его как предварительную версию архитектуры Qwen 4. Это делает его единственным конкретным доказательством, которое есть у кого-либо за пределами Alibaba, о том, как устроено семейство Qwen 4.
Это разреженная модель со 125 млрд основных параметров плюс 51 млрд параметров N-gram-эмбеддингов, активирующая примерно 6 млрд на каждом шаге инференса. Она несёт нативный контекст на 262 000 токенов, который, как указано на карточке, расширяется до 1 млн, и Alibaba сообщает, что её обучение обошлось примерно на 90 процентов дешевле, чем Qwen3.7-Plus. На карточке названы три техники:
• QSA — специфичная для Qwen схема разреженного внимания, механизм, лежащий в основе утверждения о недорогом обучении с длинным контекстом.
• Гейтированные остаточные соединения — мера стабильности для глубоких разреженных сетей
• N-граммные эмбеддинги — отдельное хранилище параметров на 51 млрд параметров, доступ к которому осуществляется посредством поиска, а не плотного вычисления
Если четыре уровня Qwen 4 унаследуют этот дизайн, интересное следствие окажется экономическим, а не архитектурным. Семейство, спроектированное для достижения качества, близкого к передовому, примерно за десятую часть стоимости обучения, — это семейство, которое можно агрессивно продавать по цене, а агрессивное ценообразование со стороны Alibaba два года было самой надёжной силой в экономике моделей с открытыми весами. Это прогноз, а не факт, и его следует обозначать именно так — но именно поэтому за этой дорожной картой стоит следить, а не отмахиваться от неё.
Что запустить, пока вы ждёте
Ничто в анонсе Qwen 4 не меняет того, что доступно на этой неделе, и честный ответ для всех, кто создаёт решения сегодня, — это поколение Qwen 3.8. Qwen3.8-Max находится в общем доступе с 3 августа 2026 года по цене $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов, единой для всего контекста в 1 миллион токенов, без надбавки за длинные промпты, а его веса были опубликованы 12 августа 2026 года как Qwen3.8-2.4T-A95B в форматах BF16 и FP8 под пользовательской лицензией Qwen. Это модель, с которой будут сравнивать уровни Qwen 4, и сегодня она обслуживает продакшен-трафик.
Если вы хотите сравнить текущее поколение Qwen с остальными передовыми моделями, не заводя отдельный аккаунт, ключ и счёт для каждой лаборатории, OrcaRouter предоставляет доступ к семейству Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash и Qwen3.8-27B — наряду с Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview и GLM 5.3 на одном OpenAI-совместимом эндпоинте. Это один API почти для 200 моделей с наценкой 0%, то есть прайс-лист провайдера передаётся без изменений, поэтому снижение цены вендором отражается на вашем ключе в тот же день, а не в следующем расчётном цикле. Когда линейка Qwen 4 действительно выйдет, именно в этом каталоге она и появится; сегодня ни одного из них там нет.

Суть
Qwen 4 Max — это настоящее анонсирование, а не реальный продукт, и обе половины этого предложения важны. Состав подтверждён: четыре уровня, архитектура нового поколения, агентная направленность и открытый 27B-уровень с открытыми весами, который будет значить больше для большего числа людей, чем флагман. Всё, что нужно для решения о покупке — цена, контекст, модальность, веса, оценки, дата — отсутствует.
Относитесь к этому как к сигналу дорожной карты с необычно хорошей доказательной базой: релиз Qwen3.8-Flash-Next бесплатно даёт предварительный обзор архитектуры, а Qwen3.8-Max даёт базовую линию действующего игрока с опубликованными весами и опубликованной ценой. Отслеживайте уровень 27B ради экосистемы, которую он создаст, и уровень Flash ради экономики пропускной способности. Не публикуйте повторно цифру в 5–10 триллионов параметров как факт о Qwen 4 и не планируйте миграцию вокруг модели, у которой нет даты релиза, — планируйте её вокруг Qwen3.8-Max и переходите, когда появится эндпоинт, на который можно перейти.

Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
