Титульная карточка с текстом «Qwen3.8-27B», подзаголовком «Открытые веса выходят на этой неделе», надзаголовком «Alibaba Qwen — что мы знаем на данный момент» и строкой даты «Неделя 10 августа 2026 года» рядом с иконкой открытой коробки и иконкой календаря.
Guides & Insights

Qwen3.8-27B с открытыми весами: Max вышел, а 27B — нет. Что мы знаем сейчас

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

13 августа 2026 года неделя открытых весов, которую Alibaba обещала для своего поколения Qwe​n3.8, разделилась надвое. Веса флагмана класса Max — Qwen3.8-2.4T-A95B, модель с 2,4 триллиона параметров и разреженной архитектурой смеси экспертов, а также первый выпуск уровня Max от Q​wen, который вообще можно было скачать, — действительно вышли на Hugging Face и ModelScope, о чём было объявлено поздно вечером накануне через сообщество ModelScope. Меньшая модель, о которой эта страница, Qwen3.8-27B, не вышла: обещанная на ту же неделю 10 августа, она до сих пор не имеет официального репозитория, карточки модели, файла лицензии или собственных бенчмарков, и сторонние трекеры теперь описывают её релиз как задержанный без указания новой даты. Вопрос, на который должна была ответить эта страница «что нам известно на данный момент», — «когда же на самом деле выйдет 27B?» — превратился в два: почему сначала вышли веса Max, и что случилось с 27B?

Это по-прежнему материал о том, что нам известно на данный момент, а не обзор. Qwen3.8-Max, флагманская модель API, доступна с 3 августа по цене $2/$6 за миллион токенов; её базовая модель с открытыми весами, Qwen3.8-2.4T-A95B, стала доступна для скачивания 13 августа; а веса Qwen3.8-27B всё ещё не опубликованы. Каждое утверждение ниже помечено соответствующим образом: подтверждённое, заявленное вендором или оценённое сообществом.

Сигнал, и что неделя на самом деле принесла

«Ранним сигналом стал пост в X от @kimmonismus, который отметил «следующую неделю» как ту, за которой стоит наблюдать: «Q​wen-3.8 27b — Grok 4.6», при этом Astra заметно отсутствовала в списке. Половина той недели, отведённая Grok, вышла 12 августа. Половина, отведённая Q​wen, разделилась надвое. Пост передавал настроение людей, которые профессионально следят за релизами моделей: релиз открытых весов Qwe​n3.8 был главным событием в календаре, и неделя наступила, а детали всё ещё не были окончательно определены. Неделю спустя детали частично прояснились: один из двух обещанных релизов открытых весов состоялся, и это был не тот, который был назван в посте.»

Что подтверждено

• Семейство реально и официально анонсировано. Alibaba представила семейство базовых моделей Qwen3.8 3 августа 2026 года, после предварительной итерации в середине июля.

• Qwen3.8-Max вышел в тот же день. Флагман API — модель смеси экспертов с 2,4 триллиона параметров, примерно 95 млрд активных параметров, окном контекста в 1 млн токенов и поддержкой ввода текста, изображений и видео — стал доступен на Q​wen API по цене $2/$6 за миллион токенов. Он также доступен через OrcaRouter по той же цене с нулевой наценкой.

• Открытые веса Max были выпущены 13 августа. Qwen3.8-2.4T-A95B — базовая модель, на которой построен API Qwen3.8-Max, — стала доступна для загрузки на Hugging Face и ModelScope, вместе с FP8-квантизованной версией. Это первый в истории релиз открытых весов уровня Max от Qwen. Загружаемая модель поддерживает только текст, с принудительно включённым режимом мышления, имеет нативный контекст в 256K токенов, расширяемый примерно до 1M, и разворачивается на SGLang, vLLM и TokenSpeed.

• Qwen3.8-27B — меньшая модель семейства с открытыми весами, которая до сих пор не выпущена. Alibaba позиционировала её как реалистичный путь для локального и on-premise развёртывания и обязалась выложить её веса на Hugging Face и ModelScope наряду с весами Max. По состоянию на 13 августа официального репозитория Qwen3.8-27B всё ещё нет. Обязательство было реальным, но поставка так и не состоялась.

• Первый независимый результат для этого поколения существует. Artificial Analysis оценивает Qwen3.8-Max с индексом интеллекта 56 примерно в $1.14 за задачу — действительно хорошо, с оговорками, которые несёт любой флагман, вышедший несколько дней назад.

Что мы на самом деле знаем о 27B

Честное резюме: «Qwen3.8-27B» — это пока в основном название и количество параметров. Подтверждённые факты: это модель примерно с 27 миллиардами параметров, представитель поколения Qwe​n3.8 с открытыми весами, рассчитанная на работу с одним GPU и в локальной инфраструктуре, а не на кластер из сотен GPU. Дэниел Хан из Unsloth сообщает, что после выхода она должна поместиться примерно в 17 ГБ видеопамяти — одна полупрофессиональная видеокарта.

Всё остальное не подтверждено. Alibaba не публиковала, является ли 27B плотной моделью или смесью экспертов, каково её окно контекста, какие модальности она принимает и какие у неё собственные показатели бенчмарков. Что изменилось на этой неделе — это сроки: Max и 27B были обещаны на одну и ту же неделю, а прибыл только Max. Сторонние трекеры теперь сообщают, что 27B задерживается, без новой даты — это интерпретация сообщества, а не официальное заявление Alibaba, и возможно, что репозиторий всё же появится до того, как обещанная неделя полностью закончится. Но на момент написания официальная организация Q​wen на Hugging Face не содержит Qwen3.8-27B, а те несколько репозиториев «Qwen3.8-27B-FP8», «-GGUF» и «-MLX», которые всплывают в поиске, — это карточки-заглушки сообщества с однозначным числом загрузок, а не официальный релиз.

Полезной отправной точкой по-прежнему является 27B предыдущего поколения: Qwen3.5-27B — открытая плотная модель с окном контекста 32K. Это разумная нижняя граница для того, что должна превзойти Qwen3.8-27B, и напоминание о том, что модели класса Qwen 27B исторически создавались для работы на оборудовании, которым действительно владеет разработчик.

Max — точка отсчета для того, что может унаследовать 27B

A comparison scoreboard for Qwen3.8-Max and Qwen3.8-27B, contrasting the Max's 2.4T MoE total parameters, ~95B active params, 1M-token context, / pricing and AA Index 56 with the 27B's ~27B params, TBD context, TBD architecture, self-host and no independent score yet.

27B не сравняется с абсолютным потолком Max, но показатели Max — теперь опубликованные в настоящей карточке модели — задают ожидания относительно того, как выглядят улучшения этого поколения. В собственных оценках Alibaba модели с открытыми весами Qwen3.8-2.4T-A95B набирает 93.0 на PaperBench, 86.1 на OSworld-Verified, 91.5 на параметрическом CAD, 67.7 на SWE-bench Pro и 86.6 на Terminal-Bench 2.1, при этом вендор заявляет о паритете с Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol и Gemini 3.1 Pro. Это цифры, предоставленные вендором, опубликованные в материалах релиза и ещё не воспроизведённые независимой лабораторией. Агентный прирост, о котором заявляли при запуске API — рост FrontierSWE с 40.7 до 73.5 в рамках одного поколения — переносится в те же материалы релиза. Если хотя бы часть этого улучшения дойдёт до 27B, это переопределит то, что означает «хорошая локальная модель для кодинга» в её классе.

Один нюанс, который стоит запомнить: загружаемый Max не идентичен API Max. Qwen3.8-2.4T-A95B — это модель только с текстом, с принудительно включённым режимом размышлений, тогда как Qwen3.8-Max API добавляет ввод изображений, режим без размышлений и контекст по умолчанию на 1 млн токенов. Этот разрыв — как раз то, что, вероятно, унаследует 27B, — и об этом стоит помнить, когда вы читаете заголовки о бенчмарках «Qwe​n3.8», не проверяя, какой вариант в них описывается.

Цена — вот в чём Max наиболее убедителен: $2/$6 за миллион токенов во всём контексте из 1M токенов через API, без надбавки за длинные промпты. Это агрессивно для передового API, и это важно для расчёта маршрутизации — при таких цифрах поколение 3.8 становится вариантом для задач, которые раньше по умолчанию использовали более дорогие флагманы.

Что вообще может запустить это?

A hardware reality-check card for Qwen3.8-27B showing community-projected VRAM requirements: Q4_K_M ~16GB, Q3_K_M ~13GB, Q6_K ~21GB, FP8 ~27GB, full precision H100 80GB, with a footer noting these are community projections based on Qwen 3.6-27B quant sizes.

Для 27B Alibaba до сих пор не опубликовала аппаратные требования, поэтому цифры, которые ходят в сообществе, остаются проекциями сообщества, основанными на таблице квантования Q​wen 3.6-27B — это оценки, а не спецификации. Рабочие диапазоны, на которые большинство людей ориентируется при планировании, не изменились:

• квант Q4_K_M, ~16 ГБ видеопамяти — RTX 4090 или эквивалент, золотая середина, на которую будет ориентироваться большинство локальных разработчиков.

• Q3_K_M quant, ~13GB VRAM — поместится на карту с 12GB видеопамяти, например RTX 3060, при сниженном качестве.

• Q6_K quant, ~21 ГБ VRAM — почти без потерь на видеокартах с 24 ГБ.

• Инференс FP8, ~27 ГБ видеопамяти — одна L40S, согласно более раннему прогнозу, для инференса производственного уровня.

• Полная точность, H100 80GB — путь эталонного качества, и не то, что большинство команд станет запускать.

Новый нюанс: «теперь поколение Qwen3.8 можно запускать у себя» — это правда, но не для той модели, на которую все рассчитывали. Открытые веса Max — это совершенно другой класс оборудования: полноточная модель в BF16 весит примерно 4,9 ТБ, а 1-битная послойная селективная квантизация от Unsloth сжимает её примерно до 397 ГБ — запустить можно, но только при суммарном объёме RAM и VRAM не менее 410 ГБ. Это серьёзная инфраструктура, а не просьюмерская видеокарта. Именно этот пробел и должна заполнить 27B, и именно её продолжающееся отсутствие — причина того, что локального пути на одной GPU для этого поколения до сих пор не существует.

Вопрос о лицензии: Max только что установил прецедент.

Вопрос о лицензии для 27B всё ещё остаётся без ответа, но то, «как это будет выглядеть», уже не просто догадка. Открытые веса Max распространяются под пользовательской лицензией с пометкой «qwen3.8-max» — а не Apache 2.0. Как сообщается в карточке модели, она в целом бесплатна для коммерческого использования и хостинга, однако на масштабе появляются дополнительные требования: продукты с более чем 100 миллионами месячных активных пользователей или доходом более 20 миллионов долларов в месяц должны отображать название модели, а компаниям с годовой выручкой более 50 миллионов долларов, предоставляющим услуги model-as-a-service или сервисы ИИ-ассистентов, требуется отдельное лицензирование. Распространяемое утверждение о том, что лицензия запрещает использование в США, ЕС, Великобритании и Корее, является ложным — лицензия не содержит территориальных ограничений.

Что касается конкретно 27B, лицензия пока не названа. Но Max вышел под специальной лицензией Q​wen, а не под Apache 2.0, что делает предположение об Apache 2.0 для сестринской модели тоже неоправданным. Старая лицензия Tongyi Qianwen — с её пунктом про 100 миллионов MAU — это не то, что получил Max; у Max новая лицензия с уровнями, зависящими от масштаба. Прочитайте файл LICENSE в самом репозитории, прежде чем строить планы на её основе, и ожидайте, что лицензия для 27B будет определена только когда выйдет её репозиторий.

Тайминг тулчейна: поддержка с первого дня только что была доказана

Инференс-движки продвигались так же быстро, как и ожидалось, — для выпущенной модели. Qwen3.8-2.4T-A95B вышел с рабочей поддержкой в SGLang, vLLM и TokenSpeed, что и означает «доступен через API почти сразу» для крупного релиза с открытыми весами. Для 27B те же движки с наибольшей вероятностью станут первыми, как только появится его репозиторий, а поддержка Max с первого дня позволяет обоснованно ожидать, что 27B унаследует эту поддержку. Квантования GGUF и AWQ от сообщества обычно отстают на одну-две недели, так что опыт в стиле Ollama — «скачай и запусти» — в день выхода 27B, скорее всего, по-прежнему будет недоступен; ручная настройка vLLM или llama.cpp, вероятно, станет локальным путём на первых порах.

Что ещё неизвестно

Честный материал об утечке останавливается на том, что действительно находится в открытом доступе, и эта граница стала шире, чем неделю назад, в одном направлении и уже в другом: вопросы Max получили ответы, а вопросы 27B — нет.

• Новая дата выхода.«Неделя 10 августа» была обязательством; неделя почти закончилась, а репозиторий так и не появился. Сторонние трекеры сообщают о задержке без новой даты, но Alibaba не сделала официального заявления.

• Архитектура. Dense или MoE для 27B, а если MoE, то количество активных параметров.

• Технические характеристики. Контекстное окно, модальности, лимиты вывода, режим рассуждений.

• Бенчмарки. У 27B нет официальных результатов и независимой оценки.

• Лицензия. Не определено, пока не выйдет репозиторий 27B; пользовательская лицензия Max — прецедент, с которым следует сверяться.

• Риск зеркал.Проблема с заглушками теперь видна в реальном использовании — в сообществе существуют карточки «Qwen3.8-27B-FP8», «-GGUF» и «-MLX» без единого официального файла. Пока официальная организация Qwen не опубликует репозиторий, загружайте файлы только со страницы официальной организации.

Что это значит для разработчиков

Практическое разделение поколения Qwen3.8 теперь трёхстороннее, а не двустороннее. Если вам нужен передовой API уже сегодня, Qwen3.8-Max доступен через OrcaRouter по опубликованной провайдером цене $2/$6, передаваемой без наценки — вы видите ту цену, которую установил Alibaba. Если вы хотите разместить модель уровня Max самостоятельно, открытые веса уже доступны для загрузки, но вам понадобится оборудование для модели полной точности объёмом примерно 4,9 ТБ или квантованной версии объёмом примерно 397 ГБ. А если вам нужно локальное развёртывание на одной GPU, которое ожидалось от этого поколения, вы всё ещё ждёте Qwen3.8-27B, которая так и не вышла. Один ключ, совместимый с OpenAI, уже покрывает API, и когда хостинг 27B устаканится, этот же ключ сможет маршрутизировать к ней запросы.

Screenshot of the OrcaRouter model page for Qwen3.8-Max, showing model id qwen/qwen3.8-max, .00/1M input token pricing, a 1M-token context window, and an OpenAI-compatible Python code sample.

Это последнее положение — более общий тезис, и именно непроверенный, задерживающийся выпуск модели с открытыми весами служит его испытательным примером. Модель, которая ещё даже не выпущена, не имеет послужного списка, независимого набора бенчмарков и истории инцидентов — а когда она наконец появится, она будет совершенно новой. Маршрутизация позволяет попробовать её без риска для пользовательского сценария: отправляйте ей трафик, который может пережить неожиданность, автоматически переключайтесь на проверенную модель, когда она ведёт себя некорректно, и переключайте на неё всю нагрузку, как только она заслужит доверие. Маршрутизирующий слой также делает честным расчёт цен: когда Alibaba снижает цену модели, к которой вы обращаетесь через единую точку доступа, изменение вступает в силу в тот же день, поскольку цена из прайс-листа проходит напрямую.

Что посмотреть

• Появится ли репозиторий 27B вообще. Появление в списке под официальной организацией Q​wen на Hugging Face или ModelScope — это событие, которое положит конец задержке, — а неделя 10 августа почти закончилась без него.

• Лицензионный файл 27B. Max поставлялся со специальной многоуровневой лицензией, а не с Apache 2.0. Будет ли 27B следовать этому прецеденту — самый значимый пункт его предстоящего анонса.

• Архитектура и длина контекста. Плотная архитектура против MoE и окно контекста определяют, для чего предназначена модель 27B.

• Первый независимый бенчмарк. Max задал планку, набрав 56 баллов в Artificial Analysis Intelligence Index; первая внешняя оценка 27B покажет, какая часть преимуществ поколения сохранится при потребительском размере.

• Охват инструментария.Унаследует ли 27B поддержку SGLang/vLLM/TokenSpeed с первого дня, как Max, и насколько быстро появятся квантования от сообщества.

Часто задаваемые вопросы

Qwen3.8-27B уже выпущен?

Нет. Alibaba объявила об этом 3 августа 2026 года и обязалась разместить веса на Hugging Face и ModelScope на неделе с 10 августа, но по состоянию на 13 августа официального репозитория Qwen3.8-27B, карточки модели или лицензии нет. Открытые веса класса Max — Qwen3.8-2.4T-A95B — вышли 13 августа; 27B — нет, и сторонние трекеры сообщают о задержке без указания новой даты.

Какое оборудование мне нужно, чтобы запустить Qwen3.8-27B?

Не подтверждено, но по оценкам сообщества на основе таблицы квантования Qwen 3.6-27B, Q4_K_M занимает примерно 16 ГБ видеопамяти (RTX 4090), Q3_K_M — примерно 13 ГБ (карты на 12 ГБ), Q6_K — примерно 21 ГБ (карты на 24 ГБ), а FP8-сервинг — примерно 27 ГБ (одна L40S). Дэниел Хан из Unsloth сообщает примерно о 17 ГБ на момент релиза. Воспринимайте это как оценки, пока официальная карточка модели не опубликует рекомендации по оборудованию.

Доступна ли Qwen3.8-27B через OrcaRouter?

Пока нет. Qwen3.8-27B — это модель с открытыми весами и самостоятельным размещением, и её сегодня нет на платформе. Флагман того же семейства — Qwen3.8-Max — уже доступен через OrcaRouter по цене провайдера $2/$6 за миллион токенов с 0% наценкой, и когда вопрос с размещением 27B решится, её можно будет добавить к тому же ключу, совместимому с OpenAI.

Стоит ли мне ждать Qwen3.8-27B или использовать Qwen3.8-Max сегодня?

Это зависит от того, где выполняется рабочая нагрузка. Если вам нужен передовой API прямо сейчас, Qwen3.8-Max доступен и имеет агрессивную цену — $2/$6 за миллион токенов. Если вы хотите развернуть Max-класс самостоятельно уже сегодня, Qwen3.8-2.4T-A95B можно скачать, но ему требуется серьёзное оборудование — примерно 4,9 ТБ в полной точности или около 397 ГБ в квантованном виде, с суммарным объёмом RAM и VRAM более 410 ГБ. Если вам нужна локальная или on-premise модель на одной потребительской видеокарте, Qwen3.8-27B — это та, которую стоит подождать: это реалистичный путь для самостоятельного размещения в этом поколении, и её выход теперь остаётся открытым вопросом, а не фиксированной датой.

Обещанная неделя почти подошла к концу, и половина обещанного так и не появилась. Qwen3.8-2.4T-A95B доступна для скачивания, лицензирована и готова к развёртыванию; Qwen3.8-27B подтверждённо существует, приверженность открытым весам сохраняется, но репозитория, лицензии, бенчмарков и новой даты по-прежнему нет. Следите, появится ли репозиторий 27B до конца обещанной недели, что будет написано в её лицензионном файле рядом с лицензией Max, и как её оценят первые независимые тесты. Эти три сигнала покажут, обычный ли это двухэтапный выпуск открытых весов, где меньшая модель ещё впереди, или задержка, которую стоит заложить в планы.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно