Титульная карточка для статьи «Qwen3.8-27B Release Date», показывающая календарь с отметкой недели 10 августа 2026 года как обещанного окна выхода, с бейджем «status: pending», подзаголовком, указывающим на анонс от 3 августа 2026 года, и графикой со слоями модели.
Guides & Insights

Дата выхода Qwen3.8-27B: всё, что мы знаем на данный момент

Автор

Jim Song

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Alibaba пообещала открытые веса Qwen3.8-27B на неделю 10 августа 2026 года, и этот срок прошёл. Теперь у задержки есть конкретная цель: официальная страница Qwen на ModelScope показывает обратный отсчёт до полуночи 15 августа 2026 года — 00:00 по JST, согласно отчёту PC Watch от 13 августа о тизере. На сегодняшний день веса так и не появились в официальной организации Qwen на Hugging Face, но вопрос о дате релиза впервые получил ответ с момента анонса 3 августа. Вот что подтверждено, что ещё не проверено и за чем стоит следить.

Что подтверждено?

Alibaba анонсировала поколение Qwe​n3.8 3 августа 2026 года. В этот день произошли две вещи: Qwen3.8-Max, флагманская модель смеси экспертов с 2,4 триллиона параметров, стала доступна через платный API, а Alibaba обязалась открыть веса как для Max, так и для меньшей Qwen3.8-27B «примерно в течение недели». Несколько независимых изданий (36Kr, TrendForce, C114) передали одно и то же обязательство: Hugging Face и ModelScope, на неделе с 10 августа.

27B — это представитель поколения, который можно развернуть у себя: Alibaba позиционировала его как рассчитанного на работу с одной GPU и локальное развёртывание, прямого преемника широко используемой Qwen3.6-27B. Эта преемственность важна. Qwen3.6-27B стала одной из самых популярных локальных моделей для кодинга своего поколения, и версия 3.8 наследует эту устоявшуюся базу вопросов: сколько стоит её запуск, стала ли она лучше для агентов, когда её можно будет скачать.

Что независимо проверяемо сегодня — это флагман, и теперь он включает открытые веса. Qwen3.8-Max уже доступен через API, а его репозитории — Qwen3.8-2.4T-A95B (полный BF16) и официальная FP8-квантизация — появились в официальной организации Qwe​n на Hugging Face в неделю 10 августа; это первый случай, когда Alibaba открыла исходный код флагманской модели Max-класса. Она уже получила оценки: Artificial Analysis даёт её индексу интеллекта 58 баллов — это самый близкий результат китайской лаборатории к вершине таблицы, — индексу кодирования 71,8, а цена составляет $2,00 за миллион входных токенов и $6,00 за миллион выходных токенов.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Как на самом деле выглядит «релиз» для модели с открытыми весами

С датой у закрытой модели всё просто — API включается. У модели с открытыми весами у «релиза» есть слои, и каждый слой выходит с разницей в несколько дней:

Исходные веса представлены в виде репозитория Hugging Face и ModelScope, с модельной карточкой и файлом LICENSE.

Инференс-фреймворки идут следом — ожидается, что vLLM и SGLang добавят поддержку в течение нескольких дней, что является сигналом того, что модель готова к использованию, а не просто к загрузке.

Коммьюнити-квантизации (GGUF, AWQ) обычно появляются с задержкой в одну-две недели — именно тогда пользователи Ollama, LM Studio и llama.cpp могут фактически скачать и запустить модель.

Итак, если вопрос — «когда можно скачать веса», ответ: появление репозитория в официальной организации Qwe​n. Если вопрос — «когда можно запустить его одной командой», прибавьте к этому одну-две недели. Обещание от 3 августа касалось первого из этих пунктов: его ждали на неделе 10 августа, — и этот уровень уже достигнут для одного представителя поколения: Qwen3.8-2.4T-A95B появился на Hugging Face на той неделе. Что касается конкретно 27B, она до сих пор не появилась на Hugging Face — но обратный отсчёт на ModelScope теперь называет цель: 15 августа 2026 года в 00:00 JST.

Что ещё не проверено

Всё остальное о 27B — предположения, пока не опубликован репозиторий. Не позволяйте уверенным публикациям превращать прогнозы в спецификации — ничто из перечисленного ниже не подтверждено на момент написания:

• Архитектура — плотная или смесь экспертов, и количество активных параметров, если MoE.

• Окно контекста, ограничения на вывод и то, является ли модель текстовой или мультимодальной. Тизер ModelScope, по данным PC Watch, описывает нативную мультимодальность и многоязычную поддержку изображений и видео — заявлено в тизере, но пока не подтверждено, пока не выйдут веса.

• Лицензия. Полагаться на Apache 2.0 небезопасно; недавние открытые релизы Qwe​n выходили под лицензией Tongyi Qianwen, которая содержит пункт о 100 миллионах активных пользователей в месяц, при превышении которого требуются коммерческие переговоры.

Любые результаты бенчмарков. Каждая цифра, которая циркулирует для поколения 3.8, предоставлена вендором для Max; у 27B вообще нет публичных оценок.

• Точные размеры квантованных моделей. Указанные в обращении значения VRAM являются прогнозами, перенесёнными с Qwen3.6-27B, а не измерениями модели 3.8.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Почему лицензия важнее даты

Дата выпуска определяет, когда можно приступить к тестированию. Лицензия определяет, можно ли выпускать продукт. Модель Qwen по лицензии Tongyi Qianwen бесплатна для использования при менее чем 100 миллионах активных пользователей в месяц — сверх этого ожидается обсуждение коммерческих условий. Для локальной модели, которую команды будут встраивать в продукты и агентов, этот порог может быть достигнут быстрее, чем кажется. Первый файл, который нужно открыть в репозитории, — это LICENSE, до карточки модели и до README.

Как поймать падение раньше, чем это сделают посты в блогах

Официальная организация Qwen на Hugging Face — это источник истины: когда репозиторий под названием Qwen3.8-27B появляется там или на ModelScope, релиз состоялся. Этот механизм уже проявил себя на этой неделе: Qwen3.8-2.4T-A95B и его FP8-собрат появились в организации именно таким образом, поэтому появление репозитория 27B будет столь же однозначным. На ModelScope уже запущена страница обратного отсчёта для Qwen3.8-27B, указывающая на полночь 15 августа, — это самое близкое к официальной дате, что у нас пока есть. Стоит следить за тремя более ранними сигналами:

• Pull request в vLLM или SGLang, упоминающий Qwen3.8-27B. PR в фреймворках часто являются первым публичным следом выпуска весов, поскольку работа по интеграции начинается сразу же, как только репозиторий подготовлен.

• Собственные каналы команды Qwen (X, WeChat, блог qwen.ai), которые обычно объявляют о самом релизе.

• Квантайзеры сообщества — Unsloth и другие обычно публикуют файлы квантования и реальные замеры VRAM в течение нескольких дней, что превращает приведённые выше прогнозы в измеримые цифры.

Одно предупреждение действует всё время: пока официальная организация не опубликовала модель, любая "Qwen3.8-27B", которую вы можете скачать, — это либо заглушка, либо загрузка от третьих лиц. Одно лишь название не гарантирует подлинность.

Что можно использовать сегодня

27B — {{1}}модель, которую стоит ждать{{/1}}, {{2}}но не единственный вариант в этом поколении{{/2}}. Qwen3.8-Max {{3}}уже доступен{{/3}} — и тоже {{4}}пригоден для самостоятельного размещения, поскольку его веса можно скачать{{/4}}, — а на OrcaRouter он {{5}}тарифицируется по прайс-листу провайдера{{/5}}: {{6}}$2.00 за миллион входных токенов и $6.00 за миллион выходных{{/6}}, {{7}}без наценки{{/7}}, так что {{8}}цена на странице цен вендора — это цена, которую вы платите{{/8}}. {{9}}Один ключ покрывает его{{/9}}, и {{10}}когда 27B выйдет и завоюет доверие на публичных бенчмарках{{/10}}, {{11}}тот же ключ будет направлять запросы и к нему{{/11}}. {{12}}Для команды, которая хочет работать с этим поколением уже сегодня{{/12}}, {{13}}сохраняя возможность самостоятельного размещения 27B позже{{/13}}, это {{14}}самый свободный от привязок путь{{/14}}.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Краткое резюме: ответ о дате выхода стал яснее, чем неделю назад. Окно, которое дала Alibaba, — неделя 10 августа 2026 года — прошло. Веса флагмана появились: Qwen3.8-2.4T-A95B и его официальная FP8-квантизация теперь на Hugging Face. Веса 27B не вышли — но теперь у задержки есть срок: обратный отсчёт на ModelScope идёт до полуночи 15 августа 2026 года (00:00 JST, по данным PC Watch). Следите за официальной организацией Qwe​n на Hugging Face и страницей Qwe​n на ModelScope, читайте LICENSE, как только репозиторий 27B появится, и относитесь ко всем циркулирующим характеристикам и цифрам VRAM как к предположениям, пока веса не позволят их измерить.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

Свяжитесь с нами

Присоединяйтесь к сообществу

DiscordEmailXGitHubYouTube