Титульная карточка для статьи «Qwen3.8-27B Release Date», показывающая календарь с отметкой недели 10 августа 2026 года как обещанного окна выхода, с бейджем «status: pending», подзаголовком, указывающим на анонс от 3 августа 2026 года, и графикой со слоями модели.
Guides & Insights

Qwen3.8-27B — дата выпуска: веса опубликованы 14 августа

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Вечером 14 августа 2026 года Alibaba выпустила открытые веса для Qwen3.8-27B, разместив репозиторий на Hugging Face и ModelScope под лицензией Apache 2.0. Это закрывает вопрос о дате релиза, который этот пост отслеживал с анонса 3 августа, и даёт первую точку данных о доступности API: в тот же день модель появилась на коммерческом API-маркетплейсе. Qwen3.8-27B — это плотная модель с возможностью самостоятельного размещения из поколения Qwen3.8: родственная модель, которую Alibaba противопоставила флагману Qwen3.8-Max с 2,4 триллиона параметров, и преемник широко используемой Qwen3.6-27B.

Что подтвердил релиз от 14 августа

Поколение Qwen3.8 было анонсировано 3 августа 2026 года. В тот день Qwen3.8-Max, флагманская модель на основе смеси экспертов, стала доступна с платным API, а Alibaba пообещала открыть веса как для Max, так и для меньшей модели Qwen3.8-27B «примерно в течение недели». Этот срок растянулся, а затем обрёл конкретную цель, когда тизер ModelScope запустил обратный отсчёт до полуночи 15 августа (00:00 по японскому стандартному времени). Релиз состоялся по расписанию: вечером 14 августа по пекинскому времени, одновременно на Hugging Face и ModelScope.

Подтверждённый набор характеристик: Qwen3.8-27B — это плотная модель с 27 миллиардами параметров, нативно мультимодальная (текст, изображения, видео, диаграммы, документы), с нативным контекстным окном на 262 000 токенов, которое расширяется до 1 миллиона токенов через YaRN, и настраиваемым режимом reasoning_effort, регулирующим глубину мышления для экономии вычислений. Это характеристики, заявленные производителем в релизных материалах, — теперь их можно проверить непосредственно в публичных весах, а не принимать на веру.

В собственных тестах Alibaba 27B превосходит своего предшественника и даже более крупную Qwen3.7-Plus: SWE-bench Pro 61.7 (против 53.5 у Qwen3.6-27B), агентное программирование в терминале 73.0 (против 63.4) и JobBench 33.4 (против 21.8). Это цифры, предоставленные вендором — независимые бенчмарки ещё не публиковали оценку для 27B, так что относитесь к ним как к заявлению, которое сообщество теперь попытается воспроизвести.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Какие слои релиза уже вышли?

Для модели с открытыми весами «выпуск» имеет несколько уровней, и они появляются с разницей в несколько дней. Сырые веса — это первый уровень: они появились 14 августа. Поддержка инференс-фреймворков — это второй уровень: vLLM и SGLang обычно добавляют поддержку в течение нескольких дней после появления весов, и это сигнал того, что модель готова к использованию, а не просто к загрузке. Квантизация сообщества — это третий уровень: сборки GGUF и AWQ, а вместе с ними путь одной команды через Ollama, LM Studio и llama.cpp, обычно через одну-две недели.

Итак, ответ на вопрос «когда я могу скачать веса» — уже сейчас. Ответ на вопрос «когда я смогу запустить это одной командой» дают уровни фреймворка и квантования, которые всё ещё внедряются.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Вопрос о лицензии решён.

Лицензия была нерешённым вопросом, который имел большее значение, чем дата, и релиз решил его. Qwen3.8-27B выпускается под Apache 2.0 — разрешительной лицензией без ограничения по числу пользователей и без триггера для коммерческих переговоров. Ранее высказывалось опасение, что открытый релиз Qwen выйдет под лицензией Tongyi Qianwen с её пунктом о 100 миллионах MAU, но для 27B оно не сбылось. Это устраняет главное юридическое препятствие для интеграции модели в продукты и агентов с первого дня.

Первый показатель доступности API

Релиз также дал первый показатель доступности API для модели 27B: в течение нескольких часов после публикации весов модель появилась на коммерческом API-маркетплейсе в качестве живого обслуживающего эндпоинта. Эта запись независимо проверяема — это запись в стороннем каталоге, а не заявление вендора — и это первое доказательство того, что модель не просто доступна для загрузки, но и может быть развернута через управляемые API.

Вот где OrcaRouter вступает в игру для расчёта стоимости. На сегодняшний день маршрутизируемая модель поколения — Qwen3.8-Max, обслуживаемая на OrcaRouter по цене провайдера: $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов, без наценки, так что цена вендора — это цена, которую вы платите. Один API-ключ покрывает её и более 200 моделей в каталоге, с автоматическим переключением при сбое. Когда Qwen3.8-27B займёт своё место на маршрутизаторе, тот же ключ будет направлять запросы к ней; до тех пор веса Apache 2.0 можно бесплатно разместить самостоятельно для оценки.

Что проверить дальше

Падение отвечает на вопрос о дате; оно пока не отвечает на вопрос о качестве. За тремя вещами стоит наблюдать в ближайшие недели:

Поддержка inference-фреймворков — pull request'ы vLLM и SGLang с упоминанием Qwen3.8-27B — сигнал того, что модель готова к масштабному обслуживанию, а не просто к запуску из репозитория.

• Квантования от сообщества с реальными замерами VRAM — Unsloth и другие обычно публикуют GGUF-сборки и измеренную память в течение нескольких дней, превращая предрелизные прогнозы в цифры, на которые можно опираться при развёртывании.

• Независимые бенчмарки — результаты Artificial Analysis и LMArena для 27B, когда они появятся, должны определять решение о выпуске, а не собственные оценки Alibaba.

Что можно использовать сегодня

Qwen3.8-27B уже доступен для загрузки — в этом суть релиза под лицензией Apache 2.0. Для команд, которые хотят работать с этим поколением модели через управляемый API уже сегодня, Qwen3.8-Max доступен на OrcaRouter по цене провайдера ($2.00 за миллион входных токенов, $6.00 за миллион выходных токенов, без наценки), с автоматическим переключением при сбоях и одним ключом для всего каталога. Пока независимые бенчмарки не подтвердят показатели вендора, самостоятельный хостинг весов 27B для оценки — наименее рискованный путь.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Вопрос о дате выпуска закрыт: Qwen3.8-27B вышел 14 августа 2026 года под лицензией Apache 2.0, с нативным контекстным окном 262K и доступностью API с того же дня. Оставшиеся вопросы — измеримые: как модель работает при инференсе, как она квантуется и воспроизводят ли независимые оценки результаты Alibaba. Прочтите LICENSE, скачайте веса и дождитесь поддержки в фреймворках и сборок сообщества, прежде чем делать ставку на неё в продакшене.