
Qwen3.8-27B — дата выпуска: веса опубликованы 14 августа
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 383 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 209 tok/s
- OrcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Вечером 14 августа 2026 года Alibaba выпустила открытые веса для Qwen3.8-27B, разместив репозиторий на Hugging Face и ModelScope под лицензией Apache 2.0. Это закрывает вопрос о дате релиза, который этот пост отслеживал с анонса 3 августа, и даёт первую точку данных о доступности API: в тот же день модель появилась на коммерческом API-маркетплейсе. Qwen3.8-27B — это плотная модель с возможностью самостоятельного размещения из поколения Qwen3.8: родственная модель, которую Alibaba противопоставила флагману Qwen3.8-Max с 2,4 триллиона параметров, и преемник широко используемой Qwen3.6-27B.
Что подтвердил релиз от 14 августа
Поколение Qwen3.8 было анонсировано 3 августа 2026 года. В тот день Qwen3.8-Max, флагманская модель на основе смеси экспертов, стала доступна с платным API, а Alibaba пообещала открыть веса как для Max, так и для меньшей модели Qwen3.8-27B «примерно в течение недели». Этот срок растянулся, а затем обрёл конкретную цель, когда тизер ModelScope запустил обратный отсчёт до полуночи 15 августа (00:00 по японскому стандартному времени). Релиз состоялся по расписанию: вечером 14 августа по пекинскому времени, одновременно на Hugging Face и ModelScope.
Подтверждённый набор характеристик: Qwen3.8-27B — это плотная модель с 27 миллиардами параметров, нативно мультимодальная (текст, изображения, видео, диаграммы, документы), с нативным контекстным окном на 262 000 токенов, которое расширяется до 1 миллиона токенов через YaRN, и настраиваемым режимом reasoning_effort, регулирующим глубину мышления для экономии вычислений. Это характеристики, заявленные производителем в релизных материалах, — теперь их можно проверить непосредственно в публичных весах, а не принимать на веру.
В собственных тестах Alibaba 27B превосходит своего предшественника и даже более крупную Qwen3.7-Plus: SWE-bench Pro 61.7 (против 53.5 у Qwen3.6-27B), агентное программирование в терминале 73.0 (против 63.4) и JobBench 33.4 (против 21.8). Это цифры, предоставленные вендором — независимые бенчмарки ещё не публиковали оценку для 27B, так что относитесь к ним как к заявлению, которое сообщество теперь попытается воспроизвести.

Какие слои релиза уже вышли?
Для модели с открытыми весами «выпуск» имеет несколько уровней, и они появляются с разницей в несколько дней. Сырые веса — это первый уровень: они появились 14 августа. Поддержка инференс-фреймворков — это второй уровень: vLLM и SGLang обычно добавляют поддержку в течение нескольких дней после появления весов, и это сигнал того, что модель готова к использованию, а не просто к загрузке. Квантизация сообщества — это третий уровень: сборки GGUF и AWQ, а вместе с ними путь одной команды через Ollama, LM Studio и llama.cpp, обычно через одну-две недели.
Итак, ответ на вопрос «когда я могу скачать веса» — уже сейчас. Ответ на вопрос «когда я смогу запустить это одной командой» дают уровни фреймворка и квантования, которые всё ещё внедряются.

Вопрос о лицензии решён.
Лицензия была нерешённым вопросом, который имел большее значение, чем дата, и релиз решил его. Qwen3.8-27B выпускается под Apache 2.0 — разрешительной лицензией без ограничения по числу пользователей и без триггера для коммерческих переговоров. Ранее высказывалось опасение, что открытый релиз Qwen выйдет под лицензией Tongyi Qianwen с её пунктом о 100 миллионах MAU, но для 27B оно не сбылось. Это устраняет главное юридическое препятствие для интеграции модели в продукты и агентов с первого дня.
Первый показатель доступности API
Релиз также дал первый показатель доступности API для модели 27B: в течение нескольких часов после публикации весов модель появилась на коммерческом API-маркетплейсе в качестве живого обслуживающего эндпоинта. Эта запись независимо проверяема — это запись в стороннем каталоге, а не заявление вендора — и это первое доказательство того, что модель не просто доступна для загрузки, но и может быть развернута через управляемые API.
Вот где OrcaRouter вступает в игру для расчёта стоимости. На сегодняшний день маршрутизируемая модель поколения — Qwen3.8-Max, обслуживаемая на OrcaRouter по цене провайдера: $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов, без наценки, так что цена вендора — это цена, которую вы платите. Один API-ключ покрывает её и более 200 моделей в каталоге, с автоматическим переключением при сбое. Когда Qwen3.8-27B займёт своё место на маршрутизаторе, тот же ключ будет направлять запросы к ней; до тех пор веса Apache 2.0 можно бесплатно разместить самостоятельно для оценки.
Что проверить дальше
Падение отвечает на вопрос о дате; оно пока не отвечает на вопрос о качестве. За тремя вещами стоит наблюдать в ближайшие недели:
Поддержка inference-фреймворков — pull request'ы vLLM и SGLang с упоминанием Qwen3.8-27B — сигнал того, что модель готова к масштабному обслуживанию, а не просто к запуску из репозитория.
• Квантования от сообщества с реальными замерами VRAM — Unsloth и другие обычно публикуют GGUF-сборки и измеренную память в течение нескольких дней, превращая предрелизные прогнозы в цифры, на которые можно опираться при развёртывании.
• Независимые бенчмарки — результаты Artificial Analysis и LMArena для 27B, когда они появятся, должны определять решение о выпуске, а не собственные оценки Alibaba.
Что можно использовать сегодня
Qwen3.8-27B уже доступен для загрузки — в этом суть релиза под лицензией Apache 2.0. Для команд, которые хотят работать с этим поколением модели через управляемый API уже сегодня, Qwen3.8-Max доступен на OrcaRouter по цене провайдера ($2.00 за миллион входных токенов, $6.00 за миллион выходных токенов, без наценки), с автоматическим переключением при сбоях и одним ключом для всего каталога. Пока независимые бенчмарки не подтвердят показатели вендора, самостоятельный хостинг весов 27B для оценки — наименее рискованный путь.

Вопрос о дате выпуска закрыт: Qwen3.8-27B вышел 14 августа 2026 года под лицензией Apache 2.0, с нативным контекстным окном 262K и доступностью API с того же дня. Оставшиеся вопросы — измеримые: как модель работает при инференсе, как она квантуется и воспроизводят ли независимые оценки результаты Alibaba. Прочтите LICENSE, скачайте веса и дождитесь поддержки в фреймворках и сборок сообщества, прежде чем делать ставку на неё в продакшене.
