
Qwen3.8-27B vs Qwen 3.8: то же поколение, один GPU против целой стойки
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
На этой неделе Alibaba вывела Qwen3.8-27B на скоростной инференс-трек Cerebras — впервые у плотной 27B-модели появился по-настоящему быстрый вариант хостинга — и Artificial Analysis наконец проиндексировала обе стороны этого противостояния. Qwen3.8-27B набирает 34 балла в AA Intelligence Index. Qwen 3.8, то есть открытое ядро, которое большинство подразумевает, когда пишет название без суффикса, набирает 40. Эти два числа перезапускают сравнение, которое августовские материалы о запуске вынуждены были строить исключительно на словах вендора.
Модель, стоящая за «Qwen 3.8» как самостоятельным названием, — это Qwen3.8-2.4T-A95B: веса смеси экспертов на 2,4 трлн параметров, опубликованные Alibaba под собственной лицензией. Qwen3.8-27B — плотная модель того же поколения: примерно 27 млрд параметров, Apache 2.0, рассчитана на один GPU. Их объединяют название семейства, нативная длина контекста 262K и окно запуска. Во всём остальном это две противоположности: одной можно владеть, другую можно только арендовать. Вот для чего на самом деле нужна каждая из них, теперь когда у обеих есть независимые показатели.
То же поколение, противоположные формы
Qwen3.8-27B — плотная модель: 27 млрд параметров (28 млрд с учётом визуального энкодера), 64 слоя, гибридный стек внимания из 48 слоёв линейного внимания Gated DeltaNet против 16 слоёв полного внимания. Именно благодаря этой гибридной архитектуре модель на 27 млрд может вмещать 262 144 токена нативного контекста. Qwen3.8-2.4T-A95B — флагманская архитектура: 2,4 трлн общих параметров, около 95 млрд активных на токен, 92 слоя с 512 экспертами в каждом, и 69 из этих 92 слоёв используют линейное внимание. Тот же приём, но в девяносто раз больший масштаб.
• Архитектура — Qwen3.8-27B: 27B, плотная, каждый токен активирует всю её. Qwen3.8-2.4T-A95B: 2,4T всего / ~95B активных, MoE.
• Контекст — у обоих собственных 262K; расширение до 1M у 27B доступно только в облачном варианте, а 2,4T достигает ~984K по измерениям.
• Ввод — Qwen3.8-27B: текст, изображение и видео. Qwen3.8-2.4T-A95B: только текст, режим размышления жёстко включён.
• Лицензия — Qwen3.8-27B: Apache 2.0. Qwen3.8-2.4T-A95B: пользовательская лицензия Qwen3.8-Max.
• Веса — Qwen3.8-27B: 55,6 ГБ BF16, квантуется в ~16-ГБ сборку Q4. Qwen3.8-2.4T-A95B: ~2,4 ТБ BF16, это GPU-стойка, а не настольный компьютер.
• Где вы с ними встретитесь — Qwen3.8-27B: у себя или дёшево в аренде. Qwen3.8-2.4T-A95B: в аренде, потому что никто в здравом уме не держит такую стойку у себя.
Независимые числа, наконец
Каждый августовский сравнительный материал о Qwen3.8-27B содержал одну и ту же оговорку: «независимых оценок пока нет». Это уже не так. У Artificial Analysis по состоянию на эту неделю есть измерения обеих моделей, и структура этих данных по-настоящему интересна.
В Intelligence Index Qwen3.8-2.4T-A95B набирает 40 баллов и занимает 4-е место из 113 в своём классе. Qwen3.8-27B набирает 34 балла — это выводит его на первое место среди 140 моделей в его размерном классе 4–40B с открытыми весами, по-настоящему сильный результат для плотной 27B-модели. По независимым измерениям обе медленны: 39,0 выходных токенов в секунду у 27B и 38,1 у 2.4T при медиане по классу около 90. Обе многословны: 27B генерирует примерно 200 млн выходных токенов по всем прогонам индекса против медианы по классу 68 млн. Ни одна не является флагманской фронтирной моделью; обе — рабочие лошадки, и индекс говорит, что 2.4T — более сильная рабочая лошадка с явным отрывом.

Цены от независимых источников рассказывают ту же историю в долларах. Artificial Analysis оценивает 27B в $0,50 за миллион входных и $3,00 за миллион выходных токенов в размещённой сборке Qwen Cloud (скидка 90% за кэш), а 2.4T — в $2,00 / $6,00 (скидка 88% за кэш). Стоимость одной задачи Intelligence Index: $0,82 для 27B против $2,16 для 2.4T. Меньшая модель дешевле в эксплуатации на единицу интеллекта — и обе дороги относительно своего класса скорости, потому что обе — reasoning-модели, которые сжигают выходные токены.
Всё остальное — SWE-bench Pro 61.7, DeepSWE 1.1 42.2, LiveCodeBench v6 90.3 для 27B; 86.6 Terminal-Bench 2.1 и 67.7 SWE-bench Pro у 2.4T — остаётся заявленным производителем, невоспроизведённым и помечено как таковое на протяжении всего этого материала. Приведённые выше индексы AA — это независимый нижний порог под всем этим.
Что меняет листинг Cerebras
12 сентября 2026 года аккаунт Qwen объявил, что Qwen3.8-27B теперь работает на Cerebras, а его запись в каталоге опубликована под баннером «Qwen 3.8 27B теперь доступна на Cerebras PayGo». Cerebras указывает цену в $0.99 за миллион входных и $1.49 за миллион выходных токенов на оборудовании класса WSE, которое прославило компанию своей скоростью. Это даёт 27B то, чего никогда не было у ядра 2.4T: скоростную полосу.

Медлительность и многословность с самого начала были единственным реальным минусом 27B. На независимом стенде он выдаёт 39 t/s; по нашей собственной телеметрии обслуживания он выдаёт ~154 выходных токена в секунду при p50 задержки первого токена 4,48 с — а теперь второй провайдер конкурирует на той же оси. А у 2.4T, напротив, вообще нет быстрого пути: при 38 t/s вы платите цены фронтирного уровня за скорость среднего сегмента, и единственный способ обойти это — арендованный кластер GPU, на котором вы сами запускаете открытые веса.
Три полосы для 27B, одна для 2.4T
На сегодняшний день dense 27B можно арендовать тремя способами, и разброс цен стоит изучить, прежде чем выбирать:
• Собственный хостинг — Qwen3.8-27B уже доступна на OrcaRouter по цене $0.33 / $2.40 за миллион, работает на нашей собственной инфраструктуре. Самая низкая цена за ввод на рынке для неё, ~154 ток/с на выводе, контекст 262K.
• Вендорный вариант — хостируемая сборка Qwen Cloud: $0.50 / $3.00 за миллион токенов, с контекстом на 1 млн токенов и 90%-ной скидкой на кэш.
• Быстрый трек — Cerebras PayGo, $0.99 / $1.49 за миллион, с упором на скорость, а не на цену.

У 2.4T open core нет аналогичного спреда. Флагманский API, обслуживающий ту же архитектуру, — Qwen3.8-Max — стоит $2.00 / $6.00 за миллион, и эта цифра не меняется, как бы вы его ни называли — Max или open core. Если вместо этого запускать веса, экономика смещается к железу: для 2.4T требуется ~2,4 ТБ весов BF16 и узел с несколькими GPU — капитальное решение, которое никто не принимает легкомысленно. GPU на 24 ГБ запускает Q4-сборку 27B при маржинальной стоимости, которая округляется до нуля.
Наглядный пример, который решает выбор большинства команд: 100M входных и 20M выходных токенов в день. При ставке 2.4T $2/$6 это около $320 в день, ~$117,000 в год. На 27B при наших $0.33/$2.40 это около $81 в день — а на self-hosted-копии это цена электроэнергии. 2.4T даёт вам реальное преимущество по качеству: AA 40 против 34. Стоит ли это преимущество пятизначного месячного счёта — вот весь вопрос, который ставит эта пара.
Где они действительно расходятся
Помимо индекса, выбор подходящего варианта для конкретной рабочей нагрузки определяют три практических различия.
Мультимодальный ввод — самый чистый фильтр. Qwen3.8-27B читает текст, изображения и видео — скриншоты, графики, документы с иллюстрациями, видеокадры — всё попадает в одно и то же окно на 262K. Qwen3.8-2.4T-A95B агрессивно ориентирован только на текст. Если во входных данных есть хоть что-то визуальное, 2.4T дисквалифицируется независимо от его более высокого индекса.
Управление мышлением — на втором месте. Режим рассуждений модели 27B можно отключать для каждого запроса, что важно для извлечения, чувствительного к задержке, где цепочка рассуждений — это чистые накладные расходы; он также предоставляет доступ к reasoning_effort. Ядро 2.4T не может отключить мышление — каждый ответ начинается с блока think>, и вы платите за эти токены, хотели вы их или нет. Флагманский API это исправляет, а открытое ядро — нет.
Лицензирование — на третьем месте, и при масштабировании оно незаметно имеет значение. Apache 2.0 для 27B — это разрешительный стандарт: изменение, распространение, коммерциализация, включая патентную лицензию. 2.4T поставляется под специальной лицензией Qwen3.8-Max — разрешительной по духу, но это условия Alibaba, а не стандарт сообщества, и стоит прочитать файл, прежде чем строить на нём продукт.
Маршрутизация решения
Обе стороны этого противостояния доступны через один ключ OrcaRouter, и именно это позволяет дёшево ответить на вопрос «что мне выбрать» эмпирически. Qwen3.8-27B доступен как qwen/qwen3.8-27b по прейскурантной цене провайдера без наценки, а флагманский API, построенный на том же ядре 2.4T, доступен как qwen/qwen3.8-max по $2.00 / $6.00 за миллион — собственный тариф Alibaba, передаваемый напрямую, поэтому любое изменение цены вендором действует здесь в тот же день.
Та же самая архитектура 2.4T в виде скачиваемых весов — это не то, что мы предоставляем: если сегодня вам нужно открытое ядро через API, флагманское направление — практический способ до него добраться, и qwen/qwen3.8 уже подготовлен к включению в тот момент, когда какой-либо провайдер начнёт предоставлять открытые веса. Правило маршрутизации, которое направляет визуальный и чувствительный к задержке трафик на qwen/qwen3.8-27b, а тяжёлую часть рассуждений — на qwen/qwen3.8-max, ничего не стоит настроить, и оно автоматически переключается между провайдерами при сбое. Один ключ, никакого второго контракта, а это разделение — изменение конфигурации, а не повторная перестройка архитектуры, — самый дешёвый способ проверить, стоят ли для вас дополнительные шесть индексных пунктов 2.4T $5.67 за миллион выходных токенов.
Кто должен выбирать
• Выбирайте Qwen3.8-27B, если ваши входные данные включают изображения или видео, если вам нужен режим размышлений, который можно отключить, если у вас есть GPU на 24 ГБ или вы планируете его приобрести, или если ваш расход на токены настолько велик, что $0.33/$2.40 против $2.00/$6.00 — это весь аргумент.
• Выбирайте Qwen 3.8 (ядро 2.4T), если вы работаете только с текстом, вам нужен самый сильный независимый показатель рассуждений в семействе (AA 40), а ставка $2/$6 — или стоимость запуска узла GPU — с запасом укладывается в ваш бюджет.
Выбирайте оба варианта, если ваш трафик охватывает два профиля: пропускайте его через шлюз, позвольте маршрутизатору разделять по модальности и сложности и меняйте решение, когда появится следующий чекпоинт или цена любой из моделей.
Вердикт
Название Qwen 3.8 всегда обозначало два продукта, притворяющихся одним семейством, и теперь у обоих есть независимые числа, о которых можно спорить. Qwen3.8-2.4T-A95B — более сильный мозг, только текст, дорогой и, бесспорно, рентабельный при цене $2/$6. Qwen3.8-27B — тот, который можно развернуть: мультимодальный, Apache 2.0, развёртываемый на своих серверах, и с этой недели у него наконец появился и быстрый режим. Разрыв в индексе реальный: 40 против 34. Разрыв в цене тоже: примерно в пять раз выше стоимость за токен, если запускать 2.4T через API. Для большинства команд решение не в шести пунктах индекса. Оно в том, покупаете ли вы токены или покупаете оборудование, — и 27B — единственный из двух, который позволяет вам купить оборудование.
