Qwen3.5 397B A17B vs Qwen3.8 27B (free): бенчмарки, цены и скорость (август 2026 г.)

Прямое сравнение Qwen3.5 397B A17B (qwen) и Qwen3.8 27B (free) (qwen) на OrcaRouter — цены, контекстное окно, задержка, пропускная способность и качество benchmark бок о бок, чтобы вы могли выбрать подходящую модель для своей нагрузки.

Итог

Для нагрузок, чувствительных к задержке, Qwen3.8 27B (free) возвращает первый token быстрее. По качеству benchmark Qwen3.5 397B A17B лидирует в сводном индексе.

Бесплатный старт · обе модели по одному ключу · оплата по цене провайдера, без наценки на токены

И Qwen3.5 397B A17B, и Qwen3.8 27B (free) доступны через один и тот же эндпоинт OrcaRouter по цене провайдера с нулевой наценкой на токены, поэтому переключение между ними — это изменение в одну строку, а цифры ниже — это то, что вы платите на самом деле.

Читать полный разбор

Это сравнение подтягивает актуальные цены, опубликованное context window, а также собственные замеры latency и throughput OrcaRouter, чтобы вы могли взвесить стоимость и производительность под свою конкретную нагрузку, а не полагаться на витринный benchmark поставщика. Правильный выбор почти всегда зависит от формы вашего трафика — длины промпта, объёма генерируемого текста, того, насколько ваши пользователи чувствительны к latency, и насколько тяжело рассуждение, — поэтому разделы ниже разбирают решение по одному измерению за раз и завершаются конкретной рекомендацией. Везде, где для одной из двух моделей метрика отсутствует, соответствующая строка опускается, а не додумывается, так что каждое утверждение здесь подкреплено реальным числом.

Кратко

  • Задержка p50155 msQwen3.8 27B (free) 95%
  • Качество8.0Qwen3.5 397B A17B 100%
  • Контекст262KQwen3.8 27B (free) 700%

Сравнение моделей

Цены, контекст, задержка, пропускная способность и качество для Qwen3.5 397B A17B и Qwen3.8 27B (free).
МетрикаQwen3.5 397B A17BQwen3.8 27B (free)Вывод
Ввод $/млн$0.17
Вывод $/млн$1.03
Контекст33K262KQwen3.8 27B (free) принимает на 700% большее контекстное окно, чем Qwen3.5 397B A17B.
Задержка p503125 ms155 msQwen3.8 27B (free) отвечает на 95% быстрее, чем Qwen3.5 397B A17B, по медиане.
Пропускная способность85 tok/s
Качество8.04.0Qwen3.5 397B A17B набирает на 100% больше, чем Qwen3.8 27B (free), по сводному индексу качества.

Для нагрузок, чувствительных к задержке, Qwen3.8 27B (free) возвращает первый token быстрее. По качеству benchmark Qwen3.5 397B A17B лидирует в сводном индексе.

Обе модели, один API-ключ. Начните с любой и переключайтесь, изменив одну строку.

Получить API-ключ

Используйте Qwen3.5 397B A17B и Qwen3.8 27B (free) по одному API-ключу

Выбирать не обязательно. Обе модели доступны через один и тот же OpenAI-совместимый эндпоинт OrcaRouter и тарифицируются по цене вышестоящего провайдера без наценки на токены. Переключение — это смена имени модели: без второго аккаунта, второго SDK и отдельных учётных данных.

Именно это делает описанный выше компромисс управляемым в продакшене: направляйте основную часть трафика в модель, которая выигрывает по важному для вас параметру, оставляйте вторую для запросов, которым она действительно нужна, и меняйте пропорцию, как только меняются ваши цифры.

curl
# Один ключ, один эндпоинт, обе модели.
curl https://api.orcarouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $ORCAROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.5-397b-a17b",
    "messages": [{"role":"user","content":"..."}]
  }'

# Смените модель, изменив одну строку.
#     "model": "qwen/qwen3.8-27b-free"

Живой тест: Qwen3.5 397B A17B vs Qwen3.8 27B (free) в режиме Battle

Режим битвы — попробуйте оба, бок о бокВ эфире
Открыть в песочнице
Qwen: Qwen3.5 397B A17B
$0.17 /M · p50 3125ms
Qwen: Qwen3.8 27B (free)
$0.00 /M · p50 155ms

Цены и анализ затрат

Одна или обе эти модели не раскрывают здесь цену за токен (это может быть модель с бесплатным тарифом, оплатой за вызов или ещё без цены), поэтому относитесь к колонкам стоимости

Читать полный разбор

как к ориентировочным и подтвердите актуальную ставку на собственной странице каждой модели, прежде чем закладывать её в бюджет.

Qwen3.5 397B A17B принимает до 33K токенов контекста, а Qwen3.8 27B (free) принимает 262K.

Читать полный разбор

Context window ограничивает, сколько исходного материала — документов, кода, предыдущего диалога — вы можете отправить в одном запросе. Более крупное окно позволяет обойтись без чанкинга и обвязки для поиска при длинных входах, но вы всё равно платите по ставке входных токенов за всё отправленное, поэтому большее окно — это возможность, а не скидка. Подбирайте окно под самый длинный одиночный запрос, который ваша нагрузка реально порождает, а не под самое большое число на странице. Учитывайте также, что на любой модели качество может ухудшаться к концу очень длинного контекста, поэтому большое окно лучше рассматривать как запас для эпизодических длинных входов, а не как разрешение забивать каждый запрос до предела.

Обе ставки — это чистая цена провайдера: OrcaRouter не добавляет наценку, поэтому рассчитанная экономия остаётся у вас.

Начать бесплатно

Скорость и задержка

Latency и throughput определяют, каково работать с моделью в продакшене. Медианная (p50) latency отклика — это время ожидания типичного запроса до первого токена; throughput (токенов в секунду) задаёт, как быстро ответ стримится после начала.

Читать полный разбор

Для интерактивного чата и циклов agent важнее всего низкая p50 latency, потому что пользователь ждёт первый токен; для пакетной генерации и длинных выводов общее время определяет throughput, потому что ответ длинный. Графики трендов за 7 дней выше показывают, стабильна latency каждой модели или дрейфует — то, что единичное громкое число скрывает: модель с отличным средним, но шумным хвостом всё равно может не уложиться в строгий p95 SLA. Если у вашего продукта есть бюджет latency, читайте и медиану, и форму кривой, и помните, что сквозная latency включает также ваш сетевой хоп и любые запросы поиска или вызовы инструментов, которые вы делаете вокруг модели.

За последние 7 дней Qwen3.8 27B (free) удерживает более низкую медианную задержку ответа.

Qwen3.5 397B A17B
Qwen3.8 27B (free)

Бенчмарки и качество

Оценки benchmark приближают способности, но не заменяют тестирование на ваших собственных промптах.

Читать полный разбор

Показанные здесь сводные индексы агрегируют несколько публичных оценок, а перцентиль отмечает, где каждая модель находится среди всех сопоставимых моделей каталога — полезный сигнал для короткого списка, но не гарантия для вашей задачи. Модель, лидирующая по индексу общего интеллекта, всё равно может отставать в вашей области (кодинг, извлечение, многоязычность, рассуждение на длинном контексте), поэтому используйте benchmark, чтобы сузить круг, а затем прогоните обе модели на репрезентативном срезе вашего трафика. Обращайте внимание на конкретный индекс, соответствующий вашему сценарию, а не на итоговое число: продукту с упором на код стоит взвешивать индекс кодинга, исследовательскому ассистенту — индекс рассуждения. Benchmark к тому же устаревают по мере обновления моделей, поэтому относитесь к ним как к стартовой гипотезе, которую вы подтверждаете собственным набором для оценки.

Qwen3.5 397B A17B
48.2
AA Coding
Лучше, чем 54% сравниваемых моделей
59 из 128
34.3
AA Intelligence
Лучше, чем 41% сравниваемых моделей
77 из 130
Qwen3.8 27B (free)

Что выбрать?

Если стоимость — жёсткое ограничение, начните с более дешёвой модели на вашем реальном сочетании вход-выход и переходите выше только если не хватает качества.

Читать полный разбор

Если приоритет — отзывчивость (чат для пользователей, agent, любой случай, где кто-то ждёт), придавайте p50 latency и throughput больший вес, чем небольшой разнице в цене. Если вы выжимаете самое тяжёлое рассуждение, кодинг или работу на длинном контексте, пусть ведёт победитель по benchmark и context window, и принимайте более высокую ставку там, где она себя окупает. Поскольку обе модели стоят за одним и тем же API, малорисковый ход — направить часть реального трафика на каждую и сравнить стоимость, latency и качество ответов на своих промптах, прежде чем определяться. Распространённый приём — многоуровневость (tier): отправляйте основную массу простых, высокочастотных запросов на более дешёвую или быструю модель, а более сильную модель приберегите для запросов, которым она действительно нужна, — это забирает большую часть выигрыша в качестве за долю стоимости. Что бы вы ни выбрали, держите переключение обратимым — вы вернёте трафик обратно, как только цифры или ваши требования изменятся.

Или не выбирайте — маршрутизируйте по каждому запросу между обеими, с одним ключом и одним эндпоинтом.

Получить обе

Лучше подходит для

  • Чат и агенты, критичные к задержкеQwen3.8 27B (free)
  • Сложные рассуждения и кодQwen3.5 397B A17B
  • Самые длинные входные данныеQwen3.8 27B (free)

Qwen3.5 397B A17B vs Qwen3.8 27B (free) — часто задаваемые вопросы

У кого больше контекстное окно, Qwen3.5 397B A17B или Qwen3.8 27B (free)?
Qwen3.8 27B (free) принимает большее контекстное окно, поэтому вмещает более длинные документы и диалоги в одном запросе.
Что быстрее, Qwen3.5 397B A17B или Qwen3.8 27B (free)?
Qwen3.8 27B (free) имеет более низкую медианную (p50) задержку ответа по данным живых измерений OrcaRouter.
Что набирает больше в benchmark, Qwen3.5 397B A17B или Qwen3.8 27B (free)?
Qwen3.5 397B A17B лидирует по сводному индексу качества, показанному выше, но лидерство в benchmark не всегда переносится на конкретную область — проверьте на своих промптах, прежде чем стандартизировать.
Что мне использовать, Qwen3.5 397B A17B или Qwen3.8 27B (free)?
Выбирайте Qwen3.5 397B A17B или Qwen3.8 27B (free) в зависимости от вашего приоритета: стоимость, контекстное окно, задержка или качество benchmark. Таблица выше показывает, какая модель побеждает по каждому критерию; сопоставьте победителя с наиболее важным для вашей нагрузки параметром.
Как тарифицируются Qwen3.5 397B A17B и Qwen3.8 27B (free) в OrcaRouter?
Обе тарифицируются по ставке вышестоящего провайдера с нулевой наценкой на токены — вы платите ту же цену за токен, что платили бы провайдеру напрямую, через один API-ключ и эндпоинт OrcaRouter.
Могу ли я вызывать и Qwen3.5 397B A17B, и Qwen3.8 27B (free) одним и тем же кодом?
Да. Обе доступны через OpenAI-compatible API OrcaRouter, поэтому вы меняете только имя модели, чтобы маршрутизировать между ними — без смены SDK, без отдельных учётных данных.

Начните с Qwen3.5 397B A17B или Qwen3.8 27B (free)

Один ключ. Обе модели. Более 40 провайдеров.

Оплата по цене провайдера, без наценки на токены. Начните бесплатно, меняйте модель одной строкой и сохраняйте решение обратимым.

Создать бесплатный аккаунт