Hero-карточка с заголовком «Claude Haiku 5.5 vs Qwen3.8-Flash-Next», показывающая Claude Haiku 5.5 при $0.10 за ввод и $0.50 за вывод с контекстом 1M против Qwen3.8-Flash-Next при $0.15 за ввод и $0.47 за вывод с контекстом 256K, средняя строка — «смесь 3:1: $0.20 против $0.23», а нижняя строка — «Index v4.3.2 — 43.40 против 39.82 — $0.21 против $0.37 за задачу».
Engineering & Research

Claude Haiku 5.5 против Qwen3.8-Flash-Next: разница в три цента за токен, семьдесят восемь — за завершённую задачу

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Поставьте две тарифные карты рядом — и покажется, будто они вышли из одного совещания. Claude Haiku 5.5 — $0.10 на входе и $0.50 на выходе. Qwen3.8-Flash-Next — $0.15 на входе и $0.47 на выходе. Модель этого вендора на треть дешевле на входе и на шесть процентов дороже на выходе. Ни один вендор не создал такую конфигурацию случайно, и ни один не опубликовал пояснительную записку о том, к чему они стремились, — но арифметика смешанной нагрузки 3:1 делает замысел очевидным и делает эту пару самым близким совпадением по ценам во всём этом сегменте.

На этом сходство заканчивается. Claude Haiku 5.5 — это закрытая API-модель, выпущенная 2026-10-07, с окном в один миллион токенов и максимальным объёмом вывода в 128 000 токенов. Qwen3.8-Flash-Next — это модель с открытыми весами на 180 миллиардов параметров и 6 миллиардами активных параметров, веса которой размещены на Hugging Face под лицензией Qwen Community License 1.0, а её опубликованное контекстное окно вызывает разногласия: её собственный конфиг чекпоинта и независимый совет не полностью сходятся в его оценке. Выпущенная 2026-08-26, она не является ни новой, ни экзотической для всех, кто работает в этой категории.

Цены на эти два решения указаны вместе не случайно. Чего тарифные карты не могут вам сказать, так это того, что они созданы для разных задач и что тот, который в электронной таблице выглядит дешевле, обходится дороже в эксплуатации.

Арифметика, которая раскрывает тайну ценообразования

Смешайте два тарифа при обычном соотношении входных данных к выходным 3:1 — соотношении, к которому ближе всего оказывается большинство трафика чатов и ассистентов по коду, — и вы получите $0.20 за миллион токенов для Claude Haiku 5.5 и $0.23 за миллион для Qwen3.8-Flash-Next. Модель Anthropic примерно на 13% дешевле при таком смешении, и это меньший разрыв, чем подразумевает столбец входных данных, и больший, чем подразумевает столбец выходных.

Поменяйте соотношение — и позиции сместятся. При 1:1 они стоят $0,30 и $0,31 за миллион — ничья в пределах погрешности округления. При 1:3, с преобладанием вывода, Claude Haiku 5.5 обходится в $0,40, а Qwen3.8-Flash-Next — в $0,39: преимущество Qwen в один цент и единственное соотношение, при котором модель Anthropic не является более дешёвой из двух.

Так что не существует единственного честного ответа на вопрос «что дешевле», и любое сравнение, которое его даёт, выбирает соотношение за читателя. Что можно обоснованно утверждать, так это следующее: карточка Claude Haiku 5.5 ориентирована на трафик с преобладанием ввода, карточка Qwen3.8-Flash-Next — на трафик с преобладанием вывода, а три цента за миллион токенов, разделяющие их при соотношении 3:1, — это самое близкое, что кому-либо удалось сделать для совпадения с цифрой Anthropic в этом сегменте. Это намеренное позиционирование, что бы ни говорили материалы к запуску.

В нашем каталоге Qwen3.8-Flash-Next указан по цене $0,15 за вход и $0,47 за выход за миллион токенов, а тариф за кэшированный ввод составляет $0,0184. Значения $0,15 и $0,47 совпадают с цифрами, которые Artificial Analysis фиксирует как прейскурантную цену провайдера; именно это и должна давать схема сквозного переноса.

Сколько на самом деле стоит день реального объёма

Возьмём пайплайн, прогоняющий 10 миллионов входных токенов и 2 миллиона выходных токенов в день. Это небольшая производственная нагрузка, которая при типичных длинах промптов с запасом укладывается в первый ценовой уровень.

• Стоимость входных данных — $1,00 в день на Claude Haiku 5.5, $1,50 в день на Qwen3.8-Flash-Next.

• Стоимость вывода — $1.00 в день на Claude Haiku 5.5, $0.94 в день на Qwen3.8-Flash-Next.

• Итого за день — $2.00 против $2.44. При таком масштабе разница за год составит около $160, или примерно 3,7 цента за миллион токенов.

Теперь примените две поправки, которые не учитывает тарифная карта, и направление сменится на противоположное.

Во-первых, Claude Haiku 5.5 использует новый токенизатор, общий с Claude 4.7 и более поздними версиями, который, согласно собственной документации Anthropic, для того же текста насчитывает примерно на 30% больше токенов, чем модель, которую он заменяет. Если ваш ввод — английская проза того типа, на котором измерялись эти подсчёты токенов, эффективная входная ставка составляет не $0.10, а $0.13, что ставит её в пределах двух центов от Qwen3.8-Flash-Next, а не на треть ниже.

Во-вторых, и это более существенно: Claude Haiku 5.5 отличается многословностью. Artificial Analysis зафиксировала 162 164 выходных токена для этой модели при прогоне Intelligence Index против 107 884 у Qwen3.8-Flash-Next. Если это соотношение сохранится на вашей рабочей нагрузке, а не абстрактное 3:1, строка вывода выше перестанет быть $1.00 против $0.94 и станет ближе к $1.50 против $0.94 — а дневной итог изменится в пользу Qwen.

Ни одна из корректировок сама по себе не является решающей. Вместе они и составляют разницу между тем, что две модели отличаются лишь в пределах погрешности округления, и тем, что Qwen3.8-Flash-Next становится существенно дешевле в эксплуатации, а единственный способ узнать, какой из этих вариантов применим, — подсчитать токены на собственном трафике, а не рассуждать исходя из тарифной сетки.

A two-column scoreboard titled 'Claude Haiku 5.5 vs Qwen3.8-Flash-Next - the scoreboard' with rows Index v4.3.2 43.40 against 39.82, cost per task $0.21 against $0.37, time per task 424.6s against 1,524.3s, Terminal Bench 4.0 0.3283 against 0.2525, AutomationBench 0.3541 against 0.5591 and context 1M tokens against 256K tokens, footed 'Board figures per Artificial Analysis v4.3.2; context and price per vendor documentation.'

Где фиксированный тариф перестаёт казаться фиксированным

У цены Claude Haiku 5.5 есть ступенька, а у Qwen3.8-Flash-Next — нет.

• Цена — Claude Haiku 5.5: $0,10 за вход / $0,50 за выход за миллион токенов при объёме запроса до 100 000 токенов, затем $0,50 / $2,50 при превышении; Qwen3.8-Flash-Next: $0,15 / $0,47 фиксированно.

• Кэшированный ввод — $0,01 за чтение и $0,125 за запись для Claude Haiku 5.5; $0,016 за чтение и $0,23 за запись для Qwen3.8-Flash-Next.

• Контекст — один миллион токенов для Claude Haiku 5.5. Для Qwen3.8-Flash-Next число зависит от того, кого вы спросите: Qwen публикует окно размером в один миллион токенов, собственная конфигурация чекпоинта ограничивает позиционные эмбеддинги значением 262 144, а Artificial Analysis фиксирует оценённую конфигурацию на уровне 256 000.

• Максимальный вывод — 128 000 токенов для Claude Haiku 5.5; 131 072 в нашей карточке каталога для Qwen3.8-Flash-Next.

• Модальность ввода — текст и изображения для Claude Haiku 5.5; текст для Qwen3.8-Flash-Next.

• Выпуск — 2026-10-07 для Claude Haiku 5.5, 2026-08-26 для Qwen3.8-Flash-Next.

• Веса — проприетарные, доступны только через API для Claude Haiku 5.5; открытые веса под лицензией Qwen Community License 1.0 для Qwen3.8-Flash-Next.

Три из этих строк тянут в сторону, противоположную той, что задаёт цена из заголовка, и самый резкий перелом приходится на шаг длины промпта. При объёме промпта менее 100 000 токенов Claude Haiku 5.5 — более дешёвая модель по обеим тарифным позициям. Выше этого порога входная ставка Anthropic увеличивается в пять раз, а Qwen3.8-Flash-Next сохраняет 3,3-кратное преимущество по входу и 5,3-кратное по выходу. Этот порог примерно совпадает с точкой, где и без того расходятся размеры контекстных окон — миллион токенов у одной модели, 262 144 у другой, — так что конвейер, которому нужно длинное окно, — это тот же конвейер, который платит по тарифу второго уровня, чтобы его получить.

Это не критика ценообразования; ступенчатые тарифы, привязанные к длине запроса, — обычный способ взимать плату за модель с длинным контекстом. Это предупреждение о сравнении. Прямое сравнение, проводимое с запросами в 8 000 токенов, описывает одну пару цен. Те же две модели с запросами в 400 000 токенов — совершенно другая пара, и более дешёвая во втором случае была более дорогой в первом.

Что указано в таблицах поставщиков ниже

Ни один из вендоров не запускал оценочный набор другого, поэтому общая картина ограничивается строками, которые Artificial Analysis измерила у обоих.

• Индекс интеллекта v4.3.2 — 43,40 у Claude Haiku 5.5 (Max) против 39,82 у Qwen3.8-Flash-Next. Преимущество Anthropic в 3,57 балла — крупнейший разрыв по сводному показателю в этой серии.

• Стоимость одной завершённой задачи Index — $0,21 против $0,37 на той же доске.

• Время выполнения задачи — 424,6 секунды против 1 524,3 секунды.

• Terminal Bench 4.0 — 0,3283 против 0,2525. Claude Haiku 5.5 — с преимуществом в 7,6 балла.

• SciCode — 0,5498 против 0,5058. Claude Haiku 5.5 — на 4,4 пункта.

• Humanity's Last Exam — 0,4439 против 0,3804. Claude Haiku 5.5 — на 6,4 пункта.

• AutomationBench, частичный балл — 0,3541 против 0,5591. Qwen3.8-Flash-Next — на 20,5 балла.

Шесть строк в пользу Anthropic, некоторые с большим отрывом, и одна строка в пользу Qwen с отрывом в 20 пунктов. Закономерность та же, что прослеживается во всём этом ценовом диапазоне: младшая модель Anthropic сильнее в рассуждениях, науке и в стоимости и задержке получения ответа, но слабее в доведении многошаговой задачи до завершения. У Qwen3.8-Flash-Next всё наоборот.

Разрыв между сводной и агентной строкой здесь необычно велик — 3,57 пункта в одну сторону, 20,5 — в другую, — что делает эту пару наименее неоднозначной в диапазоне по этой оси. Если ваша работа — один сложный вопрос, на который отвечают один раз, Claude Haiku 5.5 впереди по каждому показателю, который вы заметите. Если ваша работа — агент, который должен доводить дело до конца, Qwen3.8-Flash-Next впереди по единственной строке, которая это предсказывает, причём его преимущество более чем в пять раз превышает разрыв по сводной строке.

A capture of the Artificial Analysis model page for Claude Haiku 5.5 (Max), showing its standing chips of Intelligence #21/182, Speed #91/182, Cost #46/182 and Verbosity #62/182, the rates $0.10 in and $0.50 out with a 90% cache discount, a cost of $0.21 per task, 440M generated tokens, and the summary line that Claude Haiku 5.5 scores 43 on the Intelligence Index against a median of 13.

180 миллиардов параметров, которые вам по силам

Строка, которая для многих команд решает исход этого сравнения, вообще отсутствует в таблице бенчмарков.

Qwen3.8-Flash-Next — это разреженная модель смеси экспертов: 180 миллиардов параметров всего и 6 миллиардов активных — соотношение, которое удерживает вычислительные затраты на токен на умеренном уровне относительно общей ёмкости модели. Она опубликована под Qwen Community License 1.0, которую Artificial Analysis указывает как коммерческую, а не разрешительную лицензию; эту разницу стоит изучить, прежде чем строить на ней планы, поскольку лицензия сообщества — это не MIT, и она содержит собственные условия о распространении и масштабе. Её можно скачать, развернуть самостоятельно, закрепить на контрольной точке, квантовать и дообучить — с соблюдением этих условий.

Claude Haiku 5.5 не может быть ничем из перечисленного. Он проприетарный, доступен только через API, без опубликованного количества параметров, без лицензии и без репозитория. Anthropic обязуется сохранять возможность его вызова как минимум до 2027-10-07 — это реальная и конкретная гарантия, но гарантия доступности — это не то же самое, что сами веса.

Практическое следствие действует в обе стороны, и об этом стоит сказать прямо, а не как о рекламном доводе в пользу той или иной стороны. Команды, которым нужен инференс внутри собственного тенанта, фиксированный чекпоинт, с которым можно сравнивать, или возможность дообучения на данных предметной области, выбирают между этими двумя моделями не по баллам в индексах. Они выбирают Qwen3.8-Flash-Next, потому что другой вариант ни за какую цену не даёт того, что им нужно. Команды, которым нужна управляемая конечная точка с опубликованной системной картой, документированным набором для оценки и обязательством по снятию с эксплуатации, выбирают другое направление, а веса — не та возможность, которую они собирались использовать.

Управление стороной фиксированных тарифов

Замечание о названии. Независимый совет регистрирует эту модель как Qwen3.8-Flash-Next; наш собственный каталог указывает тот же выпуск под более коротким именем вендора Qwen3.8 Flash, по идентичной цене $0.15 / $0.47 со ставкой $0.0184 за кэшированный ввод, и направляет свой репозиторий на веса Hugging Face, опубликованные 2026-08-26. Там, где приведённые ниже цифры взяты из Artificial Analysis, они относятся к записи, которую он называет Qwen3.8-Flash-Next. Это одна и та же модель; совет просто использует более длинное из её названий.

Qwen3.8-Flash-Next есть в каталоге OrcaRouter по прейскурантной цене провайдера с наценкой 0% — передаётся как есть, а не усредняется — так что указанные выше $0,15 и $0,47 — это тарифы прямо в счёте, и изменение на стороне Qwen отражается у нас в тот же день, а не при каком-то последующем пересмотре цен. Claude Sonnet 5.5 и Claude Opus 5.5 также есть в каталоге, что делает путь эскалации с небольшой модели на средний уровень Anthropic вопросом настройки маршрутизации, а не второй интеграцией. Один API для более чем 200 моделей, один ключ, автоматическое переключение при сбое под капотом, а также DSL маршрутизации, когда потолок затрат должен находиться в маршруте, а не в коде приложения.

Claude Haiku 5.5 отсутствует в каталоге. До неё можно добраться через собственный API Anthropic, а часть этого сравнения, касающаяся Anthropic, — не то, что мы предоставляем сегодня; лучше сказать об этом прямо, чем оставлять неясность.

A capture of the OrcaRouter model page for Qwen3.8 Flash under qwen/qwen3.8-flash, showing a maximum output of 131K, text, image and video input, benchmarks published by Qwen on 2026-08-26, and a price strip reading $0.15 input and $0.47 output per million tokens.

Какой из двух, и на каком основании

Если ваш трафик смещён в сторону входных данных, ваши промпты укладываются в 100 000 токенов, и вы платите за реальный объём, Claude Haiku 5.5 — более дешёвая модель по обеим тарифным ставкам и модель с более высокими оценками по шести из семи общих измерений — с той оговоркой, что и 30%-я разница в токенизаторе, и многословность Anthropic съедают часть скидки, которая выглядит больше на карточке, чем в счёте.

Если в вашем трафике преобладает вывод, или ваши промпты достаточно длинные, чтобы пересечь порог Anthropic, или вам нужна фиксированная ставка для прогнозирования, Qwen3.8-Flash-Next обходится дешевле — иногда в пять раз на выводе выше ступени — и именно эта модель выигрывает в строке агентного завершения с преимуществом в 20 пунктов.

Если вам нужны веса, то сравнение получается совсем не близким, и цена тут вообще ни при чём.

Две карты различаются меньше чем на три цента за миллион токенов при соотношении 3:1 — это достаточно близко, чтобы тариф не должен был решать дело. Решает то, в каком из этих трёх абзацев вы находитесь, а это вопрос о вашем пайплайне, а не о той или иной модели.