Сгенерированная титульная карточка для «Claude Haiku 5.5 vs Xiaomi MiMo-V2.6-Flash», где названия двух моделей расположены по обе стороны от разделителя, с подписью «Дешевле за токен, дешевле за задачу, но решение всё равно не одно и то же», над нижним колонтитулом «Тарифы опубликованы поставщиками; стоимость задач — по данным Artificial Analysis». Настоящий логотип OrcaRouter скомпонован в правом нижнем углу.
Guides & Insights

Claude Haiku 5.5 против Xiaomi MiMo-V2.6-Flash: когда тарифная карта и фактический счёт не совпадают

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Если принимать обе тарифные карточки за чистую монету, то в противостоянии Claude Haiku 5.5 и Xiaomi MiMo-V2.6-Flash победа модели Xiaomi кажется разгромной: $0.14 и $0.28 за миллион токенов против $0.10 и $0.50 — преимущество в 1,8 раза на выходе при фиксированной ставке, а не при такой, что повышается после 100 000 токенов. Но стоит посмотреть, во сколько на самом деле обходятся независимые прогоны задач, — и порядок меняется на противоположный: MiMo-V2.6-Flash укладывается в $0.06231, чтобы выполнить задачу, которую Haiku выполняет за $0.2128, и всё же Haiku набирает на пятнадцать процентов больше баллов на той же таблице и справляется с задачей за треть реального времени. Ни одно из этих четырёх утверждений не ошибочно; они просто измеряют разные вещи. Этот материал о том, какое из них предсказывает ваш счёт, и где каждое из них перестаёт быть полезным.

Две тарифные карты

Начните с цифр, которые публикует каждый вендор, потому что именно их сравнивают, а в большинстве случаев важны совсем не они:

• Цена — Claude Haiku 5.5: $0.10 / $0.50 за миллион при объёме до 100 тыс. токенов, $0.50 / $2.50 при превышении (прайс-лист A​nthropic); X​iaomi MiMo-V2.6-Flash: $0.14 / $0.28 фиксированно (прайс-лист вендора)

• Контекстное окно — 1 000 000 токенов для Claude Haiku 5.5, 1 000 000 для MiMo-V2.6-Flash, оба опубликованы производителями

• Максимальный вывод — 128 000 токенов в Haiku (300 000 в Batch); не заявлен как отдельный потолок для MiMo-V2.6-Flash

• Архитектура — не раскрыта для Haiku; 309B общих параметров при 15B активных, Mixture-of-Experts, для MiMo-V2.6-Flash (опубликовано производителем)

• Лицензия — закрытая, доступ только через API для Haiku; MIT для MiMo-V2.6-Flash (опубликовано вендором)

• Независимый индекс — 43,395 у Claude Haiku 5.5 против 37,884 у MiMo-V2.6-Flash (Artificial Analysis)

Три из этих строк определяют большинство реальных покупок, и они указывают в трёх разных направлениях. По цене вывода модель X​iaomi дешевле — $0.28 против $0.50 при коротком контексте. По цене ввода Haiku дешевле ниже 100 000 токенов и намного дороже выше. По размеру контекстного окна модель X​iaomi заявляет вдвое больше места. Только один из этих трёх — последний — вообще является заявлением о возможностях, а ступенька фиксированного тарифа у Haiku на 100 000 токенов означает, что в сравнении цен есть стык, который скрывается одной парой чисел.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Xiaomi MiMo-V2.6-Flash — the scoreboard'. Left column Claude Haiku 5.5: input price (short) $0.10 per million, output price (short) $0.50 per million, context window 1,000,000 tokens, weights closed and API-only, cost per task $0.2128, seconds per task 426. Right column Xiaomi MiMo-V2.6-Flash: input price (flat) $0.14 per million, output price (flat) $0.28 per million, context window 1,000,000 tokens, weights open under MIT, cost per task $0.0623, seconds per task 1,320. Footer reads 'Task costs and timings per Artificial Analysis; prices vendor-published.' The real OrcaRouter logo is composited bottom-right.

Рассчитанный счёт

В прайс-листах указана цена токенов. Работа стоит денег. Artificial Analysis прогоняет обе модели через один и тот же набор задач и публикует, сколько на самом деле стоило выполнить каждую задачу, — это иная величина, чем цена за токен, и зачастую это совсем иной рейтинг:

• Стоимость одной задачи — MiMo-V2.6-Flash $0,06231 против Claude Haiku 5.5 $0,2128

• Токены вывода на задачу — MiMo-V2.6-Flash 77,792 против Claude Haiku 5.5 162,164

• Реальное время на задачу — MiMo-V2.6-Flash 1 320,08 с против Claude Haiku 5.5 426,26 с

• Индекс интеллекта — Claude Haiku 5.5 43.395 против MiMo-V2.6-Flash 37.884

• Terminal-Bench Hard — Claude Haiku 5.5 0.329 против MiMo-V2.6-Flash 0.227

Все пять показателей — от Artificial Analysis, они взяты с собственных страниц моделей этого лидерборда в начале октября 2026 года, и именно эти числа стоит использовать, когда решение должно выдержать чью-либо проверку.

Разрыв в стоимости за задачу больше, чем следует из тарифной сетки, и причина — во второй строке. Claude Haiku 5.5 расходует 162 164 выходных токена на выполнение задачи, которую MiMo-V2.6-Flash выполняет за 77 792 — примерно в 2,1 раза больше токенов, в основном потому, что по умолчанию ведёт длинные рассуждения. Модель, которая в 1,8 раза дешевле за выходной токен и выдаёт менее половины такого количества токенов на задачу, в итоге оказывается дешевле не в 1,8 раза; на этом конкретном наборе тестов она оказывается дешевле почти на порядок. Это самое важное на этой странице, и ни одна тарифная сетка нигде этого не публикует.

Линия реального времени идёт в противоположном направлении, и об этом стоит сказать честно. MiMo-V2.6-Flash выполнял задачу за 1 320 секунд против 426 у Haiku — втрое дольше, несмотря на более высокую измеренную скорость вывода 56,69 токена в секунду, потому что рассуждения Haiku не являются узким местом в этом наборе тестов так, как можно было бы предсказать по чистой скорости токенов. Если рабочая нагрузка ограничена задержкой, а не стоимостью, дешёвая модель не становится автоматически правильным выбором, и независимый стенд — единственное место, где существуют оба этих числа.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Flash, marked 'Open weights model' and 'Released September 2026', showing its Intelligence Index rank of #8 of 117, a speed measured at 56.7 output tokens per second, and the comparison summary.

Где на самом деле находятся эти пятнадцать пунктов

43,395 против 37,884 — это пятнадцатипроцентный разрыв в Индексе интеллекта, и это самый сильный аргумент в пользу Haiku в этом противостоянии. Имеет ли это значение, полностью зависит от задачи. В Terminal-Bench Hard у них 0,329 и 0,227 — более широкий относительный разрыв, и он находится на агентной, многошаговой стороне доски, где пятнадцатипроцентная разница в индексе обычно превращается в гораздо большую разницу в выполнении задач. На суббенчмарках общего рассуждения и знаний они ближе, чем подразумевает главный индекс, и MiMo-V2.6-Flash опережает по нескольким из них.

Практическая трактовка: в нижней части кривой сложности две модели взаимозаменяемы, и решение должна определять разница в стоимости. В верхней части — агенты с длинным горизонтом, кодовые базы, всё, где проваленную задачу приходится перезапускать, — пятнадцать баллов Haiku это разница между задачей, которая завершается, и задачей, которая стоит тех же денег дважды, а преимущество дешёвой модели по стоимости за задачу может инвертироваться так, как среднее по таблице лидеров вам не покажет. Это тот случай, когда нужно запускать собственную оценку, а не читать чужой индекс, потому что никакое опубликованное среднее этого не разрешает.

Чего стоит лицензия MIT

MiMo-V2.6-Flash поставляется под лицензией MIT — самой неограничительной из открытых лицензий, без потолка для коммерческого использования и без условия share-alike. Это более широкая лицензия, чем Q​wen Community Licence, и она означает, что веса MoE 309B/15B может разместить у себя, дообучить и распространять любой желающий. Для команды, чьё ограничение состоит в том, что инференс должен выполняться на её собственном оборудовании, или чей объём достаточно велик, чтобы владеть GPU было выгоднее, чем арендовать токены, это не сноска — это единственный пункт сравнения, который имеет значение, потому что Claude Haiku 5.5 вы не можете запустить вообще.

Это также меняет профиль отказов. Закрытая модель, обслуживаемая одним поставщиком и облачными партнёрами этого поставщика, выходит из строя, когда выходят из строя они; модель под лицензией MIT с несколькими независимыми хостами можно переключать между ними при отказе — при условии, что кто-то выполняет это переключение. Ни то, ни другое не является причиной выбирать MiMo-V2.6-Flash для команды, которой нужен API и ничего больше. И то, и другое имеет решающее значение для команды, которая к таковым не относится.

Утверждения вендоров, которые стоит проверить самостоятельно

Линейка MiMo принадлежит Xiaomi, и Xiaomi приводит собственные показатели скорости и качества в материалах запуска. Это цифры производителя, не воспроизведённые на момент написания, а независимая комиссия сейчас оценивает модель ниже того, куда её поместила бы трактовка производителя, — 37,884 по индексу и 0,227 в Terminal-Bench Hard против 0,329 у Haiku. Это не обвинение в чей-либо адрес; это обычный разрыв между собственным тестовым стендом производителя и стендом третьей стороны, и именно поэтому каждый раз, когда повторяется та или иная цифра, нужно указывать, откуда она.

Проверка, которую стоит провести на собственном трафике, занимает полдня и решает вопрос лучше любого рейтинга. Прогоните одни и те же двадцать задач через обе модели со своими промптами, зафиксируйте входные токены, выходные токены и реальное время выполнения по каждой задаче для каждой модели и умножьте на тарифы выше. Четыре числа, которые всё решают, — это всё то, что можно измерить: токены на входе, токены на выходе, секунды и то, была ли задача решена успешно. Показатель стоимости за задачу на независимом рейтинге — это картина для типового набора задач; ваш будет отличаться, и разница между ними обычно кроется в многословности — именно том, что скрывает тарифная сетка. Если рассуждения Haiku по умолчанию дают вам завершённые задачи, за повторную попытку с которыми вы иначе платили бы, то это дёшево даже при цене за задачу в 3,4 раза выше. Если нет, вы платите за токены, которые не изменили ответ.

Получение обоих через одну конечную точку

Ни Claude Haiku 5.5, ни X​iaomi MiMo-V2.6-Flash не обслуживаются OrcaRouter — для них нужно обращаться к собственному API поставщика и нескольким сторонним платформам. А мы предоставляем сопутствующий состав: qwen/qwen3.8-flash по $0.15 и $0.47 за миллион и z-ai/glm-5.3-flash по $0.15 и $0.50, оба по прейскурантной цене поставщика, на том же ключе и в том же счёте, что и каталог из более чем 200 моделей со сквозным ценообразованием и автоматическим переключением при сбое.

Для этого противостояния это важно вполне конкретным образом: когда две модели, между которыми вы выбираете, — это те, которые вы не можете маршрутизировать, решающий фактор обычно определяется запуском их бок о бок на реальном трафике — а значит, их нужно держать доступными рядом с моделями, которые вы маршрутизируете, без второго контракта или второго SDK ни для одной из них. Поставьте кандидата на продакшн-путь, подстраховав его работающей моделью в качестве фолбэка, позвольте запросу уйти к той, которую выберет слой маршрутизации, и пусть ваши собственные логи токенов дадут показатель стоимости за задачу, который тарифные карты отказались вам предоставить. Набор тестов независимого совета — это прокси; ваша рабочая нагрузка — это измерение.

A screenshot of the OrcaRouter models index, headed 'Models — 207 models' with the line '16 providers: one API key, one bill', a filter row for input modalities, context length, input price, status, series and supported parameters, and the first steps of the 'How to call any model' walkthrough.

Звонок

Если рабочая нагрузка предполагает большой объём, короткий вывод и допускает периодические повторные попытки, Xiaomi MiMo-V2.6-Flash — более дешёвая модель, причём с более широким отрывом, чем указано в её тарифной сетке: $0.06231 за задачу против $0.2128, — а лицензия MIT даёт вам спасательный люк, которого нет у Haiku. Если рабочая нагрузка долгосрочная и агентная, пятнадцать пунктов индекса и втрое более быстрое выполнение задач у Claude Haiku 5.5 оправдывают многократную разницу в цене, а разрыв в стоимости сокращается или меняет знак, если учесть повторные попытки.

Единственное, чего делать не стоит, — выбирать только по тарифной сетке. Две модели здесь различаются по цене менее чем вдвое за токен, но на одну завершённую задачу их стоимость расходится на порядок, и только одно из этих чисел есть на странице, которую показывает вам поставщик.

каталог из более чем 200 моделей

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно