
Claude Haiku 5.5 против Xiaomi MiMo-V2.6-Flash: когда тарифная карта и фактический счёт не совпадают
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 57 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 345 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Если принимать обе тарифные карточки за чистую монету, то в противостоянии Claude Haiku 5.5 и Xiaomi MiMo-V2.6-Flash победа модели Xiaomi кажется разгромной: $0.14 и $0.28 за миллион токенов против $0.10 и $0.50 — преимущество в 1,8 раза на выходе при фиксированной ставке, а не при такой, что повышается после 100 000 токенов. Но стоит посмотреть, во сколько на самом деле обходятся независимые прогоны задач, — и порядок меняется на противоположный: MiMo-V2.6-Flash укладывается в $0.06231, чтобы выполнить задачу, которую Haiku выполняет за $0.2128, и всё же Haiku набирает на пятнадцать процентов больше баллов на той же таблице и справляется с задачей за треть реального времени. Ни одно из этих четырёх утверждений не ошибочно; они просто измеряют разные вещи. Этот материал о том, какое из них предсказывает ваш счёт, и где каждое из них перестаёт быть полезным.
Две тарифные карты
Начните с цифр, которые публикует каждый вендор, потому что именно их сравнивают, а в большинстве случаев важны совсем не они:
• Цена — Claude Haiku 5.5: $0.10 / $0.50 за миллион при объёме до 100 тыс. токенов, $0.50 / $2.50 при превышении (прайс-лист Anthropic); Xiaomi MiMo-V2.6-Flash: $0.14 / $0.28 фиксированно (прайс-лист вендора)
• Контекстное окно — 1 000 000 токенов для Claude Haiku 5.5, 1 000 000 для MiMo-V2.6-Flash, оба опубликованы производителями
• Максимальный вывод — 128 000 токенов в Haiku (300 000 в Batch); не заявлен как отдельный потолок для MiMo-V2.6-Flash
• Архитектура — не раскрыта для Haiku; 309B общих параметров при 15B активных, Mixture-of-Experts, для MiMo-V2.6-Flash (опубликовано производителем)
• Лицензия — закрытая, доступ только через API для Haiku; MIT для MiMo-V2.6-Flash (опубликовано вендором)
• Независимый индекс — 43,395 у Claude Haiku 5.5 против 37,884 у MiMo-V2.6-Flash (Artificial Analysis)
Три из этих строк определяют большинство реальных покупок, и они указывают в трёх разных направлениях. По цене вывода модель Xiaomi дешевле — $0.28 против $0.50 при коротком контексте. По цене ввода Haiku дешевле ниже 100 000 токенов и намного дороже выше. По размеру контекстного окна модель Xiaomi заявляет вдвое больше места. Только один из этих трёх — последний — вообще является заявлением о возможностях, а ступенька фиксированного тарифа у Haiku на 100 000 токенов означает, что в сравнении цен есть стык, который скрывается одной парой чисел.

Рассчитанный счёт
В прайс-листах указана цена токенов. Работа стоит денег. Artificial Analysis прогоняет обе модели через один и тот же набор задач и публикует, сколько на самом деле стоило выполнить каждую задачу, — это иная величина, чем цена за токен, и зачастую это совсем иной рейтинг:
• Стоимость одной задачи — MiMo-V2.6-Flash $0,06231 против Claude Haiku 5.5 $0,2128
• Токены вывода на задачу — MiMo-V2.6-Flash 77,792 против Claude Haiku 5.5 162,164
• Реальное время на задачу — MiMo-V2.6-Flash 1 320,08 с против Claude Haiku 5.5 426,26 с
• Индекс интеллекта — Claude Haiku 5.5 43.395 против MiMo-V2.6-Flash 37.884
• Terminal-Bench Hard — Claude Haiku 5.5 0.329 против MiMo-V2.6-Flash 0.227
Все пять показателей — от Artificial Analysis, они взяты с собственных страниц моделей этого лидерборда в начале октября 2026 года, и именно эти числа стоит использовать, когда решение должно выдержать чью-либо проверку.
Разрыв в стоимости за задачу больше, чем следует из тарифной сетки, и причина — во второй строке. Claude Haiku 5.5 расходует 162 164 выходных токена на выполнение задачи, которую MiMo-V2.6-Flash выполняет за 77 792 — примерно в 2,1 раза больше токенов, в основном потому, что по умолчанию ведёт длинные рассуждения. Модель, которая в 1,8 раза дешевле за выходной токен и выдаёт менее половины такого количества токенов на задачу, в итоге оказывается дешевле не в 1,8 раза; на этом конкретном наборе тестов она оказывается дешевле почти на порядок. Это самое важное на этой странице, и ни одна тарифная сетка нигде этого не публикует.
Линия реального времени идёт в противоположном направлении, и об этом стоит сказать честно. MiMo-V2.6-Flash выполнял задачу за 1 320 секунд против 426 у Haiku — втрое дольше, несмотря на более высокую измеренную скорость вывода 56,69 токена в секунду, потому что рассуждения Haiku не являются узким местом в этом наборе тестов так, как можно было бы предсказать по чистой скорости токенов. Если рабочая нагрузка ограничена задержкой, а не стоимостью, дешёвая модель не становится автоматически правильным выбором, и независимый стенд — единственное место, где существуют оба этих числа.

Где на самом деле находятся эти пятнадцать пунктов
43,395 против 37,884 — это пятнадцатипроцентный разрыв в Индексе интеллекта, и это самый сильный аргумент в пользу Haiku в этом противостоянии. Имеет ли это значение, полностью зависит от задачи. В Terminal-Bench Hard у них 0,329 и 0,227 — более широкий относительный разрыв, и он находится на агентной, многошаговой стороне доски, где пятнадцатипроцентная разница в индексе обычно превращается в гораздо большую разницу в выполнении задач. На суббенчмарках общего рассуждения и знаний они ближе, чем подразумевает главный индекс, и MiMo-V2.6-Flash опережает по нескольким из них.
Практическая трактовка: в нижней части кривой сложности две модели взаимозаменяемы, и решение должна определять разница в стоимости. В верхней части — агенты с длинным горизонтом, кодовые базы, всё, где проваленную задачу приходится перезапускать, — пятнадцать баллов Haiku это разница между задачей, которая завершается, и задачей, которая стоит тех же денег дважды, а преимущество дешёвой модели по стоимости за задачу может инвертироваться так, как среднее по таблице лидеров вам не покажет. Это тот случай, когда нужно запускать собственную оценку, а не читать чужой индекс, потому что никакое опубликованное среднее этого не разрешает.
Чего стоит лицензия MIT
MiMo-V2.6-Flash поставляется под лицензией MIT — самой неограничительной из открытых лицензий, без потолка для коммерческого использования и без условия share-alike. Это более широкая лицензия, чем Qwen Community Licence, и она означает, что веса MoE 309B/15B может разместить у себя, дообучить и распространять любой желающий. Для команды, чьё ограничение состоит в том, что инференс должен выполняться на её собственном оборудовании, или чей объём достаточно велик, чтобы владеть GPU было выгоднее, чем арендовать токены, это не сноска — это единственный пункт сравнения, который имеет значение, потому что Claude Haiku 5.5 вы не можете запустить вообще.
Это также меняет профиль отказов. Закрытая модель, обслуживаемая одним поставщиком и облачными партнёрами этого поставщика, выходит из строя, когда выходят из строя они; модель под лицензией MIT с несколькими независимыми хостами можно переключать между ними при отказе — при условии, что кто-то выполняет это переключение. Ни то, ни другое не является причиной выбирать MiMo-V2.6-Flash для команды, которой нужен API и ничего больше. И то, и другое имеет решающее значение для команды, которая к таковым не относится.
Утверждения вендоров, которые стоит проверить самостоятельно
Линейка MiMo принадлежит Xiaomi, и Xiaomi приводит собственные показатели скорости и качества в материалах запуска. Это цифры производителя, не воспроизведённые на момент написания, а независимая комиссия сейчас оценивает модель ниже того, куда её поместила бы трактовка производителя, — 37,884 по индексу и 0,227 в Terminal-Bench Hard против 0,329 у Haiku. Это не обвинение в чей-либо адрес; это обычный разрыв между собственным тестовым стендом производителя и стендом третьей стороны, и именно поэтому каждый раз, когда повторяется та или иная цифра, нужно указывать, откуда она.
Проверка, которую стоит провести на собственном трафике, занимает полдня и решает вопрос лучше любого рейтинга. Прогоните одни и те же двадцать задач через обе модели со своими промптами, зафиксируйте входные токены, выходные токены и реальное время выполнения по каждой задаче для каждой модели и умножьте на тарифы выше. Четыре числа, которые всё решают, — это всё то, что можно измерить: токены на входе, токены на выходе, секунды и то, была ли задача решена успешно. Показатель стоимости за задачу на независимом рейтинге — это картина для типового набора задач; ваш будет отличаться, и разница между ними обычно кроется в многословности — именно том, что скрывает тарифная сетка. Если рассуждения Haiku по умолчанию дают вам завершённые задачи, за повторную попытку с которыми вы иначе платили бы, то это дёшево даже при цене за задачу в 3,4 раза выше. Если нет, вы платите за токены, которые не изменили ответ.
Получение обоих через одну конечную точку
Ни Claude Haiku 5.5, ни Xiaomi MiMo-V2.6-Flash не обслуживаются OrcaRouter — для них нужно обращаться к собственному API поставщика и нескольким сторонним платформам. А мы предоставляем сопутствующий состав: qwen/qwen3.8-flash по $0.15 и $0.47 за миллион и z-ai/glm-5.3-flash по $0.15 и $0.50, оба по прейскурантной цене поставщика, на том же ключе и в том же счёте, что и каталог из более чем 200 моделей со сквозным ценообразованием и автоматическим переключением при сбое.
Для этого противостояния это важно вполне конкретным образом: когда две модели, между которыми вы выбираете, — это те, которые вы не можете маршрутизировать, решающий фактор обычно определяется запуском их бок о бок на реальном трафике — а значит, их нужно держать доступными рядом с моделями, которые вы маршрутизируете, без второго контракта или второго SDK ни для одной из них. Поставьте кандидата на продакшн-путь, подстраховав его работающей моделью в качестве фолбэка, позвольте запросу уйти к той, которую выберет слой маршрутизации, и пусть ваши собственные логи токенов дадут показатель стоимости за задачу, который тарифные карты отказались вам предоставить. Набор тестов независимого совета — это прокси; ваша рабочая нагрузка — это измерение.

Звонок
Если рабочая нагрузка предполагает большой объём, короткий вывод и допускает периодические повторные попытки, Xiaomi MiMo-V2.6-Flash — более дешёвая модель, причём с более широким отрывом, чем указано в её тарифной сетке: $0.06231 за задачу против $0.2128, — а лицензия MIT даёт вам спасательный люк, которого нет у Haiku. Если рабочая нагрузка долгосрочная и агентная, пятнадцать пунктов индекса и втрое более быстрое выполнение задач у Claude Haiku 5.5 оправдывают многократную разницу в цене, а разрыв в стоимости сокращается или меняет знак, если учесть повторные попытки.
Единственное, чего делать не стоит, — выбирать только по тарифной сетке. Две модели здесь различаются по цене менее чем вдвое за токен, но на одну завершённую задачу их стоимость расходится на порядок, и только одно из этих чисел есть на странице, которую показывает вам поставщик.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
