Главная карточка с заголовком «MiMo-V2.6-Pro vs MiMo-V2.6-Flash» и подзаголовком «Трёхкратная разница в цене — и что её не объясняет», и две панели: левая панель с заголовком «MiMo-V2.6-Pro» и текстом «$0.435 / $0.87 за 1M» и «42B активных параметров», и правая панель с заголовком «MiMo-V2.6-Flash» и текстом «$0.14 / $0.28 за 1M» и «15B активных параметров», над нижним колонтитулом с текстом «Оба под лицензией MIT · у обоих контекст 1M · индекс опубликован только для Pro».
Guides & Insights

MiMo-V2.6-Pro против MiMo-V2.6-Flash: трёхкратная разница в цене, которую не объясняют два бенчмарка

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

В собственных оценочных таблицах Xiaomi MiMo-V2.6-Flash превосходит MiMo-V2.6-Pro. Строка — CyberGym, и разрыв составляет 95,1 против 94,0. Это одна строка из пятнадцати, и именно поэтому стоит внимательно прочитать остальную часть этого сравнения, а не предполагать, что флагман всегда является ответом, — потому что MiMo-V2.6-Flash стоит примерно треть того, что стоит MiMo-V2.6-Pro, и по большинству строк они различаются лишь на несколько пунктов.

Обе модели были опубликованы в виде репозиториев Hugging Face 21 сентября 2026 года под лицензией MIT, с интервалом в восемнадцать секунд, как отдельные запуски обучения, а не ступени одной лестницы. Xiaomi MiMo-V2.6-Pro — это уровень на триллион параметров. MiMo-V2.6-Flash — это уровень эффективности. Вопрос, на который отвечает эта страница, — какая из них подходит для вашего продакшен-пути, и честный ответ зависит от числа, которого нет ни в одном из этих релизов.

Что представляет собой каждый

• Параметры — Xiaomi MiMo-V2.6-Pro: 1,02 трлн всего, 42 млрд активных на токен, против Xiaomi MiMo-V2.6-Flash — примерно 309 млрд всего и 15 млрд активных
• Архитектура — обе — разреженные смеси экспертов с нативным омнимодальным вводом; у Flash задокументированы 48 слоёв: 39 со скользящим окном и 9 с полным вниманием, размер скрытого слоя 4096, 256 маршрутизируемых экспертов, из которых 8 активны, и без общих экспертов, а также визуальный трансформер на 681 млн, аудиотокенизатор на 308 млн и кодировщик аудиопатчей на 127 млн
• Контекст — 1 млн токенов у обеих моделей, с выводом до 128 000 токенов у обеих
• Лицензия — MIT у обеих, веса без ограничений доступа у обеих
• Цена — $0,435 за вход и $0,87 за выход за миллион токенов для Pro, против $0,14 и $0,28 для Flash: разрыв в 3,1 раза с обеих сторон карточки
• Вход при попадании в кэш — $0,0036 за миллион у Pro, $0,0028 у Flash
• Расходы на обучение — Xiaomi сообщает о примерно $2,62 млн для RL-запуска Pro и $854 тыс. для Flash; каждый завершён менее чем за шесть дней в ходе 30 шагов обучения с подкреплением и около 750 000 траекторий
• Оценка в независимом индексе — 46 у Xiaomi MiMo-V2.6-Pro в Artificial Analysis Intelligence Index v4.3.2; для MiMo-V2.6-Flash не опубликована

За эту последнюю строку и стоит держаться. Всё, что выше неё, кроме оценки Pro, сообщено Xiaomi.

Где за тройную цену получаешь почти ничего

В Таблице 3 Xiaomi эти две модели сопоставлены на всех испытательных средах, на которых обучалась серия, а в долгосрочной агентной работе разрывы невелики:

• DeepSWE v1.1 — Pro 71.9, Flash 67.9
• MiMo Code Bench — Pro 63.2, Flash 61.2
• AutomationBench v1.0.6 — Pro 53.1, Flash 52.3
• Toolathlon-Verified — Pro 76.9, Flash 73.6
• Terminal Bench 2.1 — Pro 89.9, Flash 87.6
• OSWorld-Verified — Pro 82.0, Flash 80.8
• JobBench — Pro 62.0, Flash 61.2
• MiMo Visual Coding — Pro 72.3, Flash 71.5
• CyberGym — Pro 94.0, Flash 95.1
• MiMo Cyber Bench — Pro 80.2, Flash 77.2

Пройдитесь взглядом по этому столбцу сверху вниз — преимущество флагмана в основном составляет от одного до четырёх пунктов, а в одной строке он проигрывает вчистую. В рабочем процессе, где разница между 67,9 и 71,9 — это разница между выполнением задачи и её провалом, цена в три раза выше — это дёшево. А в рабочем процессе, где это разница между двумя приемлемыми ответами, — нет. Таблицы поставщиков с такими десятичными знаками провоцируют ложную точность: за пределами Xiaomi их никто не запускал, а разрыв в два пункта на внутреннем стенде оценки вполне укладывается в диапазон, который может сдвинуть другой оценщик или другая политика повторных попыток.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash — the scoreboard'. The left column, MiMo-V2.6-Pro, reads Active params 42B, Price $0.435 / $0.87, DeepSWE v1.1 71.9, CyberGym 94.0, ExploitGym 17.8, Independent index 46. The right column, MiMo-V2.6-Flash, reads Active params 15B, Price $0.14 / $0.28, DeepSWE v1.1 67.9, CyberGym 95.1, ExploitGym 6.0, Independent index none published. A footer reads 'All benchmark figures are Xiaomi's own runs; only the Pro index score is independent.'

Где оно много покупает

Есть группа строк, где разрыв перестаёт быть вопросом округления. Каждая из них — это работа по безопасности:

• ExploitGym — Pro 17.8, Flash 6.0
• ExploitBench — Pro 47.9, Flash 25.3
• SEC Bench Pro — Pro 66.3, Flash 47.5
• Agents' Last Exam — Pro 31.6, Flash 27.6
• Terminal Bench 4.0 — Pro 34.9, Flash 28.8

В ExploitGym флагманская модель втрое превосходит более дешёвую — тот же коэффициент, что и в цене, — а в SEC Bench Pro это 1,4x. Такая закономерность — ровно то, чего следует ожидать от модели с 42B активных параметров против модели с 15B: задача, требующая длинной цепочки рассуждений без частичного зачёта, — это как раз тот тип задач, где проявляется дополнительная мощность, а CyberGym, где картина обратная, — исключение, подтверждающее, что два запуска выучили разное, а не одно и то же в разных масштабах.

Так что это разделение соответствует реальной границе рабочих нагрузок, а не маркетинговой. Высокообъёмная работа агентов с терпимым критерием успеха — поиск информации, классификация, рутинные правки, вызовы, которые можно спасти повторной попыткой — это территория Flash. Работа, где неверный ответ дорого обходится, а частичный ответ бесполезен — разработка эксплойтов, проверка безопасности, терминальные сессии с многошаговым состоянием — это то, где уровень Pro оправдывает повышенную цену.

Число, которого не существует

У MiMo-V2.6-Flash нет страницы модели на Artificial Analysis. У его собрата она есть. Эта асимметрия — самое важное на этой странице, потому что она означает, что единственный независимо измеренный показатель во всей серии MiMo-V2.6 — это 46 рядом с Xiaomi MiMo-V2.6-Pro. Все приведённые выше показатели Flash — включая строку CyberGym, которую он выигрывает, — получены с помощью стенда Xiaomi, оценщика Xiaomi и офлайн-прогона Xiaomi.

Есть разумные основания полагать, что это временно: на момент написания модель существует всего один день, а независимая оценка требует времени. Есть также разумные основания полагать, что это структурно, поскольку Flash — это массовый сегмент, а массовые сегменты привлекают меньше внимания к бенчмаркингу. Как бы то ни было, практическое следствие на сегодня таково: вы не можете сравнивать Flash с чем-либо за пределами его собственного семейства с той же уверенностью, с какой можете сравнивать Pro. Если вы выбираете между Flash и моделью не от Xiaomi по критерию цена/качество, вы сравниваете заявленную вендором цифру с измеренным кем-то другим значением.

Обе карточки моделей содержат одну и ту же вторую оговорку. Ни один из репозиториев не развёрнут ни одним провайдером инференса — Hugging Face прямо заявляет об этом на каждой странице, а Artificial Analysis насчитала для Pro лишь одного API-провайдера. Мы не размещаем ни один из этих чекпоинтов, поэтому ни один из них не маршрутизируется через нас. Путь к обоим — собственная платформа Xiaomi и сторонние каталоги, в которых они представлены.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Flash-RL, showing the MIT licence tag and multimodal tags including 8-bit precision and fp8, a Safetensors panel reporting a model size of 159B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a model tree listing one finetune and six quantizations, and a collection block headed MiMo-V2.6 holding three items.

Цена, которую вы платите, — это оборудование, а не токены.

Цена за токен — это лишь половина того, во что вам обходится чекпоинт, и на диске эти две величины расходятся гораздо резче, чем в тарифной сетке. MiMo-V2.6-Flash публикует 172,9 ГБ FP8-весов, разбитых на 65 шардов. Xiaomi MiMo-V2.6-Pro содержит примерно в три раза больше параметров, из-за чего её исходная загрузка до любой квантизации попадает в диапазон полутерабайта — а её собственный репозиторий сообщает о размере Safetensors-модели в 524 млрд параметров, цифра, которая не согласуется ни с общим количеством 1,02 трлн, ни с числом активных параметров 42 млрд.

Этот разрыв меняет характер решения. Flash при 172,9 ГБ — это модель, которую небольшая команда может самостоятельно разместить на арендованных мощностях и воспринимать как обычный товар. Pro при примерно втрое большем размере — это уже решение уровня кластера: материалы вокруг запуска оценивали два обучающих прогона примерно в 4 000 и 8 000 GPU, эквивалентных H200, соответственно. Если вы рассматриваете открытые веса потому, что хотите иметь возможность перестать платить за токен, эти два чекпойнта дают такую возможность при очень разных масштабах обязательств.

Выбирая между ними

Правило, которое остаётся в силе с учётом вышеприведённых оговорок, — выбирать по классу рабочей нагрузки, а не по среднему показателю бенчмарков. Flash — для всего, что вы не против повторить; Pro — для всего, где повторная попытка не спасёт. Затем измеряйте, потому что ни у одной из моделей нет независимой оценки по бенчмаркам, которые вас действительно волнуют.

Измерение двух чекпоинтов бок о бок — это то, где роутер делает то, чего не может контракт на отдельную модель. Размещение дешёвого уровня на основной массе вашего трафика с эскалацией только сложных случаев на дорогой — это то же самое решение, что и на этой странице, выраженное через конфигурацию, а не через переписывание, — и именно для такой композиции и существует слой маршрутизации. Это важно и для самой цены: мы передаём прейскурантную цену провайдера с наценкой 0%, поэтому если Xiaomi снизит тариф на любом из чекпоинтов, цифра на нашей стороне изменится в тот же день, а не при следующем продлении контракта. Это относится к моделям, которые мы предлагаем. Что касается конкретно пары MiMo-V2.6, сегодня вы по-прежнему покупаете напрямую у Xiaomi.

Что бы это уладило

Две вещи превратили бы это из оценочного суждения в арифметический расчёт. Страница Artificial Analysis для MiMo-V2.6-Flash поставила бы оба чекпоинта на ту же ось стоимости за задачу, которая сейчас помещает Pro на $0.133 за задачу Intelligence Index, и сравнение разрешилось бы само собой. Независимая репликация кластера безопасности — ExploitGym, ExploitBench, SEC Bench Pro — подтвердила бы, является ли трёхкратный разрыв в этих строках свойством модели или свойством грейдера.

До тех пор защитимая позиция такова: Xiaomi MiMo-V2.6-Flash — более выгодная покупка для большинства команд в большинстве случаев, а Xiaomi MiMo-V2.6-Pro — более выгодная покупка для узкого класса работ, где неудача обходится дорого. Единственная строка, в которой побеждает Flash, этого не опровергает — но это полезное напоминание о том, что премия флагмана — это утверждение о рабочей нагрузке, а не о модели.

Screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, showing the Xiaomi attribution and 'Released September 2026', an Intelligence card reading 46 ranked #1 of 114, a Speed card reading 125.2 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.13 cost per Intelligence Index task, and a Verbosity card reading 140M output tokens, with a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.