
MiMo-V2.6-Pro против MiMo-V2.6-Flash: трёхкратная разница в цене, которую не объясняют два бенчмарка
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
В собственных оценочных таблицах Xiaomi MiMo-V2.6-Flash превосходит MiMo-V2.6-Pro. Строка — CyberGym, и разрыв составляет 95,1 против 94,0. Это одна строка из пятнадцати, и именно поэтому стоит внимательно прочитать остальную часть этого сравнения, а не предполагать, что флагман всегда является ответом, — потому что MiMo-V2.6-Flash стоит примерно треть того, что стоит MiMo-V2.6-Pro, и по большинству строк они различаются лишь на несколько пунктов.
Обе модели были опубликованы в виде репозиториев Hugging Face 21 сентября 2026 года под лицензией MIT, с интервалом в восемнадцать секунд, как отдельные запуски обучения, а не ступени одной лестницы. Xiaomi MiMo-V2.6-Pro — это уровень на триллион параметров. MiMo-V2.6-Flash — это уровень эффективности. Вопрос, на который отвечает эта страница, — какая из них подходит для вашего продакшен-пути, и честный ответ зависит от числа, которого нет ни в одном из этих релизов.
Что представляет собой каждый
• Параметры — Xiaomi MiMo-V2.6-Pro: 1,02 трлн всего, 42 млрд активных на токен, против Xiaomi MiMo-V2.6-Flash — примерно 309 млрд всего и 15 млрд активных
• Архитектура — обе — разреженные смеси экспертов с нативным омнимодальным вводом; у Flash задокументированы 48 слоёв: 39 со скользящим окном и 9 с полным вниманием, размер скрытого слоя 4096, 256 маршрутизируемых экспертов, из которых 8 активны, и без общих экспертов, а также визуальный трансформер на 681 млн, аудиотокенизатор на 308 млн и кодировщик аудиопатчей на 127 млн
• Контекст — 1 млн токенов у обеих моделей, с выводом до 128 000 токенов у обеих
• Лицензия — MIT у обеих, веса без ограничений доступа у обеих
• Цена — $0,435 за вход и $0,87 за выход за миллион токенов для Pro, против $0,14 и $0,28 для Flash: разрыв в 3,1 раза с обеих сторон карточки
• Вход при попадании в кэш — $0,0036 за миллион у Pro, $0,0028 у Flash
• Расходы на обучение — Xiaomi сообщает о примерно $2,62 млн для RL-запуска Pro и $854 тыс. для Flash; каждый завершён менее чем за шесть дней в ходе 30 шагов обучения с подкреплением и около 750 000 траекторий
• Оценка в независимом индексе — 46 у Xiaomi MiMo-V2.6-Pro в Artificial Analysis Intelligence Index v4.3.2; для MiMo-V2.6-Flash не опубликована
За эту последнюю строку и стоит держаться. Всё, что выше неё, кроме оценки Pro, сообщено Xiaomi.
Где за тройную цену получаешь почти ничего
В Таблице 3 Xiaomi эти две модели сопоставлены на всех испытательных средах, на которых обучалась серия, а в долгосрочной агентной работе разрывы невелики:
• DeepSWE v1.1 — Pro 71.9, Flash 67.9
• MiMo Code Bench — Pro 63.2, Flash 61.2
• AutomationBench v1.0.6 — Pro 53.1, Flash 52.3
• Toolathlon-Verified — Pro 76.9, Flash 73.6
• Terminal Bench 2.1 — Pro 89.9, Flash 87.6
• OSWorld-Verified — Pro 82.0, Flash 80.8
• JobBench — Pro 62.0, Flash 61.2
• MiMo Visual Coding — Pro 72.3, Flash 71.5
• CyberGym — Pro 94.0, Flash 95.1
• MiMo Cyber Bench — Pro 80.2, Flash 77.2
Пройдитесь взглядом по этому столбцу сверху вниз — преимущество флагмана в основном составляет от одного до четырёх пунктов, а в одной строке он проигрывает вчистую. В рабочем процессе, где разница между 67,9 и 71,9 — это разница между выполнением задачи и её провалом, цена в три раза выше — это дёшево. А в рабочем процессе, где это разница между двумя приемлемыми ответами, — нет. Таблицы поставщиков с такими десятичными знаками провоцируют ложную точность: за пределами Xiaomi их никто не запускал, а разрыв в два пункта на внутреннем стенде оценки вполне укладывается в диапазон, который может сдвинуть другой оценщик или другая политика повторных попыток.

Где оно много покупает
Есть группа строк, где разрыв перестаёт быть вопросом округления. Каждая из них — это работа по безопасности:
• ExploitGym — Pro 17.8, Flash 6.0
• ExploitBench — Pro 47.9, Flash 25.3
• SEC Bench Pro — Pro 66.3, Flash 47.5
• Agents' Last Exam — Pro 31.6, Flash 27.6
• Terminal Bench 4.0 — Pro 34.9, Flash 28.8
В ExploitGym флагманская модель втрое превосходит более дешёвую — тот же коэффициент, что и в цене, — а в SEC Bench Pro это 1,4x. Такая закономерность — ровно то, чего следует ожидать от модели с 42B активных параметров против модели с 15B: задача, требующая длинной цепочки рассуждений без частичного зачёта, — это как раз тот тип задач, где проявляется дополнительная мощность, а CyberGym, где картина обратная, — исключение, подтверждающее, что два запуска выучили разное, а не одно и то же в разных масштабах.
Так что это разделение соответствует реальной границе рабочих нагрузок, а не маркетинговой. Высокообъёмная работа агентов с терпимым критерием успеха — поиск информации, классификация, рутинные правки, вызовы, которые можно спасти повторной попыткой — это территория Flash. Работа, где неверный ответ дорого обходится, а частичный ответ бесполезен — разработка эксплойтов, проверка безопасности, терминальные сессии с многошаговым состоянием — это то, где уровень Pro оправдывает повышенную цену.
Число, которого не существует
У MiMo-V2.6-Flash нет страницы модели на Artificial Analysis. У его собрата она есть. Эта асимметрия — самое важное на этой странице, потому что она означает, что единственный независимо измеренный показатель во всей серии MiMo-V2.6 — это 46 рядом с Xiaomi MiMo-V2.6-Pro. Все приведённые выше показатели Flash — включая строку CyberGym, которую он выигрывает, — получены с помощью стенда Xiaomi, оценщика Xiaomi и офлайн-прогона Xiaomi.
Есть разумные основания полагать, что это временно: на момент написания модель существует всего один день, а независимая оценка требует времени. Есть также разумные основания полагать, что это структурно, поскольку Flash — это массовый сегмент, а массовые сегменты привлекают меньше внимания к бенчмаркингу. Как бы то ни было, практическое следствие на сегодня таково: вы не можете сравнивать Flash с чем-либо за пределами его собственного семейства с той же уверенностью, с какой можете сравнивать Pro. Если вы выбираете между Flash и моделью не от Xiaomi по критерию цена/качество, вы сравниваете заявленную вендором цифру с измеренным кем-то другим значением.
Обе карточки моделей содержат одну и ту же вторую оговорку. Ни один из репозиториев не развёрнут ни одним провайдером инференса — Hugging Face прямо заявляет об этом на каждой странице, а Artificial Analysis насчитала для Pro лишь одного API-провайдера. Мы не размещаем ни один из этих чекпоинтов, поэтому ни один из них не маршрутизируется через нас. Путь к обоим — собственная платформа Xiaomi и сторонние каталоги, в которых они представлены.

Цена, которую вы платите, — это оборудование, а не токены.
Цена за токен — это лишь половина того, во что вам обходится чекпоинт, и на диске эти две величины расходятся гораздо резче, чем в тарифной сетке. MiMo-V2.6-Flash публикует 172,9 ГБ FP8-весов, разбитых на 65 шардов. Xiaomi MiMo-V2.6-Pro содержит примерно в три раза больше параметров, из-за чего её исходная загрузка до любой квантизации попадает в диапазон полутерабайта — а её собственный репозиторий сообщает о размере Safetensors-модели в 524 млрд параметров, цифра, которая не согласуется ни с общим количеством 1,02 трлн, ни с числом активных параметров 42 млрд.
Этот разрыв меняет характер решения. Flash при 172,9 ГБ — это модель, которую небольшая команда может самостоятельно разместить на арендованных мощностях и воспринимать как обычный товар. Pro при примерно втрое большем размере — это уже решение уровня кластера: материалы вокруг запуска оценивали два обучающих прогона примерно в 4 000 и 8 000 GPU, эквивалентных H200, соответственно. Если вы рассматриваете открытые веса потому, что хотите иметь возможность перестать платить за токен, эти два чекпойнта дают такую возможность при очень разных масштабах обязательств.
Выбирая между ними
Правило, которое остаётся в силе с учётом вышеприведённых оговорок, — выбирать по классу рабочей нагрузки, а не по среднему показателю бенчмарков. Flash — для всего, что вы не против повторить; Pro — для всего, где повторная попытка не спасёт. Затем измеряйте, потому что ни у одной из моделей нет независимой оценки по бенчмаркам, которые вас действительно волнуют.
Измерение двух чекпоинтов бок о бок — это то, где роутер делает то, чего не может контракт на отдельную модель. Размещение дешёвого уровня на основной массе вашего трафика с эскалацией только сложных случаев на дорогой — это то же самое решение, что и на этой странице, выраженное через конфигурацию, а не через переписывание, — и именно для такой композиции и существует слой маршрутизации. Это важно и для самой цены: мы передаём прейскурантную цену провайдера с наценкой 0%, поэтому если Xiaomi снизит тариф на любом из чекпоинтов, цифра на нашей стороне изменится в тот же день, а не при следующем продлении контракта. Это относится к моделям, которые мы предлагаем. Что касается конкретно пары MiMo-V2.6, сегодня вы по-прежнему покупаете напрямую у Xiaomi.
Что бы это уладило
Две вещи превратили бы это из оценочного суждения в арифметический расчёт. Страница Artificial Analysis для MiMo-V2.6-Flash поставила бы оба чекпоинта на ту же ось стоимости за задачу, которая сейчас помещает Pro на $0.133 за задачу Intelligence Index, и сравнение разрешилось бы само собой. Независимая репликация кластера безопасности — ExploitGym, ExploitBench, SEC Bench Pro — подтвердила бы, является ли трёхкратный разрыв в этих строках свойством модели или свойством грейдера.
До тех пор защитимая позиция такова: Xiaomi MiMo-V2.6-Flash — более выгодная покупка для большинства команд в большинстве случаев, а Xiaomi MiMo-V2.6-Pro — более выгодная покупка для узкого класса работ, где неудача обходится дорого. Единственная строка, в которой побеждает Flash, этого не опровергает — но это полезное напоминание о том, что премия флагмана — это утверждение о рабочей нагрузке, а не о модели.

