
MiMo-V2.6-Flash против MiMo-V2.6: одна серия, два чекпойнта и название, которое выполняет двойную функцию
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Спросите двух человек, что такое MiMo-V2.6, и вам могут описать две разные модели. Выпуск Xiaomi в сентябре 2026 года — это серия с двумя опубликованными чекпоинтами — MiMo-V2.6-Flash на 309 миллиардов параметров и MiMo-V2.6-Pro на 1,02 триллиона — а само название MiMo-V2.6 используется и для всего семейства, и — в большинстве публикаций — для верхнего уровня этого поколения. Так что страница под заголовком «MiMo-V2.6-Flash vs MiMo-V2.6» — это на самом деле сопоставление эффективного чекпоинта с названием, которое люди пишут, когда имеют в виду флагман. Оба чекпоинта появились на Hugging Face с разницей в восемнадцать секунд 21 сентября 2026 года, оба распространяются под лицензией MIT, и оба предназначены в первую очередь для скачивания: конечной точки Xiaomi, к которой можно обратиться, нет. Почти всё остальное у них различается.
Это значит больше, чем обычно значила бы придирка к названию, потому что эти две не образуют размерную лестницу, по которой можно будет подняться позже. Они — отдельные запуски обучения с отдельными таблицами бенчмарков, отдельными объёмами занимаемой памяти и — как показывают опубликованные цифры — парой мест, где меньший из них одерживает безоговорочную победу.
Две контрольные точки, одна опубликованная минута
Репозитории — XiaomiMiMo/MiMo-V2.6-Flash-RL, созданный в 15:39:51 UTC, и XiaomiMiMo/MiMo-V2.6-Pro-RL, созданный в 15:39:33 UTC. Доступ к обоим не ограничен. К обоим прилагаются технический отчёт и карточка модели, и оба описываются Xiaomi как результат одного смешанного прогона обучения с подкреплением, в котором задачи по программированию, универсальным агентам, визуальные задачи и кибербезопасность были объединены в один проход обучения, а не в отдельные прогоны по доменам.
• Параметры — MiMo-V2.6-Flash: 309B всего, 15B активируется на токен. MiMo-V2.6-Pro: 1.02T всего, 42B активируется. Обе — разреженные смеси экспертов.
• Backbone — Flash состоит из 48 слоёв, 39 слоёв со скользящим окном и 9 слоёв с полным вниманием, размер скрытого слоя 4096, 256 маршрутизируемых экспертов, из которых активируются 8, скользящее окно на 128 токенов и отсутствие общих экспертов. Pro использует ту же идею гибридного внимания при значительно большей ширине.
• Модальность — обе являются нативными омнимодальными, обрабатывая текст, изображение, видео и аудио в одной модели, а не в трёх сколоченных вместе конвейерах. Flash включает vision-трансформер на 681 млн параметров, аудиотокенизатор на 308 млн и аудио patch-энкодер на 127 млн параметров.
• Контекст — 1 млн токенов, заявлено для обоих, при этом конфигурация подтверждает максимальное позиционное эмбеддинг-представление на 1 048 576 токенов.
• Лицензия — MIT в обоих случаях, без порога по выручке, без ограничений допустимого использования сверх обычных и без пункта об исследованиях. Коммерческое развёртывание, модификация и распространение разрешены.
• Весовые файлы — Flash публикует 172,9 ГБ весовых данных в формате FP8, распределённых по 65 шардам. У Pro примерно втрое больше параметров, поэтому объём его загрузки достигает половины терабайта — ещё до какой-либо квантизации, которую вы выполните самостоятельно.
• Где они доступны — Hugging Face, собственная API-платформа Xiaomi, AI Studio, MiMo Code и настольное приложение MiMo. В карточке отмечается, что ни один из чекпоинтов в настоящее время не развёрнут сторонним провайдером инференса на самом Hub.
Столкновение, которое стоит людям техники
Путаница в этой паре на самом деле не между Flash и Pro. Она — между MiMo-V2.6-Flash и предыдущей моделью.
MiMo-V2-Flash вышел в декабре 2025 года, и собственный пост Xiaomi в блоге, анонсирующий его, описывает модель mixture-of-experts с 309 миллиардами общих параметров, 15 миллиардами активных, гибридную схему внимания, чередующую скользящее окно и полное внимание, и агрессивное скользящее окно на 128 токенов. Сравните это со списком выше. Чекпоинт 2026 года и чекпоинт 2025 года имеют одинаковую форму основных характеристик, одинаковый размер скользящего окна и одинаковый бюджет активации — с разницей в девять месяцев, из разных запусков обучения, с разными возможностями и разной таблицей бенчмарков.
Так, поиск по запросу «MiMo V2.6 Flash» с радостью выдаст вам страницы о MiMo-V2-Flash, включая показатель контекста 256K и цену в 0,1 доллара за миллион входных токенов, которая относится к более старой модели. Если вы подбираете размер узла, это не косметическая ошибка. Старый чекпоинт и новый — это разные загрузки с разными рецептами обслуживания, и новый заявляет в четыре раза больший контекст.
В названиях есть вторая, менее заметная ловушка. Оба репозитория заканчиваются на -RL, что читается как адаптер обучения с подкреплением, поставленный поверх какой-то другой базовой модели. Это не адаптеры. Суффикс указывает на происхождение из этапа постобучения: это полные чекпоинты, полученные в ходе потокового RL-прогона. Индекс весов подтверждает это — десятки тысяч тензоров, охватывающих весь бэкбон, визуальный энкодер, аудиостек и спекулятивный драфтер.
Что говорит собственная таблица вендора
Все цифры в этом разделе взяты из оценочных таблиц Xiaomi в двух карточках моделей. Xiaomi запускала эти испытательные стенды на собственных чекпойнтах. Ничто из этого не воспроизводилось за пределами лаборатории, ничего из этого не фигурирует в публичном рейтинге, а столбцы сравнения — это собственные прогоны вендора тех же испытательных стендов против моделей других компаний. Воспринимайте рейтинг как информативный, а десятичные знаки — как украшение.
• Кодовый агент — DeepSWE v1.1: Flash 67.9, Pro 71.9. Terminal Bench 2.1: Flash 87.6, Pro 89.9. ProgramBench: Flash 26.0. MiMo Code Bench: Flash 61.2.
• Универсальный агент — AutomationBench v1.0.6: Flash 52,3, Pro 53,1. Toolathlon-Verified: Flash 73,6, Pro 76,9. OSWorld-Verified: Flash 80,8, Pro 82,0. Agents' Last Exam: Flash 27,6. Terminal Bench 4.0: Flash 28,8.
• Кибербезопасность — единственная колонка, где меньшая модель лидирует. CyberGym: Flash 95,1 против 94,0 у Pro. MiMo Cyber Bench: Flash 77,2. А дальше — обвал: ExploitGym 6,0, ExploitBench 25,3, SEC Bench Pro 47,5.
• Визуальный агент — MiMo VisualCoding: Flash 71.5, Pro 72.3.
Прочитайте эти пункты, и честный вывод будет таким: Pro опережает почти везде, но с небольшим отрывом, и этот отрыв настолько мал, что находится в пределах шума самостоятельно запускаемого стенда. В DeepSWE между ними четыре пункта по шкале, где один и тот же чекпойнт сместился на два пункта между двумя собственными оценками Xiaomi.
Этот последний пункт заслуживает отдельного абзаца, потому что это самое полезное, что есть в любой из этих карточек. Публичный дашборд RL от Xiaomi, который транслировал оба обучающих прогона в течение сентября, опубликовал для Flash значение 65.68 на DeepSWE v1.1 с использованием харнесса mini-swe-agent при усреднении по трём. В готовой карточке указано 67.9 для выпущенных весов. Тем временем на дашборде Pro было указано 72.57, а в его карточке напечатано 71.9 — показатель снизился. Две контрольные точки из одного и того же прогона, оценённые дважды, и разрыв между двумя оценками такой же по величине, как разрыв между двумя моделями. Если вы цитировали числа с дашборда начиная с прошлой недели, они описывают тренировочные снимки, а не артефакты, которые вы скачали бы сегодня.

Ни один из них не находится на роутере
Вот часть, которая определяет большинство реальных оценок. Xiaomi не продаёт ни один из этих чекпойнтов: на её собственном сайте не опубликовано цены за токен для поколения MiMo-V2.6 самого по себе, и она не объявила вызываемый идентификатор модели ни для одного из них. Вместо этого есть скачивание, плюс — только для Pro — единственный провайдер API, которого Artificial Analysis считает предоставляющим его за $0.435 за миллион входных токенов и $0.87 за миллион выходных. Это листинг провайдера, а не тарифная карта вендора, и для Flash вообще нет ничего сопоставимого. Цифры, циркулирующие на страницах сторонних каталогов, следует читать так же.
Итак, выбор между Flash и Pro — это не выбор между двумя конечными точками с разными счётчиками. Это выбор между двумя счетами за GPU, и меньший из них составляет примерно треть от большего. В этом и заключается весь коммерческий аргумент в пользу Flash, и он сильнее, чем можно предположить по таблице бенчмарков, потому что две модели различаются всего на несколько пунктов в задачах, для которых большинство людей их покупают.
В итоге остаётся знакомая развилка на три варианта. Арендовать фронтир, иметь собственную небольшую модель или собственную большую. Фронтирная колонка — именно та, с которой Xiaomi сравнивает в собственных таблицах: Claude Opus 5, GPT-5.6 Sol и Claude Fable 5 в собственной сравнительной таблице вендора располагаются на несколько пунктов выше Pro по DeepSWE, и все три можно вызвать уже сегодня через один API-ключ на OrcaRouter по прайс-листовой цене провайдера с 0% наценки. Это важно для конкретного решения, которое стоит перед вами: изменение цены вендором отражается на вашей стороне в тот же день, а не при следующем продлении контракта, поэтому арифметика «аренда против собственной модели» остаётся честной по мере движения цен на хостинг. Автоматическое переключение при сбое также означает, что модель, которую вы всё ещё оцениваете, не обязана оставаться на продакшн-пути в одиночку, пока вы принимаете решение.
То, чего сегодня нельзя сделать ни на одном роутере — включая наш, — это вызвать MiMo-V2.6-Flash или MiMo-V2.6-Pro. Мы не маршрутизируем ни одну модель Xiaomi, и строка о доступности в собственной карточке Xiaomi указывает на собственные каналы Xiaomi: платформу API MiMo, AI Studio, MiMo Code и настольное приложение.
Какой чекпоинт, и когда
Выбирайте MiMo-V2.6-Flash, если вам нужно поколение MiMo-V2.6 и аппаратное обеспечение является ограничивающим фактором. По сравнению с флагманом вы теряете примерно четыре балла DeepSWE и один-два балла в большинстве агентных бенчмарков. Зато получаете чекпойнт, который занимает примерно треть памяти, опережает Pro на CyberGym в собственной таблице Xiaomi и обладает той же лицензией, тем же заявленным контекстом в 1M токенов и той же мультимодальностью. Для команды, занимающейся оценкой в области кибербезопасности, этот столбец CyberGym — не погрешность округления.
Берите MiMo-V2.6-Pro, если нагрузка связана с программированием или длительными агентными задачами и узел уже оплачен. Это лучшая модель почти по всем столбцам, именно её реально измерила Artificial Analysis — Intelligence Index 46 по перекалиброванной шкале v4.3, первое место среди 114 моделей в её классе открытых весов, 134,3 выходных токена в секунду, а также указанная цена $0,435 за миллион входных токенов и $0,87 за миллион выходных — и независимое измерение стоит больше, чем таблица от вендора, когда вы планируете продакшен.
Не принимайте ни то, ни другое, пока не прочитаете сами конфигурационные файлы, а не их краткие изложения. В карточке Flash описывается спекулятивный драфтер с пятью слоями, предсказывающий семь токенов за проход; в config.json в том же репозитории для num_nextn_predict_layers указано значение 3. Краткое изложение в карточке — не то, что читает среда выполнения. А блок Safetensors на странице репозитория сообщает 159B параметров для Flash и 524B для Pro, и ни одно из этих чисел не совпадает ни с общим, ни с активным количеством параметров ни в одной из карточек моделей. Xiaomi не объяснила это расхождение. Вместо этого исходите из размера по опубликованным данным о весах, потому что именно за это число вы платите в виде VRAM, независимо от того, как считаются параметры.

Что бы это уладило
Три вещи, в примерном порядке полезности. Сторонний прогон на тех же стендах — DeepSWE или Terminal Bench, с отправкой результатов, а не с самоотчётом, — показал бы, является ли разрыв в четыре пункта между Flash и Pro реальной позицией или удачной конфигурацией. Опубликованный прайс-лист превратил бы всё это сравнение из аппаратного проекта в строку расходов, которую можно поставить рядом с хостинговыми фронтирными моделями. А RL-среды, которые Xiaomi, по её словам, сделает открытыми, — это тот артефакт, который большинство команд действительно захотели бы получить, потому что именно они нужны, чтобы воспроизвести цикл на собственных трассах.
До тех пор практическая интерпретация остаётся узкой. MiMo-V2.6 — это два чекпоинта, а не один, и само название обычно означает дорогой. Если сегодня вы выбираете внутри серии, честный вариант по умолчанию — Flash, если только столбец бенчмарка, который вам особенно важен, не говорит об обратном, — а если вы не готовы покупать ноду, то ни один из них пока не является правильным ответом.

