Титульная hero-карточка с заголовком «Вышла Xiaomi MiMo-V2.6-Flash» над подзаголовком «309B открытых весов, лицензия MIT, контекст на 1M токенов — опубликовано 21 сентября 2026 г.», с четырьмя бейджами-пилюлями: «309B всего / 15B активных», «173 ГБ весов FP8», «контекст на 1M токенов» и «Технический отчёт включён».
Guides & Insights

Xiaomi MiMo-V2.6-Flash вышла: открытая модель на 309B, которую вы обслуживаете сами

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

MiMo-V2.6-Flash перестал быть обучающим заданием 21 сентября 2026 года в 15:39 UTC, когда команда MiMo от Xiaomi опубликовала чекпоинт как XiaomiMiMo/MiMo-V2.6-Flash-RL на Hugging Face — без ограничений доступа, под лицензией MIT, с приложенным техническим отчётом, 65 шардов весов в индексе. XiaomiMiMo/MiMo-V2.6-Pro-RL появился восемнадцать секунд спустя. За неделю до этого обе модели были двумя карточками с пометкой «stopped» на публичном дашборде обучения, и широко повторяемая фраза о них гласила, что никаких весов не существовало. Теперь это файлы, которые любой может скачать и запустить. Это реальное изменение в том, что можно делать с моделью, а это не то же самое, что анонс о ней.

Начните с отметки времени, потому что релиз появился без обычной вендорской хореографии. В собственном блоге Xiaomi, проверенном 22 сентября, самым новым постом всё ещё значится запуск MiMo-V2-Flash в декабре 2025 года. Нет ни презентационного эссе о запуске V2.6, ни опубликованного прайс-листа для нового поколения, ни вызываемого идентификатора модели, который Xiaomi анонсировала бы для любого из чекпойнтов. Есть репозиторий, технический отчёт, рецепты развёртывания и набор таблиц бенчмарков, составленных вендором, — плюс одна маленькая враждебная деталь в карточке модели, которая важна только тем, кто планирует реально загрузить эту штуку.

Две карты, которые вы можете держать.

Оба чекпоинта являются нативно омнимодальными с заявленным контекстом в 1 млн токенов, и оба распространяются под лицензией MIT — их можно использовать коммерчески, дообучать, распространять, без порога по выручке и без исследовательской оговорки. В карточке Flash назван «сбалансированным по эффективности чекпоинтом» серии, а Pro — флагманом; самое интересное — в том, чем эти двое различаются, если смотреть на конфигурации, а не на маркетинговую фразу.

• Количество параметров — MiMo-V2.6-Flash: 309 млрд всего, 15 млрд активируется на токен; MiMo-V2.6-Pro: 1,02 трлн всего, 42 млрд активируется. Обе модели — разреженные смеси экспертов.

• Backbone — Flash — это 48 слоёв (39 со скользящим окном, 9 с глобальным вниманием), размер скрытого состояния 4096, 256 маршрутизируемых экспертов с 8 активируемыми, скользящее окно в 128 токенов, без общих экспертов. Первый блок — глобальное внимание с полносвязной сетью прямого распространения; все последующие блоки чередуются.

• Кодировщики — MiMo ViT с 681 млн параметров (28 слоёв: 24 со скользящим окном и 4 полных), аудиотокенизатор с 308 млн параметров и кодировщик аудиопатчей с 127 млн параметров, так что текст, изображение, видео и аудио попадают в одну и ту же модель, а не в три кое-как соединённых конвейера.

• Спекулятивное декодирование — пятислойный драфтер с многотокенным предсказанием в стиле DFlash, описанный в карточке как предсказывающий семь токенов вперёд за один прямой проход для параллельной проверки.

• Хранилище — опубликованный индекс сообщает о 172,9 ГБ весовых данных, распределённых по 65 шардам, в FP8 (e4m3) с динамической схемой активации. Это следует понимать как примерно девять байт на параметр: Xiaomi выпустила большую модель, а не её квантованную версию размером с ноутбук.

Три числа, которые не совпадают

Об этом стоит сказать прямо, потому что все три влияют на решение о развёртывании, а не на аргумент из бенчмарка, и ни один из них не является зловещим — они выглядят как расхождения в документации между описанием, страницей репозитория и поставляемыми файлами.

Первый — это спекулятивный декодер. В описании модели сказано, что голова MTP — это пятислойный драфтер, предсказывающий семь токенов за проход. Этот config.json в том же репозитории устанавливает num_nextn_predict_layers в 3. Оба числа не могут описывать один и тот же артефакт, и именно конфиг будет читать среда выполнения. Если вы рассчитываете объем памяти для спекулятивного декодирования, доверьтесь конфигу и проверьте после загрузки.

Второй случай тоньше и вовсе не является ошибкой — скорее это соглашение об именовании, которое читается как ошибка. Репозиторий называется MiMo-V2.6-Flash-RL, что наводит на мысль, будто это адаптер для обучения с подкреплением, а не модель. Но это именно модель. Суффикс -RL обозначает происхождение по линии постобучения — этот чекпойнт является результатом смешанного RL-прогона, который Xiaomi транслировала в прямом эфире, а не LoRA, сидящей поверх какой-то другой базовой модели. Индекс весов это подтверждает: десятки тысяч тензоров, охватывающих весь бэкбон, визуальный энкодер, аудиостек и драфтер.

Третий — это тот, с которым вы столкнётесь первым, если подбираете оборудование со страницы репозитория, а не с карточки. Блок Safetensors на той странице сообщает 159B параметров. Это ни одно из двух чисел с карточки — ни 309B всего, ни 15B активных, — и именно эту цифру вероятнее всего скопирует тот, кто планирует ресурсы, потому что она расположена рядом с кнопкой загрузки. Xiaomi не объяснила это расхождение, и мы не можем разрешить его извне; наиболее вероятное прочтение — иная конвенция подсчёта по квантованным тензорам, а не другая модель. Безопаснее исходить из опубликованных данных о весах: 172,9 ГБ в FP8 на 65 шардов — это число, за которое придётся платить видеопамятью независимо от того, как считаются параметры.

Что говорят бенчмарки и кто их проводил

Каждая цифра ниже взята из собственных оценочных таблиц Xiaomi в карточке модели. Ничто из этого не было независимо воспроизведено, ничто не фигурирует в публичном лидерборде, а столбцы сравнения — это собственные прогоны производителя тех же тестовых стендов против моделей других компаний. Считайте форму результатов информативной, а десятичные знаки — украшением.

• Агент для кода — DeepSWE v1.1: Flash 67,9, Pro 71,9 против Claude Opus 5 с 74,0, GPT-5.6 Sol с 73,0 и Claude Fable 5 с 70,0. На Terminal Bench 2.1 Flash набирает 87,6 против 89,1 у Opus 5 — разрыв настолько мал, что, возможно, его определяет не модель, а тестовый стенд.

• Универсальный агент — AutomationBench v1.0.6 ставит Flash на 52,3, выше и GPT-5.6 Sol (45,8), и Claude Opus 5 (50,3) в прогоне Xiaomi. Toolathlon-Verified: Flash 73,6, Pro 76,9, Opus 5 80,6.

• Кибербезопасность — самая перекошенная колонка в таблице. CyberGym: Flash — 95,1, выше собственного более крупного собрата с 94,0, при этом MiMo-V2.5-Pro — 40,0. А затем дно обрывается: ExploitGym — 6,0 у Flash против 22,1 у Opus 5, ExploitBench — 25,3 против 70,0, SEC Bench Pro — 47,5 против 79,1 у GPT-5.6 Sol.

• Визуальный агент — MiMo VisualCoding: Flash 71.5, Pro 72.3, Opus 5 70.0.

Одну цифру стоит вынести отдельно, потому что это как раз то, что в посте о запуске обычно скрывают. На RL-дашборде Xiaomi для Flash было опубликовано значение 65.68 на DeepSWE v1.1 — а в карточке модели теперь указано 67.9 для того же бенчмарка на финальном чекпоинте. Это не одно и то же измерение. Цифра на дашборде была помечена как mini-swe-agent, avg@3, на тренировочном снапшоте; таблица в карточке — это офлайн-оценка выпущенных весов от вендора. Разница в два пункта — это прирост от последней части прогона плюс всё, что изменилось в настройке оценки, и сейчас никто за пределами Xiaomi не может отделить одно от другого. Если вы цитировали 65.68 с прошлой недели, теперь это устаревшее число для другого артефакта.

A screenshot of the XiaomiMiMo/MiMo-V2.6-Flash-RL repository page on Hugging Face, showing the MIT licence tag, the Safetensors block reporting 'Model size 159B params' and 'This model isn't deployed by any Inference Provider', and the repository file listing that includes the technical report and the weight shards.

Сколько на самом деле стоит его запустить

Открытые веса — это лицензия, а не счёт, и именно здесь релиз становится менее праздничным. В разделе о развёртывании в самой карточке рекомендуется SGLang (тензорный параллелизм 16, параллелизм данных 2, с включённым многослойным спекулятивным путём в стиле EAGLE) или рецепт vLLM с тензорным параллелизмом 8, и отмечается, что стабильный vLLM может отставать от архитектуры. Это многоузловая задача обслуживания для модели с 309B параметров, веса которой занимают около 173 ГБ, прежде чем вы добавите KV-кэш для контекста в 1 млн токенов. Рекомендуемые параметры сэмплирования — temperature 1.0, top_p 0.95.

Итак, честная формулировка «открытого исходного кода» здесь такова: Xiaomi убрала лицензионный барьер и оставила аппаратный барьер ровно там, где он был. Дообучение Flash на собственных трейсах теперь законно и возможно; делать это на чём-либо меньшем, чем серьёзный GPU-узел, — нет. Это реальное и иное предложение по сравнению с хостинговым эндпоинтом, и именно поэтому два способа использования этого поколения не конкурируют — они покрывают разные бюджеты.

Если вам нужна эта возможность без узла, то модели, с которыми Xiaomi сравнивает в той таблице, — практическая альтернатива: GPT-5.6 Sol, Claude Opus 5 и Claude Fable 5 доступны для вызова уже сегодня, и это один ключ API по прайс-листу провайдера с 0% наценки, передаваемой через OrcaRouter, так что решение, которое вы фактически принимаете, — «купить узел» или «платить за вызовы по счётчику». Если вы хотите увидеть, как вызываемый уровень справляется с теми же задачами по программированию, прежде чем выбрать тот или иной путь, борд по программированию читается быстрее, чем таблица производителя. Чего вы не можете сделать сегодня ни на одном роутере, — это вызвать сам MiMo-V2.6-Flash: мы не маршрутизируем ни одну модель Xiaomi, а строка о доступности в собственной карточке Xiaomi указывает на собственные каналы Xiaomi: платформу MiMo API, AI Studio, MiMo Code и десктопное приложение.

A single-column scoreboard headed 'MiMo-V2.6-Flash - the numbers that decide a deployment', listing 309B total and 15B activated parameters, a 1M-token context, text/image/video/audio modalities, the MIT licence with no revenue cap, 172.9 GB of FP8 weights across 65 shards, DeepSWE v1.1 at 67.9 against 74.0 for Claude Opus 5, CyberGym at 95.1, and SGLang tp16/dp2 or vLLM tp8 serving with no vendor price published.

Вопрос ценообразования всё ещё открыт

Xiaomi не опубликовала тариф за токен для MiMo-V2.6-Flash. В публикациях о запуске говорится, что серия сохранит тарифы API MiMo-V2.5, но это утверждение прессы, а не прайс-лист производителя: опубликованные тарифы поколения V2.5 для зарубежных рынков составляли около одной десятой доллара за миллион входных токенов, при этом кешированный ввод был на порядок дешевле, однако ничто на сайте Xiaomi не подтверждает, что новые чекпоинты унаследовали эти тарифы. Пока не появится прайс-лист, любая цифра, которую вы увидите для эндпоинта MiMo-V2.6, — это чьё-то предположение.

Есть ещё две вещи, которых по-прежнему не хватает, и обе они значатся в списке задач самой Xiaomi, а не кого-либо ещё. Заявление Ло Фули во время прямой трансляции, посвящённой RL, состояло в том, что среды обучения и код RL будут открыты, и в материалах запуска это обязательство повторяется; сейчас в репозиториях выложены веса, технический отчёт и инструкции по развёртыванию, но не стек обучения. И нет независимой оценки: ни заявки в лидерборд, ни стороннего повторного прогона колонок DeepSWE или CyberGym. Именно этот пробел важнее всего для тех, кто решает, стоит ли модель на 309B с бюджетом активных параметров 15B того, чтобы выделять под неё узел.

Что бы изменило картину?

Три сигнала заслуживают внимания, примерно в порядке того, насколько они могут повлиять на решение. Опубликованный прайс-лист превращает это из проекта по самостоятельному хостингу в статью расходов, которую можно сравнить с хостинговым фронтиром. Сторонний прогон на тех же стендах — DeepSWE или Terminal Bench, представленный, а не заявленный самостоятельно — позволил бы установить, является ли 67.9 реальной позицией или благоприятной конфигурацией. А RL-среды, если они появятся, будут более интересным артефактом для большинства команд, потому что именно они нужны, чтобы воспроизвести цикл самоулучшения на своих данных.

А до тех пор практическое прочтение этого релиза остаётся узким и ясным. MiMo-V2.6-Flash — это полноценная омнимодальная агентная модель с открытыми весами и лицензией MIT, причём такого размера, который предполагает наличие кластера, — и это первая контрольная точка поколения MiMo-V2.6, которую можно подержать в руках, а на прошлой неделе этого о ней сказать было нельзя.

A screenshot of Xiaomi's MiMo blog, captured 22 September 2026, showing the site navigation and the December 16, 2025 post 'Introducing MiMo-V2-Flash' as the newest entry, with the line 'Today, we are releasing and open-sourcing MiMo-V2-Flash', the availability note listing Hugging Face, the API Platform and AI Studio, and a 'Benchmark Comparison' table with columns for SWE-Bench Verified, SWE-Bench Multilingual, Tau2-Bench, AIME25, GPQA-Diamond, HLE and Arena-Hard.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно