
MiMo-V2.6-Flash против Qwen3.8-Max: скачивание против счётчика, и только у одного из них есть оценка
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Одно число определяет, как обычно записывают это сравнение, и это не бенчмарк. Qwen3.8-Max — это размещённая модель, которую Artificial Analysis измеряет непрерывно, поэтому она несёт текущий Intelligence Index 45 по перекалиброванной шкале v4.3, скорость вывода 39,2 токена в секунду и прейскурантную цену $2.00 за миллион входных токенов и $6.00 за миллион выходных. MiMo-V2.6-Flash, которую Xiaomi опубликовала в виде скачиваемых весов 21 сентября 2026 года, не несёт ничего из этого: ни тарифной карты провайдера, ни идентификатора модели, о котором объявила бы Xiaomi, ни страницы на Artificial Analysis вообще. Всё опубликованное о возможностях MiMo-V2.6-Flash исходит из собственных таблиц оценки Xiaomi в её карточке модели. Ни одна цифра не была воспроизведена кем-то, кто не работает в Xiaomi.
Эта асимметрия — не минус модели. Это факт о том, какого рода покупкой является каждый из них, и он меняет то, что вы действительно можете заключить из сравнения лоб в лоб. Остальная часть этой статьи посвящена трём вещам, которые вы действительно можете сравнить — форме утверждения, стоимости токена и лицензии — плюс одному числу, которое реально, измерено независимо и не принадлежит ни одной из моделей, упомянутых в заголовке.
Во-первых, какой именно Qwen 3.8 и какой именно MiMo
Оба названия в этом заголовке — это семейства, притворяющиеся контрольными точками, и эти замены отнюдь не безобидны.
• Qwen3.8-Max — облачный флагман Alibaba, представленный 3 августа 2026 года. Разреженная модель на основе смеси экспертов с 2,4 трлн параметров, из которых около 95 млрд активны на каждый токен, контекстным окном на 1 млн токенов и поддержкой ввода текста, изображений и видео. Именно эту модель в остальной части статьи мы рассматриваем как противника.
• Qwen3.8-Max (0902) — датированный 2 сентября снимок той же модели, представленный отдельной записью с той же ценой $2.00 и $6.00 и потолком вывода в 131 072 токена. Текущая страница Artificial Analysis посвящена именно этой сборке, что важно, когда вы указываете оценку индекса.
• Qwen3.8-2.4T-A95B — чекпоинт с открытыми весами того же ядра, доступный для скачивания с 12 августа 2026 года по лицензии Qwen3.8-Max License. Он работает только с текстом, режим рассуждений всегда включён, а его собственный контекст составляет 262K, а не миллион. Это не та модель, что в заголовке.
• MiMo-V2.6-Flash — это созданный Xiaomi разреженный чекпойнт типа «смесь экспертов» с 309B общих и 15B активных параметров, доступный без ограничений на Hugging Face под лицензией MIT, нативно омнимодальный, с заявленным контекстом в 1M токенов. Это более эффективная модель в релизе из двух чекпойнтов, флагманом которого является MiMo-V2.6-Pro с 1,02T общих и 42B активных параметров.
• MiMo-V2-Flash — модель декабря 2025 года. Те же 309B общих параметров, те же 15B активных, то же скользящее окно размером 128 токенов. Другой прогон обучения, другая таблица бенчмарков и контекст 256K. Любая страница, где «MiMo-V2-Flash» сравнивают с моделью Qwen, сравнивает не то поколение, и одна лишь спецификация вам этого не скажет.
Коллизия MiMo — более опасная из двух ловушек, потому что числа, идентифицирующие модель, к тому же совпадают у чекпоинтов 2025 и 2026 годов. Коллизия Qwen мягче, но у неё есть своя цена: открытые веса 2.4T и хостируемый API — это разные артефакты с разными условиями, и сравнение, в котором их перепутают, даст неверное представление и о возможностях, и о лицензии.
Индекс был перестроен, и номер, который всё ещё печатают большинство страниц, исчез.
Вот режим отказа, на который следует обратить внимание, прежде чем появится какая-либо оценка.
Artificial Analysis перекалибровала свой Intelligence Index до v4.3 7 сентября 2026 года. Оценки, полученные до этой даты, несопоставимы с оценками после неё, а на актуальной странице Qwen3.8-Max есть Обновлено — значок, отмечающий пересчитанный результат. Широко распространённая цифра 58 для Qwen3.8-Max относится к старой шкале. Текущий Qwen3.8-Max (0902) показывает 45, занимая 19-е место среди 202 моделей, которые Artificial Analysis относит к этому классу.
Это не педантизм. 58 рядом с 46 воспринимается как разрыв в двенадцать пунктов. Те же две модели на одной и той же текущей шкале различаются всего на один пункт — а 46 — это даже не та модель, которой посвящена эта статья:
• Qwen3.8-Max (0902), независимое измерение — Intelligence Index 45 на v4.3. Скорость вывода — 39,2 токена в секунду, 151-е место из 202, что, как отмечается на самой странице, является медленным. Стоимость за задачу Intelligence Index — 5,41 $. Сгенерировано выходных токенов для прохождения индекса: 190 млн.
• MiMo-V2.6-Pro, независимо измеренный — Intelligence Index 46, занял первое место среди 114 моделей класса открытых весов. Скорость вывода — 134,3 токена в секунду. Стоимость выполнения одной задачи Intelligence Index — $0.13. Выходных токенов для прохождения индекса: 140 млн.
• MiMo-V2.6-Flash, собственно предмет — страницы Artificial Analysis не существует. Нечего цитировать.
Прочитайте эти три вместе, и честный вывод окажется неутешительным для обоих вендоров. Сравнение, которого все хотят, — Flash против Qwen3.8-Max по нейтральной шкале, — не существует и не может быть построено по таблицам вендоров, потому что два вендора прогоняли разные тестовые обвязки на разных чекпойнтах в разное время, а затем сравнивали себя с моделями других компаний, которые они тоже прогоняли. Что действительно существует — это разрыв в один пункт между флагманским Qwen и более крупным чекпойнтом Xiaomi, при примерно одной сороковой стоимости за задачу индекса. Это самое интересное реальное число в этом противостоянии, и оно касается модели, которую не упоминает ни одна из сторон, указанных в заголовке.

Что таблицы поставщиков расскажут вам, а что — нет
Оба вендора публикуют цифры. Это не один и тот же тип цифр, и сопоставление их столбец за столбцом даёт диаграмму, а не вывод, — но форма этих заявлений всё же заслуживает прочтения, потому что она говорит о том, на что оптимизировалась каждая лаборатория.
• Агент для написания кода — Xiaomi сообщает, что MiMo-V2.6-Flash показывает 67.9 в DeepSWE v1.1, 87.6 в Terminal Bench 2.1, 26.0 в ProgramBench и 61.2 в MiMo Code Bench. Alibaba сообщает, что Qwen3.8-Max показывает 67.7 в SWE-bench Pro и 86.6 в Terminal-Bench 2.1. Показатели Terminal-Bench достаточно близки, так что порядок, вероятно, определяет тестовый стенд, а не модель.
• Универсальный агент — Xiaomi сообщает для Flash следующие результаты: AutomationBench v1.0.6 — 52,3, Toolathlon-Verified — 73,6, OSWorld-Verified — 80,8 и Agents' Last Exam — 27,6. Alibaba сообщает для Qwen3.8-Max: OSWorld-Verified — 86,1, WideSearch — 81,9 и Agent's Last Exam — 52,4. По двум бенчмаркам, которые запускали обе лаборатории, заявленные показатели Qwen выше — на собственном тестовом стенде Alibaba.
• Знания и безопасность — Xiaomi проводит CyberGym (Flash 95.1), MiMo Cyber Bench (77.2), ExploitGym (6.0), ExploitBench (25.3) и SEC Bench Pro (47.5). Alibaba проводит GPQA Diamond (92.6), Humanity's Last Exam (43.6) и PaperBench (93.0). Почти нет пересечений, так что почти нечего сравнивать.
Единственная по-настоящему полезная вещь, которую может показать таблица вендора, — это внутренняя несогласованность, и у Xiaomi она есть. Её публичный RL-дашборд, транслировавший обучающий прогон до сентября, опубликовал MiMo-V2.6-Flash на 65.68 в DeepSWE v1.1 с использованием харнесса mini-swe-agent при усреднении по трём. Готовая карточка модели указывает 67.9 для выпущенных весов. Они описывают соответственно тренировочный снимок и выпущенный артефакт, и разница в два пункта того же размера, что и разрыв между двумя чекпоинтами Xiaomi. Если вы цитировали число с дашборда с прошлой недели, оно устарело.
Счёт — вот где эти две модели перестают быть сопоставимыми.
Это то подразделение, которое решает вопросы развёртывания, и исход здесь отнюдь не близок.
• Qwen3.8-Max тарифицируется по потреблению. $2.00 за миллион входных токенов и $6.00 за миллион выходных по международному прайс-листу Alibaba, со скидкой за кэширование, которую Artificial Analysis оценивает в 88%, и стоимостью $5.41 за задачу Intelligence Index. Документация Alibaba для китайского региона указывает CNY 12 и CNY 36 за миллион для той же пары. Вы можете вызвать его сегодня днём и получить счёт.
• MiMo-V2.6-Flash — это вариант для скачивания. Xiaomi не публикует тариф за токен для поколения MiMo-V2.6 на собственном сайте и не объявила вызываемый идентификатор ни для одного из чекпойнтов, так что тарифицировать нечего. Вместо этого есть 172,9 ГБ данных весов FP8, распределённых по 65 шардам, — ещё до KV-кэша для контекста в 1 млн токенов — и раздел о развёртывании, рекомендующий SGLang при тензорном параллелизме 16 с коэффициентом параллелизма данных 2 или рецепт vLLM при тензорном параллелизме 8 — многоузловая задача обслуживания.
• Сторонние листинги — это не тарифная сетка. Страницы каталога действительно содержат цифры для серии MiMo-V2.6, а Artificial Analysis учитывает одного API-провайдера, предоставляющего MiMo-V2.6-Pro по $0.435 и $0.87 за миллион. Это листинг провайдера для более крупного чекпоинта, а не цена Xiaomi, и для Flash он вообще отсутствует.
Итак, арифметика — это тарифицируемая строка затрат против решения о капитальных вложениях. При нескольких сотнях миллионов токенов в месяц Qwen3.8-Max — это счёт, который можно спрогнозировать, а Flash — это нода, которую вам пришлось бы покупать, чтобы обслуживать модель, которую никто за пределами Xiaomi не измерял. При миллиардах токенов в месяц открытый путь начинает выигрывать по затратам, и именно в этот момент лицензия перестаёт быть юридической сноской и становится входным параметром для закупки.
Лицензии — не одно и то же разрешение
MIT — это, пожалуй, самая разрешительная лицензия из тех, что бывают у открытых весов. Лицензия Qwen3.8-Max — не MIT, и разница здесь нешуточная.
MiMo-V2.6-Flash поставляется под лицензией MIT: без порога по выручке, без условия о числе пользователей, без отдельного коммерческого соглашения и без пункта об исследованиях. Коммерческое развёртывание, модификация, распространение и дальнейшее обучение разрешены, а репозиторий доступен без ограничений.
Лицензия Qwen3.8-Max предоставляет право на использование, модификацию, распространение, сублицензирование, продажу, развёртывание, хостинг и дообучение — при соблюдении двух условий. Продукт или услуга, число ежемесячно активных пользователей которых превышает 100 млн или чья месячная выручка превышает 20 млн долларов США, обязаны заметно указывать название модели в своём интерфейсе. А бизнесу, предоставляющему модель как услугу или ИИ-ассистента для рабочих задач, совокупная выручка которого превышает 50 млн долларов США за любые двенадцать последовательных месяцев, перед коммерческим использованием требуется отдельная лицензия от Alibaba. Внутреннее использование из этого исключено при условии, что модель или её возможности не раскрываются третьим лицам.
Для большинства команд ни одно из этих условий не имеет обязательной силы. Для платформенного бизнеса, который добивается успеха, одно из них имеет — и приобретает обязательную силу ровно в тот момент, когда модель становится несущей. Отметим также, что эти условия относятся к загружаемым весам 2.4T, а не к хостинговому API, где вместо них применяются условия провайдера. У этих двух путей разные обязательства, и это ещё одна причина не сравнивать открытый чекпоинт с хостинговым так, будто это один и тот же продукт.
Где OrcaRouter подходит, а где — нет
Qwen3.8-Max можно маршрутизировать в OrcaRouter — как в базовой записи, так и в датированном снимке 0902 — через один API-ключ по прейскурантной цене провайдера, передаваемой сквозным образом с 0% наценки. Это особенно важно здесь по двум причинам. Во-первых, сборка 0902 — это отдельная запись, а не скрытая замена, поэтому DSL маршрутизации может привязывать критичный к воспроизводимости трафик к датированному снимку, пока всё остальное идёт по базовому уровню — без второй интеграции и без изменений кода. Во-вторых, поскольку прейскурантная цена передаётся без наценки, изменение тарифной сетки Alibaba оказывается на вашей стороне в тот же день, а не при следующем продлении контракта, что сохраняет честность приведённой выше арифметики «по потреблению против по узлам» при изменении цен. Нагрузки с интенсивным использованием кэша также сохраняют скидку провайдера на кэш, а не теряют её часть в пользу маржи реселлера.

MiMo-V2.6-Flash нигде не маршрутизируется, включая наш сервис. Мы не маршрутизируем ни одну модель Xiaomi, а строка о доступности в собственной карточке Xiaomi указывает на собственные каналы Xiaomi: платформу MiMo API, AI Studio, MiMo Code и десктопное приложение. Если вам нужен этот чекпойнт, вам придётся скачать 172,9 ГБ и найти ноду.

Какой именно, и когда
Берите Qwen3.8-Max, если вам нужна производительность без аппаратного обеспечения, если ваш объём неопределён или если вы хотите иметь возможность получить независимую цифру до того, как примете решение. Примите, что 45 в текущем индексе — это позиция в середине фронтира, а не на вершине, что 39,2 токена в секунду достаточно медленно, чтобы иметь значение внутри агентного цикла, и что 190 млн выходных токенов для завершения Intelligence Index — это примерно вдвое больше медианы: многословность стоит денег на той стороне счётчика, где оплачивается выход.
Выбирайте MiMo-V2.6-Flash, если ограничивающим фактором является лицензия, путь данных или долгосрочные расходы, которые можно амортизировать, — и если у вас есть узел. Условия MIT без порога по выручке — это действительно иное разрешение, чем лицензия с порогом MAU и триггером распределения выручки, и для компании, которая рассчитывает стать крупной, это и есть причина выбрать его. Заложите бюджет на мультиузловое обслуживание, рассчитывайте размер по опубликованным данным о весах, а не по странице репозитория, и считайте все числа в карточке Xiaomi заявленными производителем, пока кто-нибудь за пределами лаборатории не перепроверит их.
И если вы выбираете сегодня, а не в следующем квартале, сначала попробуйте вариант с оплатой по потреблению. Месяц работы с Qwen3.8-Max покажет, что на самом деле нужно вашей рабочей нагрузке. А узел скажет вам лишь то, что вы надеялись услышать.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
