
MiMo-V2.6-Pro против Claude Opus 5: в 21 раз дешевле, но на пять пунктов индекса позади
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 632 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 187 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 112 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Xiaomi MiMo-V2.6-Pro и Claude Opus 5 — это два полюса одной сделки, и у этой сделки есть цена. В Artificial Analysis Intelligence Index v4.3.2 Claude Opus 5 (max effort) набирает 51 балл, а Xiaomi MiMo-V2.6-Pro — 46. По тарифной сетке Claude Opus 5 стоит $5,00 за миллион входных токенов и $25,00 за миллион выходных; MiMo-V2.6-Pro — $0,43 и $0,87. Выполните деление — и ответ будет в 11,6 раза больше по входу, в 28,7 раза больше по выходу — и в 21 раз больше по смешанной ставке, которую Artificial Analysis публикует для каждой из них. Пять пунктов индекса стоят в двадцать один раз дороже. Выгодная это сделка или пустая трата — полностью зависит от того, что ваша рабочая нагрузка делает с пятым пунктом, и большинство команд никогда не разбирается в этом, прежде чем сделать выбор.
Две модели, если говорить прямо.
Claude Opus 5 — проприетарный флагман Anthropic, выпущенный 24 июля 2026 года, с окном контекста в 1 млн токенов и нераскрытым количеством параметров. Xiaomi MiMo-V2.6-Pro — это разреженная модель смеси экспертов с общим количеством параметров 1,02 трлн и 42 млрд активированных, с окном контекста в 1 млн токенов, встроенной мультимодальностью для текста, изображений, видео и аудио и опубликованными весами под лицензией MIT.
• Веса — MiMo-V2.6-Pro под лицензией MIT и доступны для скачивания; Claude Opus 5 — проприетарная, доступна только через API
• Параметры — MiMo-V2.6-Pro: всего 1,02T / 42B активных; Claude Opus 5 — не раскрыто
• Контекст — по 1 млн токенов в обоих случаях; Claude Opus 5 ограничивает объём вывода на уровне 128K в Messages API и 300K в Batch API
• Модальность — MiMo-V2.6-Pro принимает текст, изображения, видео и аудио; опубликованная входная поверхность Claude Opus 5 — текст и изображения
• Цена по прайс-листу — MiMo-V2.6-Pro $0.43 / $0.87 за 1 млн токенов; Claude Opus 5 $5.00 / $25.00
• Кэш — MiMo-V2.6-Pro указывает 99% скидку на кэш; Claude Opus 5 читает кэш по $0,50 за 1 млн, а запись — по $6,25 при TTL 5 минут
• Измеренная стоимость выполнения одной задачи Intelligence Index — MiMo-V2.6-Pro: $0,13; Claude Opus 5: $5,86
• Обслуживание — MiMo-V2.6-Pro: 134,3 выходных токена в секунду и 2,15 с до первого токена; Claude Opus 5 — 57,9 токена в секунду
Последняя пара — как раз то, что теряется. Более дешёвая модель к тому же и более быстрая — в 2,3 раза по пропускной способности на выходе, — потому что она работает на оборудовании, которое контролируют Xiaomi и её партнёры и на котором можно агрессивно объединять запросы в пакеты. Claude Opus 5 при максимальном усилии — это модель рассуждений, выполняющая больше работы на токен; разрыв в скорости — не дефект, а другой продукт. Но это означает, что дешёвый вариант не расплачивается за свою скидку задержкой. Он расплачивается за неё пятью индексными пунктами и хвостом задач, где и живёт этот пятый пункт.

Где на самом деле находятся пять точек
Разрыв в пять баллов по композиту из десяти оценок распределён неравномерно, и агрегат скрывает то, что действительно важно. Обе модели прогонялись на одном и том же наборе v4.3.2, который включает AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1. На опубликованных страницах нет разбивки баллов по отдельным оценкам ни для одной из моделей, а это реальное ограничение для обеих сторон данного сравнения, и об этом стоит сказать, а не замалчивать.
То, что зафиксировано, носит ориентировочный характер. Claude Opus 5 при максимальном усилии набрал 49,0% на Terminal-Bench 4.0 в наборе v4.3, уступив GPT-6 Astra с 59,1% и Claude Fable 5.1 с 52,0%. На AutomationBench-AA Opus 5 выполнил все задачи без нарушения защитных ограничений в 28,3% рабочих процессов против 41,6% у GPT-6 Astra и 32,1% у Fable 5.1. Это серьёзные агентные показатели, и именно в этих категориях пятипунктовый композитный разрыв наименее вероятно будет распределён равномерно — в собственной записи индекса MiMo-V2.6-Pro не публикуется сопоставимая агентная разбивка.
Между тем вендорские цифры, которые публикуют обе компании, несопоставимы друг с другом, и стоит прямо сказать, почему. В материалах Anthropic к запуску сообщается о 96,0% в SWE-bench Verified и 79,2% в SWE-bench Pro; один трекер отмечает, что Opus 5 вышел без отдельной позиции в SWE-bench, и для него нет независимо проверенной цифры SWE-bench Verified. В материалах Xiaomi сообщается, что MiMo-V2.6-Pro вырос с 58,4 до 72,57 в DeepSWE v1.1 за время его RL-прогона, на собственном стенде Xiaomi с mini-swe-agent при усреднении по трём, и результат не отправлен в публичный рейтинг DeepSWE. Два вендорских стенда, две разные задачи, никакого пересечения. Поставить 96,0% рядом с 72,57 и сделать вывод — значит выдумать сравнение, которого не существует.

Сравнение затрат, сделанное как следует
Подсчёт по стоимости токенов преуменьшает разрыв, потому что две модели потребляют разное количество токенов для выполнения одной и той же работы. Artificial Analysis измерила, во сколько каждой из них фактически обошёлся полный прогон Intelligence Index: $0,13 для MiMo-V2.6-Pro, $5,86 для Claude Opus 5. Это 45-кратный разрыв на контролируемом, идентичном наборе задач, и это самый честный единичный показатель из доступных, поскольку обе измерялись одинаковым способом.
Теперь сопоставьте с этим правдоподобный продакшн-цикл. Запуск агента из 30 шагов, который читает 200 000 токенов контекста на каждом шаге и записывает 2 000 токенов на каждом шаге, — это 6 миллионов входных токенов и 60 000 выходных токенов за запуск. В Claude Opus 5 по прайс-листу это $30,00 входных и $1,50 выходных — $31,50 за запуск до любого кеширования. В MiMo-V2.6-Pro это $2,58 входных и $0,05 выходных — $2,63. С кеш-скидками, которые предлагают оба поставщика, входная часть обваливается у любой из моделей, а соотношение смещается, а не исчезает: 99%-ная скидка на кеш у дешёвой модели против $0,50 за чтение кеша у дорогой всё ещё оставляет дорогую модель на порядок впереди на цикле с большим объёмом контекста.
В этом и заключается весь аргумент за дешёвый маршрут и против полного перехода. Если ваша рабочая нагрузка — это долгосрочный агентный цикл, который сотни раз перечитывает один и тот же контекст, разница в стоимости на запуск — не ошибка округления: это разница между функцией, которую вы можете позволить себе запускать для каждого пользователя, и той, которую не можете. Это довод в пользу того, чтобы поставить MiMo-V2.6-Pro перед основной массой вашего трафика. Это не довод в пользу удаления Claude Opus 5, потому что задачи, в которых пятый пункт индекса окупает себя, по построению являются задачами, в которых ошибка дешёвой модели обходится дорого.

Как здесь выглядит решение о маршрутизации
Claude Opus 5 доступен через единственный ключ OrcaRouter по каталожной цене провайдера с наценкой 0 %, как anthropic/claude-opus-5, причём фронтирные модели, с которыми вы стали бы его сравнивать, находятся рядом с ним на том же ключе. Поскольку мы пропускаем каталожную цену провайдера без наценки, изменение цены поставщиком с любой стороны становится актуальным у нас в тот же день, а не после пересчёта котировки. Самое интересное — это DSL маршрутизации: вы можете объединить две модели в один вызов вместо того, чтобы выбирать между ними, направить основную массу нагрузки в дешёвый канал, а хвост — задачи, не проходящие самопроверку или соответствующие предикату сложности, — в дорогой. Отказоустойчивость — вторая половина. У Claude Opus 5 широкое покрытие провайдеров; MiMo-V2.6-Pro на момент, когда его зафиксировала Artificial Analysis, был указан лишь у одного API-провайдера, а это тонкий маршрут для модели, которую вы поставили бы в продакшн-контур. Именно возможность переключения на резерв делает дешёвый канал безопасным для внедрения.
Стоит сказать прямо, потому что легко предположить обратное: мы не размещаем MiMo-V2.6-Pro у себя. Получить к нему доступ сегодня можно через собственную платформу Xiaomi или один из сторонних каталогов, где он указан. Аргумент о маршрутизации здесь касается того, как вы используете такую модель вместе с теми, которые мы действительно предоставляем, а не утверждения, что она принадлежит нам.
Какой выбрать?
Выбирайте Claude Opus 5, когда стоимость провала задачи настолько превышает стоимость токенов, что пять индексных пунктов — это дешёвая страховка: долгосрочная агентная работа с реальными побочными эффектами, использование инструментов, где ошибочный вызов хуже медленного, всё, где вы уже платите человеку за проверку результата. Показатель в $5,86 за индексную задачу — не причина избегать его; это цена этого уровня, и уровень существует не просто так.
Выбирайте MiMo-V2.6-Pro, когда ограничивающим фактором является объём, когда рабочая нагрузка отличается большим контекстом и повторяемостью, когда вы хотите держать веса в собственной инфраструктуре — лицензия MIT допускает коммерческое развёртывание, модификацию и дальнейшее обучение — или когда вы создаёте что-то, чья юнит-экономика сходится только при пятой части цента за тысячу токенов. Скорость 134,3 токена в секунду делает его пригодным для интерактивного использования так, как большинство открытых моделей с триллионом параметров не могут.
Выбирайте оба, если у вас есть роутер, потому что честный ответ на вопрос «что лучше» таков: они не конкурируют за одни и те же запросы. Сценарий неудачи, которого нужно избегать, — самый дорогой: стандартизировать всё на дешёвой модели, потому что заявленное соотношение равно 21x, обнаружить на третий месяц, что определённому классу запросов нужна дорогая модель, и не иметь возможности направлять их туда. Второй сценарий неудачи — зеркальное отражение: платить по тарифам Opus 5 за задачу суммаризации, которую модель с индексом 46 выполняет точно так же. Ни то, ни другое не является проблемой модели. Оба — проблемы конфигурации, а конфигурацию можно изменить во вторник днём.
