Hero-карточка радара моделей OrcaRouter для сравнения между MiMo-V2.6-Pro и Claude Opus 5 с подзаголовком «Пять пунктов индекса. В двадцать один раз дороже» и по одной панели на модель.
Guides & Insights

MiMo-V2.6-Pro против Claude Opus 5: в 21 раз дешевле, но на пять пунктов индекса позади

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Xiaomi MiMo-V2.6-Pro и Claude Opus 5 — это два полюса одной сделки, и у этой сделки есть цена. В Artificial Analysis Intelligence Index v4.3.2 Claude Opus 5 (max effort) набирает 51 балл, а Xiaomi MiMo-V2.6-Pro — 46. По тарифной сетке Claude Opus 5 стоит $5,00 за миллион входных токенов и $25,00 за миллион выходных; MiMo-V2.6-Pro — $0,43 и $0,87. Выполните деление — и ответ будет в 11,6 раза больше по входу, в 28,7 раза больше по выходу — и в 21 раз больше по смешанной ставке, которую Artificial Analysis публикует для каждой из них. Пять пунктов индекса стоят в двадцать один раз дороже. Выгодная это сделка или пустая трата — полностью зависит от того, что ваша рабочая нагрузка делает с пятым пунктом, и большинство команд никогда не разбирается в этом, прежде чем сделать выбор.

Две модели, если говорить прямо.

Claude Opus 5 — проприетарный флагман Anthropic, выпущенный 24 июля 2026 года, с окном контекста в 1 млн токенов и нераскрытым количеством параметров. Xiaomi MiMo-V2.6-Pro — это разреженная модель смеси экспертов с общим количеством параметров 1,02 трлн и 42 млрд активированных, с окном контекста в 1 млн токенов, встроенной мультимодальностью для текста, изображений, видео и аудио и опубликованными весами под лицензией MIT.

• Веса — MiMo-V2.6-Pro под лицензией MIT и доступны для скачивания; Claude Opus 5 — проприетарная, доступна только через API

• Параметры — MiMo-V2.6-Pro: всего 1,02T / 42B активных; Claude Opus 5 — не раскрыто

• Контекст — по 1 млн токенов в обоих случаях; Claude Opus 5 ограничивает объём вывода на уровне 128K в Messages API и 300K в Batch API

• Модальность — MiMo-V2.6-Pro принимает текст, изображения, видео и аудио; опубликованная входная поверхность Claude Opus 5 — текст и изображения

• Цена по прайс-листу — MiMo-V2.6-Pro $0.43 / $0.87 за 1 млн токенов; Claude Opus 5 $5.00 / $25.00

• Кэш — MiMo-V2.6-Pro указывает 99% скидку на кэш; Claude Opus 5 читает кэш по $0,50 за 1 млн, а запись — по $6,25 при TTL 5 минут

• Измеренная стоимость выполнения одной задачи Intelligence Index — MiMo-V2.6-Pro: $0,13; Claude Opus 5: $5,86

• Обслуживание — MiMo-V2.6-Pro: 134,3 выходных токена в секунду и 2,15 с до первого токена; Claude Opus 5 — 57,9 токена в секунду

Последняя пара — как раз то, что теряется. Более дешёвая модель к тому же и более быстрая — в 2,3 раза по пропускной способности на выходе, — потому что она работает на оборудовании, которое контролируют Xiaomi и её партнёры и на котором можно агрессивно объединять запросы в пакеты. Claude Opus 5 при максимальном усилии — это модель рассуждений, выполняющая больше работы на токен; разрыв в скорости — не дефект, а другой продукт. Но это означает, что дешёвый вариант не расплачивается за свою скидку задержкой. Он расплачивается за неё пятью индексными пунктами и хвостом задач, где и живёт этот пятый пункт.

Two-column scoreboard card headed 'MiMo-V2.6-Pro vs Claude Opus 5 — the scoreboard'. The Xiaomi MiMo-V2.6-Pro column lists Intelligence Index v4.3.2 score 46, list price $0.43 / $0.87 per million tokens, measured cost per index task $0.13, serving speed 134.3 tokens per second, size 1.02T total and 42B active parameters, MIT-licensed downloadable weights, and text, image, video and audio input. The Claude Opus 5 column lists index score 51, list price $5.00 / $25.00, measured cost per index task $5.86, serving speed 57.9 tokens per second, undisclosed size, proprietary API-only weights, and text and image input.

Где на самом деле находятся пять точек

Разрыв в пять баллов по композиту из десяти оценок распределён неравномерно, и агрегат скрывает то, что действительно важно. Обе модели прогонялись на одном и том же наборе v4.3.2, который включает AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1. На опубликованных страницах нет разбивки баллов по отдельным оценкам ни для одной из моделей, а это реальное ограничение для обеих сторон данного сравнения, и об этом стоит сказать, а не замалчивать.

То, что зафиксировано, носит ориентировочный характер. Claude Opus 5 при максимальном усилии набрал 49,0% на Terminal-Bench 4.0 в наборе v4.3, уступив GPT-6 Astra с 59,1% и Claude Fable 5.1 с 52,0%. На AutomationBench-AA Opus 5 выполнил все задачи без нарушения защитных ограничений в 28,3% рабочих процессов против 41,6% у GPT-6 Astra и 32,1% у Fable 5.1. Это серьёзные агентные показатели, и именно в этих категориях пятипунктовый композитный разрыв наименее вероятно будет распределён равномерно — в собственной записи индекса MiMo-V2.6-Pro не публикуется сопоставимая агентная разбивка.

Между тем вендорские цифры, которые публикуют обе компании, несопоставимы друг с другом, и стоит прямо сказать, почему. В материалах Anthropic к запуску сообщается о 96,0% в SWE-bench Verified и 79,2% в SWE-bench Pro; один трекер отмечает, что Opus 5 вышел без отдельной позиции в SWE-bench, и для него нет независимо проверенной цифры SWE-bench Verified. В материалах Xiaomi сообщается, что MiMo-V2.6-Pro вырос с 58,4 до 72,57 в DeepSWE v1.1 за время его RL-прогона, на собственном стенде Xiaomi с mini-swe-agent при усреднении по трём, и результат не отправлен в публичный рейтинг DeepSWE. Два вендорских стенда, две разные задачи, никакого пересечения. Поставить 96,0% рядом с 72,57 и сделать вывод — значит выдумать сравнение, которого не существует.

Screenshot of the OrcaRouter model page for Claude Opus 5, showing the 1M-token context window, a 128K maximum output, input pricing of $5.00 per million tokens and output pricing of $25.00 per million, cache reads at $0.50 per million and cache writes at $6.25 per million on a five-minute TTL, and the provider uptime table listing the routes behind the model.

Сравнение затрат, сделанное как следует

Подсчёт по стоимости токенов преуменьшает разрыв, потому что две модели потребляют разное количество токенов для выполнения одной и той же работы. Artificial Analysis измерила, во сколько каждой из них фактически обошёлся полный прогон Intelligence Index: $0,13 для MiMo-V2.6-Pro, $5,86 для Claude Opus 5. Это 45-кратный разрыв на контролируемом, идентичном наборе задач, и это самый честный единичный показатель из доступных, поскольку обе измерялись одинаковым способом.

Теперь сопоставьте с этим правдоподобный продакшн-цикл. Запуск агента из 30 шагов, который читает 200 000 токенов контекста на каждом шаге и записывает 2 000 токенов на каждом шаге, — это 6 миллионов входных токенов и 60 000 выходных токенов за запуск. В Claude Opus 5 по прайс-листу это $30,00 входных и $1,50 выходных — $31,50 за запуск до любого кеширования. В MiMo-V2.6-Pro это $2,58 входных и $0,05 выходных — $2,63. С кеш-скидками, которые предлагают оба поставщика, входная часть обваливается у любой из моделей, а соотношение смещается, а не исчезает: 99%-ная скидка на кеш у дешёвой модели против $0,50 за чтение кеша у дорогой всё ещё оставляет дорогую модель на порядок впереди на цикле с большим объёмом контекста.

В этом и заключается весь аргумент за дешёвый маршрут и против полного перехода. Если ваша рабочая нагрузка — это долгосрочный агентный цикл, который сотни раз перечитывает один и тот же контекст, разница в стоимости на запуск — не ошибка округления: это разница между функцией, которую вы можете позволить себе запускать для каждого пользователя, и той, которую не можете. Это довод в пользу того, чтобы поставить MiMo-V2.6-Pro перед основной массой вашего трафика. Это не довод в пользу удаления Claude Opus 5, потому что задачи, в которых пятый пункт индекса окупает себя, по построению являются задачами, в которых ошибка дешёвой модели обходится дорого.

Cost card headed 'The same agent run, priced twice', listing a stated assumption of a 30-step agent run reading 200,000 tokens of context per step and writing 2,000 tokens per step for 6M input and 60K output tokens per run; MiMo-V2.6-Pro at $0.43 / $0.87 costing $2.58 input plus $0.05 output for $2.63 per run before caching; Claude Opus 5 at $5.00 / $25.00 costing $30.00 input plus $1.50 output for $31.50 per run before caching; a per-token ratio of 11.6x on input, 28.7x on output and 21x on the blended rate; a measured $0.13 against $5.86 per Intelligence Index task, a 45x gap; and the caching comparison of a 99% cache discount against a $0.50 cache read and $6.25 cache write.

Как здесь выглядит решение о маршрутизации

Claude Opus 5 доступен через единственный ключ OrcaRouter по каталожной цене провайдера с наценкой 0 %, как anthropic/claude-opus-5, причём фронтирные модели, с которыми вы стали бы его сравнивать, находятся рядом с ним на том же ключе. Поскольку мы пропускаем каталожную цену провайдера без наценки, изменение цены поставщиком с любой стороны становится актуальным у нас в тот же день, а не после пересчёта котировки. Самое интересное — это DSL маршрутизации: вы можете объединить две модели в один вызов вместо того, чтобы выбирать между ними, направить основную массу нагрузки в дешёвый канал, а хвост — задачи, не проходящие самопроверку или соответствующие предикату сложности, — в дорогой. Отказоустойчивость — вторая половина. У Claude Opus 5 широкое покрытие провайдеров; MiMo-V2.6-Pro на момент, когда его зафиксировала Artificial Analysis, был указан лишь у одного API-провайдера, а это тонкий маршрут для модели, которую вы поставили бы в продакшн-контур. Именно возможность переключения на резерв делает дешёвый канал безопасным для внедрения.

Стоит сказать прямо, потому что легко предположить обратное: мы не размещаем MiMo-V2.6-Pro у себя. Получить к нему доступ сегодня можно через собственную платформу Xiaomi или один из сторонних каталогов, где он указан. Аргумент о маршрутизации здесь касается того, как вы используете такую модель вместе с теми, которые мы действительно предоставляем, а не утверждения, что она принадлежит нам.

Какой выбрать?

Выбирайте Claude Opus 5, когда стоимость провала задачи настолько превышает стоимость токенов, что пять индексных пунктов — это дешёвая страховка: долгосрочная агентная работа с реальными побочными эффектами, использование инструментов, где ошибочный вызов хуже медленного, всё, где вы уже платите человеку за проверку результата. Показатель в $5,86 за индексную задачу — не причина избегать его; это цена этого уровня, и уровень существует не просто так.

Выбирайте MiMo-V2.6-Pro, когда ограничивающим фактором является объём, когда рабочая нагрузка отличается большим контекстом и повторяемостью, когда вы хотите держать веса в собственной инфраструктуре — лицензия MIT допускает коммерческое развёртывание, модификацию и дальнейшее обучение — или когда вы создаёте что-то, чья юнит-экономика сходится только при пятой части цента за тысячу токенов. Скорость 134,3 токена в секунду делает его пригодным для интерактивного использования так, как большинство открытых моделей с триллионом параметров не могут.

Выбирайте оба, если у вас есть роутер, потому что честный ответ на вопрос «что лучше» таков: они не конкурируют за одни и те же запросы. Сценарий неудачи, которого нужно избегать, — самый дорогой: стандартизировать всё на дешёвой модели, потому что заявленное соотношение равно 21x, обнаружить на третий месяц, что определённому классу запросов нужна дорогая модель, и не иметь возможности направлять их туда. Второй сценарий неудачи — зеркальное отражение: платить по тарифам Opus 5 за задачу суммаризации, которую модель с индексом 46 выполняет точно так же. Ни то, ни другое не является проблемой модели. Оба — проблемы конфигурации, а конфигурацию можно изменить во вторник днём.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube