Сгенерированная титульная карточка, сравнивающая Xiaomi MiMo-V2.6-Pro и GPT-5.6 Sol при максимальном усилии. На левой карточке указано: Intelligence Index v4.3.2: 46, $0.18 смешанная цена за 1M, $0.13 за задачу индекса и 134.3 токена в секунду; на правой карточке указано: Intelligence Index v4.3.2: 47, $3.08 смешанная цена за 1M, $3,464.84 на запуск индекса и 77.3 токена в секунду. В нижнем колонтитуле указано: Обе оценки по Artificial Analysis Intelligence Index v4.3.2, получены 22 сентября 2026 года. Логотип OrcaRouter наложен в правом нижнем углу.
Guides & Insights

MiMo-V2.6-Pro против GPT-5.6 Sol: один пункт индекса, в двадцать два раза выше смешанной ставки

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Согласно Artificial Analysis Intelligence Index v4.3.2, по состоянию на 22 сентября 2026 года, GPT-5.6 Sol от вендора при максимальном усилии набирает 47 баллов, а MiMo-V2.6-Pro от Xiaomi — 46. Один балл. Смешанные тарифы, которые Artificial Analysis публикует для этих двух моделей — при соотношении 7:2:1 для попаданий в кэш, входных и выходных данных, — составляют $3,08 для GPT-5.6 Sol и $0,18 для MiMo-V2.6-Pro. Двадцатидвухкратная сумма за один балл индекса — это вся суть этого противостояния, и интересный вопрос не в том, стоит ли этот балл того. А в том, в каких конкретных запросах этот балл живёт, потому что агрегат вам этого не скажет.

Что вообще делает эту пару достойной сравнения, так это то, что они не очевидно принадлежат к одной категории. GPT-5.6 Sol — проприетарная фронтирная модель с мультиагентным режимом и соответствующим прайс-листом. Xiaomi MiMo-V2.6-Pro — это чекпойнт с открытыми весами под лицензией MIT, вышедший 22 сентября 2026 года, причём репозитории для обучения с подкреплением появились днём ранее, а цена у него такая, будто это модель среднего уровня. То, что открытая модель с триллионом параметров оказывается всего в одном пункте от флагмана OpenAI, — это и есть новость. А что вы будете делать с этим фактом — отдельное решение.

Две модели, если говорить прямо.

GPT-5.6 Sol был выпущен 9 июля 2026 года как флагман семейства GPT-5.6, наряду с Terra и Luna, и OpenAI направляет на него голосовой псевдоним gpt-5.6. Он проприетарный, принимает текстовый и графический ввод и возвращает текст, поддерживает уровни интенсивности рассуждений от none до xhigh, а также эксклюзивный для Sol многoагентный режим «ultra», и имеет дату отсечения знаний — февраль 2026 года. Его прейскурантная цена составляет $4,00 за миллион входных токенов и $20,00 за миллион выходных в первопартийном API OpenAI, при этом кэшированный ввод стоит $0,50, а контекстное окно — 1 млн токенов. Artificial Analysis измерила 77,3 выходных токена в секунду и 127,21 секунды до первого токена при стоимости $3 464,84 для прогона полного индекса.

Xiaomi MiMo-V2.6-Pro — это разреженная модель со смесью экспертов: 1,02 триллиона общих параметров и 42 миллиарда активируемых на токен, с контекстным окном 1M токенов и нативной мультимодальностью для текста, изображений, видео и аудио. Xiaomi сохранила цены предыдущего поколения, а не подняла их для нового чекпоинта, — именно поэтому модель такого размера стоит $0.43 и $0.87 за миллион токенов при 99% скидке на кэш. Artificial Analysis замерила 134,3 выходных токена в секунду, 2,15 секунды до первого токена и $206.66 на прогон индекса — $0.13 за задачу.

• Веса — MiMo-V2.6-Pro под лицензией MIT и доступна для скачивания; GPT-5.6 Sol — проприетарная, только API

• Параметры — MiMo-V2.6-Pro 1,02T всего / 42B активных; GPT-5.6 Sol не раскрыто

• Контекст — 1 млн токенов в обоих случаях; GPT-5.6 Sol ограничивает вывод на уровне 128K

• Модальность — MiMo-V2.6-Pro принимает текст, изображения, видео и аудио; заявленная поддержка входных данных GPT-5.6 Sol — текст и изображения.

• Цена по прайс-листу — MiMo-V2.6-Pro $0.43 / $0.87 за 1M; GPT-5.6 Sol $4.00 / $20.00, кэшированный ввод $0.50

• Смешанная ставка — MiMo-V2.6-Pro $0,18 за 1 млн; GPT-5.6 Sol $3,08

• Измеренная стоимость за одну задачу индексации — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $3 464,84 за полный индекс

• Скорость — MiMo-V2.6-Pro 134,3 выходных токена/с; GPT-5.6 Sol 77,3

• Время до первого токена — MiMo-V2.6-Pro 2,15 секунды; GPT-5.6 Sol 127,21 секунды

• Управление рассуждениями — GPT-5.6 Sol предоставляет none/low/medium/high/xhigh/max, а также ультра-мультиагентный режим; MiMo-V2.6-Pro не публикует аналогичной шкалы.

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol, subtitled One index point on the composite, twenty-two times the blended rate. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; list price $0.43 / $0.87 per 1M; blended rate per 1M $0.18; cost per index task $0.13; speed 134.3 tokens per second; time to first token 2.15 s. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; list price $4.00 / $20.00 per 1M; blended rate per 1M $3.08; cost to run the index $3,464.84; speed 77.3 tokens per second; time to first token 127.21 s. A footer notes both scores are Artificial Analysis Intelligence Index v4.3.2 read 22 September 2026. The OrcaRouter logo is composited in the bottom-right corner.

Где на самом деле находится эта одна точка

Разрыв в один пункт по композитному показателю из десяти оценок — это ошибка округления на уровне агрегата и пропасть на уровне компонента. Набор охватывает AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1 — рассуждение, знания, математику и программирование — и ни один из производителей не публикует разбивку по отдельным оценкам для этих двух моделей. Это отсутствие — реальное ограничение для обеих сторон этой страницы, и о нём стоит сказать, а не маскировать его композитным показателем.

Имеющиеся публичные данные носят ориентирующий характер и указывают на агентную работу как на место сосредоточения разрыва. В материалах к запуску GPT-5.6 Sol сообщается о 53,6% в Agents' Last Exam — давно проводимой оценке профессиональных рабочих процессов, охватывающей 55 областей, которую OpenAI назвала новым максимумом; 64,6% в SWE-Bench Pro; 88,8% в Terminal-Bench 2.1 и 62,6% в OSWorld 2.0 для работы с компьютером. Его результат в BrowseComp — 90,4% — возрастает до 92,2% в режиме ultra, который запускает четыре параллельных субагента примерно при четырехкратной стоимости в токенах. Это показатели вендора на вендорских стендах, и к каждому из них применима обычная оговорка — но это именно те категории, где разрыв в один пункт в сводном показателе с наименьшей вероятностью окажется равномерно распределенным, а Xiaomi не публикует сопоставимой разбивки по агентным возможностям для MiMo-V2.6-Pro.

Противовесом служит то, что собственные цифры MiMo-V2.6-Pro от поставщика относятся к совершенно иному семейству задач. Xiaomi сообщает, что модель улучшилась с 58,4 до 72,57 на DeepSWE v1.1 в ходе своего прогона обучения с подкреплением, при оценке с помощью mini-swe-agent по среднему из трёх на собственной системе оценки Xiaomi, и она никогда не подавалась на публичный лидерборд. Поставить 72,57 рядом с любой цифрой Sol означало бы придумать сравнение, которого не существует. Единственные числа, на которых обе модели фактически прогонялись одним и тем же оценщиком, — это 46 и 47.

Сравнение затрат, сделанное как следует

Арифметика по отдельным токенам преуменьшает разрыв, потому что две модели потребляют разное количество токенов, чтобы выполнить одну и ту же работу. Справедливое единое число — это то, что Artificial Analysis измерила, прогнав свой полный индекс на каждой из них: $206,66 для MiMo-V2.6-Pro и $3 464,84 для GPT-5.6 Sol. Тот же набор, тот же стенд, измерено одинаково — разница в 16,8 раза на контролируемом наборе задач, и она уже учитывает тот факт, что Sol — это модель рассуждений, генерирующая токены, чтобы думать.

Теперь продакшен-цикл. Запуск агента на 30 шагов, читающий 200 000 токенов контекста на шаг и записывающий 2 000 токенов на шаг, — это 6 млн входных и 60 000 выходных токенов за запуск. В GPT-5.6 Sol по прайс-листу это $24.00 за вход и $1.20 за выход — $25.20 за запуск до кэширования. В MiMo-V2.6-Pro это $2.58 и $0.05 — $2.63. Кэширование сдвигает обе цифры: кэшированный вход Sol по $0.50 против 99% скидки MiMo-V2.6-Pro всё равно оставляет дорогую модель на порядок впереди по затратам на цикле с большим объёмом контекста, а именно такой цикл и выполняет агент.

Та половина сравнения, что касается задержки, контрастнее половины о цене — и получает меньше внимания. У GPT-5.6 Sol время до первого токена составило 127,21 секунды. У MiMo-V2.6-Pro — 2,15. Это разница в пятьдесят девять раз, и именно это число решает, возможно ли интерактивное приложение в принципе. Sol на максимальном усилии на практике — это пакетная модель: вы отправляете запрос, ждёте, возвращаетесь позже. Если ваше приложение блокируется в ожидании первого токена, выбор уже сделан за вас, что бы ни говорил индекс.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 22 September 2026. The header reads 46 Artificial Analysis Intelligence Index, ranked first of 114 in its class; 134.3 output tokens per second, ranked eleventh of 114; $0.435 input and $0.87 output per 1M tokens with a 99% cache discount; $0.13 cost per Intelligence Index task, ranked twelfth of 114; and 140M output tokens from the Intelligence Index. Technical specifications list reasoning Yes, input modality text, image, speech and video, output modality text, a 1M-token context window, 1.0T total parameters, 42B active parameters, an MIT licence and Hugging Face model weights, under a breadcrumb reading Xiaomi, Open weights model, Released September 2026. A comparison summary notes it cost $206.66 to evaluate MiMo-V2.6-Pro on the Intelligence Index.

Один ключ, обе полосы

Обе модели доступны через один ключ OrcaRouter по прейскурантной цене провайдера с наценкой 0% — GPT-5.6 Sol как openai/gpt-5.6-sol, что является нашим собственным маршрутом к ней. Поскольку мы передаём прейскурантную цену провайдера без наценки, изменение цены с любой стороны становится актуальным у нас в тот же день, а не после ожидания повторного пересчёта цены.

DSL маршрутизации — вот где эта пара становится интересной, а не просто удобной. Две модели, различающиеся на один пункт индекса, одна из которых стоит в шестнадцать раз дороже за задачу, — это не альтернативы, между которыми нужно выбирать, а двухполосная конфигурация. Отправляйте основную часть нагрузки на дешёвую полосу, а хвост направляйте на дорогую по определяемому вами предикату: запросы, не проходящие самопроверку; запросы, соответствующие правилу сложности; запросы, у которых стоимость отказа настолько превышает стоимость токенов, что это становится дешёвой страховкой. Переключение при отказе — вторая половина этой картины. Sol доступна широко; MiMo-V2.6-Pro вышла на этой неделе и на момент фиксации в Artificial Analysis значилась лишь у одного API-провайдера, а это тонкий маршрут для модели, которую вы поставили бы в продакшн-контур. Именно роутер, умеющий переключаться на резерв, делает дешёвую полосу безопасной для внедрения, а также делает дорогую полосу необязательной, а не обязательной.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol, captured 22 September 2026. The page lists the model id openai/gpt-5.6-sol, by OpenAI, dated 2026-07-09, marked FEATURED, with Vision, Tools, JSON and Reasoning badges, a 1M-token context window, a maximum output of 128K tokens, input of text, image and file with text output, $4.00 per 1M input tokens and $20.00 per 1M output tokens, 40.2M tokens of traffic over seven days, and a code sample calling the model through the OpenAI-compatible base URL api.orcarouter.ai/v1.

Какой выбрать?

Выбирайте GPT-5.6 Sol, когда стоимость ошибки в задаче многократно превышает стоимость токенов — долгосрочная агентная работа с реальными побочными эффектами, автоматизация работы с компьютером, использование инструментов, где ошибочный вызов хуже медленного, всё, где вы уже платите человеку за проверку результата. Прогон индекса за $3,464.84 — не причина избегать его; это цена этого уровня, и уровень существует не просто так.

Выбирайте MiMo-V2.6-Pro, когда ограничивающим фактором является объём, когда рабочая нагрузка интенсивна по контексту и повторяема, когда задержка до первого токена должна быть достаточно низкой, чтобы человек мог дождаться, когда вы хотите держать веса в собственной инфраструктуре — MIT разрешает коммерческое развёртывание, модификацию и дальнейшее обучение — или когда юнит-экономика работает только при пятой части цента за тысячу токенов. Его скорость 134,3 токена в секунду делает его пригодным для интерактивного использования так, как большинство открытых моделей с триллионом параметров — нет, и это возможность, а не скидка.

Выбирайте обе, если у вас есть маршрутизатор, потому что честный ответ на вопрос «какая лучше» состоит в том, что разрыв в один пункт по композитной оценке — это не вердикт, а измерение того, насколько они похожи в среднем и насколько разными они, вероятно, окажутся в хвосте. Сценарий отказа, которого нужно избегать, — это стандартизация на дешёвой модели из-за соотношения 22x, обнаружение на третьем месяце, что для некоторого класса запросов нужна дорогая модель, и отсутствие пути, чтобы направлять их туда. Зеркальная ошибка — платить по тарифам Sol за задачу суммирования, с которой модель с индексом 46 справляется точно так же. Ни то, ни другое не является проблемой модели. И то, и другое — конфигурация, а конфигурация — это то, что можно изменить во вторник днём.

OrcaRouter объединяет более 200 моделей за одной конечной точкой, совместимой с OpenAI, по каталожной цене провайдера с наценкой 0%, поэтому изменение цены поставщиком вступает в силу в тот же день.