
MiMo-V2.6-Pro против GPT-5.6 Sol: один пункт индекса, в двадцать два раза выше смешанной ставки
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Согласно Artificial Analysis Intelligence Index v4.3.2, по состоянию на 22 сентября 2026 года, GPT-5.6 Sol от вендора при максимальном усилии набирает 47 баллов, а MiMo-V2.6-Pro от Xiaomi — 46. Один балл. Смешанные тарифы, которые Artificial Analysis публикует для этих двух моделей — при соотношении 7:2:1 для попаданий в кэш, входных и выходных данных, — составляют $3,08 для GPT-5.6 Sol и $0,18 для MiMo-V2.6-Pro. Двадцатидвухкратная сумма за один балл индекса — это вся суть этого противостояния, и интересный вопрос не в том, стоит ли этот балл того. А в том, в каких конкретных запросах этот балл живёт, потому что агрегат вам этого не скажет.
Что вообще делает эту пару достойной сравнения, так это то, что они не очевидно принадлежат к одной категории. GPT-5.6 Sol — проприетарная фронтирная модель с мультиагентным режимом и соответствующим прайс-листом. Xiaomi MiMo-V2.6-Pro — это чекпойнт с открытыми весами под лицензией MIT, вышедший 22 сентября 2026 года, причём репозитории для обучения с подкреплением появились днём ранее, а цена у него такая, будто это модель среднего уровня. То, что открытая модель с триллионом параметров оказывается всего в одном пункте от флагмана OpenAI, — это и есть новость. А что вы будете делать с этим фактом — отдельное решение.
Две модели, если говорить прямо.
GPT-5.6 Sol был выпущен 9 июля 2026 года как флагман семейства GPT-5.6, наряду с Terra и Luna, и OpenAI направляет на него голосовой псевдоним gpt-5.6. Он проприетарный, принимает текстовый и графический ввод и возвращает текст, поддерживает уровни интенсивности рассуждений от none до xhigh, а также эксклюзивный для Sol многoагентный режим «ultra», и имеет дату отсечения знаний — февраль 2026 года. Его прейскурантная цена составляет $4,00 за миллион входных токенов и $20,00 за миллион выходных в первопартийном API OpenAI, при этом кэшированный ввод стоит $0,50, а контекстное окно — 1 млн токенов. Artificial Analysis измерила 77,3 выходных токена в секунду и 127,21 секунды до первого токена при стоимости $3 464,84 для прогона полного индекса.
Xiaomi MiMo-V2.6-Pro — это разреженная модель со смесью экспертов: 1,02 триллиона общих параметров и 42 миллиарда активируемых на токен, с контекстным окном 1M токенов и нативной мультимодальностью для текста, изображений, видео и аудио. Xiaomi сохранила цены предыдущего поколения, а не подняла их для нового чекпоинта, — именно поэтому модель такого размера стоит $0.43 и $0.87 за миллион токенов при 99% скидке на кэш. Artificial Analysis замерила 134,3 выходных токена в секунду, 2,15 секунды до первого токена и $206.66 на прогон индекса — $0.13 за задачу.
• Веса — MiMo-V2.6-Pro под лицензией MIT и доступна для скачивания; GPT-5.6 Sol — проприетарная, только API
• Параметры — MiMo-V2.6-Pro 1,02T всего / 42B активных; GPT-5.6 Sol не раскрыто
• Контекст — 1 млн токенов в обоих случаях; GPT-5.6 Sol ограничивает вывод на уровне 128K
• Модальность — MiMo-V2.6-Pro принимает текст, изображения, видео и аудио; заявленная поддержка входных данных GPT-5.6 Sol — текст и изображения.
• Цена по прайс-листу — MiMo-V2.6-Pro $0.43 / $0.87 за 1M; GPT-5.6 Sol $4.00 / $20.00, кэшированный ввод $0.50
• Смешанная ставка — MiMo-V2.6-Pro $0,18 за 1 млн; GPT-5.6 Sol $3,08
• Измеренная стоимость за одну задачу индексации — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $3 464,84 за полный индекс
• Скорость — MiMo-V2.6-Pro 134,3 выходных токена/с; GPT-5.6 Sol 77,3
• Время до первого токена — MiMo-V2.6-Pro 2,15 секунды; GPT-5.6 Sol 127,21 секунды
• Управление рассуждениями — GPT-5.6 Sol предоставляет none/low/medium/high/xhigh/max, а также ультра-мультиагентный режим; MiMo-V2.6-Pro не публикует аналогичной шкалы.

Где на самом деле находится эта одна точка
Разрыв в один пункт по композитному показателю из десяти оценок — это ошибка округления на уровне агрегата и пропасть на уровне компонента. Набор охватывает AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1 — рассуждение, знания, математику и программирование — и ни один из производителей не публикует разбивку по отдельным оценкам для этих двух моделей. Это отсутствие — реальное ограничение для обеих сторон этой страницы, и о нём стоит сказать, а не маскировать его композитным показателем.
Имеющиеся публичные данные носят ориентирующий характер и указывают на агентную работу как на место сосредоточения разрыва. В материалах к запуску GPT-5.6 Sol сообщается о 53,6% в Agents' Last Exam — давно проводимой оценке профессиональных рабочих процессов, охватывающей 55 областей, которую OpenAI назвала новым максимумом; 64,6% в SWE-Bench Pro; 88,8% в Terminal-Bench 2.1 и 62,6% в OSWorld 2.0 для работы с компьютером. Его результат в BrowseComp — 90,4% — возрастает до 92,2% в режиме ultra, который запускает четыре параллельных субагента примерно при четырехкратной стоимости в токенах. Это показатели вендора на вендорских стендах, и к каждому из них применима обычная оговорка — но это именно те категории, где разрыв в один пункт в сводном показателе с наименьшей вероятностью окажется равномерно распределенным, а Xiaomi не публикует сопоставимой разбивки по агентным возможностям для MiMo-V2.6-Pro.
Противовесом служит то, что собственные цифры MiMo-V2.6-Pro от поставщика относятся к совершенно иному семейству задач. Xiaomi сообщает, что модель улучшилась с 58,4 до 72,57 на DeepSWE v1.1 в ходе своего прогона обучения с подкреплением, при оценке с помощью mini-swe-agent по среднему из трёх на собственной системе оценки Xiaomi, и она никогда не подавалась на публичный лидерборд. Поставить 72,57 рядом с любой цифрой Sol означало бы придумать сравнение, которого не существует. Единственные числа, на которых обе модели фактически прогонялись одним и тем же оценщиком, — это 46 и 47.
Сравнение затрат, сделанное как следует
Арифметика по отдельным токенам преуменьшает разрыв, потому что две модели потребляют разное количество токенов, чтобы выполнить одну и ту же работу. Справедливое единое число — это то, что Artificial Analysis измерила, прогнав свой полный индекс на каждой из них: $206,66 для MiMo-V2.6-Pro и $3 464,84 для GPT-5.6 Sol. Тот же набор, тот же стенд, измерено одинаково — разница в 16,8 раза на контролируемом наборе задач, и она уже учитывает тот факт, что Sol — это модель рассуждений, генерирующая токены, чтобы думать.
Теперь продакшен-цикл. Запуск агента на 30 шагов, читающий 200 000 токенов контекста на шаг и записывающий 2 000 токенов на шаг, — это 6 млн входных и 60 000 выходных токенов за запуск. В GPT-5.6 Sol по прайс-листу это $24.00 за вход и $1.20 за выход — $25.20 за запуск до кэширования. В MiMo-V2.6-Pro это $2.58 и $0.05 — $2.63. Кэширование сдвигает обе цифры: кэшированный вход Sol по $0.50 против 99% скидки MiMo-V2.6-Pro всё равно оставляет дорогую модель на порядок впереди по затратам на цикле с большим объёмом контекста, а именно такой цикл и выполняет агент.
Та половина сравнения, что касается задержки, контрастнее половины о цене — и получает меньше внимания. У GPT-5.6 Sol время до первого токена составило 127,21 секунды. У MiMo-V2.6-Pro — 2,15. Это разница в пятьдесят девять раз, и именно это число решает, возможно ли интерактивное приложение в принципе. Sol на максимальном усилии на практике — это пакетная модель: вы отправляете запрос, ждёте, возвращаетесь позже. Если ваше приложение блокируется в ожидании первого токена, выбор уже сделан за вас, что бы ни говорил индекс.

Один ключ, обе полосы
Обе модели доступны через один ключ OrcaRouter по прейскурантной цене провайдера с наценкой 0% — GPT-5.6 Sol как openai/gpt-5.6-sol, что является нашим собственным маршрутом к ней. Поскольку мы передаём прейскурантную цену провайдера без наценки, изменение цены с любой стороны становится актуальным у нас в тот же день, а не после ожидания повторного пересчёта цены.
DSL маршрутизации — вот где эта пара становится интересной, а не просто удобной. Две модели, различающиеся на один пункт индекса, одна из которых стоит в шестнадцать раз дороже за задачу, — это не альтернативы, между которыми нужно выбирать, а двухполосная конфигурация. Отправляйте основную часть нагрузки на дешёвую полосу, а хвост направляйте на дорогую по определяемому вами предикату: запросы, не проходящие самопроверку; запросы, соответствующие правилу сложности; запросы, у которых стоимость отказа настолько превышает стоимость токенов, что это становится дешёвой страховкой. Переключение при отказе — вторая половина этой картины. Sol доступна широко; MiMo-V2.6-Pro вышла на этой неделе и на момент фиксации в Artificial Analysis значилась лишь у одного API-провайдера, а это тонкий маршрут для модели, которую вы поставили бы в продакшн-контур. Именно роутер, умеющий переключаться на резерв, делает дешёвую полосу безопасной для внедрения, а также делает дорогую полосу необязательной, а не обязательной.

Какой выбрать?
Выбирайте GPT-5.6 Sol, когда стоимость ошибки в задаче многократно превышает стоимость токенов — долгосрочная агентная работа с реальными побочными эффектами, автоматизация работы с компьютером, использование инструментов, где ошибочный вызов хуже медленного, всё, где вы уже платите человеку за проверку результата. Прогон индекса за $3,464.84 — не причина избегать его; это цена этого уровня, и уровень существует не просто так.
Выбирайте MiMo-V2.6-Pro, когда ограничивающим фактором является объём, когда рабочая нагрузка интенсивна по контексту и повторяема, когда задержка до первого токена должна быть достаточно низкой, чтобы человек мог дождаться, когда вы хотите держать веса в собственной инфраструктуре — MIT разрешает коммерческое развёртывание, модификацию и дальнейшее обучение — или когда юнит-экономика работает только при пятой части цента за тысячу токенов. Его скорость 134,3 токена в секунду делает его пригодным для интерактивного использования так, как большинство открытых моделей с триллионом параметров — нет, и это возможность, а не скидка.
Выбирайте обе, если у вас есть маршрутизатор, потому что честный ответ на вопрос «какая лучше» состоит в том, что разрыв в один пункт по композитной оценке — это не вердикт, а измерение того, насколько они похожи в среднем и насколько разными они, вероятно, окажутся в хвосте. Сценарий отказа, которого нужно избегать, — это стандартизация на дешёвой модели из-за соотношения 22x, обнаружение на третьем месяце, что для некоторого класса запросов нужна дорогая модель, и отсутствие пути, чтобы направлять их туда. Зеркальная ошибка — платить по тарифам Sol за задачу суммирования, с которой модель с индексом 46 справляется точно так же. Ни то, ни другое не является проблемой модели. И то, и другое — конфигурация, а конфигурация — это то, что можно изменить во вторник днём.
OrcaRouter объединяет более 200 моделей за одной конечной точкой, совместимой с OpenAI, по каталожной цене провайдера с наценкой 0%, поэтому изменение цены поставщиком вступает в силу в тот же день.
