
MiMo-V2.6-Pro против GPT-5.6 Sol: один пункт индекса стоит в пятнадцать раз дороже за задачу
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 36 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 181 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
В индексе Artificial Analysis Intelligence Index v4.3.2, по состоянию на 25 сентября 2026 года, GPT-5.6 Sol при максимальном уровне усилий набирает 47 баллов, а MiMo-V2.6-Pro от Xiaomi — 46. Один балл. Число, которое на самом деле их разделяет, — это не оценка и не ставка за токен, а стоимость одной задачи индекса, которую Artificial Analysis указывает как $1.99 для GPT-5.6 Sol и $0.13 для MiMo-V2.6-Pro. В пятнадцать раз больше денег за один балл. И на момент этого чтения на собственной странице оценщика для этой модели указано уведомление об устаревании, поскольку её заменил GPT-6 Sol.
Xiaomi опубликовала веса MiMo-V2.6-Pro и технический отчёт 21 сентября 2026 года, за четыре дня до этого обзора; OpenAI выпустила GPT-5.6 Sol 9 июля 2026 года. Оба приведённых выше факта появились после того, как об этой паре в последний раз писали, и они тянут в противоположные стороны. Уведомление о прекращении поддержки говорит, что сравнение идёт с моделью, которую OpenAI уже переросла. Показатель в расчёте на задачу говорит, что то, что выглядело как ошибка округления, когда обе модели оценивались по прейскурантной цене, на реальной рабочей нагрузке и есть всё решение. Что из этих двух имеет значение, зависит от того, покупаете ли вы модель или заменяете её.
Что теперь говорится на двух страницах
GPT-5.6 Sol был выпущен 9 июля 2026 года как флагман семейства GPT-5.6. Его прейскурантная цена — $4.00 за миллион входных токенов и $20.00 за миллион выходных в собственном API OpenAI, со скидкой 90% на кэш, а на странице указано 90 миллионов выходных токенов, сгенерированных за прогон индекса, при медиане 88 миллионов. Он показал 73 выходных токена в секунду, что та же страница называет выше среднего при медиане 72 т/с. В индексе он занимает 19-е место из 210 моделей в своём классе.
Xiaomi MiMo-V2.6-Pro — это разреженный чекпоинт смеси экспертов с 1,02 триллиона общих параметров и 42 миллиардами активных, под лицензией MIT, с контекстным окном в 1 млн токенов и поддержкой ввода текста, изображений, речи и видео при выводе текста. Указана цена $0,43 и $0,87 за миллион токенов со скидкой 99% на кэш — это десятая часть тарифа Sol на ввод и двадцать третья часть на вывод. Он сгенерировал 140 миллионов выходных токенов во время прогона индекса и показал 43,6 выходных токенов в секунду, что на его странице описывается как заметно медленное по сравнению с медианой 67,1 т/с.
• Стоимость задачи в индексе — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $1,99 — разрыв 15× • Цена по прайс-листу — MiMo-V2.6-Pro $0,43 / $0,87 за 1 млн; GPT-5.6 Sol $4,00 / $20,00 • Скидка на кэш — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Выходные токены в прогоне индекса — MiMo-V2.6-Pro 140 млн; GPT-5.6 Sol 90 млн • Скорость вывода — MiMo-V2.6-Pro 43,6 t/s при медиане 67,1; GPT-5.6 Sol 73 t/s при медиане 72 • Контекст и веса — MiMo-V2.6-Pro 1 млн и лицензия MIT; GPT-5.6 Sol 1 млн и проприетарная

Уведомление об устаревании — это более значимая строка.
Artificial Analysis теперь открывает страницу GPT-5.6 Sol с уведомлением в рамке: «Эта модель устарела. Мы продолжаем тестирование производительности только для рабочей нагрузки по умолчанию с 10 тыс. входных токенов», за которым следует предложение о том, что OpenAI выпустила более новую модель, GPT-6 Sol (max), и что вместо неё следует рассматривать именно её. Таким образом, 47 в индексе — это показатель модели, которая больше не является тем, что стоит покупать. Это не делает показатель ошибочным — он был измерен по тому же индексу, в тот же день, при той же настройке усилий, что и 46, — но это меняет цель сравнения. Это уже не «какой флагман мне использовать». Это «сколько стоит вершина проприетарного рейтинга в тот момент, когда она была вершиной».
Эта переформулировка значит больше, чем кажется, потому что уведомления об устаревании на страницах оценщиков — одно из немногих мест, где темп выпуска продуктов у вендора проявляется как изменение данных, а не как пресс-релиз. Оценка заморожена; сама модель не предлагается. Всё, что вы создаёте с привязкой к 47, создаётся с привязкой к снимку.

Почему именно число на задачу — то, относительно чего нужно строить модель
Ставки за токен льстят дешёвым моделям и вводят в заблуждение на рабочих нагрузках, которые не являются нейтральными по токенам. Стоимость задачи в индексе — это другое измерение: это то, что оценщик фактически потратил, чтобы получить один ответ от каждой модели, и это учитывает как ставку, так и количество токенов, которое модель решила сгенерировать. MiMo-V2.6-Pro генерирует больше токенов, чем Sol, в прогоне по индексу — 140 миллионов против 90 миллионов, примерно в 1,6 раза больше — и всё равно стоит $0,13 за задачу против $1,99. Преимущество в ставке составляет примерно двадцать три раза на выходе; штраф за многословность — 1,6×; произведение даёт пятнадцатикратный разрыв в расчёте на задачу.
Это та арифметика, на которой должна строиться модель затрат, и это та арифметика, которая остаётся невидимой, если сравнить $0,87 с $20,00 и на этом остановиться. Она также показывает, что способно разрушить этот вывод. Если в вашей нагрузке преобладают очень короткие ответы, количество токенов у Sol падает почти до вашего, и 23-кратный разрыв в тарифах делает основную работу, поэтому реальная кратность сдвигается в сторону разрыва в тарифах, а не от него. Если в вашей нагрузке преобладают длинные цепочки рассуждений, 1,6-кратная многословность MiMo-V2.6-Pro накапливается, и $0,13 становится верхней границей, а не оценкой. Опубликованная цифра — это измерение формы одного бенчмарка, а не котировка, которую можно передать в финансовый отдел.
Линия задержки — это честный противовес.
Со скоростью 43,6 выходных токена в секунду MiMo-V2.6-Pro медленнее, чем GPT-5.6 Sol, который в тот же день показал 73, и медленнее, чем модели, с которыми его сравнивает его собственная страница, медиана которых — 67,1. На его странице об этом прямо сказано: «заметно медленная». Для пакетного конвейера это расходы на пропускную способность, которые можно оценить. Для интерактивного агента это продуктное решение, а то, что она в пятнадцать раз дешевле в расчёте на задачу, не делает медленную модель быстрой. Если ваше ограничение — бюджет на один ход, а не месячный счёт, важное соотношение — 43,6 против 73, и MiMo-V2.6-Pro его проигрывает.
Куда это попадает на маршрутизаторе
Полезная сторона такого сопоставления — не «выбрать один вариант». Она в том, что обе модели отвечают на один и тот же индекс, а оценщик публикует стоимость каждой по задачам, так что разделение можно делать по измеренной стоимости, а не по уровням тарифов вендора. В каталоге OrcaRouter — 200+ моделей за одним ключом по прайсовой цене каждого провайдера с наценкой 0%: снижение цены вендором попадает в ваш счёт в тот же день, без второго договора, который нужно пересматривать, — а DSL маршрутизации позволяет направлять дешёвые массовые вызовы одной модели, а сложные — другой, по задаче, а не по бренду. Автоматическое переключение при сбое покрывает случай, когда более дешёвый маршрут деградировал. Xiaomi MiMo-V2.6-Pro нет на наших маршрутах — мы не вносим модель в список, пока провайдер её не подключил, — поэтому для этой стороны сравнения честный ответ — собственный API вендора или та хостинговая платформа, с которой у вас уже есть отношения.

Что делать с этим к следующей неделе?
Две вещи изменились 25 сентября 2026 года, и только одна из них касается цены. GPT-5.6 Sol несёт уведомление об устаревании в индексе, где он был измерен на отметке 47, что исключает его из рассмотрения при принятии решения о покупке и оставляет его в качестве эталонного ориентира. MiMo-V2.6-Pro измеряется в $0,13 за задачу индекса против $1,99 у Sol — это в пятнадцать раз больше денег за один пункт индекса, — а его скорость составляет 43,6 токена в секунду, что медленнее модели, с которой его сравнивают, и медленнее медианы его собственного класса. Прогоните эти два показателя по своему трафику, прежде чем любая из этих цифр станет решением: стоимость за задачу — это измерение, а не тариф, а задержка — это измерение, а не мнение. Если ваши выходные данные короткие и неинтерактивные, аргумент в пользу открытого чекпойнта сильнее, чем предполагает разрыв в индексе. Если ваши выходные данные длинные или ваши пользователи ждут, пятнадцатикратная экономия покупает вам более медленный продукт, и это компромисс, который может оценить только ваша рабочая нагрузка.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
