Сгенерированная главная титульная карточка для «GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed» с надзаголовком «Два уровня скорости. Одна отсутствующая цена.» и двумя карточками: слева «GPT-5.6 Sol Ultrafast» с перечислением: Веса: такие же, как у Sol, Заявленная скорость: до 14x, Цена: ещё не опубликована; справа «MiMo v2.6 Pro Ultraspeed» с перечислением: Веса: такие же, как у Pro, Заявленная скорость: от 10x до 20x, Цена: $4.35 / $8.70; внизу — «Ни один из них не был независимо измерен.» Логотип OrcaRouter в правом нижнем углу.
Guides & Insights

GPT-5.6 Sol Ultrafast против Xiaomi MiMo v2.6 Pro Ultraspeed: два скоростных уровня, одна отсутствующая цена

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Два вендора выпустили одну и ту же продуктовую идею с разницей в три недели, и разница между ними — лучший способ увидеть, что каждый из них на самом деле продаёт. У Xiaomi это появилось 22 сентября 2026 года: Xiaomi MiMo v2.6 Pro Ultraspeed — тот же чекпойнт на 1,02 трлн параметров, что и MiMo-V2.6-Pro, но обслуживается быстрее, по цене $4,35 за миллион входных токенов и $8,70 за миллион выходных против $0,44 и $0,87 у стандартной линейки Pro. GPT-5.6 Sol Ultrafast от этого вендора — тот же приём, применённый к GPT-5.6 Sol: идентичные веса, до 750 выходных токенов в секунду, до 14× стандартного уровня, работа на wafer-scale-оборудовании Cerebras — и вообще никакой опубликованной цены спустя шесть недель после анонса режима 13 августа.

Поставьте эти два варианта рядом — и аномалия сразу бросится в глаза. Xiaomi опубликовала тарифную сетку ещё до того, как опубликовала большинство бенчмарков. OpenAI опубликовала бенчмарки, аппаратного партнёра и имена клиентов — и до сих пор не опубликовала цифру, на которую можно ориентироваться при планировании бюджета. Один из этих тарифных уровней можно купить уже сегодня. Другой — это значение в схеме API. Поэтому сравнивать их — это не столько про то, кто быстрее, сколько про то, сколько стоит скоростной тариф, когда один поставщик назвал вам цену, а другой — нет.

Что каждый из них на самом деле из себя представляет

Ни то, ни другое не является новой моделью. Это общая посылка, и её стоит заявить без обиняков, потому что оба запуска привлекли публикации, которые трактовали изменение сервинга как релиз новых возможностей.

MiMo v2.6 Pro Ultraspeed — это сервисная конфигурация флагманской модели Xiaomi: тот же разреженный чекпоинт смеси экспертов с 1,02T параметров и 42B активируемых на токен, тот же контекст на 1M токенов, та же нативная мультимодальность по тексту, изображениям, видео и аудио, те же веса под лицензией MIT в публичных репозиториях. В материалах самой Xiaomi утверждается, что скорость вывода до 20 раз выше, чем у стандартного сервиса Pro, при том же качестве; сторонние каталоги, описывающие ту же модель в тот же день, говорят примерно о 10 разах. Никто не опубликовал измерение, которое примиряло бы эти два показателя.

GPT-5.6 Sol Ultrafast — это сервисная конфигурация флагманской модели OpenAI: тот же чекпойнт, то же поведение при рассуждениях, то же контекстное окно на 1 050 000 токенов, тот же максимальный объём вывода в 128K, те же ответы. Ускорение обеспечивается аппаратным обеспечением, а не планированием — веса модели находятся в SRAM на кристалле на кремнии Cerebras масштаба пластины, а не перемещаются между памятью GPU и вычислительными блоками, — и это первый продукт партнёрства OpenAI и Cerebras по вычислениям, заключённого в январе 2026 года, сумма которого, по сообщениям, составляет около 10 миллиардов долларов за три года.

Итак, честная ось сравнения — не интеллект. Это то, что вендор решил изменить, сколько он взял за это изменение и какую часть изменения он позволил вам проверить.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

Тарифные карты, включая пустую.

• MiMo v2.6 Pro Ultraspeed — $4.35 за ввод / $8.70 за вывод за миллион токенов, опубликовано Xiaomi.

• MiMo-V2.6-Pro standard — $0,44 / $0,87, опубликовано в коммерческих каталогах Xiaomi. Примерно в 9,9 раза на входе и ровно в 10 раз на выходе.

• GPT-5.6 Sol Ultrafast — по состоянию на 27 сентября 2026 года опубликованного прайс-листа нет. На странице цен OpenAI по-прежнему четыре вкладки — Standard, Batch, Flex, Fast — и этого тарифа среди них нет.

• GPT-5.6 Sol standard — $4.00 / $20.00 за миллион токенов, текущий промо-тариф OpenAI, при этом кэшированный ввод — $0.40, а при длинном контексте — переход к $8.00 / $30.00 после примерно 272K токенов ввода.

• Единственный сопоставимый премиум-режим, цену на который OpenAI когда-либо устанавливала, — Fast mode, по цене $8,00 / $40,00, ровно вдвое дороже стандартного тарифа, за скорость вывода до примерно 2,5×.

Вот та последняя строка — и есть вся причина, почему пустая ячейка имеет значение. Скоростной тариф Xiaomi стоит в десять раз дороже стандартного и заявляет скорость в десять–двадцать раз выше; как сделка это по крайней мере внутренне согласованно: вы платите пропорционально больше за пропорционально меньшее ожидание, а ставка делается на то, что именно реальное время и есть продукт. Скоростной тариф OpenAI — это более серьёзная заявка на более дефицитный кремний, чем Fast mode, поэтому сколько бы он в итоге ни стоил, прецедент говорит о надбавке, а не о скидке. Но «прецедент говорит о надбавке» — это не число, и пока его нет, этот тариф вообще нельзя сравнивать с UltraSpeed по цене — только по тому, что Xiaomi была готова назвать свою цифру, а OpenAI — нет.

Откуда взялись эти числа

У этих двух уровней противоположные доказательственные проблемы, и стоит назвать обе, а не сглаживать разницу.

Заявление Xiaomi о скорости неопределённо по величине, но привязано к опубликованной цене. 20× — это установленный вендором потолок в условиях, которые Xiaomi не уточнила; 10× — это то, что каталожное описание готово было утверждать как типичный показатель; а реальный множитель находится где-то в широком диапазоне, который никто публично не измерял при заявленном уровне параллелизма. На фоне этого цена точна, веса доступны для скачивания под MIT, а технический отчёт и среда обучения с подкреплением общедоступны — вы можете изучить, что сделала Xiaomi, но пока не можете проверить, насколько быстро это работает.

Заявление OpenAI о скорости конкретно по величине, но не привязано ни к чему, что можно купить. До 750 выходных токенов в секунду, до 14× стандартного показателя — сказано прямо. Это ещё и показатель пропускной способности для выходных токенов, а не единый сквозной множитель: обработка входных данных и собственные рассуждения модели не сжимаются в такой пропорции — поэтому компания называет его максимумом. Подкрепляющие бенчмарки предоставлены вендором, а в одном случае являются межвендорными: прогон Humanity's Last Exam на 2500 вопросов, как сообщается, завершился за 11 часов 11 минут против 78 часов 27 минут у Claude Fable 5, при сопоставимой точности. Независимые материалы о запуске цитировали более узкое сравнение скорости генерации — примерно 11× — в том же прогоне, тогда как собственные цифры Cerebras подразумевают около 7× для общего времени теста. Три стороны, три доли одной рабочей нагрузки — ни одна из них не воспроизведена третьей стороной. Cerebras отдельно сообщает о сквозном ускорении 5,6× на GDP-Val без измеримой потери качества, что также не воспроизведено.

Оба набора цифр заявлены вендорами. Разница в том, что расплывчатость Xiaomi касается скорости, а OpenAI — стоимости, и для любого, кто составляет бюджет, стоимость угадать сложнее.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Что произошло на этой неделе и почему это не закрывает разрыв

То, что это сравнение вообще имеет информационный повод, объясняется коммитом, а не анонсом. Значение ultrafast присутствует в публичной спецификации openai-openapi от OpenAI с 13 августа 2026 года — в тот же день, когда был анонсирован этот режим, — и сопровождается описанием, которое привязывает его к gpt-5.6-sol и характеризует доступ к нему как контролируемый. Коммит, появившийся на этой неделе, — более поздний и менее значительный: 25 сентября 2026 года fe4f7a1 добавил ultrafast ещё в два перечисления — параметр service_tier на уровне запроса и поле политики service_tier для агентов. До этого коммита в этих двух списках значились auto, default, flex, priority, fast. После него появилась запись с описанием «Использует уровень обслуживания ultrafast».ultrafast в service_tier-перечисления в своей публичной openai-openapi — поле, которое схема описывает как «уровень обслуживания, используемый для запросов к модели», а также поле политики, привязанное к агентам. До этого изменения в этом списке значились default, flex, priority, fast. После него появилась запись с описанием «Использует уровень обслуживания ultrafast».

Это различие важно для всех, кто читает эти материалы. Это не создаваемый уровень; это уровень, который подключается к полю, с которым настроен агент, а значит, под него в конечном итоге можно будет написать клиент без какого-либо нового эндпоинта. В репортаже на следующий день описывается селектор Fast / Standard / Ultrafast, который появится в Responses API Playground, причём более широкий доступ ожидается после конференции DevDay компании OpenAI. Мы не видели этот селектор, и OpenAI не опубликовала заметку о развёртывании, так что эта часть основана на одном источнике. Что можно проверить — это добавленные записи схемы и то, что прайс-лист по-прежнему отсутствует спустя шесть недель после анонса.

Тем временем тариф Xiaomi можно купить уже пять дней, и он по-прежнему остаётся единственным из двух, который можно включить в счёт. Его собственный открытый вопрос иной: удержится ли десятикратная наценка или же он поведёт себя как большинство стартовых цен на новом премиальном тарифе и сползёт к стандартному уровню, как только прекратится освещение запуска. Standard Pro по цене $0.44 / $0.87 — это якорь, а тариф, стартующий с десятикратным превышением якоря, редко остаётся на этом уровне.

Выбор между ними, учитывая, что вы, вероятно, не можете

Неудобный практический факт заключается в том, что для большинства читателей это сравнение между уровнем, который вы не можете купить, и уровнем, который вам, вероятно, не стоит покупать по прейскуранту. GPT-5.6 Sol Ultrafast — это предварительная версия с листом ожидания для избранных клиентов, расширяющаяся по мере роста мощностей, без даты выхода в общий доступ и без цены; MiMo v2.6 Pro Ultraspeed доступен, дорог и создан для покупателя определённого типа.

Тест рабочей нагрузки одинаков для обоих, и он касается формы графа ваших запросов, а не размера вашего промпта. Одна длинная генерация даёт гораздо меньше, чем заявленный множитель, потому что обработка входных данных и рассуждение ускоряются не с одинаковым коэффициентом. Цикл агента из сорока шагов за одним видимым для пользователя действием даёт нечто гораздо более близкое к полному числу, потому что каждый обмен — это задержка, которую человек пережидает. Если ваш трафик похож на вторую форму, оба уровня нацелены на вас; если он похож на первую, стандартный вариант на любой из моделей всегда был правильным выбором, и стандартный вариант MiMo-V2.6-Pro по цене $0.44 / $0.87 — один из самых дешёвых способов вызвать модель класса триллиона параметров где угодно.

Что не меняется ни на одном из этих уровней, так это то, что вы покупаете задержку, а не качество. Если вы протестируете UltraSpeed или Ultrafast против их собственной стандартной линии на идентичных промптах и получите разные ответы, это находка, о которой стоит сообщить, а не особенность, — ни в описании ни одного из поставщиков не утверждается, что веса изменились.

Это также тот случай, когда роутер заслуживает своё место, и особенно для уровня, который вы не можете получить. GPT-5.6 Sol уже доступен на OrcaRouter как openai/gpt-5.6-sol по собственной ставке провайдера с нулевой наценкой на токены через OpenAI-совместимый эндпоинт по адресу api.orcarouter.ai/v1, так что стандартный маршрут, к которому вы бы откатились, — это всего одно изменение base-URL, и тот же ключ поддерживает 200+ моделей. Это важно, потому что честный ответ на вопрос «стоит ли мне использовать Ultrafast» сегодня таков: «вы не можете, так что решите, что будет обслуживать интерактивный трафик тем временем» — и способ получить низкую задержку без листа ожидания — направлять интерактивные вызовы к той модели из каталога, которая проходит вашу планку качества с наименьшим фактическим временем, а ночную работу оставить на самом дешёвом маршруте, который проходит. Когда этот уровень откроется, это и будет переключатель, который вы щёлкнете. Отметьте прямо, что мы не хостим: ни одной модели Xiaomi нет на OrcaRouter, поэтому MiMo v2.6 Pro Ultraspeed поступает из собственного API Xiaomi и нескольких сторонних платформ, и эта страница не является маршрутом к нему.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Что бы это уладило

Три измерения, ни одного из которых пока не существует. Опубликованная тарифная карта Ultrafast сделала бы это именно тем сравнением, которым оно заслуживает быть, а не сравнением с дырой в нём. Независимое распределение задержки при указанном уровне параллелизма сказало бы вам, находится ли реальный множитель Xiaomi ближе к 10× или к 20×, и сохраняется ли он под нагрузкой, а не в однопоточной демонстрации. А независимое воспроизведение набора бенчмарков любого из поставщиков вывело бы оба набора цифр из колонки заявлений.

До тех пор оправданное прочтение остаётся узким. Xiaomi выпустила скоростной тариф с ценой и расплывчатой скоростью; OpenAI выпустила скоростной тариф с конкретной скоростью и без цены; оба — та же модель, что и то, с чем их сопоставляют по цене, и ни один из них не был независимо измерен. Если задержка нужна вам сейчас и рабочая нагрузка интерактивна, UltraSpeed реален, доступен для покупки и его цена рассчитана ровно на того покупателя, на которого он нацелен. Если задержка нужна сейчас, а рабочая нагрузка неинтерактивна, стандартные каналы у обеих моделей дешевле, проверены и доступны уже сегодня — а тариф, о котором все спорят, всё ещё будет на месте, когда кто-нибудь опубликует цифры.