
GPT-5.6 Sol Ultrafast против Xiaomi MiMo v2.6 Pro Ultraspeed: два скоростных уровня, одна отсутствующая цена
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 610 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 189 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Два вендора выпустили одну и ту же продуктовую идею с разницей в три недели, и разница между ними — лучший способ увидеть, что каждый из них на самом деле продаёт. У Xiaomi это появилось 22 сентября 2026 года: Xiaomi MiMo v2.6 Pro Ultraspeed — тот же чекпойнт на 1,02 трлн параметров, что и MiMo-V2.6-Pro, но обслуживается быстрее, по цене $4,35 за миллион входных токенов и $8,70 за миллион выходных против $0,44 и $0,87 у стандартной линейки Pro. GPT-5.6 Sol Ultrafast от этого вендора — тот же приём, применённый к GPT-5.6 Sol: идентичные веса, до 750 выходных токенов в секунду, до 14× стандартного уровня, работа на wafer-scale-оборудовании Cerebras — и вообще никакой опубликованной цены спустя шесть недель после анонса режима 13 августа.
Поставьте эти два варианта рядом — и аномалия сразу бросится в глаза. Xiaomi опубликовала тарифную сетку ещё до того, как опубликовала большинство бенчмарков. OpenAI опубликовала бенчмарки, аппаратного партнёра и имена клиентов — и до сих пор не опубликовала цифру, на которую можно ориентироваться при планировании бюджета. Один из этих тарифных уровней можно купить уже сегодня. Другой — это значение в схеме API. Поэтому сравнивать их — это не столько про то, кто быстрее, сколько про то, сколько стоит скоростной тариф, когда один поставщик назвал вам цену, а другой — нет.
Что каждый из них на самом деле из себя представляет
Ни то, ни другое не является новой моделью. Это общая посылка, и её стоит заявить без обиняков, потому что оба запуска привлекли публикации, которые трактовали изменение сервинга как релиз новых возможностей.
MiMo v2.6 Pro Ultraspeed — это сервисная конфигурация флагманской модели Xiaomi: тот же разреженный чекпоинт смеси экспертов с 1,02T параметров и 42B активируемых на токен, тот же контекст на 1M токенов, та же нативная мультимодальность по тексту, изображениям, видео и аудио, те же веса под лицензией MIT в публичных репозиториях. В материалах самой Xiaomi утверждается, что скорость вывода до 20 раз выше, чем у стандартного сервиса Pro, при том же качестве; сторонние каталоги, описывающие ту же модель в тот же день, говорят примерно о 10 разах. Никто не опубликовал измерение, которое примиряло бы эти два показателя.
GPT-5.6 Sol Ultrafast — это сервисная конфигурация флагманской модели OpenAI: тот же чекпойнт, то же поведение при рассуждениях, то же контекстное окно на 1 050 000 токенов, тот же максимальный объём вывода в 128K, те же ответы. Ускорение обеспечивается аппаратным обеспечением, а не планированием — веса модели находятся в SRAM на кристалле на кремнии Cerebras масштаба пластины, а не перемещаются между памятью GPU и вычислительными блоками, — и это первый продукт партнёрства OpenAI и Cerebras по вычислениям, заключённого в январе 2026 года, сумма которого, по сообщениям, составляет около 10 миллиардов долларов за три года.
Итак, честная ось сравнения — не интеллект. Это то, что вендор решил изменить, сколько он взял за это изменение и какую часть изменения он позволил вам проверить.

Тарифные карты, включая пустую.
• MiMo v2.6 Pro Ultraspeed — $4.35 за ввод / $8.70 за вывод за миллион токенов, опубликовано Xiaomi.
• MiMo-V2.6-Pro standard — $0,44 / $0,87, опубликовано в коммерческих каталогах Xiaomi. Примерно в 9,9 раза на входе и ровно в 10 раз на выходе.
• GPT-5.6 Sol Ultrafast — по состоянию на 27 сентября 2026 года опубликованного прайс-листа нет. На странице цен OpenAI по-прежнему четыре вкладки — Standard, Batch, Flex, Fast — и этого тарифа среди них нет.
• GPT-5.6 Sol standard — $4.00 / $20.00 за миллион токенов, текущий промо-тариф OpenAI, при этом кэшированный ввод — $0.40, а при длинном контексте — переход к $8.00 / $30.00 после примерно 272K токенов ввода.
• Единственный сопоставимый премиум-режим, цену на который OpenAI когда-либо устанавливала, — Fast mode, по цене $8,00 / $40,00, ровно вдвое дороже стандартного тарифа, за скорость вывода до примерно 2,5×.
Вот та последняя строка — и есть вся причина, почему пустая ячейка имеет значение. Скоростной тариф Xiaomi стоит в десять раз дороже стандартного и заявляет скорость в десять–двадцать раз выше; как сделка это по крайней мере внутренне согласованно: вы платите пропорционально больше за пропорционально меньшее ожидание, а ставка делается на то, что именно реальное время и есть продукт. Скоростной тариф OpenAI — это более серьёзная заявка на более дефицитный кремний, чем Fast mode, поэтому сколько бы он в итоге ни стоил, прецедент говорит о надбавке, а не о скидке. Но «прецедент говорит о надбавке» — это не число, и пока его нет, этот тариф вообще нельзя сравнивать с UltraSpeed по цене — только по тому, что Xiaomi была готова назвать свою цифру, а OpenAI — нет.
Откуда взялись эти числа
У этих двух уровней противоположные доказательственные проблемы, и стоит назвать обе, а не сглаживать разницу.
Заявление Xiaomi о скорости неопределённо по величине, но привязано к опубликованной цене. 20× — это установленный вендором потолок в условиях, которые Xiaomi не уточнила; 10× — это то, что каталожное описание готово было утверждать как типичный показатель; а реальный множитель находится где-то в широком диапазоне, который никто публично не измерял при заявленном уровне параллелизма. На фоне этого цена точна, веса доступны для скачивания под MIT, а технический отчёт и среда обучения с подкреплением общедоступны — вы можете изучить, что сделала Xiaomi, но пока не можете проверить, насколько быстро это работает.
Заявление OpenAI о скорости конкретно по величине, но не привязано ни к чему, что можно купить. До 750 выходных токенов в секунду, до 14× стандартного показателя — сказано прямо. Это ещё и показатель пропускной способности для выходных токенов, а не единый сквозной множитель: обработка входных данных и собственные рассуждения модели не сжимаются в такой пропорции — поэтому компания называет его максимумом. Подкрепляющие бенчмарки предоставлены вендором, а в одном случае являются межвендорными: прогон Humanity's Last Exam на 2500 вопросов, как сообщается, завершился за 11 часов 11 минут против 78 часов 27 минут у Claude Fable 5, при сопоставимой точности. Независимые материалы о запуске цитировали более узкое сравнение скорости генерации — примерно 11× — в том же прогоне, тогда как собственные цифры Cerebras подразумевают около 7× для общего времени теста. Три стороны, три доли одной рабочей нагрузки — ни одна из них не воспроизведена третьей стороной. Cerebras отдельно сообщает о сквозном ускорении 5,6× на GDP-Val без измеримой потери качества, что также не воспроизведено.
Оба набора цифр заявлены вендорами. Разница в том, что расплывчатость Xiaomi касается скорости, а OpenAI — стоимости, и для любого, кто составляет бюджет, стоимость угадать сложнее.

Что произошло на этой неделе и почему это не закрывает разрыв
То, что это сравнение вообще имеет информационный повод, объясняется коммитом, а не анонсом. Значение ultrafast присутствует в публичной спецификации openai-openapi от OpenAI с 13 августа 2026 года — в тот же день, когда был анонсирован этот режим, — и сопровождается описанием, которое привязывает его к gpt-5.6-sol и характеризует доступ к нему как контролируемый. Коммит, появившийся на этой неделе, — более поздний и менее значительный: 25 сентября 2026 года fe4f7a1 добавил ultrafast ещё в два перечисления — параметр service_tier на уровне запроса и поле политики service_tier для агентов. До этого коммита в этих двух списках значились auto, default, flex, priority, fast. После него появилась запись с описанием «Использует уровень обслуживания ultrafast».ultrafast в service_tier-перечисления в своей публичной openai-openapi — поле, которое схема описывает как «уровень обслуживания, используемый для запросов к модели», а также поле политики, привязанное к агентам. До этого изменения в этом списке значились default, flex, priority, fast. После него появилась запись с описанием «Использует уровень обслуживания ultrafast».
Это различие важно для всех, кто читает эти материалы. Это не создаваемый уровень; это уровень, который подключается к полю, с которым настроен агент, а значит, под него в конечном итоге можно будет написать клиент без какого-либо нового эндпоинта. В репортаже на следующий день описывается селектор Fast / Standard / Ultrafast, который появится в Responses API Playground, причём более широкий доступ ожидается после конференции DevDay компании OpenAI. Мы не видели этот селектор, и OpenAI не опубликовала заметку о развёртывании, так что эта часть основана на одном источнике. Что можно проверить — это добавленные записи схемы и то, что прайс-лист по-прежнему отсутствует спустя шесть недель после анонса.
Тем временем тариф Xiaomi можно купить уже пять дней, и он по-прежнему остаётся единственным из двух, который можно включить в счёт. Его собственный открытый вопрос иной: удержится ли десятикратная наценка или же он поведёт себя как большинство стартовых цен на новом премиальном тарифе и сползёт к стандартному уровню, как только прекратится освещение запуска. Standard Pro по цене $0.44 / $0.87 — это якорь, а тариф, стартующий с десятикратным превышением якоря, редко остаётся на этом уровне.
Выбор между ними, учитывая, что вы, вероятно, не можете
Неудобный практический факт заключается в том, что для большинства читателей это сравнение между уровнем, который вы не можете купить, и уровнем, который вам, вероятно, не стоит покупать по прейскуранту. GPT-5.6 Sol Ultrafast — это предварительная версия с листом ожидания для избранных клиентов, расширяющаяся по мере роста мощностей, без даты выхода в общий доступ и без цены; MiMo v2.6 Pro Ultraspeed доступен, дорог и создан для покупателя определённого типа.
Тест рабочей нагрузки одинаков для обоих, и он касается формы графа ваших запросов, а не размера вашего промпта. Одна длинная генерация даёт гораздо меньше, чем заявленный множитель, потому что обработка входных данных и рассуждение ускоряются не с одинаковым коэффициентом. Цикл агента из сорока шагов за одним видимым для пользователя действием даёт нечто гораздо более близкое к полному числу, потому что каждый обмен — это задержка, которую человек пережидает. Если ваш трафик похож на вторую форму, оба уровня нацелены на вас; если он похож на первую, стандартный вариант на любой из моделей всегда был правильным выбором, и стандартный вариант MiMo-V2.6-Pro по цене $0.44 / $0.87 — один из самых дешёвых способов вызвать модель класса триллиона параметров где угодно.
Что не меняется ни на одном из этих уровней, так это то, что вы покупаете задержку, а не качество. Если вы протестируете UltraSpeed или Ultrafast против их собственной стандартной линии на идентичных промптах и получите разные ответы, это находка, о которой стоит сообщить, а не особенность, — ни в описании ни одного из поставщиков не утверждается, что веса изменились.
Это также тот случай, когда роутер заслуживает своё место, и особенно для уровня, который вы не можете получить. GPT-5.6 Sol уже доступен на OrcaRouter как openai/gpt-5.6-sol по собственной ставке провайдера с нулевой наценкой на токены через OpenAI-совместимый эндпоинт по адресу api.orcarouter.ai/v1, так что стандартный маршрут, к которому вы бы откатились, — это всего одно изменение base-URL, и тот же ключ поддерживает 200+ моделей. Это важно, потому что честный ответ на вопрос «стоит ли мне использовать Ultrafast» сегодня таков: «вы не можете, так что решите, что будет обслуживать интерактивный трафик тем временем» — и способ получить низкую задержку без листа ожидания — направлять интерактивные вызовы к той модели из каталога, которая проходит вашу планку качества с наименьшим фактическим временем, а ночную работу оставить на самом дешёвом маршруте, который проходит. Когда этот уровень откроется, это и будет переключатель, который вы щёлкнете. Отметьте прямо, что мы не хостим: ни одной модели Xiaomi нет на OrcaRouter, поэтому MiMo v2.6 Pro Ultraspeed поступает из собственного API Xiaomi и нескольких сторонних платформ, и эта страница не является маршрутом к нему.

Что бы это уладило
Три измерения, ни одного из которых пока не существует. Опубликованная тарифная карта Ultrafast сделала бы это именно тем сравнением, которым оно заслуживает быть, а не сравнением с дырой в нём. Независимое распределение задержки при указанном уровне параллелизма сказало бы вам, находится ли реальный множитель Xiaomi ближе к 10× или к 20×, и сохраняется ли он под нагрузкой, а не в однопоточной демонстрации. А независимое воспроизведение набора бенчмарков любого из поставщиков вывело бы оба набора цифр из колонки заявлений.
До тех пор оправданное прочтение остаётся узким. Xiaomi выпустила скоростной тариф с ценой и расплывчатой скоростью; OpenAI выпустила скоростной тариф с конкретной скоростью и без цены; оба — та же модель, что и то, с чем их сопоставляют по цене, и ни один из них не был независимо измерен. Если задержка нужна вам сейчас и рабочая нагрузка интерактивна, UltraSpeed реален, доступен для покупки и его цена рассчитана ровно на того покупателя, на которого он нацелен. Если задержка нужна сейчас, а рабочая нагрузка неинтерактивна, стандартные каналы у обеих моделей дешевле, проверены и доступны уже сегодня — а тариф, о котором все спорят, всё ещё будет на месте, когда кто-нибудь опубликует цифры.
