Сгенерированная hero-карточка с заголовком «Две скоростные дорожки с разницей в шестнадцать дней» и подзаголовком «GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed», левая панель со словами «В 6 раз быстрее стандарта», «Закрытый API» и «Кратность скорости заимствована у GPT-6 Astra», а правая панель со словами «Примерно в 10 раз быстрее стандарта», «Веса MIT» и «Всего 1,02 трлн / 42 млрд активных», над нижним колонтитулом с текстом «Данные производителя и каталога, сентябрь–октябрь 2026 г.; независимых измерений ни для одного из уровней нет».
Engineering & Research

GPT-6.1 Ultrafast против Xiaomi MiMo v2.6 Pro Ultraspeed: две скоростные полосы, одна говорит, во что это обошлось

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Два самых быстрых способа купить фронтирную модель поступили в продажу с разницей в шестнадцать дней, и только один из них рассказал, как достигается эта скорость. GPT-6.1 Ultrafast — уровень обслуживания поверх GPT-6.1 Sol, который O​penAI выпустила 29 сентября 2026 года и который получил этот уровень 8 октября 2026 года, — это закрытый флагман, доступный через API, по цене в шесть раз выше Standard и без какого-либо опубликованного описания того, что происходит между весами и вашим запросом. X​iaomi MiMo v2.6 Pro Ultraspeed, выпущенный 22 сентября 2026 года, — это скоростной уровень поверх MiMo-V2.6-Pro, чекпоинта под лицензией MIT, среду обучения с подкреплением для которого X​iaomi также опубликовала. Оба продают низкую задержку по кратной цене. Только у X​iaomi этот кратный коэффициент опирается на то, что клиент может проверить, и для решения эта разница весит больше, чем любое из заявлений о скорости.

Цена двух тарифов — это простая часть, и она описана ниже. Сложность в том, что уровень скорости — это обещание относительно обслуживания, и два поставщика дали это обещание при очень разной степени раскрытия информации: один позаимствовал свою главную цифру у родственной модели, другой выпустил рецепт обучения вместе с прайс-листом. Если вы собираетесь перевести продакшн-нагрузку на быстрый тариф, именно разрыв в раскрытии информации и есть тот риск, который вы фактически на себя берёте.

Цены, причём обе стороны расположены на одной строке

Оба уровня продаются в объёме, кратном стандартной полосе, а сами кратности настолько близки, что не цена их разделяет.

• Стандартный тариф — GPT-6.1 Sol по цене $2.00 за ввод / $10.00 за вывод за миллион токенов, против MiMo-V2.6-Pro по $0.44 / $0.87.

• Быстрый маршрут — GPT-6.1 Ultrafast по цене $12.00 / $60.00 против MiMo-V2.6-Pro-UltraSpeed по цене $4.35 / $8.70.

• Множитель — ровно 6x в каждой строке для тарифа O​penAI, примерно 9,9x на входе и ровно 10x на выходе для X​iaomi.

• Кэшированный ввод — GPT-6.1 Sol стоит $0.10 за миллион в Standard и $0.60 в Ultrafast; в доступной нам тарифной карте MiMo не публикуется отдельная строка для кэшированного ввода ни для одного из этих тарифов.

• Длинный контекст — GPT-6.1 Sol переоценивает весь запрос по 2x ставкам ввода и кэша и 1.5x вывода свыше 272 000 входных токенов, что делает Ultrafast $24.00 / $1.20 / $30.00 / $90.00. MiMo-V2.6-Pro имеет контекстное окно в 1M токенов без эквивалентного опубликованного порога.

• Абсолютный разброс — два быстрых тарифа различаются в 2,8 раза на входе и в 6,9 раза на выходе; это разрыв между фронтирной закрытой моделью и моделью с открытыми весами, проявляющийся внутри скоростного уровня, а не на стандартной ставке.

Однострочное резюме этого блока: X​iaomi назначает более высокий множитель на гораздо более дешёвую модель, а O​penAI — более низкий множитель на гораздо более дорогую. За выходные токены вы платите $60.00 за миллион для тарифа O​penAI и $8.70 для тарифа X​iaomi. Ни один из поставщиков не предлагает скидку за скорость; оба тарифицируют её как отдельный продукт, и это первый признак того, что в обоих случаях стандартный тариф по-прежнему остаётся вариантом по умолчанию, а быстрый тариф — исключением, которое вы обосновываете для каждой рабочей нагрузки.

Что каждый поставщик расскажет вам о скорости

Именно здесь два развёртывания перестают быть симметричными, и это самое полезное, что есть на странице.

Опубликованный OpenAI показатель для Ultrafast таков: GPT-6 Astra Ultrafast генерирует токены до 8 раз быстрее, чем GPT-6 Astra в стандартном режиме в Codex. Это измерение относится к другой модели, в другом клиенте, поданное как верхняя граница. В документации, посвящённой Ultrafast для GPT-6.1 Sol, говорится, что этот уровень сокращает время между генерацией выходных токенов, и даётся ссылка на тарифную карту; но при этом вообще не приводится никаких числовых значений для уровня Sol. Таким образом, ключевой показатель, привязанный к этому запуску, заимствован у родственной модели, которая работает на Ultrafast с 29 сентября, и ни одна независимая сторона не публиковала измерений токенов в секунду ни для одной из них. Вполне возможно, что это справедливо — тот же стек обслуживания, тот же механизм — но это верхняя граница, заявленная вендором, которую сама OpenAI не измеряла для этой модели.

Раскрытие информации Xiaomi отличается по своему характеру, и разница не в том, что оно более точное. В собственных материалах компании утверждается, что UltraSpeed достигает до 20-кратного превышения скорости вывода стандартного сервиса Pro при том же качестве. Сторонние каталоги, описывающие ту же модель в тот же день, говорят примерно о 10-кратном превышении. Оба числа находятся в обращении, они не совпадают, и никто не опубликовал измерение, которое бы их примирило. Если читать это честно: «до 20 раз» — это потолок от производителя при условиях, которые Xiaomi не указала, «примерно 10 раз» — это то, что каталог был готов утверждать как типичное значение, а реальный множитель находится где-то в широком диапазоне, пока кто-нибудь не опубликует распределения задержек по запросам при заявленном уровне параллелизма.

Итак, Xiaomi даёт вам два несогласованных числа, а OpenAI — одно число, которое относится к другой модели. Ни то, ни другое не является фактом, на который можно заложить бюджет, и практическое следствие для обоих одно и то же: измерьте этот уровень на собственных промптах, прежде чем делать его частью продакшен-пути.

Асимметрия, которая действительно имеет значение: что дают дополнительные цифры

Отбросив заявления о скорости, эти две линейки относятся к совершенно разным типам продуктов, и именно здесь выбор перестаёт быть сравнением цен.

MiMo-V2.6-Pro — это разреженная архитектура смеси экспертов, которую Xiaomi описала публично: 1,02 триллиона общих параметров при 42 миллиардах активируемых на токен, контекстное окно на 1 млн токенов, нативная мультимодальность для текста, изображений, видео и аудио, а также метка лицензии MIT на выпущенных чекпоинтах. В релизный пакет входят технический отчёт и примечания по развёртыванию, и Xiaomi заявляет, что делает открытыми среду обучения с подкреплением и её код, чтобы пост-обучение можно было изучить и воспроизвести. RL-прогон тоже задокументирован — 30 шагов и примерно 750 000 траекторий на модель, менее чем за шесть дней, при совокупных опубликованных затратах около $3 474 715 на прогоны Pro и Flash. На DeepSWE v1.1 — собственном стенде Xiaomi с mini-swe-agent при avg@3 — компания сообщает, что MiMo-V2.6-Flash показала рост с 48,8 до 65,68, а MiMo-V2.6-Pro — с 58,4 до 72,57 за этот прогон. Это заявленные производителем и невоспроизведённые данные; различие между «стенд Xiaomi говорит 72,57» и «72,57 — это результат» — это разница между утверждением и фактом.

GPT-6.1 Sol ничего из этого не публикует. Нет ни числа параметров, ни заметки об архитектуре, ни цифры расходов на обучение, ни чекпоинта, ни лицензии для ознакомления — есть карточка модели, контекстное окно, дата отсечки знаний 30 апреля 2026 года и API. Это обычная практика для фронтирной лаборатории, и это не критика. Но у этого есть последствие для решения о покупке, которое репортажи о запуске обычно упускают: в варианте с открытыми весами неудачный быстрый тариф можно компенсировать. Если UltraSpeed не оправдает 10-кратную стоимость вашего трафика, тот же чекпоинт можно скачать, и вы можете запускать его самостоятельно или через другого провайдера, что ограничивает ваши потери стоимостью миграции. В варианте с закрытой моделью разочаровывающий быстрый тариф — это счёт и бюджет лимитов запросов, которые вы корректируете обратно вниз; обойти это, запустив веса, нельзя, потому что весов для запуска нет.

Одно предостережение насчёт того тега MIT: в материалах о запуске его упрощают. Лицензия распространяется на контрольные точки, опубликованные X​iaomi. UltraSpeed — это хостинговый сервис, а хостинговые сервисы регулируются условиями предоставления услуг, а не лицензией на веса. Право запускать контрольную точку на собственном оборудовании и право перепродавать чьё-то ускоренное обслуживание её — это два разных права, и только первое следует из файла лицензии.

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

Две ловушки именования, прежде чем вы скопируете любой из двух идентификаторов

Ни одно из названий в заголовке этой страницы не является контрольной точкой, и документация обоих поставщиков делает эту ошибку легко повторяемой.

• GPT-6.1 Ultrafast — не модель. Идентификатор в запросе остаётся таким же, как у стандартной модели; уровень задаётся полем запроса, а результатом является тот же чекпоинт, только с другим планированием.

• MiMo v2.6 Pro Ultraspeed — тоже не отдельный набор весов. Это чекпоинт MiMo-V2.6-Pro, обслуживаемый по более быстрому маршруту и тарифицируемый как отдельная позиция.

• Что это значит для бенчмаркинга: если сравнить два режима любой из моделей на идентичных промптах, ожидаемый результат — одинаковые ответы с разной скоростью. Расходящееся содержимое при одном и том же входе — это дефект, о котором следует сообщить, а не купленная вами возможность.

• Что это означает для проверки лицензии — для Xiaomi читайте карточку модели. Для OpenAI читать нечего, потому что веса не распространяются.

Также существует более мягкая асимметрия, которая проявляется в том, как продаётся каждый тарифный уровень. GPT-6.1 Sol поддерживает резидентность данных в США и ЕС и глобальную обработку, в том числе в рамках Ultrafast, поэтому для рабочей нагрузки, привязанной к обработке в Европе, есть документированный ответ. В доступной нам тарифной карте MiMo резидентность данных вообще не указана — Xiaomi продаёт модель и путь её обслуживания, а не позицию по соответствию требованиям. Для покупателя из регулируемой отрасли эта единственная строка может предопределить результат сравнения ещё до того, как будет учтена цена.

Где каждую дорожку на самом деле можно вызвать

Оба быстрых канала доступны через собственный API соответствующего вендора, и оба представлены на сторонних платформах. Ни одного из них нет на OrcaRouter, и стоит сказать об этом прямо, а не позволять странице сравнения подразумевать обратное.

В OrcaRouter представлен стандартный тариф модели OpenAI: openai/gpt-6.1-sol по собственным прайсовым ставкам OpenAI — $2,00 за миллион входных токенов и $10,00 за миллион выходных токенов, с нулевой наценкой и сквозной передачей цены провайдера, так что изменение цен поставщиком отражается на нашей стороне в тот же день. Ultrafast — это флаг уровня обслуживания, оплачиваемый с вашего собственного аккаунта OpenAI, а модели Xiaomi здесь вообще не размещаются. Что действительно даёт один ключ — так это стандартный тариф наряду с более чем 200 другими моделями за одним эндпоинтом, совместимым с OpenAI, с автоматическим переключением при сбое между провайдерами — а это как раз то, что нужно, когда рабочая нагрузка, которую вы защищаете, — это та, что заметит потолок лимита запросов в три часа ночи.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

Какую дорожку тестировать, по порядку

Если ваша рабочая нагрузка интерактивна и время генерации отмеряется по часам человека, оба уровня стоит опробовать, и решающим фактором будет не цена — а срок годности вашего доверия. Дорожка открытых весов позволяет проверить и затем уйти; закрытая дорожка просит проверять её с единственным вендором, который может её обслуживать, и остаться. Эта асимметрия реальна, но и она не бесплатна: MiMo-V2.6-Pro-UltraSpeed — это хостинговый сервис, поэтому выход — это миграция, а не изменение конфигурации, и чекпоинт, на который вы мигрировали бы, может не соответствовать оптимизациям обслуживания этого уровня.

Если ваша нагрузка пакетная или запускается по расписанию, обе эти покупки — неверные: и при 6-кратной, и при 10-кратной цене. Честный ход — запускать её на стандартном тарифе, а разницу потратить на оценку.

Что могло бы изменить эту страницу: независимое измерение скорости вывода любого из тарифов при указанном уровне параллелизма, опубликованное заявление о резидентности от Xiaomi или число ограничения скорости от OpenAI для тарифа Sol, на которое покупатель мог бы ориентироваться вместо того, чтобы запрашивать. Пока их не существует, сравнение — это прайс-лист против прайс-листа, причём один из двух поставщиков опубликовал значительно больше об объекте, для которого устанавливается цена.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube