Сгенерированная титульная карточка с заголовком «GPT-6 Astra Ultrafast vs MiMo v2.6 Pro Ultraspeed», подзаголовком «Тот же манёвр, две разные сделки» и двумя карточками с текстом «Множитель цены: 6x vs 10x» и «Заявленная скорость: 8x vs 20x», а также с нижним колонтитулом «Показатели, заявленные поставщиком, сентябрь–октябрь 2026 г.»
Guides & Insights

GPT-6 Astra Ultrafast против Xiaomi MiMo v2.6 Pro Ultraspeed: один и тот же манёвр — две разные сделки

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две лаборатории совершили один и тот же манёвр в течение одного и того же двухнедельного периода, и самое интересное в том, что они совершили его исходя из противоположных предположений о том, что покупает клиент. GPT-6 Astra Ultrafast — флагманская модель вендора, продаваемая через уровень обслуживания Ultrafast: модель выпущена 3 сентября 2026 года, уровень широко доступен с 29 сентября 2026 года, а в публикации NVIDIA от 1 октября она названа работающей на графических процессорах Blackwell. Xiaomi MiMo v2.6 Pro Ultraspeed — это версия Xiaomi, выпущенная 22 сентября 2026 года: тот же чекпойнт на 1,02 триллиона параметров, что и MiMo-V2.6-Pro, обслуживается быстрее — примерно в десять раз превышая стандартную скорость.

Один из них — самый быстрый способ вызвать фронтирную модель. Другой — самый дешёвый быстрый уровень из существующих. Они не конкуренты в обычном смысле — вам пришлось бы написать очень странное приложение, чтобы выбирать между закрытым флагманом за $300 за миллион токенов и моделью с открытыми весами за $8.70 за миллион токенов. Что делает эту пару заслуживающей страницы — то, что оба являются скоростными уровнями, а не моделями, поэтому их сравнение изолирует один вопрос, который ставит скоростной уровень: за что именно вы платите эту многократную надбавку?

Оба тарифа продают одну и ту же не-вещь

Ни одно из этих названий не является чекпойнтом. Именно эту часть освещение запуска обычно размывает, поэтому стоит подойти к ней механически.

• На что указывает название — GPT-6 Astra Ultrafast — это GPT-6 Astra, у которой в запросе указано поле service_tier: "ultrafast"; идентификатор модели в запросе по-прежнему gpt-6-astra. Xiaomi MiMo v2.6 Pro Ultraspeed — это чекпоинт MiMo-V2.6-Pro, обслуживаемый по более быстрому пути и тарифицируемый как отдельная позиция.

• Что меняется — батчинг, спекулятивное декодирование, выделение аппаратных ресурсов, ограничения параллелизма, обработка соединений. Всё, что находится между весами и вашим HTTP-запросом, и ничего внутри весов.

• Что не меняется — ответы. Один и тот же чекпойнт при одних и тех же настройках должен выдавать одинаковое содержимое с другой скоростью. Если два потока одной и той же модели расходятся на идентичном вводе, это дефект, о котором следует сообщить, а не купленная вами возможность.

• Почему это важно для этого сравнения — поскольку ни один из уровней не заявляет улучшения по бенчмаркам относительно своего стандартного варианта, всё решение о покупке сводится к цене за токен в сопоставлении с сэкономленными секундами. А значит, выбор между двумя предложениями определяется арифметикой, а не оценкой.

Впрочем, в этой подаче есть одна асимметрия, и она не в тарифных уровнях. UltraSpeed от Xiaomi построен поверх открыто лицензированной модели — веса MiMo-V2.6 распространяются под лицензией MIT, согласно собственным карточкам моделей Xiaomi, а само семейство было выпущено вместе со своей RL-средой обучения. Ultrafast от OpenAI построен поверх закрытого флагмана, доступ к которому можно получить только через API. Платить за скорость по кратно более высокому тарифу при открытых весах — решение обратимое; вы всегда можете развернуть чекпойнт самостоятельно. Платить его за закрытый флагман — нет.

A screenshot of the XiaomiMiMo/MiMo-V2.6-Pro-RL model card on Hugging Face, showing 64 likes, the TextGeneration, Transformers, Safetensors, English, Chinese, conversational, custom_code, 8-bit precision and fp8 tags, an MIT licence tag, a Safetensors model size of 524B params and the model card's opening description of MiMo-V2.6-Pro-RL as the flagship checkpoint of the MiMo-V2.6 series, covering native omnimodal input and 1M-token context.

Два ценовых мультипликатора, и что они покупают

Вот здесь пара перестаёт быть симметричной, и числа с обеих сторон на удивление ровные, потому что каждый поставщик назначил цену в виде множителя, а не абсолютного значения.

• GPT-6 Astra Ultrafast — $60,00 за миллион входных токенов, $6,00 за кэшированный ввод, $75,00 за запись в кэш и $300,00 за вывод, против $10,00 и $50,00 у стандартного тарифа. Единообразный коэффициент 6,00x по всем столбцам, с повышением до $120,00 и $450,00 при превышении 272 000 входных токенов. Стандартный тариф доступен в нашем каталоге по прайс-листу OpenAI — это самый дешёвый способ получить доступ к флагманской модели.

• Xiaomi MiMo v2.6 Pro Ultraspeed — $4,35 за ввод и $8,70 за вывод за миллион токенов против стандартного тарифа Pro — $0,44 и $0,87. Это примерно 9,9x на вводе и ровно 10x на выводе.

• Заявления о скорости, привязанные к этим множителям — и OpenAI, и NVIDIA ограничивают Astra Ultrafast показателем «до 8x»: настолько быстрее генерация токенов по сравнению со стандартным режимом Astra. В собственных материалах Xiaomi заявлена скорость вывода до 20x выше, чем у стандартного сервиса Pro; сторонние каталоги, описывающие ту же модель в тот же день, указывают примерно 10x. Ни одного измерения, которое согласовало бы эти две цифры, опубликовано не было.

• Соотношение множителя к скорости — 6-кратная цена OpenAI даёт заявленный потолок в 8x, так что тариф оценён ниже собственного наилучшего сценария. Смотря чьим цифрам верить, 10-кратная цена Xiaomi даёт заявленный потолок от 10x до 20x, так что при потолке от вендора сделка выгодна, а при нижней цифре — просто выходит в ноль.

Это единственное наиболее значимое для решения различие между ними, и оно меньше, чем предполагают броские цены. В расчёте на единицу устранённой задержки по собственным заявлениям поставщиков Astra Ultrafast — лучшее из двух предложений. В расчёте на токен работы Xiaomi UltraSpeed примерно в четырнадцать раз дешевле на входе и в тридцать четыре раза дешевле на выходе по сравнению с тарифами Ultrafast, а также в два–шесть раз дешевле стандартного тарифа Astra, — но это другая модель, и значительно менее способная, и именно такой компромисс вы фактически и делаете. В собственных карточках моделей Xiaomi для этого семейства публикуются сведения об архитектуре и обучении, а не независимая совокупная оценка, и ни одного результата по индексу, на котором измеряется флагман OpenAI, для неё вообще не публиковалось.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing the gpt-6-astra row at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens for short-context requests, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, alongside gpt-5.6-sol at $4.00 / $0.40 / $5.00 / $20.00 short-context and $8.00 / $0.80 / $10.00 long-context, with the page's notes on the 10% regional-processing uplift and on GPT-5.6 Sol's promotional pricing running at least through November 21, 2026.

Что два поставщика решили раскрыть

Уровни скорости — это скорее тест на раскрытие информации, чем тест производительности, потому что то, что вам понадобилось бы для проверки заявления — распределение задержек при заявленном уровне параллелизма — полностью находится в руках поставщика.

Публикация NVIDIA от 1 октября — самое конкретное публичное заявление, стоящее за уровнем Astra, и её вклад — это скорее атрибуция, чем измерение: GPU Blackwell, доступность в API OpenAI и для соответствующих критериям пользователей ChatGPT Work и Codex, а также два инженера OpenAI, описывающие цикл. Филипп Тилле, руководитель направления инференса в OpenAI, говорит, что Astra может «превратить эти знания в высокопроизводительные ядра, которые делают оборудование NVIDIA привлекательным»; Удай Руддараджу, главный технический директор OpenAI по вычислительным системам, говорит: «мы использовали наши внутренние модели, чтобы оптимизировать инференс на GPU NVIDIA». Ни одно из этих предложений не сопровождается цифрой пропускной способности для этого уровня. Показатель 8x стоит сам по себе, без каких-либо уточнений, кроме «до».

Раскрытие Xiaomi пошло в другую сторону — компания опубликовала экономику обучения, включая среду и код для обучения с подкреплением, а её карточки моделей содержат сведения об архитектуре, а не о сервировании. Сам уровень UltraSpeed сопровождался заявлением о 20-кратном ускорении и отсутствием опубликованной кривой задержек. А значит, по вопросу, на который и призван отвечать скоростной уровень, оба поставщика одинаково бесполезны, и эта ничья и есть честный вывод.

Выбирать, если вам действительно придётся

Эти два уровня мало пересекаются, так что решение — это скорее не выбор победителя, а понимание того, какая из двух покупок ваша.

Выбирайте Astra Ultrafast, если работа носит агентный характер, а выбор модели уже сделан. Стоимость задачи с 40 000 выходных токенов вырастает с $2,00 до $12,00, и этот уровень — единственный способ получить качество модели фронтирного уровня при более высокой скорости. В собственной документации OpenAI прямо указано операционное предусловие: рекомендуется использовать WebSockets «особенно для агентных приложений, которые совершают множество вызовов инструментов подряд», с предупреждением, что «без постоянного соединения сетевые накладные расходы могут уменьшить выигрыш в задержке». Включите этот уровень, но оставьте под ним HTTP с обработкой каждого запроса отдельно — и вы заплатите в 6 раз больше лишь за малую долю ускорения. Также стоит знать, прежде чем вы это подключите: этот уровень поддерживает только размещение данных в США и глобальную обработку, без региональных эндпоинтов обработки в ЕС или других странах за пределами США, и на старте у него были низкие начальные лимиты частоты запросов даже для аккаунтов, которые в остальном имели бы право на более высокие.

Выбирайте MiMo v2.6 Pro Ultraspeed, если модель — это рядовой ресурс на входе конвейера, который вы могли бы разместить у себя. Лицензия MIT означает, что стандартный уровень Pro — не единственный ваш запасной вариант: есть ещё собственный хостинг. При цене $4.35 и $8.70 это достаточно дёшево, чтобы более быстрый тариф стоило включать на всякий случай, а не обосновывать его для каждой задачи, а контекст в 1M токенов соответствует флагманскому. Однако понимайте, что именно вы покупаете: тариф примерно в десять раз выше за модель, отстающую от переднего края, — это верный компромисс для массового извлечения данных и неверный для всего, где качество ответа определяет ход рабочего процесса.

Ни один из быстрых уровней не представлен на OrcaRouter, и это стоит заявить прямо, а не обходить намёками. На OrcaRouter есть openai/gpt-6-astra — флагман стандартного уровня, по $10.00 и $50.00 за миллион токенов со ступенью для длинного контекста в $20.00 и $75.00, контекстом 1 050 000 токенов и максимальным выводом 128 000 токенов, через эндпоинт, совместимый с OpenAI. Ни одна модель Xiaomi здесь вообще не размещена, так что MiMo-V2.6-Pro и его линия UltraSpeed доступны только через собственный API Xiaomi и несколько сторонних платформ. Практическая польза от эндпоинта с более чем 200 моделями в этом сравнении не в доступе к быстрым уровням. Она в том, что когда вы хотите узнать, оправдывает ли дорогой уровень свою многократную цену, вы можете отправить тот же запрос более дешёвой модели с теми же учётными данными и тем же ключом, следующим запросом, и выяснить это. Это самый дешёвый доступный эксперимент, и именно он отвечает на вопрос — потому что ни один поставщик не опубликовал кривую задержки, которая позволила бы ответить на него без измерений.

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, showing a 1,050,000-token context window, 128k maximum output, text, image and file input, public benchmarks attributed to OpenAI dated 2026-09-04, input price $10.00 and output price $50.00 per 1M tokens, p50 time to first token 4.69 s, a 10.00 s figure and 155.1M tokens of traffic, with an OpenAI-compatible Python code sample and the EN language toggle in the header.

Честное прочтение

Оба поставщика за последние три недели выпустили тарифную сетку для задержки, и ни один не представил измерений. Эта симметрия и есть суть, и у неё есть практическое следствие: единственные цифры, на которые можно опереться сегодня, — это цены, и они необычайно информативны, потому что обе стороны назначили ровный множитель, а не индивидуальное число.

Быстрый тариф OpenAI стоит в шесть раз дороже его собственной стандартной ставки и обещает потолок в восемь. Тариф Xiaomi стоит в десять раз дороже его собственной стандартной ставки и обещает потолок где-то между десятью и двадцатью — в зависимости от того, чьим цифрам вы поверите. Если читать это как арифметику на основе собственных цифр поставщиков, два варианта почти равноценны: тариф OpenAI даёт заявленный потолок в 1,33 единицы скорости на единицу цены, а тариф Xiaomi — от 1,0 до 2,0 по тому же расчёту. И причина, по которой оба могут быть обоснованны, в том, что эти два тарифа продаются разным покупателям, которые никогда всерьёз не станут рассматривать вариант друг друга. Цены к тому же — единственная часть любой из этих сделок, которую сегодня можно проверить: тарифная сетка — опубликованный факт, а заявление о латентности — нет.