
GPT-6 Astra Ultrafast против Xiaomi MiMo v2.6 Pro Ultraspeed: один и тот же манёвр — две разные сделки
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 223 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Две лаборатории совершили один и тот же манёвр в течение одного и того же двухнедельного периода, и самое интересное в том, что они совершили его исходя из противоположных предположений о том, что покупает клиент. GPT-6 Astra Ultrafast — флагманская модель вендора, продаваемая через уровень обслуживания Ultrafast: модель выпущена 3 сентября 2026 года, уровень широко доступен с 29 сентября 2026 года, а в публикации NVIDIA от 1 октября она названа работающей на графических процессорах Blackwell. Xiaomi MiMo v2.6 Pro Ultraspeed — это версия Xiaomi, выпущенная 22 сентября 2026 года: тот же чекпойнт на 1,02 триллиона параметров, что и MiMo-V2.6-Pro, обслуживается быстрее — примерно в десять раз превышая стандартную скорость.
Один из них — самый быстрый способ вызвать фронтирную модель. Другой — самый дешёвый быстрый уровень из существующих. Они не конкуренты в обычном смысле — вам пришлось бы написать очень странное приложение, чтобы выбирать между закрытым флагманом за $300 за миллион токенов и моделью с открытыми весами за $8.70 за миллион токенов. Что делает эту пару заслуживающей страницы — то, что оба являются скоростными уровнями, а не моделями, поэтому их сравнение изолирует один вопрос, который ставит скоростной уровень: за что именно вы платите эту многократную надбавку?
Оба тарифа продают одну и ту же не-вещь
Ни одно из этих названий не является чекпойнтом. Именно эту часть освещение запуска обычно размывает, поэтому стоит подойти к ней механически.
• На что указывает название — GPT-6 Astra Ultrafast — это GPT-6 Astra, у которой в запросе указано поле service_tier: "ultrafast"; идентификатор модели в запросе по-прежнему gpt-6-astra. Xiaomi MiMo v2.6 Pro Ultraspeed — это чекпоинт MiMo-V2.6-Pro, обслуживаемый по более быстрому пути и тарифицируемый как отдельная позиция.
• Что меняется — батчинг, спекулятивное декодирование, выделение аппаратных ресурсов, ограничения параллелизма, обработка соединений. Всё, что находится между весами и вашим HTTP-запросом, и ничего внутри весов.
• Что не меняется — ответы. Один и тот же чекпойнт при одних и тех же настройках должен выдавать одинаковое содержимое с другой скоростью. Если два потока одной и той же модели расходятся на идентичном вводе, это дефект, о котором следует сообщить, а не купленная вами возможность.
• Почему это важно для этого сравнения — поскольку ни один из уровней не заявляет улучшения по бенчмаркам относительно своего стандартного варианта, всё решение о покупке сводится к цене за токен в сопоставлении с сэкономленными секундами. А значит, выбор между двумя предложениями определяется арифметикой, а не оценкой.
Впрочем, в этой подаче есть одна асимметрия, и она не в тарифных уровнях. UltraSpeed от Xiaomi построен поверх открыто лицензированной модели — веса MiMo-V2.6 распространяются под лицензией MIT, согласно собственным карточкам моделей Xiaomi, а само семейство было выпущено вместе со своей RL-средой обучения. Ultrafast от OpenAI построен поверх закрытого флагмана, доступ к которому можно получить только через API. Платить за скорость по кратно более высокому тарифу при открытых весах — решение обратимое; вы всегда можете развернуть чекпойнт самостоятельно. Платить его за закрытый флагман — нет.

Два ценовых мультипликатора, и что они покупают
Вот здесь пара перестаёт быть симметричной, и числа с обеих сторон на удивление ровные, потому что каждый поставщик назначил цену в виде множителя, а не абсолютного значения.
• GPT-6 Astra Ultrafast — $60,00 за миллион входных токенов, $6,00 за кэшированный ввод, $75,00 за запись в кэш и $300,00 за вывод, против $10,00 и $50,00 у стандартного тарифа. Единообразный коэффициент 6,00x по всем столбцам, с повышением до $120,00 и $450,00 при превышении 272 000 входных токенов. Стандартный тариф доступен в нашем каталоге по прайс-листу OpenAI — это самый дешёвый способ получить доступ к флагманской модели.
• Xiaomi MiMo v2.6 Pro Ultraspeed — $4,35 за ввод и $8,70 за вывод за миллион токенов против стандартного тарифа Pro — $0,44 и $0,87. Это примерно 9,9x на вводе и ровно 10x на выводе.
• Заявления о скорости, привязанные к этим множителям — и OpenAI, и NVIDIA ограничивают Astra Ultrafast показателем «до 8x»: настолько быстрее генерация токенов по сравнению со стандартным режимом Astra. В собственных материалах Xiaomi заявлена скорость вывода до 20x выше, чем у стандартного сервиса Pro; сторонние каталоги, описывающие ту же модель в тот же день, указывают примерно 10x. Ни одного измерения, которое согласовало бы эти две цифры, опубликовано не было.
• Соотношение множителя к скорости — 6-кратная цена OpenAI даёт заявленный потолок в 8x, так что тариф оценён ниже собственного наилучшего сценария. Смотря чьим цифрам верить, 10-кратная цена Xiaomi даёт заявленный потолок от 10x до 20x, так что при потолке от вендора сделка выгодна, а при нижней цифре — просто выходит в ноль.
Это единственное наиболее значимое для решения различие между ними, и оно меньше, чем предполагают броские цены. В расчёте на единицу устранённой задержки по собственным заявлениям поставщиков Astra Ultrafast — лучшее из двух предложений. В расчёте на токен работы Xiaomi UltraSpeed примерно в четырнадцать раз дешевле на входе и в тридцать четыре раза дешевле на выходе по сравнению с тарифами Ultrafast, а также в два–шесть раз дешевле стандартного тарифа Astra, — но это другая модель, и значительно менее способная, и именно такой компромисс вы фактически и делаете. В собственных карточках моделей Xiaomi для этого семейства публикуются сведения об архитектуре и обучении, а не независимая совокупная оценка, и ни одного результата по индексу, на котором измеряется флагман OpenAI, для неё вообще не публиковалось.

Что два поставщика решили раскрыть
Уровни скорости — это скорее тест на раскрытие информации, чем тест производительности, потому что то, что вам понадобилось бы для проверки заявления — распределение задержек при заявленном уровне параллелизма — полностью находится в руках поставщика.
Публикация NVIDIA от 1 октября — самое конкретное публичное заявление, стоящее за уровнем Astra, и её вклад — это скорее атрибуция, чем измерение: GPU Blackwell, доступность в API OpenAI и для соответствующих критериям пользователей ChatGPT Work и Codex, а также два инженера OpenAI, описывающие цикл. Филипп Тилле, руководитель направления инференса в OpenAI, говорит, что Astra может «превратить эти знания в высокопроизводительные ядра, которые делают оборудование NVIDIA привлекательным»; Удай Руддараджу, главный технический директор OpenAI по вычислительным системам, говорит: «мы использовали наши внутренние модели, чтобы оптимизировать инференс на GPU NVIDIA». Ни одно из этих предложений не сопровождается цифрой пропускной способности для этого уровня. Показатель 8x стоит сам по себе, без каких-либо уточнений, кроме «до».
Раскрытие Xiaomi пошло в другую сторону — компания опубликовала экономику обучения, включая среду и код для обучения с подкреплением, а её карточки моделей содержат сведения об архитектуре, а не о сервировании. Сам уровень UltraSpeed сопровождался заявлением о 20-кратном ускорении и отсутствием опубликованной кривой задержек. А значит, по вопросу, на который и призван отвечать скоростной уровень, оба поставщика одинаково бесполезны, и эта ничья и есть честный вывод.
Выбирать, если вам действительно придётся
Эти два уровня мало пересекаются, так что решение — это скорее не выбор победителя, а понимание того, какая из двух покупок ваша.
Выбирайте Astra Ultrafast, если работа носит агентный характер, а выбор модели уже сделан. Стоимость задачи с 40 000 выходных токенов вырастает с $2,00 до $12,00, и этот уровень — единственный способ получить качество модели фронтирного уровня при более высокой скорости. В собственной документации OpenAI прямо указано операционное предусловие: рекомендуется использовать WebSockets «особенно для агентных приложений, которые совершают множество вызовов инструментов подряд», с предупреждением, что «без постоянного соединения сетевые накладные расходы могут уменьшить выигрыш в задержке». Включите этот уровень, но оставьте под ним HTTP с обработкой каждого запроса отдельно — и вы заплатите в 6 раз больше лишь за малую долю ускорения. Также стоит знать, прежде чем вы это подключите: этот уровень поддерживает только размещение данных в США и глобальную обработку, без региональных эндпоинтов обработки в ЕС или других странах за пределами США, и на старте у него были низкие начальные лимиты частоты запросов даже для аккаунтов, которые в остальном имели бы право на более высокие.
Выбирайте MiMo v2.6 Pro Ultraspeed, если модель — это рядовой ресурс на входе конвейера, который вы могли бы разместить у себя. Лицензия MIT означает, что стандартный уровень Pro — не единственный ваш запасной вариант: есть ещё собственный хостинг. При цене $4.35 и $8.70 это достаточно дёшево, чтобы более быстрый тариф стоило включать на всякий случай, а не обосновывать его для каждой задачи, а контекст в 1M токенов соответствует флагманскому. Однако понимайте, что именно вы покупаете: тариф примерно в десять раз выше за модель, отстающую от переднего края, — это верный компромисс для массового извлечения данных и неверный для всего, где качество ответа определяет ход рабочего процесса.
Ни один из быстрых уровней не представлен на OrcaRouter, и это стоит заявить прямо, а не обходить намёками. На OrcaRouter есть openai/gpt-6-astra — флагман стандартного уровня, по $10.00 и $50.00 за миллион токенов со ступенью для длинного контекста в $20.00 и $75.00, контекстом 1 050 000 токенов и максимальным выводом 128 000 токенов, через эндпоинт, совместимый с OpenAI. Ни одна модель Xiaomi здесь вообще не размещена, так что MiMo-V2.6-Pro и его линия UltraSpeed доступны только через собственный API Xiaomi и несколько сторонних платформ. Практическая польза от эндпоинта с более чем 200 моделями в этом сравнении не в доступе к быстрым уровням. Она в том, что когда вы хотите узнать, оправдывает ли дорогой уровень свою многократную цену, вы можете отправить тот же запрос более дешёвой модели с теми же учётными данными и тем же ключом, следующим запросом, и выяснить это. Это самый дешёвый доступный эксперимент, и именно он отвечает на вопрос — потому что ни один поставщик не опубликовал кривую задержки, которая позволила бы ответить на него без измерений.

Честное прочтение
Оба поставщика за последние три недели выпустили тарифную сетку для задержки, и ни один не представил измерений. Эта симметрия и есть суть, и у неё есть практическое следствие: единственные цифры, на которые можно опереться сегодня, — это цены, и они необычайно информативны, потому что обе стороны назначили ровный множитель, а не индивидуальное число.
Быстрый тариф OpenAI стоит в шесть раз дороже его собственной стандартной ставки и обещает потолок в восемь. Тариф Xiaomi стоит в десять раз дороже его собственной стандартной ставки и обещает потолок где-то между десятью и двадцатью — в зависимости от того, чьим цифрам вы поверите. Если читать это как арифметику на основе собственных цифр поставщиков, два варианта почти равноценны: тариф OpenAI даёт заявленный потолок в 1,33 единицы скорости на единицу цены, а тариф Xiaomi — от 1,0 до 2,0 по тому же расчёту. И причина, по которой оба могут быть обоснованны, в том, что эти два тарифа продаются разным покупателям, которые никогда всерьёз не станут рассматривать вариант друг друга. Цены к тому же — единственная часть любой из этих сделок, которую сегодня можно проверить: тарифная сетка — опубликованный факт, а заявление о латентности — нет.
