Сгенерированная титульная карточка с заголовком «Сверхбыстрый против Сверхбыстрого», подзаголовком «GPT-6 Astra против GPT-5.6 Sol» и двумя бейджами с надписями «у одного опубликована цена» и «другой всё ещё в превью».
Guides & Insights

GPT-6 Astra Ultrafast против GPT-5.6 Sol Ultrafast: один в тарифной сетке, а другой — нет

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

The two Ultrafast tiers are not twins, and the difference between them is not a benchmark. GPT-6 Astra Ultrafast runs on GPT-6 Astra, the company's flagship, which shipped on September 3, 2026 and went broadly available on the Ultrafast tier on September 29, 2026. GPT-5.6 Sol Ultrafast runs on GPT-5.6 Sol, the model that held the top of the company's line from July 9, 2026, and it has been in limited preview since August 13, 2026 — the state it is still in today. Read the company's own API documentation on September 30, 2026 and the sentence is unambiguous: Ultrafast "is broadly available for GPT-6 Astra, with preview access for GPT-5.6 Sol."

Это одно предложение порождает всё сравнение, и оно порождает асимметрию, которую скрыла бы таблица характеристик из двух одинаковых строк. Оба уровня предоставляют доступ к одним и тем же весам своих родительских моделей, оба воплощают одну и ту же концепцию обслуживания, и всё же у одного из них есть цена в тарифной сетке OpenAI, а у другого — нет. Поэтому покупатель, выбирающий между ними, выбирает не между двумя ценами. Он выбирает между ценой и листом ожидания — а это решение иного рода, и для него нужна другая страница.

Что на самом деле одинаково?

Начните с тех частей, которые не различаются, потому что они составляют бо́льшую часть сути и именно из-за них именование и оказывается запутанным.

• Веса — GPT-6 Astra Ultrafast — это стандартная GPT-6 Astra на более быстром пути обслуживания, а GPT-5.6 Sol Ultrafast — это стандартная GPT-5.6 Sol на более быстром пути обслуживания. Ни то, ни другое не является дистиллятом, дообученной моделью или отдельным чекпойнтом. Схема запроса OpenAI для этого уровня задаёт model как id базовой модели и добавляет service_tier: "ultrafast"; не существует gpt-6-astra-ultrafast строки модели.

• Ответы — одна и та же контрольная точка при той же настройке усилий должны возвращать одно и то же содержимое с точностью до сэмплирования. Если две ваши дорожки расходятся на идентичном промпте при идентичных настройках, это находка, которую стоит исследовать, а не функция, которую вы купили.

• Поверхность вызова — обе доступны через Responses API, и OpenAI рекомендует WebSockets для любой из них, предупреждая, что сетевые накладные расходы на каждый запрос могут свести на нет выигрыш в задержке, за который платит этот уровень.

• Ограничение по резидентности — Ultrafast поддерживает только резидентность данных в США и глобальную обработку, но не поддерживает конечные точки региональной обработки в ЕС или других регионах за пределами США. Это относится к уровню, а не к модели, поэтому в равной степени ограничивает обе стороны.

Где они действительно расходятся

Всё, что разделяет этих двоих, живёт в столбцах, которые маркетинговый материал не печатает рядом друг с другом.

• Доступность — GPT-6 Astra Ultrafast сегодня доступна всем пользователям API с низкими начальными лимитами запросов. GPT-5.6 Sol Ultrafast — это ограниченное превью для избранной группы; рекомендация OpenAI на сегодня — обратиться к вашей команде по работе с аккаунтом, чтобы запросить более высокие лимиты запросов или доступ к превью GPT-5.6 Sol.

• Цена — GPT-6 Astra Ultrafast указана в опубликованном прайс-листе: $60.00 за входные данные, $6.00 за кэшированные входные данные, $75.00 за запись в кэш и $300.00 за выходные данные за 1 млн токенов для запросов объёмом до 272 000 входных токенов; свыше этого порога — $120.00 / $12.00 / $150.00 / $450.00. У GPT-5.6 Sol Ultrafast вообще нет опубликованного прайс-листа. В таблице цен OpenAI для Ultrafast ровно одна строка, и эта строка — gpt-6-astra.

• Стандартная цена уровня — ниже GPT-6 Astra тарифицируется по стандартному тарифу $10.00 / $50.00, GPT-5.6 Sol — $4.00 / $20.00, при этом тариф Sol на собственной странице OpenAI описан как промоакционный и доступен как минимум до 21 ноября 2026 года. Sol в 2,5 раза дешевле по обоим параметрам, прежде чем применяется какой-либо скоростной тариф.

• Потолок пропускной способности — В документации OpenAI по Ultrafast указано, что он до 8 раз быстрее стандартного режима. Для предварительной версии Ultrafast от Sol заявлено до 14 раз, с выдачей до 750 выходных токенов в секунду, и именно эта цифра фигурировала в анонсе от 13 августа 2026 года. Это два разных утверждения о двух разных моделях, а не пересмотр одного утверждения.

• Аппаратное обеспечение — в анонсе предварительной версии Cerebras названа партнёром, стоящим за Ultrafast, при этом веса модели находятся близко к кремнию. Ничто в текущей документации не привязывает утверждение об аппаратном обеспечении конкретно к уровню Astra; история Cerebras задокументирована для предварительной версии Sol.

• Лимиты скорости — Для GPT-6 Astra на Ultrafast в документации указано 500 000 токенов в минуту для уровней API с 1 по 3, 1 000 000 для уровня 4 и 5 000 000 для уровня 5. Для Sol на Ultrafast эквивалентной опубликованной таблицы не существует, поскольку он не является общедоступным.

Один смежный факт, который стоит знать, прежде чем предполагать, что новейшая модель наследует быстрый трек: на странице цен OpenAI также указан gpt-6.1-sol, и в разделе Ultrafast для него тоже нет строки. Быстрый тариф сегодня — это возможность Astra с прикреплённым превью Sol.

A screenshot of OpenAI's Ultrafast documentation page, showing the sentence 'Our fastest API service tier, with up to 8x faster speeds than Standard mode.', the sentence 'It is broadly available for GPT-6 Astra, with preview access for GPT-5.6 Sol.', the recommendation to use WebSockets because per-request network overhead can reduce the latency gains, the note that Ultrafast for GPT-6 Astra is available to all API users at low rate limits with higher limits or Sol preview access available through an OpenAI account team, and a Python code sample setting service_tier to 'ultrafast' with model 'gpt-6-astra'.

Чтение 8x и 14x вместе

Два числа скорости — самая часто искажаемая часть этого сравнения, поэтому стоит точно указать, что означает каждое из них.

Показатель 14x и показатель 750 токенов в секунду взяты из предварительного обзора Ultrafast на GPT-5.6 Sol, опубликованного OpenAI 13 августа 2026 года. Как указано на той странице, Ultrafast «обеспечивает работу GPT-5.6 Sol до 14 раз быстрее, чем Standard processing» и «генерирует до 750 выходных токенов в секунду». Оба показателя представляют собой верхние пределы пропускной способности вывода, измеренные поставщиком в рамках ограниченного предварительного просмотра.

Показатель 8x — это то, что сегодня указано на странице документации OpenAI об Ultrafast в качестве описания самого тарифа: «наш самый быстрый уровень обслуживания API со скоростью до 8 раз выше, чем в Standard mode». Широкодоступная модель на этой странице — GPT-6 Astra.

Толкование, выдерживающее проверку, таково: опубликованный потолок этого уровня — 8x, а опубликованный потолок Sol preview — 14x. То, сможет ли Astra на Ultrafast достичь более высокого значения, OpenAI не публиковала, и ни одна из этих цифр не является обещанием задержки для вашего трафика — сквозное время по-прежнему включает обработку входных данных, вызовы инструментов и вашу собственную оркестрацию. Планируйте исходя из 8x для Astra, рассматривайте 14x как показатель Sol preview, который может перенестись, а может и нет, и сверяйтесь со своими собственными трейсами, а не со слайдом.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing a single Ultrafast row for gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, with gpt-5.6-sol shown only at its standard rates of $4.00 / $0.40 / $5.00 / $20.00 short-context and $8.00 / $0.80 / $10.00 long-context, and page notes covering the 10% data-residency uplift for models released on or after March 5, 2026, the further 10% FedRAMP uplift, the July 30, 2026 renaming of Priority processing to Fast mode, and the availability of GPT-5.6 Sol's promotional pricing at least through November 21, 2026.

Для наглядности стоит держать в поле зрения уровни ниже этих двух: Batch и Flex стоят 50% от Standard на GPT-6 Astra, а Fast mode — переименованный из Priority processing 30 июля 2026 года — стоит 2x от Standard при документированном потолке ускорения до 2,5x. Итак, лестница выглядит так: 0,5x, 1x, 2x при скорости до 2,5x и 6x при скорости до 8x. Переход с 2x на 6x даёт примерно в 3,2 раза больше скорости за в 3 раза больше денег, то есть это примерно линейный обмен, а не скачок, на который намекает заголовок с 8x.

Всё важное происходит на стандартном уровне.

Существует вариант этого сравнения, в котором быстрые уровни ничего не решают, и именно в этом варианте должна находиться большинство команд.

Оба родителя разделяют окно контекста в 1 050 000 токенов и потолок вывода в 128 000 токенов, оба принимают на вход текст и изображения и возвращают текст, и оба поддерживают одну и ту же поверхность вызова функций и структурированного вывода. Их различия — это обычные различия между двумя поколениями одной линейки: GPT-6 Astra имеет дату отсечки знаний 30 апреля 2026 года против 16 февраля 2026 года у Sol, и предоставляет усилие рассуждения от низкого до максимального, тогда как Sol предлагает от отсутствия до максимального. На независимых бенчмарках, которые каталог OrcaRouter содержит от Artificial Analysis, по состоянию на 30 сентября 2026 года, GPT-6 Astra показывает 96,1 на GPQA Diamond и 54,7 на Humanity's Last Exam против 94,1 и 49,5 у GPT-5.6 Sol, с более узким разрывом в программировании — 76,9 против 77,4 на AA Coding Index — и почти паритетом на Terminal-Bench v2.1 при 88,39 против 88,01. Это результаты одиночного запуска от одного оценщика, они сняты при собственной конфигурации по умолчанию каждой модели, и Artificial Analysis пересматривает свои индексы, поэтому рассматривайте их как снимок, а не как постоянное значение.

Смысл размещать их здесь в том, что ни одно из этих чисел не меняется, когда вы добавляете Ultrafast. Быстрый тариф даёт вам ту же модель раньше, так что если ваше решение — качество на токен, оно полностью определяется стандартным тарифом, и быстрый тариф вообще не входит в уравнение. Какую модель вы хотите — при $10 / $50 или при $4 / $20? На этот вопрос есть ответ, который вы можете проверить уже сегодня. Хотите ли вы также платить в шесть раз больше, чтобы получить ответ той модели раньше, — это отдельный и гораздо более узкий вопрос, и для GPT-5.6 Sol это вопрос, ответ на который сейчас вообще нельзя купить.

Решение о покупке, выраженное прямо

Если вам нужна скорость сегодня, GPT-6 Astra Ultrafast — единственный из этих двух, который вы действительно можете получить. Он общедоступен для любого пользователя API при документированных ограничениях скорости, и его стоимость известна заранее: $60 / $300 для короткого контекста, $120 / $450 для длинного контекста, при этом чтение из кэша стоит $6.00 за миллион, а запись в кэш — $75.00. Правило принятия решения следует фиксированному множителю 6x — этот уровень оправдывает свою цену в интерактивной работе, где человек ждёт, и в циклах, где скорость ощутимо устраняет оплачиваемые итерации, и он не оправдывает её в работе пакетного типа или ограниченной пропускной способностью, где Batch и Flex стоят вдвое дешевле стандарта на той же карте.

Если вам нужна скорость на GPT-5.6 Sol, честный ответ таков: купить её пока нельзя, и на собственной странице OpenAI это сказано. Предварительная версия существует, цифры 14× и 750 токенов в секунду опубликованы, а доступ предоставляется через команду по работе с аккаунтом. Все, кто называет вам цену за GPT-5.6 Sol Ultrafast, занимаются экстраполяцией; в опубликованной тарифной сетке есть только одна строка Ultrafast, и она не относится к Sol. Практическая позиция: сохранить стандартный тариф той модели, которая сейчас подходит для вашей рабочей нагрузки в продакшене, а предварительную версию Sol рассматривать как пункт пайплайна, к которому стоит вернуться, когда её можно будет купить.

Где находятся маршруты

Одно рабочее замечание: ни один из этих быстрых уровней не является отдельно адресуемой моделью. GPT-5.6 Sol при стандартном обслуживании доступна на OrcaRouter как openai/gpt-5.6-sol по собственному тарифу провайдера — $4.00 за ввод и $20.00 за вывод за миллион токенов, с переходом на длинный контекст к $8.00 / $30.00 свыше 272K — а GPT-6 Astra доступна как openai/gpt-6-astra по $10.00 / $50.00 с собственным переходом на длинный контекст. Обе предоставляются с наценкой 0%, то есть прайс-лист провайдера проходит напрямую, поэтому изменение цены поставщиком отражается в вашем счёте в тот же день, а не при продлении контракта, и обе доступны за одним ключом наряду с более чем 200 другими моделями с автоматическим переключением при сбое, так что вы можете сравнить их на собственном трафике без второй интеграции.

Уровни Ultrafast — это не маршруты, которые мы обслуживаем. Это флаги уровня сервиса с контролем доступа в учётной записи OpenAI — устанавливаемые вызывающей стороной в запросе к идентификатору базовой модели и тарифицируемые OpenAI по указанным выше тарифам, — а для GPT-5.6 Sol доступ к ним открывается после preview-запроса. Говорить об этом точно важнее, чем подразумевать возможность, которой не существует: если вы используете Ultrafast, это происходит в вашей прямой интеграции с OpenAI, а разумное место для трафика стандартного уровня, который вы направляете рядом с ним, — это шлюз, который пропускает цену по прайс-листу без наценки.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1M-token context window, 128K maximum output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.72 s, a 10.00 s figure, and 89.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

Что посмотреть

Эту страницу изменили бы две вещи, и ни одна из них не является слухом, которого стоит ждать. Первое — прайс-лист: как только OpenAI опубликует цену Ultrafast для GPT-5.6 Sol, сравнение превратится в простой вопрос «в шесть раз против чего-то», и арифметику, которую я набросал выше, придётся пересчитать, отталкиваясь от базовых $4 / $20 у Sol, а не от $10 / $50 у Astra. Второе — общая доступность предварительной версии Sol, что сдвинуло бы ту половину страницы, где говорится «это нельзя купить». Пока не произойдёт что-то из этого, честный вывод таков: GPT-6 Astra Ultrafast — это быстрый режим с установленной ценой, доступный для покупки и общедоступный, на более дорогом и более новом флагмане, а GPT-5.6 Sol Ultrafast — задокументированная предварительная версия на более дешёвом, с более высокой заявленной скоростью и вообще без цены.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно