Сгенерированная hero-карточка с заголовком «Три поста вглубь» и подзаголовком «GPT-6.1 Ultrafast — это Pro $500 только в ChatGPT — открыто для всех пользователей API», чипами с надписями «план Pro $500», «доступно для Enterprise и Edu» и «все пользователи API», а также нижним колонтитулом «Доступность согласно документации OpenAI, 8 октября 2026».
Guides & Insights

GPT-6.1 Ultrafast — это Pro, всего за $500, и эта деталь скрывалась на три поста глубже

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

GPT-6.1 Sol Ultrafastпоявилась 8 октября 2026 года с самой редкой вещью, какую только может предложить скоростной тариф: с опубликованной ценой. $12,00 за миллион входных токенов, $60,00 за миллион выходных токенов — ровно в шесть раз больше, чемGPT-6.1 Sol — модель, которую OpenAI выпустила 29 сентября 2026 года на своей презентации DevDay 2026, — стоит в стандартном режиме. А вот о чём в посте-анонсе не сказали в первую очередь, так это о том, где подписчик ChatGPT может её вообще включить, и ответ, обнаруживающийся тремя сообщениями ниже, — это план Pro за $500. Этому порядку стоит уделить больше внимания, чем ему уделили, потому что API-половина и подписочная половина этого запуска ограничены противоположными способами, и именно это различие определяет, сможете ли вы попробовать Ultrafast уже на этой неделе или ради этого придётся покупать план.

В самой модели ничего не изменилось. GPT-6.1 Sol Ultrafast — это тот же чекпойнт, то же контекстное окно на 1 050 000 токенов, тот же потолок вывода в 128 000 токенов, та же дата отсечки знаний — 30 апреля 2026 года — и те же ответы, что у GPT-6.1 Sol. Ultrafast — это уровень обслуживания, то есть приоритет планирования, который вы запрашиваете, а не вторая модель. Весь продукт — это задержка, продаваемая с многократной наценкой, и имеют значение только два вопроса: сколько её вы получаете и кому разрешено её покупать.

Что на самом деле говорит запись, в том порядке, в котором она это говорит

Версия этой истории, продиктованная обидой, состоит в том, что OpenAI похоронила гейт. Точная версия более конкретна, и её можно построчно сверить с собственной документацией OpenAI.

Журнал изменений для разработчиков содержит запись от 8 октября: добавление режима Ultrafast для GPT-6.1 Sol в Responses API, запрашиваемого отправкой model: "gpt-6.1-sol" с service_tier: "ultrafast", описываемого как сокращающего время между генерацией выходных токенов, и о котором сказано, что он доступен всем пользователям API при условии соблюдения ограничений скорости, с глобальной обработкой и размещением данных в США и ЕС. Если читать это отдельно, это неограниченный запуск по опубликованному тарифу.

В документации по уровням сказано, что Ultrafast — самый быстрый уровень обслуживания в API, широко доступен для GPT-6 Astra и GPT-6.1 Sol, с доступом в режиме предварительного просмотра для GPT-5.6 Sol, и для него рекомендуются WebSockets. О плане по-прежнему не упоминается.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

Детали подписки находятся на странице скорости на стороне ChatGPT, и это три ограничения, собранные в одном абзаце: Ultrafast доступен в Codex и ChatGPT Work, на Pro $500, а также на подходящих планах Enterprise и Edu. Администраторы Enterprise получают его отключённым по умолчанию и должны включать его для каждого пользователя или рабочей области. А потребительскому интерфейсу Chat этот уровень вообще не предлагается — сам GPT-6.1 Sol находится в Work и Codex, поэтому Chat никогда не входил в область охвата.

Соберите три страницы вместе — и картина становится ясной. API-ключ — это пропуск. Подписка ChatGPT — это пропуск только в том случае, если это самая дорогая подписка, которую продаёт OpenAI, или если администратор включил её для вас. Никто, читая первый пост анонса, не догадался бы об этом.

Почему существует этот барьер, и это не случайно

Очевидная трактовка: OpenAI использует скоростную полосу, чтобы продавать планы за $500. Механизм в основе менее циничен и более полезен: Ultrafast — это дорогой счётчик, и план за $500 — единственный потребительский план, в котором 8-кратный счётчик укладывается во включённый объём использования.

На подписке включённый объём использования расходуется в восемь раз быстрее стандартного тарифа, когда вы используете Ultrafast, поэтому один ход Ultrafast расходует столько же лимита, сколько восемь стандартных ходов. Это следствие того, что делает этот уровень — он покупает реальное время за счёт расходования мощности обслуживания, а подписка — продукт с фиксированной мощностью. Если списывать тот же лимит за восьмикратное потребление мощности, экономика плана ломается при $20 в месяц. Если списывать в восемь раз больше лимита, этот уровень просто становится непривлекательным на маленьком плане. В любом случае этот уровень оказывается там, где лимит достаточно велик, чтобы его поглотить.

У API нет такого ограничения, потому что он тарифицируется по потреблению. Там Ultrafast получает собственный бюджет ограничения скорости, отдельный от бюджетов Standard и Fast, и O​penAI описывает эти лимиты как устанавливаемые для каждой организации, а не публикуемые на странице тарифа. Это второй момент, на который стоит обратить внимание, но который не был вынесен в заголовок анонса: перевод рабочей нагрузки на Ultrafast не просто умножает счёт, он переводит нагрузку на другой потолок, и если вы увеличите трафик сверх того, что было предоставлено организации, собственные лимиты тарифа становятся режимом отказа.

Арифметика покупки скорости двумя разными способами

Вот это решение в цифрах, и именно эту часть стоит посчитать на ваших собственных значениях токенов, а не на моих. Возьмите сессию агента, которая отправляет 30 000 входных токенов и получает 1 500 выходных токенов за ход, на протяжении 40 ходов.

• Всего токенов за запуск — 1 200 000 входных, 60 000 выходных, распределённых по 40 запросам, каждый из которых с комфортным запасом остаётся ниже порога в 272 000 токенов, при котором OpenAI пересчитывает стоимость всего запроса.

• На стандартном GPT-6.1 Sol — 1,2 млн токенов по $2,00 за миллион — это $2,40, плюс 60 000 по $10,00 за миллион — это $0,60. Три доллара за запуск.

• На GPT-6.1 Sol Ultrafast — 1,2 миллиона по $12,00 — это $14,40, плюс 60 000 по $60,00 — это $3,60. Восемнадцать долларов за запуск.

• Разница — $15.00 за запуск, чтобы убрать большую часть времени генерации для задачи, которая в остальном не меняется.

Эти $15.00 за запуск — это цифра, которую стоит сопоставлять с подпиской. Если единственная причина, по которой вы рассматриваете план Pro, — это Ultrafast, то примерно 33 запуска в месяц при таком количестве токенов — это точка, где $500 за план и оплата API за токены пересекаются: ниже этой точки счётчик — более дешёвый способ купить тот же уровень, а выше — план начинает выигрывать. Ваше количество токенов сдвинет эту точку пересечения, иногда сильно, поэтому проведите собственные расчёты, прежде чем считать 33 порогом. Это наша арифметика для заявленной нагрузки, а не опубликованная точка безубыточности.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Два структурных замечания, которые сохраняются при любом количестве токенов.

Утверждение о скорости заимствовано, и это единственное, что стоит внимательно прочитать.

Ultrafast продаётся под лозунгом «до 8 раз быстрее», и единственное относящееся к конкретной модели измерение, которое OpenAI публикует в обоснование этой фразы, принадлежит другой модели. В документации к нему сказано, что GPT-6 Astra Ultrafast генерирует токены до 8 раз быстрее, чем GPT-6 Astra в стандартном режиме в Codex. Это показатель Astra, измеренный в Codex. В документации для уровня GPT-6.1 Sol он описывается как сокращающий время между токенами и ссылается на тарифную сетку; при этом числа не называется, и ни одна независимая сторона также не публиковала измерение скорости в токенах в секунду для варианта Sol.

Вполне может подтвердиться. Обе модели работают на одном и том же стеке обслуживания, и механизм тарифных уровней одинаков, так что множитель Astra — разумный априорный ориентир для Sol. Но «до 8x» — это вендорский потолок, невоспроизведённый, взятый у родственной модели, — и «до» в этом предложении выполняет реальную работу. Относитесь к множителю как к гипотезе, которую вы проверяете на собственных промптах, потому что документация самого уровня никогда не проверяет её за вас.

Ту же оговорку дешевле озвучить для более старых уровней. Ultrafast over GPT-5.6 Sol был анонсирован 13 августа 2026 года со словами «до 14 раз быстрее Standard processing» в ограниченном режиме предпросмотра, а три месяца спустя документация по-прежнему говорит о доступе в режиме предпросмотра, тогда как таблица тарифов Ultrafast содержит ровно две строки — GPT-6 Astra и GPT-6.1 Sol. Цифра 14x без опубликованной цены и без общей доступности — это заявление, а не продукт, и это полезное напоминание о том, сколь многое в этой лестнице уровней всё ещё остаётся лишь благими пожеланиями.

Если план за $500 не состоится

Тем, кто не собирается покупать Pro за $500, чтобы протестировать уровень задержки, полезнее разделить две вещи, которые объявление объединило в одно. Этот уровень доступен в API всем пользователям API, поэтому быстрый канал можно приобрести без подписки — по $12.00 и $60.00 за миллион токенов, с собственным бюджетом ограничения скорости, на нагрузке, достаточно небольшой для измерения. Сначала протестируйте его там, на своих промптах, в сравнении со стандартным каналом.

Стандартный маршрут — это тот, что существует без всего этого. OrcaRouter предоставляет GPT-6.1 Sol как openai/gpt-6.1-sol по собственным прайсовым ставкам OpenAI — $2.00 за миллион входных токенов и $10.00 за миллион выходных — с наценкой 0% и ценой провайдера, передаваемой напрямую, так что изменение цен поставщиком отражается у нас в тот же день. Ultrafast — это не то, что мы продаём: это флаг уровня обслуживания, оплачиваемый с вашего собственного аккаунта OpenAI, и мы предпочли бы сказать это прямо, а не позволять странице модели намекать на обратное. Что один ключ действительно даёт — это возможность направлять стандартный маршрут и остальной каталог — более 200 моделей за одним OpenAI-совместимым эндпоинтом — и автоматически переключаться между провайдерами при сбое одного из них, а это самая дешёвая страховка, если вы собираетесь поставить уровень задержки перед продакшн-путём.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

И если вы на Plus или Team и ответ, который вы искали, был «можно ли просто включить это», ответ — нет, с определённой формой. Codex и ChatGPT работают на Pro за $500 или на подходящем тарифе Enterprise или Edu, включается администратором, если это корпоративный тип. Всё остальное получает доступ к Ultrafast через API и платит за токен.

Что посмотреть дальше

Три вещи превратили бы это из закрытого поэтапного запуска в обычный, и все три можно наблюдать. Опубликованный лимит скорости Ultrafast для GPT-6.1 Sol положил бы конец догадкам о том, что срабатывает раньше — собственный потолок этого уровня или счёт. Измерение скорости для конкретной модели — или независимое измерение — заменило бы заимствованное число Astra на показатель, по которому можно судить об уровне Sol. А то, что Ultrafast доберётся до ChatGPT Plus, означало бы, что расчёты ёмкости изменились, а это сигнал, что ограничение было вызвано дефицитом на старте, а не постоянной конфигурацией этого уровня.

До тех пор честное резюме остаётся узким и проверяемым. GPT-6.1 Sol вышел 29 сентября 2026 года и с тех пор не менялся. 8 октября 2026 года у него появился ускоренный доступ с реальной ценой: открытый для пользователей API и доступный в ChatGPT только по тарифу за $500 — деталь, которая заслуживала первого поста, а не третьего, и которая для большинства читателей решает, идёт ли речь о статье расходов или о заказе на закупку.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube