
GPT-6.1 Sol Ultrafast выходит в API, Codex и ChatGPT Work
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
OpenAI начинает развёртывание режима Ultrafast для GPT-6.1 Sol — самого быстрого тарифа из тех, что она предлагает, и впервые у близкого к Astra уровня Sol такой тариф появился. Этот шаг ставит GPT-6.1 Sol в один ряд с GPT-6 Astra Ultrafast в API, в Codex и в ChatGPT Work, и он сопровождается опубликованным прайс-листом, а не листом ожидания: $12.00 за миллион входных токенов и $60.00 за миллион выходных токенов — ровно в шесть раз дороже, чем стоит стандартная GPT-6.1 Sol. Заявленная на упаковке скорость — «до 8x». Самое интересное — что именно измеряет эта фраза, и ответ — не та модель, за которую вы вот-вот заплатите.
В журнале изменений для разработчиков есть запись от 8 октября: «Добавлен режим Ultrafast для GPT-6.1 Sol в Responses API. Используйте gpt-6.1-sol с service_tier: "ultrafast", чтобы сократить время между генерацией выходных токенов. Он доступен всем пользователям API при условии соблюдения лимитов скорости, с глобальной обработкой и размещением данных в США и ЕС». Теперь на странице документации Ultrafast сказано: «широко доступен для GPT-6 Astra и GPT-6.1 Sol, с предварительным доступом для GPT-5.6 Sol», а страница о скорости на стороне ChatGPT подтверждает тарифную часть: Ultrafast доступен в Codex и ChatGPT Work на тарифе Pro за $500 и на подходящих тарифах Enterprise и Edu.
Ultrafast — это уровень обслуживания, а не вторая модель
В весах ничего не меняется. Тот же чекпоинт, то же контекстное окно на 1 050 000 токенов, тот же максимальный объём ввода в 922 000 токенов, тот же потолок вывода в 128 000 токенов, та же дата отсечки знаний — 30 апреля 2026 года, те же ответы. То, за что вы платите, — это приоритет в планировании: модель генерирует токены быстрее, и формулировка самой OpenAI намеренно узкая — этот тариф «сокращает время между порождаемыми выходными токенами». Он не делает модель умнее и не сокращает фазу размышления.
Это различие и есть всё решение. Для агентного цикла, который делает сорок вызовов инструментов подряд, выигрыш накапливается, потому что вывод каждого шага приходит раньше. Для одного сложного запроса на рассуждение, который большую часть своего реального времени тратит на размышления, вы можете заплатить в шесть раз больше и смотреть на тот же спиннер.
Лестница уровней, один раз, простыми словами:
• Batch and Flex — половина стоимости Standard, дешёвая дорожка для работы, которую никто не ждёт
• Стандартный — $2,00 за входные данные / $0,10 за кэшированные / $2,50 за запись в кэш / $10,00 за выходные данные за миллион токенов
• Fast — вдвое дороже Standard, или $4.00 / $0.20 / $5.00 / $20.00; 30 июля 2026 года OpenAI переименовала Priority processing в режим Fast
• Ультрабыстрый — в шесть раз быстрее Standard, или $12.00 / $0.60 / $15.00 / $60.00
• Свыше 272K входных токенов — весь запрос пересчитывается по тарифам 2x для ввода и кэша и 1.5x для вывода; Ultrafast long-context — $24.00 / $1.20 / $30.00 / $90.00
Арифметика, которую никто не указывает на маркетинговой странице
Шестикратная цена за восьмикратную скорость — это не убыточная сделка, но и не бесплатный сыр. В Ultrafast оплата идёт за токен, поэтому задача, которая на Standard стоит $1,00, на Ultrafast стоит $6,00 — и завершается примерно за одну восьмую времени. Экономия не в счёте, а в реальном времени. Вы платите дополнительные пять долларов, чтобы убрать семь восьмых времени ожидания в очереди для этой задачи, и то, дёшево это или абсурдно, полностью зависит от того, сколько стоит минута человека или пайплайна, ожидающего на другом конце.
Отсюда следуют два следствия, и именно их обычно упускают:
• Интерактивная работа — это очевидное «да». Разработчик, наблюдающий за тем, как применяется diff, агент, который не может продолжить, пока не прочитает результат, — это те случаи, когда задержка и есть сам продукт. Восьмикратно более быстрый вывод на цикле из сорока шагов — это не незначительное улучшение с точки зрения человеческого восприятия; это разница между инструментом, которым вы пользуетесь, и инструментом, который вы запускаете в фоне.
• Запланированные и пакетные задачи — это очевидное «нет». Если задача всё равно может подождать до утра, Ultrafast — это счёт в 6 раз больше, да ещё и впустую, а тариф Batch за полцены прямо здесь.
Кэшированный ввод заслуживает второго взгляда, потому что он тоже меняется: $0,60 за миллион на Ultrafast против $0,10 на Standard — это всё ещё 5% от цены некэшированного ввода. Агенты с кэшированием промптов, которые на каждом ходу заново отправляют большой системный промпт, обнаружат, что скидка за кэш масштабируется в зависимости от тарифа, а не защищает их от него.

Откуда берётся число «до 8x»
Это та часть, которую следует читать внимательно, потому что именно здесь заголовок развёртывания и документация развёртывания незаметно описывают разные вещи.
Единственное измерение скорости для конкретной модели, которое публикует OpenAI, — это предложение: «GPT-6 Astra Ultrafast генерирует токены до 8 раз быстрее, чем GPT-6 Astra в Standard mode в Codex». Это показатель Astra, измеренный в Codex. Для GPT-6.1 Sol аналогичный опубликованный множитель отсутствует. В документе, посвящённом Ultrafast для этой модели, говорится, что он сокращает время между генерацией выходных токенов, и указывает на таблицу цен; но конкретное число не приводится. Страница скорости на стороне ChatGPT повторяет предложение об Astra и на этом останавливается.
Итак, честное прочтение фразы «до 8 раз быстрее» таково: это главное обещание уровня, взятое у родственной модели, которая с 29 сентября доступна в Ultrafast, и это заявление вендора, которое ни одна независимая сторона не воспроизвела ни для одной из моделей. Оно вполне может быть верным для GPT-6.1 Sol — обе работают на одном и том же стеке обслуживания, и механизм уровня один и тот же, — но никто за пределами OpenAI не публиковал измерений количества токенов в секунду для варианта Sol, и «до» в этом предложении действительно несёт смысловую нагрузку.
Также стоит сохранять разделение уровней по моделям, потому что более старая всё ещё остаётся незавершённым делом. О Ultrafast объявили 13 августа 2026 года для GPT-5.6 Sol, заявив, что он «до 14 раз быстрее стандартной обработки», в ограниченном превью для избранных клиентов. Три месяца спустя в документации по-прежнему сказано, что у GPT-5.6 Sol есть «предварительный доступ», а таблица тарифов Ultrafast содержит ровно две строки — GPT-6 Astra и GPT-6.1 Sol. Число «14x», которое так и не стало общедоступным и не имеет опубликованного тарифа, — это заявление, а не продукт.

Кто действительно может это сделать
Сторона API — широкая, сторона подписки — узкая, и эта разница застаёт людей врасплох.
• API — доступен всем пользователям API на gpt-6.1-sol, с отдельными лимитами запросов, отличными от Standard и Fast. Это означает второй бюджет, за которым нужно следить, а не просто вторую цену.
• Сверхбыстрые лимиты скорости для GPT-6.1 Sol — 1 000 000 токенов в минуту на Build, 4 000 000 на Launch, 40 000 000 на Grow. 6 октября OpenAI сократила число уровней использования с пяти до трёх, так что эти три названия — текущая лестница тарифов, а не устаревшая.
• Резидентность данных — GPT-6.1 Sol поддерживает резидентность данных в США и ЕС и глобальную обработку, в том числе в режимах Fast и Ultrafast. Ultrafast от Astra не получает резидентность в ЕС, поэтому, если ваша рабочая нагрузка привязана к ЕС, это первая конфигурация Ultrafast, которую вообще можно купить.
• Codex and ChatGPT Work — Ultrafast доступна на плане Pro за $500, а также на подходящих планах Enterprise и Edu. Администраторы Enterprise по умолчанию получают её отключённой и должны включать её для каждого пользователя или рабочего пространства.
• Chat — не включён. Сам GPT-6.1 Sol живёт в Work и Codex; потребительская поверхность Chat в это не входит.
• Как это тарифицируется в рамках подписки — включённый объём использования расходуется по ставке в 8 раз выше стандартной, а приобретённые кредиты или оплата по факту использования в Enterprise тарифицируются по ставке в 6 раз выше стандартной. Оба числа стоит знать, прежде чем оставлять это включённым.
Одна деталь реализации решает, увидите ли вы вообще хоть какое-то ускорение. OpenAI прямо говорит об этом: используйте WebSockets, «особенно для агентных приложений, которые делают множество вызовов инструментов подряд», потому что «без постоянного соединения сетевые накладные расходы могут снизить выигрыш в задержке». Если ваш клиент открывает новое HTTP-соединение на каждый вызов, накладные расходы на запрос могут съесть всё преимущество тарифа, за который вы только что заплатили в 6 раз больше. HTTP всё ещё работает. Просто он может не стоить этого тарифа.
Что мы маршрутизируем, а что — нет
GPT-6.1 Sol стандартного уровня доступен на OrcaRouter как openai/gpt-6.1-solпо собственной цене провайдера — $2,00 за входные и $10,00 за выходные данные за миллион токенов, с наценкой 0% — прайс-листовая цена вендора передаётся как есть, поэтому когда OpenAI меняет тариф, изменение попадает в ваш счёт в тот же день, когда появляется в прайс-листе, а не при следующем продлении контракта. Один и тот же ключ и эндпоинт обслуживают более 200 моделей, поэтому вызов GPT-6.1 Sol и вызов Claude или Qwen стоят за одной интеграцией с автоматическим переключением при сбое и без второго контракта, а DSL маршрутизации объединит модели в один вызов, когда задаче требуется более одного мнения.
Ultrafast — не одна из этих моделей, и утверждать обратное было бы вводить в заблуждение. Это флаг уровня обслуживания в аккаунте OpenAI — вы отправляете service_tier: "ultrafast" в gpt-6.1-sol, и OpenAI выставляет счёт на ваш собственный аккаунт по тарифам выше — так что он существует внутри вашей прямой интеграции с OpenAI. Если вы его включите, держите трафик этого уровня на ключе вашего вендора, а трафик стандартного объёма направляйте через нас. Это честное разделение, и оно же более дешёвое для всего, что не ждёт человека.

Что с этим делать сегодня?
Если у вас есть место Codex или ChatGPT Work на тарифе Pro $, переключатель уже там, и пробный период не стоит вам ничего, кроме использования, — запустите одну и ту же задачу и там и там и посмотрите, достаточно ли в вашем цикле итераций, чтобы проявился восьмикратный выигрыш. Если вы работаете через API, эксперимент, который стоит провести, более узкий, чем следует из анонса: измерьте, какая часть вашей задержки приходится на генерацию токенов, а какая — на размышления модели, затем направьте Ultrafast на ту часть, которую он действительно может сжать.
И если у вас есть выбор между Fast на 2x и Ultrafast на 6x для одного и того же запроса, Fast — это уровень, который появился раньше, и тот, о поведении которого можно судить по одной тарифной карте. Ultrafast — новинка для этой модели, не оценённая независимыми измерениями, и стоит ровно столько, сколько скажет ваш собственный секундомер.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
