
GPT-6.1 Sol Ultrafast против GPT-6.1 Sol: скоростная полоса обходится дороже фронтирной модели
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Включение GPT-6.1 Sol Ultrafast делает GPT-6.1 Sol самым дорогим способом в семействе GPT-6 сгенерировать токен, который не производится GPT-6 Astra. В этом всё сравнение, умещённое в одно предложение, и это противоположность тому, что, судя по звучанию, должно означать «быстрый вариант на более дешёвой модели». Ultrafast стоит в шесть раз дороже Standard — $12,00 за миллион входных токенов и $60,00 за миллион выходных токенов против $2,00 и $10,00, — что ставит быстрый вызов GPT-6.1 Sol выше GPT-6 Astra на обычной скорости, выше GPT-5.6 Sol на обычной скорости и в пределах ошибки округления — ни от чего другого в тарифной сетке.
Ничто из этого не делает этот уровень уровнем сервиса. Это делает его покупкой низкой задержки, а вопрос, на который отвечает эта страница, — когда задержка стоит этой цены, а когда нет. Два сравниваемых продукта — это один и тот же чекпоинт и одни и те же ответы; вся разница — во флаге уровня сервиса и счёте.
Та же модель, и стоит сказать, насколько именно та же.
Нет никакого чекпоинта Ultrafast для скачивания, нет отдельного лимита контекста, нет другой даты отсечения знаний. Вы отправляете model: "gpt-6.1-sol" с service_tier: "ultrafast" — и OpenAI планирует запрос иначе; отправьте его без этого флага, и вы получите Standard. Всё, с чем разработчик реально работает в коде, идентично:
• ID модели — gpt-6.1-sol для обоих, один снимок по умолчанию, ничего датированного для закрепления
• Контекст — окно 1 050 000 токенов, максимальный ввод 922 000 токенов, максимальный вывод 128 000 токенов, для обоих
• Дата отсечки знаний — 30 апреля 2026 года, для обоих
• Лестница рассуждений — low, medium (default), high, xhigh, max для обоих; none и minimal не поддерживаются ни для одного из них
• Модальности — на входе текст и изображение, на выходе текст, для обеих
• Набор инструментов — те же веб-поиск, поиск файлов, генерация изображений, интерпретатор кода, размещённая оболочка, применение патчей, навыки, использование компьютера, MCP и поиск инструментов, через Responses API, для обоих
• Цена — $2.00 / $0.10 за кэшированный / $2.50 за запись в кэш / $10.00 за вывод за миллион токенов против $12.00 / $0.60 / $15.00 / $60.00
• Длинные запросы объёмом свыше 272 тыс. входных токенов — весь запрос пересчитывается по ставкам: ввод и кэш — ×2, вывод — ×1,5 в обоих случаях, поэтому длинный контекст Ultrafast обходится в $24.00 / $1.20 / $30.00 / $90.00
• Скорость — Standard — это Standard; Ultrafast — вершина иерархии уровней, и единственный опубликованный множитель для конкретной модели в документации OpenAI принадлежит GPT-6 Astra, а не этой модели
Последняя строка — это честная оговорка ко всей статье. В документации OpenAI сказано, что GPT-6 Astra Ultrafast «генерирует токены до 8 раз быстрее, чем GPT-6 Astra в стандартном режиме в Codex». В документации GPT-6.1 Sol описывается этот уровень, перечисляются его ограничения по частоте запросов и указывается, что он поддерживает размещение данных в США и ЕС, — но никакого множителя там не публикуется. Если вы покупаете это в расчёте на восьмикратную скорость, вы экстраполируете данные с родственной модели, а независимых измерений нет ни для той, ни для другой.

Разобранный пример: во сколько обходится один ход агента на каждой дорожке
Возьмите coding-агента и прогоните его через реальный, неприглядный цикл: на каждом ходу он заново перечитывает 40 000 токенов контекста репозитория и выдаёт 6 000 токенов рассуждений и патча, а задача занимает двенадцать ходов. Предположим, что ничего не кэшируется, — это пессимистичный случай и тот, в котором уровень выглядит хуже всего по входу; затем сделайте то же самое с кэшированным контекстом, потому что именно так и поступает агент с кэшированием промптов.
• Стандартный, без кэширования — 40 000 входных токенов стоят $0.08, а 6 000 выходных токенов — $0.06, то есть $0.14 за один ход и $1.68 за задачу
• Сверхбыстрый, без кэширования — $0,48 за входные данные и $0,36 за выходные данные за ход, $0,84 за ход, $10,08 за задачу
• Стандартный кэшированный контекст — 40 000 токенов снижаются до $0,10 за миллион, поэтому ход стоит $0,064, а задача — $0,77
• Сверхбыстрый кэшированный контекст — кэшированный ввод стоит $0,60 за миллион на этом уровне, поэтому ход стоит $0,384, а задача — $4,61
Множитель равен шести в каждой строке, и в этом суть: кэширование не защищает вас от уровня, оно масштабируется вместе с ним. Эти цифры дают задачу, которая завершается примерно за восьмую часть реального времени, и всё суждение сводится к тому, стоит ли устранение этого ожидания от $2,40 до $8,40 за задачу.
Вот сравнение, которое, впрочем, должно решить вопрос для большинства команд. Оцените те же объёмы токенов на GPT-6 Astra в Standard — $0,40 за вход и $0,30 за выход на ход, $8,40 за задачу. Ultrafast на GPT-6.1 Sol стоит дороже за токен, чем передовая модель на обычной скорости. Это не аргумент против этого уровня; это аргумент о том, какое измерение вы оптимизируете. Если ваша проблема — качество ответов, Astra в Standard — лучшее применение денег. Если ваша проблема в том, что человек смотрит на крутящийся индикатор, ни Astra, ни Sol не помогут, а этот уровень — поможет.
Одна оговорка, прежде чем кто-либо начнёт строить бюджет на этих цифрах: количество токенов не постоянно у разных моделей для одной и той же задачи. Это сравнения в расчёте на токен при одинаковом предполагаемом количестве токенов — единственное сравнение, которое поддерживает тарифная карта. Измеряйте собственные трассировки.

Тариф, который вам, вероятно, на самом деле нужен — Fast
Между Standard и Ultrafast есть промежуточный вариант, и на GPT-6.1 Sol именно его большинству команд стоит оценивать в первую очередь. Fast mode работает по цене вдвое выше Standard — $4.00 за входные и $20.00 за выходные данные за миллион токенов — для того же чекпоинта, а OpenAI 30 июля 2026 года переименовала Priority processing в Fast mode, так что он стабилен уже несколько месяцев. Это одна треть тарифа Ultrafast за ускорение, которое документация по уровням рассматривает как обычный поддерживаемый случай.
Ultrafast — правильный выбор, когда задержка и есть продукт, а объём токенов невелик: интерактивный агент, который не может сделать следующий шаг, пока не придёт предыдущий результат, цикл разработчика, где складываются сорок коротких итераций, демо, в котором пауза и есть режим отказа. Fast — правильный выбор, когда нужна модель, в целом более быстрая, и вы не готовы платить втрое за последний прирост. Batch и Flex остаются правильным выбором для всего, у чего срок измеряется часами, — они стоят вдвое дешевле Standard, а не вдвое дороже.
Скорость — тоже не единственный рычаг. Если задержка, которую вы пытаетесь устранить, вызвана тем, что модель размышляет, а не тем, что она печатает, этот тариф вам ничего не даст: Ultrafast сжимает генерацию токенов, а сам OpenAI описывает это так: «сокращает время между сгенерированными выходными токенами». Запрос, который проводит большую часть реального времени в рассуждениях, придёт быстрее лишь на долю от того, что обещает цена. Снизьте усилие рассуждений на одну ступень и посмотрите, как это отразится на счёте, прежде чем поднимать тариф на шесть ступеней.
Где находится стандартная полоса
Стандартная GPT-6.1 Sol доступна на OrcaRouter как openai/gpt-6.1-sol по цене самого провайдера — $2.00 за ввод и $10.00 за вывод за миллион токенов, с наценкой 0%: прайс-лист вендора передаётся как есть, поэтому изменение тарифов от OpenAI отражается в вашем использовании в тот же день, а не при следующем продлении. Тот же ключ открывает доступ более чем к 200 моделям, так что трафик стандартного канала, который вы сохраните после эксперимента с Ultrafast, может стоять за одной интеграцией рядом с тем, что ещё нужно задаче, с автоматическим переключением при сбое провайдера и DSL-маршрутизацией для объединения моделей в один вызов.
Сам Ultrafast — не то, что мы можем вам продать, и было бы нечестно формулировать это иначе. Это флаг уровня обслуживания, который OpenAI выставляет на ваш собственный аккаунт, а не отдельно маршрутизируемая модель — мы хостим чекпойнт, а не уровень. Запускайте трафик уровня на своём ключе вендора; объём маршрутизируйте через нас.

Кто должен это переключить?
Оставляйте эту функцию включённой, если человек или автоматизированный потребитель вынужден ждать каждого ответа и объём токенов на задачу достаточно мал, чтобы абсолютная сумма счёта оставалась в пределах нескольких долларов, — приведённые выше расчёты показывают, что задача агента из двенадцати ходов обходится примерно в $10; это дешёвое решение, если оно заменяет две минуты человеческого ожидания, и дорогое, если оно не заменяет вообще ничего.
Оставьте это выключенным, если ваша рабочая нагрузка запланирована, обрабатывается пакетами, оценивается массово или перезапускается каждую ночь. Отключение также оправданно, если для вас главное — качество: в шесть раз больший бюджет не даёт этой модели ровным счётом никаких дополнительных возможностей, а те же деньги, направленные на GPT-6 Astra вместо этого, — это настоящее улучшение, а не просто более быстрый генератор. Ultrafast продаёт время, а время стоит $60 за миллион токенов только для тех рабочих процессов, которые действительно его ждут.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
