Сгенерированная титульная карточка с заголовком «Ultrafast против Standard» и подзаголовком «Один чекпоинт GPT-6.1 Sol, две тарифные карты», с плашками «$2.00 / $10.00 Standard» и «$12.00 / $60.00 Ultrafast», значком «6x» и строкой «те же токены, счёт в шесть раз больше», над нижним колонтитулом, где отмечено, что цены — это собственные прайс-листовые ставки OpenAI для запросов с коротким контекстом.
Engineering & Research

GPT-6.1 Sol Ultrafast против GPT-6.1 Sol: скоростная полоса обходится дороже фронтирной модели

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Включение GPT-6.1 Sol Ultrafast делает GPT-6.1 Sol самым дорогим способом в семействе GPT-6 сгенерировать токен, который не производится GPT-6 Astra. В этом всё сравнение, умещённое в одно предложение, и это противоположность тому, что, судя по звучанию, должно означать «быстрый вариант на более дешёвой модели». Ultrafast стоит в шесть раз дороже Standard — $12,00 за миллион входных токенов и $60,00 за миллион выходных токенов против $2,00 и $10,00, — что ставит быстрый вызов GPT-6.1 Sol выше GPT-6 Astra на обычной скорости, выше GPT-5.6 Sol на обычной скорости и в пределах ошибки округления — ни от чего другого в тарифной сетке.

Ничто из этого не делает этот уровень уровнем сервиса. Это делает его покупкой низкой задержки, а вопрос, на который отвечает эта страница, — когда задержка стоит этой цены, а когда нет. Два сравниваемых продукта — это один и тот же чекпоинт и одни и те же ответы; вся разница — во флаге уровня сервиса и счёте.

Та же модель, и стоит сказать, насколько именно та же.

Нет никакого чекпоинта Ultrafast для скачивания, нет отдельного лимита контекста, нет другой даты отсечения знаний. Вы отправляете model: "gpt-6.1-sol" с service_tier: "ultrafast" — и O​penAI планирует запрос иначе; отправьте его без этого флага, и вы получите Standard. Всё, с чем разработчик реально работает в коде, идентично:

• ID модели — gpt-6.1-sol для обоих, один снимок по умолчанию, ничего датированного для закрепления

• Контекст — окно 1 050 000 токенов, максимальный ввод 922 000 токенов, максимальный вывод 128 000 токенов, для обоих

• Дата отсечки знаний — 30 апреля 2026 года, для обоих

• Лестница рассуждений — low, medium (default), high, xhigh, max для обоих; none и minimal не поддерживаются ни для одного из них

• Модальности — на входе текст и изображение, на выходе текст, для обеих

• Набор инструментов — те же веб-поиск, поиск файлов, генерация изображений, интерпретатор кода, размещённая оболочка, применение патчей, навыки, использование компьютера, MCP и поиск инструментов, через Responses API, для обоих

• Цена — $2.00 / $0.10 за кэшированный / $2.50 за запись в кэш / $10.00 за вывод за миллион токенов против $12.00 / $0.60 / $15.00 / $60.00

• Длинные запросы объёмом свыше 272 тыс. входных токенов — весь запрос пересчитывается по ставкам: ввод и кэш — ×2, вывод — ×1,5 в обоих случаях, поэтому длинный контекст Ultrafast обходится в $24.00 / $1.20 / $30.00 / $90.00

• Скорость — Standard — это Standard; Ultrafast — вершина иерархии уровней, и единственный опубликованный множитель для конкретной модели в документации OpenAI принадлежит GPT-6 Astra, а не этой модели

Последняя строка — это честная оговорка ко всей статье. В документации OpenAI сказано, что GPT-6 Astra Ultrafast «генерирует токены до 8 раз быстрее, чем GPT-6 Astra в стандартном режиме в Codex». В документации GPT-6.1 Sol описывается этот уровень, перечисляются его ограничения по частоте запросов и указывается, что он поддерживает размещение данных в США и ЕС, — но никакого множителя там не публикуется. Если вы покупаете это в расчёте на восьмикратную скорость, вы экстраполируете данные с родственной модели, а независимых измерений нет ни для той, ни для другой.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context stepping to $120.00 / $12.00 / $150.00 / $450.00 in long context, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

Разобранный пример: во сколько обходится один ход агента на каждой дорожке

Возьмите coding-агента и прогоните его через реальный, неприглядный цикл: на каждом ходу он заново перечитывает 40 000 токенов контекста репозитория и выдаёт 6 000 токенов рассуждений и патча, а задача занимает двенадцать ходов. Предположим, что ничего не кэшируется, — это пессимистичный случай и тот, в котором уровень выглядит хуже всего по входу; затем сделайте то же самое с кэшированным контекстом, потому что именно так и поступает агент с кэшированием промптов.

• Стандартный, без кэширования — 40 000 входных токенов стоят $0.08, а 6 000 выходных токенов — $0.06, то есть $0.14 за один ход и $1.68 за задачу

• Сверхбыстрый, без кэширования — $0,48 за входные данные и $0,36 за выходные данные за ход, $0,84 за ход, $10,08 за задачу

• Стандартный кэшированный контекст — 40 000 токенов снижаются до $0,10 за миллион, поэтому ход стоит $0,064, а задача — $0,77

• Сверхбыстрый кэшированный контекст — кэшированный ввод стоит $0,60 за миллион на этом уровне, поэтому ход стоит $0,384, а задача — $4,61

Множитель равен шести в каждой строке, и в этом суть: кэширование не защищает вас от уровня, оно масштабируется вместе с ним. Эти цифры дают задачу, которая завершается примерно за восьмую часть реального времени, и всё суждение сводится к тому, стоит ли устранение этого ожидания от $2,40 до $8,40 за задачу.

Вот сравнение, которое, впрочем, должно решить вопрос для большинства команд. Оцените те же объёмы токенов на GPT-6 Astra в Standard — $0,40 за вход и $0,30 за выход на ход, $8,40 за задачу. Ultrafast на GPT-6.1 Sol стоит дороже за токен, чем передовая модель на обычной скорости. Это не аргумент против этого уровня; это аргумент о том, какое измерение вы оптимизируете. Если ваша проблема — качество ответов, Astra в Standard — лучшее применение денег. Если ваша проблема в том, что человек смотрит на крутящийся индикатор, ни Astra, ни Sol не помогут, а этот уровень — поможет.

Одна оговорка, прежде чем кто-либо начнёт строить бюджет на этих цифрах: количество токенов не постоянно у разных моделей для одной и той же задачи. Это сравнения в расчёте на токен при одинаковом предполагаемом количестве токенов — единственное сравнение, которое поддерживает тарифная карта. Измеряйте собственные трассировки.

A generated cost card headed 'One agent turn, four ways', comparing GPT-6.1 Sol Standard at $0.14 per turn and $1.68 over twelve turns uncached and $0.064 and $0.77 with prompt caching, GPT-6.1 Sol Ultrafast at $0.84 and $10.08 uncached and $0.384 and $4.61 cached, and GPT-6 Astra Standard at $0.70 and $8.40 on the same token counts, over a footer reading that these are OpenAI list rates per 1M tokens for short-context requests and that the per-turn and per-task figures are the article's arithmetic on those rates rather than vendor benchmarks.

Тариф, который вам, вероятно, на самом деле нужен — Fast

Между Standard и Ultrafast есть промежуточный вариант, и на GPT-6.1 Sol именно его большинству команд стоит оценивать в первую очередь. Fast mode работает по цене вдвое выше Standard — $4.00 за входные и $20.00 за выходные данные за миллион токенов — для того же чекпоинта, а OpenAI 30 июля 2026 года переименовала Priority processing в Fast mode, так что он стабилен уже несколько месяцев. Это одна треть тарифа Ultrafast за ускорение, которое документация по уровням рассматривает как обычный поддерживаемый случай.

Ultrafast — правильный выбор, когда задержка и есть продукт, а объём токенов невелик: интерактивный агент, который не может сделать следующий шаг, пока не придёт предыдущий результат, цикл разработчика, где складываются сорок коротких итераций, демо, в котором пауза и есть режим отказа. Fast — правильный выбор, когда нужна модель, в целом более быстрая, и вы не готовы платить втрое за последний прирост. Batch и Flex остаются правильным выбором для всего, у чего срок измеряется часами, — они стоят вдвое дешевле Standard, а не вдвое дороже.

Скорость — тоже не единственный рычаг. Если задержка, которую вы пытаетесь устранить, вызвана тем, что модель размышляет, а не тем, что она печатает, этот тариф вам ничего не даст: Ultrafast сжимает генерацию токенов, а сам OpenAI описывает это так: «сокращает время между сгенерированными выходными токенами». Запрос, который проводит большую часть реального времени в рассуждениях, придёт быстрее лишь на долю от того, что обещает цена. Снизьте усилие рассуждений на одну ступень и посмотрите, как это отразится на счёте, прежде чем поднимать тариф на шесть ступеней.

Где находится стандартная полоса

Стандартная GPT-6.1 Sol доступна на OrcaRouter как openai/gpt-6.1-sol по цене самого провайдера — $2.00 за ввод и $10.00 за вывод за миллион токенов, с наценкой 0%: прайс-лист вендора передаётся как есть, поэтому изменение тарифов от OpenAI отражается в вашем использовании в тот же день, а не при следующем продлении. Тот же ключ открывает доступ более чем к 200 моделям, так что трафик стандартного канала, который вы сохраните после эксперимента с Ultrafast, может стоять за одной интеграцией рядом с тем, что ещё нужно задаче, с автоматическим переключением при сбое провайдера и DSL-маршрутизацией для объединения моделей в один вызов.

Сам Ultrafast — не то, что мы можем вам продать, и было бы нечестно формулировать это иначе. Это флаг уровня обслуживания, который OpenAI выставляет на ваш собственный аккаунт, а не отдельно маршрутизируемая модель — мы хостим чекпойнт, а не уровень. Запускайте трафик уровня на своём ключе вендора; объём маршрутизируйте через нас.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1M-token context window, 128K maximum output, text, image and file input with text output, vision, tools, JSON and reasoning capabilities, public benchmarks attributed to OpenAI dated 2026-09-29, input price $2.00 and output price $10.00 per 1M tokens, p50 time to first token 6.14 s and 313.9M tokens of traffic, with the page's code snippet and EN language toggle visible in the header.

Кто должен это переключить?

Оставляйте эту функцию включённой, если человек или автоматизированный потребитель вынужден ждать каждого ответа и объём токенов на задачу достаточно мал, чтобы абсолютная сумма счёта оставалась в пределах нескольких долларов, — приведённые выше расчёты показывают, что задача агента из двенадцати ходов обходится примерно в $10; это дешёвое решение, если оно заменяет две минуты человеческого ожидания, и дорогое, если оно не заменяет вообще ничего.

Оставьте это выключенным, если ваша рабочая нагрузка запланирована, обрабатывается пакетами, оценивается массово или перезапускается каждую ночь. Отключение также оправданно, если для вас главное — качество: в шесть раз больший бюджет не даёт этой модели ровным счётом никаких дополнительных возможностей, а те же деньги, направленные на GPT-6 Astra вместо этого, — это настоящее улучшение, а не просто более быстрый генератор. Ultrafast продаёт время, а время стоит $60 за миллион токенов только для тех рабочих процессов, которые действительно его ждут.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно