
GPT-6.1 Sol Ultrafast против GPT-5.6 Sol Ultrafast: один уровень, три модели, одна из них всё ещё ждёт
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
GPT-6.1 Sol Ultrafast и GPT-5.6 Sol Ultrafast — это один и тот же уровень обслуживания, применяемый к двум разным поколениям Sol, и после 8 октября 2026 года они находятся в противоположных состояниях. GPT-6.1 Sol перешёл от статуса «скоро» к опубликованному тарифу — $12.00 за миллион входных токенов, $60.00 за миллион выходных токенов, в шесть раз дороже Standard — и доступен всем пользователям API, а также пользователям Codex и ChatGPT Work на плане Pro за $500. GPT-5.6 Sol всё ещё там, где Ultrafast начинался: анонсированный уровень, в ограниченном предпросмотре, и вообще без строки на странице цен. То же название, тот же механизм, и только один из них можно купить.
Это краткая версия. Более длинная версия важна, потому что заявленные показатели скорости для этого уровня привязаны к разным моделям, измерялись на разных поверхностях, а в одном случае устарели на три месяца.
Что на самом деле представляет собой «Ultrafast» на каждой модели
Ни в одной из моделей Ultrafast не является отдельным чекпоинтом. Вы отправляете тот же id модели и переключаете уровень обслуживания — model: "gpt-6.1-sol" с service_tier: "ultrafast" в Responses API — и OpenAI планирует ваш запрос на пути с низкой задержкой. Веса, ответы и контекстное окно не меняются. В GPT-6.1 Sol это окно составляет 1 050 000 токенов при максимальном входе 922 000 токенов и максимальном выходе 128 000; GPT-5.6 Sol имеет идентичное окно и тот же потолок вывода и отличается в основном датой отсечки знаний (16 февраля 2026 г. против 30 апреля 2026 г.) и лестницей рассуждений, где GPT-5.6 Sol по-прежнему принимает none, а GPT-6.1 Sol — нет.
Итак, сравнение не в том, «какая модель быстрее думает». Оно в том, «какое поколение того же уровня доступно вам», и ответ изменился четыре дня назад.

Опубликованные мультипликаторы и единственное число, оставшееся на уровне 14x
OpenAI опубликовала два заявления о скорости, касающихся этого уровня, на двух моделях, и ни одно из них не является общим утверждением об «Ultrafast».
• GPT-6 Astra Ultrafast — «генерирует токены до 8 раз быстрее, чем GPT-6 Astra в стандартном режиме в Codex». Это текущий главный тезис этого тарифа, повторяемый в документации по скорости на стороне ChatGPT.
• GPT-5.6 Sol Ultrafast — анонсирован 13 августа 2026 года как работающий «до 14 раз быстрее стандартной обработки», в ограниченном предварительном доступе для отдельных клиентов.
Обратите внимание, чего не хватает. Для GPT-6.1 Sol Ultrafast не опубликован множитель скорости. На странице его документации описывается уровень, указаны ограничения по скорости и политика размещения данных, а также даётся ссылка на таблицу цен — но единственный множитель для конкретной модели во всей документации принадлежит Astra. Честная позиция такова: «до 8x» — это измерение Astra, полученное на том же стеке обслуживания, и именно это число лежит в основе продажи развёртывания, хотя его никто не воспроизвёл для Sol — ни внутри OpenAI, ни за её пределами.
Показатель 14x заслуживает большего недоверия, чем обычно, потому что он слишком стар. Объявленный в середине августа для уровня, который до сих пор не стал общедоступным, он оставался без пересмотра примерно два месяца, пока сам уровень перестраивали вокруг двух других моделей. За это время самое очевидное, что можно было ожидать, — что Ultrafast для 5.6 Sol выйдет из предварительного доступа и получит цену, — так и не произошло. Вместо этого GPT-6 Astra получила его 29 сентября, а GPT-6.1 Sol — 8 октября. Число, которое существует только в анонсе и привязано к конфигурации, которую никто не может купить, — это маркетинговый текст, пока оно не попадёт в прайс-лист.
Сравнение: сколько стоит каждый из них и кто может получить к нему доступ
• Стандартный тариф — GPT-6.1 Sol: $2.00 за ввод / $0.10 за кэшированные данные / $2.50 за запись в кэш / $10.00 за вывод за 1 млн токенов в сравнении с GPT-5.6 Sol: $4.00 / $0.40 / $5.00 / $20.00
• Сверхбыстрый тариф — GPT-6.1 Sol $12.00 / $0.60 / $15.00 / $60.00, опубликован по правилу 6x-Standard и отдельной строкой в таблице тарифов Ultrafast в сравнении с GPT-5.6 Sol, тариф не опубликован
• Длинный контекст свыше 272K входных токенов — GPT-6.1 Sol переоценён по ставкам 2x за ввод и кэш и 1.5x за вывод для всего запроса, что даёт строку Ultrafast для длинного контекста $24.00 / $1.20 / $30.00 / $90.00 против эквивалента Ultrafast у GPT-5.6 Sol, который никто не публиковал
• Доступность уровня — GPT-6.1 Sol: все пользователи API при условии соблюдения отдельных лимитов запросов, а также Codex и ChatGPT Work на тарифе Pro за $500 и на подходящих тарифах Enterprise и Edu, в отличие от GPT-5.6 Sol: ограниченный предпросмотр для отдельных клиентов API
• Лимиты запросов на момент запуска — у GPT-6.1 Sol собственный бюджет Ultrafast, отдельный от лимитов Standard и Fast; в отличие от GPT-5.6 Sol, он задаётся отдельно для каждой организации и повышается по запросу, а также не публикуется
• Размещение данных — GPT-6.1 Sol поддерживает размещение в США и ЕС и глобальную обработку в режимах Fast и Ultrafast, тогда как GPT-5.6 Sol — только размещение в США и глобальную обработку
• Кратность скорости — GPT-6.1 Sol, ничего не опубликовано, против GPT-5.6 Sol, «до 14 раз» в августовском анонсе, не воспроизведено
• Контекст и потолок вывода — 1 050 000 и 128 000 для обоих
Одна асимметрия в этом списке заслуживает отдельного внимания. GPT-6.1 Sol — единственная конфигурация Ultrafast с размещением данных в ЕС: Ultrafast от Astra доступна только в США, а 5.6 Sol вообще не открыта. Если ваша рабочая нагрузка привязана к обработке в ЕС, 8 октября — первая дата, когда этот уровень стал доступен вам в какой-либо форме.
При подписке разница в тарифе, а не в модели.
В Codex и ChatGPT Work оба поколения структурно ведут себя одинаково — Ultrafast — это настройка скорости для модели, которая у вас уже есть, — но ограничение доступа к нему новое. Ultrafast доступен на Pro за $500 и в подходящих тарифах Enterprise и Edu, и по умолчанию он отключён в рабочих пространствах Enterprise, пока администратор не включит его. В рамках подписки включённый объём использования расходуется по ставке в 8 раз выше стандартной, а приобретённые кредиты или оплата по мере использования в Enterprise тарифицируются по ставке в 6 раз выше; в API множитель составляет фиксированные 6x для каждой строки тарификации.
Конкретно для GPT-5.6 Sol ничего из этого пока недостижимо. Подписочного пути нет — в документации по скорости на стороне ChatGPT Ultrafast указан как поддерживающий GPT-6 и GPT-6.1 Sol — а путь через API по-прежнему закрыт для всех, кроме когорты предварительного просмотра. Что бы ни обещала цифра 14x, она обещает это набору аккаунтов, который не расширялся два месяца.

Какой из них действительно использовать и когда ждать
Если вы начинаете сегодня, вопрос во многом решается сам собой: GPT-6.1 Sol Ultrafast можно купить, у него есть цена и документация, а у GPT-5.6 Sol Ultrafast — нет. Причина, по которой стоит вместо него обратиться к более старой модели, вовсе не в уровне — дело в том, что GPT-5.6 Sol существует с 9 июля 2026 года, и если у вас есть наборы промптов, оценки и модели затрат, построенные под него, затраты на переход к обновлению Sol с другой датой отсечки знаний и строго более узкой лестницей рассуждений реальны, даже если цена снижена вдвое. Совершайте этот переход по собственному графику, а не потому, что наконец появилась настройка скорости.
Правило принятия решения для самого уровня — то, которое подразумевают цифры Astra и подтверждает Sol: шестикратная цена за сокращение задержки — выгодная сделка, когда человек или агент заблокирован на выводе, и плохая, когда у задачи есть время до утра. Ничто в запуске GPT-6.1 Sol не меняет эту арифметику; он лишь делает это доступным на более дешёвой базовой модели, где абсолютный счёт за быстрый ответ меньше.
А если вам нужен вместо этого уровень Fast, об этом можно рассуждать, исходя только из тарифной сетки: в 2 раза дороже Standard, и Fast остаётся стабильным промежуточным вариантом с тех пор, как 30 июля 2026 года OpenAI переименовала Priority processing. Ultrafast — это по-прежнему уровень, на котором вы покупаете обещание, не подкреплённое измерениями, а на стороне GPT-5.6 Sol — уровень, который вы вообще не можете купить.
Вызов любого из них одной клавишей
GPT-5.6 Sol и GPT-6.1 Sol уровня Standard оба доступны на OrcaRouter — openai/gpt-5.6-solпо $4.00 за вход и $20.00 за выход за миллион токенов, openai/gpt-6.1-solпо $2.00 и $10.00 — с наценкой 0%, причём прайс-лист провайдера транслируется напрямую, так что изменение цены вендором отражается в вашем счёте в тот же день, когда оно появляется в тарифной сетке. Для этой пары это важнее, чем обычно, потому что $4.00 / $20.00 у GPT-5.6 Sol — явно промоакционная цена, и OpenAI заявляет, что она действует как минимум до 21 ноября 2026 года. Когда это окно закроется, разрыв между двумя поколениями сократится, а платформа со сквозной передачей цены означает, что вы узнаете об этом из своих цифр потребления, а не из письма о продлении.
Один и тот же ключ и эндпоинт обслуживают более 200 моделей, поэтому сравнение двух поколений Sol на вашем собственном трафике не требует двух интеграций или двух договоров, а автоматическое переключение при сбое сохраняет рабочий продакшен-путь, если один провайдер деградирует. Там, где одного ответа недостаточно, DSL маршрутизации объединяет несколько моделей в один вызов, а модельная фузия ставит за ним панель.
Ultrafast мы не предоставляем. На обеих моделях это флаг уровня сервиса в аккаунте OpenAI, а не отдельно маршрутизируемая модель, поэтому он остаётся внутри вашей прямой интеграции с OpenAI, — а на GPT-5.6 Sol он там даже не является общедоступным. Мы говорим об этом прямо, потому что альтернатива — намекать на возможность, которой у нас нет. А такой фразы мы на этом блоге видеть не хотим.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
