Редакционная плоская векторная иллюстрация для главного баннера технологического блога о сверхбыстром инференсе ИИ: {{1}}большой скруглённый чип модели глубокого синего цвета с мягким голубым свечением на светлом фоне, {{2}}стилизованная молния и шкала скорости со стрелкой на максимуме рядом с ним, {{3}}быстрые потоки токенов, мчащиеся по горизонтальной линии скорости с линиями движения, и маленький секундомер.{{/3}} {{/2}} {{/1}} Белый фон с мягкими сине-голубыми градиентными акцентами и одним тонким тёплым бликом; минималистичные плоские линейные иконки; чистая современная геометрическая типографика без засечек; без читаемого текста, без букв, без слов, без водяных знаков, без сторонних логотипов; композиция 16:9.
Guides & Insights

GPT-5.6 Sol Ultrafast: Ultrafast выпущен по цене в 6 раз выше стандартной, но эта модель всё ещё доступна только в режиме предварительного просмотра

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Ожидание для этого уровня закончилось, но не для этой модели. На DevDay 29 сентября 2026 года вендор превратил Ultrafast в то, что можно купить: новый тариф ChatGPT Pro 500 за $500 в месяц включает его, API теперь публикует тарифную сетку Ultrafast по шестикратной стандартной ставке — $60.00 за ввод / $300.00 за вывод за миллион токенов на GPT-6 Astra — а документация вендора по Codex подтверждает, что тарифы Pro вообще не имеют пятичасового лимита использования, тогда как это окно применяется к Plus. Всё это заявлено вендором и опубликовано в его собственном обзоре DevDay, на страницах справки и в документации для разработчиков. А вот модель, которой посвящена эта страница, не сдвинулась с места.GPT-5.6 Sol Ultrafast, анонсированный 13 августа 2026 года как уровень обслуживания с ускорением Cerebras для GPT-5.6 Sol с пропускной способностью до 14× от стандартной и 750 выходных токенов в секунду, по-прежнему доступен только в режиме предварительного доступа — организуемого через команду вендора по работе с аккаунтами — и по-прежнему не имеет собственной опубликованной цены. Уровень вышел. Вариант Sol всё ещё ждёт.

С момента, когда мы впервые написали об этом, произошли два изменения цен, и они указывают в противоположных направлениях. Лежащая в основе модель подешевела: стандартный GPT-5.6 Sol теперь тарифицируется по $4.00 за миллион входных токенов и $20.00 за миллион выходных — это промо-тариф OpenAI, который, по словам поставщика, действует как минимум до 21 ноября 2026 года, — а не $5.00 / $30.00, действовавшие в августе. Скоростной уровень поверх неё впервые получил цену, и он недёшев: Ultrafast на GPT-6 Astra тарифицируется по $60.00 / $300.00 за миллион. Каждая цифра в этом материале была повторно сверена с опубликованным тарифным справочником OpenAI, справочником по API и документацией по ценам Codex по состоянию на 2026-09-30.

Что такое режим Ultrafast на самом деле

Ultrafast — это уровень обслуживания, а не новая модель. OpenAI объявила о нём 13 августа 2026 года как о первом продукте своего партнёрства в области вычислений с производителем чипов Cerebras, начавшегося в январе 2026 года, — сообщалось, что сумма сделки составляет около 10 миллиардов долларов за три года. Там, где стандартный GPT-5.6 Sol инференс выполняется на кластерах GPU и тратит большую часть времени на перемещение весов между памятью и вычислительными блоками, Ultrafast загружает веса модели в 44 ГБ внутрикристальной SRAM на чипах Cerebras пластинчатого масштаба (wafer-scale); модель размером с Sol занимает несколько пластин, уложенных слоями, поэтому веса находятся там же, где и вычисления. В результате потолок пропускной способности задаётся кремнием, а не пропускной способностью памяти.

Аппаратная история продолжилась 2026-08-18. На мероприятии Supernova компания Cerebras представила CS-4 — систему следующего поколения уровня стойки, построенную на собственной платформе Nexus: три чипа Wafer-Scale Engine на стойку, до 2× скорости генерации токенов по сравнению с предыдущей CS-3 и, по данным Cerebras, более 1000 токенов в секунду на моделях с более чем 10 триллионами параметров. Это заявления Cerebras о системе в раннем доступе, которая ещё не является общедоступной. С момента презентации единственный пост в X утверждает, что CS-4 уже обслуживает GPT-5.6 Sol со скоростью примерно 1300 токенов в секунду — это согласуется по направлению с собственными показателями Cerebras, но пока никем не подтверждено. Относитесь к этому как к раннему сигналу: правдоподобно, неподтверждённо, и стоит перепроверить, прежде чем планировать мощности на его основе.

Что важно для вашего кода: идентификатор модели, веса, характер рассуждений и выходные данные идентичны стандартной GPT-5.6 Sol. OpenAI позиционирует Ultrafast как «больше полезной работы в секунду», а не как уровень качества, и предварительная версия использует полноценную флагманскую модель — скорость обеспечивается не заменой на более дешёвую модель. Меняется лишь скорость, с которой выводятся токены.

Не путайте Ultrafast с быстрым режимом. Быстрый режим — это отдельный, приобретаемый за отдельную плату уровень на стандартном оборудовании: до примерно 2,5× скорости генерации при 2× надбавке за токен и без изменения качества — 30 июля 2026 года он был переименован из Priority Processing, и на GPT-5.6 Sol он стоит $8.00 за вход / $40.00 за выход за 1M токенов. Ultrafast — это совсем другое: оборудование Cerebras, до 14× на GPT-5.6 Sol и до 8× на GPT-6 Astra, стоимостью 6× от стандартного тарифа на Astra и всё ещё без объявленной цены на Sol. Теперь эти два названия стоят рядом друг с другом в одном и том же меню выбора модели, и это остаётся самым запутанным моментом во всём этом релизе.

Как быстро — цифры, которые имеют значение.

Speed card titled 'GPT-5.6 Sol Ultrafast — how fast', sourced to the OpenAI announcement of 2026-08-13 with all speed figures vendor-reported. Three highlight cells read Up to 14x max speedup vs standard, 750 output tokens per second max, and 11h 11m for 2,500 HLE questions. Rows list standard GPT-5.6 Sol as the 1x baseline, fast mode up to ~2.5x at 2x price, Claude Fable 5 on the same HLE set at 78h 27m, GDP-Val end-to-end at 5.6x faster, and 'same model, same quality — hardware only'. Footer: 14x is a maximum, not a guarantee, and none of the speed figures are independently verified yet.

Главный показатель — 14×, и он требует определения. OpenAI утверждает, что Ultrafast генерирует до 750 выходных токенов в секунду по сравнению со стандартной обработкой GPT-5.6 Sol. Это показатель пропускной способности для выходных токенов, а не безоговорочное утверждение, что «всё работает в 14 раз быстрее» — время обработки запроса от начала до конца также включает обработку ввода и собственные рассуждения модели, поэтому 14× указано как максимальное значение.

• Максимальная пропускная способность вывода — до 750 выходных токенов в секунду, согласно анонсу OpenAI (2026-08-13).

• По сравнению со стандартной обработкой — до 14 раз быстрее, согласно тому же анонсу; фактический прирост зависит от длины ввода и типа задачи.

• Humanity's Last Exam, 2 500 вопросов — OpenAI/Cerebras сообщают, что GPT-5.6 Sol Ultrafast завершает работу за 11 часов 11 минут против 78 часов 27 минут у Claude Fable 5, при сопоставимой точности. Данные заявлены поставщиками, а само сравнение охватывает аппаратные стеки двух разных вендоров — воспринимайте это как ориентир, а не как вердикт.

• GDP-Val, сквозной — Cerebras сообщает о 5,6-кратном ускорении в целом без измеримой потери качества. Также по данным вендора.

• Сравнение Fast mode и Ultrafast — Fast mode достигает примерно 2,5× скорости вывода при 2× надбавке к цене, но ограничен тем же порогом в ~272K токенов, что и стандартные тарифы. Ultrafast — более крупный скачок: 14× на GPT-5.6 Sol согласно августовскому анонсу и до 8× на GPT-6 Astra в Codex согласно текущей документации OpenAI, а по публикациям о запуске это до 300 выходных токенов в секунду.

• CS-4, следующее аппаратное обеспечение — Cerebras утверждает, что стойка CS-4 выдаёт более 1 000 токенов в секунду на моделях с более чем 10 триллионами параметров, что до 2× превосходит генерацию токенов CS-3. Неподтверждённое сообщение сообщества оценивает GPT-5.6 Sol на CS-4 примерно в 1 300 токенов в секунду — то же направление, но пока не подтверждено ни OpenAI, ни Cerebras.

Одна оговорка, прежде чем вы процитируете 14×: это верхний предел пропускной способности вывода на оборудовании одного производителя, а независимые сравнения августовского запуска давали примерно от 7× до 11× в зависимости от того, какая часть рабочей нагрузки измерялась. Та же дисциплина применима к сигналу скорости CS-4 — показатель ~1 300 токенов/с для GPT-5.6 Sol на CS-4 начался с одного поста в X, и ни OpenAI, ни Cerebras его не подтвердили. Воспринимайте всё это как заявления производителей и сообщества, а не как вердикты бенчмарков.

Сколько сейчас стоит Ultrafast — и почему это всё ещё не определяет цену Sol

Price card titled 'What GPT-5.6 Sol costs today — 2026-08-18', listing published input/output rates per 1M tokens. Three highlight cells read Standard $5.00 / $30.00, Fast mode $10.00 / $60.00, and Ultrafast price TBD in preview. Rows list prompt cache read $0.50, cache write $6.25, long-context over ~272K $10.00 / $45.00, batch API $2.50 / $15.00, and context window ~1.05M with 128K max output. Footer: Ultrafast has no published price as of 2026-08-18 — standard and fast mode are what you can buy today.

Вот положение дел с вопросом о ценах на 2026-09-30, изложенное прямо. У Ultrafast есть опубликованная ставка — для GPT-6 Astra и только для GPT-6 Astra. На странице цен OpenAI теперь есть столбец Ultrafast рядом со Standard, Batch, Flex и Fast: $60.00 за входные данные / $6.00 за кэшированные входные данные / $75.00 за запись в кэш / $300.00 за выходные данные за миллион токенов в коротком контексте, с удвоением до $120.00 / $12.00 / $150.00 / $450.00 после примерно 272K токенов. Это в шесть раз больше стандартной ставки Astra, тогда как режим Fast — в два раза, и это первая конкретная цифра, которую OpenAI назвала для этого уровня. Приведённая выше карточка — это наш собственный снимок от 2026-08-18, и её долларовые показатели устарели дважды: из-за снижения стандартной ставки, а теперь из-за этой строки Ultrafast. Чего всё ещё не хватает в той таблице — любой ставки Ultrafast для GPT-5.6 Sol: в столбце Ultrafast указана ровно одна модель, gpt-6-astra. Уровень имеет цену; эта модель — нет.

Что вы можете оценить сегодня, по моделям:

• Стандартный GPT-5.6 Sol — $4.00 за вход / $20.00 за выход за 1 млн токенов для запросов объёмом примерно до 272 тыс. токенов. OpenAI указывает, что это промо-цена, действующая как минимум до 21 ноября 2026 года. Это базовый вариант, который можно вызвать прямо сейчас.

• Быстрый режим — $8.00 / $40.00 при коротком контексте на GPT-5.6 Sol, с удвоением до $16.00 / $60.00 после примерно 272K токенов. Вдвое выше стандартного тарифа за примерно до 2,5× скорости вывода, и на Sol это по-прежнему самое быстрое, что реально можно купить.

• Кэш промптов — чтения из кэша тарифицируются по $0.40 за 1M (на 90% дешевле свежего ввода); записи в кэш тарифицируются по $5.00 за 1M.

• Уровень для длинного контекста — входные данные объёмом свыше примерно 272K токенов тарифицируются по $8.00 / $30.00 при стандартной обработке, в пределах окна модели ~1.05M токенов и максимального объёма вывода 128K токенов.

• Batch API — $2.00 / $10.00 для короткого контекста и $4.00 / $15.00 для длинного контекста, фиксированная скидка 50% при обработке примерно за 24 часа.

Для GPT-5.6 Sol показатель Astra — лучшая доступная подсказка, и не более того. OpenAI назначает цену Ultrafast на уровне 6× от стандартного тарифа базовой модели; примените этот множитель к $4 / $20 для Sol — и получите $24 / $120 за миллион. Это арифметика, а не опубликованная цена — OpenAI ничего не говорила о ставке для Sol Ultrafast, а с августовских когорт предварительного просмотра вообще не взимали плату по ставке уровня. Планируйте исходя из стандартного Sol по $4 / $20 или быстрого режима по $8 / $40, пока поставщик не опубликует эту строку.

Как использовать — широко доступно на Astra, для Sol всё ещё по запросу

Access разделён на две части 29 сентября, и это разделение идёт вразрез с моделью, которой посвящена данная страница. Ultrafast теперь широко доступен на GPT-6 Astra: документация OpenAI API сообщает, что он открыт для всех пользователей API с низкими лимитами скорости — 500 000 токенов в минуту на уровнях использования 1–3, 1 миллион на уровне 4, 5 миллионов на уровне 5 — и поставляется внутри ChatGPT Work и Codex в новом тарифе Pro 500, а также в подходящих тарифах Enterprise и Edu, где владельцу рабочего пространства необходимо включить его вручную и где он не поддерживается для рабочих пространств, требующих инференса за пределами Соединённых Штатов. GPT-5.6 Sol Ultrafast не перешёл вместе с ним. Та же документация по-прежнему описывает его как доступ в режиме предварительного просмотра через команду аккаунта OpenAI, а описание самого параметра в схеме API всё ещё гласит «currently available for gpt-5.6-sol» — строка, которая теперь отстаёт от остальной документации, а не ведёт её за собой. Если вы хотите получить этот уровень сегодня, вам нужен он на Astra.

Вопрос с интерфейсом тоже решён. TestingCatalog 26 сентября 2026 года сообщил, что переключатель скорости с вариантами Standard, Fast и Ultrafast оставался неопубликованным в Responses API Playground; три дня спустя OpenAI выпустила потребительскую версию именно этого, причём Ultrafast теперь доступен как опция в меню выбора модели в ChatGPT Work и Codex на Pro 500. Мы отметили эту находку как интерпретацию невыпущенного интерфейса, сделанную одним изданием, и заявили, что OpenAI ничего из этого не подтвердила. В целом это было верно, а внедрение, на которое указывала эта находка, состоялось на DevDay, а не после него.

Пилотные когорты, которые OpenAI назвала в августе, — это кодинг, коммерция, финансовые исследования, поддержка и другие интерактивные рабочие нагрузки — команды, агенты которых совершают много вызовов на запрос и где узким местом является задержка отклика. Jane Street, Rogo и Podium были среди названных ранних тестировщиков. Если ваша нагрузка — это одноходовой чат, скоростной тариф имеет куда меньшее значение, чем для агентного цикла из 40 вызовов. Практический ответ теперь зависит от того, о какой модели вы спрашиваете: на GPT-6 Astra вы можете задать service_tier: "ultrafast" уже сегодня днём, а на GPT-5.6 Sol — всё ещё нет.

Что вы можете сделать сегодня — практический ответ

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

Пока GPT-5.6 Sol Ultrafast остаётся за дверью предпросмотра, обе флагманские модели уже доступны на OrcaRouter по тарифу провайдера с нулевой наценкой за токен — ID модели openai/gpt-5.6-sol через совместимую с OpenAI конечную точку по адресу api.orcarouter.ai/v1, а рядом с ней GPT-6 Astra по стандартной цене $10.00 / $50.00 — это модель, поверх которой OpenAI теперь добавила уровень Ultrafast и которую мы не маршрутизируем на этом уровне. Приведённый ниже снимок экрана сделан в августе 2026 года и всё ещё показывает действовавшую тогда линейку $5.00 / $30.00; сегодняшний тариф Sol — $4.00 / $20.00, и именно его мы пропускаем напрямую. Именно из-за такого сквозного пропуска изменения цен поставщика доходят до нашей стороны в тот же день: $4.00 за вход / $20.00 за выход — те же цифры, которые публикует OpenAI, без наценки за токен сверху. Если у вас уже есть клиент OpenAI, миграция — это смена базового URL и ID модели; и ничего больше. Тот же ключ и та же конечная точка обслуживают 200+ моделей, так что Sol стоит рядом со своими родственными моделями — GPT-5.6 Terra по $2.00 / $12.00 и GPT-5.6 Luna по $0.20 / $1.20 — а также модели с открытыми весами, с которыми вы бы его сравнивали, и вы можете маршрутизировать по сложности вместо повторной интеграции каждой из них.

Две особенности OrcaRouter стоит упомянуть на странице о скорости. BYOK: используйте собственный ключ OpenAI, и OpenAI выставляет счёт напрямую по своим тарифам — OrcaRouter добавляет $0 за токен и сохраняет лимиты запросов и кредиты вашего провайдера без изменений. Guardrails: PII Shield и политика контента срабатывают до выставления счёта, поэтому заблокированный запрос возвращает чистый 400 и с него никогда не взимается плата, а Agent Firewall оценивает вызовы инструментов и MCP до их выполнения. Сам Ultrafast широко доступен на GPT-6 Astra, но не на условиях маршрутизации и не для Sol — это уровень с контролем доступа с оплатой по 6× стандартного тарифа, и мы его не обслуживаем. Если OpenAI когда-нибудь предложит его на стандартных условиях, его подключение к той же конечной точке сведётся к смене model-id; созданная сегодня конфигурация сохранится.

Честная граница — когда Ultrafast не является ответом

Пять мест, где история о скорости всё ещё не работает, теперь, когда половина её уже улеглась:

Доступность — не то же самое, что доступность для вас. Ultrafast открылся для всех пользователей API на GPT-6 Astra, но открылся с низкими лимитами скорости, в схеме OpenAI он по-прежнему описывается как доступ с контролем, он не поддерживает обработку в ЕС или других регионах за пределами США, а в рабочих пространствах Enterprise он выключен, пока владелец его не включит. На GPT-5.6 Sol вообще ничего не открылось. Проверьте собственный доступ, прежде чем строить архитектуру на любом из них.

14× — это максимум, а не гарантия. Это верхний предел пропускной способности вывода на оборудовании Cerebras; сквозная задержка всё ещё включает обработку ввода, время рассуждения модели и вашу собственную сеть. Запрос с интенсивным рассуждением может потратить большую часть своего реального времени на размышления, где заявленное ускорение сокращается.

У одной модели цена указана, а у другой — нет. Тариф Astra Ultrafast опубликован — 6× от стандартного — а строки Ultrafast для GPT-5.6 Sol нигде нет. Закладывайте бюджет исходя из стандартного Sol по цене $4 / $20 или быстрого режима по $8 / $40, а любую цифру «стоимость GPT-5.6 Sol Ultrafast», которую увидите, включая приведённую выше экстраполяцию $24 / $120, считайте арифметикой, а не тарифной сеткой.

Эти бенчмарки заявлены производителем. 11-часовой прогон HLE и показатель GDP-Val 5,6× — это цифры OpenAI/Cerebras из августовского анонса; независимые оценки ускорения варьируются примерно от 7× до 11× в зависимости от того, что измеряется. Добавьте к этому списку сигнал CS-4: показатель ~1 300 токенов/с для GPT-5.6 Sol на CS-4 взят из единственного поста в X и не имеет независимого подтверждения. Новые показатели Astra Ultrafast — 8× в Codex, 6× по цене — тоже от самой OpenAI.

А тот, что стоит денег, а не времени: он не устранит узкое место, которого у вас нет. Если ваши агенты работают медленно из-за вашей собственной оркестрации, задержек инструментов или промптов с большим объёмом входных данных, более быстрый путь вывода сдвигает хвост лишь незначительно. Решение о подборе уровня — GPT-5.6 Sol за $4 / $20 против GPT-5.6 Terra за $2 / $12 против GPT-5.6 Luna за $0.20 / $1.20 — всё ещё влияет на ваш счёт сильнее, чем любой уровень скорости.

Главное. Ultrafast больше не уровень из листа ожидания, о котором можно только читать. С 29 сентября 2026 года OpenAI продаёт его: он включён в план ChatGPT Pro 500 за $500 в Work и Codex, открыт для всех пользователей API на GPT-6 Astra при низких лимитах скорости и стоит в шесть раз дороже стандартного тарифа — $60 / $300 за миллион короткого контекста. GPT-5.6 Sol Ultrafast, августовский предпросмотр, вокруг которого строилась эта страница, не изменился: доступ всё ещё контролируется, всё ещё ограничен gpt-5.6-sol в схеме API, всё ещё без цены, а показатель ~1 300 токенов/с, заявленный для Sol на CS-4 от Cerebras, по-прежнему остаётся единственным непроверенным постом в X. Стандартный GPT-5.6 Sol по цене $4 / $20 — это то, что вы можете вызвать сегодня на OrcaRouter с наценкой $0; GPT-6 Astra по цене $10 / $50 — это то, что вы можете вызвать, если хотите модель, получившую строку Ultrafast.

Теперь Ultrafast на GPT-6 Astra стоит настоящих денег — в 6 раз дороже стандартного тарифа или включён в план Pro 500 за $500, — тогда как Ultrafast в GPT-5.6 Sol остаётся предварительной версией. Полноценный GPT-5.6 Sol уже доступен на OrcaRouter по цене $4 / $20 за миллион токенов без наценки — можно использовать со своим ключом.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно