Титульная карточка для сравнения GPT-5.3 Codex Spark и GPT-5.6 Sol, показывающая две скруглённые карточки: левая карточка с надписью GPT-5.3 Codex Spark, со значком молнии, текстом «1,000+ ток/с — исследовательская предварительная версия» и баннером «публичной цены API пока нет»; правая карточка с надписью GPT-5.6 Sol, со значком щита, текстом «$5 / $30 — флагман» и баннером «API доступен для вызова уже сегодня».
Guides & Insights

GPT-5.3 Codex Spark vs GPT-5.6 Sol: скоростной козырь OpenAI пока недоступен в API

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

GPT-5.3 Codex Spark — это самая быстрая из всех когда-либо выпущенных моделей для написания кода: исследовательская предварительная версия, которая генерирует более 1000 токенов в секунду на чипах Cerebras и вносит правки в код до 15 раз быстрее, чем полная версия GPT-5.3 Codex — так утверждает производитель. Вот что большинство обзоров замалчивает: это не универсальный API-продукт. Публичной цены на API нет, доступ открыт только подписчикам ChatGPT Pro через приложение Codex и CLI, а на OrcaRouter она недоступна. Две модели для написания кода, к которым вы реально можете обратиться через один endpoint, — это GPT-5.3 Codex по $1.75 за миллион входных токенов и $14.00 за миллион выходных, и GPT-5.6 Sol по $5.00 / $30.00 — и именно сравнение скоростной предварительной версии с флагманской моделью показывает, стоит ли ждать Spark.

Хронология объясняет путаницу. GPT-5.3 Codex, агентная модель OpenAI для написания кода, появилась в API в феврале 2026 года; вариант Spark вышел в том же месяце в качестве исследовательского предварительного релиза, нацеленного именно на интерактивное программирование, где миллисекунды между нажатием клавиши и откликом важнее, чем балл в бенчмарке. Пять месяцев спустя OpenAI выпустила семейство GPT-5.6 — Sol, Terra и Luna — и GPT-5.6 Sol, флагман за $5 / $30, выпущенный 9 июля 2026 года, — это модель, которая сделала большую часть разрыва в скорости неактуальной. Это не противостояние двух соперников; это противостояние исследовательского предварительного релиза и флагмана, появившегося после него.

Что такое GPT-5.3 Codex Spark на самом деле

GPT-5.3 Codex Spark — первая модель OpenAI, предназначенная для программирования в реальном времени, и первая публичная веха в партнерстве компании с производителем чипов Cerebras, начавшемся в январе 2026 года. Она работает на Wafer Scale Engine 3 от Cerebras — чипе размером с обеденную тарелку с четырьмя триллионами транзисторов, что позволяет обойти узкое место коммуникации между GPU-кластерами, которое главным образом определяет задержку при обычном инференсе. Помимо чипа, OpenAI сократила накладные расходы на один цикл обмена примерно на 80%, на один токен — примерно на 30%, а время до первого токена — примерно на 50% благодаря постоянным WebSocket-соединениям и изменениям в Responses API — путь через WebSocket включен по умолчанию для Spark.

Компромисс очевиден. На агентных бенчмарках инженерии ПО, на которые ссылается OpenAI, Spark оказывается значительно ниже полной версии GPT-5.3 Codex — 58,4% против 77,3% на Terminal-Bench 2.0, оба показателя сообщены вендором — потому что по умолчанию он использует облегчённый стиль работы: вносит минимальные точечные правки и не запускает тесты автоматически, если явно об этом не попросить. Это модель с контекстом 128K и только текстовым входом, что ставит её по возможностям далеко позади нынешних флагманов. Скорость — это продукт, и продукт этот — превью.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the GPT-5.6 Sol header with Vision, Tools, and JSON badges, the 1.05M-token context window, a 128K max output, the p50 TTFT figure, and the flagship description covering deep reasoning and long-horizon agentic workflows.

Ситуация с ценами: нет цены на API, и что говорят трекеры

OpenAI не опубликовала цену API для GPT-5.3 Codex Spark. На момент запуска он был доступен подписчикам ChatGPT Pro через приложение Codex, CLI Codex и расширение VS Code, при этом доступ к API предоставлялся только избранным партнёрам по дизайну, а у него собственные отдельные лимиты, которые не засчитываются в стандартное использование. Полгода спустя это всё ещё честное описание ситуации. Несколько сторонних трекеров цен теперь указывают $1.75 / $14.00 за миллион строк для Spark — те же цифры, что и у полного GPT-5.3 Codex, — но OpenAI не делала анонса об общей доступности, а цифра на трекере — это не цена, по которой можно купить. Считайте все цены на Spark неподтверждёнными, пока OpenAI не заявит об обратном.

Что вы можете купить сегодня по опубликованным ценам:

GPT-5.3 Codex — $1.75 за миллион входных токенов, $14.00 за миллион выходных, кэшированный ввод по $0.175. Контекстное окно 400K с пределом выходных токенов 128K. Агентная модель для написания кода от OpenAI, доступная в публичном API с февраля 2026 года.

GPT-5.6 Sol — $5.00 за миллион входных токенов и $30.00 за миллион выходных токенов для запросов до 32K входных токенов, повышаясь до $10 / $45 выше этого; кэшированный ввод $0.50, запись в кэш $6.25. Контекст примерно на 1.05M токенов с выводом 128K, ввод текста плюс изображений плюс файлов. Флагманская модель OpenAI, выпущена 9 июля 2026 года.

Обе позиции находятся на OrcaRouter по отпускным ценам вендоров с нулевой наценкой — линия $1.75 / $14 и линия $5 / $30 — это цены здесь, а не их версия у реселлера. Снижение цены поставщиком вступает в силу на этой стороне в тот же день, когда его делает вендор, потому что OrcaRouter передаёт отпускную цену как есть, а не добавляет повторную наценку.

The OrcaRouter model page for openai/gpt-5.3-codex, showing the GPT-5.3-Codex header with Vision, Tools, JSON, and Reasoning badges, the 400K-token context window, the $1.75 per million input and $14.00 per million output pricing, and an OpenAI-compatible code snippet pointing at the OrcaRouter base URL.

GPT-5.3 Codex Spark против GPT-5.6 Sol, параметр за параметром

Скорость — Spark генерирует 1,000+ токенов в секунду на оборудовании Cerebras (по данным производителя), и именно ради этого он и существует; измеренная скорость генерации GPT-5.6 Sol на OrcaRouter за последние 7 дней составляет около 244 токенов в секунду. Не близко — и это ещё не вся история.

Цена — у Spark нет публичной цены на API; GPT-5.6 Sol — $5 / $30 на базовом тарифе, $10 / $45 при вводе более 32K токенов.

Контекст — Spark на 128K, только текст; GPT-5.6 Sol примерно на 1.05M с вводом текста, изображений и файлов.

Агентное кодирование — Spark набирает 58,4% на Terminal-Bench 2.0 (по данным вендора); GPT-5.6 Sol получает 77,4 по AA Coding, по независимым измерениям Artificial Analysis, и занимает 2-е место среди 132 моделей.

Стиль работы — Spark вносит минимальные правки и по умолчанию пропускает тестовые запуски; GPT-5.6 Sol — это полноценный агентный флагман с рассуждением и использованием инструментов.

Доступ — Spark — это исследовательская предварительная версия ChatGPT Pro; GPT-5.6 Sol — публичная API-модель с опубликованной ценой.

Если единственное, что вам нужно, — это быстрый черновик небольшой правки, дизайн Spark идеален. Если же вам нужен агент, который читает репозиторий, планирует изменение, запускает тесты и повторяет цикл, пока они не пройдут, Spark и не пытается быть таким — и 77,4 балла Sol по шкале AA Coding — это цифра, которую стоит сопоставить с превью, у которого таких баллов нет.

A three-column comparison scoreboard for GPT-5.3 Codex Spark, GPT-5.3 Codex, and GPT-5.6 Sol: Spark shows no public API price, a 128K context, 1,000+ tokens per second vendor-reported, Terminal-Bench 2.0 of 58.4 percent, text-only input, and Pro-only preview access; GPT-5.3 Codex shows $1.75/$14, a 400K context, about 73 tokens per second, Terminal-Bench 2.0 of 77.3 percent, text plus image plus file input, and public API access; GPT-5.6 Sol shows $5/$30, a 1.05M context, about 244 tokens per second, an AA Coding score of 77.4, text plus image plus file input, and public API access.

Реальность маршрутизации: вам не нужно выбирать вслепую.

Это один из тех матчапов, где уровень маршрутизации меняет решение. Обе вызываемые модели доступны на OrcaRouter по прейскурантным ценам самих вендоров с нулевой наценкой — openai/gpt-5.3-codex по $1.75 / $14 и openai/gpt-5.6-sol по $5 / $30 — так что вы можете прогнать одну и ту же рабочую нагрузку через обе на одном ключе и позволить своему трафику решить, вместо того чтобы доверять нарративам любого из вендоров. DSL маршрутизации делает это практичным: правило отказоустойчивости, при котором работа агента, связанная с кодингом, выполняется на GPT-5.3 Codex, а сложные вызовы с длинным контекстом эскалируются до GPT-5.6 Sol, с измерением каждой задачи на ваших собственных данных.

Три особенности OrcaRouter делают это дешевле альтернатив. Во-первых, наценка $0 за токен — вы платите цену провайдера по прайс-листу, без каких-либо надбавок. Во-вторых, BYOK — используйте свой существующий ключ провайдера, и провайдер выставляет вам счёт напрямую, так что нет предоплаченного пула кредитов и нет раздутого роутером счёта, который нужно сверять. В-третьих, эндпоинт является совместимым с OpenAI: направьте ваш существующий клиент chat/completions или Responses на базовый URL OrcaRouter — тот же код продолжит работать, а за одним эндпоинтом доступно 200+ моделей на тот случай, когда вы перерастёте линейку одного провайдера. Слой защиты перед этим эндпоинтом — ещё одна причина, по которой желание использовать research-preview можно безопасно отложить: пока у Spark нет публичного API и SLA, для продакшена ответ — опубликованная модель, а слой маршрутизации сохраняет для этой модели цену по прайс-листу с автоматическим переключением при сбое, так что всплеск лимитов не остановит пайплайн.

Где Spark — неправильный ответ

Честные ограничения, потому что дизайн Spark — это компромисс, о который вы не должны спотыкаться. Если ваша работа — это долгосрочное агентное программирование — задача, требующая понимания всего репозитория, удержания плана на протяжении многих шагов и проверки собственных изменений, — режим по умолчанию Spark с минимальным редактированием и без запуска тестов является ловушкой, а его текстовый контекст на 128K без поддержки других типов данных не вместит репозиторий. Если вам нужны изображения или файлы в промпте, он не может их принять. Если вам нужна прогнозируемая цена или SLA, на который можно положиться, у него нет ни того, ни другого. А если ваша нагрузка — это высокопроизводительный пакетный конвейер, 1000 токенов в секунду не имеют значения; важны стоимость за токен и пропускная способность, а они говорят в пользу более дешёвого GPT-5.3 Codex.

Также стоит назвать то, что мы не хостим: GPT-5.3 Codex Spark отсутствует на OrcaRouter, потому что нет публичного API для маршрутизации. Мы не делаем вид, что это не так. Честный подход к планированию — строить на существующих моделях: GPT-5.3 Codex для агентной работы по написанию кода по $1.75 / $14, GPT-5.6 Sol для сложных длинноконтекстных мультимодальных вызовов агентов по $5 / $30 — и рассматривать Spark как превью, за которым стоит наблюдать, а не как зависимость, на которую стоит ставить пайплайн.

Суть

GPT-5.3 Codex Spark — самый интересный исследовательский превью, который OpenAI выпустила в этом году, и это ещё не производственное решение. Производственное решение — то, у которого есть опубликованные цены, проверяемые бенчмарки и API, который отвечает, — это GPT-5.3 Codex для агентной работы с кодом и GPT-5.6 Sol для самых сложных запросов, оба на одной конечной точке по прейскурантной цене с нулевой наценкой. Когда Spark доберётся до публичного API, он почти наверняка окажется за тем же типом конечной точки, и переключение будет сменой имени модели, а не миграцией. А пока это повод следить за ним — и самый быстрый способ быть готовым — подключить вызываемые модели на ключе, который у вас уже есть.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube