
GPT-5.3 Codex Spark vs GPT-5.6 Sol: скоростной козырь OpenAI пока недоступен в API
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0259Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0258Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0166Интеллект82Кодинг
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
GPT-5.3 Codex Spark — это самая быстрая из всех когда-либо выпущенных моделей для написания кода: исследовательская предварительная версия, которая генерирует более 1000 токенов в секунду на чипах Cerebras и вносит правки в код до 15 раз быстрее, чем полная версия GPT-5.3 Codex — так утверждает производитель. Вот что большинство обзоров замалчивает: это не универсальный API-продукт. Публичной цены на API нет, доступ открыт только подписчикам ChatGPT Pro через приложение Codex и CLI, а на OrcaRouter она недоступна. Две модели для написания кода, к которым вы реально можете обратиться через один endpoint, — это GPT-5.3 Codex по $1.75 за миллион входных токенов и $14.00 за миллион выходных, и GPT-5.6 Sol по $5.00 / $30.00 — и именно сравнение скоростной предварительной версии с флагманской моделью показывает, стоит ли ждать Spark.
Хронология объясняет путаницу. GPT-5.3 Codex, агентная модель OpenAI для написания кода, появилась в API в феврале 2026 года; вариант Spark вышел в том же месяце в качестве исследовательского предварительного релиза, нацеленного именно на интерактивное программирование, где миллисекунды между нажатием клавиши и откликом важнее, чем балл в бенчмарке. Пять месяцев спустя OpenAI выпустила семейство GPT-5.6 — Sol, Terra и Luna — и GPT-5.6 Sol, флагман за $5 / $30, выпущенный 9 июля 2026 года, — это модель, которая сделала большую часть разрыва в скорости неактуальной. Это не противостояние двух соперников; это противостояние исследовательского предварительного релиза и флагмана, появившегося после него.
Что такое GPT-5.3 Codex Spark на самом деле
GPT-5.3 Codex Spark — первая модель OpenAI, предназначенная для программирования в реальном времени, и первая публичная веха в партнерстве компании с производителем чипов Cerebras, начавшемся в январе 2026 года. Она работает на Wafer Scale Engine 3 от Cerebras — чипе размером с обеденную тарелку с четырьмя триллионами транзисторов, что позволяет обойти узкое место коммуникации между GPU-кластерами, которое главным образом определяет задержку при обычном инференсе. Помимо чипа, OpenAI сократила накладные расходы на один цикл обмена примерно на 80%, на один токен — примерно на 30%, а время до первого токена — примерно на 50% благодаря постоянным WebSocket-соединениям и изменениям в Responses API — путь через WebSocket включен по умолчанию для Spark.
Компромисс очевиден. На агентных бенчмарках инженерии ПО, на которые ссылается OpenAI, Spark оказывается значительно ниже полной версии GPT-5.3 Codex — 58,4% против 77,3% на Terminal-Bench 2.0, оба показателя сообщены вендором — потому что по умолчанию он использует облегчённый стиль работы: вносит минимальные точечные правки и не запускает тесты автоматически, если явно об этом не попросить. Это модель с контекстом 128K и только текстовым входом, что ставит её по возможностям далеко позади нынешних флагманов. Скорость — это продукт, и продукт этот — превью.

Ситуация с ценами: нет цены на API, и что говорят трекеры
OpenAI не опубликовала цену API для GPT-5.3 Codex Spark. На момент запуска он был доступен подписчикам ChatGPT Pro через приложение Codex, CLI Codex и расширение VS Code, при этом доступ к API предоставлялся только избранным партнёрам по дизайну, а у него собственные отдельные лимиты, которые не засчитываются в стандартное использование. Полгода спустя это всё ещё честное описание ситуации. Несколько сторонних трекеров цен теперь указывают $1.75 / $14.00 за миллион строк для Spark — те же цифры, что и у полного GPT-5.3 Codex, — но OpenAI не делала анонса об общей доступности, а цифра на трекере — это не цена, по которой можно купить. Считайте все цены на Spark неподтверждёнными, пока OpenAI не заявит об обратном.
Что вы можете купить сегодня по опубликованным ценам:
• GPT-5.3 Codex — $1.75 за миллион входных токенов, $14.00 за миллион выходных, кэшированный ввод по $0.175. Контекстное окно 400K с пределом выходных токенов 128K. Агентная модель для написания кода от OpenAI, доступная в публичном API с февраля 2026 года.
• GPT-5.6 Sol — $5.00 за миллион входных токенов и $30.00 за миллион выходных токенов для запросов до 32K входных токенов, повышаясь до $10 / $45 выше этого; кэшированный ввод $0.50, запись в кэш $6.25. Контекст примерно на 1.05M токенов с выводом 128K, ввод текста плюс изображений плюс файлов. Флагманская модель OpenAI, выпущена 9 июля 2026 года.
Обе позиции находятся на OrcaRouter по отпускным ценам вендоров с нулевой наценкой — линия $1.75 / $14 и линия $5 / $30 — это цены здесь, а не их версия у реселлера. Снижение цены поставщиком вступает в силу на этой стороне в тот же день, когда его делает вендор, потому что OrcaRouter передаёт отпускную цену как есть, а не добавляет повторную наценку.

GPT-5.3 Codex Spark против GPT-5.6 Sol, параметр за параметром
• Скорость — Spark генерирует 1,000+ токенов в секунду на оборудовании Cerebras (по данным производителя), и именно ради этого он и существует; измеренная скорость генерации GPT-5.6 Sol на OrcaRouter за последние 7 дней составляет около 244 токенов в секунду. Не близко — и это ещё не вся история.
• Цена — у Spark нет публичной цены на API; GPT-5.6 Sol — $5 / $30 на базовом тарифе, $10 / $45 при вводе более 32K токенов.
• Контекст — Spark на 128K, только текст; GPT-5.6 Sol примерно на 1.05M с вводом текста, изображений и файлов.
• Агентное кодирование — Spark набирает 58,4% на Terminal-Bench 2.0 (по данным вендора); GPT-5.6 Sol получает 77,4 по AA Coding, по независимым измерениям Artificial Analysis, и занимает 2-е место среди 132 моделей.
• Стиль работы — Spark вносит минимальные правки и по умолчанию пропускает тестовые запуски; GPT-5.6 Sol — это полноценный агентный флагман с рассуждением и использованием инструментов.
• Доступ — Spark — это исследовательская предварительная версия ChatGPT Pro; GPT-5.6 Sol — публичная API-модель с опубликованной ценой.
Если единственное, что вам нужно, — это быстрый черновик небольшой правки, дизайн Spark идеален. Если же вам нужен агент, который читает репозиторий, планирует изменение, запускает тесты и повторяет цикл, пока они не пройдут, Spark и не пытается быть таким — и 77,4 балла Sol по шкале AA Coding — это цифра, которую стоит сопоставить с превью, у которого таких баллов нет.

Реальность маршрутизации: вам не нужно выбирать вслепую.
Это один из тех матчапов, где уровень маршрутизации меняет решение. Обе вызываемые модели доступны на OrcaRouter по прейскурантным ценам самих вендоров с нулевой наценкой — openai/gpt-5.3-codex по $1.75 / $14 и openai/gpt-5.6-sol по $5 / $30 — так что вы можете прогнать одну и ту же рабочую нагрузку через обе на одном ключе и позволить своему трафику решить, вместо того чтобы доверять нарративам любого из вендоров. DSL маршрутизации делает это практичным: правило отказоустойчивости, при котором работа агента, связанная с кодингом, выполняется на GPT-5.3 Codex, а сложные вызовы с длинным контекстом эскалируются до GPT-5.6 Sol, с измерением каждой задачи на ваших собственных данных.
Три особенности OrcaRouter делают это дешевле альтернатив. Во-первых, наценка $0 за токен — вы платите цену провайдера по прайс-листу, без каких-либо надбавок. Во-вторых, BYOK — используйте свой существующий ключ провайдера, и провайдер выставляет вам счёт напрямую, так что нет предоплаченного пула кредитов и нет раздутого роутером счёта, который нужно сверять. В-третьих, эндпоинт является совместимым с OpenAI: направьте ваш существующий клиент chat/completions или Responses на базовый URL OrcaRouter — тот же код продолжит работать, а за одним эндпоинтом доступно 200+ моделей на тот случай, когда вы перерастёте линейку одного провайдера. Слой защиты перед этим эндпоинтом — ещё одна причина, по которой желание использовать research-preview можно безопасно отложить: пока у Spark нет публичного API и SLA, для продакшена ответ — опубликованная модель, а слой маршрутизации сохраняет для этой модели цену по прайс-листу с автоматическим переключением при сбое, так что всплеск лимитов не остановит пайплайн.
Где Spark — неправильный ответ
Честные ограничения, потому что дизайн Spark — это компромисс, о который вы не должны спотыкаться. Если ваша работа — это долгосрочное агентное программирование — задача, требующая понимания всего репозитория, удержания плана на протяжении многих шагов и проверки собственных изменений, — режим по умолчанию Spark с минимальным редактированием и без запуска тестов является ловушкой, а его текстовый контекст на 128K без поддержки других типов данных не вместит репозиторий. Если вам нужны изображения или файлы в промпте, он не может их принять. Если вам нужна прогнозируемая цена или SLA, на который можно положиться, у него нет ни того, ни другого. А если ваша нагрузка — это высокопроизводительный пакетный конвейер, 1000 токенов в секунду не имеют значения; важны стоимость за токен и пропускная способность, а они говорят в пользу более дешёвого GPT-5.3 Codex.
Также стоит назвать то, что мы не хостим: GPT-5.3 Codex Spark отсутствует на OrcaRouter, потому что нет публичного API для маршрутизации. Мы не делаем вид, что это не так. Честный подход к планированию — строить на существующих моделях: GPT-5.3 Codex для агентной работы по написанию кода по $1.75 / $14, GPT-5.6 Sol для сложных длинноконтекстных мультимодальных вызовов агентов по $5 / $30 — и рассматривать Spark как превью, за которым стоит наблюдать, а не как зависимость, на которую стоит ставить пайплайн.
Суть
GPT-5.3 Codex Spark — самый интересный исследовательский превью, который OpenAI выпустила в этом году, и это ещё не производственное решение. Производственное решение — то, у которого есть опубликованные цены, проверяемые бенчмарки и API, который отвечает, — это GPT-5.3 Codex для агентной работы с кодом и GPT-5.6 Sol для самых сложных запросов, оба на одной конечной точке по прейскурантной цене с нулевой наценкой. Когда Spark доберётся до публичного API, он почти наверняка окажется за тем же типом конечной точки, и переключение будет сменой имени модели, а не миграцией. А пока это повод следить за ним — и самый быстрый способ быть готовым — подключить вызываемые модели на ключе, который у вас уже есть.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
