Титульная карточка для «GPT-5 Codex против GPT-5.6 Sol — специалист по коду против флагмана, который его поглотил»: крупный тёмно-синий заголовок, строка подзаголовка и две скруглённые карточки — GPT-5 Codex ($1.25 / $10 за 1M · специалист по коду) и GPT-5.6 Sol ($5 / $30 за 1M · флагманский универсал) — с логотипом OrcaRouter, размещённым в правом нижнем углу.
Guides & Insights

GPT-5 Codex против GPT-5.6 Sol: специалист по коду против флагмана, который его поглотил

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Когда O​penAI выпустила семейство G​PT-​5.6 9 июля 2026 года, она тихо упразднила отдельное приложение Codex и встроила режим агента-кодера в ChatGPT. Страница модели, подготовленная O​penAI для GPT-5.6 Sol, затем читалась как должностная инструкция, взятая у специалиста по программированию, — «глубокие многошаговые рассуждения, крупномасштабная разработка ПО и долгосрочные агентские рабочие процессы». Так что противостояние между GPT-5 Codex и GPT-5.6 Sol — это не обычная битва характеристик. Это специалист, спрашивающий, не сделала ли флагманская модель, только что поглотившая его продуктовую категорию, его избыточным.

Короткий ответ — нет, но причина интереснее, чем «Codex по-прежнему хорош». GPT-5 Codex остаётся доступным в API по цене $1,25 за миллион входных токенов и $10 за миллион выходных: это специализированный агент для разработки ПО, оптимизированный для автоматизации CLI, IDE и GitHub, с независимо измеренными показателями. GPT-5.6 Sol стоит в четыре раза дороже на входе и в три раза дороже на выходе ($5 / $30) и является новейшим универсальным флагманом с более высокими — но в основном заявленными производителем — показателями в программировании. На самом деле выбор в этой паре сводится к цене, контексту и разнице между специалистом и универсалом, который хорошо пишет код. Всё ниже помечено по источникам.

Что представляет собой каждая модель

GPT-5 Codex — это ровно то, что указано на его странице модели: «специализированная версия GPT-5, оптимизированная для разработки программного обеспечения и рабочих процессов написания кода». Выпущенная в сентябре 2025 года, она является API-моделью, стоящей за кодинг-агентом OpenAI, — той самой, которая создаёт проекты с нуля, реализует новые функции, проводит масштабный рефакторинг, ревьюит код и планирует изменения в нескольких файлах с регулируемым параметром глубины рассуждений. Она принимает на вход текст и изображения (скриншоты для работы с UI), имеет контекст на 400K токенов и потолок вывода в 128K токенов и явно нацелена на агентные сценарии кодинга: CLI, расширения для IDE, GitHub и облачные задачи.

GPT-5.6 Sol — флагманский уровень серии GPT-5.6, выпущенный 9 июля 2026 года с датой отсечения знаний по февраль 2026 года. Это модель, которой OpenAI доверяет самую сложную общую работу: глубокое многошаговое рассуждение, масштабную разработку программного обеспечения, долгосрочных агентов, использование компьютера и мультиагентный режим рассуждений «ultra». Её контекст составляет 1,05 млн токенов — в 2,6 раза больше, чем у GPT-5 Codex, — с тем же потолком вывода в 128K, и она принимает на вход текст, изображения и файлы. Sol также работает внутри ChatGPT, поэтому когда OpenAI сегодня говорит о «Codex» в продуктовом смысле, обычно это означает, что Sol выполняет агентную разработку кода.

Цена: разрыв 4x / 3x, который сужается, но никогда не закрывается.

Ключевые цифры, обе рассчитаны по прейскурантной цене провайдера: GPT-5 Codex — $1.25 / $10 за миллион токенов (чтение из кэша — $0.125); GPT-5.6 Sol — $5 / $30 (чтение из кэша — $0.50). Это в четыре раза выше входной цены и в три раза выше выходной. В обычный день программирования с десятью миллионами токенов при соотношении ввода/вывода 75/25 GPT-5 Codex обходится примерно в $34, а GPT-5.6 Sol — примерно в $112. Разрыв не теоретический.

Два обстоятельства сужают этот разрыв. Во-первых, кэширование: обе модели оценивают кэшированный вход гораздо дешевле свежего, а циклы агента постоянно перечитывают один и тот же контекст репозитория, поэтому большая доля токенов может попадать в дешёвый тариф. Во-вторых, эффективность: O​penAI утверждает, что поколение 5.6 выполняет агентские задачи примерно на 54% меньшим числом выходных токенов, чем предыдущее поколение. Если Sol'у нужно вдвое меньше выходных токенов для той же работы, разрыв в стоимости одной задачи сокращается примерно с 3.3x до примерно 2x — реальная экономия, но она не устраняет четырёхкратную разницу в цене входных токенов, а заявление об эффективности исходит от O​penAI, а не из независимых измерений.

Sol также использует многоуровневую цену на входные данные: на странице модели OrcaRouter базовая ставка $5 / $30 применяется к запросам до 32K входных токенов, а более крупные запросы тарифицируются по верхней ставке $10 / $45. Это и есть налог за длинный контекст — именно такие запросы отправляет агент, работающий с большим репозиторием. Так что практическое сравнение цен ещё сильнее зависит от рабочей нагрузки, чем предполагает заголовок о разнице в 3–4 раза.

The OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the flagship description, $5.00 input / $30.00 output per 1M tokens, the 1.05M-token context window, and seven-day telemetry (p50 TTFT 3.82s, ~465 tok/s, 39.0M tokens/7d).

Контекст и как вы их называете

Разрыв в контексте — второй реальный водораздел. 400K токенов охватывают значительную кодовую базу, а Codex, будучи специалистом, был создан для эффективной работы в этом окне. Но контекст Sol в 1,05 млн токенов меняет то, что можно передать модели: целый монорепозиторий, длинные трассировки агента, онбординг-вики плюс код. Для команд, которые передают целые репозитории одним запросом, большее окно — это разница между «модель может видеть нужные файлы» и «модель может видеть нужные файлы плюс всё, что их импортирует». Это также разница между входным токеном за $1,25 и за $5, и именно поэтому решение о контексте — это решение о стоимости.

Обе модели используют одни и те же две формы API — O​penAI Chat Completions и Responses API — и обе поддерживают вызов инструментов/функций и структурированные выходные данные. На OrcaRouter обе находятся за одной конечной точкой, совместимой с O​penAI, поэтому переключение между ними — это изменение имени модели, а не изменение интеграции.

Где расходятся бенчмарки — и примечание о честности

Интересная цифра в том, что у двух моделей почти нет общих бенчмарков. У GPT-5 Codex есть по-настоящему независимые результаты: Artificial Analysis оценивает его по индексу интеллекта в 36,1 и индексу кодирования в 38,9, при этом математический индекс — 98,7, LiveCodeBench — 84,0, а SWE-Bench Verified — 74,5 процента. Флагманские показатели GPT-5.6 Sol — Terminal-Bench 2.1 на уровне 88,8, индекс Coding Agent от Artificial Analysis на уровне 80 при максимальном рассуждении, Agents' Last Exam — 53,6 — это те, что O​penAI опубликовала при запуске, и они не были воспроизведены независимым оценщиком. «88,8 против 84,0» — нечестное сравнение, потому что одно из этих чисел проверено независимым аудитом, а другое — заявление вендора. Честный вывод: Sol на поколение новее, и его потолок явно выше, но единственный показатель кодирования, который у любой из этих моделей подтверждён независимой лабораторией, принадлежит более дешёвой и старой специализированной модели.

Comparison scoreboard for GPT-5 Codex vs GPT-5.6 Sol. Left column GPT-5 Codex: Input price $1.25/1M, Output price $10.00/1M, Context 400K, Released Sep 2025, Coding bench LiveCodeBench 84.0, Cache read $0.125. Right column GPT-5.6 Sol: Input price $5.00/1M, Output price $30.00/1M, Context 1.05M, Released Jul 2026, Coding bench Terminal-Bench 2.1 88.8, Cache read $0.50. Footer: 'Codex figures per Artificial Analysis; Sol figures OpenAI-reported.' OrcaRouter logo composited bottom-right.

Есть также бенчмарк, который оспаривает сама O​penAI. На SWE-Bench Pro GPT-5.6 Sol набирает 64.6 процента, тогда как Claude Fable 5 лидирует с результатом 80 — и O​penAI публично поставила под сомнение достоверность этого бенчмарка. В данном случае интересен не сам результат, а тот факт, что ведущий вендор теперь утверждает, будто в его низкой оценке виноват сам бенчмарк. Для команды разработчиков это напоминание: тестируйте модель на своём репозитории, прежде чем доверять любому рейтингу, включая наш.

Скорость: предостережение о трафике

На семидневной телеметрии OrcaRouter GPT-5.6 Sol показывает медианное время до первого токена 3,82 секунды и около 465 выходных токенов в секунду при трафике в 39 миллионов токенов. Страница GPT-5 Codex всё ещё «собирает» телеметрию — её трафик через роутер слишком мал, чтобы было что усреднять. Этот малый трафик сам по себе информация: в глазах рынка работа API для кодинг-агентов уже перешла на более новые модели. Это не значит, что GPT-5 Codex медленный или сломан; это значит, что ответ на вопрос «что быстрее» нельзя получить из данных роутера, пока кто-нибудь не прогонит через него реальный объём.

Какой вам выбрать?

Выберите GPT-5 Codex, если…

Ваша рабочая нагрузка действительно имеет форму кодинга: вы запускаете агента, который редактирует код, ревьюит пул-реквесты, рефакторит, пишет тесты и работает внутри IDE или CLI-окружения. Вам нужна сосредоточенность специалиста, в четыре раза более дешёвый вход и единственный независимо проверенный результат по кодингу в этом сравнении. GPT-5 Codex — также правильный выбор, если вам нужна семантика агентного кодера от OpenAI — регулятор усилий рассуждения, цикл использования инструментов — без переплаты за флагманские цены за общую функциональность, которая вам не понадобится.

Выберите GPT-5.6 Sol, если…

Ваша работа сочетает программирование со сложными общими рассуждениями, агентами с длинным горизонтом, использованием компьютера или большим количеством файлов на входе — или вам просто нужен один флагман для всего. Контекст 1.05M, мультиагентный ультра-режим, более новое обучение и интеграция с продуктами ChatGPT и Codex — всё говорит в пользу Sol. Его показатели в программировании выше на бумаге, и на бенчмарке, в который верит вендор, это лучший кодинг-агент, который когда-либо выпускала O​penAI. Вы платите в три-четыре раза больше за токен ради этой широты; история с эффективностью токенов сокращает разрыв на задачах, где Sol действительно выигрывает.

Часто ответ — и то и другое: маршрутизация по задаче

Поскольку обе модели доступны на OrcaRouter с нулевой наценкой, самая мощная связка вообще не оставляет выбора. Направляйте объём задач по написанию кода на GPT-5 Codex — специалиста за $1.25 / $10 — и эскалируйте до GPT-5.6 Sol за $5 / $30 только те задачи, которым нужна флагманская широта охвата. Один API-ключ, один совместимый с O​penAI эндпоинт, смена имени модели при маршрутизации и автоматический failover, если у провайдера выдался неудачный час. Сквозное ценообразование важно здесь в особом смысле: $1.25 / $10 и $5 / $30, которые вы закладываете в бюджет, — это прейскурантные цены провайдеров, поэтому будущее снижение цен O​penAI вступает в силу на нашем эндпоинте в тот же день, когда оно объявлено, и ваша логика маршрутизации не требует изменений.

The OrcaRouter model page for GPT-5 Codex (openai/gpt-5-codex), showing the $1.25 input / $10.00 output per 1M pricing, the 400K-token context window, the description of the specialized software-engineering model, and 'Collecting...' telemetry placeholders on thin traffic.

Вопросы, которые это вызывает

Заменил ли GPT-5.6 Sol GPT-5 Codex?

В продукте — да: отдельное приложение Codex было объединено с ChatGPT при запуске версии 5.6, и Sol — это движок, который управляет режимом coding-agent. В API — нет: GPT-5 Codex по-прежнему является активной обслуживаемой моделью с собственной ценой, и многие агентные пайплайны продолжают её использовать, потому что она специализированная и недорогая.

Действительно ли код, написанный Sol, лучше, чем у Codex?

Судя по цифрам, опубликованным OpenAI, — да: Terminal-Bench 2.1 показывает 88,8 против 84,0 у Codex на LiveCodeBench, — но это разные бенчмарки, и показатели Sol указаны вендором, тогда как Codex измерены независимо. Протестируйте на своём репозитории; только этот результат имеет значение.

Зачем кому-то вообще ещё запускать GPT-5 Codex?

Цена и соответствие. За четверть входной цены Sol специализированный пайплайн для кодинг-агента, которому никогда не нужна широта универсального флагмана, экономит реальные деньги на каждом миллионе токенов, а сфокусированность специалиста означает меньшую необходимость в настройке промптов, чтобы удерживать его на задачах кодинга.

Это сопоставление стоит обдумать, потому что O​penAI встроила ответ в собственный продукт. Компания год продавала специалиста по коду, а затем поглотила его флагманским продуктом общего назначения, который пишет код достаточно хорошо, чтобы забрать корону у специалиста — при этом оставив специалиста в API за небольшую долю цены. Это не трюк; это нижний предел цены для тех, кто хочет «кодинг-агента, не платя за флагман». GPT-5 Codex — это дешёвый, узкоспециализированный и независимо оценённый специалист. GPT-5.6 Sol — это более новый, более широкий и более дорогой флагман, чьи заявления о возможностях кодинга стоит проверить на собственных задачах. Большинство продакшн-команд обнаружат, что честный ответ — оба; и поскольку оба доступны через одну сквозную конечную точку, маршрутизация между ними — это конфигурация, а не миграция.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube