
GPT-5 Codex против GPT-5.6 Sol: специалист по коду против флагмана, который его поглотил
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0259Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0258Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0166Интеллект82Кодинг
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
Когда OpenAI выпустила семейство GPT-5.6 9 июля 2026 года, она тихо упразднила отдельное приложение Codex и встроила режим агента-кодера в ChatGPT. Страница модели, подготовленная OpenAI для GPT-5.6 Sol, затем читалась как должностная инструкция, взятая у специалиста по программированию, — «глубокие многошаговые рассуждения, крупномасштабная разработка ПО и долгосрочные агентские рабочие процессы». Так что противостояние между GPT-5 Codex и GPT-5.6 Sol — это не обычная битва характеристик. Это специалист, спрашивающий, не сделала ли флагманская модель, только что поглотившая его продуктовую категорию, его избыточным.
Короткий ответ — нет, но причина интереснее, чем «Codex по-прежнему хорош». GPT-5 Codex остаётся доступным в API по цене $1,25 за миллион входных токенов и $10 за миллион выходных: это специализированный агент для разработки ПО, оптимизированный для автоматизации CLI, IDE и GitHub, с независимо измеренными показателями. GPT-5.6 Sol стоит в четыре раза дороже на входе и в три раза дороже на выходе ($5 / $30) и является новейшим универсальным флагманом с более высокими — но в основном заявленными производителем — показателями в программировании. На самом деле выбор в этой паре сводится к цене, контексту и разнице между специалистом и универсалом, который хорошо пишет код. Всё ниже помечено по источникам.
Что представляет собой каждая модель
GPT-5 Codex — это ровно то, что указано на его странице модели: «специализированная версия GPT-5, оптимизированная для разработки программного обеспечения и рабочих процессов написания кода». Выпущенная в сентябре 2025 года, она является API-моделью, стоящей за кодинг-агентом OpenAI, — той самой, которая создаёт проекты с нуля, реализует новые функции, проводит масштабный рефакторинг, ревьюит код и планирует изменения в нескольких файлах с регулируемым параметром глубины рассуждений. Она принимает на вход текст и изображения (скриншоты для работы с UI), имеет контекст на 400K токенов и потолок вывода в 128K токенов и явно нацелена на агентные сценарии кодинга: CLI, расширения для IDE, GitHub и облачные задачи.
GPT-5.6 Sol — флагманский уровень серии GPT-5.6, выпущенный 9 июля 2026 года с датой отсечения знаний по февраль 2026 года. Это модель, которой OpenAI доверяет самую сложную общую работу: глубокое многошаговое рассуждение, масштабную разработку программного обеспечения, долгосрочных агентов, использование компьютера и мультиагентный режим рассуждений «ultra». Её контекст составляет 1,05 млн токенов — в 2,6 раза больше, чем у GPT-5 Codex, — с тем же потолком вывода в 128K, и она принимает на вход текст, изображения и файлы. Sol также работает внутри ChatGPT, поэтому когда OpenAI сегодня говорит о «Codex» в продуктовом смысле, обычно это означает, что Sol выполняет агентную разработку кода.
Цена: разрыв 4x / 3x, который сужается, но никогда не закрывается.
Ключевые цифры, обе рассчитаны по прейскурантной цене провайдера: GPT-5 Codex — $1.25 / $10 за миллион токенов (чтение из кэша — $0.125); GPT-5.6 Sol — $5 / $30 (чтение из кэша — $0.50). Это в четыре раза выше входной цены и в три раза выше выходной. В обычный день программирования с десятью миллионами токенов при соотношении ввода/вывода 75/25 GPT-5 Codex обходится примерно в $34, а GPT-5.6 Sol — примерно в $112. Разрыв не теоретический.
Два обстоятельства сужают этот разрыв. Во-первых, кэширование: обе модели оценивают кэшированный вход гораздо дешевле свежего, а циклы агента постоянно перечитывают один и тот же контекст репозитория, поэтому большая доля токенов может попадать в дешёвый тариф. Во-вторых, эффективность: OpenAI утверждает, что поколение 5.6 выполняет агентские задачи примерно на 54% меньшим числом выходных токенов, чем предыдущее поколение. Если Sol'у нужно вдвое меньше выходных токенов для той же работы, разрыв в стоимости одной задачи сокращается примерно с 3.3x до примерно 2x — реальная экономия, но она не устраняет четырёхкратную разницу в цене входных токенов, а заявление об эффективности исходит от OpenAI, а не из независимых измерений.
Sol также использует многоуровневую цену на входные данные: на странице модели OrcaRouter базовая ставка $5 / $30 применяется к запросам до 32K входных токенов, а более крупные запросы тарифицируются по верхней ставке $10 / $45. Это и есть налог за длинный контекст — именно такие запросы отправляет агент, работающий с большим репозиторием. Так что практическое сравнение цен ещё сильнее зависит от рабочей нагрузки, чем предполагает заголовок о разнице в 3–4 раза.

Контекст и как вы их называете
Разрыв в контексте — второй реальный водораздел. 400K токенов охватывают значительную кодовую базу, а Codex, будучи специалистом, был создан для эффективной работы в этом окне. Но контекст Sol в 1,05 млн токенов меняет то, что можно передать модели: целый монорепозиторий, длинные трассировки агента, онбординг-вики плюс код. Для команд, которые передают целые репозитории одним запросом, большее окно — это разница между «модель может видеть нужные файлы» и «модель может видеть нужные файлы плюс всё, что их импортирует». Это также разница между входным токеном за $1,25 и за $5, и именно поэтому решение о контексте — это решение о стоимости.
Обе модели используют одни и те же две формы API — OpenAI Chat Completions и Responses API — и обе поддерживают вызов инструментов/функций и структурированные выходные данные. На OrcaRouter обе находятся за одной конечной точкой, совместимой с OpenAI, поэтому переключение между ними — это изменение имени модели, а не изменение интеграции.
Где расходятся бенчмарки — и примечание о честности
Интересная цифра в том, что у двух моделей почти нет общих бенчмарков. У GPT-5 Codex есть по-настоящему независимые результаты: Artificial Analysis оценивает его по индексу интеллекта в 36,1 и индексу кодирования в 38,9, при этом математический индекс — 98,7, LiveCodeBench — 84,0, а SWE-Bench Verified — 74,5 процента. Флагманские показатели GPT-5.6 Sol — Terminal-Bench 2.1 на уровне 88,8, индекс Coding Agent от Artificial Analysis на уровне 80 при максимальном рассуждении, Agents' Last Exam — 53,6 — это те, что OpenAI опубликовала при запуске, и они не были воспроизведены независимым оценщиком. «88,8 против 84,0» — нечестное сравнение, потому что одно из этих чисел проверено независимым аудитом, а другое — заявление вендора. Честный вывод: Sol на поколение новее, и его потолок явно выше, но единственный показатель кодирования, который у любой из этих моделей подтверждён независимой лабораторией, принадлежит более дешёвой и старой специализированной модели.

Есть также бенчмарк, который оспаривает сама OpenAI. На SWE-Bench Pro GPT-5.6 Sol набирает 64.6 процента, тогда как Claude Fable 5 лидирует с результатом 80 — и OpenAI публично поставила под сомнение достоверность этого бенчмарка. В данном случае интересен не сам результат, а тот факт, что ведущий вендор теперь утверждает, будто в его низкой оценке виноват сам бенчмарк. Для команды разработчиков это напоминание: тестируйте модель на своём репозитории, прежде чем доверять любому рейтингу, включая наш.
Скорость: предостережение о трафике
На семидневной телеметрии OrcaRouter GPT-5.6 Sol показывает медианное время до первого токена 3,82 секунды и около 465 выходных токенов в секунду при трафике в 39 миллионов токенов. Страница GPT-5 Codex всё ещё «собирает» телеметрию — её трафик через роутер слишком мал, чтобы было что усреднять. Этот малый трафик сам по себе информация: в глазах рынка работа API для кодинг-агентов уже перешла на более новые модели. Это не значит, что GPT-5 Codex медленный или сломан; это значит, что ответ на вопрос «что быстрее» нельзя получить из данных роутера, пока кто-нибудь не прогонит через него реальный объём.
Какой вам выбрать?
Выберите GPT-5 Codex, если…
Ваша рабочая нагрузка действительно имеет форму кодинга: вы запускаете агента, который редактирует код, ревьюит пул-реквесты, рефакторит, пишет тесты и работает внутри IDE или CLI-окружения. Вам нужна сосредоточенность специалиста, в четыре раза более дешёвый вход и единственный независимо проверенный результат по кодингу в этом сравнении. GPT-5 Codex — также правильный выбор, если вам нужна семантика агентного кодера от OpenAI — регулятор усилий рассуждения, цикл использования инструментов — без переплаты за флагманские цены за общую функциональность, которая вам не понадобится.
Выберите GPT-5.6 Sol, если…
Ваша работа сочетает программирование со сложными общими рассуждениями, агентами с длинным горизонтом, использованием компьютера или большим количеством файлов на входе — или вам просто нужен один флагман для всего. Контекст 1.05M, мультиагентный ультра-режим, более новое обучение и интеграция с продуктами ChatGPT и Codex — всё говорит в пользу Sol. Его показатели в программировании выше на бумаге, и на бенчмарке, в который верит вендор, это лучший кодинг-агент, который когда-либо выпускала OpenAI. Вы платите в три-четыре раза больше за токен ради этой широты; история с эффективностью токенов сокращает разрыв на задачах, где Sol действительно выигрывает.
Часто ответ — и то и другое: маршрутизация по задаче
Поскольку обе модели доступны на OrcaRouter с нулевой наценкой, самая мощная связка вообще не оставляет выбора. Направляйте объём задач по написанию кода на GPT-5 Codex — специалиста за $1.25 / $10 — и эскалируйте до GPT-5.6 Sol за $5 / $30 только те задачи, которым нужна флагманская широта охвата. Один API-ключ, один совместимый с OpenAI эндпоинт, смена имени модели при маршрутизации и автоматический failover, если у провайдера выдался неудачный час. Сквозное ценообразование важно здесь в особом смысле: $1.25 / $10 и $5 / $30, которые вы закладываете в бюджет, — это прейскурантные цены провайдеров, поэтому будущее снижение цен OpenAI вступает в силу на нашем эндпоинте в тот же день, когда оно объявлено, и ваша логика маршрутизации не требует изменений.

Вопросы, которые это вызывает
Заменил ли GPT-5.6 Sol GPT-5 Codex?
В продукте — да: отдельное приложение Codex было объединено с ChatGPT при запуске версии 5.6, и Sol — это движок, который управляет режимом coding-agent. В API — нет: GPT-5 Codex по-прежнему является активной обслуживаемой моделью с собственной ценой, и многие агентные пайплайны продолжают её использовать, потому что она специализированная и недорогая.
Действительно ли код, написанный Sol, лучше, чем у Codex?
Судя по цифрам, опубликованным OpenAI, — да: Terminal-Bench 2.1 показывает 88,8 против 84,0 у Codex на LiveCodeBench, — но это разные бенчмарки, и показатели Sol указаны вендором, тогда как Codex измерены независимо. Протестируйте на своём репозитории; только этот результат имеет значение.
Зачем кому-то вообще ещё запускать GPT-5 Codex?
Цена и соответствие. За четверть входной цены Sol специализированный пайплайн для кодинг-агента, которому никогда не нужна широта универсального флагмана, экономит реальные деньги на каждом миллионе токенов, а сфокусированность специалиста означает меньшую необходимость в настройке промптов, чтобы удерживать его на задачах кодинга.
Это сопоставление стоит обдумать, потому что OpenAI встроила ответ в собственный продукт. Компания год продавала специалиста по коду, а затем поглотила его флагманским продуктом общего назначения, который пишет код достаточно хорошо, чтобы забрать корону у специалиста — при этом оставив специалиста в API за небольшую долю цены. Это не трюк; это нижний предел цены для тех, кто хочет «кодинг-агента, не платя за флагман». GPT-5 Codex — это дешёвый, узкоспециализированный и независимо оценённый специалист. GPT-5.6 Sol — это более новый, более широкий и более дорогой флагман, чьи заявления о возможностях кодинга стоит проверить на собственных задачах. Большинство продакшн-команд обнаружат, что честный ответ — оба; и поскольку оба доступны через одну сквозную конечную точку, маршрутизация между ними — это конфигурация, а не миграция.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
