Титульная карточка hero с надписью «GPT-6 Sol Pro vs Claude Opus 5» и подзаголовком «Лестница усилий, которую никто не заносит в таблицу», пара меток из двух столбцов «GPT-6 Sol Pro» / «Claude Opus 5», и строка нижнего колонтитула «Списки поставщиков не проверены; цифры по данным Artificial Analysis.», с настоящим логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

GPT-6 Sol Pro против Claude Opus 5: лестница усилий, которую никто не заносит в таблицу

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

GPT-6 Sol Pro и Claude Opus 5 постоянно сравнивают друг с другом, и почти всегда не с той настройкой. Сравнение, которое циркулирует, — это Claude Opus 5 при максимальном уровне усилий рассуждения против GPT-6 Sol Pro при максимальном уровне усилий рассуждения, что даёт разрыв в три пункта по нейтральному индексу и пятикратную разницу в стоимости. Установите обе модели в конфигурацию, которую их собственные вендоры поставляют по умолчанию, — и помните, что «Pro» в названии первой модели — это конфигурация рассуждения, а не отдельная модель, — и разрыв в три пункта исчезает полностью. Остаётся разница в стоимости, и это единственная часть истории, которая выдерживает столкновение со счётом за продакшен.

Это не трюк подачи. Это прямое следствие двух шкал усилий, которые не откалиброваны друг относительно друга, опубликованных двумя вендорами, которые сравнивают их со старыми моделями друг друга.

Что на самом деле представляют собой эти две модели, до любого сравнения

GPT-6 Sol — модель рассуждений среднего уровня от OpenAI, общедоступная с 22 сентября 2026 года, по цене $2,00 за миллион входных токенов и $10,00 за миллион выходных токенов. В документации OpenAI для разработчиков нет идентификатора модели gpt-6-sol-pro — на странице указана одна запись Sol: контекстное окно на 1 050 000 токенов, максимальный объём входных данных 922 000 токенов, ограничение вывода 128 000 токенов, дата отсечения знаний 20 апреля 2026 года и шкала усилий рассуждения со значениями none, low, medium, high, xhigh и max, где medium используется по умолчанию. «Pro» — это значение режима рассуждений, тот же шаблон псевдонима, который установило поколение GPT-5.6 и который унаследовало это. Запись в стороннем каталоге под названием GPT-5.6 Sol Pro действительно существует и теперь указывает $2,00 и $10,00 — цифры GPT-6 Sol, — что является артефактом именования, а не продуктом.

Claude Opus 5 — это реальная модель от Anthropic с отдельной ценой, общедоступная с 24 июля 2026 года по цене $5.00 за входные и $25.00 за выходные данные за миллион токенов. Её контекстное окно составляет 1 000 000 токенов, ограничение синхронного вывода — 128 000, а собственная шкала усилий — output_config.effort — включает уровни low, medium, high, xhigh и max, причём по умолчанию используется high. Мышление является адаптивным и включено по умолчанию — впервые для семейства Opus.

Ещё один факт, который определяет всё нижесказанное и который не содержит ни одна существующая страница сравнения: в собственной таблице жизненного цикла Anthropic модель Claude Opus 5 указана как Активна (устаревшая), с баннером о миграции, указывающим на Claude Opus 5.5, который стал общедоступным 22 сентября 2026 года по цене $4.00 и $20.00. Стартовые графики OpenAI по-прежнему сравниваются с Opus 5, а не с 5.5. Модель в сравнении — это Opus предыдущего поколения.

Две ценовые линии, построчно

Оба — это списки вендоров: собственные опубликованные цифры OpenAI и Anthropic, передаваемые без изменений платформами, которые их размещают.

• Ввод — GPT-6 Sol $2.00 за миллион токенов против Claude Opus 5 $5.00 за миллион токенов

• Вывод — GPT-6 Sol: $10.00 за миллион токенов против Claude Opus 5: $25.00 за миллион токенов

• Чтение из кэша — GPT-6 Sol: $0,20 за миллион токенов против Claude Opus 5: $0,50 за миллион токенов; в обоих случаях это ровно 10% от тарифа за некэшированный ввод

• Запись в кэш — GPT-6 Sol: $2.50 за миллион токенов при единственном TTL против Claude Opus 5: $6.25 при пятиминутном TTL и $10.00 при часовом TTL; более длительный TTL — это опция, которую OpenAI не предлагает, и именно этот уровень чаще всего случайно указывают в сравнительных таблицах, потому что именно он отображается на карточках в хостируемом каталоге

• Обработка длинного контекста — GPT-6 Sol пересчитывает стоимость запроса, превышающего порог входного контекста, по более высокому тарифу для всего запроса; Claude Opus 5 вообще не взимает надбавку за длинный контекст, поэтому запрос на 900 000 токенов тарифицируется по той же ставке за токен, что и запрос на 9 000 токенов

• Пакетная обработка — GPT-6 Sol имеет пакетный эндпоинт со стандартной скидкой, тогда как Message Batches API от Claude Opus 5 даёт скидку 50% в обоих направлениях, а скидка Anthropic на пакетную обработку суммируется с кэшированием промптов

• Контекстное окно — GPT-6 Sol 1 050 000 токенов против Claude Opus 5 1 000 000 токенов

• Максимальный вывод — 128 000 токенов для обоих, при этом Claude Opus 5 повышает это значение до 300 000 в Message Batches API при использовании бета-заголовка output-300k-2026-03-24

Связка «пакетная обработка + кэширование» — наименее обсуждаемый пункт в этом списке и тот, который сильнее всего меняет расчёты. 50-процентная скидка за пакетную обработку, сочетающаяся с чтением из кэша по цене в одну десятую входного тарифа, — это не то же предложение, что 50-процентная скидка за пакетную обработку сама по себе, а для длительных задач синтеза — где также действует ограничение Anthropic на пакетный вывод в 300 000 токенов — она закрывает значительную часть разрыва, который по цене из прайс-листа кажется непреодолимым.

A two-column scoreboard card titled 'GPT-6 Sol vs Claude Opus 5 - the scoreboard'. Left column 'GPT-6 Sol': AA Index, max effort 48; AA Index, default effort 48; cost per task, max $1.06; cost per task, default $0.37; price in/out $2 / $10; context window 1.05M. Right column 'Claude Opus 5': AA Index, max effort 51; AA Index, default effort 48; cost per task, max $5.86; cost per task, default $3.61; price in/out $5 / $25; context window 1M. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Лестница усилий — это и есть настоящее сравнение.

Вот число, которое должно быть в каждой из этих статей. В Artificial Analysis, чей тестовый стенд — единственный нейтральный, публикующий полную шкалу уровней усилий для обеих моделей, Claude Opus 5 набирает 51 балл при максимальном уровне усилий и стоит $5,86 за индексную задачу. При своём стандартном высоком уровне он набирает 48 баллов и стоит $3,61. GPT-6 Sol набирает 48 баллов при максимальном уровне усилий и стоит $1,06 — а при высоком уровне усилий 43 балла за $0,37.

Прочитайте эти две строки вместе. Claude Opus 5, работающий на той настройке усилия, которую Anthropic поставляет по умолчанию, показывает ровно тот же индексный балл, что и GPT-6 Sol, работающий на пределе. Разрыв, о котором сообщали в материалах о запуске — три пункта — существует только при сравнении каждой модели на максимуме её собственной шкалы, а максимум шкалы — не то, где какая-либо из моделей работает по умолчанию. Преимущество Opus 5 при максимальном усилии реально, и его получение обходится примерно в пять с половиной раз дороже на каждую выполненную задачу.

К этим цифрам следует приложить две оговорки о честности, и обе отсутствуют на страницах, которые их цитируют.

• Версия индекса меняется. Оценка Opus 5 публиковалась как 61, 63, 54 и 51 в последовательных пересмотрах индекса Artificial Analysis с июля. Ни одна из них не является неверной; каждая из них неверна без указания своей версии. Число 51 выше — это текущий рейтинг, и его нельзя сравнивать с 61, процитированным из статьи дня запуска.

• Шкалы усилий не калиброваны между поставщиками. «Высокий» у одной модели — это не тот же объём размышлений, что «высокий» у другой. Совпадающие оценки при номинально разных настройках свидетельствуют о затратах, а не об эквивалентности возможностей.

Там, где независимая запись тоньше, чем кажется

За Claude Opus 5 стоят восемь недель независимых измерений третьими сторонами и набор заявленных производителем стартовых показателей, которые явно обозначены как таковые — Frontier-Bench v0.1 — 43,3%, ARC-AGI-3 — 30,2%, GDPval-AA v2 — 1 861 Elo. Каждый из этих показателей измерялся в сравнении с GPT-5.6 Sol или Claude Fable 5, а не с GPT-6 Sol. Нигде нет результата с общим испытательным стендом, который ставил бы Opus 5 и GPT-6 Sol лицом к лицу на собственных бенчмарках Anthropic, а системная карта Anthropic признаёт, что в целом модель не превосходит Claude Fable 5 по возможностям.

Независимые данные также содержат оговорку противоположного характера. В ходе оценки AA-Omniscience от Artificial Analysis уровень галлюцинаций Opus 5 составляет 50%, что на четырнадцать пунктов выше, чем у Opus 4.8, — задокументированная причина заключается в том, что доля отказов снизилась примерно с 23% до 7%, поэтому модель отвечает на больше вопросов и ошибается в большем числе из них. Vals AI отдельно сообщила, что Opus 5 и Fable 5 использовали Opus 4.8 в качестве резервного варианта на случай отказов во время прогонов Terminal-Bench; если переклассифицировать девять затронутых успешных прохождений как неудачи, показатель Opus 5 сместится с 84,64% до 81,27%. Это не дисквалифицирующие результаты, но материал, утверждающий, что Opus 5 — более надёжный выбор, должен включать их.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens, above the 'Intelligence Index vs Cost to Run Intelligence' scatter chart with the reasoning-models-only filter applied.

Независимый послужной список GPT-6 Sol на этой неделе умещается в одно число: показатель индекса, приведённый выше, измеренный при максимальном усилии, за которым в накопленном стороннем тестировании стоят восемнадцать месяцев выпусков моделей. Эта асимметрия — восемь недель проверки против одного дня — и есть честная причина, по которой покупатель всё ещё может платить пятикратную наценку, и она лучше, чем заголовок о трёх пунктах.

Где слой маршрутизации меняет решение

Claude Opus 5 представлен в каталоге OrcaRouter по цене $5.00 за вход, $25.00 за выход, $0.50 за чтение из кэша и $10.00 за запись в кэш за миллион токенов, с окном в 1,000,000 токенов, ограничением вывода в 128,000 токенов и обоими эндпоинтами /v1/chat/completions и /v1/messages — цены из списка провайдера передаются без наценки сверху, поэтому изменение цены Anthropic применяется у нас в тот же день, когда вступает в силу у них. Показатель записи в кэш в карточке модели — это тариф при TTL в один час; пятиминутный тариф Anthropic — $6.25, и цитирование одного из них без указания, какого именно, — вот почему эти два числа выглядят как противоречие.

GPT-6 Sol не входит в число наших маршрутов, поэтому ничто здесь не является утверждением о его цене через нас.

Screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5), captured 23 September 2026, showing an input price of $5.00 per million tokens, an output price of $25.00 per million tokens, a 1,000,000-token context window, a 128,000-token output cap, reasoning and tools tags, a 'Traffic — Last 7 days' section, and both the /v1/chat/completions and /v1/messages endpoints.

Что единая конечная точка на самом деле даёт в этом противостоянии, так это возможность удерживать оба ответа одновременно. Аргументы в пользу Opus 5 и аргументы в пользу Sol оба зависят от effort, а effort — это параметр отдельного запроса, а не контракт. Команда, которая маршрутизирует обе модели через один ключ с автоматическим переключением при сбое может направлять работу, которой нужен потолок максимального effort у Opus 5, в Opus 5, а уровень для больших объёмов — в Sol при среднем effort, без второй интеграции и второго набора лимитов скорости. DSL маршрутизации встраивает это решение в сам вызов, а не в проект миграции — что здесь особенно важно, потому что правильный ответ для этой пары меняется от запроса к запросу, а не от квартала к кварталу.

Решающее правило

• Объёмная работа при известной планке качества — GPT-6 Sol при среднем или высоком уровне усилий. Сорок индексных пунктов по $0,25 за задачу — это самая дешёвая заслуживающая доверия строка на этом табло, а регулятор усилий — задокументированный параметр, а не догадка.

• Работа, требующая верхней границы диапазона возможностей и способная за это платить, — Claude Opus 5 на xhigh или max. На три индексных пункта выше потолка Sol, при цене от $4,88 до $5,86 за задачу, и единственный из двух с потолком пакетного вывода в 300 000 токенов.

• Массовые пакетные задания на больших корпусах — Claude Opus 5, на основе структурного аргумента, а не аргумента о цене за токен. Никакой надбавки за длинный контекст, скидка за пакетную обработку, которая складывается с кэшированием, и часовой TTL кэша для префиксов, которые переживают пятиминутное окно.

• Всё, где неверный ответ обходится дорого, — ни один из них, судя по текущим данным. У Opus 5 доля галлюцинаций в этом релизе выросла на четырнадцать пунктов, а сторонние данные о Sol ограничиваются одним числом.

• Если показанное вам сравнение было «Opus 5 max против Sol max» — прежде чем принимать решение, перезапустите его с уровнем усилий по умолчанию. Именно там решение фактически и принимается, и это та единственная конфигурация, которую существующее покрытие вам никогда не показывает.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно