
GPT-6 Sol Pro против Claude Opus 5: лестница усилий, которую никто не заносит в таблицу
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
GPT-6 Sol Pro и Claude Opus 5 постоянно сравнивают друг с другом, и почти всегда не с той настройкой. Сравнение, которое циркулирует, — это Claude Opus 5 при максимальном уровне усилий рассуждения против GPT-6 Sol Pro при максимальном уровне усилий рассуждения, что даёт разрыв в три пункта по нейтральному индексу и пятикратную разницу в стоимости. Установите обе модели в конфигурацию, которую их собственные вендоры поставляют по умолчанию, — и помните, что «Pro» в названии первой модели — это конфигурация рассуждения, а не отдельная модель, — и разрыв в три пункта исчезает полностью. Остаётся разница в стоимости, и это единственная часть истории, которая выдерживает столкновение со счётом за продакшен.
Это не трюк подачи. Это прямое следствие двух шкал усилий, которые не откалиброваны друг относительно друга, опубликованных двумя вендорами, которые сравнивают их со старыми моделями друг друга.
Что на самом деле представляют собой эти две модели, до любого сравнения
GPT-6 Sol — модель рассуждений среднего уровня от OpenAI, общедоступная с 22 сентября 2026 года, по цене $2,00 за миллион входных токенов и $10,00 за миллион выходных токенов. В документации OpenAI для разработчиков нет идентификатора модели gpt-6-sol-pro — на странице указана одна запись Sol: контекстное окно на 1 050 000 токенов, максимальный объём входных данных 922 000 токенов, ограничение вывода 128 000 токенов, дата отсечения знаний 20 апреля 2026 года и шкала усилий рассуждения со значениями none, low, medium, high, xhigh и max, где medium используется по умолчанию. «Pro» — это значение режима рассуждений, тот же шаблон псевдонима, который установило поколение GPT-5.6 и который унаследовало это. Запись в стороннем каталоге под названием GPT-5.6 Sol Pro действительно существует и теперь указывает $2,00 и $10,00 — цифры GPT-6 Sol, — что является артефактом именования, а не продуктом.
Claude Opus 5 — это реальная модель от Anthropic с отдельной ценой, общедоступная с 24 июля 2026 года по цене $5.00 за входные и $25.00 за выходные данные за миллион токенов. Её контекстное окно составляет 1 000 000 токенов, ограничение синхронного вывода — 128 000, а собственная шкала усилий — output_config.effort — включает уровни low, medium, high, xhigh и max, причём по умолчанию используется high. Мышление является адаптивным и включено по умолчанию — впервые для семейства Opus.
Ещё один факт, который определяет всё нижесказанное и который не содержит ни одна существующая страница сравнения: в собственной таблице жизненного цикла Anthropic модель Claude Opus 5 указана как Активна (устаревшая), с баннером о миграции, указывающим на Claude Opus 5.5, который стал общедоступным 22 сентября 2026 года по цене $4.00 и $20.00. Стартовые графики OpenAI по-прежнему сравниваются с Opus 5, а не с 5.5. Модель в сравнении — это Opus предыдущего поколения.
Две ценовые линии, построчно
Оба — это списки вендоров: собственные опубликованные цифры OpenAI и Anthropic, передаваемые без изменений платформами, которые их размещают.
• Ввод — GPT-6 Sol $2.00 за миллион токенов против Claude Opus 5 $5.00 за миллион токенов
• Вывод — GPT-6 Sol: $10.00 за миллион токенов против Claude Opus 5: $25.00 за миллион токенов
• Чтение из кэша — GPT-6 Sol: $0,20 за миллион токенов против Claude Opus 5: $0,50 за миллион токенов; в обоих случаях это ровно 10% от тарифа за некэшированный ввод
• Запись в кэш — GPT-6 Sol: $2.50 за миллион токенов при единственном TTL против Claude Opus 5: $6.25 при пятиминутном TTL и $10.00 при часовом TTL; более длительный TTL — это опция, которую OpenAI не предлагает, и именно этот уровень чаще всего случайно указывают в сравнительных таблицах, потому что именно он отображается на карточках в хостируемом каталоге
• Обработка длинного контекста — GPT-6 Sol пересчитывает стоимость запроса, превышающего порог входного контекста, по более высокому тарифу для всего запроса; Claude Opus 5 вообще не взимает надбавку за длинный контекст, поэтому запрос на 900 000 токенов тарифицируется по той же ставке за токен, что и запрос на 9 000 токенов
• Пакетная обработка — GPT-6 Sol имеет пакетный эндпоинт со стандартной скидкой, тогда как Message Batches API от Claude Opus 5 даёт скидку 50% в обоих направлениях, а скидка Anthropic на пакетную обработку суммируется с кэшированием промптов
• Контекстное окно — GPT-6 Sol 1 050 000 токенов против Claude Opus 5 1 000 000 токенов
• Максимальный вывод — 128 000 токенов для обоих, при этом Claude Opus 5 повышает это значение до 300 000 в Message Batches API при использовании бета-заголовка output-300k-2026-03-24
Связка «пакетная обработка + кэширование» — наименее обсуждаемый пункт в этом списке и тот, который сильнее всего меняет расчёты. 50-процентная скидка за пакетную обработку, сочетающаяся с чтением из кэша по цене в одну десятую входного тарифа, — это не то же предложение, что 50-процентная скидка за пакетную обработку сама по себе, а для длительных задач синтеза — где также действует ограничение Anthropic на пакетный вывод в 300 000 токенов — она закрывает значительную часть разрыва, который по цене из прайс-листа кажется непреодолимым.

Лестница усилий — это и есть настоящее сравнение.
Вот число, которое должно быть в каждой из этих статей. В Artificial Analysis, чей тестовый стенд — единственный нейтральный, публикующий полную шкалу уровней усилий для обеих моделей, Claude Opus 5 набирает 51 балл при максимальном уровне усилий и стоит $5,86 за индексную задачу. При своём стандартном высоком уровне он набирает 48 баллов и стоит $3,61. GPT-6 Sol набирает 48 баллов при максимальном уровне усилий и стоит $1,06 — а при высоком уровне усилий 43 балла за $0,37.
Прочитайте эти две строки вместе. Claude Opus 5, работающий на той настройке усилия, которую Anthropic поставляет по умолчанию, показывает ровно тот же индексный балл, что и GPT-6 Sol, работающий на пределе. Разрыв, о котором сообщали в материалах о запуске — три пункта — существует только при сравнении каждой модели на максимуме её собственной шкалы, а максимум шкалы — не то, где какая-либо из моделей работает по умолчанию. Преимущество Opus 5 при максимальном усилии реально, и его получение обходится примерно в пять с половиной раз дороже на каждую выполненную задачу.
К этим цифрам следует приложить две оговорки о честности, и обе отсутствуют на страницах, которые их цитируют.
• Версия индекса меняется. Оценка Opus 5 публиковалась как 61, 63, 54 и 51 в последовательных пересмотрах индекса Artificial Analysis с июля. Ни одна из них не является неверной; каждая из них неверна без указания своей версии. Число 51 выше — это текущий рейтинг, и его нельзя сравнивать с 61, процитированным из статьи дня запуска.
• Шкалы усилий не калиброваны между поставщиками. «Высокий» у одной модели — это не тот же объём размышлений, что «высокий» у другой. Совпадающие оценки при номинально разных настройках свидетельствуют о затратах, а не об эквивалентности возможностей.
Там, где независимая запись тоньше, чем кажется
За Claude Opus 5 стоят восемь недель независимых измерений третьими сторонами и набор заявленных производителем стартовых показателей, которые явно обозначены как таковые — Frontier-Bench v0.1 — 43,3%, ARC-AGI-3 — 30,2%, GDPval-AA v2 — 1 861 Elo. Каждый из этих показателей измерялся в сравнении с GPT-5.6 Sol или Claude Fable 5, а не с GPT-6 Sol. Нигде нет результата с общим испытательным стендом, который ставил бы Opus 5 и GPT-6 Sol лицом к лицу на собственных бенчмарках Anthropic, а системная карта Anthropic признаёт, что в целом модель не превосходит Claude Fable 5 по возможностям.
Независимые данные также содержат оговорку противоположного характера. В ходе оценки AA-Omniscience от Artificial Analysis уровень галлюцинаций Opus 5 составляет 50%, что на четырнадцать пунктов выше, чем у Opus 4.8, — задокументированная причина заключается в том, что доля отказов снизилась примерно с 23% до 7%, поэтому модель отвечает на больше вопросов и ошибается в большем числе из них. Vals AI отдельно сообщила, что Opus 5 и Fable 5 использовали Opus 4.8 в качестве резервного варианта на случай отказов во время прогонов Terminal-Bench; если переклассифицировать девять затронутых успешных прохождений как неудачи, показатель Opus 5 сместится с 84,64% до 81,27%. Это не дисквалифицирующие результаты, но материал, утверждающий, что Opus 5 — более надёжный выбор, должен включать их.

Независимый послужной список GPT-6 Sol на этой неделе умещается в одно число: показатель индекса, приведённый выше, измеренный при максимальном усилии, за которым в накопленном стороннем тестировании стоят восемнадцать месяцев выпусков моделей. Эта асимметрия — восемь недель проверки против одного дня — и есть честная причина, по которой покупатель всё ещё может платить пятикратную наценку, и она лучше, чем заголовок о трёх пунктах.
Где слой маршрутизации меняет решение
Claude Opus 5 представлен в каталоге OrcaRouter по цене $5.00 за вход, $25.00 за выход, $0.50 за чтение из кэша и $10.00 за запись в кэш за миллион токенов, с окном в 1,000,000 токенов, ограничением вывода в 128,000 токенов и обоими эндпоинтами /v1/chat/completions и /v1/messages — цены из списка провайдера передаются без наценки сверху, поэтому изменение цены Anthropic применяется у нас в тот же день, когда вступает в силу у них. Показатель записи в кэш в карточке модели — это тариф при TTL в один час; пятиминутный тариф Anthropic — $6.25, и цитирование одного из них без указания, какого именно, — вот почему эти два числа выглядят как противоречие.
GPT-6 Sol не входит в число наших маршрутов, поэтому ничто здесь не является утверждением о его цене через нас.

Что единая конечная точка на самом деле даёт в этом противостоянии, так это возможность удерживать оба ответа одновременно. Аргументы в пользу Opus 5 и аргументы в пользу Sol оба зависят от effort, а effort — это параметр отдельного запроса, а не контракт. Команда, которая маршрутизирует обе модели через один ключ с автоматическим переключением при сбое может направлять работу, которой нужен потолок максимального effort у Opus 5, в Opus 5, а уровень для больших объёмов — в Sol при среднем effort, без второй интеграции и второго набора лимитов скорости. DSL маршрутизации встраивает это решение в сам вызов, а не в проект миграции — что здесь особенно важно, потому что правильный ответ для этой пары меняется от запроса к запросу, а не от квартала к кварталу.
Решающее правило
• Объёмная работа при известной планке качества — GPT-6 Sol при среднем или высоком уровне усилий. Сорок индексных пунктов по $0,25 за задачу — это самая дешёвая заслуживающая доверия строка на этом табло, а регулятор усилий — задокументированный параметр, а не догадка.
• Работа, требующая верхней границы диапазона возможностей и способная за это платить, — Claude Opus 5 на xhigh или max. На три индексных пункта выше потолка Sol, при цене от $4,88 до $5,86 за задачу, и единственный из двух с потолком пакетного вывода в 300 000 токенов.
• Массовые пакетные задания на больших корпусах — Claude Opus 5, на основе структурного аргумента, а не аргумента о цене за токен. Никакой надбавки за длинный контекст, скидка за пакетную обработку, которая складывается с кэшированием, и часовой TTL кэша для префиксов, которые переживают пятиминутное окно.
• Всё, где неверный ответ обходится дорого, — ни один из них, судя по текущим данным. У Opus 5 доля галлюцинаций в этом релизе выросла на четырнадцать пунктов, а сторонние данные о Sol ограничиваются одним числом.
• Если показанное вам сравнение было «Opus 5 max против Sol max» — прежде чем принимать решение, перезапустите его с уровнем усилий по умолчанию. Именно там решение фактически и принимается, и это та единственная конфигурация, которую существующее покрытие вам никогда не показывает.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
