
GPT-6 против Claude Opus 5: обе стороны этого противостояния уже заменены
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Самое полезное, что стоит знать о GPT-6 в сравнении с Claude Opus 5 — это то, что обе стороны этого противостояния отстают на одно поколение от собственных производителей. Claude Opus 5 вышел 24 июля 2026 года и был заменён на Claude Opus 5.5 22 сентября. GPT-6 Sol вышел 22 сентября и был заменён на GPT-6.1 Sol 29 сентября. Если вы искали это сравнение, потому что выбираете между ними для новой работы, вы выбираете между двумя моделями, которые каждый производитель уже перерос, — а честная версия этой статьи о том, когда более старая пара всё ещё остаётся правильным выбором, а не о том, кто побеждает.
Что на самом деле представляют собой эти две модели
Claude Opus 5 был флагманской моделью Anthropic: контекстное окно на 1 000 000 токенов, максимальный объём вывода 128 000 токенов, ввод текста, изображений и файлов, цена — $5.00 за миллион входных токенов и $25.00 за миллион выходных токенов, при этом ставка за кэшированный ввод составляет $0.50, а за запись в кэш — $10.00. Это единая модель с одним идентификатором, anthropic/claude-opus-5.
GPT-6 Sol — средний уровень поколения из трёх моделей — GPT-6 Astra выше него, а GPT-6 Luna ниже него — с тем же контекстом более чем в 1 000 000 токенов (в каталоге указано 1 050 000 для стороны OpenAI против 1 000 000 у Opus 5), тем же потолком вывода в 128 000 токенов и тем же вводом текста/изображений/файлов. Его цена указана как $2.00 / $10.00 при ставке $0.20 за кэшированный ввод и $2.50 за запись в кэш. В его тарифной карте есть ступень, которой нет в карте Anthropic: любой запрос, превышающий 272 000 входных токенов, пересчитывает весь запрос по цене $4.00 / $15.00.
Это 2,5-кратный разрыв в цене за токен в пользу Sol на коротких контекстах, и на кэше разрыв тоже сохраняется — 90%-ная скидка на кэшированный ввод у Sol против 98%-ной скидки у Opus 5, что сужает разницу до $0.20 против $0.50 за миллион, а не устраняет её. При нагрузке с длинным контекстом разрыв сокращается вдвое, а не исчезает.
• Ввод — GPT-6 Sol $2,00 за миллион против Claude Opus 5 $5,00
• Вывод — GPT-6 Sol $10,00 за миллион против Claude Opus 5 $25,00
• Кэшированный ввод — GPT-6 Sol $0,20 за миллион против Claude Opus 5 $0,50
• Запись в кэш — GPT-6 Sol $2,50 за миллион против Claude Opus 5 $10,00
• При вводе свыше 272K — GPT-6 Sol пересчитывает стоимость всего запроса по $4,00 / $15,00; аналогичного шага на карточке Opus 5 нет
• Контекст и вывод — 1 050 000 на входе и 128 000 на выходе против 1 000 000 на входе и 128 000 на выходе
Независимый совет, где разрыв больше цены
По цене GPT-6 Sol выигрывает в 2,5 раза. А на табло преимущество Claude Opus 5 больше, чем можно было бы предположить по разнице в цене, — и это противоположно обычной истории о дешёвой модели.
• AA Intelligence Index — Claude Opus 5 50.8, занимает 11-е место; GPT-6 Sol 47.6, занимает 14-е место
• AA Coding Index — Claude Opus 5 78.0, занимает 2-е место в этом рейтинге; GPT-6 Sol 60.0
• GPQA Diamond — Claude Opus 5 93.2
• Humanity's Last Exam — Claude Opus 5 54.9 против GPT-6 Sol 47.9
• Terminal-Bench 2.1 — Claude Opus 5 89.1
• Terminal-Bench 4.0 — Claude Opus 5 49.0 против GPT-6 Sol 43.9
• τ-bench banking — Claude Opus 5 42.1
• SciCode — Claude Opus 5 56.4 против GPT-6 Sol 57.6
• Long-context recall — Claude Opus 5 79.3 против GPT-6 Sol 83.7
Две строки выбиваются в другую сторону, и о них стоит сказать отдельно, потому что сводный показатель их скрывает. GPT-6 Sol опережает Opus 5 по recall на длинном контекстена 4,4 балла и с минимальным перевесом обходит его по SciCodeна 1,2. Так что честная картина — не «Opus 5 лучше во всём», а то, что Opus 5 решительно впереди в таблицах по кодингу и агентным задачам (преимущество в 24 балла по Coding Index — это результат иного класса), тогда как Sol удерживает строку извлечения по длинному окну и делит первенство по одному из двух показателей научного кода.
Одна методологическая оговорка, прежде чем любую из этих двух цифр где-либо ещё процитируют: Artificial Analysis не гарантирует, что две страницы моделей отображаются на основе одной и той же версии индекса в один и тот же день, и она разделяет свои группы сравнения — модели с открытыми весами ранжируются против других моделей с открытыми весами того же класса размера, проприетарные модели — в пределах проприетарного ценового диапазона. Обе модели здесь проприетарные, так что обе цифры происходят с одной и той же стороны этой границы, но относитесь к различиям меньше балла как к указанию направления, а не как к контролируемому измерению. Каждая цифра от вендора в этом материале — это результат бенчмарка, который вендор провёл для своей собственной модели против своей же предыдущей модели, и она обозначена как таковая.
Что изменили две замены
Claude Opus 5.5 появилась 22 сентября по цене $4.00 / $20.00 — дешевле, чем Opus 5, по обоим тарифам, со ставкой $0.20 за кэшированный ввод, совпадающей с Sol, — и набирает 57.6 балла в том же Intelligence Index. Это на 6.8 балла выше, чем у Opus 5, при затратах на 20% меньше. Любой аргумент в пользу сохранения Opus 5 в новой сборке должен объяснить, почему ради того, чтобы остаться на более старой версии, стоит жертвовать 6.8 баллами индекса и доплачивать $1.00/$5.00 за миллион.
GPT-6.1 Sol вышел 29 сентября по той же цене $2.00 / $10.00, что и GPT-6 Sol, набрав 51,8 балла в индексе против 47,6 у Sol, при ставке $0,10 за кэшированный ввод, что вдвое снижает стоимость чтения из кэша. Это та же цена при лучшем результате и лучшей экономике кэширования. Единственный довод именно в пользу GPT-6 Sol — тот же, что применим и к Opus 5: набор регрессионных тестов, базовые показатели для которого снимались на нём, а смена модели обесценивает сравнения, которым вы уже доверяете.
Есть вторая, более тихая причина, по которой команда остаётся на старой паре, и дело не в бенчмарках. Оба этих варианта — это чекпоинты с самой длинной историей продакшена за ними. Opus 5 доступен для вызова с 24 июля, а GPT-6 Sol — с 22 сентября, и измерения независимого оценщика по обоим идут достаточно долго, чтобы показать форму, а не единичное значение. Объём трафика Sol за последние семь дней по нашим собственным данным маршрутизации составляет около 2,1 млн токенов; у Opus 5 — около 23,0 млн. Это скользящее окно, а не общий итог за всё время, и оно меняется между замерами — но это напоминание о том, что Opus 5 всё ещё выполняет реальную работу в продакшене даже после того, как вышла его замена.
Форма задержки и стоимости — вот где Sol оправдывает себя.
• Медианное время до первого токена — GPT-6 Sol 6 785 мс против Claude Opus 5 4 652 мс
• Медианная скорость вывода — GPT-6 Sol 179,6 токенов/с против Claude Opus 5 82,2 токенов/с
• Наблюдаемый нами трафик за семь дней — GPT-6 Sol ~2,1 млн токенов, Claude Opus 5 ~23,0 млн токенов
Sol выдаёт первый токен примерно через 2,1 секунды, но затем стримит более чем вдвое быстрее Opus 5. При долгой генерации — таком запуске, когда на выходе тысячи токенов, а не десятки, — решающее значение приобретает второе число, и дешёвая модель, которая завершает работу раньше, стоит больше, чем можно предположить по её прайс-листу. В коротком запросе, чувствительном к задержке, пользователь ощущает именно показатель времени до первого токена.
Оба этих показателя — это измерения обслуживания из нашей собственной маршрутизации, снятые за скользящее семидневное окно, и они меняются от замера к замеру. Они полезны для сравнения формы двух моделей, а не для того, чтобы ссылаться на них как на ожидаемый уровень обслуживания.

Эксплуатация пары, пока миграция не решена
Причина, по которой на это сравнение вообще стоит отвечать, в том, что ни одна из замен не является простой подстановкой. Если ваши оценки строились на Claude Opus 5, переход на Opus 5.5 — это пересмотр базовой линии, а не обновление; то же самое верно для GPT-6 Sol по сравнению с GPT-6.1 Sol. Полезнее всего в этот период — запустить оба поколения параллельно на своём трафике, а не выбирать по чужой таблице.
Все четыре модели находятся в одном каталоге на OrcaRouter — Claude Opus 5, Claude Opus 5.5, GPT-6 Sol и GPT-6.1 Sol, доступные через один API перед более чем 200 моделями, причём цена из прайс-листа провайдера передаётся с наценкой 0%, так что снижение цены вендором отражается здесь в тот же день, а не при вашей следующей сверке, — что превращает сравнение в вопрос маршрутизации, а не закупки. DSL маршрутизации позволяет разделять трафик по размеру запроса или по доле: направьте часть продакшен-трафика на более свежий чекпоинт, сравните его с базовым уровнем на собственных оценках, расширяйте долю, когда показатели это подтверждают, и оставляйте более старую модель в качестве резервной, пока этого не произойдёт. Автоматическое переключение при сбое между провайдерами покрывает случай, когда маршрут деградирует в середине миграции, — именно тот сценарий отказа, из-за которого люди бросают миграцию на полпути.


Кому что следует выбрать, учитывая, что оба устарели?
Если вы начинаете что-то новое: ни то, ни другое. Claude Opus 5.5 дешевле Claude Opus 5 и набирает на 6,8 балла больше, а GPT-6.1 Sol стоит столько же, сколько GPT-6 Sol, при лучшем индексе и вдвое меньшей стоимости чтения из кэша. Единственная причина начинать с более старой пары — жёсткая зависимость от чекпоинта, который вы не можете изменить.
Если вы уже используете одну из них: решение касается вашего набора регрессионных тестов, а не лидербордов. Claude Opus 5 остаётся более сильной моделью для кодинга и агентных задач из этих двух с большим отрывом, поэтому конвейер для кодинга, стабильно работающий на ней, следует сравнивать с Opus 5.5, а не мигрировать вбок на уровень GPT-6. Высоконагруженный, чувствительный к стоимости конвейер на GPT-6 Sol имеет более простой апгрейд — та же цена, лучший результат, лучший кэш — и честная причина отложить его только в том, что вы ещё не перезапустили свои оценки.
А если вам просто нужен ответ на вопрос, кто из двух побеждает: это Claude Opus 5 — почти во всех дисциплинах, за 2,5-кратную цену. Аргумент GPT-6 Sol никогда не сводился к тому, что он лучше. Он сводился к тому, что он достаточно дёшев, чтобы оправдать разницу, — и теперь этот аргумент принадлежит GPT-6.1 Sol по той же цене, но с лучшим результатом.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
