Сгенерированная титульная карточка с надписью «GPT-6 против Claude Opus 5», чип с надписью «Opus 5 заменён на Claude Opus 5.5, 22 сентября 2026» и чип с надписью «GPT-6 Sol заменён на GPT-6.1 Sol, 29 сентября 2026», а также нижний колонтитул с надписью «Обе модели по-прежнему участвуют в маршрутизации; показатели индекса по данным Artificial Analysis». Логотип OrcaRouter наложен в правом нижнем углу.
Guides & Insights

GPT-6 против Claude Opus 5: обе стороны этого противостояния уже заменены

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Самое полезное, что стоит знать о GPT-6 в сравнении с Claude Opus 5 — это то, что обе стороны этого противостояния отстают на одно поколение от собственных производителей. Claude Opus 5 вышел 24 июля 2026 года и был заменён на Claude Opus 5.5 22 сентября. GPT-6 Sol вышел 22 сентября и был заменён на GPT-6.1 Sol 29 сентября. Если вы искали это сравнение, потому что выбираете между ними для новой работы, вы выбираете между двумя моделями, которые каждый производитель уже перерос, — а честная версия этой статьи о том, когда более старая пара всё ещё остаётся правильным выбором, а не о том, кто побеждает.

Что на самом деле представляют собой эти две модели

Claude Opus 5 был флагманской моделью Anthropic: контекстное окно на 1 000 000 токенов, максимальный объём вывода 128 000 токенов, ввод текста, изображений и файлов, цена — $5.00 за миллион входных токенов и $25.00 за миллион выходных токенов, при этом ставка за кэшированный ввод составляет $0.50, а за запись в кэш — $10.00. Это единая модель с одним идентификатором, anthropic/claude-opus-5.

GPT-6 Sol — средний уровень поколения из трёх моделей — GPT-6 Astra выше него, а GPT-6 Luna ниже него — с тем же контекстом более чем в 1 000 000 токенов (в каталоге указано 1 050 000 для стороны OpenAI против 1 000 000 у Opus 5), тем же потолком вывода в 128 000 токенов и тем же вводом текста/изображений/файлов. Его цена указана как $2.00 / $10.00 при ставке $0.20 за кэшированный ввод и $2.50 за запись в кэш. В его тарифной карте есть ступень, которой нет в карте Anthropic: любой запрос, превышающий 272 000 входных токенов, пересчитывает весь запрос по цене $4.00 / $15.00.

Это 2,5-кратный разрыв в цене за токен в пользу Sol на коротких контекстах, и на кэше разрыв тоже сохраняется — 90%-ная скидка на кэшированный ввод у Sol против 98%-ной скидки у Opus 5, что сужает разницу до $0.20 против $0.50 за миллион, а не устраняет её. При нагрузке с длинным контекстом разрыв сокращается вдвое, а не исчезает.

• Ввод — GPT-6 Sol $2,00 за миллион против Claude Opus 5 $5,00
• Вывод — GPT-6 Sol $10,00 за миллион против Claude Opus 5 $25,00
• Кэшированный ввод — GPT-6 Sol $0,20 за миллион против Claude Opus 5 $0,50
• Запись в кэш — GPT-6 Sol $2,50 за миллион против Claude Opus 5 $10,00
• При вводе свыше 272K — GPT-6 Sol пересчитывает стоимость всего запроса по $4,00 / $15,00; аналогичного шага на карточке Opus 5 нет
• Контекст и вывод — 1 050 000 на входе и 128 000 на выходе против 1 000 000 на входе и 128 000 на выходе

Независимый совет, где разрыв больше цены

По цене GPT-6 Sol выигрывает в 2,5 раза. А на табло преимущество Claude Opus 5 больше, чем можно было бы предположить по разнице в цене, — и это противоположно обычной истории о дешёвой модели.

• AA Intelligence Index — Claude Opus 5 50.8, занимает 11-е место; GPT-6 Sol 47.6, занимает 14-е место
• AA Coding Index — Claude Opus 5 78.0, занимает 2-е место в этом рейтинге; GPT-6 Sol 60.0
• GPQA Diamond — Claude Opus 5 93.2
• Humanity's Last Exam — Claude Opus 5 54.9 против GPT-6 Sol 47.9
• Terminal-Bench 2.1 — Claude Opus 5 89.1
• Terminal-Bench 4.0 — Claude Opus 5 49.0 против GPT-6 Sol 43.9
• τ-bench banking — Claude Opus 5 42.1
• SciCode — Claude Opus 5 56.4 против GPT-6 Sol 57.6
• Long-context recall — Claude Opus 5 79.3 против GPT-6 Sol 83.7

Две строки выбиваются в другую сторону, и о них стоит сказать отдельно, потому что сводный показатель их скрывает. GPT-6 Sol опережает Opus 5 по recall на длинном контекстена 4,4 балла и с минимальным перевесом обходит его по SciCodeна 1,2. Так что честная картина — не «Opus 5 лучше во всём», а то, что Opus 5 решительно впереди в таблицах по кодингу и агентным задачам (преимущество в 24 балла по Coding Index — это результат иного класса), тогда как Sol удерживает строку извлечения по длинному окну и делит первенство по одному из двух показателей научного кода.

Одна методологическая оговорка, прежде чем любую из этих двух цифр где-либо ещё процитируют: Artificial Analysis не гарантирует, что две страницы моделей отображаются на основе одной и той же версии индекса в один и тот же день, и она разделяет свои группы сравнения — модели с открытыми весами ранжируются против других моделей с открытыми весами того же класса размера, проприетарные модели — в пределах проприетарного ценового диапазона. Обе модели здесь проприетарные, так что обе цифры происходят с одной и той же стороны этой границы, но относитесь к различиям меньше балла как к указанию направления, а не как к контролируемому измерению. Каждая цифра от вендора в этом материале — это результат бенчмарка, который вендор провёл для своей собственной модели против своей же предыдущей модели, и она обозначена как таковая.

Что изменили две замены

Claude Opus 5.5 появилась 22 сентября по цене $4.00 / $20.00 — дешевле, чем Opus 5, по обоим тарифам, со ставкой $0.20 за кэшированный ввод, совпадающей с Sol, — и набирает 57.6 балла в том же Intelligence Index. Это на 6.8 балла выше, чем у Opus 5, при затратах на 20% меньше. Любой аргумент в пользу сохранения Opus 5 в новой сборке должен объяснить, почему ради того, чтобы остаться на более старой версии, стоит жертвовать 6.8 баллами индекса и доплачивать $1.00/$5.00 за миллион.

GPT-6.1 Sol вышел 29 сентября по той же цене $2.00 / $10.00, что и GPT-6 Sol, набрав 51,8 балла в индексе против 47,6 у Sol, при ставке $0,10 за кэшированный ввод, что вдвое снижает стоимость чтения из кэша. Это та же цена при лучшем результате и лучшей экономике кэширования. Единственный довод именно в пользу GPT-6 Sol — тот же, что применим и к Opus 5: набор регрессионных тестов, базовые показатели для которого снимались на нём, а смена модели обесценивает сравнения, которым вы уже доверяете.

Есть вторая, более тихая причина, по которой команда остаётся на старой паре, и дело не в бенчмарках. Оба этих варианта — это чекпоинты с самой длинной историей продакшена за ними. Opus 5 доступен для вызова с 24 июля, а GPT-6 Sol — с 22 сентября, и измерения независимого оценщика по обоим идут достаточно долго, чтобы показать форму, а не единичное значение. Объём трафика Sol за последние семь дней по нашим собственным данным маршрутизации составляет около 2,1 млн токенов; у Opus 5 — около 23,0 млн. Это скользящее окно, а не общий итог за всё время, и оно меняется между замерами — но это напоминание о том, что Opus 5 всё ещё выполняет реальную работу в продакшене даже после того, как вышла его замена.

Форма задержки и стоимости — вот где Sol оправдывает себя.

• Медианное время до первого токена — GPT-6 Sol 6 785 мс против Claude Opus 5 4 652 мс
• Медианная скорость вывода — GPT-6 Sol 179,6 токенов/с против Claude Opus 5 82,2 токенов/с
• Наблюдаемый нами трафик за семь дней — GPT-6 Sol ~2,1 млн токенов, Claude Opus 5 ~23,0 млн токенов

Sol выдаёт первый токен примерно через 2,1 секунды, но затем стримит более чем вдвое быстрее Opus 5. При долгой генерации — таком запуске, когда на выходе тысячи токенов, а не десятки, — решающее значение приобретает второе число, и дешёвая модель, которая завершает работу раньше, стоит больше, чем можно предположить по её прайс-листу. В коротком запросе, чувствительном к задержке, пользователь ощущает именно показатель времени до первого токена.

Оба этих показателя — это измерения обслуживания из нашей собственной маршрутизации, снятые за скользящее семидневное окно, и они меняются от замера к замеру. Они полезны для сравнения формы двух моделей, а не для того, чтобы ссылаться на них как на ожидаемый уровень обслуживания.

A generated two-column comparison scoreboard titled "GPT-6 Sol vs Claude Opus 5 — the scoreboard". The left column, GPT-6 Sol, reads Input $2.00, Output $10.00, AA Intelligence 47.6, AA Coding 60.0, Long-context recall 83.7, Output speed 180 tok/s. The right column, Claude Opus 5, reads Input $5.00, Output $25.00, AA Intelligence 50.8, AA Coding 78.0, Long-context recall 79.3, Output speed 82 tok/s. A footer line reads "Index figures per Artificial Analysis; serving figures are a rolling seven-day window from OrcaRouter." The OrcaRouter logo is composited in the bottom-right corner.

Эксплуатация пары, пока миграция не решена

Причина, по которой на это сравнение вообще стоит отвечать, в том, что ни одна из замен не является простой подстановкой. Если ваши оценки строились на Claude Opus 5, переход на Opus 5.5 — это пересмотр базовой линии, а не обновление; то же самое верно для GPT-6 Sol по сравнению с GPT-6.1 Sol. Полезнее всего в этот период — запустить оба поколения параллельно на своём трафике, а не выбирать по чужой таблице.

Все четыре модели находятся в одном каталоге на OrcaRouter — Claude Opus 5, Claude Opus 5.5, GPT-6 Sol и GPT-6.1 Sol, доступные через один API перед более чем 200 моделями, причём цена из прайс-листа провайдера передаётся с наценкой 0%, так что снижение цены вендором отражается здесь в тот же день, а не при вашей следующей сверке, — что превращает сравнение в вопрос маршрутизации, а не закупки. DSL маршрутизации позволяет разделять трафик по размеру запроса или по доле: направьте часть продакшен-трафика на более свежий чекпоинт, сравните его с базовым уровнем на собственных оценках, расширяйте долю, когда показатели это подтверждают, и оставляйте более старую модель в качестве резервной, пока этого не произойдёт. Автоматическое переключение при сбое между провайдерами покрывает случай, когда маршрут деградирует в середине миграции, — именно тот сценарий отказа, из-за которого люди бросают миграцию на полпути.

Screenshot of the OrcaRouter model page for anthropic/claude-opus-5, showing the Anthropic vendor label, a 2026-07-24 catalogue release date, a 1M-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $5.00 per million input, $25.00 per million output, a 4.65 s median time to first token, a 10.00 s p95, and 23.0M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-sol, showing the OpenAI vendor label, a 2026-09-22 catalogue release date, a 1,050,000-token context window (shown as 1.05M-token context in the model blurb), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $2.00 per million input, $10.00 per million output, a 6.79 s median time to first token, a 10.00 s p95, and 2.1M tokens routed in seven days.

Кому что следует выбрать, учитывая, что оба устарели?

Если вы начинаете что-то новое: ни то, ни другое. Claude Opus 5.5 дешевле Claude Opus 5 и набирает на 6,8 балла больше, а GPT-6.1 Sol стоит столько же, сколько GPT-6 Sol, при лучшем индексе и вдвое меньшей стоимости чтения из кэша. Единственная причина начинать с более старой пары — жёсткая зависимость от чекпоинта, который вы не можете изменить.

Если вы уже используете одну из них: решение касается вашего набора регрессионных тестов, а не лидербордов. Claude Opus 5 остаётся более сильной моделью для кодинга и агентных задач из этих двух с большим отрывом, поэтому конвейер для кодинга, стабильно работающий на ней, следует сравнивать с Opus 5.5, а не мигрировать вбок на уровень GPT-6. Высоконагруженный, чувствительный к стоимости конвейер на GPT-6 Sol имеет более простой апгрейд — та же цена, лучший результат, лучший кэш — и честная причина отложить его только в том, что вы ещё не перезапустили свои оценки.

А если вам просто нужен ответ на вопрос, кто из двух побеждает: это Claude Opus 5 — почти во всех дисциплинах, за 2,5-кратную цену. Аргумент GPT-6 Sol никогда не сводился к тому, что он лучше. Он сводился к тому, что он достаточно дёшев, чтобы оправдать разницу, — и теперь этот аргумент принадлежит GPT-6.1 Sol по той же цене, но с лучшим результатом.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно