Hero-карточка с заголовком Claude Sonnet 5.5 vs GPT-6 Sol, подзаголовком «в тарифе за $2 теперь два флагмана», с плашками «та же цена: $2 / $10», «индекс 56 против 47» и «контекст 1M против 1.05M», а в нижнем колонтитуле — ссылка на Artificial Analysis v4.3.2 и цены вендоров.
Guides & Insights

Claude Sonnet 5.5 против GPT-6 Sol: в категории за $2 теперь два флагмана

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Sonnet 5.5 и GPT-6 Sol имеют одинаковую цену — $2 за миллион входных токенов, $10 за миллион выходных токенов — и они появились с разницей в шесть дней в конце сентября 2026 года. Это совпадение — не самое интересное. Интересно то, что когда Artificial Analysis измерила обе модели на своём Intelligence Index v4.3.2, модель Anthro​pic среднего уровня обошла модель, которую Open​AI продаёт как свой флагман: 56 у Claude Sonnet 5.5 против 47 у GPT-6 Sol. В той же ревизии Claude Sonnet 5 — модель, которую заменяет Sonnet 5.5 — находится на отметке 38.

Так что это уже не сравнение дешёвого уровня с дорогим. Это сравнение двух моделей по одной цене, от двух лабораторий, с разрывом в 18 пунктов между моделью Anthropic и её собственным предшественником и разрывом в девять пунктов в пользу Anthropic против топового релиза OpenAI. Всё ниже — попытка выяснить, какие из этих разрывов сохраняются при столкновении с реальной рабочей нагрузкой, а какие из них — артефакт бенчмарка.

Что на самом деле представляет собой каждая модель

Claude Sonnet 5.5 — вторая модель в поколении 5.5 от Anthropic, выпущенная 28 сентября 2026 года, через пять дней после запуска Claude Opus 5.5, на котором её и пообещали. Она носит идентификатор claude-sonnet-5-5 в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry, сохраняет контекстное окно на 1 млн токенов и потолок вывода в 128K, присущие этому уровню, а также в точности сохраняет цены Claude Sonnet 5: $2 за вход, $10 за выход, $0,20 за миллион для чтения из кэша, $2,50 за запись в кэш на пять минут. Она доступна с нулевым хранением данных с первого дня, а обязательство Anthropic по прекращению поддержки действует до 28 сентября 2027 года.

Two-column scoreboard for Claude Sonnet 5.5 and GPT-6 Sol across six rows. Left column Claude Sonnet 5.5: input $2.00 per million, output $10.00 per million, 1M-token context, AA Intelligence Index 56, cost per Index task $7.60, released September 28 2026. Right column GPT-6 Sol: input $2.00 per million, output $10.00 per million up to 272K then $4 / $15, 1,050,000-token context, AA Intelligence Index 47, cost per task not published, released September 22 2026. A footer line reads Index and cost per task per Artificial Analysis v4.3.2; prices per the vendors.

GPT-6 Sol — преемник модели, носящей сбивающее с толку название GPT-5.6 Sol, — той самой, которую OrcaRouter до сих пор указывает как доступную по цене $4 за вход и $20 за выход и которую Artificial Analysis с тех пор пометила как устаревшую со ссылкой на GPT-6 Sol. Новая модель вышла 22 сентября 2026 года по цене $2 / $10 с контекстным окном 1 050 000 токенов, ограничением вывода 128K и ступенчатым тарифом: заявленные $2 / $10 действуют до 272 000 входных токенов, а всё сверх этого тарифицируется по $4 / $15.

Эта последняя деталь — первое место, где рушится концепция «идентичного ценообразования».

Ценовое равенство справедливо только для коротких промптов.

Обе тарифные карты указывают $2 и $10, и почти каждое сравнение в день запуска на этом заканчивалось. Сопоставьте их по условиям, которые определяют счёт:

• Базовая ставка — Claude Sonnet 5.5 $2 / $10 против GPT-6 Sol $2 / $10

• Тариф для длинного контекста — Sonnet 5.5 тарифицирует всё окно в 1 млн токенов по стандартному тарифу; GPT-6 Sol удваивает до $4 / $15 при превышении 272 000 входных токенов

• Контекстное окно — 1 000 000 токенов против 1 050 000 токенов

• Максимальный вывод — 128K токенов в синхронном API для обоих; Sonnet 5.5 достигает 300K в Message Batches API при использовании output-300k-2026-03-24заголовка

• Пакетная скидка — 50% на ввод и вывод для Sonnet 5.5; проверьте текущие условия OpenAI для Sol, а не исходите из предположения о паритете.

• Чтение из кэша — $0.20 за миллион на обоих

Прогон репозитория объёмом 800 000 токенов стоит вдвое дороже за токен на GPT-6 Sol, чем на Claude Sonnet 5.5, и это именно та рабочая нагрузка, для которой обе модели и продвигаются. Если ваши промпты короткие, тарифные сетки действительно совпадают, и цена не должна ничего решать. Если они длинные — она уже решила.

Собственное табло Anthropic, читайте внимательно

Anthropic опубликовала сравнение из четырёх колонок с Claude Sonnet 5, Claude Opus 5.5 и GPT-6 Sol. Показатели, заявленные производителем, которые пока не воспроизвела ни одна третья сторона:

Artificial Analysis model page for Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback), released September 2026, showing an Intelligence Index of 56, a price of $2.00 per million input tokens and $10.00 per million output tokens, a cost of $7.60 per Intelligence Index task, a verbosity of 410M output tokens against a median of 88M, and a 1M-token context window.

• Terminal-Bench 4.0 — Sonnet 5.5 70,6 % против Sonnet 5 10,3 %

• FrontierCode 1.1, Main — Sonnet 5.5 46,2% при максимальном усилии, Sonnet 5 42,4%, Opus 5.5 54,4%, GPT-6 Sol 49,3%

• CursorBench 4.0 — Sonnet 5.5 55,5 % против Sonnet 5 34,1 % против Opus 5.5 57,8 %

• GDPval-AA v2.1 — Sonnet 5.5 1844 против Sonnet 5 1449 против Opus 5.5 1846 против GPT-6 Sol 1487

• AA-Briefcase v1.1 — Sonnet 5.5 1811 против Sonnet 5 1359 против Opus 5.5 1822 против GPT-6 Sol 1483

• Последний экзамен человечества, с инструментами — Sonnet 5.5 64,5% против Sonnet 5 54,9% против Opus 5.5 67,7%

• OSWorld 2.1, частично — Sonnet 5.5 80,1% против Sonnet 5 57,0% против Opus 5.5 81,8%

• Chartography, без инструментов — Sonnet 5.5 61,6% против Sonnet 5 15,6% против Opus 5.5 64,4% против GPT-6 Sol 53,6%

Две из этих строк снабжены сносками, и обе они важны. Показатели GDPval-AA, AA-Briefcase и Chartography для GPT-6 Sol помечены Anthropic как измеренные после исправления функции понимания изображений на стороне OpenAI, а значение FrontierCode для Sonnet 5.5 — это результат в режиме Max-effort, который, как отмечает Anthropic, оказался ниже его собственного результата Xhigh в том же тестировании. Поставщик, сравнивающий себя с конкурентом на бенчмарке, который он проводит сам, со сносками, оговаривающими обе стороны, — это не нейтральное доказательство. Это наилучшее доступное доказательство в день запуска, и это не то же самое, что измерение.

Что говорят независимые числа и о чём они умалчивают

Artificial Analysis опубликовала первый независимый прогон: Index 56 на v4.3.2, стоимость $7,60 за Index и показатель многословности в 410 млн выходных токенов против медианы в 88 млн. Это число многословности заслуживает большего внимания, чем ему уделяют. Оно означает, что модель склонна тратить очень много токенов на пути к ответу, и это механизм, стоящий за единственным заявлением об эффективности, которое исходит не из собственной таблицы Anthropic.

Anthropic утверждает, что Claude Sonnet 5.5 генерирует вывод на 30% быстрее, чем Claude Sonnet 5, и стоит «до 30% меньше за задачу» при той же цене за токен. Вместе эти два утверждения описывают модель, которая выполняет ту же работу за меньшее число токенов, а не более дешёвый тариф. Именно для этого и нужно измерение многословности на 410 млн токенов, и одного независимого прогона недостаточно, чтобы окончательно это решить, — но достаточно, чтобы сказать, что маркетинговая фраза и измеренное количество токенов указывают в противоположных направлениях, а в счёте фигурирует именно измеренное.

Обратите также внимание на то, чего независимый индекс пока не содержит. Нет ни одного опубликованного воспроизведения OSWorld, Terminal-Bench или CursorBench от кого-либо, кроме Anthropic. И 56 — это составной показатель: он ничего не говорит о том, какая из десяти входящих в него оценок обеспечила разрыв с 47 у Sol. Преимущество в девять пунктов по составному показателю может скрывать отставание в пятнадцать пунктов в той единственной оценке, от которой зависит ваша рабочая нагрузка.

Там, где они расходятся так, как не может показать тарифная карта

Цена и оценка по индексу — это две простые оси. А решают вопрос о миграции именно поведенческие, и здесь две модели совсем не близки.

OrcaRouter model page for openai/gpt-5.6-sol, attributed to OpenAI and dated 2026-07-09, showing a 1M-token context window, 128K maximum output, text, image and file input, an input price of $4.00 and output price of $20.00 per million tokens, a p50 time to first token of 10.00 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Claude Sonnet 5.5 по умолчанию использует адаптивное мышление с high в качестве уровня усилий по умолчанию, а также убирает три возможности, которые допускало предыдущее поколение: отправка thinking: {"type": "disabled"} теперь возвращает ошибку 400 и должна быть заменена на between_tools; принудительное использование инструментов — tool_choice, установленный в "any" или на конкретный инструмент, — сразу возвращает ошибку 400; а более старый computer_20251124 инструмент computer-use отклоняется в Claude API и Google Cloud в пользу набора инструментов. Блоки мышления теперь также привязаны к модели, которая их создала, поэтому диалог может перейти с Claude Sonnet 5 на Claude Sonnet 5.5 и сохранить свои рассуждения, но обратно с ними перейти уже не может.

Если ваш агентный цикл задаёт tool_choice: "any", чтобы принудительно вызвать schema-valid вызов, Claude Sonnet 5.5 будет отклонять запрос, пока вы не переключитесь на auto со strict tool use или structured outputs. Это самая настоящая задача миграции — из тех, что превращают замену ID модели в одну строку в целый день работы.

Цена перехода на GPT-6 Sol качественно иная, потому что модель, которую она заменяет, всё ещё в каталоге и её по-прежнему вызывают. GPT-5.6 Sol не отозвана; она помечена как устаревшая в Artificial Analysis, стоит вдвое дороже новой модели и по-прежнему получает трафик. Собственные измерения OrcaRouter показывают, что она обрабатывает примерно 95 миллионов токенов в неделю, — это разумный ориентир того, сколько интеграций ещё не мигрировали. Переход на GPT-6 Sol — это ценовое решение, которое можно принять позже; не обязательно принимать его сейчас.

Запуск сравнения по одному ключу

Практическая проблема сравнения двух поставщиков заключается в том, что обычно оно требует двух аккаунтов, двух путей интеграции через SDK и двух наборов лимитов запросов, прежде чем вы что-либо узнаете. OrcaRouter создан, чтобы устранить эту проблему: один OpenAI-совместимый эндпоинт, более 200 моделей, цена провайдера по прайс-листу передаётся без наценки, и автоматическое переключение при сбое между провайдерами.

Обе значимые здесь модели уже сегодня можно маршрутизировать через неё. GPT-6 Sol есть в каталоге за $2 / $10, причём тариф с длинным контекстом сохранён, а Claude Sonnet 5 — модель, на которой по-прежнему идёт большая часть трафика Claude API, с измеренной скоростью 150 выходных токенов в секунду и медианным временем до первого токена (p50) около пяти секунд, — находится на платформе с 30 июня по цене Anthropic $2 / $10.

Сам Claude Sonnet 5.5 пока ещё не в нашем каталоге. И хотя это так, честный путь к нему — собственный API поставщика и три облака из списка Anthropic, а честный способ оценить его — направить на него ту часть трафика, потерять которую вы можете себе позволить. Для этого и нужен слой маршрутизации: повышайте процент, следите за частотой сбоев и оставляйте предыдущую модель в качестве резервного варианта, а не плана отката.

Какой из них идёт в продакшн?

Выбирайте по профилю рабочей нагрузки, а не по интегральному показателю.

Claude Sonnet 5.5 — лучший вариант для работы с длинным контекстом, для всего, что уже написано под интерфейсы Anthropic для использования инструментов и управления компьютером, а также для команд, чьи промпты регулярно превышают четверть миллиона токенов: фиксированное окно там ценнее, чем любая разница в показателях индекса. Примите как данность, что миграция сопровождается чек-листом: принудительное использование инструментов, переключатель режима размышления, связки с инструментом советника и изменение инструмента computer-use.

GPT-6 Sol — более безопасный выбор для обеспечения преемственности в стеке, ориентированном на OpenAI, и более дешёвый, если ваши промпты короткие, а интеграции уже построены. Его преимущество не в возможностях — по совокупному показателю он уступает — а в том, что его предшественник всё ещё работает, и у миграции нет крайнего срока.

По имеющимся на сегодня цифрам Claude Sonnet 5.5 побеждает в очном сравнении по независимому индексу и по экономике длинного контекста и не проигрывает ни в чём, что любое опубликованное измерение пока способно обнаружить сверх уверенности из собственной таблицы поставщика. Это более узкое утверждение, чем то, которое содержится в материалах о запуске, и именно на него стоит опираться.

То, что изменило бы ответ, — это второй независимый прогон агентных оценок и опубликованный показатель числа токенов на задачу для обеих моделей на одних и тех же задачах. Пока не появится и то и другое, составной индекс даёт преимущество в девять пунктов модели, более дешёвой в эксплуатации, а преимущество в девять пунктов по составному индексу — не то же самое, что преимущество в девять пунктов на вашей рабочей нагрузке.

Сравнение в этой статье3

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно