
Claude Sonnet 5.5 против GPT-6 Sol: в категории за $2 теперь два флагмана
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 984 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 195 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Claude Sonnet 5.5 и GPT-6 Sol имеют одинаковую цену — $2 за миллион входных токенов, $10 за миллион выходных токенов — и они появились с разницей в шесть дней в конце сентября 2026 года. Это совпадение — не самое интересное. Интересно то, что когда Artificial Analysis измерила обе модели на своём Intelligence Index v4.3.2, модель Anthropic среднего уровня обошла модель, которую OpenAI продаёт как свой флагман: 56 у Claude Sonnet 5.5 против 47 у GPT-6 Sol. В той же ревизии Claude Sonnet 5 — модель, которую заменяет Sonnet 5.5 — находится на отметке 38.
Так что это уже не сравнение дешёвого уровня с дорогим. Это сравнение двух моделей по одной цене, от двух лабораторий, с разрывом в 18 пунктов между моделью Anthropic и её собственным предшественником и разрывом в девять пунктов в пользу Anthropic против топового релиза OpenAI. Всё ниже — попытка выяснить, какие из этих разрывов сохраняются при столкновении с реальной рабочей нагрузкой, а какие из них — артефакт бенчмарка.
Что на самом деле представляет собой каждая модель
Claude Sonnet 5.5 — вторая модель в поколении 5.5 от Anthropic, выпущенная 28 сентября 2026 года, через пять дней после запуска Claude Opus 5.5, на котором её и пообещали. Она носит идентификатор claude-sonnet-5-5 в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry, сохраняет контекстное окно на 1 млн токенов и потолок вывода в 128K, присущие этому уровню, а также в точности сохраняет цены Claude Sonnet 5: $2 за вход, $10 за выход, $0,20 за миллион для чтения из кэша, $2,50 за запись в кэш на пять минут. Она доступна с нулевым хранением данных с первого дня, а обязательство Anthropic по прекращению поддержки действует до 28 сентября 2027 года.

GPT-6 Sol — преемник модели, носящей сбивающее с толку название GPT-5.6 Sol, — той самой, которую OrcaRouter до сих пор указывает как доступную по цене $4 за вход и $20 за выход и которую Artificial Analysis с тех пор пометила как устаревшую со ссылкой на GPT-6 Sol. Новая модель вышла 22 сентября 2026 года по цене $2 / $10 с контекстным окном 1 050 000 токенов, ограничением вывода 128K и ступенчатым тарифом: заявленные $2 / $10 действуют до 272 000 входных токенов, а всё сверх этого тарифицируется по $4 / $15.
Эта последняя деталь — первое место, где рушится концепция «идентичного ценообразования».
Ценовое равенство справедливо только для коротких промптов.
Обе тарифные карты указывают $2 и $10, и почти каждое сравнение в день запуска на этом заканчивалось. Сопоставьте их по условиям, которые определяют счёт:
• Базовая ставка — Claude Sonnet 5.5 $2 / $10 против GPT-6 Sol $2 / $10
• Тариф для длинного контекста — Sonnet 5.5 тарифицирует всё окно в 1 млн токенов по стандартному тарифу; GPT-6 Sol удваивает до $4 / $15 при превышении 272 000 входных токенов
• Контекстное окно — 1 000 000 токенов против 1 050 000 токенов
• Максимальный вывод — 128K токенов в синхронном API для обоих; Sonnet 5.5 достигает 300K в Message Batches API при использовании output-300k-2026-03-24заголовка
• Пакетная скидка — 50% на ввод и вывод для Sonnet 5.5; проверьте текущие условия OpenAI для Sol, а не исходите из предположения о паритете.
• Чтение из кэша — $0.20 за миллион на обоих
Прогон репозитория объёмом 800 000 токенов стоит вдвое дороже за токен на GPT-6 Sol, чем на Claude Sonnet 5.5, и это именно та рабочая нагрузка, для которой обе модели и продвигаются. Если ваши промпты короткие, тарифные сетки действительно совпадают, и цена не должна ничего решать. Если они длинные — она уже решила.
Собственное табло Anthropic, читайте внимательно
Anthropic опубликовала сравнение из четырёх колонок с Claude Sonnet 5, Claude Opus 5.5 и GPT-6 Sol. Показатели, заявленные производителем, которые пока не воспроизвела ни одна третья сторона:

• Terminal-Bench 4.0 — Sonnet 5.5 70,6 % против Sonnet 5 10,3 %
• FrontierCode 1.1, Main — Sonnet 5.5 46,2% при максимальном усилии, Sonnet 5 42,4%, Opus 5.5 54,4%, GPT-6 Sol 49,3%
• CursorBench 4.0 — Sonnet 5.5 55,5 % против Sonnet 5 34,1 % против Opus 5.5 57,8 %
• GDPval-AA v2.1 — Sonnet 5.5 1844 против Sonnet 5 1449 против Opus 5.5 1846 против GPT-6 Sol 1487
• AA-Briefcase v1.1 — Sonnet 5.5 1811 против Sonnet 5 1359 против Opus 5.5 1822 против GPT-6 Sol 1483
• Последний экзамен человечества, с инструментами — Sonnet 5.5 64,5% против Sonnet 5 54,9% против Opus 5.5 67,7%
• OSWorld 2.1, частично — Sonnet 5.5 80,1% против Sonnet 5 57,0% против Opus 5.5 81,8%
• Chartography, без инструментов — Sonnet 5.5 61,6% против Sonnet 5 15,6% против Opus 5.5 64,4% против GPT-6 Sol 53,6%
Две из этих строк снабжены сносками, и обе они важны. Показатели GDPval-AA, AA-Briefcase и Chartography для GPT-6 Sol помечены Anthropic как измеренные после исправления функции понимания изображений на стороне OpenAI, а значение FrontierCode для Sonnet 5.5 — это результат в режиме Max-effort, который, как отмечает Anthropic, оказался ниже его собственного результата Xhigh в том же тестировании. Поставщик, сравнивающий себя с конкурентом на бенчмарке, который он проводит сам, со сносками, оговаривающими обе стороны, — это не нейтральное доказательство. Это наилучшее доступное доказательство в день запуска, и это не то же самое, что измерение.
Что говорят независимые числа и о чём они умалчивают
Artificial Analysis опубликовала первый независимый прогон: Index 56 на v4.3.2, стоимость $7,60 за Index и показатель многословности в 410 млн выходных токенов против медианы в 88 млн. Это число многословности заслуживает большего внимания, чем ему уделяют. Оно означает, что модель склонна тратить очень много токенов на пути к ответу, и это механизм, стоящий за единственным заявлением об эффективности, которое исходит не из собственной таблицы Anthropic.
Anthropic утверждает, что Claude Sonnet 5.5 генерирует вывод на 30% быстрее, чем Claude Sonnet 5, и стоит «до 30% меньше за задачу» при той же цене за токен. Вместе эти два утверждения описывают модель, которая выполняет ту же работу за меньшее число токенов, а не более дешёвый тариф. Именно для этого и нужно измерение многословности на 410 млн токенов, и одного независимого прогона недостаточно, чтобы окончательно это решить, — но достаточно, чтобы сказать, что маркетинговая фраза и измеренное количество токенов указывают в противоположных направлениях, а в счёте фигурирует именно измеренное.
Обратите также внимание на то, чего независимый индекс пока не содержит. Нет ни одного опубликованного воспроизведения OSWorld, Terminal-Bench или CursorBench от кого-либо, кроме Anthropic. И 56 — это составной показатель: он ничего не говорит о том, какая из десяти входящих в него оценок обеспечила разрыв с 47 у Sol. Преимущество в девять пунктов по составному показателю может скрывать отставание в пятнадцать пунктов в той единственной оценке, от которой зависит ваша рабочая нагрузка.
Там, где они расходятся так, как не может показать тарифная карта
Цена и оценка по индексу — это две простые оси. А решают вопрос о миграции именно поведенческие, и здесь две модели совсем не близки.

Claude Sonnet 5.5 по умолчанию использует адаптивное мышление с high в качестве уровня усилий по умолчанию, а также убирает три возможности, которые допускало предыдущее поколение: отправка thinking: {"type": "disabled"} теперь возвращает ошибку 400 и должна быть заменена на between_tools; принудительное использование инструментов — tool_choice, установленный в "any" или на конкретный инструмент, — сразу возвращает ошибку 400; а более старый computer_20251124 инструмент computer-use отклоняется в Claude API и Google Cloud в пользу набора инструментов. Блоки мышления теперь также привязаны к модели, которая их создала, поэтому диалог может перейти с Claude Sonnet 5 на Claude Sonnet 5.5 и сохранить свои рассуждения, но обратно с ними перейти уже не может.
Если ваш агентный цикл задаёт tool_choice: "any", чтобы принудительно вызвать schema-valid вызов, Claude Sonnet 5.5 будет отклонять запрос, пока вы не переключитесь на auto со strict tool use или structured outputs. Это самая настоящая задача миграции — из тех, что превращают замену ID модели в одну строку в целый день работы.
Цена перехода на GPT-6 Sol качественно иная, потому что модель, которую она заменяет, всё ещё в каталоге и её по-прежнему вызывают. GPT-5.6 Sol не отозвана; она помечена как устаревшая в Artificial Analysis, стоит вдвое дороже новой модели и по-прежнему получает трафик. Собственные измерения OrcaRouter показывают, что она обрабатывает примерно 95 миллионов токенов в неделю, — это разумный ориентир того, сколько интеграций ещё не мигрировали. Переход на GPT-6 Sol — это ценовое решение, которое можно принять позже; не обязательно принимать его сейчас.
Запуск сравнения по одному ключу
Практическая проблема сравнения двух поставщиков заключается в том, что обычно оно требует двух аккаунтов, двух путей интеграции через SDK и двух наборов лимитов запросов, прежде чем вы что-либо узнаете. OrcaRouter создан, чтобы устранить эту проблему: один OpenAI-совместимый эндпоинт, более 200 моделей, цена провайдера по прайс-листу передаётся без наценки, и автоматическое переключение при сбое между провайдерами.
Обе значимые здесь модели уже сегодня можно маршрутизировать через неё. GPT-6 Sol есть в каталоге за $2 / $10, причём тариф с длинным контекстом сохранён, а Claude Sonnet 5 — модель, на которой по-прежнему идёт большая часть трафика Claude API, с измеренной скоростью 150 выходных токенов в секунду и медианным временем до первого токена (p50) около пяти секунд, — находится на платформе с 30 июня по цене Anthropic $2 / $10.
Сам Claude Sonnet 5.5 пока ещё не в нашем каталоге. И хотя это так, честный путь к нему — собственный API поставщика и три облака из списка Anthropic, а честный способ оценить его — направить на него ту часть трафика, потерять которую вы можете себе позволить. Для этого и нужен слой маршрутизации: повышайте процент, следите за частотой сбоев и оставляйте предыдущую модель в качестве резервного варианта, а не плана отката.
Какой из них идёт в продакшн?
Выбирайте по профилю рабочей нагрузки, а не по интегральному показателю.
Claude Sonnet 5.5 — лучший вариант для работы с длинным контекстом, для всего, что уже написано под интерфейсы Anthropic для использования инструментов и управления компьютером, а также для команд, чьи промпты регулярно превышают четверть миллиона токенов: фиксированное окно там ценнее, чем любая разница в показателях индекса. Примите как данность, что миграция сопровождается чек-листом: принудительное использование инструментов, переключатель режима размышления, связки с инструментом советника и изменение инструмента computer-use.
GPT-6 Sol — более безопасный выбор для обеспечения преемственности в стеке, ориентированном на OpenAI, и более дешёвый, если ваши промпты короткие, а интеграции уже построены. Его преимущество не в возможностях — по совокупному показателю он уступает — а в том, что его предшественник всё ещё работает, и у миграции нет крайнего срока.
По имеющимся на сегодня цифрам Claude Sonnet 5.5 побеждает в очном сравнении по независимому индексу и по экономике длинного контекста и не проигрывает ни в чём, что любое опубликованное измерение пока способно обнаружить сверх уверенности из собственной таблицы поставщика. Это более узкое утверждение, чем то, которое содержится в материалах о запуске, и именно на него стоит опираться.
То, что изменило бы ответ, — это второй независимый прогон агентных оценок и опубликованный показатель числа токенов на задачу для обеих моделей на одних и тех же задачах. Пока не появится и то и другое, составной индекс даёт преимущество в девять пунктов модели, более дешёвой в эксплуатации, а преимущество в девять пунктов по составному индексу — не то же самое, что преимущество в девять пунктов на вашей рабочей нагрузке.
Сравнение в этой статье3
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
