
GPT-6 против Claude Opus 5.5: модель, которую только что получили все, против той, что всё ещё лидирует
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
7 октября 2026 года GPT-6 стала моделью, с которой общаются более 1,2 млрд еженедельных пользователей ChatGPT, и при этом она по-прежнему не является моделью с самым высоким баллом в независимом рейтинге. GPT-6 Sol — уровень, который OpenAI включила для ChatGPT Plus, Pro, Business и Enterprise, — набирает 47,6 балла в Intelligence Index v4.3.2 от Artificial Analysis. Claude Opus 5.5, выпущенная Anthropic 22 сентября 2026 года по цене $4,00 за миллион входных токенов и $20,00 за миллион выходных, набирает 57,6 балла в той же версии. Десять баллов — по единственному показателю, по которому готовы оцениваться маркетинговые команды обоих вендоров.
Этот разрыв реален, и я не собираюсь его преуменьшать. Но это ещё и наименее интересный факт об этой паре в октябре, потому что то, что изменилось на этой неделе, — не бенчмарк. GPT-6 появился в ChatGPT для всех с возможностью, которую OpenAI называет Intelligent UI, а модель, на которой работают платные уровни этого запуска, — GPT-6 Sol. Так что полезное сравнение больше не «какой API лучше», а «что на самом деле получили 1,2 миллиарда человек, которые только что обзавелись GPT-6, и достаточно ли этого, чтобы разработчик или команда перестали платить за Claude Opus 5.5». Эти два ответа различаются, и различие не в десяти пунктах.
Что на самом деле изменилось 7 октября
Если быть точным в отношении даты, поскольку это не запуск: GPT-6 Sol и GPT-6 Luna были выпущены 22 сентября 2026 года в качестве API-моделей. GPT-6 Astra, флагманская модель, появилась раньше них — OpenAI выпустила её 3 сентября 2026 года. 7 октября произошло то, что GPT-6 стал доступен на вкладке Chat в ChatGPT по всему миру для тарифов Plus, Pro, Business и Enterprise, а тарифы Free и Go — с 8 октября; доступ для Enterprise по-прежнему зависит от настроек администратора рабочего пространства. Это событие распространения, а не релиз, и это различие важно для всех, кто читает более ранние материалы.
Связанная с ним возможность — это по-настоящему новая часть. Intelligent UI позволяет GPT-6 составлять ответ из текста, графики, нажимаемых кнопок, форм и диаграмм, выбираемых для каждого вопроса, и транслировать интерфейс по мере того, как модель его генерирует. Сам OpenAI формулирует это так: сравнение может вернуться в виде сопоставления бок о бок, объяснение — в виде интерактивной диаграммы, а простой текстовый ответ — когда текст и есть правильный ответ. С этим связаны два внутренних результата, о которых сообщил вендор: на ценных повседневных агентных задачах GPT-6 при уровне усилий Extra High начинает отвечать за то же время, что GPT-5.6 при Medium, при этом в целом показывает лучший результат, чем GPT-5.6 при Extra High, а на вопросах, требующих веб-поиска, GPT-6 Instant начинает отвечать в среднем на 44% раньше, чем GPT-5.6 Instant. Оба показателя — это цифры OpenAI, воспроизведённые из её собственного анонса, и ни один из них пока не имеет независимого воспроизведения.
Две тарифные карты, и где покупаются десять баллов
Ни одна из моделей не изменила цену на этой неделе. Claude Opus 5.5 стоит $4.00 за ввод и $20.00 за вывод с 22 сентября. GPT-6 Sol — $2.00 и $10.00 с того же дня. По одной строке на каждое измерение, обе стороны в каждой:
• Цена на ввод — GPT-6 Sol $2.00 за 1 млн против Claude Opus 5.5 $4.00; Sol вдвое дешевле
• Цена на вывод — GPT-6 Sol $10.00 за 1 млн против Claude Opus 5.5 $20.00; снова вдвое
• Условие для длинного контекста — GPT-6 Sol пересчитывает весь запрос по $4.00 за ввод и $15.00 за вывод при превышении 272,000 входных токенов; у Claude Opus 5.5 нет сопоставимого порога при окне в 1 млн
• Кэшированный ввод — GPT-6 Sol $0.20 за 1 млн против Claude Opus 5.5 $0.20; на одном уровне
• Стоимость прогона полного набора Intelligence Index — Claude Opus 5.5 $5.98 за задачу против GPT-6 Sol $1.04, разрыв в 5.7×, купленный за те десять пунктов
• Контекстное окно — GPT-6 Sol 1,050,000 токенов против Claude Opus 5.5 1,000,000, при этом у обоих потолок вывода 128,000 токенов

Четвёртая строка решает исход большинства реальных внедрений, и это не та строка, что на маркетинговой странице. Надбавка GPT-6 Sol за длинный контекст агрессивна по сравнению с его же заявленными цифрами: если запрос превышает 272 000 входных токенов, весь запрос тарифицируется по $4,00 и $15,00, а не только превышение. Для агента, ведущего длинную сессию с большим документом в контексте, это незаметно лишает его большей части преимущества в половинной цене. У Claude Opus 5.5 нет аналогичного порога, поэтому запрос на 400 000 токенов обходится ему по той же ставке за токен, что и запрос на 4 000 токенов.
Где обитают десять точек, потому что они распределены неравномерно
Композитный индекс скрывает собственные компоненты, а этот скрывает необычно неравномерный профиль. Извлеките отдельные оценки, с которыми можно сопоставить показатели обоих поставщиков:
• Humanity's Last Exam — Claude Opus 5.5 61,4% против GPT-6 Sol 47,9%, разрыв в 13,5 пункта в абстрактных рассуждениях
• SciCode — Claude Opus 5.5 66,9% против GPT-6 Sol 57,6%, разрыв в 9,3 пункта на коде исследовательского уровня
• Terminal-Bench 4.0 — Claude Opus 5.5 59,6% против GPT-6 Sol 43,9%
• Воспроизведение в длинном контексте — Claude Opus 5.5 84,7% против GPT-6 Sol 83,7%, разрыв в 1,0 пункта, самый узкий на этой странице
• Многоходовое агентное использование инструментов — обе модели находятся в пределах нескольких пунктов друг от друга в семействе τ²-Bench, где обе сильны

Всё решает распределение. В абстрактных рассуждениях — сложный экзаменационный вопрос, исследовательская задача, для которой нет готового ответа, который можно было бы скопировать, — Claude Opus 5.5 безоговорочно впереди, и разрыв слишком велик, чтобы объясняться шумом. В извлечении факта из очень длинного входного текста оба фактически на одном уровне, а у GPT-6 Sol окно чуть больше. Если ваша нагрузка — это поиск по длинным документам и работа агента в долгих сессиях, эти десять баллов по большей части не ваша проблема. Если же это новые рассуждения — это ваша проблема, и, чтобы их избежать, вам придётся платить в 5,7 раза больше за задачу.
Что внедрение ChatGPT говорит и не говорит вам
Есть соблазн воспринимать фразу «1,2 млрд еженедельных пользователей теперь имеют GPT-6» как свидетельство возможностей. Это не так. Это свидетельство распространения, и OpenAI прямо указывает, что развёртывание ChatGPT работает на GPT-6 Sol для платных тарифов и GPT-6 Luna для Free и Go, причём обе «настроены для повседневного общения» — иная цель оптимизации, чем у API-продукта. Модели, лежащие в основе Work и Codex, в этом релизе не изменились, и это самый ясный сигнал в анонсе о том, что речь идёт о событии для потребительской поверхности, а не о релизе новых возможностей. Всем, кто проводит бенчмарки «GPT-6, которым пользуются 1,2 млрд человек», следует понимать: они измеряют настроенное для чата развёртывание, а не API-эндпоинт.
Что развёртывание действительно меняет, так это выбор по умолчанию. Модель, которая просто доступна всем, оказывается в гораздо большем числе прототипов, внутренних инструментов и незавершённых побочных проектов, чем модель, которую нужно сознательно выбрать. Если вы выбираете API для чего-то долговечного, эта повсеместная привычность чего-то стоит — но она не стоит десяти пунктов индекса и не стоит 5,7-кратной стоимости на задачу в конвейере с интенсивными рассуждениями.
Запуск обоих без выбора
Честный ответ на вопрос «стоит ли переключаться» здесь таков: эти две модели предназначены для разных задач, и вопрос переключения — это в основном вопрос маршрутизации. Обе есть в каталоге OrcaRouter — GPT-6 Sol по цене поставщика $2.00/$10.00, при этом тариф для длинного контекста $4.00/$15.00 передан без изменений, и Claude Opus 5.5 по $4.00/$20.00 — за одним ключом и одним OpenAI-совместимым эндпоинтом, с наценкой 0% к прайс-листу провайдера. Это важно больше обычного в неделю, когда вендор меняет потребительский запуск, потому что наша ценовая строка — это цена провайдера, а не наша.
Схема, подходящая для этой пары, — разделение: направляйте трафик длинных документов и длинных сессий тому из двух, который дешевле при таком количестве токенов, — после 272 000 токенов это уже не GPT-6 Sol, — и отправляйте трафик новых рассуждений в Claude Opus 5.5, при этом GPT-6 Sol оставляется в качестве автоматического переключения при отказе, чтобы ограничение частоты запросов на одном маршруте не превращалось в сбой на вашей стороне. Вам не обязательно разрешать этот десятипунктный спор, чтобы выпустить продукт; вам нужно знать, какие из ваших запросов попадают в ту часть распределения, где это применимо.

Вердикт, каков он есть
Claude Opus 5.5 — более сильная модель по показателю, по которому отчитываются обе лаборатории, а на двух оценках, которые важнее всего для сложных рассуждений, он далеко впереди. GPT-6 Sol стоит вдвое дешевле по заявленной цене, обходится в пятую часть стоимости за задачу на независимом наборе тестов и теперь является моделью по умолчанию в приложении, которое уже открыто у большинства ваших коллег. Ни один из этих фактов не изменился на этой неделе; изменилось то, что GPT-6 перестал быть тем, что вам приходилось выбирать, и стал тем, что у вас уже есть.
Следить нужно за тем, станет ли следующий ход OpenAI шагом в развитии возможностей или очередным шагом в дистрибуции. В своём собственном анонсе компания прямо задаёт это ожидание — она говорит, что хочет, чтобы со временем ChatGPT создавал больше интерфейсов, которые нужны людям, — а это дорожная карта о поверхностях, а не о баллах индекса. Если ваше решение зависит от индекса, Claude Opus 5.5 всё ещё выигрывает. Если оно зависит от стоимости при больших объёмах и от того, что модель уже всем известна, GPT-6 Sol сегодня — более безопасный выбор по умолчанию, а пункт о длинном контексте — единственная строка в его тарифной сетке, которую вам придётся заложить в бюджет.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
