Титульная карточка с надписью «GPT-6 против Claude Opus 5.5», чип с надписью «GPT-6 вышел в ChatGPT 2026-10-07», две строки с ценами «GPT-6 Sol $2 / $10» и «Claude Opus 5.5 $4 / $20», а также строка в футере «Показатели GPT-6 включают данные, заявленные вендором; показатели индекса — по Artificial Analysis». Логотип OrcaRouter скомпонован в правом нижнем углу.
Guides & Insights

GPT-6 против Claude Opus 5.5: модель, которую только что получили все, против той, что всё ещё лидирует

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

7 октября 2026 года GPT-6 стала моделью, с которой общаются более 1,2 млрд еженедельных пользователей ChatGPT, и при этом она по-прежнему не является моделью с самым высоким баллом в независимом рейтинге. GPT-6 Sol — уровень, который OpenAI включила для ChatGPT Plus, Pro, Business и Enterprise, — набирает 47,6 балла в Intelligence Index v4.3.2 от Artificial Analysis. Claude Opus 5.5, выпущенная Anthropic 22 сентября 2026 года по цене $4,00 за миллион входных токенов и $20,00 за миллион выходных, набирает 57,6 балла в той же версии. Десять баллов — по единственному показателю, по которому готовы оцениваться маркетинговые команды обоих вендоров.

Этот разрыв реален, и я не собираюсь его преуменьшать. Но это ещё и наименее интересный факт об этой паре в октябре, потому что то, что изменилось на этой неделе, — не бенчмарк. GPT-6 появился в ChatGPT для всех с возможностью, которую OpenAI называет Intelligent UI, а модель, на которой работают платные уровни этого запуска, — GPT-6 Sol. Так что полезное сравнение больше не «какой API лучше», а «что на самом деле получили 1,2 миллиарда человек, которые только что обзавелись GPT-6, и достаточно ли этого, чтобы разработчик или команда перестали платить за Claude Opus 5.5». Эти два ответа различаются, и различие не в десяти пунктах.

Что на самом деле изменилось 7 октября

Если быть точным в отношении даты, поскольку это не запуск: GPT-6 Sol и GPT-6 Luna были выпущены 22 сентября 2026 года в качестве API-моделей. GPT-6 Astra, флагманская модель, появилась раньше них — OpenAI выпустила её 3 сентября 2026 года. 7 октября произошло то, что GPT-6 стал доступен на вкладке Chat в ChatGPT по всему миру для тарифов Plus, Pro, Business и Enterprise, а тарифы Free и Go — с 8 октября; доступ для Enterprise по-прежнему зависит от настроек администратора рабочего пространства. Это событие распространения, а не релиз, и это различие важно для всех, кто читает более ранние материалы.

Связанная с ним возможность — это по-настоящему новая часть. Intelligent UI позволяет GPT-6 составлять ответ из текста, графики, нажимаемых кнопок, форм и диаграмм, выбираемых для каждого вопроса, и транслировать интерфейс по мере того, как модель его генерирует. Сам OpenAI формулирует это так: сравнение может вернуться в виде сопоставления бок о бок, объяснение — в виде интерактивной диаграммы, а простой текстовый ответ — когда текст и есть правильный ответ. С этим связаны два внутренних результата, о которых сообщил вендор: на ценных повседневных агентных задачах GPT-6 при уровне усилий Extra High начинает отвечать за то же время, что GPT-5.6 при Medium, при этом в целом показывает лучший результат, чем GPT-5.6 при Extra High, а на вопросах, требующих веб-поиска, GPT-6 Instant начинает отвечать в среднем на 44% раньше, чем GPT-5.6 Instant. Оба показателя — это цифры OpenAI, воспроизведённые из её собственного анонса, и ни один из них пока не имеет независимого воспроизведения.

Две тарифные карты, и где покупаются десять баллов

Ни одна из моделей не изменила цену на этой неделе. Claude Opus 5.5 стоит $4.00 за ввод и $20.00 за вывод с 22 сентября. GPT-6 Sol — $2.00 и $10.00 с того же дня. По одной строке на каждое измерение, обе стороны в каждой:

• Цена на ввод — GPT-6 Sol $2.00 за 1 млн против Claude Opus 5.5 $4.00; Sol вдвое дешевле
• Цена на вывод — GPT-6 Sol $10.00 за 1 млн против Claude Opus 5.5 $20.00; снова вдвое
• Условие для длинного контекста — GPT-6 Sol пересчитывает весь запрос по $4.00 за ввод и $15.00 за вывод при превышении 272,000 входных токенов; у Claude Opus 5.5 нет сопоставимого порога при окне в 1 млн
• Кэшированный ввод — GPT-6 Sol $0.20 за 1 млн против Claude Opus 5.5 $0.20; на одном уровне
• Стоимость прогона полного набора Intelligence Index — Claude Opus 5.5 $5.98 за задачу против GPT-6 Sol $1.04, разрыв в 5.7×, купленный за те десять пунктов
• Контекстное окно — GPT-6 Sol 1,050,000 токенов против Claude Opus 5.5 1,000,000, при этом у обоих потолок вывода 128,000 токенов

A two-column comparison scoreboard for GPT-6 Sol and Claude Opus 5.5, showing GPT-6 Sol at an Intelligence Index of 47.6 and $1.04 per index task against Claude Opus 5.5 at 57.6 and $5.98, plus input and output prices of $2.00/$10.00 against $4.00/$20.00 and 1,050,000 against 1,000,000-token context windows. A footer reads "Index figures per Artificial Analysis v4.3.2; GPT-6 vendor-reported items labelled in text."

Четвёртая строка решает исход большинства реальных внедрений, и это не та строка, что на маркетинговой странице. Надбавка GPT-6 Sol за длинный контекст агрессивна по сравнению с его же заявленными цифрами: если запрос превышает 272 000 входных токенов, весь запрос тарифицируется по $4,00 и $15,00, а не только превышение. Для агента, ведущего длинную сессию с большим документом в контексте, это незаметно лишает его большей части преимущества в половинной цене. У Claude Opus 5.5 нет аналогичного порога, поэтому запрос на 400 000 токенов обходится ему по той же ставке за токен, что и запрос на 4 000 токенов.

Где обитают десять точек, потому что они распределены неравномерно

Композитный индекс скрывает собственные компоненты, а этот скрывает необычно неравномерный профиль. Извлеките отдельные оценки, с которыми можно сопоставить показатели обоих поставщиков:

• Humanity's Last Exam — Claude Opus 5.5 61,4% против GPT-6 Sol 47,9%, разрыв в 13,5 пункта в абстрактных рассуждениях
• SciCode — Claude Opus 5.5 66,9% против GPT-6 Sol 57,6%, разрыв в 9,3 пункта на коде исследовательского уровня
• Terminal-Bench 4.0 — Claude Opus 5.5 59,6% против GPT-6 Sol 43,9%
• Воспроизведение в длинном контексте — Claude Opus 5.5 84,7% против GPT-6 Sol 83,7%, разрыв в 1,0 пункта, самый узкий на этой странице
• Многоходовое агентное использование инструментов — обе модели находятся в пределах нескольких пунктов друг от друга в семействе τ²-Bench, где обе сильны

A screenshot of the top of the Artificial Analysis leaderboard table, under the Model, Context Window, Creator, Intelligence Index, Cost per Task, Tokens/s, First Chunk and Response column headings, showing Claude Opus 5.5 (max with fallback) at 58 and $5.98 per index task, Claude Sonnet 5.5 at 56, Claude Opus 5.5 (xhigh) at 56 and (high) at 54, Claude Fable 5.1 at 53, GPT-6 Astra (max) at 53 and $3.26, Gemini 4 Argon (high) at 53 and $1.99, GPT-6 Astra (xhigh) at 52 and GPT-6.1 Sol (max) at 52 and $0.72.

Всё решает распределение. В абстрактных рассуждениях — сложный экзаменационный вопрос, исследовательская задача, для которой нет готового ответа, который можно было бы скопировать, — Claude Opus 5.5 безоговорочно впереди, и разрыв слишком велик, чтобы объясняться шумом. В извлечении факта из очень длинного входного текста оба фактически на одном уровне, а у GPT-6 Sol окно чуть больше. Если ваша нагрузка — это поиск по длинным документам и работа агента в долгих сессиях, эти десять баллов по большей части не ваша проблема. Если же это новые рассуждения — это ваша проблема, и, чтобы их избежать, вам придётся платить в 5,7 раза больше за задачу.

Что внедрение ChatGPT говорит и не говорит вам

Есть соблазн воспринимать фразу «1,2 млрд еженедельных пользователей теперь имеют GPT-6» как свидетельство возможностей. Это не так. Это свидетельство распространения, и OpenAI прямо указывает, что развёртывание ChatGPT работает на GPT-6 Sol для платных тарифов и GPT-6 Luna для Free и Go, причём обе «настроены для повседневного общения» — иная цель оптимизации, чем у API-продукта. Модели, лежащие в основе Work и Codex, в этом релизе не изменились, и это самый ясный сигнал в анонсе о том, что речь идёт о событии для потребительской поверхности, а не о релизе новых возможностей. Всем, кто проводит бенчмарки «GPT-6, которым пользуются 1,2 млрд человек», следует понимать: они измеряют настроенное для чата развёртывание, а не API-эндпоинт.

Что развёртывание действительно меняет, так это выбор по умолчанию. Модель, которая просто доступна всем, оказывается в гораздо большем числе прототипов, внутренних инструментов и незавершённых побочных проектов, чем модель, которую нужно сознательно выбрать. Если вы выбираете API для чего-то долговечного, эта повсеместная привычность чего-то стоит — но она не стоит десяти пунктов индекса и не стоит 5,7-кратной стоимости на задачу в конвейере с интенсивными рассуждениями.

Запуск обоих без выбора

Честный ответ на вопрос «стоит ли переключаться» здесь таков: эти две модели предназначены для разных задач, и вопрос переключения — это в основном вопрос маршрутизации. Обе есть в каталоге OrcaRouter — GPT-6 Sol по цене поставщика $2.00/$10.00, при этом тариф для длинного контекста $4.00/$15.00 передан без изменений, и Claude Opus 5.5 по $4.00/$20.00 — за одним ключом и одним OpenAI-совместимым эндпоинтом, с наценкой 0% к прайс-листу провайдера. Это важно больше обычного в неделю, когда вендор меняет потребительский запуск, потому что наша ценовая строка — это цена провайдера, а не наша.

Схема, подходящая для этой пары, — разделение: направляйте трафик длинных документов и длинных сессий тому из двух, который дешевле при таком количестве токенов, — после 272 000 токенов это уже не GPT-6 Sol, — и отправляйте трафик новых рассуждений в Claude Opus 5.5, при этом GPT-6 Sol оставляется в качестве автоматического переключения при отказе, чтобы ограничение частоты запросов на одном маршруте не превращалось в сбой на вашей стороне. Вам не обязательно разрешать этот десятипунктный спор, чтобы выпустить продукт; вам нужно знать, какие из ваших запросов попадают в ту часть распределения, где это применимо.

A screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, showing the Anthropic vendor label, a 2026-09-22 release date, a 1M-token context window, a 128K-token maximum output, text, image and file input with vision, tool calling, JSON output and reasoning modes, and pricing of $4.00 per million input tokens and $20.00 per million output tokens with a $0.20 cached-input rate.

Вердикт, каков он есть

Claude Opus 5.5 — более сильная модель по показателю, по которому отчитываются обе лаборатории, а на двух оценках, которые важнее всего для сложных рассуждений, он далеко впереди. GPT-6 Sol стоит вдвое дешевле по заявленной цене, обходится в пятую часть стоимости за задачу на независимом наборе тестов и теперь является моделью по умолчанию в приложении, которое уже открыто у большинства ваших коллег. Ни один из этих фактов не изменился на этой неделе; изменилось то, что GPT-6 перестал быть тем, что вам приходилось выбирать, и стал тем, что у вас уже есть.

Следить нужно за тем, станет ли следующий ход OpenAI шагом в развитии возможностей или очередным шагом в дистрибуции. В своём собственном анонсе компания прямо задаёт это ожидание — она говорит, что хочет, чтобы со временем ChatGPT создавал больше интерфейсов, которые нужны людям, — а это дорожная карта о поверхностях, а не о баллах индекса. Если ваше решение зависит от индекса, Claude Opus 5.5 всё ещё выигрывает. Если оно зависит от стоимости при больших объёмах и от того, что модель уже всем известна, GPT-6 Sol сегодня — более безопасный выбор по умолчанию, а пункт о длинном контексте — единственная строка в его тарифной сетке, которую вам придётся заложить в бюджет.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно