
GPT-5.6 против Grok 4.6: вровень по индексу, разница в контексте и цене
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0240Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0340Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2134Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123Интеллект49Кодинг
По шкале Artificial Analysis Intelligence Index, по которой обе модели оценивались по состоянию на начало сентября 2026 года, OpenAI GPT-5.6 — чей флагманский уровень, GPT-5.6 Sol, соответствует имени API gpt-5.6 — и SpaceXAI Grok 4.6 набрали одинаковое число: 61. Независимый индекс, ставящий два конкурирующих флагмана на один уровень, — это редчайший результат в сравнении передовых моделей, и именно здесь это соперничество становится интересным, а не завершается. Модели, которые сравнялись, продаются совершенно по-разному. GPT-5.6 Sol, флагман, выпущенный OpenAI 9 июля и перепозиционированный как её доступный уровень после запуска GPT-6 Astra 3 сентября, стоит $4.00 за миллион входных токенов и $20.00 за миллион выходных после снижения цены 24 августа и поддерживает контекст объёмом примерно до 1,05 миллиона токенов. Grok 4.6, выпущенный xAI 12 августа, стоит $2.00 / $6.00 и ограничен 500 000 токенов. Одинаковый балл в независимом рейтинге — а затем модели расходятся в том, насколько далеко можно продвинуть один запрос, — и в том, сколько это продвижение стоит.
Эта страница существует сейчас по конкретной причине: два прайс-листа и два потолка изменились в течение нескольких недель друг от друга. Grok 4.6 вышел 12 августа, а 28 августа стал доступен в обычных чатах Grok в вебе и на мобильных устройствах после первоначальных двух недель, ограниченных Grok Build и API. Промо-снижение цены GPT-5.6 Sol состоялось 24 августа, а десять дней спустя запуск GPT-6 Astra тихо понизил Sol с флагмана до доступного флагмана. Обе модели ниже — это то, к чему вы тянетесь, когда хотите рассуждений уровня, близкого к передовому, не платя по ценам класса Astra, — именно поэтому ничья 61:61 стала живой точкой принятия решения, а не тривиальным вопросом.
Что означает «счет 61:61» и что это не значит
Оценке нужны дата и шкала. Artificial Analysis измерила GPT-5.6 Sol примерно на 61 и Grok 4.6 на 61 по шкале индекса, использовавшейся до начала сентября, — той самой шкале, на которую ссылаются другие сравнения GPT-5.6 в этом блоге, — при этом Grok занял 11-е место среди 202 моделей, отслеживаемых AA, а Sol оказался в паре позиций от него с тем же баллом. Затем AA перекалибровала индекс 7 сентября (v4.3) — версия, которая сжимает баллы: GPT-5.6 Sol показывает там 47, GPT-6 Astra и Claude Fable 5.1 — 53, а общего балла Grok 4.6 по новой шкале пока опубликовано не было. Таким образом, ничья ниже — это утверждение о сентябрьской шкале до перекалибровки, и её лучше всего читать как относительную позицию: по самому свежему индексу, в котором оценивались обе модели, эти две находились на одном уровне, и обе стояли сразу за классом Claude Opus 5.
Ещё одна оговорка по поводу ничьей, и она важна для того, как вы её используете. Эти два результата были получены при разных настройках усилий — GPT-5.6 Sol на максимальном рассуждении, самой высокой настройке OpenAI (которая запускает четыре параллельных субагента на сложных запросах), и Grok 4.6 на высоком, настройке xAI по умолчанию на её шкале от «низкого» до «сверхвысокого». Обе конфигурации — это режимы «выложиться по полной», но это не одна и та же конфигурация, и ничья относится именно к этим двум конкретным настройкам, а не ко всем настройкам, которые предлагают модели. Что действительно показывает равный результат, так это то, что ни одна из моделей не обладает преимуществом в общем интеллекте, на которое другая сторона могла бы указать в независимом композитном тесте — поэтому покупателю, выбирающему между ними, приходится смотреть не только на индекс, но и на контекст, цену и доказательства, которые каждая сторона может реально предъявить.
Две тарифные карты, два обрыва
Оба вендора тарифицируют длинный промпт как событие премиум-класса, и оба тарифицируют весь запрос по более высокому тарифу после пересечения порога — это общий механизм, который делает это сравнение цен наглядным. Тариф OpenAI для GPT-5.6 Sol составляет $4.00 / $20.00 за миллион токенов, с кэшированным чтением по $0.40, и как только запрос превышает примерно 272K входных токенов, весь запрос пересчитывается по тарифу $8.00 / $30.00 — структура длинного контекста, задокументированная Epoch AI 8 сентября. Тариф xAI для Grok 4.6 составляет $2.00 / $6.00 с кэшированным чтением по $0.50, и как только промпт превышает 200K токенов, весь запрос переходит на тариф $4.00 / $12.00.
• Выпущено — GPT-5.6: 9 июля 2026 года (публичный API; псевдоним gpt-5.6 достигает уровня Sol). Grok 4.6: 12 августа 2026 года.
• Цена по прайс-листу за 1M (вход / выход) — GPT-5.6 Sol: $4.00 / $20.00, чтения из кэша $0.40 (промо как минимум до 21 ноября 2026 г.). Grok 4.6: $2.00 / $6.00, чтения из кэша $0.50.
• Тариф для длинных промптов — GPT-5.6 Sol: весь запрос — $8.00 / $30.00 при входном контексте свыше ~272K. Grok 4.6: весь запрос — $4.00 / $12.00 при входном контексте 200K.
• Контекст / потолок вывода — GPT-5.6 Sol: ~1,05 млн на вход, 128K на выход. Grok 4.6: 500K на вход, опубликованного ограничения вывода нет.
• Index (независимый) — GPT-5.6 Sol (max) ~61 против Grok 4.6 (high) 61, по сентябрьской шкале до перекалибровки.
• Модальность — обе принимают текст и изображения на входе и создают текст.
Прогоните готовые цифры — и закономерность недвусмысленна: при любой длине промпта, которую Grok 4.6 может обслужить, он оказывается более дешёвым вариантом, поскольку его пересмотренный потолок по-прежнему находится на уровне или ниже стандартной ставки GPT-5.6 Sol.
• 100K на входе / 8K на выходе — GPT-5.6 Sol: 0.10 × $4 + 0.008 × $20 = $0.56. Grok 4.6: 0.10 × $2 + 0.008 × $6 = $0.25. Grok примерно на 55% дешевле для этого запроса.
• 400K на вход / 30K на выход (обе цены пересмотрены) — GPT-5.6 Sol: 0.40 × $8 + 0.03 × $30 = $4.10. Grok 4.6: 0.40 × $4 + 0.03 × $12 = $1.96. Grok по-прежнему примерно вдвое дешевле, даже после своего собственного скачка цен.
• 600K вход / 30K выход — GPT-5.6 Sol: 0.60 × $8 + 0.03 × $30 = $5.70. Grok 4.6: не может — 600K превышает его контекстное окно в 500K. Это диапазон, где Sol — единственный вариант, и где его цена перестаёт выглядеть премиальной.

Геометрия ценового обрыва отличается одним аспектом, который играет на руку GPT-5.6 Sol: его порог (272K) расположен выше, чем у Grok (200K), поэтому существует диапазон — примерно от 200K до 272K входных токенов, — где Grok уже пересмотрел цены, а Sol ещё нет. Даже там Grok обычно выигрывает по долларам, потому что его пересмотренная ставка на выходные токены в $12 всё ещё на 40% ниже стандартных $20 у Sol. Экономика меняется в пользу Sol только после 500K токенов, а это ровно та область, куда окно контекста Grok попасть не может. Если длина ваших промптов остаётся менее 200K — что справедливо для большинства чат-трафика, RAG и ассистентов кода, — Grok 4.6 в масштабе дешевле почти в два раза по смешанной стоимости, а обрыв для всего запроса означает, что к 200K следует относиться как к границе планирования, а не как к мягкой рекомендации.
Для чего на самом деле нужны дополнительные полмиллиона токенов Sol
Окно в 500K у Grok 4.6 охватывает больше реальных рабочих нагрузок, чем можно предположить по спецификациям: чтение всей кодовой базы, длинные транскрипты действий агента, большие контексты для поиска — а отсутствие опубликованного ограничения на выход помогает на стороне генерации: для одного вызова, который должен выдать очень длинный артефакт, у Grok нет задокументированного потолка, тогда как GPT-5.6 Sol останавливается на 128K выходных токенов. Преимущество GPT-5.6 Sol лежит в диапазоне от 500K до 1.05M, и рабочие нагрузки, которым это действительно нужно, уже, чем подразумевает маркетинг: агенты, удерживающие в контексте весь репозиторий плюс длинную историю задач, очень длинные стенограммы встреч или исследований, анализируемые за один проход, и задачи поиска по корпусам, слишком большим для разбиения на окна размером с Grok. Если ни один из ваших пайплайнов не затрагивает этот диапазон, дополнительный контекст Sol — это запас, за который вы платите по тарифу $4.00 за входные токены, не используя его.
Эти две модели также по-разному управляют рассуждением. GPT-5.6 Sol предлагает регулятор усилий: низкий / средний / высокий / максимальный, где максимальный режим запускает четыре параллельных субагента, координирующих выполнение сложных задач — фактически небольшой рой агентов на каждый трудный запрос, мощный, но затратный по выходным токенам, и именно эта настройка стоит за индексом ~61. Grok 4.6 работает как единая модель с регулятором от низкого до xhigh (по умолчанию — высокий) и серверными инструментами для поиска и выполнения кода, что делает его поведение более предсказуемым для бюджета: один запрос, одна модель, стоимость, которую можно оценить по прайс-листу. Для разработчика, которому нужны детерминированные расходы, одномодельная архитектура Grok проще в эксплуатации; для самых сложных долгосрочных задач рой максимальных усилий Sol является более мощной конфигурацией — и именно поэтому его лучшие результаты и самые большие счета исходят из одной и той же настройки.
Доказательства, которые каждая сторона может на самом деле представить
Ни у одной из моделей нет независимого преимущества по рейтингу кодинга, поэтому доказуемые данные разделяются по вендорам. OpenAI сообщает о примерно 96% для GPT-5.6 Sol на SWE-bench Verified — это самое сильное подтверждение по кодингу, которое может показать любая из моделей, но это заявленная оценка без опубликованного независимого аудита, — а реальное преимущество Sol включает в себя работу внутри инструментов Codex и ChatGPT. xAI сообщает о 94,9% для Grok 4.6 на GPQA Diamond, который она называет самым высоким результатом среди всех протестированных на этом бенчмарке, и приводит агентные оценки со средней стоимостью API около $0,84 за комплексную задачу; оба показателя — цифры от вендора. По скорости две модели ближе, чем предполагает разница в цене: AA зафиксировал Grok 4.6 на уровне 64,9 выходных токенов в секунду, а GPT-5.6 Sol — в том же диапазоне середины 60-х при стандартном обслуживании, при этом отдельный предварительный просмотр OpenAI «Ultrafast» на базе Cerebras (до примерно 750 токенов в секунду) остаётся ограниченным и без цены. Читайте всю таблицу данных так: ничья по индексу, подтверждения по кодингу с обеих сторон без независимого аудита ни у одной из них и отсутствие разрыва в скорости, который изменил бы решение.
Какой дефолт рационален в сентябре 2026 года?
Выбирайте Grok 4.6, если ваш трафик укладывается в 200K токенов на вход — при каждой поддерживаемой длине цена почти вдвое ниже, независимый индекс показывает, что модели сопоставимы, а простая настройка на одну модель с серверными инструментами делает счёт предсказуемым. Выбирайте GPT-5.6 Sol, если вам действительно нужен диапазон контекста от 500K до 1.05M токенов, если ваш стек уже нативен для Codex или ChatGPT, а опубликованный показатель ~96% по SWE-bench даёт отделу закупок подтверждение качества кода, или если вам нужна опция конфигурации с четырьмя субагентами в режиме максимальной отдачи для самых трудных задач с длинным горизонтом. И следите за двумя датами: акция GPT-5.6 Sol по цене $4/$20 гарантирована как минимум до 21 ноября 2026 года, после чего это сравнение изменится, а xAI уже намекнула на Grok 4.7 — любое из этих событий может пересмотреть ценовое соотношение в той паре, которую вы собираетесь сделать стандартом.
Запуск обоих без изменения архитектуры
Поскольку равенство в индексе означает, что это решение о потолке и цене, а не о качестве, практический паттерн для большинства команд — маршрутизировать, а не выбирать. GPT-5.6 Sol и Grok 4.6 доступны на OrcaRouter по прейскурантным ценам своих провайдеров, передаются без наценки — в листинге указаны $4/$20 для OpenAI и $2/$6 для xAI, и когда любой из вендоров меняет тариф, новая цена появляется на том же ключе в тот же день. С помощью одного OpenAI-совместимого эндпоинта вы можете направлять трафик до 200K в Grok 4.6, передавать на эскалацию промпты, которым нужен более длинный контекст Sol или его конфигурация максимальных усилий, и использовать автоматическое переключение при сбое, чтобы ограничение скорости на одном пути провайдера было событием маршрутизации, а не отказом

Ценовая половина этого сравнения — та часть, которая меняется: акция OpenAI на Sol гарантирована только до 21 ноября, а у xAI в дорожной карте значится 4.7, — поэтому справочным материалом, который этот блог поддерживает в актуальном состоянии, является страница цен на GPT-5.6 Sol, с датой проверки и повторной верификацией при каждом изменении тарифной карты.

Двухстрочный ответ
Если ваши промпты укладываются в 500 000 токенов — а у большинства так и есть — Grok 4.6 показывает тот же независимый индексный балл, что и GPT-5.6 Sol, примерно за половину цены на любой длине, которую он может обслужить, без опубликованного лимита вывода и с предсказуемым одномодельным регулятором. GPT-5.6 Sol оправдывает свою премиальную цену в диапазоне, недоступном Grok: за пределами 500 000 токенов контекста и внутри инструментария OpenAI, где его заявленные ~96% SWE-bench Verified и уровни Terra и Luna под ним дают вам семейство моделей, а не одну модель. Ничья по индексу означает, что это решение зависит от потолков и денег, а не от возможностей — так что измерьте свои самые длинные реальные промпты, прежде чем решаться, потому что это единственное число выбирает победителя.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
