Титульная карточка для статьи, сравнивающей GPT-6 Sol с Grok 4.7: заголовок «GPT-6 Sol vs Grok 4.7», подзаголовок «Более дешёвый токен, который стоит в три раза дороже», статистика «240M vs 77M выходных токенов», где у Grok 4.7 — $6.00 за выходные токены и $3.74 за задачу, а у GPT-6 Sol — $10.00 за выходные токены и $1.06 за задачу.
Guides & Insights

GPT-6 Sol против Grok 4.7: более дешёвый токен, который стоит втрое дороже

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две модели вышли с разницей в один день в сентябре 2026 года, и на ценнике они совсем не близки. Grok 4.7 появилась 21 сентября по цене $2.00 за миллион входных токенов и $6.00 за миллион выходных токенов. GPT-6 Sol вышла 22 сентября при тех же $2.00 за вход и $10.00 за выход. Выход у Grok дешевле на 40%. Именно на этом основании большинство сравнений выберут её, и это не тот показатель, на который следует смотреть.

Число, которое решает это сопоставление, не указано ни в одной из таблиц тарифов. Это 240 миллионов против 77 миллионов — столько выходных токенов сгенерировала каждая модель, пока Artificial Analysis проводила свой Intelligence Index. Grok 4.7 израсходовала чуть более чем в три раза больше токенов, чтобы ответить на тот же набор вопросов. Умножьте это на тариф за токен — и модель с более дешёвым выходом в итоге обходится в $3.74 за выполненную задачу против $1.06. Дешевле за токен, но счёт больше чем в три раза.

Что на самом деле представляет собой каждая модель

Grok 4.7 — преемник Grok 4.6 от xAI, позиционируемый как её самая сильная модель для программирования и работы со знаниями, с контекстным окном на 500 000 токенов, вводом текста и изображений, выводом текста и настраиваемым уровнем усилий при рассуждении: low, medium, high и xhigh. xAI не раскрыла количество параметров. Заявленная дата отсечения предварительного обучения — июнь 2026 года, а дополнительное обучение продолжалось по август.

GPT-6 Sol — это модель GPT-6 среднего уровня от OpenAI — ниже флагманской GPT-6 Astra, выше бюджетной GPT-6 Luna — с окном контекста в 1 050 000 токенов, максимальным вводом в 922 000 токенов, потолком вывода в 128 000 токенов и датой отсечения знаний 20 апреля 2026 года. Она принимает текст и изображения, выдаёт текст, а усилие рассуждения варьируется от none до max; OpenAI описала её цены как постоянные, а не промоакционные.

Контекстные окна не близки. У Sol оно примерно вдвое больше. Это имеет значение ровно для одного класса рабочих нагрузок, и это не тот класс, который запускает большинство людей.

Тарифная карта и строка, которая её инвертирует

• Ввод — GPT-6 Sol $2,00 за миллион токенов против Grok 4.7 $2,00 за миллион токенов; идентично

• Вывод — GPT-6 Sol $10.00 за миллион токенов против Grok 4.7 $6.00 за миллион токенов; Grok дешевле на 40%

Кэшированный ввод — GPT-6 Sol $0.20 за миллион токенов против Grok 4.7 $0.50 за миллион токенов; чтение из кэша у Sol дешевле в два с половиной раза, что противоположно тому, что подразумевает тариф на вывод.

• Запись в кэш — GPT-6 Sol $2.50 за миллион токенов против Grok 4.7, ставка для которого не опубликована в той же таблице

• Контекстное окно — у GPT-6 Sol 1 050 000 токенов против 500 000 токенов у Grok 4.7

• Надбавка за длинный контекст — GPT-6 Sol пересчитывает запрос объёмом свыше 272 000 входных токенов по ставкам 2× за входные данные и кэш и 1,5× за выходные данные для всего запроса, тогда как Grok 4.7 удваивает все ставки при 200 000 входных токенов, также для всего запроса

• Дата отсечки знаний — GPT-6 Sol, 20 апреля 2026 г., по сравнению с Grok 4.7, где дата отсечки предварительного обучения указана как июнь 2026 г., с дополнительным обучением по август включительно.

• Усилие рассуждения — GPT-6 Sol: нет, низкий, средний (по умолчанию), высокий, очень высокий, максимальный, против Grok 4.7: низкий, средний (по умолчанию), высокий, очень высокий

• Модальность — на входе текст и изображение, на выходе текст, в обоих случаях

Именно на строке с кэшем покупателю и стоит задержаться. У Grok ставка за вывод ниже, но его кэшированный ввод в два с половиной раза выше, чем у Sol, а кэшированный ввод — это то, где живут длинные истории агента и повторяющиеся системные промпты. Рабочая нагрузка, которая в основном перечитывает большой стабильный контекст, обнаружит, что эти двое гораздо ближе друг к другу, чем предполагает $6 против $10, — а как только сверху применяется соотношение объёма токенов, порядок меняется на противоположный.

A six-row scoreboard card titled 'GPT-6 Sol vs Grok 4.7 - the scoreboard', comparing the two models on output price, cached input, context window, Intelligence Index score, index output tokens and cost per task. The left column lists GPT-6 Sol at $10.00 output, $0.20 cached input, a 1,050,000-token context, an Index of 48, 77M index tokens and $1.06 per task; the right column lists Grok 4.7 at $6.00 output, $0.50 cached input, a 500,000-token context, an Index of 46, 240M index tokens and $3.74 per task. A footer reads 'Vendor list prices; index figures per Artificial Analysis.'

Почему 240 миллионов токенов — это вся история

Artificial Analysis измерила Grok 4.7 в режиме xhigh: за прогон индекса модель сгенерировала примерно 240 млн выходных токенов, тогда как медиана для моделей в той же таблице составляет около 88 млн. В своём собственном резюме она называет модель «заметно медленной и очень многословной». GPT-6 Sol, измеренный на том же стенде, сгенерировал 77 млн — в таблице он описан как «довольно лаконичный».

Совет также прямо сообщает о последствии. Grok 4.7 набирает 46 баллов в Индексе интеллекта при $3.74 за задачу. На высокой настройке оценка также составляет 46, а стоимость — $2.73 за задачу. GPT-6 Sol набирает 48 баллов при $1.06 за задачу. Тот же индекс, тот же стенд и разница в стоимости в два–три с половиной раза, которую не отражает ни один прайс-лист.

Две оговорки, прежде чем воспринимать эти показатели как чистое прямое сравнение. Обе страницы были зафиксированы в один и тот же день, но на табло указаны разные итоговые значения — на странице Grok показан класс из 212 моделей, а в отдельном листинге Grok сообщается о месте в рейтинге из 655, — поэтому нет гарантии, что обе оценки относятся к одной и той же сборке индекса. И ни один из этих показателей не является числом от вендора: Artificial Analysis использует собственный испытательный стенд, в этом и смысл, но настройки рассуждений в двух листингах различаются (xhigh для Grok, max для Sol), поэтому главным выводом считайте пятисотпроцентный разрыв в стоимости, а разрыв в индексе в два пункта — приблизительным.

Screenshot of the Artificial Analysis model page for Grok 4.7 (xhigh), captured 23 September 2026, showing an Intelligence Index score of 46, list pricing of $2.00 per million input tokens and $6.00 per million output tokens with a 75% cache discount, a cost of $3.74 per Intelligence Index task, 240 million output tokens generated during the index run, a 500,000-token context window and 39.2 output tokens per second.

Что опубликовала xAI и что никто не проверил

Собственные стартовые показатели xAI сильны и, как и все стартовые показатели вендоров, не воспроизведены. CursorBench 4.0 — 46,3% при xhigh против 40,4% у Grok 4.6. Terminal-Bench 4.0 — 38,0% против 20,3% — крупнейший единичный прирост в релизе. DeepSWE v1.1 — 71,0% при high против 65,2%. EEBench — 64,0% против 53,0%. Это стенд xAI, настройки xAI, отчётность xAI.

Цифры OpenAI для GPT-6 Sol подчиняются той же закономерности и заслуживают такого же дисконта. Разница в том, что у Sol на один элемент независимых доказательств больше, чем у Grok: показатель стоимости за задачу от Artificial Analysis, который рассчитывается на основе измеренного потребления токенов, а не на основе таблицы оценок поставщика. Именно это число и выдерживает данное сравнение.

Чего никто не публиковал ни для одной из этих моделей, так это прямого сравнения на одних и тех же задачах с одним и тем же харнессом и одной и той же настройкой усилий. Если увидите такое, проверьте, какая из этих трёх переменных изменилась.

Расчёт стоимости за месяц кэшированного агентского трафика

Возьмём рабочую нагрузку, которая в основном представляет собой стабильный контекст: агент для программирования с системным промптом размером 60 000 токенов и сводкой репозитория; этот контекст перечитывается при 5 000 вызовах в месяц, каждый из которых возвращает 4 000 выходных токенов. Предположим, что кэширование работает, а стабильный префикс тарифицируется по ставке для кэша.

На GPT-6 Sol: 300 миллионов кэшированных входных токенов по $0,20 за миллион — это $60,00. Двадцать миллионов выходных токенов по $10,00 за миллион — это $200,00. Итого — $260,00.

Для Grok 4.7: те же 300 миллионов кэшированных входных токенов по $0,50 за миллион — это $150,00. Двадцать миллионов выходных токенов по $6,00 за миллион — это $120,00. Итого $270,00.

Почти идентично — и это при постоянном объёме токенов, что является щедрым допущением. Измеренная многословность Grok 4.7 в прогоне по индексу была в три раза выше, чем у Sol. Примените даже множитель 1,5× к объёму вывода, и счёт Grok вырастает до $330.00 против $320.00 у Sol, и дальше разрыв только увеличивается. Более низкая цена за вывод не выдерживает кэширования плюс многословности; она едва выдерживает одно кэширование.

Здесь нет утверждений о цене ни одной из моделей через OrcaRouter — ни одна из них не входит в наш каталог. GPT-6 Sol доступна через собственный API OpenAI, а Grok 4.7 — через xAI; остальные модели линейки Grok, включая Grok 4.6, маршрутизируются через нас по прейскурантной цене xAI в рамках модели pass-through. Смысл этих расчётов в том, что правило эскалации, которое вы прописываете, должно основываться на стоимости одной выполненной задачи на вашем собственном трафике, а не на тарифной сетке — и именно слой маршрутизации позволяет протестировать это правило без второго договора.

Screenshot of OrcaRouter's model page for Grok 4.6, captured 23 September 2026, showing the model id grok/grok-4.6 from provider SpaceXAI, a 500,000-token context window, text, image and file input, list pricing of $2.00 per million input tokens and $6.00 per million output tokens, and an OpenAI-compatible API served over both /v1/chat/completions and /v1/responses. Grok 4.7 itself does not appear on the catalogue.

Где каждому свое место

• Массовая работа агентов с кэшированным контекстом — GPT-6 Sol. Строка кэшированного ввода в 2,5 раза в пользу Sol, а строка объёма вывода хуже, чем у Grok, и они усиливают друг друга.

• Для задач по программированию, где вам нужно самое сильное опубликованное улучшение Terminal-Bench в этом релизе — Grok 4.7 — это модель с этим показателем, и он большой. Просто закладывайте бюджет на токены, а не на тариф.

• Длинные документы объёмом более 500 000 токенов — GPT-6 Sol, и это даже не близко. Окно Grok заканчивается там, где окно Sol проходит только половину.

• Пути, чувствительные к задержке, — ни то, ни другое. Artificial Analysis указывает, что Grok 4.7 выдаёт 39,2 выходных токена в секунду, и описывает это как заметно медленную скорость. Проверьте собственный показатель скорости Sol в текущей таблице, прежде чем предполагать, что он лучше.

• Если вам показали сравнение стоимости за токен, которое заканчивается словами «значит, Grok дешевле», — оно завершилось на один шаг слишком рано. Следующий шаг — количество токенов.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно