
GPT-6.1 Sol vs Grok 4.7: самая низкая цена за вывод среди всех — и самый дорогой разговор
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Grok 4.7, преемник Grok 4.6 от xAI, вышел 21 сентября 2026 года по цене $2.00 за миллион входных токенов и $6.00 за миллион выходных. GPT-6.1 Sol, обновление среднего уровня от OpenAI, вышел восемь дней спустя, 29 сентября, по цене $2.00 за вход и $10.00 за выход. Цены за вход идентичны, а цена за выход у Grok 4.7 на 40% ниже — и именно на этом большинство сравнений останавливается. И останавливаться здесь неправильно, потому что один и тот же независимый совет теперь измерил обе модели от начала до конца: Grok 4.7 сжёг примерно 240 миллионов выходных токенов, проходя Artificial Analysis Intelligence Index; GPT-6.1 Sol сжёг 67 миллионов. Умножьте более низкую ставку на объём, превышающий её в три с половиной раза, — и модель с меньшей ценой за токен обойдётся в $3.74 за выполненную задачу против $0.72.
Две модели, с разницей в восемь дней, и тарифная сетка, которая инвертируется
Grok 4.7 — самая мощная модель xAI для программирования и работы со знаниями: контекстное окно на 500 000 токенов, до 450 000 выходных токенов в одном ответе согласно собственному описанию вендора, ввод текста, изображений и файлов, а также настраиваемый уровень усилий рассуждения: низкий, средний (по умолчанию), высокий и очень высокий. xAI не раскрыла количество параметров, а дата отсечки предобучения указана как июнь 2026 года с дополнительным обучением до августа.
GPT-6.1 Sol — это обновление OpenAI на один шаг для уровня GPT-6 Sol, расположенное ниже GPT-6 Astra и выше GPT-6 Luna: 1 050 000 токенов контекста — примерно вдвое больше, чем у Grok, — при максимальном объёме вывода в 128 000 токенов, что примерно треть от Grok, дата отсечки знаний — 30 апреля 2026 года, и те же текстовые, графические и файловые входные данные. Его лестница рассуждений проходит от low до max со значением по умолчанию medium, и оно больше вообще не принимает none.
По одной строке на каждое измерение, обе стороны — на каждом:
• Ввод — GPT-6.1 Sol $2,00 за 1 млн против Grok 4.7 $2,00 за 1 млн; одинаково
• Вывод — GPT-6.1 Sol $10,00 за 1 млн против Grok 4.7 $6,00 за 1 млн; Grok дешевле на 40%
• Кэшированный ввод — GPT-6.1 Sol $0,10 за 1 млн против Grok 4.7 $0,50 за 1 млн; Sol в пять раз дешевле — противоположность тому, что следует из строки вывода
• Контекстное окно — 1 050 000 токенов против 500 000
• Максимальный вывод в одном ответе — 128 000 токенов против заявленных 450 000
• Тарифный шаг для длинного контекста — пересчитывает стоимость всего запроса при превышении 272 000 входных токенов: 2× для ввода и кэша и 1,5× для вывода, против удвоения всех ставок при превышении 200 000 входных токенов, также для всего запроса
• Усилие рассуждений — низкое, среднее (по умолчанию), высокое, xhigh, максимальное против низкое, среднее (по умолчанию), высокое, xhigh
• Веса и параметры — закрытые, нераскрытые против закрытых, нераскрытых; ни один из них не даёт вам чекпойнт
• Индекс интеллекта при максимальном опубликованном усилии — GPT-6.1 Sol 51,8 при максимальном усилии против Grok 4.7 46,4 при xhigh
• Стоимость одной задачи индекса, независимо — $0,72 против $3,74
• Выходные токены в прогоне индекса — 67 миллионов против 240 миллионов, на фоне медианы по таблице лидеров около 81 миллиона
Всё это сравнение — две строки в том списке. Ставка Grok 4.7 за вывод действительно ниже, а строка кэша у него действительно в пять раз выше; а чтобы его измерить, он сгенерировал в три с половиной раза больше токенов. Тарифная сетка, если читать её отдельно, указывает в одну сторону. Измерение же указывает в другую — с пятикратным перевесом.

Где Grok 4.7 на самом деле впереди
Было бы нечестно преподносить эту статью как разгром, потому что Grok 4.7 побеждает в реальных оценках. Оценённые бок о бок при максимальном опубликованном усилии на Artificial Analysis v4.3.2 — Grok на xhigh, Sol на max, разница в конфигурации, которую стоит учитывать на всём протяжении:
• GDPval-AA v2.1 — Grok 4.7 Elo 1715.4 против GPT-6.1 Sol Elo 1575.1. Преимущество в 140 пунктов Elo на экономически ценной интеллектуальной работе и крупнейшая отдельная независимая победа модели с более низким тарифом.
• AutomationBench-AA — Grok 4.7 0.6556 против GPT-6.1 Sol 0.6487. Фактически ничья, номинально за Grok.
• SciCode — Grok 4.7 0.5741 против GPT-6.1 Sol 0.5417. Преимущество в 3.2 пункта в научном программировании.
• Terminal-Bench 4.0 — Grok 4.7 0.2576 против GPT-6.1 Sol 0.5606. Отставание в 30 пунктов — крупнейший разрыв в этой паре.
• Humanity's Last Exam — Grok 4.7 0.4314 против GPT-6.1 Sol 0.5292.
• AA-LCR v1.1, рассуждение на длинном контексте — Grok 4.7 0.7667 против GPT-6.1 Sol 0.83.
• AA-Omniscience — Grok 4.7 32.0 против GPT-6.1 Sol 41.5.
• GDP.pdf — Grok 4.7 0.20 против GPT-6.1 Sol 0.31.
• CritPt — Grok 4.7 0.1771 против GPT-6.1 Sol 0.3171.
В трёх из девяти оценок побеждает Grok 4.7 или фиксируется ничья, включая ту, с которой труднее всего спорить: GDPval-AA создан, чтобы оценивать в деньгах экономически ценную профессиональную работу, и преимущество в 140 пунктов Elo — не шум. Если ваша рабочая нагрузка относится к тому типу, который GDPval был призван отражать, — анализ с большим объёмом документов, профессиональные результаты работы, решения, требующие суждения и имеющие правильный ответ, — то модель с более дешёвой тарифной сеткой также оказывается лучшей моделью на нейтральном табло, а более высокая стоимость за задачу — это цена, которую вы за это платите.
Собственные цифры запуска xAI внушительны и, как и все стартовые показатели вендоров, невоспроизведены. CursorBench 4.0 — 46,3% при xhigh против 40,4% у Grok 4.6; Terminal-Bench 4.0 — 38,0% против 20,3%, самый крупный единичный заявленный прирост в релизе; DeepSWE v1.1 — 71,0% при high против 65,2%; EEBench — 64,0% против 53,0%. Это стенд xAI, настройки xAI, отчётность xAI — и обратите внимание, что заявленные 38,0% в Terminal-Bench 4.0 идут вразрез с 0,2576 независимого борда для той же модели на том же бенчмарке, а это как раз то расхождение, которого следует ожидать между настроенной конфигурацией вендора и нейтральным прогоном с максимальными усилиями.
Показатели OpenAI для GPT-6.1 Sol заслуживают такого же дисконта и имеют тот же недостаток. Единственная цифра в этом сравнении, которую не привёл ни один из вендоров, — это стоимость одной выполненной задачи, потому что она рассчитывается на основе измеренного потребления токенов, а не из таблицы баллов. Именно эта цифра и остаётся.
Почему 240 миллионов токенов решают всё
Artificial Analysis описывает многословность Grok 4.7 в своей собственной сводке, и количество токенов, стоящее за прогоном индекса, служит доказательством: 240 миллионов выходных токенов против медианы по таблице около 81 миллиона — примерно в три раза больше того, что выдаёт типичная модель на том же наборе тестов. 67 миллионов у GPT-6.1 Sol находятся значительно ниже медианы. Сопоставьте два соотношения — объём в 3,6 раза больше при цене в 0,6 раза — и более низкая цена за выходные токены означает покупку большего числа токенов, а не меньшего счёта; именно так и выглядит разница в стоимости за задачу: $3,74 против $0,72.
Кэширование меняет размер эффекта, но не его направление, и именно эта деталь сбивает людей с толку. Кэшированный ввод Grok 4.7 стоит $0,50 за миллион против $0,10 у Sol — в пять раз дороже на той строке, где живут длинные истории агентов и повторяющиеся системные промпты. Поэтому рабочая нагрузка, в которой доминирует повторное чтение большого стабильного префикса, обнаруживает, что две модели ближе, чем предполагают $6 против $10, а после применения многословности Grok — дальше друг от друга, чем предполагают ставки на ввод. Здесь строка кэша и строка токенов указывают в одну сторону, что необычно и делает это сопоставление чище, чем подразумевают тарифные карты.
Пункты о длинном контексте стоит оценивать отдельно, потому что они срабатывают в разных точках. GPT-6.1 Sol пересчитывает весь запрос по другой цене при превышении 272 000 входных токенов; Grok 4.7 делает то же самое выше 200 000. На запросе в 250 000 токенов Grok уже удвоил цену — $4.00 и $12.00 при чтении из кэша за $1.00 — тогда как Sol всё ещё на своих стандартных $2.00 и $10.00. В диапазоне от 200 000 до 272 000 токенов модель с более дешёвой тарифной сеткой оказывается значительно более дорогой, и этот диапазон часто встречается в работе с документами.
Там, где Grok действительно выигрывает по структуре, а не по оценке, — это потолок вывода. Максимальный ответ в 450 000 токенов против 128 000 у Sol — это иной класс артефактов: целая сгенерированная кодовая база, длинная стенограмма, синтез размером с книгу за один вызов. Если сегодня вы упираетесь в ограничения на вывод, эта строка решает сравнение, и ничто из приведённой выше арифметики затрат не применяется — вы не можете купить возможность, которой нет у другой модели, ни по какой цене.
Оба находятся на одной клавише — это и есть самое полезное.
Grok 4.7 доступен на OrcaRouter по собственной прайс-листовой цене xAI — $2,00 и $6,00 за миллион токенов при чтении из кэша за $0,50, а переход после 200 000 токенов к $4,00 и $12,00 передаётся в точности так, как указывает xAI, — а GPT-6.1 Sol появился на наших маршрутах в день релиза по цене OpenAI: $2,00 и $10,00, кэшированный ввод — $0,10, а порог в 272 000 токенов остался без изменений. Ни к одному из них ничего не добавляется: платформа передаёт прайс-листовую цену провайдера, а не делает наценку, — а значит, снижение цены вендором для любого из них вступает в силу здесь в тот же день, когда вступает в силу там, без второго счёта и без посредника-перепродавца.

Для этой конкретной пары это важнее удобства. Две модели расходятся в том, в чём они сильны, — Grok 4.7 лидирует по Elo в профессиональных задачах и в научном программировании, GPT-6.1 Sol лидирует в выполнении терминальных команд, фактической надёжности и извлечении из длинного контекста, — и граница между этими типами нагрузки видна в вашем собственном трафике раньше, чем в бенчмарке. Отправлять запросы в формате GDPval в одну сторону, а длительные агентные прогоны — в другую, за одним эндпоинтом, с автоматическим фейловером между обоими и правилом маршрутизации, которое вы меняете в конфигурации, а не в деплое, — более дешёвый способ найти эту границу, чем проект по оценке. Объединение моделей (model fusion), когда панель моделей отвечает совместно, — это другая опция, которую предлагает платформа, если вы предпочитаете вообще не выбирать на уровне отдельного запроса.

Звонок
• Длинные выводы в агентных и терминальных задачах, циклы с кэшированным префиксом — GPT-6.1 Sol. Тридцать баллов на Terminal-Bench 4.0, строка кэша в пять раз дешевле и пятая часть стоимости за выполненную задачу.
• Профессиональная работа со знаниями, анализ документов, задачи на суждение — Grok 4.7 за счёт преимущества в 140 пунктов Elo в GDPval-AA, причём счёт за токены заложен в бюджет, а не предполагается.
• Научное программирование — Grok 4.7, с небольшим перевесом, по категории SciCode в таблице лидеров. Проверьте это на собственном наборе тестов; 3,2 пункта — в пределах диапазона, который может сдвинуть другой набор промптов.
• Единичные ответы объёмом более 128 000 выходных токенов — Grok 4.7, и никакая арифметика этого не заменит.
• Запросы объёмом от 200 000 до 272 000 входных токенов — GPT-6.1 Sol, потому что Grok 4.7 уже удвоил весь свой запрос, а Sol — нет.
• Самый дешёвый возможный разговор — ни одна из этих двух. Обе — модели с ценами фронтирного уровня и фронтирным аппетитом к токенам; сравнение о том, какая из них завершит вашу задачу, а не о том, какая дешевле в абстракции.
• Если сравнение заканчивается словами «Grok дешевле за токен» — оно закончилось на шаг слишком рано. Следующий шаг — количество токенов, а это 240 миллионов против 67.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
