Титульная карточка с надписью «Grok 4.7 против Gemini 3.1 Pro» и подзаголовком «Рейтинг изменился; модель — нет», а также три карточки: индекс AA v4.3.2 — 46 против 30, стандартная цена за 1 млн — $2/$6 против $2/$12 и статус — GA против preview.
Guides & Insights

Grok 4.7 против Gemini 3.1 Pro: таблица лидеров изменилась, а модель — нет

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

19 февраля 2026 года Artificial Analysis опубликовала статью под заголовком «Gemini 3.1 Pro Preview: новый лидер в области ИИ». Она лидировала в шести из десяти оценок и опережала Claude Opus 4.6 на четыре балла. Откройте страницу той же модели сегодня — и число — 30, шестьдесят девятое место из 200. Поставщик ничего не изменил. Изменилась линейка: Artificial Analysis пересмотрела свой Intelligence Index до версии v4.3.2 19 сентября 2026 года, переоценив каждую модель в каталоге по другому набору оценок, и февральский лидер стал сентябрьским середняком, в то время как сама модель оставалась нетронутой в предварительной версии. Это фон для сравнения с Grok 4.7 — выпущенным поставщиком 21 сентября 2026 года — и именно поэтому это противостояние меньше о том, какая модель умнее, а больше о том, на какую из этих двух вы всё ещё можете положиться как на нечто неизменное в следующем месяце.

Что каждое из них представляет собой на самом деле

Gemini 3.1 Pro — новейшая модель Google уровня Pro, которая так и не стала общедоступной (GA). Она вышла как gemini-3.1-pro-preview 19 февраля 2026 года, и в таблице устаревания Google она до сих пор указана с пометкой «дата отключения не объявлена» — это превью находится в статусе превью уже семь месяцев, пока Google выпускала под ней линейку Flash: 3.5 Flash в мае, 3.6 в июле, 3.7 в августе, 3.8 в сентябре. Нет GA-модели Pro новее Gemini 3 Pro. У неё входное окно в 1 048 576 токенов и выходной потолок в 65 536 токенов; она принимает текст, изображения, видео, аудио и PDF, а на выходе выдаёт текст, и предоставляет управление уровнем мышления со значениями «низкий», «средний» и «высокий», без параметра бюджета и без минимальной настройки. Веса закрыты.

Grok 4.7 существует всего день и тоже имеет закрытые веса. Он поддерживает контекст в 500 тыс. токенов — половину от контекста Gemini — и принимает текст и изображения, поэтому вообще не может обрабатывать видео или аудио; это самое заметное различие в возможностях в данном сравнении. Его заявленная цена — 2,00 доллара за миллион входных токенов и 6,00 доллара за миллион выходных токенов при длине запроса менее 200 тыс. токенов, повышаясь до 4,00 и 12,00 доллара выше этой отметки, а чтение из кэша стоит 0,50 и 1,00 доллара; xAI также указывает более быстрый вариант примерно с удвоенной скоростью вывода и вдвое большей ценой. В проверенной здесь документации для него не опубликовано максимальное значение объёма вывода.

Линейка сдвинулась. Вот и вся история.

Обе модели сейчас оцениваются по Artificial Analysis Intelligence Index v4.3.2, который заменил Terminal-Bench 2.1 на Terminal-Bench 4.0, а tau3-Banking — на AutomationBench-AA, и заново установил опорные точки шкалы Elo GDPval-AA. Показатель каждой модели сместился, когда он вышел. Показатель Gemini 3.1 Pro сместился сильнее, чем у большинства, потому что его февральские сильные стороны были сосредоточены в оценках, которые новый индекс либо упразднил, либо пересмотрел их вес. Если читать два столбца рядом сегодня:

Композитный — Grok 4.7 (xhigh): 46 в Artificial Analysis Intelligence Index v4.3.2. Gemini 3.1 Pro Preview: 30 в той же редакции, на 69-м месте из 200.

Длинный контекст — Grok 4.7: окно 500k, AA-LCR v1.1 — 77%. Gemini 3.1 Pro: окно 1M — вдвое больше — и потолок вывода 65K, что примерно вдвое меньше того, что обычно нужно агентной сессии с длинным контекстом.

Входные модальности — Grok 4.7: текст и изображения. Gemini 3.1 Pro: текст, изображения, видео, аудио и PDF. Даже близко не стоит, и это не разрыв в бенчмарках — это разрыв в возможностях.

Скорость — Grok 4.7: опубликованных измерений пока нет. Gemini 3.1 Pro: 124,4 выходных токена в секунду, 39-е место из 200, при этом время до первого токена через Google AI Studio составляет 63,62 секунды.

Цена, стандартный тариф — Grok 4.7: $2.00 за вход / $6.00 за выход за 1M. Gemini 3.1 Pro: $2.00 за вход / $12.00 за выход. Одинаковый вход, вдвое больший выход.

Цена, тариф для длинного контекста — Grok 4.7: удваивается до $4.00 / $12.00 при 200 тыс. токенов промпта. Gemini 3.1 Pro: повышается до $4.00 / $18.00 на той же границе в 200 тыс. Тот же ввод, на 50% больше вывода.

Зрелость — Grok 4.7: ему всего один день, вендорные бенчмарки по большей части не воспроизведены. Gemini 3.1 Pro: семь месяцев на рынке, но всё ещё preview-сборка без обязательств по GA и без даты отключения.

OrcaRouter model page for Gemini 3.1 Pro Preview showing the google/gemini-3.1-pro-preview identifier, a 1M-token context window, a 65K maximum output, audio, file, image, text and video input with text output, and list rates of $2.00 per 1M input and $12.00 per 1M output.

Теперь проблема с предпросмотром вполне реальна.

Семимесячное превью было бы скорее странностью, чем риском, если бы с ним ничего не пошло не так. Но кое-что пошло. С 18 сентября 2026 года пользователи начали сообщать, что Gemini 3.1 Pro исчез из селектора моделей AI Studio, и на момент написания этого текста не было ни ответа сотрудников Google, ни уведомления о прекращении поддержки, ни объяснения причины — нерешённый инцидент с доступностью, а не подтверждённый вывод из эксплуатации. Сопоставьте это с историей анонсов: в мае 2026 года на I/O Google заявила, что Gemini 3.5 Pro «выйдет в следующем месяце», а в конце августа пресса сообщила, что от этой модели отказались, поскольку внутренние кандидаты «не превосходили серию Flash в достаточной мере». На собственной странице Pro у Google по-прежнему значится «3.5 Pro скоро выйдет», и это противоречие на одном экране. Каким бы ни было решение, практический вывод таков: Gemini 3.1 Pro — это превью-эндпоинт без даты GA, без названного преемника и с нынешним вопросительным знаком в отношении доступности.

Риск Grok 4.7 — это зеркальное отражение, и он меньше по своей природе. Модели всего один день, поэтому данных о ней мало — Artificial Analysis не опубликовала ни измерений скорости, ни задержки, а собственный набор бенчмарков xAI для неё не был независимо воспроизведён. Вне сомнений остаётся то, что модель общедоступна, имеет цену, документацию и стабильную идентичность. На модели, чья идентичность стабильна, а показатели не доказаны, строить гораздо проще, чем на модели, чьи показатели опубликованы, а доступность — нет.

Чего стоит разделение на практике

Допустим, вы выбираете для конвейера обработки документов. При 100 тыс. входных токенов и 8 тыс. выходных Grok 4.7 стоит $0.20 за вход и $0.048 за выход — примерно четверть доллара. Gemini 3.1 Pro стоит $0.20 за вход и $0.096 за выход — примерно тридцать центов.Эти два варианта различаются в пределах двадцати процентов, и если ваши документы — это сканы, PDF, аудио или видео, Gemini — единственный из двух, кто вообще способен их читать. Это не аргумент из бенчмарков; для такой нагрузки сравнение на этом заканчивается.

Теперь предположим, что вы выбираете модель для агента с длинным контекстом. При входе 300k и выходе 8k Grok 4.7 стоит $1.20 за вход и $0.096 за выход, около $1.30. Gemini 3.1 Pro стоит $1.20 за вход и $0.144 за выход, около $1.35. Практически идентично — и здесь окно в 1M и потолок вывода в 65K у Gemini становятся ограничением, которое решает исход, потому что предел в 65K — это то место, где длительные агентные прогоны ломаются. Ни одна из моделей не является дешёвым вариантом в этом сравнении, и ни одна не является дорогой по меркам фронтирных моделей.

Two-column scoreboard titled “Grok 4.7 vs Gemini 3.1 Pro - the scoreboard”: AA Index 46 vs 30, context 500k vs 1M, input modality “text + image” vs “text + image + video + audio + PDF”, max output “not stated” vs 65k, price per 1M $2/$6 vs $2/$12, and status GA vs preview.

Маршрутизация вокруг движущейся цели

OrcaRouter предоставляет доступ к Gemini 3.1 Pro — она указана на собственной странице модели по тарифам провайдера: $2,00 за вход и $12,00 за выход, с окном 1M и максимальным выводом 65k — потому что мы передаём списочные цены провайдера без наценки, 0%. В подобном случае это не маркетинговая фраза: у Google есть preview-сборка без объявленного срока жизни, доступность которой колебалась в сентябре, и полезное свойство роутера в том, что он сохраняет стабильность интеграции, пока то, что за ней стоит, меняется. Автоматическое переключение при сбое означает, что preview-эндпоинт, который перестал отвечать, становится событием маршрутизации, а не аварией, а DSL маршрутизации позволяет объединить мультимодальную модель с чисто текстовой в одном вызове — именно такую форму и предполагает эта пара: Gemini читает видео, а Grok выполняет рассуждения по его расшифровке. Grok 4.7 на момент написания не входит в каталог OrcaRouter; вызвать её сегодня — значит идти через собственный API xAI и сторонние платформы, которые её предоставляют.

Подход, который стоит выстроить: оставляйте Gemini 3.1 Pro для всего, что должно принимать видео, аудио или PDF, а его статус предварительной версии воспринимайте как операционный риск, который нужно обходить, а не как причину отказываться от него. Grok 4.7 стоит задействовать для работы с текстом и изображениями, где применимы его более низкая цена за вывод и более высокий композитный балл и где модель, которую вы интегрируете сегодня, — это та же модель, к которой вы всё ещё будете обращаться через шесть месяцев. Единственное, чего делать не стоит, — воспринимать 69-е место в рейтинге как вердикт модели: это вердикт пересмотру бенчмарка, а тот же пересмотр, который понизил Gemini 3.1 Pro, понизил и десятки моделей, к которым Google не имел отношения.

Звонок

На текущем индексе Grok 4.7 опережает Gemini 3.1 Pro на шестнадцать пунктов, а по цене вывода он вдвое дешевле в стандартном тарифе и на треть дешевле в тарифе с длинным контекстом. Если ваши задачи — это текст и изображения, этого достаточно, чтобы принять решение. Если ваши задачи — видео, аудио или отсканированные документы, Gemini 3.1 Pro — единственный кандидат из этих двух, и на этом сравнение заканчивается: вы покупаете возможность, а не оценку. Оговорка, которая должна сопровождать оба, касается происхождения, а не производительности: один — семимесячная предварительная версия без даты GA и с сентябрьским инцидентом доступности за плечами, другой — возрастом в один день с громким показателем и без независимого воспроизведения чего-либо ещё. Ни один из них не является устоявшимся выбором. Оба стоит маршрутизировать, а не привязываться к одному окончательно.

Artificial Analysis page for Grok 4.7 at xhigh reasoning effort: an Artificial Analysis Intelligence Index score of 46, ranked #16 of 655; Speed and Cost both reported as N/A; 240M output tokens from the Intelligence Index run, ranked #140 of 655; a 500k-token context window with text and image input and text output; and comparison charts for intelligence, speed and cost per task.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно