Сгенерированная hero-карточка для GPT-6.1 Sol против Gemini 3.1 Pro с заголовком «Семь месяцев предварительного просмотра, восемь дней поставок», с двумя информационными карточками с текстом «Gemini 3.1 Pro: анонсирована 19 февраля 2026 года, всё ещё preview-эндпоинт, Intelligence Index 29.7» и «GPT-6.1 Sol: выпущен 29 сентября 2026 года, готовый продукт, Intelligence Index 51.8», нижним колонтитулом с текстом «Показатели индекса по данным Artificial Analysis, Intelligence Index v4.3.2; цены по данным Google и OpenAI.» и логотипом OrcaRouter в правом нижнем углу.
Guides & Insights

GPT-6.1 Sol против Gemini 3.1 Pro: семь месяцев превью против восьми дней с момента выпуска

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Gemini 3.1 Pro уже семь с половиной месяцев числится в прайс-листе вендора и за всё это время так и не вышел из статуса preview. Анонсированный 19 февраля 2026 года, задокументированный сегодня на эндпоинте, оканчивающемся на -preview, он не имеет ни обязательства о переходе в общий доступ, ни — что показательнее — даты отключения. GPT-6.1 Sol существует всего восемь дней: он вышел 29 сентября 2026 года по цене $2,00 за миллион входных и $10,00 за миллион выходных токенов. Поставьте их рядом в Индексе интеллекта Artificial Analysis — и семимесячный preview не просто конкурентоспособен: в самой свежей ревизии индекса он отстаёт от более новой модели меньше чем на 22 пункта — 29,7 против 51,8 на v4.3.2 — и при этом обходится в 1,8 раза дороже за одну задачу индекса: $1,30 против $0,72. Именно из-за этого сочетания сравнение интересно, а не формально: в этом зачёте старая модель одновременно уступает по возможностям и проигрывает по стоимости, а для preview, которому полагалось дорасти до релиза, это перевёрнутая логика. Но оговорка о ревизии индекса здесь важнее, чем где-либо ещё в этом наборе, потому что 29,7 и 53 цитируются на одном и том же сайте, а это не одно и то же измерение.

Обе — большие мультимодальные модели с контекстными окнами класса 1M. Gemini 3.1 Pro принимает текст, изображения, видео, аудио и PDF-файлы с ограничением вывода в 65 536 токенов и ценовым уровнем в 200 000 токенов, выше которого тариф удваивается. GPT-6.1 Sol принимает текст, изображения и файлы с окном в 1 050 000 токенов, ограничением вывода в 128 000 токенов, пятью уровнями усилий рассуждения и уровнем длинного контекста свыше 272 000 токенов промпта. Один — это выпущенный продукт с обязательством поддержки. Другой — предварительная версия с неограниченным жизненным циклом, и эта разница, как выясняется, стоит больше, чем разрыв в индексе.

К номеру индекса необходимо прикрепить его ревизию.

Artificial Analysis заново прогоняет свой набор тестов и заново публикует оценки в соответствии с текущей редакцией индекса, а значит, одна и та же модель может иметь два разных числа в зависимости от того, когда вы посмотрите. Для Gemini 3.1 Pro этот разрыв необычно велик: в более раннем материале самой компании об этой модели сообщалось 57 по старой редакции, тогда как страница в её нынешнем виде указывает 29,7 на v4.3.2 — версии с десятью оценками, где также фигурирует 51,8 у GPT-6.1 Sol. Обе цифры реальны, и обе находятся на одном и том же сайте.

Что это означает для сравнения, узко и важно. Вычитать можно только числа из одной и той же ревизии. 29,7 и 51,8 из v4.3.2 дают разрыв в 22 пункта; 57 и 51,8 дают разрыв в пять пунктов в другую сторону. Именно показатель в 22 пункта и следует здесь использовать, потому что именно в нём обе модели измерялись одним и тем же набором тестов по одной и той же шкале — и потому что показатели стоимости за задачу, $1,30 против $0,72, взяты из того же прогона.

• Intelligence Index, v4.3.2 — GPT-6.1 Sol 51.8 против Gemini 3.1 Pro 29.7

• Стоимость одной задачи индексации — GPT-6.1 Sol $0.72 против Gemini 3.1 Pro $1.30

• Стоимость запуска полного набора тестов — GPT-6.1 Sol $1,082 против Gemini 3.1 Pro $1,935

• Контекстное окно — GPT-6.1 Sol: 1 050 000 токенов против Gemini 3.1 Pro: 1 000 000 токенов

• Максимальный объём вывода — 128 000 токенов у GPT-6.1 Sol против 65 536 токенов у Gemini 3.1 Pro

• Входные модальности — текст, изображение и файл в обоих случаях, а также видео, аудио и PDF в Gemini 3.1 Pro

Две из этих строк говорят в пользу preview-версии и заслуживают того, чтобы сказать о них прямо. Gemini 3.1 Pro принимает видео и аудио, а GPT-6.1 Sol — нет; если ваш конвейер обрабатывает на входе запись экрана или звонок, это тот разрыв в возможностях, который не закроет никакой балл. А его потолок вывода в 65 536 токенов вдвое ниже, чем у GPT-6.1 Sol, — это важно для генерации длинных текстов, но редко становится ограничением в агентных задачах, где выводы короткие, а ходов много.

Почему именно более новое число должно определять ваше решение

Вопрос цены интереснее вопроса индекса.

Тарифная сетка Gemini 3.1 Pro: $2.00 за вход и $12.00 за выход за миллион токенов, кэшированный ввод — $0.20, запись в кэш — $0.375, а граница уровня — 200 000 токенов промпта, выше которой тарифы становятся $4.00 и $18.00. У GPT-6.1 Sol — $2.00 за вход и $10.00 за выход, кэшированный ввод — $0.10, запись в кэш — $2.50, а граница — 272 000 токенов, выше которой его тарифы становятся $4.00 и $15.00. Основная цена ввода идентична. Цена вывода у GPT-6.1 Sol на 20% ниже, и ступень для длинного контекста ниже по обеим осям. А вот в чём две тарифные сетки расходятся — это кэширование: $0.10 против $0.20 за миллион кэшированных входных токенов, при этом preview-модель записывает кэш дешевле — $0.375 против $2.50.

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, credited to Google and dated 2026-02-19, showing the -preview model identifier, text, image, video, audio and file input with text output, a 1M-token context window with a 65K maximum output, and a rate row reading $2.00 input and $12.00 output per million tokens alongside a 10.60-second median time to first token and an 11.3M seven-day traffic figure.

Эта последняя пара переворачивает поверхностное прочтение. Если ваша нагрузка активно использует кэш — длинный фиксированный системный промпт, отправляемый заново каждый ход, или документ, перечитываемый в течение сессии, — строка записи в кэш у Gemini 3.1 Pro радикально дешевле, а строка чтения из кэша вдвое дороже. Какая модель выиграет, зависит от того, сколько раз вы перечитываете то, что уже записали, а это число содержится в ваших собственных логах, и его не публикует ни один бенчмарк. Что не допускает разночтений — это стоимость индекса: на идентичной оценочной работе восьмидневная модель завершила её на 33% дешевле, а семимесячная preview-версия в целом завершила её на 79% дороже, чем более новая модель.

Значок предварительного просмотра — это операционный факт.

Это та часть сравнения, которую не способна передать таблица с оценками, и для развёртывания в продакшене она важнее всего вышеперечисленного.

Gemini 3.1 Pro находится в предварительном доступе с февраля: нет ни объявления о выходе в общий доступ, ни даты отключения. Оба этих отсутствия важны, и они работают в противоположных направлениях. Отсутствие GA означает отсутствие обязательств по жизненному циклу: на эндпоинты предварительного доступа не распространяются те же условия уведомления об устаревании, что и на общедоступные, и их могут изменить без повышения версии, даже если вызывающая сторона уже их использует, — именно поэтому в продакшене принято закреплять точный идентификатор модели, а не алиас. Отсутствие даты отключения означает, что окно миграции тоже нельзя спланировать, — модель уже просуществовала дольше квартала, в котором все ожидали её перехода в общий доступ, а это семейство уже отключало Pro-модель раньше.

Позиция GPT-6.1 Sol — это зеркальное отражение. Ему восемь дней, а значит, его история независимых оценок ограничивается одной конфигурацией, а режимы отказов не задокументированы; нет корпуса практиков, к которому можно обратиться, когда он сбоит. Сам факт его выпуска был новостью, и он поставляется в рамках структуры поддержки, которой нет у предварительной версии.

Это разные риски, а не разная степень риска. Выберите предварительную версию — и вы делаете ставку на то, что вендор продолжит обслуживать эндпоинт, не имея контрактных обязательств это делать. Выберите модель возрастом восемь дней — и вы делаете ставку на то, что одного прогона бенчмарка и восьми дней доступности достаточно как доказательства для вашей рабочей нагрузки. Индекс не поможет ни с тем, ни с другим.

Единственное, что сделало бы это простым

Анонс общего доступа к Gemini 3.1 Pro с идентификатором модели вне пространства имён -preview и опубликованным обязательством по жизненному циклу решил бы большую часть этой проблемы. Он не закрыл бы разрыв в 22 пункта по индексу или разрыв в стоимости за задачу в 1,8×, но устранил бы риск обесценивания, который сейчас делает сравнение однобоким, и позволил бы команде внедрить модель, не фиксируя идентификатор предварительной версии и не надеясь на удачу.

Отсутствие этого объявления спустя семь с половиной месяцев — само по себе информация. Предварительная версия, которая, по февральской формулировке поставщика, должна была «вскоре» проверить обновления перед выходом в GA, имела для этого два полных квартала. Либо валидация всё ещё идёт, либо предварительная версия и есть продукт — и вызывающая сторона не может определить это извне. Что вызывающая сторона может сделать — это оценить неопределённость и маршрутизировать соответствующим образом.

Оба на одном ключе, поэтому ответ может быть отдельным для каждой рабочей нагрузки.

A screenshot of OpenAI's developer model page for GPT-6.1 Sol, headed 'GPT-6.1 Sol' with the tagline 'Near-Astra performance for complex work at a lower cost', showing a 1,050,000-token context window with 128,000 max output tokens and an Apr 30, 2026 knowledge cutoff, a price row reading $2 input and $10 output per million tokens, and the note that reasoning.effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.

Gemini 3.1 Pro доступен на OrcaRouter по собственным указанным тарифам — $2.00 / $12.00, с повышением до $4.00 / $18.00 при превышении 200 000 токенов промпта, при этом чтение из кэша — $0.20. GPT-6.1 Sol доступен на OrcaRouter по $2.00 / $10.00, с повышением до $4.00 / $15.00 при превышении 272 000 токенов промпта, при этом чтение из кэша — $0.10. В обоих случаях — цена по прайс-листу провайдера, ничего не добавлено, один ключ и один счёт.

Это позволяет недорого уладить неудобные части этого сравнения. Приём видео и аудио остаётся на предварительной версии, потому что больше ничто в этой паре его не принимает; работа с большими объёмами текста и кода уходит к более новой модели, которая дешевле в расчёте на задачу и на 33% дешевле при идентичной работе по оценке. Если эндпоинт предварительной версии будет изменён или отозван, автоматическое переключение при сбое переведёт эти вызовы на другой маршрут, а не завершит их с ошибкой — это именно та страховка, которой требует риск жизненного цикла предварительной версии. А поскольку оба находятся за одним эндпоинтом, совместимым с OpenAI, сравнение цен, которое действительно имеет значение, можно провести на собственном трафике за один день, а не спорить о нём, исходя из тарифной сетки.

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 3.1 Pro — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 29.7 on v4.3.2; cost per index task $0.72 against $1.30; input price $2.00 against $2.00; output price $10.00 against $12.00; maximum output 128,000 against 65,536 tokens; lifecycle released September 29, 2026 against a preview running since February 19, 2026. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; prices per OpenAI and Google as listed on OrcaRouter.'

Итак, обоснованное прочтение таково: дело не в том, какая модель лучше. Оно в том, что эти две стоят почти одинаково, хотя их разделяют семь месяцев по зрелости жизненного цикла и 22 пункта в текущем независимом лидерборде, и что реальные преимущества preview-модели — видео- и аудиовход, дешёвая запись в кэш — узки и специфичны. Если вашей рабочей нагрузке нужны эти модальности, Gemini 3.1 Pro — единственный вариант из двух, а разрыв в индексе — это плата за вход. Если нет, вам предлагают preview-эндпоинт с открытым будущим по стоимости за задачу на 80% выше, чем у модели, вышедшей на прошлой неделе, и бремя доказывания работает в обратную сторону.