
GPT-6.1 Sol против Gemini 3.1 Pro: семь месяцев превью против восьми дней с момента выпуска
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Gemini 3.1 Pro уже семь с половиной месяцев числится в прайс-листе вендора и за всё это время так и не вышел из статуса preview. Анонсированный 19 февраля 2026 года, задокументированный сегодня на эндпоинте, оканчивающемся на -preview, он не имеет ни обязательства о переходе в общий доступ, ни — что показательнее — даты отключения. GPT-6.1 Sol существует всего восемь дней: он вышел 29 сентября 2026 года по цене $2,00 за миллион входных и $10,00 за миллион выходных токенов. Поставьте их рядом в Индексе интеллекта Artificial Analysis — и семимесячный preview не просто конкурентоспособен: в самой свежей ревизии индекса он отстаёт от более новой модели меньше чем на 22 пункта — 29,7 против 51,8 на v4.3.2 — и при этом обходится в 1,8 раза дороже за одну задачу индекса: $1,30 против $0,72. Именно из-за этого сочетания сравнение интересно, а не формально: в этом зачёте старая модель одновременно уступает по возможностям и проигрывает по стоимости, а для preview, которому полагалось дорасти до релиза, это перевёрнутая логика. Но оговорка о ревизии индекса здесь важнее, чем где-либо ещё в этом наборе, потому что 29,7 и 53 цитируются на одном и том же сайте, а это не одно и то же измерение.
Обе — большие мультимодальные модели с контекстными окнами класса 1M. Gemini 3.1 Pro принимает текст, изображения, видео, аудио и PDF-файлы с ограничением вывода в 65 536 токенов и ценовым уровнем в 200 000 токенов, выше которого тариф удваивается. GPT-6.1 Sol принимает текст, изображения и файлы с окном в 1 050 000 токенов, ограничением вывода в 128 000 токенов, пятью уровнями усилий рассуждения и уровнем длинного контекста свыше 272 000 токенов промпта. Один — это выпущенный продукт с обязательством поддержки. Другой — предварительная версия с неограниченным жизненным циклом, и эта разница, как выясняется, стоит больше, чем разрыв в индексе.
К номеру индекса необходимо прикрепить его ревизию.
Artificial Analysis заново прогоняет свой набор тестов и заново публикует оценки в соответствии с текущей редакцией индекса, а значит, одна и та же модель может иметь два разных числа в зависимости от того, когда вы посмотрите. Для Gemini 3.1 Pro этот разрыв необычно велик: в более раннем материале самой компании об этой модели сообщалось 57 по старой редакции, тогда как страница в её нынешнем виде указывает 29,7 на v4.3.2 — версии с десятью оценками, где также фигурирует 51,8 у GPT-6.1 Sol. Обе цифры реальны, и обе находятся на одном и том же сайте.
Что это означает для сравнения, узко и важно. Вычитать можно только числа из одной и той же ревизии. 29,7 и 51,8 из v4.3.2 дают разрыв в 22 пункта; 57 и 51,8 дают разрыв в пять пунктов в другую сторону. Именно показатель в 22 пункта и следует здесь использовать, потому что именно в нём обе модели измерялись одним и тем же набором тестов по одной и той же шкале — и потому что показатели стоимости за задачу, $1,30 против $0,72, взяты из того же прогона.
• Intelligence Index, v4.3.2 — GPT-6.1 Sol 51.8 против Gemini 3.1 Pro 29.7
• Стоимость одной задачи индексации — GPT-6.1 Sol $0.72 против Gemini 3.1 Pro $1.30
• Стоимость запуска полного набора тестов — GPT-6.1 Sol $1,082 против Gemini 3.1 Pro $1,935
• Контекстное окно — GPT-6.1 Sol: 1 050 000 токенов против Gemini 3.1 Pro: 1 000 000 токенов
• Максимальный объём вывода — 128 000 токенов у GPT-6.1 Sol против 65 536 токенов у Gemini 3.1 Pro
• Входные модальности — текст, изображение и файл в обоих случаях, а также видео, аудио и PDF в Gemini 3.1 Pro
Две из этих строк говорят в пользу preview-версии и заслуживают того, чтобы сказать о них прямо. Gemini 3.1 Pro принимает видео и аудио, а GPT-6.1 Sol — нет; если ваш конвейер обрабатывает на входе запись экрана или звонок, это тот разрыв в возможностях, который не закроет никакой балл. А его потолок вывода в 65 536 токенов вдвое ниже, чем у GPT-6.1 Sol, — это важно для генерации длинных текстов, но редко становится ограничением в агентных задачах, где выводы короткие, а ходов много.
Почему именно более новое число должно определять ваше решение
Вопрос цены интереснее вопроса индекса.
Тарифная сетка Gemini 3.1 Pro: $2.00 за вход и $12.00 за выход за миллион токенов, кэшированный ввод — $0.20, запись в кэш — $0.375, а граница уровня — 200 000 токенов промпта, выше которой тарифы становятся $4.00 и $18.00. У GPT-6.1 Sol — $2.00 за вход и $10.00 за выход, кэшированный ввод — $0.10, запись в кэш — $2.50, а граница — 272 000 токенов, выше которой его тарифы становятся $4.00 и $15.00. Основная цена ввода идентична. Цена вывода у GPT-6.1 Sol на 20% ниже, и ступень для длинного контекста ниже по обеим осям. А вот в чём две тарифные сетки расходятся — это кэширование: $0.10 против $0.20 за миллион кэшированных входных токенов, при этом preview-модель записывает кэш дешевле — $0.375 против $2.50.

Эта последняя пара переворачивает поверхностное прочтение. Если ваша нагрузка активно использует кэш — длинный фиксированный системный промпт, отправляемый заново каждый ход, или документ, перечитываемый в течение сессии, — строка записи в кэш у Gemini 3.1 Pro радикально дешевле, а строка чтения из кэша вдвое дороже. Какая модель выиграет, зависит от того, сколько раз вы перечитываете то, что уже записали, а это число содержится в ваших собственных логах, и его не публикует ни один бенчмарк. Что не допускает разночтений — это стоимость индекса: на идентичной оценочной работе восьмидневная модель завершила её на 33% дешевле, а семимесячная preview-версия в целом завершила её на 79% дороже, чем более новая модель.
Значок предварительного просмотра — это операционный факт.
Это та часть сравнения, которую не способна передать таблица с оценками, и для развёртывания в продакшене она важнее всего вышеперечисленного.
Gemini 3.1 Pro находится в предварительном доступе с февраля: нет ни объявления о выходе в общий доступ, ни даты отключения. Оба этих отсутствия важны, и они работают в противоположных направлениях. Отсутствие GA означает отсутствие обязательств по жизненному циклу: на эндпоинты предварительного доступа не распространяются те же условия уведомления об устаревании, что и на общедоступные, и их могут изменить без повышения версии, даже если вызывающая сторона уже их использует, — именно поэтому в продакшене принято закреплять точный идентификатор модели, а не алиас. Отсутствие даты отключения означает, что окно миграции тоже нельзя спланировать, — модель уже просуществовала дольше квартала, в котором все ожидали её перехода в общий доступ, а это семейство уже отключало Pro-модель раньше.
Позиция GPT-6.1 Sol — это зеркальное отражение. Ему восемь дней, а значит, его история независимых оценок ограничивается одной конфигурацией, а режимы отказов не задокументированы; нет корпуса практиков, к которому можно обратиться, когда он сбоит. Сам факт его выпуска был новостью, и он поставляется в рамках структуры поддержки, которой нет у предварительной версии.
Это разные риски, а не разная степень риска. Выберите предварительную версию — и вы делаете ставку на то, что вендор продолжит обслуживать эндпоинт, не имея контрактных обязательств это делать. Выберите модель возрастом восемь дней — и вы делаете ставку на то, что одного прогона бенчмарка и восьми дней доступности достаточно как доказательства для вашей рабочей нагрузки. Индекс не поможет ни с тем, ни с другим.
Единственное, что сделало бы это простым
Анонс общего доступа к Gemini 3.1 Pro с идентификатором модели вне пространства имён -preview и опубликованным обязательством по жизненному циклу решил бы большую часть этой проблемы. Он не закрыл бы разрыв в 22 пункта по индексу или разрыв в стоимости за задачу в 1,8×, но устранил бы риск обесценивания, который сейчас делает сравнение однобоким, и позволил бы команде внедрить модель, не фиксируя идентификатор предварительной версии и не надеясь на удачу.
Отсутствие этого объявления спустя семь с половиной месяцев — само по себе информация. Предварительная версия, которая, по февральской формулировке поставщика, должна была «вскоре» проверить обновления перед выходом в GA, имела для этого два полных квартала. Либо валидация всё ещё идёт, либо предварительная версия и есть продукт — и вызывающая сторона не может определить это извне. Что вызывающая сторона может сделать — это оценить неопределённость и маршрутизировать соответствующим образом.
Оба на одном ключе, поэтому ответ может быть отдельным для каждой рабочей нагрузки.

Gemini 3.1 Pro доступен на OrcaRouter по собственным указанным тарифам — $2.00 / $12.00, с повышением до $4.00 / $18.00 при превышении 200 000 токенов промпта, при этом чтение из кэша — $0.20. GPT-6.1 Sol доступен на OrcaRouter по $2.00 / $10.00, с повышением до $4.00 / $15.00 при превышении 272 000 токенов промпта, при этом чтение из кэша — $0.10. В обоих случаях — цена по прайс-листу провайдера, ничего не добавлено, один ключ и один счёт.
Это позволяет недорого уладить неудобные части этого сравнения. Приём видео и аудио остаётся на предварительной версии, потому что больше ничто в этой паре его не принимает; работа с большими объёмами текста и кода уходит к более новой модели, которая дешевле в расчёте на задачу и на 33% дешевле при идентичной работе по оценке. Если эндпоинт предварительной версии будет изменён или отозван, автоматическое переключение при сбое переведёт эти вызовы на другой маршрут, а не завершит их с ошибкой — это именно та страховка, которой требует риск жизненного цикла предварительной версии. А поскольку оба находятся за одним эндпоинтом, совместимым с OpenAI, сравнение цен, которое действительно имеет значение, можно провести на собственном трафике за один день, а не спорить о нём, исходя из тарифной сетки.

Итак, обоснованное прочтение таково: дело не в том, какая модель лучше. Оно в том, что эти две стоят почти одинаково, хотя их разделяют семь месяцев по зрелости жизненного цикла и 22 пункта в текущем независимом лидерборде, и что реальные преимущества preview-модели — видео- и аудиовход, дешёвая запись в кэш — узки и специфичны. Если вашей рабочей нагрузке нужны эти модальности, Gemini 3.1 Pro — единственный вариант из двух, а разрыв в индексе — это плата за вход. Если нет, вам предлагают preview-эндпоинт с открытым будущим по стоимости за задачу на 80% выше, чем у модели, вышедшей на прошлой неделе, и бремя доказывания работает в обратную сторону.
