
Что такое Gemini 3.1 Pro? Уровень Pro от Google не менялся семь месяцев
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Gemini 3.1 Pro — единственная действующая модель уровня Pro в своей собственной линейке. Она была анонсирована 19 февраля 2026 года, и семь месяцев спустя документация производителя по моделям по-прежнему относит её к категории «Preview» на эндпоинте gemini-3.1-pro-preview — ни общего доступа, ни даты отключения, ни выпущенного преемника. За те же семь месяцев производитель выпустил пять релизов Flash, и новейший из них, Gemini 3.8 Flash, теперь набирает на одиннадцать баллов больше в независимом индексе, на который ссылается большинство. Этот разрыв — причина, по которой страница, объясняющая, что такое Gemini 3.1 Pro, должна начинаться с того, чем она не является.
Если вам нужна версия из двух предложений: Gemini 3.1 Pro — это модель рассуждений с закрытыми весами и нативной мультимодальностью от Google DeepMind, которая читает текст, изображения, видео, аудио и PDF-файлы и пишет текст. Вы вызываете её через собственные API Google или через маршрутизатор, который предоставляет к ней доступ; она принимает до 1 048 576 входных токенов, а её стоимость составляет $2.00 за миллион входных токенов и $12.00 за миллион выходных токенов при длине запроса менее 200 000 токенов. Она остаётся надёжной рабочей лошадкой для длинного контекста и мультимодальных задач. Это уже не та модель, которую выбирают потому, что она самая умная из доступных.
Какое место оно занимает в своей собственной семье
Это та часть, которую большинство обзоров пропускают, и именно она важнее всего. Семейство Gemini 3 — это не одна лестница с Pro на вершине. Это две лестницы, которые перестали быть сопоставимыми.
Изменилась именно линейка Flash. В документации Google по моделям, прочитанной 23 сентября 2026 года, в качестве новых стабильных релизов перечислены Gemini 3.8 Flash, Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking, а за ними всё ещё остаются стабильными Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash и Gemini 3.5 Flash-Lite. Gemini 3.8 Flash вышел 2 сентября 2026 года — третий выпуск Flash за шесть недель.
А вот линейка Pro — это та, которая не получила продолжения. В документации Google нет Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro или 3.8 Pro. Gemini 3 Pro — модель, которую должен был заменить Gemini 3.1 Pro, — указана как отключённая. Gemini 2.5 Pro всё ещё работает, но доступ к ней ограничен кругом прежних пользователей. В итоге Gemini 3.1 Pro остаётся единственным эндпоинтом Gemini 3 уровня Pro, к которому можно обратиться сегодня, — не потому, что он выиграл гонку, а потому, что никто больше в неё не заявился.
Заявленный план Google в феврале состоял в том, что предварительная версия будет длиться достаточно долго, чтобы «проверить эти обновления» и продвинуть такие области, как амбициозные агентные рабочие процессы, прежде чем модель станет «скоро общедоступной». Это слова Google из февральского анонса. Спустя семь месяцев этого не произошло, и сообщения о задержке стоит прямо обозначить как сообщения, а не как факт: SemiAnalysis пришла к выводу, что работа над Gemini 3.5 Pro была тихо отменена, а Wall Street Journal, как цитируют вторичные издания, сообщила, что внутренний кандидат 3.5 Pro был отброшен, поскольку не смог превзойти серию Flash. Официальная позиция Google такова: 3.5 Pro остаётся в ограниченном тестировании с партнёрами, и подтверждённого месяца нет. Мы не смогли найти заявление Google, подтверждающее или опровергающее отмену, и не собираемся выбирать сторону за них.
Практическое следствие — ловушка в названиях. Если вы отправитесь искать «самый новый Gemini Pro», то самой свежей моделью уровня Pro, которую вы найдёте, окажется версия за февраль, тогда как номера версий в линейке Flash уже дошли до 3.8. Номера версий здесь не отражают соотношение возможностей между уровнями; это два отдельных релизных потока.
Характеристики, которые имеют значение
Все приведённые ниже цифры взяты из собственной документации Google по Gemini API от 23 сентября 2026 года, если не указано иное.
• Входной контекст — 1 048 576 токенов, то же окно в миллион токенов, которое Google предоставляет начиная с поколения 2.5. Объём вывода отдельно ограничен 65 536 токенами — это предел для ответа, а не для диалога.
• Входные модальности — текст, изображение, видео, аудио и PDF. Выходные модальности — только текст. Нет генерации аудио, нет генерации изображений, нет Live API, поэтому это не модель для голосового агента в реальном времени или пайплайна изображений. Google выпускает отдельные варианты Gemini 3.x Flash для этих задач.
• Рассуждения — поддерживаются, с управлением уровнем мышления. Токены мышления тарифицируются по тарифу вывода, поэтому именно цена вывода — это число, которое доминирует в вашем счёте.
• Инструментарий — кэширование, выполнение кода, вызов функций, привязка к Поиску, привязка к Картам, структурированные выходные данные, контекст URL, Batch API, гибкий инференс и приоритетный инференс — все указаны как поддерживаемые. Поиск по файлам указан как поддерживаемый только в AI Studio.
• Лицензия и веса — проприетарные. Открытых весов нет, нет чекпоинта для скачивания и нет возможности самостоятельного хостинга. Любой путь к этой модели — это хостируемый API.
• Эндпоинты — gemini-3.1-pro-preview — это код модели. Google также указывает gemini-3.1-pro-preview-customtools как вариант. Эндпоинт предварительной версии может быть изменён без вашего ведома и без изменения версии, и это стандартная причина, по которой в продакшене закрепляют точные ID моделей, а не алиасы.
• Задокументированная дата обновления — на странице модели указано: «Последнее обновление: февраль 2026 г.». Мы не смогли найти дату отсечки знаний, указанную на собственной странице модели Google; сторонние каталоги указывают на январь 2025 года, и мы отмечаем это как неподтверждённое, а не повторяем как факт.
Сколько это стоит
У Gemini 3.1 Pro есть ценовой обрыв, и это как раз та деталь, из-за которой выглядящая дешёвой смета превращается в счёт с удвоенной суммой. Опубликованные Google цены для разработчиков зависят от размера промпта, а не от версии модели.
• Стандартный уровень, промпты до 200 000 токенов — 2,00 $ за миллион входных токенов, 12,00 $ за миллион выходных токенов, при этом токены мышления считаются выходными.
• Стандартный тариф, промпты объёмом более 200 000 токенов — $4.00 за вход и $18.00 за выход. Обе ставки удваиваются на одном и том же пороге. В этом и ловушка: нагрузка с длинным контекстом платит вдвое больше заявленной ставки именно потому, что использует функцию, ради которой и была куплена модель.
• Кэширование контекста — $0,20 или $0,40 за миллион кэшированных токенов в зависимости от того, с какой стороны от порога в 200 000 вы находитесь, плюс хранение кэша по цене $4,50 за миллион токенов в час.
• Тарифы Batch и Flex — $1.00 за ввод и $6.00 за вывод при объёме менее 200 000 токенов; $2.00 и $9.00 — выше этого порога. Примерно вдвое дешевле для задач, которые могут подождать.
• Приоритетный уровень — $3.60 за ввод и $21.60 за вывод ниже порога, $7.20 и $32.40 — выше него.
• Бесплатный уровень — недоступен для этой модели. Нет бесплатного лимита запросов, на который можно было бы опираться при прототипировании.
Стоит знать две вещи о том, насколько надёжны эти цифры. Собственная страница цен Google является здесь авторитетным источником, и мы читали её напрямую, поэтому приведённые выше цифры актуальны по состоянию на 23 сентября 2026 года. Но сторонние листинги этой модели действительно противоречивы — один трекер указывает ставку $2.50 / $15.00, другой — смешанную ставку $4.50, — и причина в ступенчатой тарификации. Если страница называет вам одну цифру для Gemini 3.1 Pro, не сообщая, к какому диапазону размера запроса она относится, эта цифра непригодна для реальной оценки.
В чём оно измеримо хорошо, а в чём — измеримо нет
Начните с того, что заявляет Google, затем держите это отдельно от того, что измерили независимые оценщики, потому что с февраля эти два показателя резко разошлись.
В собственном анонсе Google приводится ровно одна цифра бенчмарка: «подтверждённый результат 77,1%» на ARC-AGI-2 — Google описывает его как более чем вдвое превышающий показатели Gemini 3 Pro в рассуждениях. Это цифра самого вендора, взятая из собственного поста Google, и единственная, которую мы смогли там подтвердить. В публикациях о запуске фигурировал гораздо более широкий набор — GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity’s Last Exam — но этих цифр нет в собственном анонсе Google, а вторичные отчёты расходятся между собой по тем показателям, которые мы проверили (GPQA Diamond фигурирует и как 94,1, и как 94,3 — в зависимости от источника). Мы не публикуем их как установленные результаты.
Независимая картина — вот где история делает поворот. В версии индекса Artificial Analysis Intelligence Index, действовавшей на 23 сентября 2026 года, Gemini 3.1 Pro Preview набирает 30 баллов и занимает 81-е место среди 212 моделей этого класса. Медианная модель в классе набирает 25 баллов, так что она находится выше среднего, — а лидер на том же графике, Claude Opus 5 при максимальной настройке рассуждений, набирает 58. Сам индекс — это версионируемая линейка, а не фиксированная: Artificial Analysis пересмотрела его после февральского запуска, и её собственные заметки о пересмотре фиксируют новые оценки, вошедшие в составной показатель. Сообщалось, что Gemini 3.1 Pro был безоговорочным лидером индекса в том виде, в каком он существовал на момент февральского запуска, с 57 баллами. Это не та же линейка, что и 30, и мы не собираемся ставить эти два числа рядом так, будто они отражают снижение.
Что текущее сопоставление действительно показывает, так это настоящий профиль, и он однобокий:
• Интеллект — 30 по индексу, 81-е место из 212. Выше медианы, далеко от переднего края.
• Скорость — 116,5 выходных токенов в секунду, 38-е место из 212. Заметно быстро для модели рассуждений.
• Стоимость — $0,67 за выполнение одной задачи Intelligence Index, 31-е место из 212. Это дёшево в расчёте на единицу работы, потому что модель экономно расходует токены мышления.
• Многословность — 67 млн выходных токенов на прохождение индекса против медианы по классу в 88 млн. 39-е место из 212; Artificial Analysis называет это «довольно лаконичным». Для сравнения: Gemini 3.8 Flash при высоком уровне рассуждений сжигает 170 млн токенов на том же наборе и стоит $1,24 за задачу — больше, чем Gemini 3.1 Pro, несмотря на более дешёвую цену за токен.
Так что честная оценка не в том, что «старая модель проигрывает везде». Gemini 3.1 Pro быстр и экономичен по токенам, а если считать стоимость на задачу, он обходит своего более нового собрата. Что он теряет — так это верхний уровень возможностей, и в любой рабочей нагрузке, где качество является связывающим ограничением, это единственная ось, которая имеет значение.

Вопрос о доступности в сентябре
Вокруг этой модели есть одно актуальное событие, и это скорее вопрос, чем релиз. С 18 сентября 2026 года пользователи на собственном форуме разработчиков AI Studio от Google сообщают, что Gemini 3.1 Pro исчез из селектора моделей AI Studio — в заголовке темы изменение датируется 2026-09-18 — при этом платные пользователи говорят, что их перевели на Gemini 3.8 Flash, а оттуда — на 3.7 и 3.6 Flash. Ни один сотрудник Google не ответил в теме, которую мы читали, нет уведомления о прекращении поддержки, и причина не названа. Когда мы проверяли 23 сентября 2026 года, модель всё ещё была указана и всё ещё доступна для вызова через Gemini API и через наш собственный каталог.
Мы помечаем это как нерешённые сообщения пользователей на собственном форуме Google, а не как вывод из эксплуатации и не как сбой. Но если ваш продакшен-путь зависит именно от этой модели, это повод настроить фолбэк, а не исходить из того, что preview-эндпоинт — это постоянная величина.
Кому стоит это выбрать, а кому — нет
Выбирайте Gemini 3.1 Pro, если ваша задача — длинная и мультимодальная. Окно в миллион токенов с нативной поддержкой видео, аудио и PDF по-прежнему остаётся причиной выбрать её, и возраст модели ничего в этом не меняет. Если конкретнее: анализ целого репозитория, аудит часов записанных встреч или видеоматериалов, извлечение структурированных данных из наборов документов со смешанными медиа — или любой пайплайн, где один промпт действительно превышает 200 000 токенов, а альтернатива — слой поиска, который вам пришлось бы создавать и оценивать. Её эффективность по токенам — это реальный второй аргумент: она завершает набор задач за 67 млн выходных токенов, тогда как Gemini 3.8 Flash расходует 170 млн, поэтому счёт за задачу может оказаться ниже, даже если цена за токен выглядит выше.
В трёх случаях выбирайте что-то другое. Если вам нужен текущий лучший ответ Google на сложный вопрос, требующий рассуждений, или на долгосрочную задачу по программированию, Gemini 3.8 Flash опережает Gemini 3.1 Pro по текущему независимому индексу, доступен для всех, а не в режиме предварительного просмотра, стоит $0,75 за миллион входных и $3,75 за миллион выходных токенов до 31 декабря 2026 года и имеет бесплатный тариф, которого нет у Gemini 3.1 Pro. Чтобы добиться этого, он расходует больше токенов мышления — таков компромисс, и он настоящий. Если вам нужен абсолютный фронтир, сейчас это не модель Google: на том же графике индекса Claude Opus 5 при максимальном уровне рассуждений лидирует с 58 против 30 у Gemini 3.1 Pro. А если ваша рабочая нагрузка чувствительна к задержке или стоимости и неглубока — классификация, извлечение, маршрутизация, краткое резюмирование, — то уровень Flash-Lite или небольшая модель с открытыми весами справится с задачей за малую долю от $2,00 за миллион входных токенов, а платить за это по тарифам Pro — просто пустая трата.
Чего бы мы не стали делать, так это выбирать Gemini 3.1 Pro потому, что это новейшая Pro-модель от Google. Она не новая, и по состоянию на этот месяц у Google нет выпущенного преемника для неё.
Вызывать его, не ставя весь свой стек на preview-эндпоинт
Неудобная часть семимесячного превью в том, что оно достаточно хорошее, чтобы на нём строить, и недостаточно стабильное, чтобы принимать его как данность. Стоит назвать две меры по смягчению.
Закрепите точный код модели, а не алиас. Эндпоинт предварительной версии может быть изменён на месте, поэтому gemini-3.1-pro-preview в файле конфигурации безопаснее, чем плавающая ссылка на «latest Pro», и это делает незаметное изменение видимым в diff.
Держите маршрутизацию выше модели. В OrcaRouter Gemini 3.1 Pro — это google/gemini-3.1-pro-preview, доступная через тот же ключ и тот же эндпоинт, что и любая другая модель в нашем каталоге, включая нативный/v1beta/models/{model}:generateContent формат для кода, написанного под Gemini SDK, и совместимый с OpenAI/v1/chat/completions для всего остального. Поскольку цены —это проброс по себестоимости с наценкой 0%, $2.00 / $12.00 из тарифной сетки Google — это ровно та сумма, которую вы платите здесь, а изменение цены у вендора вступает в силу в тот же день, а не в следующем расчётном периоде. Для preview-модели это особенно важно из-за отказоустойчивости: настроенная цепочка резервирования означает, что в день, когда Gemini 3.1 Pro недоступна, ваш повторный запрос попадает на следующую модель в цепочке ещё до начала ответа, а не после того, как это заметят ваши пользователи. В этом и разница между preview, на котором можно запускать продакшен, и preview, который годится только для демонстрации.
Наша собственная запись в каталоге для модели содержит характеристики в том виде, в каком мы их предоставляем — контекст в один миллион токенов, максимальный вывод 65 536 токенов, вход аудио/файл/изображение/текст/видео, вывод текста, а также медианное время до первого токена 10,00 секунд за последние семь дней, что стоит знать, прежде чем предполагать, что это модель с задержкой чата. Это не так.

Что всё ещё открыто?
Три вещи, которые мы не смогли закрыть и предпочли бы назвать, а не замалчивать. Google не сообщила, выйдет ли Gemini 3.1 Pro когда-либо в общий доступ, и опубликованной даты прекращения поддержки тоже нет. Отчёты AI Studio остаются необъяснёнными спустя пять дней, и мы не нашли никакого ответа от вендора. А на вопрос о преемнике можно ответить только отрицательно: страница Pro от Google уже несколько месяцев анонсирует скорый выпуск Pro, в отчётах говорится, что внутренний кандидат был отклонён из-за неспособности превзойти линейку Flash, и по состоянию на 23 сентября 2026 года ничего не выпущено. Если появится Gemini 3.5 Pro или Gemini 4 Pro, положение Gemini 3.1 Pro в этом семействе изменится впервые с февраля — и именно это, а не его первоначальный запуск, является событием, заслуживающим внимания.

Gemini 3.1 Pro доступен на OrcaRouter по прейскурантной цене Google, за тем же ключом, что и всё остальное, что мы предоставляем. Откройте страницу модели Gemini 3.1 Pro — там актуальные цены, ограничения контекста и цепочка резервных моделей, которую можно настроить до выхода следующей предварительной ревизии.
Сравнение в этой статье3
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
