Титульная карточка для «Mercury 2.5 Preview vs Gemini 3.1 Pro» с подзаголовком «Two previews, six months apart». На левой панели с названием «Mercury 2.5 Preview» показаны: иконка молнии, плашка «256K context», тег «text only» и плашка «$0.04 intro»; на правой панели с названием «Gemini 3.1 Pro» — мультимодальный набор глифов (изображение, аудио, видео), плашка «1M context», бейдж «AA Index 57 at launch» и плашка «$2.00 / $12.00». Между ними расположен тонкий бейдж «vs». Логотип OrcaRouter добавлен в правый нижний угол.
Guides & Insights

Mercury 2.5 Preview против Gemini 3.1 Pro: Два превью с разницей в полгода

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Обе модели в этом матче носят в названии слово «preview», но на этом сходство заканчивается. Mercury 2.5 Preview и Gemini 3.1 Pro — обе модели-рассуждатели, доступные сегодня через API, однако их превью-статусы находятся на противоположных концах жизненного цикла. Gemini 3.1 Pro, флагманская модель для рассуждений, находится в превью с 19 февраля 2026 года — за плечами у неё шесть месяцев независимых оценок, места в публичных лидербордах и продакшн-трафик, индекс Artificial Analysis Intelligence Index 57 на запуске, мультимодальный ввод текста, изображений, аудио и видео, контекст на 1 млн токенов и цена $2.00 / $12.00 за миллион токенов. Mercury 2.5 Preview — диффузионная LLM от Inception, вышедшая 31 августа 2026 года, — существует два дня: это текстовая модель с контекстом 256K, заявленной скоростью 1107 токенов в секунду, ценой $0.20 / $0.75 (примерно $0.04 / $0.15 по скидке до 8 сентября) и ни одним независимым бенчмарком. Называть обе «превью» — значит уходить от главного вопроса: сколько стоит шестимесячный задел из доказательств и проверок в сравнении с принципиально более быстрым способом генерации текста.

Что на самом деле представляет собой каждая модель

Gemini 3.1 Pro — закрытая, мультимодальная универсальная флагманская модель рассуждений. Она {{1}}воспринимает текст, изображения, аудио и видео{{/1}}, работает с {{2}}контекстным окном в 1M токенов{{/2}} при {{3}}потолке вывода в 64K{{/3}} и {{4}}динамически регулирует глубину рассуждений{{/4}} — {{5}}производитель описывает четырёхуровневую интенсивность рассуждений, которая масштабируется в зависимости от сложности задачи{{/5}}. Её стартовые показатели — {{6}}ARC-AGI-2: 77,1%{{/6}}, {{7}}GPQA Diamond: 94,3%{{/7}}, {{8}}SWE-bench Verified: 80,6%{{/8}}, {{9}}Terminal-Bench 2.0: 68,5%{{/9}} — {{10}}заявлены производителем, но подкреплены шестью месяцами независимых проверок{{/10}}, включая {{11}}повторное измерение Artificial Analysis по более строгой индексной шкале, где модель набирает около 46,5{{/11}}. Именно такую перепроверку и заслуживает зрелая модель: {{12}}её тестировали достаточно интенсивно, чтобы индекс вокруг неё стал строже{{/12}}. Mercury 2.5 Preview — диффузионная модель: {{13}}она генерирует и уточняет токены параллельно, а не по одному{{/13}}. Она поддерживает {{14}}регулируемую глубину рассуждений, параллельные вызовы инструментов и JSON по схеме{{/14}} и создана для {{15}}нагрузок с накопительной задержкой, которые называет Inception{{/15}}: {{16}}поисковые агенты, голосовые конвейеры и субагенты, пишущие код{{/16}}. Все утверждения о её качестве, включая {{17}}скачок более чем на 10 пунктов относительно Mercury 2{{/17}}, — {{18}}собственные заявления производителя, и ни одна третья сторона её не измеряла{{/18}}.

A screenshot of the Artificial Analysis model page for Inception's Mercury 2, the diffusion model Mercury 2.5 Preview builds on, showing its independently measured output speed of 684 tokens per second, its $0.25 / $0.75 per-1M pricing, its 128K context window, and its Intelligence Index score of 22.

Контраст спецификации

Цена — Mercury 2.5 Preview: $0.20 / $0.75 за 1M входных/выходных токенов, ~$0.04 / $0.15 вводная цена до 8 сентября. Gemini 3.1 Pro: $2.00 / $12.00 за 1M токенов, повышаясь до $4.00 / $18.00 при вводе свыше 200K.

Контекст / вывод — Mercury 2.5 Preview: 256K контекста. Gemini 3.1 Pro: 1M контекста, макс. вывод 64K.

Входные данные — Mercury 2.5 Preview: только текст. Gemini 3.1 Pro: текст, изображение, аудио, видео, файл.

Архитектура — Mercury 2.5 Preview: диффузионная LLM, параллельная генерация токенов. Gemini 3.1 Pro: авторегрессивная, динамическая глубина рассуждений.

Скорость — Mercury 2.5 Preview: заявлено 1 107 токенов/с. Gemini 3.1 Pro: нет сопоставимого громкого заявления.

Доказательства — Mercury 2.5 Preview: только заявлено вендором. Gemini 3.1 Pro: AA Index 57 на момент запуска (46.5 по новой шкале) плюс длинная история независимых оценок.

A two-column scoreboard titled 'Mercury 2.5 Preview vs Gemini 3.1 Pro — the scoreboard'. Left column 'Mercury 2.5 Preview': 'Price: $0.20 / $0.75 (intro $0.04 / $0.15)', 'Inputs: text only', 'Context: 256K', 'Speed: 1,107 tok/s (claimed)', 'Independent score: none yet', 'Preview since: Aug 31, 2026'. Right column 'Gemini 3.1 Pro': 'Price: $2.00 / $12.00', 'Inputs: text, image, audio, video', 'Context: 1M', 'Speed: autoregressive', 'Independent score: AA Index 57 at launch', 'Preview since: Feb 19, 2026'. A footer reads 'Gemini index per Artificial Analysis; Mercury figures vendor-reported.' The OrcaRouter logo is composited in the bottom-right corner.

Разрыв мультимодальности — решающее отличие.

Для большинства приложений это сравнение разрешается ещё до того, как в дело вступают цены или бенчмарки, потому что Mercury 2.5 Preview не видит. Gemini 3.1 Pro читает скриншоты, диаграммы, аудио и видео — это модель, на которую вы указываете на PDF, график, запись совещания или интерфейс, когда хотите получить ответ о чём-то, что ещё не является текстом. Mercury 2.5 Preview — только текст по замыслу; диффузионная языковая модель, генерирующая текст параллельно, вообще не имеет входного пути для изображений или аудио. Для приложения с большим количеством документов, визуального агента или любого мультимодального продукта Gemini 3.1 Pro — единственный кандидат, и точка. Ограничение Mercury 2.5 Preview только текстом — это не примечание мелким шрифтом; это граница, которая определяет, для каких задач модель вообще подходит.

Шесть месяцев тестирования против двух дней

По фактам это не соревнование, и важно прямо сказать, почему. Gemini 3.1 Pro уже шесть месяцев разбирают по косточкам независимые лаборатории; его результат оценивали, перепроверяли и оспаривали — именно так выглядит «достоверность» для модели. Mercury 2.5 Preview имеет один источник информации — своего создателя, — и этот источник заявляет о скачке интеллекта более чем на 10 пунктов по сравнению с Mercury 2 и о паритете с оптимизированной по стоимости категорией передовых моделей. Оба утверждения могут быть правдой. Ни одно из них не подтверждено никем за пределами Inception, и модель слишком новая, чтобы ожидать чего-то иного. Асимметрия не в том, что одна лучше; она в том, что одна познаваема, а другая — пока нет.

Где скорость Меркурия действительно выигрывает

Честная аргументация в пользу Mercury 2.5 Preview узка, ограничена текстом и реальна. Параллельная генерация токенов меняет математику задержки так, как не может ни одна авторегрессионная модель — включая Gemini 3.1 Pro, — потому что авторегрессионная модель последовательна по своей конструкции. Для голосового конвейера ирония в том, что вход и выход — это аудио, но мышление между ними — текст: быстрый текстовый слой рассуждений — именно то, что делает голосового агента отзывчивым. Для поискового агента, совершающего повторные вызовы инструментов, и для субагента программирования, отправляющего множество мелких завершений в рамках одной задачи, задержка каждого вызова складывается в ощущаемую скорость. По стартовой цене — $0,04 на вход, $0,15 на выход — Mercury 2.5 Preview примерно в 80 раз дешевле стандартной ставки вывода Gemini 3.1 Pro, что делает его не просто более быстрым, а представителем иного ценового класса для высокообъёмных текстовых рассуждений. Оговорка, которая должна сопровождать каждое из этих предложений: скорость заявлена, паритет качества заявлен, а независимых измерений не существует.

Цены: премиум Gemini с длинным контекстом против тизера Mercury

В тарифной таблице Gemini 3.1 Pro есть деталь, которую полезно знать, прежде чем сравнивать основные показатели: запросы, превышающие 200K входных токенов, переходят с $2.00 / $12.00 на $4.00 / $18.00 за миллион. Для модели с контекстом в 1M такая надбавка за длинный контекст — не редкий случай, а цена реального использования того окна, которым модель знаменита. У Mercury 2.5 Preview такого перехода нет, и её контекст в 256K вряд ли будет часто достигать длинноконтекстной области. Но низкая цена Mercury — это приманка, срок которой истекает 8 сентября, тогда как цена Gemini — стабильная опубликованная ставка. При сравнении сопоставляйте прайсовую цену Mercury ($0.20 / $0.75) со стандартным тарифом Gemini, а не со скидкой: скидка — это стимул попробовать, а не цена для планирования.

Решение о маршрутизации

Обе модели уже доступны для маршрутизации, и это меняет подход к каждой из них. Gemini 3.1 Pro представлена на OrcaRouter как google/gemini-3.1-pro-preview, по прейскурантной цене провайдера, передаваемой с 0% наценкой, поэтому стандартный и длинноконтекстный тарифы стоят ровно столько, сколько публикует провайдер, наряду с ещё 200+ моделями по одному API-ключу. Значок Preview — это как раз то, что стоит обходить при маршрутизации, а не делать на него ставку: панель частоты ошибок на странице модели существует не просто так, а автоматический фейловер означает, что деградировавший ответ превью направляется второму провайдеру без изменения кода. Mercury 2.5 Preview пока нет на OrcaRouter; Inception предоставляет её через собственный API и несколько сторонних платформ. Модель, которой всего два дня и которую пока нельзя поставить за фейловер, — это тестовый кандидат, а не производственная зависимость. В день, когда провайдер добавит её в список, будет действовать та же сквозная цена, и приветственная скидка появится здесь в тот же день — и вот тогда это сравнение станет правилом маршрутизации, а не решением, которое нужно принимать каждый раз.

Честный вердикт — эти две превью-версии отвечают на разные вопросы. Gemini 3.1 Pro отвечает на вопрос «на какой модели строить продукт уже сегодня»: она мультимодальна, поддерживает длинный контекст, независимо протестирована и стабильна, и цена всё это отражает. Mercury 2.5 Preview отвечает на вопрос «какой физический предел скорости у текстовых рассуждений» — и его архитектура скорости — самое интересное в модели; осталось дождаться, пока независимая лаборатория подтвердит, реально ли качество, которое эта скорость обеспечивает. Если ваша рабочая нагрузка мультимодальна или требует длинного контекста, выбор уже сделан. Если она чисто текстовая, с накоплением задержек и чувствительна к цене, Mercury 2.5 Preview — та ставка, за которой стоит следить, а 8 сентября — дата, к которой за ней стоит наблюдать.

A screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview) showing the model header, the Home > Models > Google breadcrumb, the February 19, 2026 preview start date, and the description of Google's frontier reasoning model.
© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube