
Mercury 2.5 Preview против Gemini 3.1 Pro: Два превью с разницей в полгода
- googleНОВИНКАGoogle: Gemini 3.8 Flash2026-09-0259Интеллект76Кодинг
- qwenНОВИНКАQwen: Qwen3.8 Max (0902)2026-09-0258Интеллект72Кодинг
- anthropicНОВИНКАAnthropic: Claude Fable 5.12026-09-0166Интеллект82Кодинг
- AlibabaНОВИНКАQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.3 Flash2026-08-2658Интеллект72Кодинг
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
Обе модели в этом матче носят в названии слово «preview», но на этом сходство заканчивается. Mercury 2.5 Preview и Gemini 3.1 Pro — обе модели-рассуждатели, доступные сегодня через API, однако их превью-статусы находятся на противоположных концах жизненного цикла. Gemini 3.1 Pro, флагманская модель для рассуждений, находится в превью с 19 февраля 2026 года — за плечами у неё шесть месяцев независимых оценок, места в публичных лидербордах и продакшн-трафик, индекс Artificial Analysis Intelligence Index 57 на запуске, мультимодальный ввод текста, изображений, аудио и видео, контекст на 1 млн токенов и цена $2.00 / $12.00 за миллион токенов. Mercury 2.5 Preview — диффузионная LLM от Inception, вышедшая 31 августа 2026 года, — существует два дня: это текстовая модель с контекстом 256K, заявленной скоростью 1107 токенов в секунду, ценой $0.20 / $0.75 (примерно $0.04 / $0.15 по скидке до 8 сентября) и ни одним независимым бенчмарком. Называть обе «превью» — значит уходить от главного вопроса: сколько стоит шестимесячный задел из доказательств и проверок в сравнении с принципиально более быстрым способом генерации текста.
Что на самом деле представляет собой каждая модель
Gemini 3.1 Pro — закрытая, мультимодальная универсальная флагманская модель рассуждений. Она {{1}}воспринимает текст, изображения, аудио и видео{{/1}}, работает с {{2}}контекстным окном в 1M токенов{{/2}} при {{3}}потолке вывода в 64K{{/3}} и {{4}}динамически регулирует глубину рассуждений{{/4}} — {{5}}производитель описывает четырёхуровневую интенсивность рассуждений, которая масштабируется в зависимости от сложности задачи{{/5}}. Её стартовые показатели — {{6}}ARC-AGI-2: 77,1%{{/6}}, {{7}}GPQA Diamond: 94,3%{{/7}}, {{8}}SWE-bench Verified: 80,6%{{/8}}, {{9}}Terminal-Bench 2.0: 68,5%{{/9}} — {{10}}заявлены производителем, но подкреплены шестью месяцами независимых проверок{{/10}}, включая {{11}}повторное измерение Artificial Analysis по более строгой индексной шкале, где модель набирает около 46,5{{/11}}. Именно такую перепроверку и заслуживает зрелая модель: {{12}}её тестировали достаточно интенсивно, чтобы индекс вокруг неё стал строже{{/12}}. Mercury 2.5 Preview — диффузионная модель: {{13}}она генерирует и уточняет токены параллельно, а не по одному{{/13}}. Она поддерживает {{14}}регулируемую глубину рассуждений, параллельные вызовы инструментов и JSON по схеме{{/14}} и создана для {{15}}нагрузок с накопительной задержкой, которые называет Inception{{/15}}: {{16}}поисковые агенты, голосовые конвейеры и субагенты, пишущие код{{/16}}. Все утверждения о её качестве, включая {{17}}скачок более чем на 10 пунктов относительно Mercury 2{{/17}}, — {{18}}собственные заявления производителя, и ни одна третья сторона её не измеряла{{/18}}.

Контраст спецификации
• Цена — Mercury 2.5 Preview: $0.20 / $0.75 за 1M входных/выходных токенов, ~$0.04 / $0.15 вводная цена до 8 сентября. Gemini 3.1 Pro: $2.00 / $12.00 за 1M токенов, повышаясь до $4.00 / $18.00 при вводе свыше 200K.
• Контекст / вывод — Mercury 2.5 Preview: 256K контекста. Gemini 3.1 Pro: 1M контекста, макс. вывод 64K.
• Входные данные — Mercury 2.5 Preview: только текст. Gemini 3.1 Pro: текст, изображение, аудио, видео, файл.
• Архитектура — Mercury 2.5 Preview: диффузионная LLM, параллельная генерация токенов. Gemini 3.1 Pro: авторегрессивная, динамическая глубина рассуждений.
• Скорость — Mercury 2.5 Preview: заявлено 1 107 токенов/с. Gemini 3.1 Pro: нет сопоставимого громкого заявления.
• Доказательства — Mercury 2.5 Preview: только заявлено вендором. Gemini 3.1 Pro: AA Index 57 на момент запуска (46.5 по новой шкале) плюс длинная история независимых оценок.

Разрыв мультимодальности — решающее отличие.
Для большинства приложений это сравнение разрешается ещё до того, как в дело вступают цены или бенчмарки, потому что Mercury 2.5 Preview не видит. Gemini 3.1 Pro читает скриншоты, диаграммы, аудио и видео — это модель, на которую вы указываете на PDF, график, запись совещания или интерфейс, когда хотите получить ответ о чём-то, что ещё не является текстом. Mercury 2.5 Preview — только текст по замыслу; диффузионная языковая модель, генерирующая текст параллельно, вообще не имеет входного пути для изображений или аудио. Для приложения с большим количеством документов, визуального агента или любого мультимодального продукта Gemini 3.1 Pro — единственный кандидат, и точка. Ограничение Mercury 2.5 Preview только текстом — это не примечание мелким шрифтом; это граница, которая определяет, для каких задач модель вообще подходит.
Шесть месяцев тестирования против двух дней
По фактам это не соревнование, и важно прямо сказать, почему. Gemini 3.1 Pro уже шесть месяцев разбирают по косточкам независимые лаборатории; его результат оценивали, перепроверяли и оспаривали — именно так выглядит «достоверность» для модели. Mercury 2.5 Preview имеет один источник информации — своего создателя, — и этот источник заявляет о скачке интеллекта более чем на 10 пунктов по сравнению с Mercury 2 и о паритете с оптимизированной по стоимости категорией передовых моделей. Оба утверждения могут быть правдой. Ни одно из них не подтверждено никем за пределами Inception, и модель слишком новая, чтобы ожидать чего-то иного. Асимметрия не в том, что одна лучше; она в том, что одна познаваема, а другая — пока нет.
Где скорость Меркурия действительно выигрывает
Честная аргументация в пользу Mercury 2.5 Preview узка, ограничена текстом и реальна. Параллельная генерация токенов меняет математику задержки так, как не может ни одна авторегрессионная модель — включая Gemini 3.1 Pro, — потому что авторегрессионная модель последовательна по своей конструкции. Для голосового конвейера ирония в том, что вход и выход — это аудио, но мышление между ними — текст: быстрый текстовый слой рассуждений — именно то, что делает голосового агента отзывчивым. Для поискового агента, совершающего повторные вызовы инструментов, и для субагента программирования, отправляющего множество мелких завершений в рамках одной задачи, задержка каждого вызова складывается в ощущаемую скорость. По стартовой цене — $0,04 на вход, $0,15 на выход — Mercury 2.5 Preview примерно в 80 раз дешевле стандартной ставки вывода Gemini 3.1 Pro, что делает его не просто более быстрым, а представителем иного ценового класса для высокообъёмных текстовых рассуждений. Оговорка, которая должна сопровождать каждое из этих предложений: скорость заявлена, паритет качества заявлен, а независимых измерений не существует.
Цены: премиум Gemini с длинным контекстом против тизера Mercury
В тарифной таблице Gemini 3.1 Pro есть деталь, которую полезно знать, прежде чем сравнивать основные показатели: запросы, превышающие 200K входных токенов, переходят с $2.00 / $12.00 на $4.00 / $18.00 за миллион. Для модели с контекстом в 1M такая надбавка за длинный контекст — не редкий случай, а цена реального использования того окна, которым модель знаменита. У Mercury 2.5 Preview такого перехода нет, и её контекст в 256K вряд ли будет часто достигать длинноконтекстной области. Но низкая цена Mercury — это приманка, срок которой истекает 8 сентября, тогда как цена Gemini — стабильная опубликованная ставка. При сравнении сопоставляйте прайсовую цену Mercury ($0.20 / $0.75) со стандартным тарифом Gemini, а не со скидкой: скидка — это стимул попробовать, а не цена для планирования.
Решение о маршрутизации
Обе модели уже доступны для маршрутизации, и это меняет подход к каждой из них. Gemini 3.1 Pro представлена на OrcaRouter как google/gemini-3.1-pro-preview, по прейскурантной цене провайдера, передаваемой с 0% наценкой, поэтому стандартный и длинноконтекстный тарифы стоят ровно столько, сколько публикует провайдер, наряду с ещё 200+ моделями по одному API-ключу. Значок Preview — это как раз то, что стоит обходить при маршрутизации, а не делать на него ставку: панель частоты ошибок на странице модели существует не просто так, а автоматический фейловер означает, что деградировавший ответ превью направляется второму провайдеру без изменения кода. Mercury 2.5 Preview пока нет на OrcaRouter; Inception предоставляет её через собственный API и несколько сторонних платформ. Модель, которой всего два дня и которую пока нельзя поставить за фейловер, — это тестовый кандидат, а не производственная зависимость. В день, когда провайдер добавит её в список, будет действовать та же сквозная цена, и приветственная скидка появится здесь в тот же день — и вот тогда это сравнение станет правилом маршрутизации, а не решением, которое нужно принимать каждый раз.
Честный вердикт — эти две превью-версии отвечают на разные вопросы. Gemini 3.1 Pro отвечает на вопрос «на какой модели строить продукт уже сегодня»: она мультимодальна, поддерживает длинный контекст, независимо протестирована и стабильна, и цена всё это отражает. Mercury 2.5 Preview отвечает на вопрос «какой физический предел скорости у текстовых рассуждений» — и его архитектура скорости — самое интересное в модели; осталось дождаться, пока независимая лаборатория подтвердит, реально ли качество, которое эта скорость обеспечивает. Если ваша рабочая нагрузка мультимодальна или требует длинного контекста, выбор уже сделан. Если она чисто текстовая, с накоплением задержек и чувствительна к цене, Mercury 2.5 Preview — та ставка, за которой стоит следить, а 8 сентября — дата, к которой за ней стоит наблюдать.

