Титульная карточка для «Qwen 4 Max vs Gemini 3.1 Pro» с подзаголовком «Неанонсированный флагман против превью, которое никогда не заканчивалось», три капсульных бейджа с текстом «Превью с 19 февраля 2026», «Контекст в 1 048 576 токенов» и «26,3% извлечения при 1M», строка футера с текстом «Alibaba анонсировала 22 сентября 2026 г.; Google представила превью 19 февраля 2026 г.», и логотип OrcaRouter в правом нижнем углу.
Engineering & Research

Qwen 4 Max против Gemini 3.1 Pro: необъявленный флагман против предварительной версии, которая так и не закончилась

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Большинство сравнений противопоставляют выпущенный продукт выпущенному продукту. Это сравнение необычно: Qwen 4 Max был представлен на конференции Yunqi в Ханчжоу 22 сентября 2026 года без даты выпуска, без цены и без весов, а Gemini 3.1 Pro находится в предварительном доступе с 19 февраля 2026 года и всё ещё в предварительном доступе — семь месяцев спустя, без объявленной даты общего доступа и без даты отключения в таблице устаревания. Ни одна из моделей в этом сравнении не является устоявшимся продуктом. Это не причина пропускать сравнение. Это и есть сравнение, и это единственное, что в нём действительно информативно.

Семь месяцев предварительного просмотра

Метка предварительной версии должна обозначать кратковременное состояние. Теперь Gemini 3.1 Pro сохраняет её на протяжении трёх выпусков Flash от той же лаборатории, включая Gemini 3.8 Flash от 2 сентября 2026 года, который Google описывает как свою самую интеллектуальную модель Flash. В независимых композитных тестах эта модель теперь набирает больше баллов, чем 3.1 Pro. В линейке Pro от Google нет более новой модели: Gemini 3.8 Pro не существует, а поколение 3.5 Pro было задержано и, по сообщениям, отложено. Практический эффект заключается в том, что модель, носящая название Pro, больше не является моделью с наивысшими показателями от собственного производителя.

Собственный текст Google об ограничениях в карточке каталога советует планировать устаревание preview — это честный способ трактовать статус. Preview без даты GA и без даты отключения — это модель, на которую можно опираться, но вокруг которой нельзя строить график.

Сторона Qwen — это зеркальное отражение с перевёрнутым знаком. Qwen 4 Max находится не в долгом превью; он в состоянии до превью, когда вообще ничего не опубликовано. Два режима отказа противоположны: Gemini 3.1 Pro — реальный эндпоинт, долгосрочное существование которого не определено, а Qwen 4 Max — указанный пункт дорожной карты без эндпоинта.

A two-column scoreboard titled "Qwen 4 Max vs Gemini 3.1 Pro - the scoreboard". Left column Qwen 4 Max: Status announced, no date; Input price not published; Output price not published; Context window not published; Long-context retrieval not published; Independent score none exists. Right column Gemini 3.1 Pro: Status preview since Feb 19 2026; Input price $2.00 per 1M tokens; Output price $12.00 per 1M tokens; Context window 1,048,576 tokens; Long-context retrieval 26.3% at 1M tokens; Independent score 30 on index v4.3.2. Footer reads "Gemini 3.1 Pro pricing and vendor-reported retrieval from Google; index v4.3.2 published September 19 2026.", with the OrcaRouter logo bottom-right.

Сравнение — и показатель длинного контекста, который решает исход

Спецификация Gemini 3.1 Pro публична и конкретна. У Qwen 4 Max она пуста. А вот на чём стоит остановиться — так это на одной строке в столбце Gemini, потому что это из тех чисел, которые цитируют, хотя не следовало бы:

• Статус — Gemini 3.1 Pro в предварительной версии с 19 февраля 2026 года, тогда как Qwen 4 Max анонсирован 22 сентября 2026 года без указания даты

• Цена за вход — Gemini 3.1 Pro: $2.00 за 1 млн токенов при длине промпта до 200K и $4.00 при превышении, тогда как для Qwen 4 Max она не опубликована

• Цена за вывод — Gemini 3.1 Pro: $12.00 за 1M до 200K и $18.00 свыше, тогда как для Qwen 4 Max она не опубликована

• Кэшированный ввод — Gemini 3.1 Pro: $0.20 за 1M при чтении из кэша, тогда как для Qwen 4 Max цена не опубликована

• Контекст — Gemini 3.1 Pro: 1 048 576 токенов, в сравнении с Qwen 4 Max — не опубликовано.

• Потолок вывода — Gemini 3.1 Pro: 65 536 токенов, тогда как у Qwen 4 Max он не опубликован.

• Модальность — Gemini 3.1 Pro: ввод текста, изображений, видео, аудио и PDF с текстовым выводом, в отличие от Qwen 4 Max — не опубликовано

• Управление рассуждениями — низкий, средний и высокий уровни мышления у Gemini 3.1 Pro, а у Qwen 4 Max не опубликованы.

• Извлечение из длинного контекста — заявленный производителем показатель MRCR v2 для Gemini 3.1 Pro составляет 84,9 процента в среднем по восьми иглам при 128K, но 26,3 процента в точечном режиме на один миллион токенов, тогда как для Qwen 4 Max ничего не сообщается

• Оценки, заявленные производителями — Gemini 3.1 Pro SWE-bench Verified 80,6 процента, GPQA Diamond 94,3 процента, ARC-AGI-2 77,1 процента, Humanity's Last Exam 44,4 процента без инструментов, тогда как о Qwen 4 Max ничего не сообщается

• Независимая оценка — Gemini 3.1 Pro 30 по Artificial Analysis Intelligence Index v4.3.2, в отличие от Qwen 4 Max, для которого независимой оценки не существует

Именно эту строку про длинный контекст и стоит запомнить. Окно контекста в 1,048,576 токенов — это маркетинговая цифра; 26,3 процента извлечения при настройке на один миллион токенов — вот что сообщает тот же производитель, когда измеряет дальний край этого окна. Обе цифры приводит Google, и поэтому этот разрыв говорит о модели, а не о том, кто проводит оценку. Если ваша рабочая нагрузка зависит от поиска факта, скрытого ближе к концу промпта на миллион токенов, броская цифра контекста не сообщает ничего полезного, а эта строка говорит почти всё.

Индекс сместился, а модель — нет.

Gemini 3.1 Pro вышел 19 февраля 2026 года с показателем 57 в Индексе интеллекта Artificial Analysis, первым в своей области. Согласно редакции индекса v4.3.2, опубликованной 19 сентября 2026 года, у него указано 30. Ничего в модели между этими двумя датами не менялось. Линейку перестроили, причём за четыре дня до анонса Qwen 4 от Alibaba.

Это совпадение стоит больше, чем сами числа. Три из четырёх моделей в этой партии сравнений — Gemini 3.1 Pro, Claude Opus 5 и флагман Qwen 3.8 — имеют независимые оценки, которые изменились при одной и той же ревизии, и в каждом случае сдвиг был достаточно большим, чтобы изменить порядок в рейтинге. Любое сравнение, написанное в этом месяце, где приводится одно значение индекса без указания ревизии, сравнивает оценки, полученные с помощью разных линеек, и эта ошибка останется невидимой для читателя.

Для Qwen 4 Max следствие таково: цель продолжает смещаться. Когда Alibaba в конце концов опубликует результаты, оценкой, которую нужно побить в этом индексе, будет то, что текущая ревизия указывает в тот день, а ревизия менялась как минимум один раз за последнюю неделю.

A screenshot of the OrcaRouter page for Gemini 3.1 Pro in its cost-estimator view (English UI), showing a monthly token volume of 10M against a sample summarisation prompt, an estimated $50.00 per month falling to $43.70 with prompt caching at list price, a cost per request of $0.006040, a note that the estimate uses base-tier rates and that actual token counts depend on the provider's tokenizer, and a PERFORMANCE panel for the last 7 days reading p50 time-to-first-token 10.00 s, output speed 632 tok/s and an error rate of 77.5%, above a 7-day latency trend chart running 09-16 to 09-22.

Что говорят операционные цифры, включая неудобную

Gemini 3.1 Pro доступен для маршрутизации на OrcaRouter как google/gemini-3.1-pro-preview, со значками Flagship и Featured, без предрелизного баннера, по каталожной цене Google — $2.00 и $12.00 за миллион токенов с наценкой 0%. Сама маршрутизация честна — тариф на странице совпадает с тарифом, который публикует Google. Эксплуатационные показатели за семь дней по 22 сентября тоже стоит привести, а не пропускать: p50 времени до первого токена — 10,00 секунды, скорость вывода — около 632 токенов в секунду, а частота ошибок за этот период — 77,5 процента. Эта частота ошибок — не сноска. Для модели уровня preview без даты GA это самое важное для принятия решения число на странице, а сравнение, которое называет цену без него, продаёт, а не информирует.

Тот же каталог содержит почти 200 моделей на одной совместимой с OpenAI конечной точке с автоматическим переключением при сбое и DSL маршрутизации, и это тот механизм, который делает подобную частоту ошибок выживаемой, а не фатальной: деградировавший путь провайдера можно переключить, а не вывести из строя. Семейство Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash и Qwen3.8-27B — находится на той же конечной точке, что и Gemini 3.1 Pro Preview, так что замена, о которой на самом деле эта статья, — та, которую можно выполнить уже сегодня, — это изменение политики маршрутизации, а не миграционный проект. Qwen 4 Max в каталоге нет, как и ни одного уровня Qwen 4; когда он появится, именно там он и будет указан.

Решение, если его можно так назвать

Ни одна из моделей здесь не является продуктом, на который можно сделать ставку, и честный совет — относиться к обеим соответственно. Gemini 3.1 Pro сегодня можно вызывать по опубликованной цене, с опубликованным контекстным окном и публичной историей оценок, включая слабость извлечения на дальнем конце этого окна; к тому же это предварительная версия, производитель которой советует планировать её вывод из эксплуатации, работающая с частотой ошибок, недопустимой для продакшен-зависимости. У Qwen 4 Max нет ни одной из этих проблем, потому что у неё нет ни одного из этих свойств.

Если вам нужна модель сейчас, выбор не между этими двумя. Он между Gemini 3.1 Pro и уже выпущенным флагманом Qwen, и, судя по имеющимся данным, это решение о качестве извлечения при длинном контексте против входной ставки в $2.00 с опубликованными весами. Если вы можете подождать, следите за двумя вещами, а не за одной: карточкой модели Qwen 4 Max и датой общего доступа Gemini 3.1 Pro. Что появится первым, то и скажет, какую из этих двух дорожных карт Alibaba и Google на самом деле ставят в приоритет.

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно