Um cartão de título de destaque para "Qwen 4 Max vs Gemini 3.1 Pro", com o subtítulo "O flagship não anunciado contra a prévia que nunca terminou", três badges em formato de pílula com os textos "Prévia desde 19 de fev. de 2026", "Contexto de 1.048.576 tokens" e "26,3% de recuperação em 1M", uma linha de rodapé com "A Alibaba anunciou em 22 de setembro de 2026; o Google apresentou a prévia em 19 de fevereiro de 2026", e o logotipo da OrcaRouter no canto inferior direito.
Engineering & Research

Qwen 4 Max vs Gemini 3.1 Pro: o carro-chefe não anunciado contra a prévia que nunca terminou

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

A maioria das comparações coloca um produto já lançado contra outro produto já lançado. Esta é incomum: o Qwen 4 Max foi mostrado em pré-visualização na conferência Yunqi, em Hangzhou, em 22 de setembro de 2026, sem data de lançamento, sem preço e sem pesos, e o Gemini 3.1 Pro está em pré-visualização desde 19 de fevereiro de 2026 e continua em pré-visualização — sete meses depois, sem data de disponibilidade geral anunciada e sem data de encerramento em sua tabela de depreciação. Nenhum dos modelos neste confronto é um produto consolidado. Isso não é motivo para pular a comparação. É a comparação, e é a única coisa sobre ela que é genuinamente informativa.

Sete meses de prévia

Uma designação de prévia deveria ser um estado de curta duração. O Gemini 3.1 Pro agora a mantém ao longo de três lançamentos do Flash do mesmo laboratório, incluindo o Gemini 3.8 Flash, em 2 de setembro de 2026, que o Google descreve como seu modelo Flash mais inteligente. Nos índices compostos independentes, esse modelo agora pontua acima do 3.1 Pro. A linha Pro do Google não tem membro mais recente: não há Gemini 3.8 Pro, e a geração 3.5 Pro foi adiada e, segundo relatos, deixada de lado. O efeito prático é que o modelo que carrega o nome Pro não é mais o modelo com melhor pontuação de seu próprio fornecedor.

O próprio texto de limitação do Google na entrada do catálogo aconselha planejar a descontinuação do preview, que é a forma honesta de interpretar o status. Um preview sem data de GA e sem data de encerramento é um modelo sobre o qual você pode construir, mas em torno do qual não pode planejar.

O lado Qwen é uma imagem espelhada com o sinal invertido. O Qwen 4 Max não está em uma prévia longa; está em pré-prévia, sem nada publicado. Os dois modos de falha são opostos: o Gemini 3.1 Pro é um endpoint real cuja existência de longo prazo não é especificada, e o Qwen 4 Max é um item de roadmap especificado sem endpoint.

A two-column scoreboard titled "Qwen 4 Max vs Gemini 3.1 Pro - the scoreboard". Left column Qwen 4 Max: Status announced, no date; Input price not published; Output price not published; Context window not published; Long-context retrieval not published; Independent score none exists. Right column Gemini 3.1 Pro: Status preview since Feb 19 2026; Input price $2.00 per 1M tokens; Output price $12.00 per 1M tokens; Context window 1,048,576 tokens; Long-context retrieval 26.3% at 1M tokens; Independent score 30 on index v4.3.2. Footer reads "Gemini 3.1 Pro pricing and vendor-reported retrieval from Google; index v4.3.2 published September 19 2026.", with the OrcaRouter logo bottom-right.

A comparação, e o número de contexto longo que a decide

A especificação do Gemini 3.1 Pro é pública e específica. A do Qwen 4 Max está vazia. O que vale a pena considerar é uma linha da coluna do Gemini, porque é o tipo de número que é citado e não deveria ser:

• Status — Gemini 3.1 Pro em prévia desde 19 de fevereiro de 2026, versus Qwen 4 Max anunciado em 22 de setembro de 2026 sem data

• Preço de entrada — Gemini 3.1 Pro US$ 2,00 por 1M de tokens até um prompt de 200K e US$ 4,00 acima disso, em comparação com Qwen 4 Max, não divulgado

• Preço de saída — Gemini 3.1 Pro US$ 12,00 por 1 milhão até 200 mil e US$ 18,00 acima, versus Qwen 4 Max, não publicado

• Entrada em cache — Gemini 3.1 Pro US$ 0,20 por 1M em leitura de cache, versus Qwen 4 Max não publicado

• Contexto — Gemini 3.1 Pro 1.048.576 tokens, versus Qwen 4 Max não publicado

• Limite de saída — Gemini 3.1 Pro 65.536 tokens, versus Qwen 4 Max não divulgado

• Modalidade — entrada de texto, imagem, vídeo, áudio e PDF no Gemini 3.1 Pro com saída de texto, versus Qwen 4 Max não publicado

• Controle de raciocínio — Gemini 3.1 Pro com níveis de pensamento baixo, médio e alto, versus Qwen 4 Max não publicado

• Recuperação de contexto longo — MRCR v2 reportado pelo fornecedor do Gemini 3.1 Pro em 84,9 por cento na média de oito agulhas a 128K, mas 26,3 por cento na configuração pontual de um milhão de tokens, enquanto para o Qwen 4 Max nada foi reportado

• Pontuações informadas pelo fornecedor — Gemini 3.1 Pro SWE-bench Verified 80,6%, GPQA Diamond 94,3%, ARC-AGI-2 77,1%, Humanity's Last Exam 44,4% sem ferramentas, contra Qwen 4 Max, nada informado

• Pontuação independente — Gemini 3.1 Pro 30 no Artificial Analysis Intelligence Index v4.3.2, em comparação com Qwen 4 Max, para o qual não existe avaliação independente

Essa linha de contexto longo é a que vale a pena levar. Uma janela de contexto de 1.048.576 tokens é um número de marketing; 26,3 por cento de recuperação na configuração de um milhão de tokens é o que o mesmo fornecedor relata quando mede a extremidade distante dessa janela. Ambas as cifras vêm do Google, o que faz da lacuna uma afirmação sobre o modelo, e não sobre o avaliador. Se a sua carga de trabalho depende de encontrar um fato enterrado perto do fim de um prompt de um milhão de tokens, o número de contexto de manchete não lhe diz nada de útil, e esta linha diz-lhe quase tudo.

O índice mudou, o modelo não

O Gemini 3.1 Pro foi lançado em 19 de fevereiro de 2026 com 57 no Artificial Analysis Intelligence Index, em primeiro lugar no setor. Sob a revisão v4.3.2 do índice, publicada em 19 de setembro de 2026, consta como 30. Nada no modelo mudou entre essas duas datas. A régua foi reconstruída, e foi reconstruída quatro dias antes do anúncio do Qwen 4 da Alibaba.

Essa coincidência vale mais do que os próprios números. Três dos quatro modelos neste lote de comparações — Gemini 3.1 Pro, Claude Opus 5 e o carro-chefe Qwen 3.8 — têm pontuações independentes que mudaram sob a mesma revisão, e em cada caso a mudança foi grande o suficiente para inverter um ranking. Qualquer comparação escrita este mês que cite um único valor de índice sem nomear a revisão está comparando pontuações tomadas com réguas diferentes, e o erro não será visível para um leitor.

Para o Qwen 4 Max, a consequência é que o alvo não para de se mover. Quando a Alibaba finalmente publicar, a pontuação a ser batida neste índice será o que a revisão atual disser naquele dia, e a revisão já mudou pelo menos uma vez na última semana.

A screenshot of the OrcaRouter page for Gemini 3.1 Pro in its cost-estimator view (English UI), showing a monthly token volume of 10M against a sample summarisation prompt, an estimated $50.00 per month falling to $43.70 with prompt caching at list price, a cost per request of $0.006040, a note that the estimate uses base-tier rates and that actual token counts depend on the provider's tokenizer, and a PERFORMANCE panel for the last 7 days reading p50 time-to-first-token 10.00 s, output speed 632 tok/s and an error rate of 77.5%, above a 7-day latency trend chart running 09-16 to 09-22.

O que dizem os números operacionais, incluindo o desconfortável

O Gemini 3.1 Pro é roteável no OrcaRouter como google/gemini-3.1-pro-preview, ostentando os selos Flagship e Featured, sem banner de pré-lançamento, ao preço de tabela do Google de US$ 2,00 e US$ 12,00 por milhão de tokens, com 0% de markup. O roteamento em si é honesto — a tarifa exibida na página é a tarifa que o Google publica. Os números operacionais dos sete dias até 22 de setembro também merecem ser publicados, em vez de omitidos: um p50 de tempo até o primeiro token de 10,00 segundos, uma velocidade de saída em torno de 632 tokens por segundo e uma taxa de erro de 77,5% em todo o período. Essa taxa de erro não é uma nota de rodapé. Para um modelo de nível preview sem data de disponibilidade geral, é o número mais relevante para a decisão em toda a página, e uma comparação que cita o preço sem ele está vendendo, não informando.

O mesmo catálogo reúne cerca de 200 modelos em um único endpoint compatível com OpenAI, com failover automático e uma DSL de roteamento, que é o mecanismo que torna uma taxa de erro como essa algo sobrevivível em vez de fatal: um caminho de provedor degradado pode sofrer failover em vez de ser derrubado. A família Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash e Qwen3.8-27B — fica no mesmo endpoint que o Gemini 3.1 Pro Preview, de modo que a substituição sobre a qual este artigo realmente trata, aquela que você pode fazer hoje, é uma mudança de política de roteamento, e não um projeto de migração. O Qwen 4 Max não está no catálogo, e nenhum modelo da linha Qwen 4 está; quando algum for lançado, é aí que ele apareceria.

A decisão, se é que se pode chamar assim

Nenhum dos modelos aqui é um produto com o qual você possa se comprometer, e o conselho honesto é tratar ambos de acordo com isso. O Gemini 3.1 Pro pode ser chamado hoje por um preço publicado, com uma janela de contexto publicada e um histórico público de avaliações, incluindo a fraqueza de recuperação na extremidade final dessa janela; ele também é uma prévia cujo fornecedor avisa para planejar a descontinuação, apresentando uma taxa de erro que seria inaceitável para uma dependência de produção. O Qwen 4 Max não tem nenhum desses problemas porque não tem nenhuma dessas propriedades.

Se você precisa de um modelo agora, a escolha não é entre esses dois. É entre o Gemini 3.1 Pro e o carro-chefe da Qwen já disponível e, com as evidências disponíveis, essa é uma decisão sobre qualidade de recuperação em contexto longo versus uma tarifa de entrada de US$ 2,00 com pesos publicados. Se você puder esperar, observe duas coisas em vez de uma: um model card do Qwen 4 Max e uma data de disponibilidade geral para o Gemini 3.1 Pro. O que chegar primeiro dirá qual desses dois roteiros a Alibaba e o Google estão de fato priorizando.

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente