
Qwen 4 Max vs Gemini 3.1 Pro: o carro-chefe não anunciado contra a prévia que nunca terminou
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
A maioria das comparações coloca um produto já lançado contra outro produto já lançado. Esta é incomum: o Qwen 4 Max foi mostrado em pré-visualização na conferência Yunqi, em Hangzhou, em 22 de setembro de 2026, sem data de lançamento, sem preço e sem pesos, e o Gemini 3.1 Pro está em pré-visualização desde 19 de fevereiro de 2026 e continua em pré-visualização — sete meses depois, sem data de disponibilidade geral anunciada e sem data de encerramento em sua tabela de depreciação. Nenhum dos modelos neste confronto é um produto consolidado. Isso não é motivo para pular a comparação. É a comparação, e é a única coisa sobre ela que é genuinamente informativa.
Sete meses de prévia
Uma designação de prévia deveria ser um estado de curta duração. O Gemini 3.1 Pro agora a mantém ao longo de três lançamentos do Flash do mesmo laboratório, incluindo o Gemini 3.8 Flash, em 2 de setembro de 2026, que o Google descreve como seu modelo Flash mais inteligente. Nos índices compostos independentes, esse modelo agora pontua acima do 3.1 Pro. A linha Pro do Google não tem membro mais recente: não há Gemini 3.8 Pro, e a geração 3.5 Pro foi adiada e, segundo relatos, deixada de lado. O efeito prático é que o modelo que carrega o nome Pro não é mais o modelo com melhor pontuação de seu próprio fornecedor.
O próprio texto de limitação do Google na entrada do catálogo aconselha planejar a descontinuação do preview, que é a forma honesta de interpretar o status. Um preview sem data de GA e sem data de encerramento é um modelo sobre o qual você pode construir, mas em torno do qual não pode planejar.
O lado Qwen é uma imagem espelhada com o sinal invertido. O Qwen 4 Max não está em uma prévia longa; está em pré-prévia, sem nada publicado. Os dois modos de falha são opostos: o Gemini 3.1 Pro é um endpoint real cuja existência de longo prazo não é especificada, e o Qwen 4 Max é um item de roadmap especificado sem endpoint.

A comparação, e o número de contexto longo que a decide
A especificação do Gemini 3.1 Pro é pública e específica. A do Qwen 4 Max está vazia. O que vale a pena considerar é uma linha da coluna do Gemini, porque é o tipo de número que é citado e não deveria ser:
• Status — Gemini 3.1 Pro em prévia desde 19 de fevereiro de 2026, versus Qwen 4 Max anunciado em 22 de setembro de 2026 sem data
• Preço de entrada — Gemini 3.1 Pro US$ 2,00 por 1M de tokens até um prompt de 200K e US$ 4,00 acima disso, em comparação com Qwen 4 Max, não divulgado
• Preço de saída — Gemini 3.1 Pro US$ 12,00 por 1 milhão até 200 mil e US$ 18,00 acima, versus Qwen 4 Max, não publicado
• Entrada em cache — Gemini 3.1 Pro US$ 0,20 por 1M em leitura de cache, versus Qwen 4 Max não publicado
• Contexto — Gemini 3.1 Pro 1.048.576 tokens, versus Qwen 4 Max não publicado
• Limite de saída — Gemini 3.1 Pro 65.536 tokens, versus Qwen 4 Max não divulgado
• Modalidade — entrada de texto, imagem, vídeo, áudio e PDF no Gemini 3.1 Pro com saída de texto, versus Qwen 4 Max não publicado
• Controle de raciocínio — Gemini 3.1 Pro com níveis de pensamento baixo, médio e alto, versus Qwen 4 Max não publicado
• Recuperação de contexto longo — MRCR v2 reportado pelo fornecedor do Gemini 3.1 Pro em 84,9 por cento na média de oito agulhas a 128K, mas 26,3 por cento na configuração pontual de um milhão de tokens, enquanto para o Qwen 4 Max nada foi reportado
• Pontuações informadas pelo fornecedor — Gemini 3.1 Pro SWE-bench Verified 80,6%, GPQA Diamond 94,3%, ARC-AGI-2 77,1%, Humanity's Last Exam 44,4% sem ferramentas, contra Qwen 4 Max, nada informado
• Pontuação independente — Gemini 3.1 Pro 30 no Artificial Analysis Intelligence Index v4.3.2, em comparação com Qwen 4 Max, para o qual não existe avaliação independente
Essa linha de contexto longo é a que vale a pena levar. Uma janela de contexto de 1.048.576 tokens é um número de marketing; 26,3 por cento de recuperação na configuração de um milhão de tokens é o que o mesmo fornecedor relata quando mede a extremidade distante dessa janela. Ambas as cifras vêm do Google, o que faz da lacuna uma afirmação sobre o modelo, e não sobre o avaliador. Se a sua carga de trabalho depende de encontrar um fato enterrado perto do fim de um prompt de um milhão de tokens, o número de contexto de manchete não lhe diz nada de útil, e esta linha diz-lhe quase tudo.
O índice mudou, o modelo não
O Gemini 3.1 Pro foi lançado em 19 de fevereiro de 2026 com 57 no Artificial Analysis Intelligence Index, em primeiro lugar no setor. Sob a revisão v4.3.2 do índice, publicada em 19 de setembro de 2026, consta como 30. Nada no modelo mudou entre essas duas datas. A régua foi reconstruída, e foi reconstruída quatro dias antes do anúncio do Qwen 4 da Alibaba.
Essa coincidência vale mais do que os próprios números. Três dos quatro modelos neste lote de comparações — Gemini 3.1 Pro, Claude Opus 5 e o carro-chefe Qwen 3.8 — têm pontuações independentes que mudaram sob a mesma revisão, e em cada caso a mudança foi grande o suficiente para inverter um ranking. Qualquer comparação escrita este mês que cite um único valor de índice sem nomear a revisão está comparando pontuações tomadas com réguas diferentes, e o erro não será visível para um leitor.
Para o Qwen 4 Max, a consequência é que o alvo não para de se mover. Quando a Alibaba finalmente publicar, a pontuação a ser batida neste índice será o que a revisão atual disser naquele dia, e a revisão já mudou pelo menos uma vez na última semana.

O que dizem os números operacionais, incluindo o desconfortável
O Gemini 3.1 Pro é roteável no OrcaRouter como google/gemini-3.1-pro-preview, ostentando os selos Flagship e Featured, sem banner de pré-lançamento, ao preço de tabela do Google de US$ 2,00 e US$ 12,00 por milhão de tokens, com 0% de markup. O roteamento em si é honesto — a tarifa exibida na página é a tarifa que o Google publica. Os números operacionais dos sete dias até 22 de setembro também merecem ser publicados, em vez de omitidos: um p50 de tempo até o primeiro token de 10,00 segundos, uma velocidade de saída em torno de 632 tokens por segundo e uma taxa de erro de 77,5% em todo o período. Essa taxa de erro não é uma nota de rodapé. Para um modelo de nível preview sem data de disponibilidade geral, é o número mais relevante para a decisão em toda a página, e uma comparação que cita o preço sem ele está vendendo, não informando.
O mesmo catálogo reúne cerca de 200 modelos em um único endpoint compatível com OpenAI, com failover automático e uma DSL de roteamento, que é o mecanismo que torna uma taxa de erro como essa algo sobrevivível em vez de fatal: um caminho de provedor degradado pode sofrer failover em vez de ser derrubado. A família Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash e Qwen3.8-27B — fica no mesmo endpoint que o Gemini 3.1 Pro Preview, de modo que a substituição sobre a qual este artigo realmente trata, aquela que você pode fazer hoje, é uma mudança de política de roteamento, e não um projeto de migração. O Qwen 4 Max não está no catálogo, e nenhum modelo da linha Qwen 4 está; quando algum for lançado, é aí que ele apareceria.
A decisão, se é que se pode chamar assim
Nenhum dos modelos aqui é um produto com o qual você possa se comprometer, e o conselho honesto é tratar ambos de acordo com isso. O Gemini 3.1 Pro pode ser chamado hoje por um preço publicado, com uma janela de contexto publicada e um histórico público de avaliações, incluindo a fraqueza de recuperação na extremidade final dessa janela; ele também é uma prévia cujo fornecedor avisa para planejar a descontinuação, apresentando uma taxa de erro que seria inaceitável para uma dependência de produção. O Qwen 4 Max não tem nenhum desses problemas porque não tem nenhuma dessas propriedades.
Se você precisa de um modelo agora, a escolha não é entre esses dois. É entre o Gemini 3.1 Pro e o carro-chefe da Qwen já disponível e, com as evidências disponíveis, essa é uma decisão sobre qualidade de recuperação em contexto longo versus uma tarifa de entrada de US$ 2,00 com pesos publicados. Se você puder esperar, observe duas coisas em vez de uma: um model card do Qwen 4 Max e uma data de disponibilidade geral para o Gemini 3.1 Pro. O que chegar primeiro dirá qual desses dois roteiros a Alibaba e o Google estão de fato priorizando.

Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
