
Gemini 3.7 Flash vs Gemini 3.1 Pro: A Camada Flash do Google Tornou Seu Próprio Carro-Chefe Obsoleto?
- AlibabaNOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.3 Flash2026-08-2658Inteligência72Código
- DeepSeekNOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1860Inteligência75Código
- obsidianQwen3.8 27B2026-08-1552Inteligência68Código
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
Há uma pergunta desconfortável na linha de modelos de 2026 do Google, e ela é direcionada a todas as equipes que atualmente pagam pelo Gemini 3.1 Pro: por que o modelo Flash barato está superando o carro-chefe no índice independente? O Gemini 3.7 Flash, lançado em 13 de agosto de 2026 a US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de saída, obtém 56 no Artificial Analysis Intelligence Index em raciocínio alto. O Gemini 3.1 Pro, a prévia que o Google lançou em 19 de fevereiro de 2026 a US$ 2,00 / US$ 12,00 — e US$ 4,00 / US$ 18,00 acima do contexto de 200K — marca na faixa dos 40 superiores no mesmo índice hoje. O carro-chefe que liderou o índice no lançamento foi ultrapassado pela própria camada de trabalho pesado, e este artigo é sobre o que isso significa para os dois modelos e para as equipes que precisam escolher entre eles.
A premissa: o nível principal do Google está preso na pré-visualização.
O contexto importa mais do que os números. O Gemini 3.1 Pro está em prévia desde fevereiro de 2026 — sete meses até o momento em que escrevo — e seu sucessor, o Gemini 3.5 Pro, foi anunciado no Google I/O em maio como "chegando no próximo mês", e depois perdeu junho, julho e agosto. Desde o início de setembro, a camada principal está sem sucessor lançado, sem data e com relatos de possível cancelamento. Enquanto isso, a camada Flash lançou três gerações no mesmo período: Gemini 3.6 Flash em 21 de julho, Gemini 3.7 Flash em 13 de agosto, e a capacidade agêntica de compreensão de vídeo em ambos os modelos em 1º de setembro. A comparação não é realmente "Pro vs Flash". É "a camada que o Google está lançando" contra "a camada que o Google parou de lançar".
O contraste da especificação
• Preço — Gemini 3.7 Flash $0,75 / $3,75 por 1M de tokens (promoção até 31 de dezembro de 2026, depois $1,50 / $7,50) vs Gemini 3.1 Pro $2,00 / $12,00 com contexto abaixo de 200K, subindo para $4,00 / $18,00 acima de 200K. Três a quatro vezes mais barato no preço de tabela, antes dos controles de nível de raciocínio.
• Contexto / saída máxima — 1M / 64K vs 1M / 64K. Limites idênticos.
• Entradas — texto, imagem, áudio, vídeo, PDF. A superfície multimodal é a mesma; a diferença é o que o modelo faz com vídeo (abaixo).
• Controle de raciocínio — Gemini 3.7 Flash: pensamento baixo / médio / alto. Gemini 3.1 Pro: baixo / médio / alto, com pensamento dinâmico ativado por padrão.
• Pontuação independente — Gemini 3.7 Flash 56 no Artificial Analysis Intelligence Index vs Gemini 3.1 Pro na casa dos 40 altos na versão atual do índice (pontuou 57 no lançamento na versão anterior).
• Velocidade de saída — Gemini 3.7 Flash aproximadamente 285 tokens/seg em raciocínio alto vs Gemini 3.1 Pro aproximadamente 112–125 tokens/seg — cerca de duas vezes e meia mais rápida.
• Status — Gemini 3.7 Flash estável, GA. Gemini 3.1 Pro em preview, com a curta janela de deprecação do preview.
O índice e a bagunça do benchmark por baixo dele.
A manchete é o índice: a Artificial Analysis, avaliadora independente de múltiplos fornecedores, agora classifica o Gemini 3.7 Flash com 56 e o Gemini 3.1 Pro nos 40 e poucos — o cavalo de batalha à frente do carro-chefe, uma inversão das posições no lançamento do Gemini 3.1 Pro, quando seus 57 lideravam o índice. Esse é o fato mais importante deste confronto, e vem de fonte independente, não de relato do fornecedor.
Abaixo do índice, o livro-razão de benchmarks é uma bagunça de harnesses não comparáveis, e lê-lo ingenuamente produz a resposta errada. O histórico publicado do Gemini 3.1 Pro — 80,6% no SWE-bench Verified, 77,1% no ARC-AGI-2, 94,3% no GPQA Diamond, um Elo de 2887 no LiveCodeBench Pro — foi reportado pelo Google no seu lançamento de fevereiro, usa versões de benchmark diferentes das dos números do Flash e nunca foi reproduzido de maneira uniforme. Os 43,6% do Gemini 3.7 Flash no FrontierCode 1.1, os 65,3% no DeepSWE v1.1 e um Elo de 1588 na arena de desenvolvimento web são igualmente reportados pelo fornecedor nos harnesses mais novos. Onde os dois modelos se sobrepõem em um agregado independente — o AA Index — o Flash vence. Qualquer um que diga que "o Pro vence o Flash no SWE-bench" está comparando duas versões de dois testes diferentes sem dizer isso.


A lacuna de capacidade de vídeo
A capacidade que torna a comparação desequilibrada é o vídeo. O novo modo de compreensão de vídeo agêntico do Google — anunciado em 1º de setembro de 2026 — se aplica ao Gemini 3.7 Flash, ao Gemini 3.6 Flash e ao Gemini 3.5 Flash-Lite. O Gemini 3.1 Pro não está na lista. O modelo Flash lê vídeo da maneira que o novo modo define leitura de vídeo: o modelo decide o que assistir, em que velocidade, e por meio de quadros, áudio ou transcrição, carregando apenas os segmentos relevantes, com economias relatadas pelo fornecedor de até 66% em custo e 88% em tokens. O Gemini 3.1 Pro tecnicamente aceita entrada de vídeo, mas usa o caminho mais antigo de amostragem estática e não recebe nenhuma das novas ferramentas. Para os usuários do carro-chefe, a mais nova capacidade de vídeo da família Gemini está sendo lançada primeiro no modelo mais barato, e o nível Pro não tem data anunciada para recebê-la.
Velocidade, e o problema do risco de pré-visualização
A velocidade amplia a diferença de preço da mesma forma que em todas as comparações com o Gemini 3.7 Flash: cerca de três vezes a taxa de geração em um modelo que já custa um terço do preço. Mas a segunda diferença é aquela que as equipes esquecem de precificar: status. O Gemini 3.1 Pro é um preview, e previews vêm com uma janela curta de aviso de descontinuação quando o sucessor é lançado. Uma carga de trabalho em produção em um modelo preview é um risco permanente de que o ID do modelo mude, os preços mudem ou a capacidade seja alterada com pouco aviso prévio. O Gemini 3.7 Flash é GA — estável, documentado e sem previsão de ser substituído por capricho, mesmo que o ritmo quase mensal de Flash do Google signifique que um 3.8 Flash possa vir logo em seguida. O risco de descontinuação do preview do 3.1 Pro não é hipotético; é o estado atual de um nível cujo sucessor está atrasado há três meses.
Onde o Gemini 3.1 Pro ainda vence
O caso honesto a favor do 3.1 Pro tem três pilares, e nenhum deles é capacidade bruta. Primeiro, o endpoint de ferramentas personalizadas: o Gemini 3.1 Pro é fornecido com uma superfície de API dedicada de bash/ferramentas personalizadas que o Flash não iguala, e equipes que construíram ferramentas de agente com base nela têm um sistema funcional hoje. Segundo, cargas de trabalho ajustadas: um pipeline já ajustado aos padrões de pensamento dinâmico, aos padrões de cache e às pontuações de avaliação do 3.1 Pro é um alvo móvel, e a troca custa um tempo real de engenharia mesmo quando o destino é mais rápido e mais barato. Terceiro, as tarefas específicas em que o histórico de produção mais longo do Pro ainda não tem equivalente no Flash — os benchmarks da geração de lançamento, como GPQA e ARC-AGI-2, nos quais o Flash nunca foi avaliado. Se a sua carga de trabalho for uma dessas, "o Flash supera o Pro no índice" não resolve a sua questão; apenas um teste na sua própria avaliação resolve.
O veredito: o que a ascensão da camada Flash significa
A direção é inequívoca. Para uma nova carga de trabalho hoje, o Gemini 3.7 Flash é o melhor Gemini padrão: mais barato, mais rápido, estável em GA, mais alto no índice independente, e é o primeiro a receber a nova capacidade de vídeo. O Gemini 3.1 Pro mantém uma base real, porém estreita — usuários de ferramentas personalizadas, pipelines ajustados e tarefas onde seu registro mais antigo de benchmarks ainda se aplica. A história mais ampla é que o nível principal do Google está estagnado, enquanto o nível de trabalho pesado é onde a empresa está de fato competindo — e as equipes que ainda pagam preços de principal pelo 3.1 Pro estão pagando por um status que a própria empresa deixou de defender.

Para equipes que querem migrar sem um projeto, a mudança entre os modelos Gemini é uma alteração de nome de modelo, e não uma integração. O Gemini 3.1 Pro é servido no OrcaRouter pelo preço de tabela de US$ 2,00 / US$ 12,00, repassado com margem de 0%, junto com o Gemini 3.6 Flash e o restante da camada Gemini roteável atrás de uma única chave — então uma carga de trabalho pode enviar uma fatia do tráfego para um modelo Flash, manter o 3.1 Pro como fallback para as tarefas em que ele ainda vence, e deixar o failover automático absorver o risco de qualquer um dos modelos do Google mudar. O próprio Gemini 3.7 Flash está disponível pela API do Google e por várias plataformas de terceiros. O DSL de roteamento e a fusão de modelos são exatamente como você rodaria uma comparação direta entre os dois modelos Gemini na sua própria avaliação antes de trocar. A escolha que o portfólio está empurrando para você é clara: use a camada Flash por padrão e mantenha o Pro apenas para os casos restritos em que ele comprovadamente justifica seu preço premium.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
