Gemini 3.5 Flash

google/gemini-3.5-flash
VisãoÁudioFerramentasJSONRaciocínio
por google · 2026-05-23

Google Gemini 3.5 Flash — o modelo Flash-tier mais forte do Google, situando-se logo abaixo do 3.1-pro-preview em inteligência (AA Intel 55.3 vs 57.2) com latência Flash. Janela de contexto de 1M tokens (1,048,576), saída máxima de 64K (65,536). Entrada multimodal completa em texto, imagem, áudio, vídeo e arquivo; saída apenas de texto. AA Coding 45, GPQA Diamond 92.2%, IFBench 76.3% (seguimento de instruções de alto nível), Long-Context Recall 69.3%, SciCode 53.1%, τ²-Bench 95.3% (uso agêntico de ferramentas), HLE 41%. Suporta raciocínio (include_reasoning / reasoning), saídas estruturadas, chamadas de ferramentas, response_format, seed, stop e controles de amostragem padrão. Endpoints: chat_completions, gemini_generate. Melhor adequação: loops agênticos de alto volume, análise de documentos longos e extração multimodal onde a latência ou o custo do Pro-tier é excessivo.

ctx1.05M tokens
Saída máx.65.5K
Entradatext + image + video + file + audio
Saídatext
p50 TTFT2.77 s
ENTRADA$1.50/ 1M tokens
SAÍDA$9.00/ 1M tokens
p50 TTFT2.77 s7 d
p95 TTFT8.91 s7 d
TRÁFEGO1.0Mtokens / 7 d

O Gemini 3.5 Flash é um modelo de linguagem de grande porte desenvolvido pelo Google, otimizado para velocidade e eficiência. Ele pertence à família Gemini e foi projetado para lidar com entradas…

O que é Gemini 3.5 Flash?

Quem deve usar o Gemini 3.5 Flash?

Quais modalidades de entrada o Gemini 3.5 Flash suporta?

Como o Gemini 3.5 Flash é acessado através do OrcaRouter?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preços

Entrada / 1M tokens$1.50
Saída / 1M tokens$9.00
Leitura de cache / 1M$0.150
Escrita de cache / 1M$0.083
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $37.50 · Com cache de prompt $32.78

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.004523

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
2.77 s
Velocidade de saída
732 tok/s
p95 TTFT
8.91 s
Taxa de erro
1.00%

Benchmarks públicos

70.1
AA Coding
Melhor que 88% dos modelos comparados
nº 15 de 120
50.2
AA Intelligence
Melhor que 83% dos modelos comparados
nº 21 de 122
51.0
AA Math
Melhor que 27% dos modelos comparados
nº 59 de 81
GPQA Diamond
92.2
Humanity's Last Exam
41.0
IFBench
76.3
Long-Context Recall
69.3
MMLU-Pro
59.0 index
SciCode
53.1
tau_banking
25.4
TerminalBench Hard
40.9
terminalbench_v2_1
78.7
τ²-Bench
95.3
Fonte: artificialanalysis.ai

Comparativo

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrada $/M$1.50$2.00$4.00$0.50
Saída $/M$9.00$12.00$18.00$3.00
Contexto1.0M1.0M1.0M1.0M
Qualidade9/1010/1010/109/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o Gemini 3.5 Flash no OrcaRouter?
Os tokens de entrada custam $1.50 por 1 milhão de tokens; os tokens de saída custam $9.00 por 1 milhão de tokens. A OrcaRouter cobra à taxa do provedor, com markup zero. Não há taxas adicionais.
Qual é o tamanho da janela de contexto do Gemini 3.5 Flash?
Ele suporta uma janela de contexto de 1.048.576 tokens (cerca de 1 milhão de tokens). Isso inclui tanto tokens de entrada quanto de saída combinados.
Quais são os principais pontos fortes do Gemini 3.5 Flash?
Ele é otimizado para baixa latência, alta taxa de transferência e eficiência de custo. Suporta entradas multimodais (texto, imagem, vídeo, arquivo, áudio) e uma grande janela de contexto, tornando-o ideal para aplicações em tempo real e processamento de documentos longos.
Como o Gemini 3.5 Flash se compara ao Gemini 3.5 Pro?
Flash é mais rápido e mais barato, mas tem desempenho menor em benchmarks para tarefas complexas de raciocínio e matemática. Pro é mais preciso, porém mais lento e mais caro. Flash é melhor para aplicações de alto volume e sensíveis à latência.
Como os dados são tratados ao usar o Gemini 3.5 Flash via OrcaRouter?
OrcaRouter atua como um proxy e não armazena seus dados. No entanto, as políticas de tratamento de dados do Google se aplicam ao modelo subjacente. A OrcaRouter recomenda revisar os termos do Google sobre retenção de dados e privacidade.
Como posso chamar o Gemini 3.5 Flash usando uma API compatível com OpenAI?
Use a URL base https://api.orcarouter.ai/v1, o ID do modelo "google/gemini-3.5-flash" e passe uma chave de API do OrcaRouter no cabeçalho Authorization. A API suporta chat completions padrão e streaming.
Qual comprimento de saída o Gemini 3.5 Flash pode gerar?
Pode gerar até 65,536 tokens por resposta. Isso é significativamente maior do que muitos modelos, permitindo conteúdo de formato longo, código ou raciocínio estendido.
Existe algum desconto para tokens repetidos ou em cache?
Com base nos fatos fornecidos, o OrcaRouter não oferece cacheamento ou descontos por volume. Cada token é cobrado pela taxa padrão, independentemente de reutilização.

Incorporar este selo

Gemini 3.5 Flash$1.50/M in2768ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash no OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

Ficha do modelo como dados

GET /api/public/models/google/gemini-3.5-flashAbrir
Legível por máquina:/llms.txt/llms-full.txt