Gemini 2.5 Flash

google/gemini-2.5-flash
VisãoÁudioFerramentasJSONRaciocínio
por Google · 2025-06-17

Gemini 2.5 Flash é o modelo de trabalho de última geração do Google, especificamente projetado para raciocínio avançado, codificação, matemática e tarefas científicas. Ele inclui capacidades de "pensamento" incorporadas, permitindo fornecer respostas com maior...

ctx1.05M tokens
Saída máx.65.5K
Entradafile + image + text + audio + video
Saídatext
p50 TTFT10.00 s
ENTRADA$0.30/ 1M tokens
SAÍDA$2.50/ 1M tokens
p50 TTFT10.00 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO433.8Ktokens / 7 d

O Google Gemini 2.5 Flash é um modelo de linguagem multimodal desenvolvido pelo Google. Ele pertence à série Gemini 2.5, projetado para processamento eficiente de entradas de texto, imagens, áudio e…

O que é o Google Gemini 2.5 Flash?

Quem deve usar o Gemini 2.5 Flash?

Quais são as principais especificações do Gemini 2.5 Flash?

Como o Gemini 2.5 Flash difere dos outros modelos Gemini?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preços

Entrada / 1M tokens$0.300
Saída / 1M tokens$2.50
Leitura de cache / 1M$0.030
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $9.60 · Com cache de prompt $8.66

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.001254

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
10.00 s
Velocidade de saída
1247 tok/s
p95 TTFT
10.00 s
Taxa de erro
2.3%

Benchmarks públicos

17.8
AA Coding
Melhor que 15% dos modelos comparados
nº 105 de 123
14.1
AA Intelligence
Melhor que 14% dos modelos comparados
nº 107 de 125
60.3
AA Math
Melhor que 44% dos modelos comparados
nº 45 de 81
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
Fonte: artificialanalysis.ai

Comparativo

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrada $/M$0.30$2.00$4.00$0.50
Saída $/M$2.50$12.00$18.00$3.00
Contexto1.0M1.0M1.0M1.0M
Qualidade3/1010/1010/109/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o Gemini 2.5 Flash por token?
A entrada é de $0.30 por 1 milhão de tokens, a saída é de $2.50 por 1 milhão de tokens. Estas são as taxas do provedor Google com margem zero através do OrcaRouter.
Qual é o tamanho da janela de contexto do Gemini 2.5 Flash?
A janela de contexto é de 1.048.576 tokens (1M tokens). A saída máxima é de 65.536 tokens.
Quais são os principais pontos fortes do Gemini 2.5 Flash?
Ele atinge uma pontuação de 93,2 no MATH-500, demonstrando forte raciocínio matemático. Ele também suporta múltiplas modalidades de entrada (arquivo, imagem, texto, áudio, vídeo) e possui uma janela de contexto muito grande a um preço competitivo.
Como o Gemini 2.5 Flash se compara com o Gemini 2.0 Flash?
Gemini 2.5 Flash é mais caro, mas oferece melhor desempenho matemático (93,2 vs. pontuação inferior no MATH-500). Ambos têm janelas de contexto de 1M. O 2.0 Flash custa $0,15/$0,60 por 1M de tokens, enquanto o 2.5 Flash custa $0,30/$2,50.
O OrcaRouter adiciona algum markup ao preço do modelo?
Não, a OrcaRouter cobra exatamente pela taxa do provedor, sem margem de lucro. Você paga $0,30 por 1M de entrada e $2,50 por 1M de tokens de saída.
Posso usar o Gemini 2.5 Flash através de uma API compatível com OpenAI?
Sim. Use a URL base https://api.orcarouter.ai/v1 e o ID do modelo "google/gemini-2.5-flash". Todos os SDKs da OpenAI e clientes HTTP funcionam com parâmetros padrão de conclusão de chat.
Quais modalidades de entrada o Gemini 2.5 Flash suporta?
Isso suporta entradas de arquivo, imagem, texto, áudio e vídeo. Você pode misturá-las em uma única solicitação.
Como meus dados são tratados ao usar o Gemini 2.5 Flash através do OrcaRouter?
O tratamento de dados segue as políticas de privacidade da API do Google e os termos da OrcaRouter. O Google pode processar dados para melhoria do modelo, a menos que você opte por não participar por meio da sua conta do Google Cloud. Consulte a documentação de processamento de dados do Google para obter detalhes.

Incorporar este selo

Google: Gemini 2.5 Flash$0.30/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="Google: Gemini 2.5 Flash no OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

Ficha do modelo como dados

GET /api/public/models/google/gemini-2.5-flashAbrir
Legível por máquina:/llms.txt/llms-full.txt