Gemini 2.5 Flash

google/gemini-2.5-flash
VisiónAudioHerramientasJSONRazonamiento
por Google · 2025-06-17

Gemini 2.5 Flash es el modelo de trabajo de última generación de Google, diseñado específicamente para tareas avanzadas de razonamiento, programación, matemáticas y ciencia. Incluye capacidades de "pensamiento" integradas, lo que le permite proporcionar respuestas con mayor...

ctx1.05M tokens
Salida máx.65.5K
Entradafile + image + text + audio + video
Salidatext
p50 TTFT10.00 s
ENTRADA$0.30/ 1M tokens
SALIDA$2.50/ 1M tokens
p50 TTFT10.00 s7 d
p95 TTFT10.00 s7 d
TRÁFICO433.8Ktokens / 7 d

Google Gemini 2.5 Flash es un modelo de lenguaje multimodal desarrollado por Google. Pertenece a la serie Gemini 2.5, diseñada para el procesamiento eficiente de entradas de texto, imágenes, audio y…

¿Qué es Google Gemini 2.5 Flash?

¿Quién debería usar Gemini 2.5 Flash?

¿Cuáles son las especificaciones clave de Gemini 2.5 Flash?

¿En qué se diferencia Gemini 2.5 Flash de otros modelos Gemini?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Precios

Entrada / 1M tokens$0.300
Salida / 1M tokens$2.50
Lectura caché / 1M$0.030
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $9.60 · Con caché de prompts $8.66

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.001255

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
10.00 s
Velocidad de salida
1247 tok/s
p95 TTFT
10.00 s
Tasa de error
2.3%

Pruebas de referencia públicas

17.8
AA Coding
Mejor que el 15 % de los modelos comparados
n.º 105 de 123
14.1
AA Intelligence
Mejor que el 14 % de los modelos comparados
n.º 107 de 125
60.3
AA Math
Mejor que el 44 % de los modelos comparados
n.º 45 de 81
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
Fuente: artificialanalysis.ai

Comparativa

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrada $/M$0.30$2.00$4.00$0.50
Salida $/M$2.50$12.00$18.00$3.00
Contexto1.0M1.0M1.0M1.0M
Calidad3/1010/1010/109/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuánto cuesta Gemini 2.5 Flash por token?
Input es $0.30 por 1 millón de tokens, output es $2.50 por 1 millón de tokens. Estas son las tarifas del proveedor Google con margen cero a través de OrcaRouter.
¿Cuál es el tamaño de la ventana de contexto de Gemini 2.5 Flash?
La ventana de contexto es de 1 048 576 tokens (1M tokens). La salida máxima es de 65 536 tokens.
¿Cuáles son las principales fortalezas de Gemini 2.5 Flash?
Alcanza una puntuación de 93.2 en MATH-500, lo que demuestra un sólido razonamiento matemático. También admite múltiples modalidades de entrada (archivo, imagen, texto, audio, video) y cuenta con una ventana de contexto muy amplia a un precio competitivo.
¿Cómo se compara Gemini 2.5 Flash con Gemini 2.0 Flash?
Gemini 2.5 Flash es más caro pero ofrece un rendimiento matemático mejorado (93.2 frente a una puntuación más baja en MATH-500). Ambos tienen ventanas de contexto de 1M. 2.0 Flash cuesta $0.15/$0.60 por 1M tokens, mientras que 2.5 Flash cuesta $0.30/$2.50.
¿Añade OrcaRouter algún recargo al precio del modelo?
No, OrcaRouter factura a la tarifa exacta del proveedor con margen cero. Usted paga $0.30 por 1M de entrada y $2.50 por 1M de tokens de salida.
¿Puedo usar Gemini 2.5 Flash a través de una API compatible con OpenAI?
Sí. Usa la URL base https://api.orcarouter.ai/v1 y el ID de modelo "google/gemini-2.5-flash". Todos los SDKs de OpenAI y clientes HTTP funcionan con parámetros estándar de finalización de chat.
¿Qué modalidades de entrada admite Gemini 2.5 Flash?
Soporta entradas de archivo, imagen, texto, audio y video. Puedes combinarlas en una sola solicitud.
¿Cómo se manejan mis datos al usar Gemini 2.5 Flash a través de OrcaRouter?
El manejo de datos sigue las políticas de privacidad de la API de Google y los términos de OrcaRouter. Google puede procesar datos para mejorar el modelo a menos que optes por no participar a través de tu cuenta de Google Cloud. Consulta la documentación de procesamiento de datos de Google para obtener detalles.

Insertar esta insignia

Google: Gemini 2.5 Flash$0.30/M in10000ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="Google: Gemini 2.5 Flash en OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

Ficha del modelo como datos

GET /api/public/models/google/gemini-2.5-flashAbrir
Legible por máquina:/llms.txt/llms-full.txt