Gemini 3.5 Flash

google/gemini-3.5-flash
VisiónAudioHerramientasJSONRazonamiento
por google · 2026-05-23

Google Gemini 3.5 Flash: el modelo Flash más potente de Google, justo por debajo de 3.1-pro-preview en inteligencia (AA Intel 55.3 frente a 57.2) con latencia Flash. Ventana de contexto de 1 millón de tokens (1 048 576), salida máxima de 64K (65 536). Entrada multimodal completa: texto, imagen, audio, video y archivos; solo salida de texto. AA Coding 45, GPQA Diamond 92.2 %, IFBench 76.3 % (seguimiento de instrucciones de primer nivel), Long-Context Recall 69.3 %, SciCode 53.1 %, τ²-Bench 95.3 % (uso agéntico de herramientas), HLE 41 %. Compatible con razonamiento (include_reasoning / reasoning), salidas estructuradas, llamadas a herramientas, response_format, seed, stop y controles de muestreo estándar. Puntos de conexión: chat_completions, gemini_generate. Mejor ajuste: bucles agénticos de alto volumen, análisis de documentos extensos y extracción multimodal donde la latencia o el costo del nivel Pro resulten excesivos.

ctx1M tokens
Salida máx.65K
Entradatext + image + video + file + audio
Salidatext
p50 TTFT4.10 s
ENTRADA$1.50/ 1M tokens
SALIDA$9.00/ 1M tokens
p50 TTFT4.10 s7 d
p95 TTFT10.00 s7 d
TRÁFICO33.4Mtokens / 7 d

Gemini 3.5 Flash es un modelo de lenguaje grande desarrollado por Google, ajustado para velocidad y eficiencia. Pertenece a la familia Gemini y está diseñado para manejar entradas multimodales…

¿Qué es Gemini 3.5 Flash?

¿Quién debería usar Gemini 3.5 Flash?

¿Qué modalidades de entrada admite Gemini 3.5 Flash?

¿Cómo se accede a Gemini 3.5 Flash a través de OrcaRouter?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Precios

Entrada / 1M tokens$1.50
Salida / 1M tokens$9.00
Lectura caché / 1M$0.150
Escritura caché / 1M$0.083
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $37.50 · Con caché de prompts $32.78

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.004527

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
4.10 s
Velocidad de salida
362 tok/s
p95 TTFT
10.00 s
Tasa de error
0.08%

Pruebas de referencia públicas

70.1
AA Coding
Mejor que el 84 % de los modelos comparados
n.º 21 de 133
52.0
AA Intelligence
Mejor que el 77 % de los modelos comparados
n.º 29 de 135
51.0
AA Math
Mejor que el 27 % de los modelos comparados
n.º 60 de 82
GPQA Diamond
92.2
Humanity's Last Exam
42.7
IFBench
76.3
Long-Context Recall
81.0
MMLU-Pro
59.0 index
SciCode
53.1
tau_banking
32.2
TerminalBench Hard
40.9
terminalbench_v2_1
78.7
τ²-Bench
95.3
Fuente: artificialanalysis.ai

Actividad de la comunidad

De qué hablan los desarrolladores esta semana

Hacker News0 menciones · 7 d

Comparativa

Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrada $/M$1.50$2.00$4.00$0.50
Salida $/M$9.00$12.00$18.00$3.00
Contexto1.0M1.0M1.0M1.0M
Calidad9/1010/1010/109/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuánto cuesta Gemini 3.5 Flash en OrcaRouter?
Los tokens de entrada son $1.50 por 1 millón de tokens; los tokens de salida son $9.00 por 1 millón de tokens. OrcaRouter factura a la tarifa del proveedor sin margen adicional. No hay cargos adicionales.
¿Cuál es el tamaño de la ventana de contexto de Gemini 3.5 Flash?
Admite una ventana de contexto de 1,048,576 tokens (aproximadamente 1 millón de tokens). Esto incluye tanto tokens de entrada como de salida combinados.
¿Cuáles son las principales fortalezas de Gemini 3.5 Flash?
Está optimizado para baja latencia, alto rendimiento y eficiencia de costos. Admite entradas multimodales (texto, imagen, video, archivo, audio) y una ventana de contexto grande, lo que lo hace ideal para aplicaciones en tiempo real y procesamiento de documentos largos.
¿Cómo se compara Gemini 3.5 Flash con Gemini 3.5 Pro?
Flash es más rápido y más barato, pero tiene un rendimiento inferior en pruebas de benchmark en tareas de razonamiento complejo y matemáticas. Pro es más preciso, pero más lento y más caro. Flash es mejor para aplicaciones de alto volumen y sensibles a la latencia.
¿Cómo se manejan los datos al utilizar Gemini 3.5 Flash a través de OrcaRouter?
OrcaRouter actúa como un proxy y no almacena tus datos. Sin embargo, las políticas de manejo de datos de Google se aplican al modelo subyacente. OrcaRouter recomienda revisar los términos de Google sobre retención de datos y privacidad.
¿Cómo llamo a Gemini 3.5 Flash usando una API compatible con OpenAI?
Usa la URL base https://api.orcarouter.ai/v1, el ID del modelo "google/gemini-3.5-flash", y pasa una clave de API de OrcaRouter en el encabezado Authorization. La API admite completaciones de chat estándar y streaming.
¿Qué longitud de salida puede generar Gemini 3.5 Flash?
Puede generar hasta 65,536 tokens por respuesta. Esto es significativamente mayor que muchos modelos, lo que permite contenido de formato largo, código o razonamiento extendido.
¿Hay algún descuento para tokens repetidos o en caché?
Basado en los hechos proporcionados, OrcaRouter no ofrece almacenamiento en caché ni descuentos por volumen. Cada token se factura a la tarifa estándar independientemente de la reutilización.

Insertar esta insignia

Gemini 3.5 Flash$1.50/M in4102ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg" alt="Gemini 3.5 Flash en OrcaRouter" /> </a>
Markdown [![Gemini 3.5 Flash](https://www.orcarouter.ai/embed/google/gemini-3.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash)

Ficha del modelo como datos

GET /api/public/models/google/gemini-3.5-flashAbrir
Legible por máquina:/llms.txt/llms-full.txt