Gemini 3.8 Flash

google/gemini-3.8-flash
NuevoDestacado
VisiónAudioHerramientasJSONRazonamiento
por Google · 2026-09-02

Gemini 3.8 Flash es el modelo Flash más inteligente de Google, con mejoras significativas respecto a 3.7 Flash en ingeniería de software, tareas agénticas y razonamiento de múltiples pasos.

ctx1M tokens
Salida máx.65K
Entradatext + image + video + file + audio
Salidatext
p50 TTFT4.53 s
ENTRADA$0.75/ 1M tokens
SALIDA$3.75/ 1M tokens
p50 TTFT4.53 s7 d
p95 TTFT10.00 s7 d
TRÁFICO105.8Mtokens / 7 d

Gemini 3.8 Flash está dirigido a equipos que necesitan un modelo de Google con entrada multimodal amplia, una ventana de contexto extensa, un límite de salida grande y una API compatible con OpenAI.…

¿Quién debería usar Gemini 3.8 Flash?

¿Qué entradas y salidas se admiten?

Ejemplos de código

Llama desde cualquier SDK

Compatible con OpenAI: conserva tu SDK actual

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parámetros admitidos

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Precios

Entrada / 1M tokens$0.750
Salida / 1M tokens$3.75
Lectura caché / 1M$0.075
MonedaUSD

Calculadora de costes

Tokens / mes10MM
Proporción de entrada70%%
Estimado / mes $16.50 · Con caché de prompts $14.14

Estimación según precio de lista

Estimador de tokens y coste

Tokens de entrada: 18Coste por solicitud: $0.001888

Solo una estimación: el número real de tokens depende del tokenizador del proveedor.

Rendimiento

p50 TTFT
4.53 s
Velocidad de salida
282 tok/s
p95 TTFT
10.00 s
Tasa de error
0.54%

Pruebas de referencia públicas

76.3
AA Coding
Mejor que el 95 % de los modelos comparados
n.º 7 de 137
58.7
AA Intelligence
Mejor que el 92 % de los modelos comparados
n.º 11 de 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Fuente: artificialanalysis.ai, deepmind.google

Actividad de la comunidad

De qué hablan los desarrolladores esta semana

Hacker News13 menciones · 7 d13 más que la semana anterior

Comparativa

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrada $/M$0.75$2.00$4.00$0.50
Salida $/M$3.75$12.00$18.00$3.00
Contexto1.0M1.0M1.0M1.0M
Calidad9/1010/1010/109/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

Preguntas frecuentes

¿Cuánto cuesta Gemini 3.8 Flash a través de OrcaRouter?
OrcaRouter factura Gemini 3.8 Flash a la tarifa del proveedor sin ningún margen: $0.75 por cada 1M de tokens de entrada y $3.75 por cada 1M de tokens de salida. No se indica ninguna tarifa de sesión ni tarifa de plataforma en el catálogo. Dado que la salida cuesta cinco veces más que la entrada, las generaciones largas costarán proporcionalmente más que las indicaciones largas.
¿Cuáles son la ventana de contexto y el tamaño máximo de salida?
Gemini 3.8 Flash tiene una ventana de contexto de 1 048 576 tokens y una salida máxima de 65 536 tokens. La ventana de contexto está anunciada para entradas de texto, imagen, video, archivo y audio. El proveedor no proporciona una fórmula separada de tokens por tipo de medio en este listado.
¿Cuáles son las principales fortalezas de Gemini 3.8 Flash?
Sus fortalezas enumeradas son un contexto de 1,048,576 tokens, una salida máxima de 65,536 tokens, una amplia entrada multimodal y una puntuación de 54.9 en HLE-Verified. Estas características se adaptan al trabajo de preguntas de nivel experto, tareas con documentos largos y comprensión multimedia a través de una API compatible con OpenAI. No se hacen afirmaciones adicionales de calidad en el catálogo.
¿Cómo se compara Gemini 3.8 Flash con otros modelos?
El registro del catálogo no contiene puntuaciones de referencia ni precios para ningún modelo alternativo. Las comparaciones deben realizarse ejecutando conjuntos de pruebas idénticos a través de OrcaRouter y midiendo la precisión, el costo y la velocidad. Utilice el ID de modelo google/gemini-3.8-flash junto con otros ID y compare los campos realmente devueltos para su carga de trabajo.
¿Qué términos de tratamiento de datos aplican?
Esta página de catálogo no indica reglas de retención, entrenamiento o intercambio de datos. Si envías datos a Gemini 3.8 Flash a través de OrcaRouter, el contenido de la solicitud se procesa para completar la transacción. Los términos comerciales para el manejo de datos se encuentran en los términos del proveedor de Google y los términos de OrcaRouter. Consulta esos documentos antes de enviar datos regulados o confidenciales.
¿Cómo llamo a Gemini 3.8 Flash usando una API compatible con OpenAI?
Use la URL base de OrcaRouter https://api.orcarouter.ai/v1 y establezca el campo del modelo en google/gemini-3.8-flash. Luego envíe una solicitud estándar de finalización de chat de estilo OpenAI con su clave de API de OrcaRouter. Los clientes existentes que admitan chat.completions.create deberían funcionar después de cambiar la URL base y el nombre del modelo.
¿Añade OrcaRouter un margen a la tarifa del proveedor?
No. El listado del catálogo indica que el modelo se factura a la tarifa del proveedor sin margen adicional. Los precios de token de entrada y salida mostrados son $0.75 por 1M de entrada y $3.75 por 1M de salida. Esto hace que el costo por token indicado sea la tarifa directa del proveedor.
¿Está disponible el almacenamiento en caché de indicaciones para este modelo?
Los hechos del modelo no mencionan el almacenamiento en caché de mensajes, los precios de aciertos de caché ni el comportamiento automático de caché. No debe depender de mensajes almacenados en caché para reducir costos. La estimación de costos más segura se basa en la facturación completa de tokens de entrada a $0.75 por 1M de tokens de entrada.
¿Qué modalidades de entrada están soportadas?
El modelo acepta entrada de texto, imagen, video, archivo y audio. La salida se lista como hasta 65,536 tokens y no se documenta ninguna modalidad de salida multimedia. Para indicaciones de imagen, video, archivo o audio, pruebe el formato de contenido de su cliente porque el esquema de medios de la API no está descrito en el catálogo.

Insertar esta insignia

Google: Gemini 3.8 Flash$0.75/M in4529ms p50vía OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash en OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Ficha del modelo como datos

GET /api/public/models/google/gemini-3.8-flashAbrir
Legible por máquina:/llms.txt/llms-full.txt