Una tarjeta de título para la comparación entre Gemini 3.7 Flash y DeepSeek V4 Flash, que muestra dos rayos: una caja de seguridad cerrada etiquetada como Gemini 3.7 Flash con una etiqueta de $0.75 / $3.75, y una caja abierta con una flecha de descarga etiquetada como DeepSeek V4 Flash con una etiqueta de $0.14 / $0.28.
Guides & Insights

Gemini 3.7 Flash vs DeepSeek V4 Flash: Dos modelos "Flash", respuestas opuestas a la misma pregunta

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Los dos modelos de 2026 con los nombres más confusos se llaman Flash, y no podrían responder a la misma pregunta de manera más diferente. Gemini 3.7 Flash, lanzado el 13 de agosto de 2026, es el caballo de batalla cerrado de Go​ogle: aproximadamente 340 tokens de salida por segundo, un Intelligence Index de 56 y un precio promocional de $0,75 por millón de tokens de entrada y $3,75 por millón de tokens de salida. DeepSeek V4 Flash es la mitad de pesos abiertos de la familia V4 de Deep​Seek, que salió en abril y se actualizó a finales de julio: con licencia MIT, descargable y con un precio de $0,14 por millón de tokens de entrada y $0,28 por millón de tokens de salida en la propia API de Deep​Seek — alrededor de una quinta parte del precio promocional de entrada de Go​ogle y una decimotercera parte del precio de salida. Ambos son modelos «flash», diseñados para ser rápidos y baratos en trabajos de gran volumen. La palabra es donde termina la similitud.

{{1}}La pregunta que responden de manera distinta es la definitoria de esta generación: ¿alquilas inteligencia o la posees?{{/1}} {{2}}DeepSeek V4 Flash es un modelo de mezcla de expertos de 284 mil millones de parámetros, con unos 13B activos por token, una ventana de contexto de 1M de tokens y un límite de salida de 384K, publicado bajo licencia MIT; los pesos suponen una descarga de ~160GB, y la actualización del 31 de julio (V4-Flash-0731) añadió capacidades de agente sustancialmente más potentes.{{/2}} {{3}}Gemini 3.7 Flash es un modelo propietario construido sobre Gemini 3.6 Flash, con un contexto de 1M, un límite de salida de 64K, entrada multimodal y sin opción de autoalojamiento.{{/3}} {{4}}Uno de estos modelos puede aislarse de la red, ajustarse finamente y ejecutarse en tu propio hardware.{{/4}} {{5}}El otro solo se ejecuta donde Go​ogle lo ejecuta.{{/5}}

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Los dos Flashes, uno al lado del otro

Ambos modelos apuntan al mismo comprador — {{1}}cargas de trabajo de producción de gran volumen que no pueden permitirse un buque insignia por token{{/1}} — pero llegan ahí mediante arquitecturas opuestas. La atención híbrida de DeepSeek V4 Flash (sparse comprimido más atención fuertemente comprimida) es lo que hace que su contexto de 1M sea lo bastante económico para venderse a estos precios; es el modelo al que Deep​Seek apunta los endpoints legacy `deepseek-chat` y `deepseek-reasoner`, retirado en julio. Gemini 3.7 Flash es el refinamiento algorítmico de Go​ogle de su propia línea Flash, y su ventaja es el rendimiento de servicio: {{2}}mediciones independientes lo sitúan en aproximadamente 340 tokens/s frente a los aproximadamente 113 de DeepSeek V4 Flash{{/2}}, y lo consigue mientras acepta entrada de audio y vídeo que DeepSeek V4 Flash no acepta.

Índice de Inteligencia — 56 para Gemini 3.7 Flash frente a 50 para DeepSeek V4 Flash, según Artificial Analysis.

Velocidad de salida — ~340 tokens/s frente a ~113 tokens/s, ambos según Artificial Analysis.

Ventana de contexto — 1M tokens para ambos; DeepSeek V4 Flash genera hasta 384K frente a los 64K de Gemini 3.7 Flash.

Precio de entrada — $0,75 (promocional, hasta 2026) frente a $0,14 en la propia API de DeepSeek.

Precio de salida — $3.75 (promocional) frente a $0.28.

Pesos — propietarios frente a los con licencia MIT y descargables.

A comparison scoreboard for Gemini 3.7 Flash and DeepSeek V4 Flash: Gemini 3.7 Flash leads 56 to 50 on the AA Index and ~340 to ~113 tokens per second, while DeepSeek V4 Flash leads 384K to 64K on max output, $0.14 to $0.75 on input and $0.28 to $3.75 on output, with both at 1M context and proprietary weights against MIT open weights.

Lo que realmente compran seis puntos de índice

La brecha de seis puntos en el índice es significativa pero no abismal, y se concentra sobre todo en áreas para las que DeepSeek V4 Flash no fue optimizado. Las cifras reportadas de codificación agéntica de Gemini 3.7 Flash (65.3 en DeepSWE v1.1, 43.6 en FrontierCode 1.1 Main, según el proveedor) están muy por delante, y su Elo de desarrollo web (1588, también según el proveedor) refleja mejoras reales en la generación de UI. Las propias cifras reportadas de DeepSeek V4 Flash — 79.0 en SWE-bench Verified, 91.6 en LiveCodeBench, una puntuación de 95.0 en τ²-Bench que los rastreadores independientes corroboran — se mantienen sólidas en codificación acotada y uso de herramientas, y su recuperación con contexto de 1M (78.7 en MRCR, 60.5 en CorpusQA) es competitiva con cualquier cosa en su rango de precios. El patrón: Gemini 3.7 Flash lidera en profundidad agéntica y trabajo web; DeepSeek V4 Flash cambia esas ventajas por pura economía de tokens y un techo de contexto largo que ningún caballo de batalla cerrado iguala.

Los pesos abiertos cambian la contratación, no solo el precio.

La licencia MIT es la parte de esta comparación que ninguna tabla de referencia captura. DeepSeek V4 Flash se puede descargar y ejecutar en tu propio hardware, afinar con tus propios datos y usar en entornos donde no se permiten llamadas a la API — y la licencia no tiene restricciones basadas en la escala, así que nada en tu crecimiento cambia los términos. El costo práctico es operativo: servir un modelo MoE de 284B a la velocidad que un equipo de producción desea requiere un inventario real de GPU, y para la mayoría de los equipos la opción honesta es la API alojada. Ahí es donde la brecha de precios hace su verdadero trabajo: incluso la ruta alojada, a $0.14 / $0.28, es lo suficientemente barata como para ser la opción predeterminada para la larga cola de tráfico. Gemini 3.7 Flash no ofrece ninguna vía de propiedad — lo que compras es un servicio multimodal, rápido y gestionado de forma confiable, con un precio promocional y un precipicio en enero.

La factura de volumen

Ejecute el mismo día en ambos: 20 millones de tokens de entrada y 4 millones de tokens de salida. En la API propia de DeepSeek V4 Flash, eso son $2.80 + $1.12, unos $3.92. En Gemini 3.7 Flash a la tarifa promocional, eso son $15 + $15, unos $30: una brecha de 7.6x incluso mientras Go​ogle ofrece su descuento. Después del 1 de enero de 2027, cuando Gemini 3.7 Flash vuelva a $1.50 / $7.50, el mismo día factura unos $58, quince veces la cifra de Deep​Seek. La ventaja de velocidad compensa parcialmente esto en cargas de trabajo interactivas — los tokens más rápidos significan menos solicitudes concurrentes — pero para trabajo por lotes y en segundo plano, el modelo abierto gana la factura sin discusión. Los dos modelos ni siquiera apuntan a la misma curva de costos, que es precisamente el punto.

The OrcaRouter model page for DeepSeek V4 Flash, showing the ~$0.15 per million input and ~$0.29 per million output pass-through pricing, a 1M-token context window with 384K max output, and the text-only 284B-total / 13B-active mixture-of-experts description.

¿Quién debería construir sobre cuál?

Elige DeepSeek V4 Flash cuando el coste por token sea la restricción vinculante, cuando quieras salidas largas de hasta 384K, cuando necesites la opción de autoalojamiento o despliegue aislado (air-gapped), o cuando estés construyendo algo cuyos márgenes no sobrevivan al precio de los tokens de buque insignia. Elige Gemini 3.7 Flash cuando necesites velocidad en un bucle interactivo, entrada multimodal, la fiabilidad gestionada de Go​ogle, o los resultados de codificación agéntica más sólidos que Go​ogle reporta — y cuando te resulte aceptable que el precio promocional sea temporal. No son rivales como lo son dos buques insignia; son dos estrategias de aprovisionamiento diferentes con el mismo nombre. La capa de enrutamiento es donde se encuentran las estrategias: DeepSeek V4 Flash está disponible en OrcaRouter al precio de lista de Deep​Seek con un margen del 0%, y el patrón de conmutación por error (failover) encaja de forma natural con esta combinación — una regla que canaliza la mayor parte del tráfico por V4 Flash y escala el subconjunto difícil a un modelo cerrado más potente, con Gemini 3.7 Flash accesible a través de la propia API Gemini de Go​ogle en la otra rama del mismo enrutador.

La lectura honesta

Si puedes autoalojarlo o te mueves puramente por el coste, DeepSeek V4 Flash es el mejor modelo sobre el que construir, y la licencia hace que sea una decisión que nunca tendrás que replantearte. Si necesitas la velocidad de servicio de Go​ogle, la entrada multimodal o la ventaja reportada en codificación agéntica, Gemini 3.7 Flash es el mejor servicio mientras dure la promoción, con la duplicación del precio en enero ya marcada en el calendario. Dos modelos, un nombre, y el mercado verá qué filosofía recibe los votos del tráfico durante el próximo año.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario