
Gemini 3.7 Flash vs DeepSeek V4 Flash: Dos modelos "Flash", respuestas opuestas a la misma pregunta
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Los dos modelos de 2026 con los nombres más confusos se llaman Flash, y no podrían responder a la misma pregunta de manera más diferente. Gemini 3.7 Flash, lanzado el 13 de agosto de 2026, es el caballo de batalla cerrado de Google: aproximadamente 340 tokens de salida por segundo, un Intelligence Index de 56 y un precio promocional de $0,75 por millón de tokens de entrada y $3,75 por millón de tokens de salida. DeepSeek V4 Flash es la mitad de pesos abiertos de la familia V4 de DeepSeek, que salió en abril y se actualizó a finales de julio: con licencia MIT, descargable y con un precio de $0,14 por millón de tokens de entrada y $0,28 por millón de tokens de salida en la propia API de DeepSeek — alrededor de una quinta parte del precio promocional de entrada de Google y una decimotercera parte del precio de salida. Ambos son modelos «flash», diseñados para ser rápidos y baratos en trabajos de gran volumen. La palabra es donde termina la similitud.
{{1}}La pregunta que responden de manera distinta es la definitoria de esta generación: ¿alquilas inteligencia o la posees?{{/1}} {{2}}DeepSeek V4 Flash es un modelo de mezcla de expertos de 284 mil millones de parámetros, con unos 13B activos por token, una ventana de contexto de 1M de tokens y un límite de salida de 384K, publicado bajo licencia MIT; los pesos suponen una descarga de ~160GB, y la actualización del 31 de julio (V4-Flash-0731) añadió capacidades de agente sustancialmente más potentes.{{/2}} {{3}}Gemini 3.7 Flash es un modelo propietario construido sobre Gemini 3.6 Flash, con un contexto de 1M, un límite de salida de 64K, entrada multimodal y sin opción de autoalojamiento.{{/3}} {{4}}Uno de estos modelos puede aislarse de la red, ajustarse finamente y ejecutarse en tu propio hardware.{{/4}} {{5}}El otro solo se ejecuta donde Google lo ejecuta.{{/5}}

Los dos Flashes, uno al lado del otro
Ambos modelos apuntan al mismo comprador — {{1}}cargas de trabajo de producción de gran volumen que no pueden permitirse un buque insignia por token{{/1}} — pero llegan ahí mediante arquitecturas opuestas. La atención híbrida de DeepSeek V4 Flash (sparse comprimido más atención fuertemente comprimida) es lo que hace que su contexto de 1M sea lo bastante económico para venderse a estos precios; es el modelo al que DeepSeek apunta los endpoints legacy `deepseek-chat` y `deepseek-reasoner`, retirado en julio. Gemini 3.7 Flash es el refinamiento algorítmico de Google de su propia línea Flash, y su ventaja es el rendimiento de servicio: {{2}}mediciones independientes lo sitúan en aproximadamente 340 tokens/s frente a los aproximadamente 113 de DeepSeek V4 Flash{{/2}}, y lo consigue mientras acepta entrada de audio y vídeo que DeepSeek V4 Flash no acepta.
• Índice de Inteligencia — 56 para Gemini 3.7 Flash frente a 50 para DeepSeek V4 Flash, según Artificial Analysis.
• Velocidad de salida — ~340 tokens/s frente a ~113 tokens/s, ambos según Artificial Analysis.
• Ventana de contexto — 1M tokens para ambos; DeepSeek V4 Flash genera hasta 384K frente a los 64K de Gemini 3.7 Flash.
• Precio de entrada — $0,75 (promocional, hasta 2026) frente a $0,14 en la propia API de DeepSeek.
• Precio de salida — $3.75 (promocional) frente a $0.28.
• Pesos — propietarios frente a los con licencia MIT y descargables.

Lo que realmente compran seis puntos de índice
La brecha de seis puntos en el índice es significativa pero no abismal, y se concentra sobre todo en áreas para las que DeepSeek V4 Flash no fue optimizado. Las cifras reportadas de codificación agéntica de Gemini 3.7 Flash (65.3 en DeepSWE v1.1, 43.6 en FrontierCode 1.1 Main, según el proveedor) están muy por delante, y su Elo de desarrollo web (1588, también según el proveedor) refleja mejoras reales en la generación de UI. Las propias cifras reportadas de DeepSeek V4 Flash — 79.0 en SWE-bench Verified, 91.6 en LiveCodeBench, una puntuación de 95.0 en τ²-Bench que los rastreadores independientes corroboran — se mantienen sólidas en codificación acotada y uso de herramientas, y su recuperación con contexto de 1M (78.7 en MRCR, 60.5 en CorpusQA) es competitiva con cualquier cosa en su rango de precios. El patrón: Gemini 3.7 Flash lidera en profundidad agéntica y trabajo web; DeepSeek V4 Flash cambia esas ventajas por pura economía de tokens y un techo de contexto largo que ningún caballo de batalla cerrado iguala.
Los pesos abiertos cambian la contratación, no solo el precio.
La licencia MIT es la parte de esta comparación que ninguna tabla de referencia captura. DeepSeek V4 Flash se puede descargar y ejecutar en tu propio hardware, afinar con tus propios datos y usar en entornos donde no se permiten llamadas a la API — y la licencia no tiene restricciones basadas en la escala, así que nada en tu crecimiento cambia los términos. El costo práctico es operativo: servir un modelo MoE de 284B a la velocidad que un equipo de producción desea requiere un inventario real de GPU, y para la mayoría de los equipos la opción honesta es la API alojada. Ahí es donde la brecha de precios hace su verdadero trabajo: incluso la ruta alojada, a $0.14 / $0.28, es lo suficientemente barata como para ser la opción predeterminada para la larga cola de tráfico. Gemini 3.7 Flash no ofrece ninguna vía de propiedad — lo que compras es un servicio multimodal, rápido y gestionado de forma confiable, con un precio promocional y un precipicio en enero.
La factura de volumen
Ejecute el mismo día en ambos: 20 millones de tokens de entrada y 4 millones de tokens de salida. En la API propia de DeepSeek V4 Flash, eso son $2.80 + $1.12, unos $3.92. En Gemini 3.7 Flash a la tarifa promocional, eso son $15 + $15, unos $30: una brecha de 7.6x incluso mientras Google ofrece su descuento. Después del 1 de enero de 2027, cuando Gemini 3.7 Flash vuelva a $1.50 / $7.50, el mismo día factura unos $58, quince veces la cifra de DeepSeek. La ventaja de velocidad compensa parcialmente esto en cargas de trabajo interactivas — los tokens más rápidos significan menos solicitudes concurrentes — pero para trabajo por lotes y en segundo plano, el modelo abierto gana la factura sin discusión. Los dos modelos ni siquiera apuntan a la misma curva de costos, que es precisamente el punto.

¿Quién debería construir sobre cuál?
Elige DeepSeek V4 Flash cuando el coste por token sea la restricción vinculante, cuando quieras salidas largas de hasta 384K, cuando necesites la opción de autoalojamiento o despliegue aislado (air-gapped), o cuando estés construyendo algo cuyos márgenes no sobrevivan al precio de los tokens de buque insignia. Elige Gemini 3.7 Flash cuando necesites velocidad en un bucle interactivo, entrada multimodal, la fiabilidad gestionada de Google, o los resultados de codificación agéntica más sólidos que Google reporta — y cuando te resulte aceptable que el precio promocional sea temporal. No son rivales como lo son dos buques insignia; son dos estrategias de aprovisionamiento diferentes con el mismo nombre. La capa de enrutamiento es donde se encuentran las estrategias: DeepSeek V4 Flash está disponible en OrcaRouter al precio de lista de DeepSeek con un margen del 0%, y el patrón de conmutación por error (failover) encaja de forma natural con esta combinación — una regla que canaliza la mayor parte del tráfico por V4 Flash y escala el subconjunto difícil a un modelo cerrado más potente, con Gemini 3.7 Flash accesible a través de la propia API Gemini de Google en la otra rama del mismo enrutador.
La lectura honesta
Si puedes autoalojarlo o te mueves puramente por el coste, DeepSeek V4 Flash es el mejor modelo sobre el que construir, y la licencia hace que sea una decisión que nunca tendrás que replantearte. Si necesitas la velocidad de servicio de Google, la entrada multimodal o la ventaja reportada en codificación agéntica, Gemini 3.7 Flash es el mejor servicio mientras dure la promoción, con la duplicación del precio en enero ya marcada en el calendario. Dos modelos, un nombre, y el mercado verá qué filosofía recibe los votos del tráfico durante el próximo año.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
