
Gemini 3.7 Flash vs Gemini 3.1 Pro: ¿La gama Flash de Google dejó obsoleto a su propio buque insignia?
- AlibabaNUEVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNUEVOZ.ai: GLM 5.3 Flash2026-08-2658Inteligencia72Código
- DeepSeekNUEVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1860Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1552Inteligencia68Código
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1261Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
Hay una pregunta incómoda dentro de la línea de modelos 2026 de Google, y está dirigida a todos los equipos que actualmente pagan por Gemini 3.1 Pro: ¿por qué el económico modelo Flash está superando al buque insignia en el índice independiente? Gemini 3.7 Flash, lanzado el 13 de agosto de 2026 a 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de tokens de salida, obtiene 56 puntos en el Artificial Analysis Intelligence Index con razonamiento alto. Gemini 3.1 Pro, la vista previa que Google publicó el 19 de febrero de 2026 a 2,00 $ / 12,00 $ — y 4,00 $ / 18,00 $ por encima de 200K de contexto — se sitúa en la parte alta de los 40 en el mismo índice hoy. El buque insignia que encabezó el índice en su lanzamiento ha sido superado por su propia gama de trabajo pesado, y este artículo trata sobre lo que eso significa para los dos modelos y para los equipos que tienen que elegir entre ellos.
La premisa: el nivel insignia de Google está atascado en vista previa.
El contexto importa más que los números. Gemini 3.1 Pro lleva en vista previa desde febrero de 2026 —siete meses al momento de escribir estas líneas— y su sucesor, Gemini 3.5 Pro, se anunció en el Google I/O de mayo como «llegará el próximo mes», pero no llegó en junio, ni en julio, ni en agosto. Para principios de septiembre, el nivel insignia no tiene sucesor publicado ni fecha de lanzamiento, y hay informes de una posible cancelación. Mientras tanto, el nivel Flash lanzó tres generaciones en el mismo período: Gemini 3.6 Flash el 21 de julio, Gemini 3.7 Flash el 13 de agosto y la capacidad agéntica de comprensión de video en ambos el 1 de septiembre. La comparación no es realmente «Pro vs Flash». Es «el nivel que Google está lanzando» frente a «el nivel que Google ha dejado de lanzar».
El contraste de especificaciones
• Precio — Gemini 3.7 Flash, $0.75 / $3.75 por 1M de tokens (promoción hasta el 31 de diciembre de 2026; después, $1.50 / $7.50), frente a Gemini 3.1 Pro, $2.00 / $12.00 con contexto inferior a 200K, que sube a $4.00 / $18.00 por encima de 200K. De tres a cuatro veces más barato a precio de lista, antes de los controles del nivel de razonamiento.
• Contexto / salida máxima — 1M / 64K frente a 1M / 64K. Límites idénticos.
• Entradas — texto, imagen, audio, video y PDF, todos. La superficie multimodal es la misma; la diferencia es lo que el modelo hace con el video (abajo).
• Control de razonamiento — Gemini 3.7 Flash: pensamiento bajo / medio / alto. Gemini 3.1 Pro: bajo / medio / alto con pensamiento dinámico activado por defecto.
• Puntuación independiente: Gemini 3.7 Flash 56 en el Artificial Analysis Intelligence Index frente a Gemini 3.1 Pro en los 40 altos en la versión actual del índice (obtuvo 57 en el lanzamiento con la versión anterior).
• Velocidad de salida — Gemini 3.7 Flash aproximadamente 285 tokens/seg con razonamiento alto frente a Gemini 3.1 Pro aproximadamente 112–125 tokens/seg — aproximadamente dos veces y media más rápido.
• Estado — {{1}}Gemini 3.7 Flash{{/1}} estable y con disponibilidad general (GA). {{2}}Gemini 3.1 Pro{{/2}} en vista previa, con su breve ventana de deprecación.
El índice, y el lío de benchmarks que hay debajo de él.
El titular es el índice: Artificial Analysis, el evaluador independiente entre proveedores, ahora clasifica a Gemini 3.7 Flash en 56 y a Gemini 3.1 Pro en los 40 altos — el caballo de batalla por delante del buque insignia, una inversión de las posiciones que se vieron en el lanzamiento de 3.1 Pro, cuando su 57 encabezaba el índice. Ese es el dato más importante de esta comparativa, y proviene de una fuente independiente, no de informes del proveedor.
Debajo del índice, el registro de benchmarks es un caos de plataformas de prueba no comparables, y leerlo de forma ingenua produce la respuesta equivocada. El récord publicado de Gemini 3.1 Pro —80,6 % en SWE-bench Verified, 77,1 % en ARC-AGI-2, 94,3 % en GPQA Diamond y un Elo de 2887 en LiveCodeBench Pro— fue reportado por Google en su lanzamiento de febrero, utiliza versiones de benchmark distintas a las cifras de Flash y nunca se reprodujo de manera uniforme. Las cifras de Gemini 3.7 Flash —43,6 % en FrontierCode 1.1, 65,3 % en DeepSWE v1.1 y 1588 Elo en el arena de desarrollo web— son igualmente reportadas por el proveedor en las plataformas más nuevas. Donde ambos coinciden en un agregado independiente, el AA Index, gana Flash. Cualquiera que te diga «Pro le gana a Flash en SWE-bench» está comparando dos versiones de dos pruebas diferentes y no lo está diciendo.


La brecha en capacidades de video
La capacidad que hace que la comparación parezca desequilibrada es el video. El nuevo modo agéntico de comprensión de video de Google — anunciado el 1 de septiembre de 2026 — se aplica a Gemini 3.7 Flash, Gemini 3.6 Flash y Gemini 3.5 Flash-Lite. Gemini 3.1 Pro no está en la lista. El modelo Flash lee el video tal como el nuevo modo define la lectura de video: el modelo decide qué ver, a qué velocidad y mediante fotogramas, audio o transcripción, cargando solo los segmentos relevantes, con ahorros reportados por el proveedor de hasta el 66% en costo y el 88% en tokens. Gemini 3.1 Pro acepta técnicamente entrada de video, pero utiliza la ruta de muestreo estático más antigua y no recibe ninguna de las nuevas herramientas. Para los usuarios del modelo insignia, la capacidad de video más nueva de la familia Gemini se está lanzando primero en el modelo más económico, y el nivel Pro no tiene fecha anunciada para recibirla.
La velocidad, y el problema del riesgo de previsualización.
La velocidad agrava la diferencia de precio igual que en cualquier comparativa con Gemini 3.7 Flash: aproximadamente el triple de tasa de salida en un modelo que ya cuesta un tercio del precio. Pero la segunda diferencia es la que los equipos olvidan poner en precio: el estatus. Gemini 3.1 Pro es una vista previa, y las vistas previas conllevan una ventana de aviso de desaprobación corta cuando llega el sucesor. Una carga de trabajo de producción sobre un modelo en vista previa es un riesgo constante de que el ID del modelo cambie, que el precio cambie o que la capacidad se mueva con poca antelación. Gemini 3.7 Flash está disponible de forma general (GA): estable, documentado y sin fecha prevista de reemplazo a la ligera, aunque el ritmo casi mensual de Flash de Google implica que un 3.8 Flash podría llegar rápidamente. El riesgo de desaprobación de la vista previa de 3.1 Pro no es hipotético; es el estado actual de un nivel cuyo sucesor lleva tres meses retrasado.
Donde Gemini 3.1 Pro todavía gana
El caso honesto a favor de 3.1 Pro se apoya en tres pilares, y ninguno de ellos es la capacidad bruta. Primero, el endpoint de herramientas personalizadas: Gemini 3.1 Pro se sirve con una superficie de API dedicada de bash/herramientas personalizadas que Flash no iguala, y los equipos que han construido tooling de agentes sobre ella tienen hoy un sistema funcional. Segundo, las cargas de trabajo ajustadas: un pipeline ya optimizado para los defaults de pensamiento dinámico, los patrones de caché y las puntuaciones de eval de 3.1 Pro es un objetivo móvil, y cambiar requiere tiempo real de ingeniería incluso cuando el destino es más rápido y barato. Tercero, las tareas específicas donde el historial de producción más largo de Pro todavía no tiene equivalente en Flash — los benchmarks de generación de lanzamiento como GPQA y ARC-AGI-2, en los que Flash nunca ha sido medido. Si tu carga de trabajo es una de esas, «Flash supera a Pro en el índice» no resuelve tu pregunta; solo una prueba con tu propia evaluación lo hace.
El veredicto: qué significa la adopción de Flash-tier
La dirección es inequívoca. Hoy, para una carga de trabajo nueva, Gemini 3.7 Flash es el mejor Gemini por defecto: más barato, más rápido, estable en GA, mejor posicionado en el índice independiente, y recibe primero la nueva capacidad de video. Gemini 3.1 Pro conserva una base de usuarios real pero reducida — usuarios de herramientas personalizadas, pipelines optimizados y tareas donde su historial de benchmarks más antiguo sigue siendo válido. El panorama general es que el nivel insignia de Google está estancado, mientras que su nivel de trabajo es donde la empresa realmente compite — y los equipos que aún pagan precios de insignia por 3.1 Pro están pagando por un estatus que la propia empresa ha dejado de defender.

Para los equipos que quieren migrar sin un proyecto, el cambio entre los modelos Gemini es un cambio de nombre de modelo, más que una integración. Gemini 3.1 Pro se sirve en OrcaRouter a su precio de lista de $2.00 / $12.00, trasladado sin margen (0 %), junto con Gemini 3.6 Flash y el resto del nivel Gemini enrutable detrás de una única clave, de modo que una carga de trabajo puede enviar una parte del tráfico a un modelo Flash, mantener 3.1 Pro como respaldo para las tareas en las que todavía gana, y dejar que la conmutación automática por error absorba el riesgo de que cualquiera de los modelos de Google cambie. Gemini 3.7 Flash en sí mismo está disponible a través de la propia API de Google y de varias plataformas de terceros. El DSL de enrutamiento y la fusión de modelos son exactamente cómo se ejecutaría una comparación en igualdad de condiciones entre los dos modelos Gemini en tu propia evaluación antes de cambiar. La elección hacia la que la gama te empuja es clara: usar por defecto el nivel Flash, y reservar Pro solo para los casos concretos en los que demuestre merecer su prima.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
