Una tarjeta de título para la comparación entre Gemini 3.7 Flash y Claude Opus 5, que muestra una tarjeta de velocista rápido etiquetada como Gemini 3.7 Flash con una etiqueta de $0.75 / $3.75, una tarjeta de torre alta etiquetada como Claude Opus 5 con una etiqueta de $5 / $25, y un pequeño ícono de fracción 1/6 entre ellas.
Guides & Insights

Gemini 3.7 Flash vs Claude Opus 5: Lo que un caballo de batalla te ofrece por una sexta parte del precio

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Este es el número que hace que esta comparación valga la pena: Claude Opus 5, el buque insignia de Anthrop​ic, obtiene 61 en el Artificial Analysis Intelligence Index, mientras que Gemini 3.7 Flash, el caballo de batalla de Go​ogle lanzado el 13 de agosto de 2026, obtiene 56. Cinco puntos. Y con la tarifa promocional que Go​ogle ofrece hasta fin de año, Gemini 3.7 Flash cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de salida — aproximadamente una sexta parte de los $5.00/$25.00 de Claude Opus 5. La brecha que solía separar al "caballo de batalla" del "buque insignia" se ha estrechado hasta el punto de que la pregunta honesta ya no es si el modelo barato es bueno, sino qué sigue haciendo el caro que el barato no puede.

El encuadre importa, porque no es un duelo de igual a igual y pretender lo contrario te induciría a error. Claude Opus 5, lanzado el 24 de julio de 2026, es el modelo de disponibilidad general más capaz de Anthropic: un modelo de razonamiento con contexto de 1M de tokens y un límite de salida de 128K, diseñado para las tareas más difíciles de ingeniería, investigación y uso de computadora. Gemini 3.7 Flash es el caballo de batalla de gran volumen de Google: contexto de 1M, salida de 64K, entrada de texto/imagen/audio/video, y una filosofía de diseño opuesta a la de Opus: generar tantos tokens como sea posible, al menor costo posible, para el 95 % del tráfico que es rutinario. Compararlos con un solo número es como terminas con una respuesta equivocada; compararlos según la forma del trabajo que realmente ejecutas es como obtienes una respuesta útil.

The Google DeepMind model card for Gemini 3.7 Flash, showing the model's headline description as Google's workhorse model for coding and agents, its 1M-token context window and 64K output cap, and benchmark tables of its gains over Gemini 3.6 Flash.

Cinco puntos, desglosados

El Índice de Inteligencia no es una escala lineal, y la brecha entre 56 y 61 vale más en algunas tareas que en otras. El 61 de Opus 5 proviene de liderar en los miembros más difíciles del compuesto: sus 30.2 en ARC-AGI-3, 43.3 en FrontierBench y 79.2 en SWE-bench Pro están todos reportados por el proveedor, pero son el tipo de resultados de razonamiento de frontera que ningún modelo clase Flash alcanza. El 56 de Gemini 3.7 Flash se obtiene de manera diferente: las cifras reportadas por Google para él (65.3 en DeepSWE v1.1, 1588 Elo en WebDev Arena, 30.4 en AutomationBench) muestran un modelo excelente en ingeniería y agentes acotados y de alto volumen, no en razonamiento novedoso y abierto. Por lo tanto, cinco puntos del índice describen un verdadero precipicio de capacidad, aunque la distancia titular parezca pequeña.

• Índice de Inteligencia — 56 para Gemini 3.7 Flash frente a 61 para Claude Opus 5 (esfuerzo máximo), según Artificial Analysis.

• Velocidad de salida — ~340 tokens/s para Gemini 3.7 Flash frente a ~53 tokens/s para Claude Opus 5, ambos según Artificial Analysis. Una diferencia de 6,4x.

• Ventana de contexto — 1M tokens para ambos, pero el límite de salida de Claude Opus 5 es de 128K frente a los 64K de Gemini 3.7 Flash.

• Precio de entrada — $0.75 (promocional, hasta 2026) frente a $5.00 — una brecha de 6.7x.

• Precio de salida — $3,75 (promocional) frente a $25,00 — una brecha de 6,7x.

• Entrada multimodal — Gemini 3.7 Flash acepta texto, imagen, audio y video; Claude Opus 5 solo acepta texto e imagen.

A comparison scoreboard for Gemini 3.7 Flash and Claude Opus 5: Claude Opus 5 leads 61 to 56 on the AA Index and 128K to 64K on max output, but Gemini 3.7 Flash leads ~340 to ~53 tokens per second, $0.75 to $5.00 input and $3.75 to $25.00 output, with both at 1M context.

Dónde Claude Opus 5 todavía justifica su precio

El caso del buque insignia no es nostalgia, es la cola de la distribución de tareas. La ingeniería autónoma de largo horizonte —un modelo que se deja solo con un código base durante una hora para planificar, editar, probar e iterar— es donde la ventaja reportada de Opus 5 es más amplia, y sus resultados en computer-use (71 en OSWorld, reportado por el proveedor) lo colocan en una clase a la que Gemini 3.7 Flash no accede. Los equipos que migran desde Claude Opus 4.8 también deben saber que Opus 5 incorpora el pensamiento adaptativo activado por defecto con niveles de esfuerzo recalibrados, y que desactivar el pensamiento está limitado al esfuerzo alto: cambios de comportamiento que pueden romper pipelines existentes. Nada de eso lo convierte en la elección equivocada para trabajos difíciles; lo convierte en la elección correcta para una porción de trabajo más reducida de lo que sugiere su precio.

Lo otro que Opus 5 vende es la economía de plataforma de Anthrop​ic. Su caché de prompts puede reducir el costo efectivo de entrada hasta en un 90% en aciertos de caché, y su nivel de lote reduce a la mitad el precio del tráfico asíncrono — por lo que una carga de trabajo con alta caché y alto lote en Opus 5 factura mucho más cerca de la sombra de su precio de etiqueta de lo que implica el titular de $5 / $25. El precio real del buque insignia depende de la carga de trabajo; el del caballo de batalla no.

Dónde Gemini 3.7 Flash es la compra más inteligente

Para cualquier cosa que transmita en flujo continuo, procese por lotes o se alimente de contexto largo, el caballo de batalla no solo es más barato, sino que está estructuralmente mejor posicionado. Una ventaja de 6,4x en velocidad de salida cambia lo que puedes construir: finalización de código interactiva, resumen en vivo de un repositorio completo, bucles de agente que necesitan muchas llamadas por minuto — todo esto choca con el muro de rendimiento en un modelo de 53 tokens/s mucho antes de llegar al muro de calidad. Gemini 3.7 Flash también acepta entrada de audio y vídeo, lo que abre casos de uso (transcripción de reuniones, comprensión de fotogramas de vídeo) que ningún modelo Claude cubre en ese eje de entrada. Y su nivel de razonamiento ajustable significa que puedes ejecutarlo con esfuerzo bajo para trabajo rutinario barato y con esfuerzo alto para el subconjunto más difícil, pagando solo por el razonamiento que utilizas.

El manual de pairing

Los profesionales sobre el terreno han dejado en gran medida de tratar esto como una dicotomía, y el patrón que no deja de repetirse es un bucle de divide y vencerás: Claude Opus 5 hace la planificación y el diseño, Gemini 3.7 Flash hace la implementación de gran volumen, y Opus 5 revisa. Cada modelo se usa donde su relación calidad-coste es mejor, y el pipeline combinado resulta a la vez más barato y más rápido que ejecutar cualquiera de los dos por separado. Una capa de enrutamiento hace que ese patrón sea práctico en lugar de meramente arquitectónico: Claude Opus 5 ya está disponible en OrcaRouter al precio de lista de Anthrop​ic con un margen del 0%, y el DSL de enrutamiento permite componer una sola llamada que envía el planificador a Opus 5 y el ejecutor a los modelos de clase Flash tras un único endpoint compatible con OpenAI, con la fusión de modelos como paso adicional: ambos modelos responden a la misma pregunta y un juez concilia los dos veredictos.

The OrcaRouter model page for Claude Opus 5, showing Anthropic's $5.00 per million input and $25.00 per million output list pricing and a 1M-token context window.

El proyecto de ley, lado a lado

Pongamos números reales. Un día de 10 millones de tokens de entrada y 1 millón de tokens de salida — un pipeline agéntico pesado pero ordinario — factura $75 + $375 = $450 en la tarifa estándar de Claude Opus 5. El mismo tráfico en la tarifa promocional de Gemini 3.7 Flash factura $7.50 + $37.50 = $45, exactamente una décima parte. Incluso teniendo en cuenta los descuentos de caché de Opus en el lado de entrada, la brecha es un orden de magnitud, y es la razón por la que "flash para el grueso, opus para la cola difícil" se ha convertido en la forma de producción predeterminada en lugar de una exótica. Cuando termine la promoción, la tarifa de entrada de Gemini 3.7 Flash se duplica a $1.50 — sigue siendo un tercio de la de Opus, y sigue siendo lo suficientemente barata para mantener intacta la aritmética del emparejamiento.

La lectura honesta

La brecha de cinco puntos es real y se sitúa exactamente donde cabría esperar: en el trabajo más difícil y de horizonte más largo. Si tu carga de trabajo está dominada por esa cola — investigación de frontera, ingeniería autónoma de varias horas, uso de computadora — Claude Opus 5 justifica su precio y no deberías darle más vueltas. Si tu carga de trabajo está dominada por el volumen, la latencia o el contexto largo, Gemini 3.7 Flash a la tarifa promocional es la mejor compra por un orden de magnitud, y la brecha con el modelo insignia es un nivel de benchmark, no un abismo. Los modelos están convergiendo, y la respuesta práctica para la mayoría de los equipos ya no es «cuál», sino «qué partes del trabajo van a cada uno».

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario