
Gemini 3.7 Flash vs Claude Opus 5: Lo que un caballo de batalla te ofrece por una sexta parte del precio
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 221 tok/s
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAINUEVOGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 106 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Este es el número que hace que esta comparación valga la pena: Claude Opus 5, el buque insignia de Anthropic, obtiene 61 en el Artificial Analysis Intelligence Index, mientras que Gemini 3.7 Flash, el caballo de batalla de Google lanzado el 13 de agosto de 2026, obtiene 56. Cinco puntos. Y con la tarifa promocional que Google ofrece hasta fin de año, Gemini 3.7 Flash cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de salida — aproximadamente una sexta parte de los $5.00/$25.00 de Claude Opus 5. La brecha que solía separar al "caballo de batalla" del "buque insignia" se ha estrechado hasta el punto de que la pregunta honesta ya no es si el modelo barato es bueno, sino qué sigue haciendo el caro que el barato no puede.
El encuadre importa, porque no es un duelo de igual a igual y pretender lo contrario te induciría a error. Claude Opus 5, lanzado el 24 de julio de 2026, es el modelo de disponibilidad general más capaz de Anthropic: un modelo de razonamiento con contexto de 1M de tokens y un límite de salida de 128K, diseñado para las tareas más difíciles de ingeniería, investigación y uso de computadora. Gemini 3.7 Flash es el caballo de batalla de gran volumen de Google: contexto de 1M, salida de 64K, entrada de texto/imagen/audio/video, y una filosofía de diseño opuesta a la de Opus: generar tantos tokens como sea posible, al menor costo posible, para el 95 % del tráfico que es rutinario. Compararlos con un solo número es como terminas con una respuesta equivocada; compararlos según la forma del trabajo que realmente ejecutas es como obtienes una respuesta útil.

Cinco puntos, desglosados
El Índice de Inteligencia no es una escala lineal, y la brecha entre 56 y 61 vale más en algunas tareas que en otras. El 61 de Opus 5 proviene de liderar en los miembros más difíciles del compuesto: sus 30.2 en ARC-AGI-3, 43.3 en FrontierBench y 79.2 en SWE-bench Pro están todos reportados por el proveedor, pero son el tipo de resultados de razonamiento de frontera que ningún modelo clase Flash alcanza. El 56 de Gemini 3.7 Flash se obtiene de manera diferente: las cifras reportadas por Google para él (65.3 en DeepSWE v1.1, 1588 Elo en WebDev Arena, 30.4 en AutomationBench) muestran un modelo excelente en ingeniería y agentes acotados y de alto volumen, no en razonamiento novedoso y abierto. Por lo tanto, cinco puntos del índice describen un verdadero precipicio de capacidad, aunque la distancia titular parezca pequeña.
• Índice de Inteligencia — 56 para Gemini 3.7 Flash frente a 61 para Claude Opus 5 (esfuerzo máximo), según Artificial Analysis.
• Velocidad de salida — ~340 tokens/s para Gemini 3.7 Flash frente a ~53 tokens/s para Claude Opus 5, ambos según Artificial Analysis. Una diferencia de 6,4x.
• Ventana de contexto — 1M tokens para ambos, pero el límite de salida de Claude Opus 5 es de 128K frente a los 64K de Gemini 3.7 Flash.
• Precio de entrada — $0.75 (promocional, hasta 2026) frente a $5.00 — una brecha de 6.7x.
• Precio de salida — $3,75 (promocional) frente a $25,00 — una brecha de 6,7x.
• Entrada multimodal — Gemini 3.7 Flash acepta texto, imagen, audio y video; Claude Opus 5 solo acepta texto e imagen.

Dónde Claude Opus 5 todavía justifica su precio
El caso del buque insignia no es nostalgia, es la cola de la distribución de tareas. La ingeniería autónoma de largo horizonte —un modelo que se deja solo con un código base durante una hora para planificar, editar, probar e iterar— es donde la ventaja reportada de Opus 5 es más amplia, y sus resultados en computer-use (71 en OSWorld, reportado por el proveedor) lo colocan en una clase a la que Gemini 3.7 Flash no accede. Los equipos que migran desde Claude Opus 4.8 también deben saber que Opus 5 incorpora el pensamiento adaptativo activado por defecto con niveles de esfuerzo recalibrados, y que desactivar el pensamiento está limitado al esfuerzo alto: cambios de comportamiento que pueden romper pipelines existentes. Nada de eso lo convierte en la elección equivocada para trabajos difíciles; lo convierte en la elección correcta para una porción de trabajo más reducida de lo que sugiere su precio.
Lo otro que Opus 5 vende es la economía de plataforma de Anthropic. Su caché de prompts puede reducir el costo efectivo de entrada hasta en un 90% en aciertos de caché, y su nivel de lote reduce a la mitad el precio del tráfico asíncrono — por lo que una carga de trabajo con alta caché y alto lote en Opus 5 factura mucho más cerca de la sombra de su precio de etiqueta de lo que implica el titular de $5 / $25. El precio real del buque insignia depende de la carga de trabajo; el del caballo de batalla no.
Dónde Gemini 3.7 Flash es la compra más inteligente
Para cualquier cosa que transmita en flujo continuo, procese por lotes o se alimente de contexto largo, el caballo de batalla no solo es más barato, sino que está estructuralmente mejor posicionado. Una ventaja de 6,4x en velocidad de salida cambia lo que puedes construir: finalización de código interactiva, resumen en vivo de un repositorio completo, bucles de agente que necesitan muchas llamadas por minuto — todo esto choca con el muro de rendimiento en un modelo de 53 tokens/s mucho antes de llegar al muro de calidad. Gemini 3.7 Flash también acepta entrada de audio y vídeo, lo que abre casos de uso (transcripción de reuniones, comprensión de fotogramas de vídeo) que ningún modelo Claude cubre en ese eje de entrada. Y su nivel de razonamiento ajustable significa que puedes ejecutarlo con esfuerzo bajo para trabajo rutinario barato y con esfuerzo alto para el subconjunto más difícil, pagando solo por el razonamiento que utilizas.
El manual de pairing
Los profesionales sobre el terreno han dejado en gran medida de tratar esto como una dicotomía, y el patrón que no deja de repetirse es un bucle de divide y vencerás: Claude Opus 5 hace la planificación y el diseño, Gemini 3.7 Flash hace la implementación de gran volumen, y Opus 5 revisa. Cada modelo se usa donde su relación calidad-coste es mejor, y el pipeline combinado resulta a la vez más barato y más rápido que ejecutar cualquiera de los dos por separado. Una capa de enrutamiento hace que ese patrón sea práctico en lugar de meramente arquitectónico: Claude Opus 5 ya está disponible en OrcaRouter al precio de lista de Anthropic con un margen del 0%, y el DSL de enrutamiento permite componer una sola llamada que envía el planificador a Opus 5 y el ejecutor a los modelos de clase Flash tras un único endpoint compatible con OpenAI, con la fusión de modelos como paso adicional: ambos modelos responden a la misma pregunta y un juez concilia los dos veredictos.

El proyecto de ley, lado a lado
Pongamos números reales. Un día de 10 millones de tokens de entrada y 1 millón de tokens de salida — un pipeline agéntico pesado pero ordinario — factura $75 + $375 = $450 en la tarifa estándar de Claude Opus 5. El mismo tráfico en la tarifa promocional de Gemini 3.7 Flash factura $7.50 + $37.50 = $45, exactamente una décima parte. Incluso teniendo en cuenta los descuentos de caché de Opus en el lado de entrada, la brecha es un orden de magnitud, y es la razón por la que "flash para el grueso, opus para la cola difícil" se ha convertido en la forma de producción predeterminada en lugar de una exótica. Cuando termine la promoción, la tarifa de entrada de Gemini 3.7 Flash se duplica a $1.50 — sigue siendo un tercio de la de Opus, y sigue siendo lo suficientemente barata para mantener intacta la aritmética del emparejamiento.
La lectura honesta
La brecha de cinco puntos es real y se sitúa exactamente donde cabría esperar: en el trabajo más difícil y de horizonte más largo. Si tu carga de trabajo está dominada por esa cola — investigación de frontera, ingeniería autónoma de varias horas, uso de computadora — Claude Opus 5 justifica su precio y no deberías darle más vueltas. Si tu carga de trabajo está dominada por el volumen, la latencia o el contexto largo, Gemini 3.7 Flash a la tarifa promocional es la mejor compra por un orden de magnitud, y la brecha con el modelo insignia es un nivel de benchmark, no un abismo. Los modelos están convergiendo, y la respuesta práctica para la mayoría de los equipos ya no es «cuál», sino «qué partes del trabajo van a cada uno».
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
