
Claude Haiku 5.5 vs Gemini 3.6 Flash: 7,5 veces el costo por respuesta, un modelo con nueve puntos menos
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Claude Haiku 5.5 y Gemini 3.6 Flash ocupan el mismo nivel dentro de sus respectivas gamas —el pequeño, rápido y económico— y ahí es donde termina el parecido. En el Artificial Analysis Intelligence Index v4.3.2, Claude Haiku 5.5 obtiene 43,40 en su configuración Max frente a 33,98 de Gemini 3.6 Flash en su configuración High. En la misma ejecución, completar una tarea del Index cuesta 0,21 $ con Claude Haiku 5.5 y 1,60 $ con Gemini 3.6 Flash.
Lee ese par en conjunto, porque cualquiera de los dos por separado engaña. El modelo más barato no es un poco más barato; es 7,5 veces más barato por tarea finalizada. Y el modelo al que está superando no es un poco más débil; es 9,42 puntos de índice más débil, lo que en una tabla de 182 modelos es la distancia entre el cuartil superior y el medio.
Ambos datos provienen de la misma ejecución independiente, lo cual importa porque las fichas de proveedor que aparecen aquí no te dicen ninguno de los dos. Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026; Google lanzó Gemini 3.6 Flash el 21 de julio de 2026. Los tres meses entre ambos son la parte interesante.
Las dos tarjetas, una al lado de la otra
Por millón de tokens en dólares estadounidenses. Las tarifas de Anthropic y Google provienen de su propia documentación de precios; las filas compartidas son Artificial Analysis Intelligence Index v4.3.2. En caché el 2026-10-08.

• Entrada — Claude Haiku 5.5 $0,10 hasta 100.000 tokens y $0,50 por encima; Gemini 3.6 Flash $0,75 fijo hoy, y aumentará a $1,50 el 1 de enero de 2027.
• Salida — Claude Haiku 5.5 $0.50 hasta 100,000 tokens y $2.50 a partir de ahí; Gemini 3.6 Flash $3.75 fijo hoy, subiendo a $7.50 en la misma fecha.
• Entrada en caché — Claude Haiku 5.5 $0.01 y $0.05; Gemini 3.6 Flash $0.075, más un cargo de almacenamiento de $0.50 por millón de tokens por hora.
• Contexto y límite de salida — 1M tokens para ambos. Claude Haiku 5.5 limita una respuesta a 128.000 tokens; Gemini 3.6 Flash, a 65.536.
• Modalidad — Claude Haiku 5.5 acepta texto e imágenes. Gemini 3.6 Flash acepta texto, imágenes, vídeo, audio y archivos. Esta es la única fila en la que el lado de Google está indiscutiblemente por delante, y para un pipeline de comprensión de medios puede decidir la cuestión por completo.
• Puntuación independiente — 43,40 para Claude Haiku 5.5 (Max) frente a 33,98 para Gemini 3.6 Flash (High).
• Coste por tarea finalizada — $0.21 frente a $1.60, en la misma ejecución de evaluación.

Por qué hay que usar por tarea, y no por token
El múltiplo de la tarifa ya parece de 7,5 en entrada y 7,5 en salida, así que la cifra por tarea no sorprende aquí, pero vale la pena mostrar por qué los dos modelos coinciden en una medida y están tan separados en la otra, porque la misma aritmética corta en sentido contrario en los otros emparejamientos de este lote.
Gemini 3.6 Flash es el menos verboso de los dos. Emite 41.606 tokens de salida por tarea del Intelligence Index — 20.061 de razonamiento y 21.545 de respuesta — frente a los 162.164 de Claude Haiku 5.5, repartidos en 129.047 de razonamiento y 33.118 de respuesta. El modelo de Anthropic gasta casi cuatro veces más tokens haciendo el mismo trabajo, y es el que tiene una tasa de salida que es una séptima parte de la de Google, por lo que la brecha de tokens y la brecha de tasa se multiplican en lugar de cancelarse.
Esa combinación —tarifa barata multiplicada por uso intensivo— es la descripción honesta de la economía de Claude Haiku 5.5, y la propia publicación de lanzamiento de Anthropic reconoce la otra cara de la moneda: el modelo ofrece «una relación calidad-precio especialmente buena cuando se usa para tareas con prompts de hasta 100.000 tokens, que representan alrededor del 90% de las solicitudes a nuestro modelo Haiku anterior». Superados los 100.000 tokens, la tarifa de entrada pasa a $0,50 y la de salida a $2,50, momento en el que el múltiplo frente a Gemini 3.6 Flash se reduce a aproximadamente 1,5x.
Lo que hizo el propio nivel de Google mientras esta comparación permanecía inmóvil
Aquí es donde el texto deja de ser una comparación entre dos modelos y se convierte en una advertencia sobre con qué Gemini estás comparando en realidad.
Google ha mantenido el precio de Flash fijo a lo largo de tres generaciones. Gemini 3.6 Flash, Gemini 3.7 Flash y Gemini 3.8 Flash figuran todos a 0,75 $ de entrada y 3,75 $ de salida en la propia documentación de precios de Google, con la misma tarifa de caché de 0,075 $ y el mismo incremento del 1 de enero de 2027 a 1,50 $ y 7,50 $. La ficha de Google para la línea 3.6 lo describe como «nuestro modelo Flash de la generación anterior», que son palabras del propio proveedor.
Lo que se movió fue la puntuación, no el precio. En la tabla independiente, Gemini 3.6 Flash obtiene 33,98, Gemini 3.7 Flash 39,06 y Gemini 3.8 Flash 40,93 —todos en su configuración publicada de mayor intensidad. Nueve puntos de índice llegaron dentro del nivel flash de Google en seis semanas, sin ningún cambio en la tarifa.
La consecuencia para cualquiera que esté en plena evaluación es concreta: si hace tres semanas comparaste este enfrentamiento con Gemini 3.7 Flash, tu resultado está desactualizado, y si lo comparas con Gemini 3.8 Flash, la diferencia con Claude Haiku 5.5 se reduce a 2,47 puntos. Gemini 3.6 Flash es la versión de esta comparación que más favorece a Anthropic, y también es la versión que Google está más lejos de vender.
Artificial Analysis marca la entrada 3.6 como obsoleta. La documentación de precios de Google sigue publicando la tarifa, y su lista de modelos sigue remitiendo a una sección de 3.6, así que la lectura honesta no es «desapareció», sino «fue reemplazada dos veces dentro de su propia familia en diez semanas» — y eso es un hecho sobre la rapidez con la que se mueve este nivel, no una razón para omitir la comparación.
Para quién decide esto en realidad
Hay un caso sólido para Gemini 3.6 Flash, y no es la puntuación.
Si necesitas audio o vídeo en el prompt, Claude Haiku 5.5 no puede hacerlo en absoluto: lee texto e imágenes y nada más. Gemini 3.6 Flash lee texto, imágenes, vídeo, audio y archivos, y nuestro propio catálogo lo registra con 582 tokens de salida por segundo medidos y una mediana de 4,1 segundos hasta el primer token durante la última semana, lo que lo convierte en un modelo rápido incluso para los estándares de Flash. Para un pipeline de comprensión de medios, la lista de modalidades lo decide todo y la diferencia en el índice es una nota a pie de página.
Si tu trabajo son texto e imágenes, la aritmética no está lo bastante reñida como para discutirla. Con una mezcla de entrada con carga 7:2:1 —la forma que tiene la mayoría del tráfico de producción—, Claude Haiku 5.5 sale a $0.077 por millón de tokens frente a $0.63 de Gemini 3.6 Flash. Con un millón de tokens combinados al día, eso es 77 centavos frente a $6.30, y el segundo número empeora el 1 de enero de 2027, mientras que el primero no se mueve.
El acantilado de los 100.000 tokens es la única condición que le da la vuelta. Una canalización de recuperación o de documentos largos que ensambla habitualmente prompts de 150.000 tokens paga el nivel de $0,50/$2,50 de Anthropic por toda la solicitud, y en ese punto los dos modelos están a menos de 1,5 veces de distancia entre sí en precio, mientras que Gemini 3.6 Flash sigue ganando en modalidad y en la cifra del 91,8 % que Google publica para la recuperación multiaguja con un promedio de 128k. Eso es reportado por el proveedor y no reproducido, y pertenece exactamente a ese encuadre.

Llamar a ambos, o llamar a uno
Gemini 3.6 Flash ya está en el catálogo de OrcaRouter en google/gemini-3.6-flash, al precio de lista de Google con 0 % de recargo — $0.75 y $3.75 con una lectura de caché a $0.075, aplicados tal como los cobra el proveedor. Eso importa para este modelo en concreto porque la subida del 1 de enero de Google es un cambio de tarifa, y un catálogo de traspaso la aplica el mismo día en que ocurre, no en la siguiente renovación de contrato. Una sola clave de API y una sola llamada al SDK invocan este modelo o cualquiera de los más de 200 del catálogo, así que una comparación A/B entre una pata de Google y una pata de Anthropic es un cambio en la cadena del modelo con conmutación por error automática por debajo, en lugar de una segunda integración.
Claude Haiku 5.5 no está en el catálogo. El modelo de Anthropic es accesible a través de la propia API de Anthropic y mediante AWS, Google Cloud y Microsoft Azure, y esa es toda la respuesta honesta. Lo que sí tenemos de esa línea es Claude Sonnet 5.5 y Claude Opus 5.5 — que es lo que hace que la ruta de escalado desde una llamada de clasificación barata hasta una llamada agéntica de gama media sea una decisión de enrutamiento y no un proyecto.
Lo que deja el veredicto lo bastante simple como para enunciarlo sin rodeos. Para trabajo de texto e imagen con prompts cortos, Claude Haiku 5.5 gana en todos los ejes excepto en el techo de respuesta. Para cualquier cosa con audio o video, Gemini 3.6 Flash es el único de los dos que puede responder siquiera — y si vas a pagar la tarifa de Google por esa capacidad, pregunta por cuál Gemini la estás pagando, porque en este nivel puedes obtener nueve puntos de índice más por el mismo dinero de un hermano más nuevo.
Una API para más de 200 modelos, una sola clave, conmutación por error automática por debajo, de modo que un A/B entre una rama de Google y una rama de Anthropic es un cambio en la cadena de modelo en lugar de una segunda integración.
Comparados en este artículo2
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
