Una tarjeta principal generada titulada 'Claude Haiku 5.5 vs Gemini 3.6 Flash' con el antetítulo '7.5x EL COSTO POR RESPUESTA', que muestra Claude Haiku 5.5 con Entrada $0.10, Salida $0.50 e Índice 43.40 frente a Gemini 3.6 Flash con Entrada $0.75, Salida $3.75 e Índice 33.98, sobre una barra que dice 'Costo por tarea finalizada $0.21 vs $1.60'.
Engineering & Research

Claude Haiku 5.5 vs Gemini 3.6 Flash: 7,5 veces el costo por respuesta, un modelo con nueve puntos menos

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Haiku 5.5 y Gemini 3.6 Flash ocupan el mismo nivel dentro de sus respectivas gamas —el pequeño, rápido y económico— y ahí es donde termina el parecido. En el Artificial Analysis Intelligence Index v4.3.2, Claude Haiku 5.5 obtiene 43,40 en su configuración Max frente a 33,98 de Gemini 3.6 Flash en su configuración High. En la misma ejecución, completar una tarea del Index cuesta 0,21 $ con Claude Haiku 5.5 y 1,60 $ con Gemini 3.6 Flash.

Lee ese par en conjunto, porque cualquiera de los dos por separado engaña. El modelo más barato no es un poco más barato; es 7,5 veces más barato por tarea finalizada. Y el modelo al que está superando no es un poco más débil; es 9,42 puntos de índice más débil, lo que en una tabla de 182 modelos es la distancia entre el cuartil superior y el medio.

Ambos datos provienen de la misma ejecución independiente, lo cual importa porque las fichas de proveedor que aparecen aquí no te dicen ninguno de los dos. Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026; Google lanzó Gemini 3.6 Flash el 21 de julio de 2026. Los tres meses entre ambos son la parte interesante.

Las dos tarjetas, una al lado de la otra

Por millón de tokens en dólares estadounidenses. Las tarifas de Anthropic y Google provienen de su propia documentación de precios; las filas compartidas son Artificial Analysis Intelligence Index v4.3.2. En caché el 2026-10-08.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.6 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 33.98, cost per task $0.21 against $1.60, input price $0.10 against $0.75, output tokens per task 162,164 against 41,606, Terminal Bench 4.0 0.3283 against 0.0707 and input modality 'text, image' against 'text, image, video, audio', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; Gemini 3.6 Flash is flagged deprecated on the board.'

• Entrada — Claude Haiku 5.5 $0,10 hasta 100.000 tokens y $0,50 por encima; Gemini 3.6 Flash $0,75 fijo hoy, y aumentará a $1,50 el 1 de enero de 2027.

• Salida — Claude Haiku 5.5 $0.50 hasta 100,000 tokens y $2.50 a partir de ahí; Gemini 3.6 Flash $3.75 fijo hoy, subiendo a $7.50 en la misma fecha.

• Entrada en caché — Claude Haiku 5.5 $0.01 y $0.05; Gemini 3.6 Flash $0.075, más un cargo de almacenamiento de $0.50 por millón de tokens por hora.

• Contexto y límite de salida — 1M tokens para ambos. Claude Haiku 5.5 limita una respuesta a 128.000 tokens; Gemini 3.6 Flash, a 65.536.

• Modalidad — Claude Haiku 5.5 acepta texto e imágenes. Gemini 3.6 Flash acepta texto, imágenes, vídeo, audio y archivos. Esta es la única fila en la que el lado de Google está indiscutiblemente por delante, y para un pipeline de comprensión de medios puede decidir la cuestión por completo.

• Puntuación independiente — 43,40 para Claude Haiku 5.5 (Max) frente a 33,98 para Gemini 3.6 Flash (High).

• Coste por tarea finalizada — $0.21 frente a $1.60, en la misma ejecución de evaluación.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

Por qué hay que usar por tarea, y no por token

El múltiplo de la tarifa ya parece de 7,5 en entrada y 7,5 en salida, así que la cifra por tarea no sorprende aquí, pero vale la pena mostrar por qué los dos modelos coinciden en una medida y están tan separados en la otra, porque la misma aritmética corta en sentido contrario en los otros emparejamientos de este lote.

Gemini 3.6 Flash es el menos verboso de los dos. Emite 41.606 tokens de salida por tarea del Intelligence Index — 20.061 de razonamiento y 21.545 de respuesta — frente a los 162.164 de Claude Haiku 5.5, repartidos en 129.047 de razonamiento y 33.118 de respuesta. El modelo de Anthropic gasta casi cuatro veces más tokens haciendo el mismo trabajo, y es el que tiene una tasa de salida que es una séptima parte de la de Google, por lo que la brecha de tokens y la brecha de tasa se multiplican en lugar de cancelarse.

Esa combinación —tarifa barata multiplicada por uso intensivo— es la descripción honesta de la economía de Claude Haiku 5.5, y la propia publicación de lanzamiento de Anthropic reconoce la otra cara de la moneda: el modelo ofrece «una relación calidad-precio especialmente buena cuando se usa para tareas con prompts de hasta 100.000 tokens, que representan alrededor del 90% de las solicitudes a nuestro modelo Haiku anterior». Superados los 100.000 tokens, la tarifa de entrada pasa a $0,50 y la de salida a $2,50, momento en el que el múltiplo frente a Gemini 3.6 Flash se reduce a aproximadamente 1,5x.

Lo que hizo el propio nivel de Google mientras esta comparación permanecía inmóvil

Aquí es donde el texto deja de ser una comparación entre dos modelos y se convierte en una advertencia sobre con qué Gemini estás comparando en realidad.

Google ha mantenido el precio de Flash fijo a lo largo de tres generaciones. Gemini 3.6 Flash, Gemini 3.7 Flash y Gemini 3.8 Flash figuran todos a 0,75 $ de entrada y 3,75 $ de salida en la propia documentación de precios de Google, con la misma tarifa de caché de 0,075 $ y el mismo incremento del 1 de enero de 2027 a 1,50 $ y 7,50 $. La ficha de Google para la línea 3.6 lo describe como «nuestro modelo Flash de la generación anterior», que son palabras del propio proveedor.

Lo que se movió fue la puntuación, no el precio. En la tabla independiente, Gemini 3.6 Flash obtiene 33,98, Gemini 3.7 Flash 39,06 y Gemini 3.8 Flash 40,93 —todos en su configuración publicada de mayor intensidad. Nueve puntos de índice llegaron dentro del nivel flash de Google en seis semanas, sin ningún cambio en la tarifa.

La consecuencia para cualquiera que esté en plena evaluación es concreta: si hace tres semanas comparaste este enfrentamiento con Gemini 3.7 Flash, tu resultado está desactualizado, y si lo comparas con Gemini 3.8 Flash, la diferencia con Claude Haiku 5.5 se reduce a 2,47 puntos. Gemini 3.6 Flash es la versión de esta comparación que más favorece a Anthropic, y también es la versión que Google está más lejos de vender.

Artificial Analysis marca la entrada 3.6 como obsoleta. La documentación de precios de Google sigue publicando la tarifa, y su lista de modelos sigue remitiendo a una sección de 3.6, así que la lectura honesta no es «desapareció», sino «fue reemplazada dos veces dentro de su propia familia en diez semanas» — y eso es un hecho sobre la rapidez con la que se mueve este nivel, no una razón para omitir la comparación.

Para quién decide esto en realidad

Hay un caso sólido para Gemini 3.6 Flash, y no es la puntuación.

Si necesitas audio o vídeo en el prompt, Claude Haiku 5.5 no puede hacerlo en absoluto: lee texto e imágenes y nada más. Gemini 3.6 Flash lee texto, imágenes, vídeo, audio y archivos, y nuestro propio catálogo lo registra con 582 tokens de salida por segundo medidos y una mediana de 4,1 segundos hasta el primer token durante la última semana, lo que lo convierte en un modelo rápido incluso para los estándares de Flash. Para un pipeline de comprensión de medios, la lista de modalidades lo decide todo y la diferencia en el índice es una nota a pie de página.

Si tu trabajo son texto e imágenes, la aritmética no está lo bastante reñida como para discutirla. Con una mezcla de entrada con carga 7:2:1 —la forma que tiene la mayoría del tráfico de producción—, Claude Haiku 5.5 sale a $0.077 por millón de tokens frente a $0.63 de Gemini 3.6 Flash. Con un millón de tokens combinados al día, eso es 77 centavos frente a $6.30, y el segundo número empeora el 1 de enero de 2027, mientras que el primero no se mueve.

El acantilado de los 100.000 tokens es la única condición que le da la vuelta. Una canalización de recuperación o de documentos largos que ensambla habitualmente prompts de 150.000 tokens paga el nivel de $0,50/$2,50 de Anthropic por toda la solicitud, y en ese punto los dos modelos están a menos de 1,5 veces de distancia entre sí en precio, mientras que Gemini 3.6 Flash sigue ganando en modalidad y en la cifra del 91,8 % que Google publica para la recuperación multiaguja con un promedio de 128k. Eso es reportado por el proveedor y no reproducido, y pertenece exactamente a ese encuadre.

A capture of the OrcaRouter model page for Gemini 3.6 Flash under google/gemini-3.6-flash, showing a 65K maximum output, text, image, video, file and audio input, public benchmarks published by Google dated 2026-07-21, a p50 time to first token of 4.1 seconds, and the page's own description of the model as Google's fast, cost-efficient multimodal model in the Gemini 3 family with a 1M-token context window.

Llamar a ambos, o llamar a uno

Gemini 3.6 Flash ya está en el catálogo de OrcaRouter en google/gemini-3.6-flash, al precio de lista de Google con 0 % de recargo — $0.75 y $3.75 con una lectura de caché a $0.075, aplicados tal como los cobra el proveedor. Eso importa para este modelo en concreto porque la subida del 1 de enero de Google es un cambio de tarifa, y un catálogo de traspaso la aplica el mismo día en que ocurre, no en la siguiente renovación de contrato. Una sola clave de API y una sola llamada al SDK invocan este modelo o cualquiera de los más de 200 del catálogo, así que una comparación A/B entre una pata de Google y una pata de Anthropic es un cambio en la cadena del modelo con conmutación por error automática por debajo, en lugar de una segunda integración.

Claude Haiku 5.5 no está en el catálogo. El modelo de Anthropic es accesible a través de la propia API de Anthropic y mediante AWS, Google Cloud y Microsoft Azure, y esa es toda la respuesta honesta. Lo que sí tenemos de esa línea es Claude Sonnet 5.5 y Claude Opus 5.5 — que es lo que hace que la ruta de escalado desde una llamada de clasificación barata hasta una llamada agéntica de gama media sea una decisión de enrutamiento y no un proyecto.

Lo que deja el veredicto lo bastante simple como para enunciarlo sin rodeos. Para trabajo de texto e imagen con prompts cortos, Claude Haiku 5.5 gana en todos los ejes excepto en el techo de respuesta. Para cualquier cosa con audio o video, Gemini 3.6 Flash es el único de los dos que puede responder siquiera — y si vas a pagar la tarifa de Google por esa capacidad, pregunta por cuál Gemini la estás pagando, porque en este nivel puedes obtener nueve puntos de índice más por el mismo dinero de un hermano más nuevo.

Una API para más de 200 modelos, una sola clave, conmutación por error automática por debajo, de modo que un A/B entre una rama de Google y una rama de Anthropic es un cambio en la cadena de modelo en lugar de una segunda integración.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario