
Claude Haiku 5.5 vs Gemini 3.8 Flash: Dos puntos de índice, seis veces el costo por tarea
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Claude Haiku 5.5 y Gemini 3.8 Flashestán más cerca en capacidad medida que cualquier otro par de esta banda de precios: 43,40 frente a 40,93 en el Artificial Analysis Intelligence Index v4.3.2, y ambos se sitúan entre los cincuenta primeros de una tabla de 225 modelos. Lo que los diferencia es cuánto cuesta uno de esos puntos del índice. Según esa misma medición independiente, una tarea completada del Intelligence Index cuesta 0,21 $ en Claude Haiku 5.5 y 1,24 $ en Gemini 3.8 Flash.
Eso supone una brecha seis veces mayor para una diferencia de dos puntos y medio en la puntuación, y es el número que debería decidir esta comparación. Todo lo demás —las tarifas de lista, la lista de modalidades, los plazos vinculados al precio de Google— es una discusión sobre los márgenes.
Ambos modelos, en las cifras que importan
Por millón de tokens en dólares estadounidenses, según la documentación de precios propia de Anthropic y Google, con las mediciones independientes atribuidas a Artificial Analysis. Almacenado en caché el 2026-10-08.

Entrada — Claude Haiku 5.5 $0.10 hasta 100,000 tokens y $0.50 por encima; Gemini 3.8 Flash $0.75 fijo, y sube a $1.50 el 1 de enero de 2027.
• Salida — Claude Haiku 5.5 $0.50 hasta 100,000 tokens y $2.50 por encima; Gemini 3.8 Flash $3.75 tarifa fija, subiendo a $7.50 en la misma fecha.
• Entrada en caché — Claude Haiku 5.5 $0.01 y $0.05; Gemini 3.8 Flash $0.075, más un cargo por almacenamiento de $0.50 por millón de tokens por hora.
• Contexto — 1M de tokens para ambos. Salida máxima — 128.000 tokens para Claude Haiku 5.5 frente a 65.536 para Gemini 3.8 Flash.
• Modalidad de entrada — texto e imágenes para Claude Haiku 5.5; texto, imágenes, voz y video para Gemini 3.8 Flash. Esta es la única línea en la que la lista de Google es estrictamente más larga.
• Puntuación independiente — 43,40 para Claude Haiku 5.5 (Max) frente a 40,93 para Gemini 3.8 Flash (High), en Intelligence Index v4.3.2.
• Costo independiente por tarea — $0,21 frente a $1,24 en la misma placa.
• Velocidad — 241.9 tokens de salida por segundo frente a 125.2, ambos medidos por Artificial Analysis.
De dónde viene la cifra de seis veces
La brecha de coste por tarea es mayor que la brecha de precio de etiqueta, y esa es la parte interesante, porque significa que la lista de tarifas por sí sola no lo explica.
La aritmética de las etiquetas es bastante simple: $0.10 frente a $0.75 en la entrada es siete veces y media más barato, y $0.50 frente a $3.75 en la salida es la misma proporción. Si ambos generaran los mismos tokens para el mismo trabajo, esa proporción se trasladaría directamente a la factura.
No se mantiene, y ambos efectos favorecen a Google. Claude Haiku 5.5 es verboso de una forma que su propio proveedor reconoce: Artificial Analysis registró 440 millones de tokens de salida mientras ejecutaba el Index, frente a una mediana de 100 millones, y califica al modelo de muy verboso. Gemini 3.8 Flash generó 170 millones frente a una mediana de 81 millones —también señalado como verboso, pero un tercio del recuento de tokens. La propia documentación de Anthropic añade el segundo efecto: Claude Haiku 5.5 utiliza el tokenizador más reciente que comparte con Claude 4.7 y posteriores, por lo que el mismo texto cuenta como aproximadamente un 30% más de tokens que en el modelo al que sustituye.
En conjunto, la versión honesta de la afirmación sobre precios es esta: una ventaja de diez a uno en la tarifa de entrada y una ventaja de siete y medio a uno en la tarifa de salida, consumidas en parte por un modelo que escribe más tokens por respuesta, lo que da como resultado una ventaja de seis a uno en la medición que cobra por el trabajo completo. Sigue siendo una paliza, y una menor de lo que sugiere la lista de tarifas.
El precio de Google tiene una fecha
Lo más útil de la página de precios de Google es una frase que la mayoría de las tablas comparativas omiten.
Gemini 3.8 Flash figura a $0.75 de entrada y $3.75 de salida "hasta el 31 de diciembre de 2026", y a $1.50 y $7.50 "a partir del 1 de enero de 2027". La entrada en caché pasa de $0.075 a $0.15 en la misma fecha. Se trata de una tarifa introductoria con una fecha de vencimiento impresa al lado, a aproximadamente once semanas de este escrito.
Nada en la tarjeta de Anthropic dice eso. Las tarifas de Claude Haiku 5.5 se declaran como las tarifas, con una estructura de dos niveles determinada por la longitud del prompt en lugar de por el calendario, y un compromiso de retirada no antes del 7 de octubre de 2027. Si estás modelando una pipeline que se extiende hasta el próximo año, el paso de enero de Google es una duplicación y debe incluirse en el modelo; el de Anthropic no tiene un evento equivalente que planificar.
Eso es válido en ambos sentidos, y la interpretación justa no es "un proveedor es honesto y el otro no". Una tarifa promocional es una tarifa real mientras se mantenga vigente, y Google tiene derecho a fijar el precio de un lanzamiento de esa manera. Es simplemente un hecho de la comparación que el lado que parece más barato de las cifras de enero es el que tiene la fecha límite.

¿Cuánto valen dos puntos del índice?
Una diferencia de 2,47 puntos en un índice que llega hasta los sesenta y tantos no es un error de redondeo ni es un abismo. Ambos modelos se encuentran en la misma banda de funcionamiento, y la pregunta práctica es si la diferencia se manifiesta en las tareas que realmente ejecutas.
Según las cifras de los propios proveedores, los dos no se miden con el mismo harness, así que no se pueden equiparar directamente —Anthropic publica los resultados de GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 y FrontierCode para Claude Haiku 5.5, y Google publica su propio conjunto para Gemini 3.8 Flash, y ninguno de los dos proveedores ejecutó la suite del otro. La única comparación homogénea disponible es el ranking independiente, y ahí la respuesta es que Anthropic va por delante por un margen medible pero pequeño.
La diferencia de capacidades que más importará a algunos equipos está en la cuestión de las modalidades. Gemini 3.8 Flash acepta entrada de voz y video; Claude Haiku 5.5 acepta texto e imágenes. Un pipeline que ingiere grabaciones de llamadas o capturas de pantalla de forma nativa no está eligiendo entre estos dos modelos por precio en absoluto — uno de ellos no puede hacer el trabajo sin un paso previo de transcripción o extracción de fotogramas, y ese paso tiene su propio costo y sus propios modos de fallo.
Ejecutando el lado más barato del par
Gemini 3.8 Flash está en el catálogo de OrcaRouter al precio de lista de Google con un 0 % de recargo, lo cual importa aquí más de lo habitual: la tarifa del proveedor se transfiere tal cual en lugar de combinarse, así que si quieres ver qué le hace realmente a una factura el ajuste de enero, la cifra se mueve cuando se mueve la de Google. Claude Sonnet 5.5 y Claude Opus 5.5 también están en el catálogo, lo que convierte una prueba de enrutamiento a tres bandas —la ruta Flash de Google, un nivel medio de Anthropic y, más adelante, un nivel pequeño de Anthropic— en una configuración en lugar de un proyecto. Una clave, un SDK, conmutación por error automática por debajo, y el DSL de enrutamiento si prefieres expresar la escalada en la ruta en lugar de en el código de la aplicación.
Claude Haiku 5.5 en sí mismo aún no está en el catálogo, y es mejor decirlo que dejarlo ambiguo. La parte de Anthropic de esta comparación actualmente solo es accesible en Anthropic, mientras que la parte de Google se puede llamar desde nosotros hoy al precio que se muestra arriba.

¿Cuál, y para quién?
Si tu trabajo consiste en texto que entra y texto que sale, tus prompts no superan los 100.000 tokens y pagas por token para un volumen real, Claude Haiku 5.5 es el modelo más barato según todas las métricas de este artículo y el de mayor puntuación en la única tabla comparativa compartida, con la salvedad de que la ventaja es de seis veces en el costo por tarea y no las diez veces que sugiere el precio de etiqueta.
Si necesitas entrada de audio o vídeo, o necesitas una respuesta de más de 65K, o tus prompts tienden a ser largos con frecuencia, el cálculo cambia: Gemini 3.8 Flash acepta entradas que el nivel pequeño de Anthropic no puede, y más allá de los 100.000 tokens, el propio segundo nivel de Anthropic tiene un precio muy superior a la tarifa plana de Google.
Lo único a lo que hay que aferrarse son las fechas. La tarifa de Google es válida hasta finales de año y se duplica después. La de Anthropic se declara fija con un escalón por longitud. Sea cual sea el lado en el que te sitúes, incorpora el calendario a la hoja de cálculo antes de construir el pipeline.
