
Claude Haiku 5.5 vs DeepSeek V4.1 Flash: el precio de etiqueta más barato no es el modelo más barato
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
En la lista de precios, no hay comparación posible. Claude Haiku 5.5, que el proveedor lanzó el 7 de octubre de 2026, figura a $0,10 por millón de tokens de entrada y $0,50 por millón de tokens de salida. DeepSeek V4.1 Flash, publicado el 10 de septiembre de 2026, figura a $0,30 y $1,20 en la tabla independiente, o a $0,15 y $0,60 en la tarifa de horas valle del propio proveedor. El proveedor es entre dos y tres veces más barato en ambos medidores, y es la primera vez que un modelo de la clase Haiku queda por debajo de una tarifa de DeepSeek Flash.
Luego mides lo que cuesta una tarea terminada, y la brecha se desmorona. En la misma ejecución de evaluación, una tarea del Intelligence Index cuesta $0,21 en Claude Haiku 5.5 y $0,27 en DeepSeek V4.1 Flash — una ventaja del 20 %, no del 200 %. La razón está en la misma página: Claude Haiku 5.5 generó 162.164 tokens de salida por tarea frente a los 88.574 de DeepSeek. Pagas menos por token y compras casi el doble de ellos.
Esa inversión es toda la comparación, y todo lo que sigue es un argumento sobre de qué lado de ella cae tu carga de trabajo.
Ambas tarjetas de tarifas, leídas tal como están escritas
Por millón de tokens en dólares estadounidenses. Las cifras de Anthropic provienen de la propia documentación de precios de Anthropic; las de DeepSeek provienen de la página Model & Pricing de DeepSeek, que es la fuente autorizada para su estructura de pico y fuera de pico. Las mediciones independientes son Artificial Analysis Intelligence Index v4.3.2, consultado el 2026-10-08.

• Entrada — Claude Haiku 5.5 $0,10 hasta 100.000 tokens y $0,50 por encima de eso. DeepSeek V4.1 Flash $0,30 fijo en la tarjeta del tablero, o $0,15 en las franjas de menor demanda de DeepSeek.
• Salida — Claude Haiku 5.5 $0,50 hasta 100.000 tokens y $2,50 por encima. DeepSeek V4.1 Flash $1,20 tarifa plana, o $0,60 fuera de horas punta.
• Entrada en caché — Claude Haiku 5.5: $0,01 por debajo de 100.000 tokens y $0,05 por encima, un descuento del 90 %. DeepSeek V4.1 Flash: $0,006, un descuento del 98 %. Este es el único medidor donde la tarjeta DeepSeek es más barata en términos absolutos, y lo es por un margen mayor del que la gente espera.
• Tarificación según la hora del día — Anthropic no tiene ninguna. DeepSeek duplica ambos medidores entre las 01:00 y las 04:00 y de nuevo entre las 06:00 y las 10:00 UTC los días laborables, excluyendo los días festivos públicos de China. Todas las demás horas, incluido todo el fin de semana, son horas valle.
• Contexto y techo de salida — 1M tokens cada uno. Claude Haiku 5.5 limita una sola respuesta a 128,000 tokens; DeepSeek V4.1 Flash la limita a 384,000.
• Pesos — Claude Haiku 5.5 es propietario, solo API, id de modelo claude-haiku-5-5. DeepSeek V4.1 Flash es abierto bajo MIT, 552B parámetros totales con 16B activos, en Hugging Face.
• Modalidad: ambas aceptan texto e imágenes y devuelven texto. Ninguna es nativa de video.
• Puntuación independiente — 43.40 para Claude Haiku 5.5 (Max) frente a 39.46 para DeepSeek V4.1 Flash (Max). Una diferencia de 3.94 puntos en una tabla de 182 modelos.

Por qué el número por tarea supera al número por token
Las tarifas de etiqueta se cotizan por token porque eso es lo que se mide. Son una mala guía para saber cuánto cuesta una carga de trabajo, porque un modelo de razonamiento decide cuántos tokens necesita una tarea, y los dos modelos de aquí difieren en un factor de 1,8.
Claude Haiku 5.5 emite 162.164 tokens de salida por tarea de Intelligence Index, repartidos en 129.047 de razonamiento y 33.118 de respuesta. DeepSeek V4.1 Flash emite 88.574, repartidos en 62.670 de razonamiento y 25.904 de respuesta. Ambos facturan el pensamiento como salida. Así que el modelo con la tasa de salida un 60 % menor gasta casi el doble del costoso medidor, y la aritmética los deja con menos de seis centavos de diferencia entre sí.
Hay un segundo efecto que empuja en la misma dirección. La ejecución del índice está dominada tanto por la entrada como por la salida porque el arnés reenvía el contexto: los $0.2128 por tarea de Claude Haiku 5.5 se desglosan en $0.1317 de entrada y $0.0811 de salida, y dentro de la línea de entrada, $0.0954 de eso corresponde a lecturas de caché y $0.0337 a escrituras de caché, frente a solo $0.0026 de entrada nueva. Los $0.2652 de DeepSeek se dividen en $0.1589 de entrada y $0.1063 de salida, con $0.0966 de la entrada en escrituras de caché. Los dos modelos leen aproximadamente la misma cantidad de contexto en caché; DeepSeek paga más por las mismas lecturas y escrituras.
La propia publicación de lanzamiento de Anthropic comienza con una advertencia similar desde la dirección opuesta. Dice que Haiku 5.5 es "especialmente buena relación calidad-precio cuando se utiliza para tareas con prompts de hasta 100.000 tokens, que constituyen alrededor del 90% de las solicitudes a nuestro modelo Haiku anterior". Ese calificador es importante — mira el acantilado a continuación.
El precipicio de los 100.000 tokens es la verdadera bifurcación
Anthropic no aplica una tarifa plana a Claude Haiku 5.5. Los medidores de $0.10 y $0.50 se mantienen para prompts de hasta 100,000 tokens y luego pasan a $0.50 y $2.50 — un salto de cinco veces en la entrada y un salto de cinco veces en la salida, aplicado a toda la solicitud en lugar de al exceso.
La estructura de DeepSeek es completamente diferente. Su tarifa depende de cuándolo envías, no de cuánto envías. Un prompt de 150.000 tokens cuesta lo mismo por token que un prompt de 500 tokens, el doble dentro de dos franjas horarias entre semana.
Pon un pipeline de prompts largos en ambos y la comparación se invierte por completo. Con 150.000 tokens de entrada y 20.000 de salida, Claude Haiku 5.5 factura $0,125 de entrada y $0,05 de salida — $0,175 por la llamada —, mientras que DeepSeek, fuera de horas punta, factura $0,0225 y $0,012, lo que suma menos de cuatro centavos. Eso significa que DeepSeek gana por un factor de aproximadamente 4,5, en los mismos dos modelos donde el caso de los prompts cortos hacía que Anthropic ganara por tres.
Ninguna de las dos estructuras es mejor en abstracto. Una cobra según cuánto envías; la otra, según cuándo lo envías, y solo una de esas dos variables está bajo tu control en el momento de la solicitud.
La otra palanca de DeepSeek que nadie incluye en el precio
La línea de caché merece un análisis aparte, porque es el medidor más barato de toda esta comparación y es el que crece con el volumen de producción en lugar de reducirse.
La tasa de aciertos de caché de DeepSeek es de $0.006 por millón de tokens, con un descuento declarado del 98% — aproximadamente una sexta parte de los $0.01 de Anthropic y una fracción de lo que cuesta la entrada nueva en cualquiera de los dos lados. Todo lo que reenvíe un prefijo estable — un prompt de sistema largo, un conjunto de documentos recuperados, un esquema de herramientas — paga esa tasa en cada turno después del primero. La ejecución de indexación anterior ya muestra lo grande que es esa proporción: $0.0954 del costo de entrada por tarea de Claude Haiku 5.5 corresponde a lecturas de caché, a partir de solo $0.0026 de entrada no cacheada.
Así que la división práctica es más estrecha que «Anthropic es más barato». Si tus solicitudes son cortas, de un solo turno y con caché caliente, Claude Haiku 5.5 va por delante en precio, por delante en capacidad por 3,94 puntos de índice, y por delante en las filas compuestas de rendimiento agéntico. Si tus solicitudes son largas, o con abundantes prefijos, o se pueden programar en las ventanas de menor demanda de DeepSeek, DeepSeek V4.1 Flash domina en coste y no es precisamente por un margen estrecho.
Lo que realmente puedes llamar hoy
Ambos modelos son accesibles, pero no de forma simétrica, y esa asimetría merece mencionarse en lugar de dejarla para que la descubras tú.
DeepSeek V4.1 Flash ya está en el catálogo de OrcaRouter, ofrecido al precio de lista del proveedor con un 0 % de recargo, lo cual importa más aquí que de costumbre, porque la tarifa de DeepSeek tiene una estructura de picos. Publicamos $0,15 de entrada y $0,60 de salida, con $0,003 por lectura de caché, y las dos ventanas de duplicación en días laborables incluidas en el registro de precios, de modo que una solicitud enrutada al tramo de DeepSeek se factura tal como DeepSeek la factura, y no a un promedio combinado. La conmutación por error automática se sitúa por debajo de la ruta, de modo que un 429 en ventana de pico o una caída parcial del proveedor redirige la llamada en lugar de hacerla fallar.
Claude Haiku 5.5 no está en el catálogo. Al modelo de Anthropic se puede acceder directamente a través de Anthropic y mediante sus tres socios de nube —AWS, Google Cloud y Microsoft Azure, que menciona la publicación de lanzamiento—, y esa es la única forma honesta de decirlo. Lo que el catálogo sí incluye de la línea de Anthropic es Claude Sonnet 5.5 y Claude Opus 5.5, que es lo que hace que una ruta de escalado desde una llamada de clasificación barata hasta una llamada agéntica de nivel medio sea una configuración de enrutamiento en lugar de una segunda integración.

¿Cuál elegir?
Si tu tráfico es de clasificación, extracción, decisiones de enrutamiento, resumen y turnos de subagente —prompts cortos, alto volumen, imágenes de por medio—, Claude Haiku 5.5 es el mejor modelo y, por debajo de 100.000 tokens, el más económico. Obtiene 3,94 puntos de índice más, acepta imágenes y Anthropic ofrece un control de esfuerzo ajustable para que puedas intercambiar capacidad por coste por llamada sin cambiar de modelo.
Si tu tráfico consiste en documentos largos, tiene un uso intensivo de recuperación o puedes programarlo, DeepSeek V4.1 Flash gana en las cuentas: es entre tres y cuatro veces más barato por llamada larga, tiene una tarifa de caché de una sexta parte de la de Anthropic, un límite de respuesta de 384.000 tokens y pesos abiertos que puedes conservar si alguna vez el modelo de pago por token deja de convenirte.
Lo que esta comparación realmente determina es más limitado que «Anthropic es ahora la opción barata». Determina que un modelo pequeño de Anthropic puede batir una tarifa de DeepSeek Flash en el precio de etiqueta y aun así quedar a menos de un 20% de ella en la factura, y que la distancia entre esos dos hechos es un ajuste de verbosidad.
Una API para más de 200 modelos, una sola clave, conmutación por error automática por debajo, de modo que un 429 en ventana de máxima demanda o un bajón de un proveedor redirige la llamada en lugar de hacerla fallar.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
