
Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic acaba de romper el suelo de precios
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Durante dos años, el nivel barato del mercado tuvo una forma que todos conocían: los laboratorios estadounidenses cobraban más y los chinos cobraban menos, y uno elegía su bando en consecuencia. Claude Haiku 5.5 rompió ese esquema el 7 de octubre de 2026, al lanzarse a $0.10 por millón de tokens de entrada y $0.50 por millón de tokens de salida, lo cual está por debajo de la tarifa publicada de DeepSeek V4 Flash, el modelo que ha sido el punto de referencia de lo barato desde el verano.
Es una victoria más limitada de lo que parece, y las razones valen más que el titular. La tarifa de Anthropic solo se aplica a prompts de hasta 100.000 tokens. Por encima de eso, pasa a ser 0,50 $ y 2,50 $, lo que supone varias veces el precio de DeepSeek. Y la propia tarjeta de DeepSeek tiene una forma que nadie copia: se duplica durante dos franjas entre semana. Dos proveedores, dos ideas completamente distintas de lo que significa «barato».
Lo que publica cada proveedor
Por millón de tokens, en dólares estadounidenses. Las cifras de Anthropic provienen de la documentación de precios de Anthropic; las cifras de DeepSeek provienen de la propia página Modelos y precios de DeepSeek, que es la tarjeta autorizada para el modelo.

• Entrada — Claude Haiku 5.5 $0,10 hasta 100.000 tokens, $0,50 por encima. DeepSeek V4 Flash $0,15 en horas valle, $0,30 en las franjas de máxima demanda.
• Salida — Claude Haiku 5.5 $0.50 hasta 100,000 tokens, $2.50 por encima. DeepSeek V4 Flash $0.60 fuera de hora punta, $1.20 en hora punta.
• Entrada en caché — Claude Haiku 5.5 $0.01 hasta 100,000 tokens y $0.05 por encima. DeepSeek V4 Flash $0.003 fuera de horas punta y $0.006 en horas punta, lo que es más de tres veces más barato.
• Ventanas de máxima demanda — Anthropic no tiene ninguna; la tarifa cambia según la longitud del prompt y nada más. DeepSeek duplica la tarifa entre las 01:00 y las 04:00 y de nuevo entre las 06:00 y las 10:00 UTC, de lunes a viernes, excluidos los días festivos públicos de China.
• Contexto y salida — 1M tokens y 128.000 de salida máxima para Claude Haiku 5.5; 1M tokens y 384.000 de salida máxima para DeepSeek V4 Flash.
• Modalidad — Claude Haiku 5.5 acepta texto e imágenes; DeepSeek V4 Flash es solo texto, y la visión reside en el modelo hermano en lugar de en este.
• Puntuación independiente — Artificial Analysis Intelligence Index v4.3.2 sitúa a Claude Haiku 5.5 (Max) en 43,40, segundo de 182 modelos, y a DeepSeek V4 Flash 0731 (Max) en 34,33, décimo de 117.
• Velocidad — la misma fuente mide 241,9 tokens de salida por segundo para Claude Haiku 5.5 y 222,0 para DeepSeek V4 Flash, el segundo más rápido en su propia tabla.
El crossover lo es todo
Alinea las dos tarjetas en una sola petición y la comparación se invierte dos veces.
Por debajo de 100.000 tokens, Anthropic es más barato tanto en los medidores como en la etiqueta de precio que importa: $0,10 frente a $0,15 de entrada, $0,50 frente a $0,60 de salida. Es la primera vez que un modelo pequeño de Anthropic queda por debajo de una tarifa de DeepSeek Flash en términos comparables, y es el dato con el que abre la publicación de lanzamiento.
Por encima de los 100.000 tokens, se invierte drásticamente. La entrada de $0.50 de Anthropic es más de tres veces la tarifa fuera de horas punta de DeepSeek, y la salida de $2.50 es más de cuatro veces esa tarifa. Una canalización de recuperación o de documentos largos que ensambla habitualmente prompts de 150.000 tokens no es en absoluto un cliente de Claude Haiku 5.5; es un cliente del modelo que ya estaba usando.
Y en las dos ventanas entre semana de DeepSeek, la segunda comparación se estrecha desde la dirección opuesta, porque la tarifa de DeepSeek se duplica mientras que la de Anthropic no se mueve. La estructura de ningún proveedor es mejor en abstracto. Uno fija el precio según cuánto envías, el otro lo fija según cuándo lo envías, y solo uno de esos está bajo tu control en el momento de la solicitud.
Lo que cuesta una tarea terminada, que es el único número justo
Las tarifas de lista son por token, y los dos modelos no emiten la misma cantidad de tokens para el mismo trabajo. Ahí es donde la aritmética del lanzamiento se vuelve incómoda para Anthropic.
Artificial Analysis sitúa a Claude Haiku 5.5 (Max) en $0.21 por tarea de Intelligence Index y a DeepSeek V4 Flash 0731 (Max) en $0.22 por tarea. Una décima parte de la tarifa de entrada, una ventana más amplia y una diferencia de 26 puntos en el Intelligence Index — 43.40 frente a 34.33 — y el costo medido de completar una tarea queda dentro de un centavo del modelo al que se suponía que debía vender más barato.
La razón está en la misma página. Al evaluar el Index, Claude Haiku 5.5 generó 440 millones de tokens de salida frente a una mediana de 100 millones, y el evaluador lo califica de muy verboso. DeepSeek V4 Flash generó 240 millones frente a una mediana de 140 millones y también recibe la calificación de muy verboso. Ambos modelos piensan largo y tendido, ambos facturan el pensamiento como salida, y la salida es el medidor que decide la factura. El recorte del noventa por ciento en la entrada es real y se cobra sobre la mitad más pequeña de la factura.
Hay un segundo efecto, más silencioso. La propia documentación de Anthropic dice que Claude Haiku 5.5 utiliza el tokenizador más reciente compartido con Claude 4.7 y posteriores, por lo que el mismo texto cuenta como aproximadamente un 30 % más de tokens que en Claude Haiku 4.5. La tarifa se redujo por un factor de diez; el recuento de tokens no se redujo en absoluto y, con el mismo texto, aumentó.

El modelo que hay detrás del nombre DeepSeek también cambió.
Cualquiera que compare estos dos basándose en una tabla de benchmark de hace meses debería saber esto antes de hacerlo.
La página de precios de DeepSeek ahora incluye deepseek-flash como nombre del modelo, respaldado por DeepSeek-V4.1-Flash, y afirma que el id heredado deepseek-v4-flash todavía se acepta, pero que "los modelos correspondientes se han retirado" — las solicitudes con el nombre antiguo las atiende el modelo más reciente y se facturan al precio de Flash. En otras palabras, el id conservó su nombre, su precio y su lugar en la línea, y los pesos que hay debajo se movieron.
Eso no es una crítica; es una advertencia sobre a qué está fechada una tabla de benchmark. La entrada de Artificial Analysis que cita este artículo corresponde al lanzamiento 0731 de DeepSeek V4 Flash en su configuración Max, que es el modelo que midió el tablero, y no es automáticamente una afirmación sobre lo que hoy responda a ese id. El Claude Haiku 5.5 de Anthropic, por el contrario, es un id fijo sin sufijo de fecha ni alias, y su posición en el Index está fechada a su propia semana de lanzamiento.
Dos modelos, un solo endpoint
La razón por la que esta comparación es fácil de resolver por ti mismo en lugar de en una hoja de especificaciones es que ambos lados se pueden invocar desde el mismo lugar — con una excepción que vale la pena mencionar.
DeepSeek V4 Flash está hoy en el catálogo de OrcaRouter, y la conmutación por error automática se encuentra debajo de él, así que la parte de DeepSeek en esta comparación es invocable por nosotros esta mañana en lugar de leer sobre ella. Una advertencia que vale la pena mencionar en lugar de dejarla para que la descubra: nuestra propia tarifa listada para este modelo es de $0.22 de entrada y $0.66 de salida por millón de tokens, que se sitúa por encima de la tarifa de horas valle de DeepSeek y por debajo de la de horas punta. Trate la página de DeepSeek, no la nuestra, como la autoridad sobre la estructura de horas punta y valle, y la nuestra como un único número combinado con el que iniciar una ejecución medida. Claude Sonnet 5.5 y Claude Opus 5.5 también están en el catálogo. Así que una prueba A/B entre una parte de DeepSeek Flash y una parte de Claude es una clave y un SDK, y el DSL de enrutamiento los compondrá en una sola llamada si la lógica de escalado pertenece a la ruta en lugar de a la aplicación.
Claude Ha 5.5 todavía no está en el catálogo. Eso no es una evasiva: significa que actualmente hay que acceder directamente a Anthropic para el lado de Anthropic de esta comparación, y para el lado de DeepSeek no. Si quieres el nivel barato de DeepSeek en la misma clave que el resto de tu stack hoy, esa parte ya está activa.

¿Cuál elegir?
Si tus llamadas son cortas —clasificación, extracción, enrutamiento, resumen, turnos de subagente— y caben en menos de 100.000 tokens, Claude Haiku 5.5 es ahora el modelo más barato en ambos medidores y el más potente en el tablero independiente, y la decisión es sencilla. También es el único de los dos que acepta una imagen.
Si tus llamadas son largas, si vuelves a enviar un prefijo compartido grande o si puedes planificar, la aritmética apunta en la dirección opuesta, y lo hace por un amplio margen: la entrada en caché de DeepSeek a $0.003 fuera de horas pico es un orden de magnitud inferior a los $0.01 de Anthropic, su techo de salida es tres veces mayor, y su descuento fuera de horas pico es un problema de planificación más que una limitación del producto.
Lo que el lanzamiento realmente zanjó es más limitado que «Anthropic es barato ahora». Zanjó que los laboratorios estadounidenses cobrarán menos que los chinos en el caso de prompts cortos, y que el caso de prompts cortos es donde se concentra la mayor parte del tráfico de producción. Todo lo que supera los 100.000 tokens sigue siendo el mercado del otro modelo.
