Tarjeta de título principal generada para Claude Sonnet 5.5 vs Claude Fable 5.1, con el subtítulo «El modelo barato se sitúa tres puntos por delante», que muestra $2.00 de entrada y $10.00 de salida por millón de tokens a la izquierda frente a $10.00 y $50.00 a la derecha y, debajo de ellos, las cifras 56 y 53 del Artificial Analysis Intelligence Index v4.3, con el logotipo de OrcaRouter compuesto en la esquina inferior derecha.
Guides & Insights

Claude Sonnet 5.5 vs Claude Fable 5.1: el modelo barato va tres puntos por delante

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Sonnet 5.5 llegó el 28 de septiembre de 2026 a $2.00 por millón de tokens de entrada y $10.00 por millón de tokens de salida. Claude Fable 5.1, el modelo de clase Mythos que el proveedor lanzó el 1 de septiembre, se sitúa en $10.00 y $50.00 en esas mismas dos líneas. El resumen tentador es que Fable 5.1 es el caro y, por lo tanto, el mejor, y en el Artificial Analysis Intelligence Index el orden es al revés: Claude Sonnet 5.5 obtiene 56 y Claude Fable 5.1 obtiene 53. Eso no es un artefacto de redondeo, y tampoco es toda la historia, porque el mismo evaluador los coloca con una diferencia de tres centavos por tarea entre sí en la misma suite: $7.60 frente a $7.63. Una diferencia de cinco veces en la tarifa de precios casi ha desaparecido para cuando se termina una tarea. Lo que queda es un conjunto de diferencias de forma más que de puntuación, y elegir entre estos dos es sobre todo una cuestión de qué forma tiene tu carga de trabajo.

Dos tarjetas de tarifas, y la única línea donde la brecha no es de cinco veces

La comparación por token es contundente y no necesita interpretación.

• Entrada — Claude Sonnet 5.5 a $2.00 por millón de tokens frente a Claude Fable 5.1 a $10.00, una diferencia de cinco veces

• Salida — $10.00 frente a $50.00 por millón, de nuevo exactamente cinco veces

• Lectura de caché — $0.20 frente a $0.25 por millón. Esta es la línea que sostiene ejecuciones largas de agentes, y el descuento se desploma de 5× a 20%

• Escritura en caché — $2.50 frente a $12.50 por millón para la ventana estándar de cinco minutos, la mayor diferencia individual en cualquiera de las dos tarjetas

• Lote — El modo por lotes de Anthropic no se aplica a ninguna de estas tarjetas como sí lo hace con las de Fable 5.1: Fable 5.1 se lanzó con precios por lotes reducidos a la mitad, a $5.00 de entrada y $25.00 de salida. Lee la línea de lote en la propia página de precios de Anthropic antes de asumir que se extiende a toda la familia

• Contexto y límite máximo — 1.000.000 de tokens de contexto y 128.000 tokens de salida máxima en ambos. En la API de Message Batches, Claude Sonnet 5.5 admite hasta 300.000 tokens de salida con el encabezado beta output-300k-2026-03-24, lo que supone una diferencia real de límite máximo para la generación en volumen y no una cuestión de marketing.

Hay un punto modesto a favor de Claude Sonnet 5.5 que la tabla de tarifas no refleja del todo. Anthropic informa de que el modelo suele necesitar muchos menos tokens para hacer el mismo trabajo que su predecesor, lo que, según afirma, se traduce en hasta un 30 % menos de costo por tarea. Esa es una afirmación del proveedor sobre una comparación distinta —Sonnet 5.5 frente a Sonnet 5— y no es evidencia sobre este enfrentamiento. Sin embargo, es el mecanismo que explica lo que encontró la medición independiente.

A dónde va la brecha de precio del quíntuple

Artificial Analysis ejecutó ambos modelos el 29/09/2026 bajo un único harness y una sola etiqueta de configuración, «Razonamiento adaptativo, esfuerzo máximo, fallback predeterminado», en el Intelligence Index v4.3. Las dos cifras principales son 56 para Claude Sonnet 5.5 y 53 para Claude Fable 5.1 —el modelo más barato va por delante por unos tres puntos en una escala en la que ese mismo evaluador sitúa al modelo mediano en 26. Ambos están etiquetados como modelos de proveedor en la misma página, así que esto es un solo instrumento y una sola instantánea, no dos.

Luego, la columna de coste, y la razón por la que este emparejamiento es interesante en vez de obvio. En la misma ejecución del índice, Claude Sonnet 5.5 cuesta $7.602633 por tarea y Claude Fable 5.1 cuesta $7.629706. Separados por veintisiete milésimas de dólar. El desglose es donde se vuelve extraño: solo el lado de entrada de Claude Fable 5.1 es de $3.73 por tarea frente al componente de entrada sustancialmente menor de Sonnet 5.5, y sus tokens de razonamiento por sí solos cuestan $2.36 por tarea. El modelo que es cinco veces más barato por token no es más barato por tarea terminada en absoluto.

La causa es el volumen, y los dos modelos fallan en direcciones opuestas.

• Tokens de salida en el conjunto de índices: Claude Sonnet 5.5 generó 410.577.501 frente a los 188.465.663 de Claude Fable 5.1, en un conjunto donde la mediana registrada es de 88 millones. Ambos están muy por encima de la mediana; Sonnet 5.5 es más del doble de Fable 5.1 y casi cinco veces la mediana

• Tokens de salida por tarea: 192.838 para Sonnet 5.5 frente a 78.111 para Fable 5.1, con una proporción de razonamiento de 142.386 frente a 47.240. Sonnet 5.5 piensa aproximadamente tres veces más tiempo por tarea

• Tokens de entrada en toda la suite de índices: 18.500 millones para Sonnet 5.5 frente a 5.600 millones para Fable 5.1. Sonnet 5.5 leyó tres veces más, que es la cifra más discreta del par y la que consume la tarifa de entrada más barata

• Precio combinado con una mezcla 7:2:1 de entrada, lectura de caché y salida — $1,54 para Sonnet 5.5 frente a $7,17 para Fable 5.1. Esta es la línea que coincide con la tarjeta de tarifas, y es la línea que describe una carga de trabajo con salidas cortas y bien delimitadas.

Si juntamos todo eso, la afirmación honesta es esta: la brecha de precio combinada es real y la brecha por tarea no. Cuál de los dos números describe tu factura depende por completo de si tus tareas terminan o se alargan divagando, y el conjunto de índices está diseñado para dejarlas divagar.

La escalera del esfuerzo es la decisión real.

Ambos modelos exponen un parámetro de esfuerzo —low, medium, high, xhigh, max— y ambos se midieron en cada peldaño el 2026-09-29. Esta es la parte de la comparación que ninguna tabla de tarifas puede expresar, porque el modelo económico en un peldaño inferior supera al modelo caro en un peldaño inferior por un amplio margen y el modelo caro solo se diferencia cerca de la parte superior.

• Esfuerzo bajo — Claude Sonnet 5.5 obtiene 35,84 a $0,41 por tarea; Claude Fable 5.1 obtiene 46,82 a $2,37. En el nivel más bajo, el modelo caro va once puntos por delante, por casi seis veces el precio

• Esfuerzo medio — 40,74 a $0,59 frente a 48,92 a $2,98. Fable 5.1 mantiene una ventaja de ocho puntos a cinco veces el costo

• Esfuerzo alto — 46,74 a $1,08 frente a 51,15 a $3,91. La brecha se reduce a cuatro puntos y medio; la relación de costes se mantiene en aproximadamente 3,6×

• Esfuerzo Xhigh — 51,85 a $2,74 frente a 53,20 a $5,98. A un punto y un tercio de distancia, al 46 % del precio

• Esfuerzo máximo — 55.98 a $7.60 frente a 53.35 a $7.63. El orden se invierte y el costo converge a menos de medio punto porcentual.

Lee la cuarta y la quinta filas juntas y aparece la forma de este enfrentamiento. Claude Sonnet 5.5 en xhigh entrega 51.85 —a solo un punto y medio de índice del mejor puntaje de Claude Fable 5.1 en cualquier nivel de esfuerzo— por $2.74 por tarea frente a $7.63. Si tu trabajo necesita estar cerca de la frontera en lugar de en ella, esa fila es toda la respuesta, y ahorra un 64 % por tarea completada. Lleva Sonnet 5.5 al máximo y compras tres puntos más por 2.8 veces el dinero, lo que te deja en la misma factura que el máximo de Fable 5 con un puntaje marginalmente mejor y un perfil de razonamiento muy diferente.

Esa última frase vale la pena precisarla, porque es lo bastante contraintuitiva como para verificarla dos veces. Con el mismo esfuerzo máximo, el modelo con una tarifa cinco veces más barata cuesta lo mismo por tarea que el modelo con la tarifa cara. Llega a ello emitiendo 2,5 veces más tokens de salida, de los cuales la proporción de razonamiento es tres veces mayor. La propia documentación de Anthropic explica parte del mecanismo: el tokenizador cambió, y el mismo texto produce alrededor de un 30 % más de tokens en Claude Sonnet 5.5 que en modelos anteriores. Ese es uno de varios factores contribuyentes, y es un recordatorio útil de que los recuentos de tokens de salida no son comparables entre revisiones del tokenizador sin decirlo.

La latencia es donde los dos dejan de parecerse entre sí.

La convergencia de puntuación no se extiende al tiempo. En la misma instantánea de 2026-09-29, Artificial Analysis reporta un tiempo hasta el primer token de 254,41 segundos para Claude Fable 5.1 y de 2,80 segundos para Claude Sonnet 5.5 en el segmento de prompts largos, con velocidades de salida medianas de 67,9 y 49,4 tokens por segundo, respectivamente. Esa es una diferencia de dos órdenes de magnitud en cuánto tiempo espera quien realiza la llamada antes de que llegue algo, y es el número más relevante a nivel operativo de esta comparación.

Ambas cifras necesitan que se indiquen claramente sus condicionantes. El TTFT de Fable 5.1 se mide en el tipo de prompt largo; la porción de prompt medio del evaluador para el mismo modelo el mismo día es de 117,60 segundos, por lo que la cifra de 254 segundos es la cola y no una constante. Los 2,80 segundos de Sonnet 5.5 son su mediana general, con la propia banda de varianza del evaluador, que va de 1,91 segundos en el percentil cinco a 4,23 en el noventa y cinco. La documentación de la plataforma de Anthropic describe la latencia comparativa de Fable 5.1 como más lenta y la de Sonnet 5.5 como rápida, lo cual es consistente en cuanto a dirección sin constituir una medición.

Nuestra propia infraestructura ofrece una tercera lectura, porque enrutamos Claude Fable 5.1 y medimos lo que servimos. Durante los siete días hasta el 28 de septiembre, en el tráfico propio de OrcaRouter, Claude Fable 5.1 registra una mediana del primer token de 6.973 milisegundos con un percentil 95 de 10,0 segundos, una velocidad de salida de 65,8 tokens por segundo y una tasa de error del 0,349%. Esa p50 es más de cien veces más rápida que la cifra para prompts largos del evaluador, lo cual no es tanto una contradicción como una definición de términos: un primer token orientado al desarrollador con un prompt corto y el primer token de un benchmark con uno largo son mediciones de cosas diferentes. Cualquiera que planifique en función del número de la tabla de clasificación debería saber cuál de los dos está comprando.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

La honestidad en el sourcing, la retención y la migración de la que nadie habla

Las tablas de benchmark de los proveedores y las evaluaciones independientes son instrumentos distintos y nunca deben restarse entre sí. La propia tabla de lanzamiento de Anthropic para Claude Sonnet 5.5 reporta Terminal-Bench 4.0 al 70.6%. Artificial Analysis, ejecutando su propio harness, reporta un 63.6% para el mismo modelo en una evaluación del mismo nombre. Para Claude Fable 5.1, la discrepancia va en sentido contrario: Anthropic reportó un 55.8% en el lanzamiento y el harness independiente registra un 52.0%. Ninguno de los pares es una corrección del otro. Juzga cada uno según sus propios criterios, y prefiere el independiente cuando decidas a dónde enviar el tráfico de producción.

La postura de retención también difiere, y es el tipo de diferencia que solo aparece en una revisión de adquisiciones. Anthropic afirma que Claude Sonnet 5.5 está disponible con retención cero de datos, la misma postura que adoptó con Opus 5.5 y Sonnet 5. El material de lanzamiento de Claude Fable 5.1 describe una política incremental de uso de datos que coexiste con él y un despliegue separado dentro de Project Glasswing con una ventana de retención predeterminada de 30 días para la supervisión de seguridad, con el acuerdo de retención cero descrito como el estado provisional. Si tu equipo responde ante una revisión de tratamiento de datos, esa distinción es una partida real, y no una nota al pie, y vale la pena leer la página de políticas actual de Anthropic en lugar de cualquier resumen de ella, incluido este.

El costo de la migración es asimétrico de una manera que rara vez aparece en la cobertura de lanzamientos. Pasar a Claude Sonnet 5.5 no es un cambio de string de modelo. La guía de migración de Anthropic indica que los valores no predeterminados de temperature, top_p y top_k ahora devuelven un error 400, que un tool_choice de any o de una herramienta con nombre se rechaza directamente, y que thinking: {"type": "disabled"} debe convertirse en between_tools si estabas ejecutando con el pensamiento inicial desactivado. El tipo between_tools se acepta con esfuerzo low, medium y high, y devuelve un 400 con xhigh o max. En la API de Claude y Google Cloud, el uso de computadora solo se admite a través del conjunto de herramientas computer_toolset_20260801; el anterior computer_20251124 se rechaza. Ninguno de esos puntos se aplica a un cambio a Claude Fable 5.1, que es una actualización de la misma familia desde Fable 5 con tres cambios disruptivos propios. Si estás sopesando los dos como objetivos de migración paralelos, el modelo más barato es el más costoso de adoptar.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Cuál poner dónde

La decisión que se deriva de las cifras es una decisión sobre cuánto de tu tráfico está bien acotado.

• Trabajo acotado, de gran volumen e impulsado por herramientas — Claude Sonnet 5.5, con esfuerzo xhigh si necesitas estar cerca de la frontera. Está punto y medio de índice por detrás de lo mejor de Fable 5.1 por un 64 % menos por tarea completada, devuelve su primer token en unos tres segundos, y su línea más económica de escritura en caché hace asequible un prefijo de contexto reconstruido.

• Trabajo de horizonte largo y abierto, donde una respuesta incorrecta sale cara — Claude Fable 5.1. Alcanza la puntuación máxima de Sonnet 5.5 con el mismo costo por tarea, pero llegando ahí con un tercio de los tokens de razonamiento y una cuarta parte de la entrada, lo cual importa cuando la tarea es genuinamente abierta y la forma de la suite de evaluación se parece a tu problema

• Superficies interactivas limitadas por la latencia — Claude Sonnet 5.5, y no hay punto de comparación. Según la propia instantánea del evaluador, la diferencia en el primer token es de dos órdenes de magnitud en el tipo de prompt largo, y la lectura de prompt medio solo la reduce a unos 118 segundos. No se puede construir una superficie de chat sobre la cifra de Fable 5.1 sin usar procesamiento por lotes o streaming para sortearla.

• Generación masiva con salidas largas — Claude Sonnet 5.5, debido al límite de salida de 300.000 tokens disponible en la API Message Batches con la cabecera output-300k-2026-03-24, frente a un límite de 128.000 tokens en todos los demás casos. Confirma el precio de tu lote antes de comprometerte; la tarifa por lotes no es idéntica entre las dos tarjetas

• Trabajo que debe abarcar varias cuentas o transferir el razonamiento entre sistemas: lee la documentación de Anthropic sobre el pensamiento preservado antes de hacer cualquiera de las dos cosas. Los bloques de pensamiento están vinculados al modelo y a la cuenta que los produjeron, y Sonnet 5.5 es el primer Sonnet que se lanza con clasificadores que impiden la extracción del razonamiento. Eso es una función de cumplimiento y una restricción al mismo tiempo

• Cargas de trabajo reguladas o sensibles a la retención — consulte la política actual en lugar de la cobertura de lanzamiento. Claude Sonnet 5.5 se lanzó con retención de datos cero disponible; el material de Fable 5.1 describe una política incremental con una ventana predeterminada de 30 días en una implementación y retención cero como estado provisional

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

En OrcaRouter, Claude Fable 5.1 y Claude Sonnet 5 se encuentran detrás de una sola credencial al precio de lista del proveedor con 0% de recargo, así que la línea de lectura de caché y el cambio de tokenizador son lo único que mueve tu factura cuando cambias entre ellos. Claude Sonnet 5.5 aún no es una ruta en nuestra plataforma —el modelo tiene un día de vida—, así que la afirmación honesta es que hoy se llega a él a través de la propia API de Anthropic. Cualquiera que ejecute Fable 5.1 a través de nosotros puede calcular el costo del cambio el día en que llegue sin cambiar nada más de su integración y, mientras tanto, la conmutación por error automática entre proveedores es lo que hace seguro probar un modelo tan nuevo en una ruta que debe mantenerse activa.

El veredicto es más ajustado de lo que sugiere el precio. Claude Sonnet 5.5 es la mejor opción predeterminada para casi todo lo acotado: obtiene tres puntos más en el índice independiente, responde en segundos y, en xhigh, se queda a punto y medio del techo de Fable 5 por bastante menos de la mitad del coste por tarea. Claude Fable 5.1 conserva un argumento real, y es el que plantea la propia tabla comparativa de Anthropic: cuando el trabajo es abierto y el coste de equivocarse supera el de pensar más tiempo, cinco veces el precio compra un modelo que alcanza la misma puntuación sin gastar tres veces los tokens de razonamiento para llegar hasta ahí. Elige en función de la forma de la tarea, no del tamaño de la tabla de tarifas, porque en lo más alto de la escala de esfuerzo esos dos modelos te cobran lo mismo.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario