
Claude Opus 5: el modelo casi fronterizo de Anthropic a la mitad del precio de Fable 5
- DeepSeekNUEVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiNUEVOZ.ai: GLM 5.32026-08-1860Inteligencia75Código
- obsidianNUEVOQwen3.8 27B2026-08-1552Inteligencia68Código
- qwenNUEVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNUEVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencia69Código
- grokNUEVOSpaceXAI: Grok 4.62026-08-1261Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencia77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencia77Código
El 24 de julio de 2026, Anthropic lanzó Claude Opus 5 — y en un día hizo algo raro para un modelo "más barato": llegó a la cima de las clasificaciones independientes. Anthropic presentó Opus 5 como un modelo que alcanza cerca de la inteligencia fronteriza de Claude Fable 5 a la mitad del precio, y se lanzó el mismo día en Claude.ai, la API de Claude, Claude Code y Claude Cowork. Desde entonces, Artificial Analysis lo ha calificado como el modelo #1 en su Intelligence Index. Esta guía cubre qué es realmente Opus 5, qué está verificado independientemente versus reportado por el proveedor, su nuevo dial de esfuerzo y postura de seguridad, cuánto cuesta en la práctica, y quién debería cambiarse.
Cada figura a continuación está etiquetada por fuente, porque a esta velocidad la historia cambia a diario: lo que decía "sin puntuación independiente todavía" el día del lanzamiento ahora es "independientemente #1." Los puntos de referencia y precios se mueven — verifique antes de comprometer su presupuesto.
TL;DR. Claude Opus 5 tiene un precio de $5 por 1M de tokens de entrada y $25 por 1M de salida — idéntico a Opus 4.8 y exactamente la mitad del precio de Fable 5 ($10 / $50). En el Artificial Analysis Intelligence Index ahora lidera con 61 (máximo esfuerzo), el mejor modelo de los 170 evaluados, superando a Fable 5 (60) y equiparando su clase a la mitad del costo. Los propios benchmarks de lanzamiento de Anthropic lo respaldan: Frontier-Bench v0.1 43.3% (frente al 33.7% de Fable 5), además de liderar en AutomationBench de Zapier y en el benchmark de uso computacional OSWorld 2.0. Dos cosas lo convierten en algo más que un recorte de precio: un dial de esfuerzo (bajo/medio/alto/máximo) que intercambia costo por capacidad por solicitud, y la postura de seguridad más sólida de cualquier Opus hasta ahora. Si ya desarrollas en Claude, actualizar es de bajo riesgo y no aumenta tu factura; si estás eligiendo entre modelos insignia, Opus 5 es ahora el líder en valor y calidad — valídalo con tu propia carga de trabajo.
Conclusiones clave
• Ahora, de forma independiente, #1. Artificial Analysis sitúa a Claude Opus 5 (máximo esfuerzo) con 61 en su Índice de Inteligencia — el modelo mejor clasificado, por delante de Fable 5 (60).
• La mitad del precio de Fable 5. $5 / $25 por 1 millón de tokens, igual que Opus 4.8 y la mitad de los $10 / $50 de Fable 5 — calidad de vanguardia a un precio de gama media.
• Nuevo dial de esfuerzo. Los ajustes bajo/medio/alto/máximo intercambian tokens (coste) por capacidad; "máximo" es lo que encabeza la tabla de clasificación, los ajustes más baratos aún superan a la mayoría de los rivales.
• Construido para agentes y uso en computadoras. Anthropic enfatiza la finalización de tareas de múltiples pasos (AutomationBench) y la conducción de una interfaz de usuario real (OSWorld 2.0), no solo respuestas únicas.
• El Opus más seguro hasta ahora. Anthropic lo llama "el modelo Opus más alineado", esperando que sus clasificadores cibernéticos intervengan aproximadamente un 85% menos que Fable 5 — menos rechazos falsos en trabajo legítimo.
• Amplia disponibilidad inmediata. Modelo predeterminado en Claude Max, el más potente en Claude Pro, y disponible en la API, Claude Code y Claude Cowork desde el primer día.
Nota sobre la lectura de este informe: todo lo atribuido a Anthropic es una afirmación del proveedor a partir de materiales de lanzamiento; las cifras independientes (el Índice de Inteligencia) se atribuyen a Artificial Analysis. Cuando un número aún no se ha publicado (una puntuación separada de SWE-bench Verified), lo indicamos en lugar de adivinarlo.
Lo que realmente es Claude Opus 5
Opus 5 es el miembro más reciente de la línea Opus de Anthropic — el nivel "pesado" por encima de Sonnet y Haiku. Se sitúa por encima de Opus 4.8 y, según el Índice de Inteligencia independiente, ahora ha superado a Fable 5, el modelo insignia de vanguardia de Anthropic de junio de 2026. Lo que lo hace notable no es un modesto incremento de capacidad, sino la combinación: inteligencia cercana a la cima de la tabla a un precio de caballo de batalla. Anthropic lo describe como un modelo "reflexivo y proactivo" destinado a la codificación, flujos de trabajo agentivos y tareas ofimáticas empresariales cotidianas.
Concretamente, Opus 5 cuesta $5 por 1M tokens de entrada y $25 por 1M tokens de salida. Eso es lo mismo que Opus 4.8, y la mitad de los $10 / $50 de Fable 5. Es la opción predeterminada en Claude Max y la opción más potente en Claude Pro, y está disponible a través de la API de Claude, Claude Code (para codificación) y Claude Cowork (para trabajo de agente colaborativo) desde el día de lanzamiento. La ventana de contexto es de la familia Opus de clase 1M.
¿Qué es realmente nuevo?
La señal más clara del día del lanzamiento fue Frontier-Bench v0.1 de Anthropic, un conjunto difícil de razonamiento y tareas: Opus 5 obtiene un 43,3%, frente al 33,7% de Fable 5 y el 18,7% de Opus 4.8. En ese punto de referencia, el nuevo modelo más barato de Anthropic supera a su propio buque insignia más caro, una afirmación que desde entonces ha sido respaldada por puntuaciones independientes.
Dos puntos de referencia adicionales de proveedores completan la historia de "diseñado para el trabajo real". En AutomationBench de Zapier, que mide si un modelo lleva una tarea empresarial hasta su finalización en lugar de solo iniciarla, Anthropic afirma que la tasa de aprobación de Opus 5 es aproximadamente 1.5 veces la del modelo más cercano a un costo equivalente, y que incluso su configuración de esfuerzo más barata supera el mejor resultado de cualquier competidor. En OSWorld 2.0, un punto de referencia de uso de computadora, Anthropic informa que Opus 5 supera a sus rivales en todos los niveles de precio y supera la puntuación máxima de Fable 5 utilizando aproximadamente un tercio del presupuesto. Opus 5 también mejora respecto a Opus 4.8 en todas las evaluaciones de ciencias de la vida que Anthropic rastrea, con el mayor salto — más de 10 puntos porcentuales — en tareas de química orgánica como la lectura de estructuras moleculares a partir de datos de espectroscopia.
El dial de esfuerzo: pagar solo por la capacidad que necesitas
La característica principal — y en la que se centran la mayoría de los revisores — es el ajuste de esfuerzo. Opus 5 permite elegir cuánto esfuerzo dedica el modelo a una solicitud: bajo, medio, alto o máximo. Un mayor esfuerzo implica más tokens de razonamiento interno (por lo tanto, mayor costo y latencia) y mayor calidad; un menor esfuerzo conserva tokens para respuestas más rápidas y económicas. En efecto, es un regulador de tu factura de IA.
Por eso Artificial Analysis enumera varias entradas de Opus 5 (medium, high, xhigh, max): cada nivel de esfuerzo es un punto diferente en la curva de coste-calidad. El ajuste "max" es el que actualmente encabeza el Intelligence Index con 61; los ajustes inferiores sacrifican un poco de calidad a cambio de un coste por tarea significativamente menor, e incluso ellos, según Anthropic, superan los mejores resultados de la mayoría de los competidores. En la práctica, esto significa que un solo modelo puede atender tanto tus llamadas sensibles a la latencia y de alto volumen (low/medium) como tus trabajos de razonamiento más difíciles (high/max): ajustas por solicitud en lugar de cambiar de modelo.

El análisis profundo de benchmarks: lo que realmente miden estas pruebas
Ayuda saber qué significa cada número antes de confiar en él. El Artificial Analysis Intelligence Index es un compuesto de muchas evaluaciones independientes (razonamiento, matemáticas, codificación, conocimiento) realizadas por un tercero; una puntuación de 61 que coloca a Opus 5 en primer lugar entre 170 modelos es la señal única más creíble aquí, precisamente porque Anthropic no la ejecutó. Frontier-Bench v0.1 (43.3% para Opus 5) es el conjunto difícil propio de Anthropic — una señal relativa de que Opus 5 supera problemas más difíciles que Fable 5 (33.7%) u Opus 4.8 (18.7%), no "43% correcto" en el sentido escolar.
AutomationBench y OSWorld 2.0 importan más que una única puntuación de razonamiento si tu caso de uso son los agentes. AutomationBench recompensa la finalización de tareas (la diferencia entre un agente que redacta un correo y uno que realmente presenta el informe de gastos), y OSWorld 2.0 recompensa el manejo de una interfaz de usuario real de computadora. La afirmación de Anthropic de que Opus 5 iguala el pico de OSWorld de Fable 5 a un tercio del costo es, ahora que el Intelligence Index corrobora su posición general, un argumento sólido para trasladar las cargas de trabajo de agentes a Opus 5. La única brecha: aún no hay una cifra de SWE-bench Verified auditada de forma independiente y por separado para Opus 5 (Fable 5 se sitúa en 95.0%, Opus 4.8 en 88.6%), así que para una cita de precisión de codificación pura, espere ese número.

Lo que cuesta en la práctica
Los precios por token son abstractos; el costo por tarea es lo que impacta tu factura. Toma un paso representativo de un agente con 20,000 tokens de entrada y 3,000 tokens de salida. Opus 5 (y Opus 4.8): entrada 20k × $5/1M = $0.10, salida 3k × $25/1M = $0.075, es decir, alrededor de $0.175 por llamada. Fable 5 a $10 / $50: $0.20 de entrada + $0.15 de salida = aproximadamente $0.35 — casi el doble. En 100,000 llamadas de este tipo al mes, eso es alrededor de $17,500 en Opus 5 frente a unos $35,000 en Fable 5. Dado que el Intelligence Index ahora sitúa a Opus 5 por delante de Fable 5, esto no es "casi Fable 5 por menos" — es calidad de clase líder por aproximadamente la mitad de la factura mensual.
El dial de esfuerzo cambia las matemáticas nuevamente. Un pipeline de soporte de alto volumen puede manejar la mayoría de las llamadas con esfuerzo bajo o medio — más barato que los números anteriores — y reservar el esfuerzo máximo para el puñado de tickets realmente difíciles. El marco de Anthropic es que incluso las configuraciones económicas superan a las mejores de los rivales, por lo que rara vez pagas por una capacidad que no usas. Modela tu propia combinación de niveles de esfuerzo en lugar de asumir que cada llamada se ejecuta al máximo.
Cómo acceder y usar Claude Opus 5
Opus 5 está disponible de inmediato en cinco lugares: Claude.ai (donde es la opción predeterminada en el plan Max y la más potente en Pro), la API de Claude (ID del modelo en la documentación de Anthropic), Claude Code (para codificación en terminal e IDE) y Claude Cowork (para trabajo colaborativo con agentes de múltiples pasos). Los usuarios de la API establecen el nivel de esfuerzo como un parámetro, por lo que la compensación entre costo y capacidad es programable por solicitud. Si ya usas Opus 4.8, el cambio consiste en modificar el ID del modelo al mismo precio: la actualización de menor fricción que Anthropic ha lanzado en un tiempo.
Para quién es: tres escenarios
1. Pipelines agentivos y de uso de computadora
Si tu producto ejecuta agentes de varios pasos o maneja un navegador o escritorio, los resultados de AutomationBench y OSWorld 2.0 de Opus 5 están dirigidos directamente a ti — ahora respaldados por un #1 Intelligence Index independiente. Ejecuta la mayoría de los pasos con esfuerzo medio y escala a alto/máximo para los difíciles; prueba con tus propios rastros de agente antes de comprometerte.
2. Equipos de codificación vigilando el presupuesto.
Opus 5 está en Claude Code desde el primer día al precio de Opus 4.8. Con la ventaja del Intelligence Index, es un codificador predeterminado sólido; la única cita faltante es un número independiente de SWE-bench Verified (Fable 5 aún posee eso con un 95.0%). Para los equipos que ya están en Claude, la actualización es de bajo riesgo y sin aumento de precio.
3. Empresas que se estandarizan en un modelo
Amplia disponibilidad, contexto de clase 1M, el perfil de alineación Opus más seguro y un dial de esfuerzo que cubre tanto trabajo masivo barato como razonamiento difícil hacen de Opus 5 un único predeterminado plausible para trabajo mixto de oficina e ingeniería, a un costo que es mucho más fácil de defender que un buque insignia de frontera.

Seguridad y alineación
Anthropic posiciona a Opus 5 como su lanzamiento más seguro de Opus: "el modelo Opus más alineado" y "el menos susceptible de ser engañado para su mal uso". Una consecuencia práctica es importante para implementaciones reales: Anthropic espera que los clasificadores cibernéticos de Opus 5 intervengan aproximadamente un 85% menos que los de Fable 5. En términos simples, eso debería significar menos rechazos falsos en trabajos legítimos de seguridad, programación o investigación — una frustración común con modelos fronterizos fuertemente protegidos — mientras se bloquea el mal uso genuino. Como siempre, valida según tu propio contenido y requisitos de cumplimiento en lugar de aceptar la postura por fe.
La historia de control de exportaciones de Fable 5 ahora está en el mensaje del sistema.
El lanzamiento de Fable 5 fue cualquier cosa menos fluido, y ese contexto importa para cualquiera que compare Claude Opus 5 contra él. Tres días después de que Claude Fable 5 y Claude Mythos 5 se lanzaron el 9 de junio de 2026, Anthropic suspendió ambos modelos para cumplir con una orden de control de exportaciones del Departamento de Comercio de EE.UU.; los controles se levantaron el 30 de junio y el acceso se restableció el 1 de julio. Esa secuencia es historia documentada — Simon Willison vio cómo la API de Anthropic comenzaba a devolver errores en tiempo real, y Anthropic publicó su propia declaración sobre la suspensión y el restablecimiento.
Lo nuevo es cómo Opus 5 maneja las preguntas al respecto. La fecha de corte del entrenamiento del modelo es mayo de 2026, por lo que la suspensión y su revocación quedan fuera de lo que aprendió. El prompt del sistema de Claude Opus 5, de aproximadamente 200.000 caracteres, que el red-teamer Pliny the Liberator publicó el 25 de julio —un documento que Anthropic no ha confirmado que coincida con el de producción— registra la cronología completa e instruye al modelo a responder con franqueza las preguntas sobre la suspensión en lugar de negarla, remitiendo a los usuarios a la declaración oficial de Anthropic cuando no pueda confirmar el estado actual. Es un ejemplo concreto de un proveedor que incorpora la historia posterior a la fecha de corte en el prompt para que el modelo no improvise sobre su propia familia.
Cuándo no usarlo
No recurras a Opus 5 cuando necesites específicamente una cifra de codificación verificada por SWE-bench auditada de forma independiente para citar hoy — esa cifra aún no se ha publicado, y Fable 5 (95.0%) todavía la tiene. No asumas que cada configuración de esfuerzo es la #1; la configuración máxima que encabeza la tabla de clasificación es 61, y las configuraciones más bajas intercambian algo de calidad por costo, por lo que debes evaluar el nivel de esfuerzo que realmente ejecutarás. Y para texto de alto volumen puro, sensible a la latencia y sin necesidad de razonamiento, un modelo de nivel de eficiencia más barato (por ejemplo Gemini 3.6 Flash a $1.50 / $7.50) seguirá siendo más barato por token — Opus 5 es un modelo de razonamiento y agente, no uno de texto masivo.
Preguntas frecuentes
¿Cuánto cuesta Claude Opus 5?
$5 por cada 1M de tokens de entrada y $25 por cada 1M de tokens de salida — lo mismo que Opus 4.8, y la mitad de los $10 / $50 de Fable 5. [Anthropic]
¿Es Opus 5 realmente el modelo #1?
En el Índice de Inteligencia de Artificial Analysis, sí, al momento de escribir esto: Claude Opus 5 (máximo esfuerzo) lidera con 61 de 170 modelos, por delante de Fable 5 (60). Esa es una puntuación independiente, no una afirmación del proveedor. Otras tablas de clasificación y su propia carga de trabajo pueden clasificar de manera diferente, y las clasificaciones cambian a medida que se agregan modelos.
¿Qué es el dial de esfuerzo?
Una configuración por solicitud (low/medium/high/max) que intercambia tokens — y por lo tanto costo y latencia — por capacidad. Max encabeza la tabla de clasificación; configuraciones más baratas aún superan a la mayoría de los rivales según Anthropic. Los usuarios de API lo establecen como un parámetro.
¿Es Opus 5 mejor que Fable 5?
En el Intelligence Index independiente (61 vs 60) y el Frontier-Bench v0.1 de Anthropic (43.3% vs 33.7%), sí — a la mitad del precio. Fable 5 aún lidera el SWE-bench Verified medido independientemente (95.0%), por lo que para citas de precisión pura en codificación, Fable 5 mantiene esa corona específica.
¿Cómo se compara Opus 5 con Opus 4.8?
Mismo precio de $5/$25, referencias de proveedor materialmente más altas (Frontier-Bench v0.1 43.3 % frente a 18.7 %) y mejoras en todas las evaluaciones de ciencias de la vida rastreadas, además del nuevo dial de esfuerzo y una alineación más segura. Para los usuarios existentes de 4.8, es una actualización sin aumento de precio.
¿Qué tan seguro es?
Anthropic lo llama el modelo Opus más alineado y el menos susceptible al mal uso, y espera que sus clasificadores cibernéticos intervengan aproximadamente un 85% menos a menudo que los de Fable 5 — típicamente menos rechazos falsos en trabajos legítimos.
¿Dónde puedo usar Claude Opus 5?
Claude.ai (predeterminado en Max, más potente en Pro), la Claude API, Claude Code y Claude Cowork — disponible desde el 24 de julio de 2026.
¿Cuál es la ventana de contexto?
Clase de 1M de tokens de la familia Opus (Opus 4.8 es 1M sin recargo por contexto largo). Anthropic no ha desglosado por separado una cifra de Opus 5, así que trátelo como clase 1M hasta que se confirme.
¿Admite imágenes o video?
Opus 5 es principalmente un modelo de razonamiento de texto y herramientas. Para la comprensión multimodal pesada (imagen/video), un modelo como Gemini 3.1 Pro está diseñado específicamente; usa Opus 5 para texto, código y agentes.
En resumen
Claude Opus 5 resultó ser más que un movimiento de precios. Tiene un precio de caballo de batalla: $5/$25, la mitad que Fable 5 y el mismo que Opus 4.8; pero ahora lidera el índice independiente Artificial Analysis Intelligence Index con 61 (esfuerzo máximo), respaldado por fuertes evaluaciones comparativas de proveedores (Frontier-Bench v0.1 43.3%, AutomationBench, OSWorld 2.0), un dial de esfuerzo genuinamente útil y el perfil de alineación más seguro de cualquier Opus. La única salvedad es que aún falta un número independiente de SWE-bench Verified, donde Fable 5 (95.0%) mantiene la cita de precisión en codificación. Para los usuarios actuales de Claude, la actualización es de bajo riesgo y no aumenta la factura; para todos los demás, Opus 5 es ahora el modelo a superar en calidad por dólar: valídelo en su propia carga de trabajo y enrútelo junto con cada competidor a través de un único endpoint compatible con OpenAI en OrcaRouter.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
