
Las demos de Claude Opus 5.5 cuestan de 3 a 26 dólares: cómo interpretar los primeros días de las builds
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 495 tok/s
- openaiNUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- openaiNUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- anthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- grokNUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 186 tok/s
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
Dos cifras de la primera semana de Claude Opus 5.5 el mismo modelo y discrepan por un orden de magnitud. Un desarrollador informa de un laboratorio de lentes interactivo — una página donde arrastras un anillo de enfoque y ves un plano de enfoque barrer un valle — a $25.66 en gasto de API y una hora 26 minutos de tiempo real. Un recopilatorio muy compartido de demos de lanzamiento valora una animación de castillo de Blender construida proceduralmente, completa con fuegos artificiales y un reflejo de lago, en $13.30 y 35 minutos. Un hilo que llegó a la portada de r/ClaudeAI dice $3.21. El proveedor lanzó Claude Opus 5.5 el 22 de septiembre de 2026 a $4 por millón de tokens de entrada y $20 por millón de salida, y ninguna de esas tres cifras es incorrecta. Están midiendo cosas diferentes, y si vas a presupuestar en función de ellas necesitas saber cuál.
La brecha no es ruido. Es la diferencia entre lo que una ejecución de agente produce y lo que consume, y los últimos cuatro días han producido una cantidad notable de esto último con muy poca rendición de cuentas al respecto. Así que aquí está la aritmética que nadie publicó junto a las demos, luego la parte del lanzamiento que realmente está en una lista de tarifas y se puede comprobar.
Lo que realmente se compró con $25.66
El extremo caro de la gama es el extremo más útil, porque el constructor publicó tanto el artefacto como la factura.
El laboratorio de lentes de Ryan Sael, titulado "El plano de enfoque", es una única página interactiva creada a partir de un solo prompt en una sola sesión. Pone una lente de cámara en pantalla, te permite arrastrar el anillo de enfoque y te muestra eso que todos los fotógrafos conocen pero casi nadie ha visto: la fina lámina en el mundo donde una foto realmente se vuelve nítida. Gira el anillo y la lámina se mueve, los elementos de cristal se deslizan hacia adelante o hacia atrás dentro del barril para mostrar por qué, y una consola informa la distancia, la apertura y la zona nítida — 60 cm, f/2, 1.9 cm de profundidad, con la configuración con la que se abre la página. Cierra la apertura de f/2 a f/16 y la zona nítida se ensancha a medida que el cono de luz se estrecha. Una vista explosionada separa el cristal. No hay ningún modelo de imagen en ninguna parte del proceso, ni recursos descargados: cada elemento se dibuja y anima en código, y por eso toda la demostración del círculo de confusión es una simulación en vivo en lugar de un diagrama.
Esa es una explicación genuinamente buena, y la afirmación que lleva adjunta es inusualmente precisa: un solo intento, 1 hora 26 minutos, $25.66 de uso de API, con la página activa en lens.lab.sael.net cuando la leí. La cifra es autodeclarada y no auditable, pero también es el único coste de demo en circulación que viene con una duración de sesión para dividir.
Hagamos las cuentas con la lista de precios. Con los precios publicados de Claude Opus 5.5, $4 por millón de tokens de entrada y $20 por millón de tokens de salida, $25.66 equivalen a entre 1,28 millones y 6,4 millones de tokens según la proporción: el extremo superior si la ejecución hubiera sido solo entrada, el extremo inferior si hubiera sido solo salida. Una ejecución agéntica como esta se sitúa en algún punto intermedio, y la razón por la que se acerca más al extremo bajo es el concepto que la mayoría pasa por alto: las lecturas de caché en Claude Opus 5.5 cuestan $0,20 por millón, una cuadragésima parte de la tarifa de entrada, así que una sesión larga que no deja de releer el mismo código en crecimiento apenas paga nada por ese tráfico. Diez millones de tokens de entrada en caché cuestan $2. El lado de la salida es donde se acumula una hora y media de un modelo escribiendo código, pensando y reescribiéndolo: a $20 por millón, un millón de tokens de salida son $20, y los tokens de pensamiento se facturan como salida. La cifra de Sael es coherente con una ejecución que produjo del orden de un millón de tokens de salida frente a un lado de entrada grande, barato y en caché, que es exactamente el aspecto que tiene una ejecución desatendida de 86 minutos.
De esto se desprenden dos cosas. Primero, la rebaja del precio de etiqueta que acaparó la atención el día del lanzamiento, de $5/$25 a $4/$20, es un cambio del 20 % por token y, por sí sola, no habría abaratado esta ejecución; la rebaja en la lectura de caché de $0,50 a $0,20 es la línea que hizo asequible un bucle de 90 minutos. Segundo, y menos cómodo: nada en el informe de $25,66 te dice si la ejecución salió bien. Una ejecución única bien hecha y una sesión que estuvo batallando durante hora y media y luego tuvo éxito producen lo mismo.
La cifra de $13.30 no resiste su propia aritmética
El punto medio del rango es instructivo por una razón diferente. Un recopilatorio de demos de lanzamiento publicado el 23 de septiembre informa de un enfrentamiento directo en el que se pidió a Claude Opus 5.5 que construyera de forma procedimental una animación de diez segundos en Blender a partir de un único prompt —castillo, reflejo en el lago, fuegos artificiales— frente a GPT-6 Astra, sin edición manual, e informa de 35 minutos y 199.600 tokens de salida por unos 13,30 USD, frente a 28 minutos y unos 14,50 USD para GPT-6 Astra. El recuento de tokens es la parte interesante, porque no cuadra con el precio.
199.600 tokens de salida a los $20 por millón de Claude Opus 5.5 son $3.99, no $13.30. Para llegar a $13.30 solo en salida necesitarías 665.000 tokens. El dinero que falta está en las otras columnas: la entrada a $4 por millón, las escrituras de caché a $5 por millón para un punto de interrupción de cinco minutos y a $8 por millón para una hora, y cualquier reintento. Eso no es una contradicción en el informe: es el informe siendo honesto sobre un recuento de tokens que cuenta una cosa y una factura que cuenta cuatro, que es la confusión más común en las conversaciones sobre costos durante la semana de lanzamiento. Si vas a tomar un solo número de una demo publicada, toma la cifra en dólares y trata cualquier recuento de tokens que la acompañe como una descripción parcial de la ejecución.
En el extremo más barato, la contabilidad se vuelve aún más escueta. El hilo de r/ClaudeAI que reporta $3.21 de uso de la API para una compilación terminada es típico del género: un título, un video y ningún desglose. Es plausible que se trate de una sesión más corta, un artefacto más pequeño o una gran cantidad de entrada en caché. No es algo con lo que planificar un presupuesto, y no pude verificar ni un dólar de ello.
Por qué cada uno de estos números es una cota inferior
El modo de fallo aquí no es que quienes construyen disimulen. Es la selección. Las demos que circulan son las que funcionaron, publicadas por las personas para las que funcionaron, y los cuatro intentos que produjeron una página rota costaron lo mismo que el que no la produjo. El recopilatorio que compiló la comparación de Blender lo dice sin rodeos —que nadie publica los fracasos—, y su propia entrada más detallada es un caso representativo: un sitio de una marca de relojes que no cumplió con el brief y usó una tipografía ilegible en la primera pasada y necesitó una segunda para convertirse en la versión que se mostró.
«One shot» también hace un trabajo silencioso en ese vocabulario. Describe una sola sesión, no un solo intento, y se permite que una sesión contenga tanta autocorrección como el modelo pueda generar —lo que, en una ejecución de 86 minutos, es mucha. Que el modelo reescriba su propio código dos veces dentro de una misma ventana de contexto es un «one shot» y dos intentos.
Así que la lectura honesta de los primeros cuatro días es de tres niveles de evidencia, y no se deben promediar:
• Costo autoinformado con una duración de sesión — útil para el orden de magnitud, no verificable. Los $25.66 de Sael en 1h26m son el dato más sólido de este nivel.
• Costo autoinformado con un recuento de tokens — inconsistente a nivel interno más veces que no, como muestra la cifra de $13.30.
• Una cifra en dólares sin nada que la respalde — una señal de que alguien construyó algo, y nada más que eso.
La parte del lanzamiento que está en una rate card
Si se dejan de lado las afirmaciones de la demostración, el panorama verificable es acotado y claro. Todas las cifras a continuación son las tarifas publicadas por Anthropic, extraídas de la documentación de modelos y el anuncio de la propia empresa del 25 de septiembre de 2026:
• Entrada — $4 por millón de tokens. Salida — $20 por millón, con los tokens de pensamiento facturados como salida, y el pensamiento adaptativo de Claude Opus 5.5 siempre activado e imposible de desactivar.
• Lecturas de caché — $0.20 por millón, un multiplicador de 0.05x. Escrituras de caché — $5 por millón en el punto de corte de cinco minutos, $8 por millón en una hora. Batch API — 50 % de descuento en ambos sentidos, $2 y $10.
• Modo rápido — $8 de entrada y $40 de salida por millón, hasta 2.5 veces la velocidad, y Anthropic todavía lo etiqueta como una vista previa de investigación.
• Envelope — contexto de 1M de tokens, 128K tokens de salida de forma síncrona y 300K en la Batch API con un encabezado beta, corte de conocimiento confiable de junio de 2026, esfuerzo predeterminado medio en lugar del alto que Claude Opus 5 usaba de forma predeterminada.
• Disponibilidad — la Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS, con un retiro comprometido no antes del 22 de septiembre de 2027.
Las afirmaciones de rendimiento del propio proveedor, etiquetadas como afirmaciones: Claude Opus 5.5 rinde al nivel de Claude Fable 5.1 en la mayoría del trabajo, cuesta alrededor de un 40 % menos ejecutarlo que Claude Opus 5, y genera resultados más de un 30 % más rápido. El 40 % es un promedio de carga de trabajo seleccionado por el proveedor, no una cifra de tarifa, y no deberían citarse los dos como si fueran el mismo tipo de hecho.
La comprobación independiente es más pequeña que la tabla del proveedor y apunta en la misma dirección con menos margen. Artificial Analysis otorga a Claude Opus 5.5 una puntuación de 57,6 en su Índice de Inteligencia, junto con 61,4 en Humanity's Last Exam, 66,9 en SciCode y 84,7 en recuperación de contexto largo en las cifras que recoge su página del modelo. En la medición de agentes de codificación de la misma publicación, que informa del coste por tarea en lugar del coste por token, la cifra se mueve en sentido contrario: con el esfuerzo máximo, el coste por tarea sube a unos 13,04 $, frente a 10,79 $ de Claude Opus 5 en el mismo entorno de evaluación. Un token más barato, del que el modelo consume más, no es una tarea más barata. Es la misma lección que enseñan las facturas de la demo, y llega desde un tercero.
Qué hacer de forma diferente en la segunda semana
Si el número de $25.66 es el que te hizo querer probar esto, lo útil no es presupuestar $25.66, sino hacer que tu propia ejecución produzca un número que puedas explicar.
Establece el esfuerzo de forma explícita en lugar de aceptar el valor predeterminado, porque es el control que mueve los tokens por tarea más de lo que lo hace la elección del modelo, y el valor predeterminado en este modelo cambió con respecto a Claude Opus 5. Almacena en caché el prefijo estable de forma deliberada: el prompt mínimo que se puede almacenar en caché en Claude Opus 5.5 es de 512 tokens, frente a los 1.024 anteriores, así que los prefijos compartidos cortos que antes nunca se almacenaban en caché ahora sí lo hacen. Deja margen en max_tokens para cualquier trabajo de larga duración, ya que el pensamiento forma parte de ese presupuesto y ya no se puede desactivar; la propia guía de migración de Anthropic sugiere empezar con 64K para trabajos en los niveles de esfuerzo más altos y ajustar a partir de ahí. E instrumenta la ejecución al final, no al principio: lee el campo model de nivel superior en cada respuesta, porque en los prompts que sus clasificadores señalan, Anthropic redirige la solicitud dentro de la misma llamada, y la cadena de modelo que enviaste no describe lo que respondió.
Ese último punto es donde un router deja de ser una comodidad. Una build que se ejecuta sin supervisión durante una hora y media a través de un límite de salvaguarda puede volver habiendo terminado silenciosamente algunos turnos en un modelo más pequeño, y la única forma de descubrirlo es mirar. Claude Opus 5.5 está en OrcaRouter al precio de lista de la propia Anthropic con un 0 % de margen — la tarifa del proveedor se transfiere directamente, así que un cambio de precio del proveedor está activo aquí el mismo día en que se publica —, que es lo menos interesante que hace el enrutamiento aquí. Lo interesante es que una API para más de 200 modelos pone todo el experimento en una sola clave, de modo que «ejecútalo en el modelo de frontera y recurre a otro antes que fallar» es una línea de configuración en lugar de un segundo contrato y una reescritura. La conmutación por error automática es lo que hace que sea seguro poner un modelo desconocido en una ruta que te importa, y un rechazo que puedes esquivar redirigiendo es un rechazo que no pone fin a tu ejecución en el minuto 70.
El número que se moverá a continuación
Anthropic ha dicho que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán "en las próximas semanas", y eso cambiará el precio de todos estos demos sin cambiar su forma: una tarifa por token más barata frente a un recuento de tokens que nadie puede predecir de antemano. La misma incertidumbre que hizo que los números de la primera semana fueran inservibles se aplicará a los de la próxima generación, y esa es la razón para crear el hábito ahora en lugar de después de que vuelva a llegar el recorte de precios.
Por el momento, el resumen honesto es breve. Claude Opus 5.5 es real, está disponible de forma general y tiene un precio de $4 y $20, con las lecturas en caché más baratas que la línea haya tenido jamás. Las demos que produjo en sus primeros cuatro días son notables, y sus etiquetas de precio son anécdotas. Si quieres un costo para tu propia carga de trabajo, el único instrumento que lo mide es tu propia ejecución, con límite, y la factura leída después.



Comparados en este artículo2
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
