Una tarjeta de título generada para Claude Opus 5.5 vs GPT-6 Sol, con el subtítulo «La mitad del precio, hasta que el contexto se alarga», con dos iconos planos de línea (un documento y una nube) y una línea de pie de página que dice «Índice según Artificial Analysis a máximo esfuerzo; precios según los proveedores». El logotipo real de OrcaRouter está compuesto en la esquina inferior derecha.
Guides & Insights

Claude Opus 5.5 vs GPT-6 Sol: la mitad del precio, hasta que el contexto se vuelve largo

Autor

Magnus Corvin

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Ant​hropic y Open​AI lanzaron sus buques insignia competidores la misma tarde. Claude Opus 5.5salió el 22 de septiembre de 2026 a 4 dólares por millón de tokens de entrada y 20 dólares por millón de tokens de salida, un recorte del 20 % en ambas líneas respecto a Claude Opus 5. GPT-6 Solsalió el mismo día a 2 dólares de entrada y 10 de salida, un recorte directo del 50 % respecto a GPT-5.6 Sol, que Open​AI describió como permanente y no promocional. Lee solo esas dos frases y el enfrentamiento parece decidido antes de empezar: el modelo de Open​AI cuesta la mitad, y la mitad de precio es la mitad de precio. Lee el resto de ambas tarifas y la brecha se cierra en gran medida —no porque ninguno de los dos proveedores haya cambiado nada, sino porque ambos modelos aplican un recargo al mismo tipo de solicitud, y eso le cuesta a Sol mucho más de su ventaja de lo que le cuesta a Ant​hropic.

Dos tarjetas de tarifas, ambas con un escalón

Por debajo de 272.000 tokens de entrada, esta es la comparación más sencilla en la frontera actual:

• Entrada — GPT-6 Sol $2.00 por millón vs Claude Opus 5.5 $4.00

• Salida — GPT-6 Sol $10.00 por millón frente a Claude Opus 5.5 $20.00

• Entrada en caché — GPT-6 Sol aproximadamente 90% de descuento en la parte en caché frente a Claude Opus 5.5 $0.20 por millón, un multiplicador del 5% sobre la entrada base

• Contexto y salida — GPT-6 Sol 872K según lo medido por Artificial Analysis, 1M según lo declarado en otros lugares, 128K de salida máxima frente a Claude Opus 5.5 1M y 128K

• Fecha de corte de conocimiento — Claude Opus 5.5 junio 2026 vs GPT-6 Sol no se indica en los mismos términos

Por encima de 272.000 tokens de entrada, la aritmética cambia en ambos lados, y no en la misma cuantía. GPT-6 Sol vuelve a tarificar toda la solicitud —no el exceso, la llamada completa— a aproximadamente el doble de la tarifa de entrada y una vez y media la de salida, situándose cerca de $4.00 de entrada y $15.00 de salida. La tarjeta de tarifas de Claude Opus 5.5 no tiene escalón de contexto largo: Anthropic cobra $4.00 y $20.00 en toda la ventana de 1M tokens y afirma que una solicitud de 900K tokens cuesta lo mismo por token que una de 9K tokens.

Si juntamos todo eso, el orden de precios cambia en un punto inesperado. En una llamada de contexto largo, las tarifas de entrada convergen en torno a $4 en ambos modelos —la ventaja de Sol de mitad de precio en la entrada desaparece por completo—, mientras que la salida se reduce de una diferencia de 2x a unos $15 frente a $20, una ventaja del 25% en lugar del 50%. Sol sigue siendo más barato. Ya no es lo bastante barato como para ser el único número en la decisión, y la razón es que los dos recargos tienen formas distintas: el modelo de Anthropic cobra una tarifa plana que resulta ser más alta, mientras que el de OpenAI aplica un recargo que golpea con más fuerza justo en las cargas de trabajo agénticas, de lectura de repositorios y de conjuntos de documentos para las que ambas compañías venden estos modelos.

A generated graphic titled 'Two rate cards, one step each', with a subtitle reading 'Above 272,000 input tokens the input rates converge and the output gap narrows to about a quarter.' Two panels compare per-million-token input and output rates: below 272,000 input tokens Claude Opus 5.5 is $4.00 / $20.00 against GPT-6 Sol at $2.00 / $10.00, and above 272,000 input tokens Claude Opus 5.5 stays at $4.00 / $20.00 while GPT-6 Sol moves to approximately $4.00 / $15.00 because the whole call reprices. The footer reads 'Per-million-token rates. Sol's step per OpenAI; Opus 5.5 bills its full 1M window at one rate per Anthropic.'

La puntuación independiente, que es la única comparación en las mismas condiciones

A two-column scoreboard comparing Claude Opus 5.5 and GPT-6 Sol across six shared rows: Intelligence Index (58, ranked #1 of 210, against 48, ranked #18), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), output speed (not yet published against 113.3 tokens per second), time to first token (not yet published against 142.74s), knowledge cutoff (Jun 2026 against not stated in the same terms) and long-context step (none against the whole call repriced above 272K). The footer reads 'Index, speed and latency figures per Artificial Analysis at max effort; prices and the 272K step per the vendors.'

Ninguna de las dos tablas de lanzamiento contiene el nuevo modelo de la otra —ambas se escribieron antes de que llegaran los lanzamientos del mismo día—, así que el material del proveedor no puede clasificar a estos dos en absoluto. Artificial Analysis sí puede, porque ejecuta todos los modelos en una única configuración publicada:

• Índice de Inteligencia — Claude Opus 5.5 58, en el puesto #1 de 210 frente a GPT-6 Sol 48, en el puesto #18

• Etiqueta de configuración — ambos puntuados con el máximo esfuerzo; Claude Opus 5.5 etiquetado además como "Default Fallback"

• Velocidad de salida — GPT-6 Sol 113,3 tokens/seg, en el puesto 38 frente a Claude Opus 5.5, que aún no se ha publicado

• Tiempo hasta el primer token — GPT-6 Sol 142,74 s frente a una mediana de la tabla de 3,83 s; Claude Opus 5.5 aún no publicado

• Precio — GPT-6 Sol $2.00 / $10.00 por millón vs Claude Opus 5.5 $4.00 / $20.00

Diez puntos de índice y diecisiete puestos representan la mayor separación en cualquier emparejamiento actual entre Claude y OpenAI, y va en contra del modelo más barato por segunda vez este mes: el mismo patrón apareció cuando GPT-6 Sol se enfrentó a Claude Opus 5 en una comparación anterior y perdió por tres puntos con un costo 60 % menor. La fila de velocidad va en sentido contrario e importa más de lo que parece: 113,3 tokens por segundo es aproximadamente el doble de lo que logra el buque insignia GPT-6 Astra, y es la cifra más rápida de este grupo. Combinado con un primer token de 142 segundos, el perfil es el de un modelo que piensa durante mucho tiempo y luego escribe rápido, lo que encaja mal con cualquier cosa interactiva y resulta razonable para ejecuciones largas sin supervisión.

Ambas cifras conllevan la misma advertencia que las de los proveedores: son mediciones de esfuerzo máximo, y el valor predeterminado de fábrica de ninguno de los dos modelos es el esfuerzo máximo. Claude Opus 5.5 usa por defecto medio en una escala de esfuerzo que va de bajo a máximo; GPT-6 Sol expone una escala que va de ninguno a máximo. Un índice de esfuerzo máximo es una forma justa de comparar techos y una forma engañosa de predecir tu factura.

¿Qué se rompe al cambiar, en ambas direcciones?

La fricción migratoria aquí es asimétrica y vale la pena conocerla antes de cualquiera de los dos movimientos.

Claude Opus 5.5 no es una sustitución directa para Claude Opus 5. El pensamiento ya no se puede desactivar, por lo que el código que establecía una ruta sin pensamiento dará error o cambiará su comportamiento de forma silenciosa. El uso forzado de herramientas devuelve un error. Los bloques de pensamiento están vinculados al modelo y a la conversación que los produjeron, por lo que no se pueden reproducir en otros modelos. La herramienta de uso de computadora más antigua computer_20251124 no se acepta en la API de Claude ni en Google Cloud. Por separado, el texto entre llamadas a herramientas ahora se devuelve dentro de bloques de pensamiento que están vacíos con la configuración de visualización predeterminada, por lo que una aplicación que transmita ese texto como progreso simplemente se quedará en silencio entre llamadas sin lanzar nada.

La escala de esfuerzo de GPT-6 Sol es la más flexible de las dos: puede cambiarse a mitad de conversación sin invalidar la caché de prompts, lo que significa que una primera pasada barata y un reintento costoso sobre el mismo contexto es un patrón admitido en lugar de uno que rompe la caché. Es una ventaja de ingeniería real para cualquiera que ejecute razonamiento por niveles dentro de una sola sesión, y es el argumento más sólido a favor de Sol que no aparece en ninguna tabla de precios.

Ejecutando ambos, y decidiendo con tus propios números

La posición honesta sobre esta comparación es que las tablas de los proveedores no pueden resolverla y el índice independiente solo resuelve el techo. Lo que queda es la cuestión de la carga de trabajo —cuánto duran realmente tus contextos y cuánto cuesta un intento fallido—, y eso es medible en tu propio tráfico en lugar de discutible desde un comunicado de prensa.

Ambos modelos se pueden enrutar desde OrcaRouter al precio de lista del proveedor con un 0 % de margen: GPT-6 Sol a los $2.00 / $10.00 de OpenAI y Claude Opus 5.5 a los $4.00 / $20.00 de Anthropic. Como el traspaso es exacto y los precios cambian el mismo día en que los mueven los proveedores, la proporción que mides en staging es la proporción que pagas en producción, sin ninguna capa de margen que volver a calcular. Una sola clave cubre ambos, así que la regla de enrutamiento que envía las llamadas de menos de 272K a Sol y las llamadas de contexto largo al modelo que gane en tus evaluaciones es un cambio de configuración y no una segunda integración, y la conmutación automática por error significa que un lanzamiento el mismo día en cualquiera de los dos lados es algo a lo que puedes destinar una porción del tráfico en lugar de una apuesta que haces con toda una canalización.

A screenshot of OrcaRouter's own model page for openai/gpt-6-sol, headed 'GPT-6 Sol' and credited to OpenAI, showing a 1M-token context, 128K max output, and a stat strip reading INPUT $2.00 and OUTPUT $10.00 per 1M tokens with a 2.25s p50 time to first token and 4.8M tokens of traffic over 7 days.

La versión de esto que sobrevive al contacto con un proyecto de ley

GPT-6 Sol es el modelo más barato en cada línea, en cada configuración, y eso no está en disputa. Lo que no se sostiene es la suposición de que "mitad de precio" es la cifra con la que hay que planificar: en una llamada de contexto largo, las tarifas de entrada se igualan en aproximadamente $4 y la brecha de salida se reduce a una cuarta parte, lo cual es una decisión distinta de la que describen las páginas de lanzamiento. Sopesa eso frente a una brecha de diez puntos en el índice, diecisiete posiciones y un primer token medido de 142 segundos, y la división se escribe sola para la mayoría de las cargas de trabajo: Sol como el predeterminado de alto volumen en contextos cortos y medianos, Claude Opus 5.5 donde el contexto se alarga o la tarea es lo bastante difícil como para que un reintento cueste más que la diferencia de tokens. El error que vale la pena evitar es elegir uno de estos basándose solo en la tarifa principal, porque es el segundo número en cada tarjeta de tarifas el que decide el caso para el que se crearon ambos modelos.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario