
Odyssey-3 vs Seedance 2.5: segundos de metraje vs horas de simulación
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiNUEVOOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleNUEVOGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenNUEVOQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencia72Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencia69Código
Pregunta cuánto cuesta Seedance 2.5 y obtienes una respuesta en dólares por segundo. Pregunta cuánto cuesta Odyssey-3 y no obtienes absolutamente nada: ni tarifa, ni endpoint, ni licencia, porque el modelo anunciado el 15 de septiembre de 2026 aún no se ha lanzado y su creador solo lo ha prometido públicamente "en las próximas semanas". Esa brecha parece una diferencia de madurez y, en su mayor parte, es una diferencia de categoría. Seedance 2.5, lanzado por el equipo Seed de ByteDance el 31 de julio de 2026, es un motor de producción que se vende por segundo de metraje finalizado a quienes necesitan metraje. Odyssey-3 es un modelo del mundo con una interfaz de acción, y el comprador al que está dirigido no quiere metraje en absoluto: quiere un entorno que responda correctamente cuando algo actúa dentro de él. Ambos se orientan hacia algunos de los mismos problemas, incluidos los datos de robótica y de conducción, que es precisamente por lo que merece la pena trazar la distinción con cuidado.
Seedance 2.5 es un motor de producción, y los socios de lanzamiento lo demuestran
La capacidad estrella es la duración. Seedance 2.5 genera treinta segundos en una sola pasada, el doble de los quince de su predecesor, con extensión de varias rondas para secuencias más largas y un modo beta ultralargo que, según se informa, llega aún más lejos. Eso por sí solo cambia para qué sirve el modelo: treinta segundos son una escena, no un plano, y el marketing de ByteDance se apoya en la frase «toma única» precisamente por esa razón.
Alrededor de la duración se encuentran las funciones que hacen que una generación sea utilizable en una edición real. El modelo acepta referencias multimodales intensivas —según los informes, admite hasta treinta imágenes, diez clips de vídeo y diez clips de audio por generación, con vídeo y audio de referencia limitados a unos treinta segundos cada uno, y las referencias solo de audio son nuevas en esta versión. Hay nuevos modos de referencia para renders de modelo blanco o arcilla, placas de pantalla verde, referencias de movimiento y creativas. El control es a nivel de marca de tiempo, lo que permite que un prompt se dirija a la narrativa, la cámara o el movimiento dentro de un rango de tiempo específico, y la edición a nivel de región después de la generación preserva la continuidad en lugar de forzar una regeneración. El audio y el vídeo se generan conjuntamente en una sola pasada, por lo que la sincronización labial sigue el diálogo entrecomillado, y se admiten más de diez idiomas de forma nativa.
La lista de adopción es la pista. El día del lanzamiento, XCMG, XPeng, Lingchu Intelligence, Weifen Zhifei y Qiongche Intelligence confirmaron alianzas, y los casos de uso declarados van desde datos de entrenamiento de IA encarnada y casos límite de conducción autónoma hasta vídeos de entrenamiento de SOP industriales, educación y publicidad de comercio electrónico. Parte de eso es trabajo creativo. Parte es generación de datos para sistemas que después actuarán sobre el mundo — que es la parte que se solapa con Odyssey-3.
¿Cuánto cuesta un segundo de Seedance 2.5?
El precio es público y se mide en tokens en lugar de segundos, lo que genera un paso de conversión que vale la pena hacer antes de comprometerse. Las cifras reportadas para el endpoint de ModelArk son $10.70 por millón de tokens sin entrada de video y $6.40 por millón de tokens cuando se incluye entrada de video. En la práctica, eso equivale a aproximadamente $0.51 por un clip de cinco segundos en 16:9 a 480p y alrededor de $1.16 por el mismo clip a 720p. Esas son las tarifas publicadas del proveedor tal como se reportaron en el lanzamiento; considérelas como la lista actual y no como un costo medido por entregable, porque tanto la resolución como la duración influyen en su escala.
La disponibilidad tiene límites reales. El acceso para consumidores pasa por las propias aplicaciones de ByteDance, mientras que el acceso por API se divide entre Volcano Engine Ark en China y BytePlus ModelArk a nivel internacional. Al menos un distribuidor afirma que el modelo no está disponible en Estados Unidos, y las fuentes no coinciden en si las resoluciones compatibles llegan como máximo a 720p o se extienden hasta 1080p; una discrepancia que conviene resolver consultando la documentación del propio proveedor antes de diseñar en torno a una resolución.
Este es el tipo de modelo en el que una capa de enrutamiento se gana su lugar por una razón específica: las tarifas cambian. Un precio de video por token que cambió una vez en el lanzamiento volverá a cambiar, y la diferencia entre un modelo de costos basado en el número de hoy y uno basado en el del trimestre pasado es la diferencia entre un margen y una sorpresa. OrcaRouter transmite el precio de lista del proveedor con un 0 % de margen, por lo que un recorte de proveedor está activo en nuestro lado el mismo día en lugar de en la próxima renovación de contrato, y la conmutación por error automática mantiene en movimiento una cola de generación cuando un endpoint de proveedor se degrada — una preocupación de programación más que teórica en cargas de trabajo de video. Seedance 2.5 en sí no es enrutado por OrcaRouter; se sirve a través de las propias plataformas de ByteDance y sus endpoints de ModelArk.

Odyssey-3 no se vende por segundos
Odyssey-3 aún no tiene una unidad de venta, que es precisamente el punto. Se describe como un modelo fundacional del mundo capaz de impulsar robots, conducir automóviles, entrenar IAs, pilotar drones y jugar videojuegos — un transformador de difusión autorregresivo entrenado con una gran colección de observaciones visuales que, según su creador, da lugar a una comprensión aprendida de la física, la dinámica, la relación causa-efecto y el comportamiento humano. La adaptación a una nueva tarea se realiza entrenando un decodificador de acciones con pares de observación-acción y manteniendo congelado el modelo del mundo preentrenado, de modo que una política pequeña lee la representación congelada y emite comandos motores.
Las demostraciones, todas reportadas por el proveedor y ninguna reproducida de forma independiente, abarcan seis encarnaciones: brazos robóticos a partir de decenas de horas de demostraciones, incluidas conductas de recuperación que no estaban en los datos; políticas humanoides construidas con Flexion a partir de decenas de horas de teleoperación, que, según Odyssey, generalizan mejor que las líneas base VLA contra las que se probaron, sin publicar una cifra; conducción en circuito cerrado en India a partir de veinte horas de datos simulados; vuelo de drones en interiores a partir de datos simulados; políticas de Grand Theft Auto V que se transfirieron a Red Dead Redemption 2 y Sleeping Dogs sin entrenamiento adicional, con aproximadamente dos horas de metraje de GTA que produjeron movimiento a caballo en RDR2; y generación de entornos para entrenar otras IA mediante el trabajo de PROWL.
El único dato duro es el 77 %: las políticas de conducción entrenadas con simulación recorrieron aproximadamente esa fracción de distancia entre intervenciones del conductor de seguridad en comparación con las políticas entrenadas con imágenes reales. Es una cifra de un proveedor sin ningún informe técnico ni verificación externa que la respalde.

La unidad de venta decide qué se optimiza.
Una vez que ves los dos modelos como medidores en lugar de como capacidades, sus diferencias dejan de parecer que uno está por delante del otro.
Un modelo que se factura por segundo de salida está optimizado para una salida que satisfaga a un espectador. Eso no es una ambición menor; es un objetivo distinto con sus propios problemas difíciles. Que Seedance 2.5 produzca treinta segundos coherentes con diálogo sincronizado y control a nivel de marca temporal es un resultado genuinamente difícil, y los modos de fallo por los que se lo juzga —que la cara de un personaje se desvíe, que un corte no acierte, que una línea de diálogo esté desincronizada— son los que notaría una persona en una sala de edición.
Un modelo al que se le pide predecir qué sucede a continuación cuando un controlador actúa se optimiza para algo que un espectador nunca comprobará: si la dinámica se sostiene bajo una secuencia de decisiones, incluidas decisiones que nadie demostró. Por eso Odyssey reporta un comportamiento de recuperación que emerge de decenas de horas de datos en lugar de reportar fidelidad, y por eso su única afirmación cuantitativa se mide en intervenciones del conductor de seguridad en vez de en calidad visual. Un renderizador puede equivocarse de formas que el público perdona. Un simulador puede equivocarse de formas sobre las que un controlador actúa, y el segundo tipo de error se acumula a lo largo de un rollout.
La superposición en los casos de uso declarados —datos de entrenamiento para robots, casos límite de conducción autónoma— es donde estos dos se encuentran, y se trata de una verdadera competencia por presupuesto, más que por posición en los benchmarks. La pregunta a la que realmente se enfrenta un equipo de robótica es si comprar segundos renderizados de un mundo plausible o comprar un modelo de dinámica con una interfaz de acciones, y la respuesta depende de si el consumidor final es un revisor humano o un bucle de entrenamiento.
Lado a lado
• Unidad de venta — Seedance 2.5: tokens, que equivalen a aproximadamente $0,51 por clip de 5 s en 480p y $1,16 en 720p. Odyssey-3: ninguno publicado.
• Qué obtienes por unidad — Seedance 2.5: metraje terminado, de hasta 30 s en una sola pasada, con audio y diálogo sincronizados. Odyssey-3: una predicción del siguiente estado del mundo más acciones de motor para el hardware conectado.
• Entradas — Seedance 2.5: texto más hasta ~30 imágenes, 10 vídeos y 10 clips de audio. Odyssey-3: un decodificador de acciones entrenado con pares observación-acción, sobre un backbone congelado.
• Control de edición — Seedance 2.5: segmentación a nivel de marca temporal y ediciones posteriores a la generación a nivel de región. Odyssey-3: no aplicable; no existe una superficie de edición.
• Socios declarados — Seedance 2.5: XCMG, XPeng y otros tres en el lanzamiento. Odyssey-3: Flexion en políticas sobre humanoides; no se anunciaron clientes comerciales.
• Disponibilidad — Seedance 2.5: disponible desde el 31 de julio de 2026, sujeto a límites regionales. Odyssey-3: anunciado el 15 de septiembre de 2026, lanzamiento público «en las próximas semanas», sin fecha ni precio.
¿Cuál pertenece a tu stack?
Si el entregable es un video que una persona va a ver, Seedance 2.5 es un producto ya disponible con un precio publicado y un amplio conjunto de funciones, y la decisión es la típica de construir frente a comprar — con dos advertencias que vale la pena comprobar primero: si las resoluciones que necesitas están realmente disponibles en el endpoint al que puedes acceder, y si tu región recibe servicio en absoluto. Su mayor duración de una sola pasada y el control de marcas de tiempo son las características que más cambian el flujo de trabajo, porque eliminan pasos de unión en lugar de mejorar un fotograma.
Si el entregable es una política entrenada o un controlador, Seedance 2.5 no es un sustituto, por muy bueno que parezca el metraje, y Odyssey-3 apunta a tu problema sin nada que comprar. La afirmación que merece seguimiento es la columna vertebral congelada: un único modelo preentrenado que llega a brazos, humanoides, un coche, un dron y tres juegos mediante un decodificador pequeño es una declaración sobre cuánta comprensión física se transfiere entre encarnaciones y, si se sostiene, cambia lo que un equipo de robótica tiene que recopilar. Nadie fuera de Odyssey lo ha probado, y no hay informe técnico, ni licencia, ni precio.
Lo que hay que observar no tiene nada de glamuroso: para Seedance 2.5, un precio estabilizado y una declaración clara de disponibilidad regional; para Odyssey-3, un repositorio, una licencia y un tercero que reproduzca el 77%. Hasta que exista la segunda lista, la diferencia entre estos dos modelos no es la calidad. Es que uno de ellos es un producto, y el otro es un argumento.

OrcaRouter mantiene más de 200 modelos detrás de una única clave de API, así que el modelo de vídeo que elijas no es el único que puedes invocar.
