Carton-titre pour Odyssey-3 vs ByteDance Seedance 2, avec un panneau de gauche intitulé Odyssey-3 indiquant « un monde où vous vivez », 832x480 ou 1280x720 Pro, Physics-IQ +9,99 pp rang 03 ; et un panneau de droite intitulé ByteDance Seedance 2 indiquant GA depuis le 12 février 2026, plateforme à facturation à l’usage, un clip fini jusqu’à 15 s, résolution non publiée, Physics-IQ non soumis.
Guides & Insights

Odyssey-3 vs ByteDance Seedance 2 : un environnement dans lequel on agit, face à un clip que l’on regarde

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Mettez Odyssey-3 et ByteDance Seedance 2 côte à côte et la première chose que l'on remarque, c'est qu'ils ne répondent pas à la même demande. Odyssey-3, publié par Odyssey le 8 octobre 2026, génère un environnement à partir d'une invite, puis continue de le prédire en temps réel pendant que vous vous y déplacez ou déclenchez un événement : c'est un simulateur avec une caméra que vous pilotez. ByteDance Seedance 2 est un générateur de clips avec un fauteuil de réalisateur : des références textuelles, visuelles, audio et vidéo en entrée, une vidéo finie en sortie, jusqu'à quinze secondes, générée en une seule passe et livrée comme un objet figé. L'un possède une entrée de contrôle ; l'autre possède une timeline. La comparaison vaut quand même la peine d'être faite, parce que les deux convergent vers le même acheteur, et parce qu'ils font des paris opposés sur l'endroit où réside la valeur d'un modèle de vidéo générative.

Il n'existe qu'un seul tableau de scores commun, et il est plus mince qu'il n'y paraît. Seedance 2 lui-même n'apparaît pas dans Physics-IQ Verified, le tableau d'Anates Labs et DeepMind qui évalue la capacité d'un modèle à prédire de véritables expériences physiques. Seedance 2.5, le successeur du 31 juillet 2026, y figure. Ainsi, le seul chiffre d'un tiers qui place quoi que ce soit de cette famille à côté d'Odyssey-3 est une comparaison entre deux générations de modèles d'un côté, ce qu'il vaut la peine de préciser avant que quiconque ne la cite comme une confrontation à armes égales.

Les deux mécanismes

Odyssey-3 est un transformer de diffusion autorégressif. La description d'Odyssey elle-même : un modèle de diffusion vidéo multi-étapes étendu de manière autorégressive avec teacher forcing et masquage causal, de sorte qu'il poursuit à partir d'observations précédentes et prédit des états futurs conditionnés par des entrées d'action, puis une passe de post-entraînement d'appariement de distributions et de distillation adversariale produit une variante en quelques étapes, assez rapide pour interagir avec. La sortie n'est pas une scène qui se déroule ; c'est une scène qui répond. L'aperçu donne accès à une navigation à la première personne, une navigation à la troisième personne et un mouvement de caméra indépendant — trois manières différentes d'appuyer sur la même prédiction et de voir ce qu'elle fait.

B​yteDance Seedance 2 est un modèle multimodal unifié de génération conjointe audio-vidéo. Il accepte du texte, des images, de l’audio et de la vidéo comme références et génère le clip en une seule passe, jusqu’à quinze secondes, avec l’audio généré conjointement plutôt que doublé après coup. La page de B​yteDance décrit des références d’images, d’audio et de vidéo donnant le contrôle sur le jeu, l’éclairage, les ombres et les mouvements de caméra, ce qui relève du langage de la production plutôt que de la simulation : vous spécifiez un plan, vous ne pilotez pas un monde. Sorti le 12 février 2026, il est devenu viral en quelques jours avec des clips d’acteurs réels et de films existants — et c’est aussi ce qui a déclenché la tempête de droits d’auteur, avec des lettres de mise en demeure de Disney et Netflix, des condamnations de la Motion Picture Association et de la SAG-AFTRA, et une lettre de mars 2026 de deux sénateurs américains demandant à B​yteDance de le fermer. B​yteDance a déclaré en février 2026 qu’elle renforçait ses garde-fous. Cette histoire fait partie des spécifications du modèle si vous commercialisez quoi que ce soit.

Dimension par dimension

ByteDance's BytePlus ModelArk developer documentation in English, showing the Ark SDK quick-start with a Python client using model seed-2-0-lite-260228 against base_url https://ark.ap-southeast.bytepluses.com/api/v3, a sidebar covering Models, video generation, image generation and the Model list, and three endpoint cards for Dola Seed 2.0, Dreamina Seedance 2.5 (described as the mainline video generation model with 30s extended storytelling, multimodal references and improved generation quality) and Dola Seedream 5.0.

• Ce qu’il produit — un environnement interactif dans lequel vous agissez, face à un clip fixe de quinze secondes maximum. Tout ce qui se situe en aval de cette ligne change.

• Surface de contrôle — navigation en direct et événements en cours de génération, par rapport à une invite ainsi qu’à des références d’image, d’audio et de vidéo spécifiées à l’avance. L’une est pilotée pendant la génération ; l’autre est dirigée avant celle-ci.

• Audio — Seedance 2 le génère conjointement avec la vidéo, au sein du même modèle. La documentation de lancement d'Odyssey-3 ne mentionne pas du tout l'audio.

• Résolution — Odyssey-3 fonctionne en 832×480, l’Odyssey-3 Pro en 1280×720. La page de B​yteDance consacrée à Seedance 2 ne publie pas de résolution de sortie, et le chiffre 1080p qui circule appartient à la gamme antérieure Seedance 1.0.

• Coût — Odyssey-3 est affiché à 0,0 $ par vidéo générée dans la colonne des coûts normalisés de Physics-IQ, et Odyssey-3 Pro à 0,267 $, tous deux hors traitement des prompts. Seedance 2 ne publie aucun prix catalogue à la seconde ou par clip que nous ayons pu vérifier ; son successeur Seedance 2.5 figure dans le même tableau à 2,838 $ par vidéo.

• Évaluation indépendante — la génération propre d'aucun des deux modèles n'a fait l'objet d'une comparaison directe par un tiers. Les résultats publiés de Seedance 2.0 sont ceux du SeedVideoBench-2.0 interne de ByteDance ; ceux d'Odyssey-3 sont une soumission à un benchmark ainsi qu'une évaluation menée par le fournisseur sur le jeu de données d'un tiers.

• Poids — fermés des deux côtés. Odyssey n’a publié aucun point de contrôle, et Seedance n’a jamais été ouvert.

• Positionnement commercial — Odyssey-3 est un aperçu de recherche avec un formulaire de contact pour l’accès à l’API et aucune grille tarifaire. Seedance 2 est vendu via les propres plateformes de ByteDance et, hors de Chine, via CapCut sous le nom de Dreamina Seedance 2.0.

Le seul chiffre qui les compare vraiment

Physics-IQ Verified évalue les modèles sur l'amélioration nette de la plausibilité physique par rapport à la moyenne de la piste, en points de pourcentage, et il enregistre quel jeu de prompts a été utilisé. Sur les prompts propres au benchmark, Seedance 2.5 se classe septième à +3,59 pp, avec un coût normalisé de 2,838 $ par vidéo. Odyssey-3, sur le même jeu de prompts, se classe huitième à +2,15 pp, à 0,129 $ par vidéo. Lisez attentivement : cela représente un écart de 1,44 point en faveur de Seedance et un écart de coût d'environ vingt-deux fois à son désavantage.

Les lignes principales d’Odyssey-3 utilisent une colonne différente. Soumis avec des prompts personnalisés, Odyssey-3 obtient +9,99 pp et Odyssey-3 Pro +11,15 pp — troisième et deuxième du classement, derrière FLUX 3 [large] à +12,27 pp. La même famille de modèles apparaît deux fois sur le même classement sous deux régimes de prompts différents, avec des scores très différents, ce qui est la chose la plus utile à comprendre pour savoir lire ce classement : le chiffre est en partie une propriété du modèle et en partie une propriété de la personne qui a écrit le prompt.

Odyssey rapporte également 66,1 sur la piste vidéo-vers-vidéo pour Odyssey-3 Pro, le meilleur score qu’il revendique, et 54,7 pour Odyssey-3 Pro sur image-vers-vidéo. Ces deux chiffres proviennent de la propre lecture du fournisseur d’un classement auquel il a soumis des résultats, et non d’une exécution indépendante.

Two-column scoreboard headed “Odyssey-3 vs ByteDance Seedance 2 — the scoreboard” with six shared dimension labels. Odyssey-3: an environment you act inside; live navigation and mid-run events; no audio; 832x480, 1280x720 Pro; /bin/bash.139 a video, Pro /bin/bash.267; no independent scoring yet. ByteDance Seedance 2: a fixed clip up to 15 seconds; text, image, audio and video references upfront; audio generated jointly with the video; resolution not published; no per-second list price published; not on Physics-IQ. Footer: “Odyssey-3 figures vendor-reported and unreproduced; Seedance 2 has no third-party score; Seedance 2.5, a later model, is on Physics-IQ at +3.59 pp”.

Là où chacun gagne réellement

Si votre problème est « j’ai besoin d’un plan », la conception de Seedance 2 répond exactement à cela : les références multimodales signifient que vous pouvez lui fournir l’apparence de l’acteur, le lit audio et le mouvement de caméra, et obtenir un clip finalisé avec son. Rien dans l’aperçu d’Odyssey-3 ne fait cela, et rien dans ses documents de lancement ne suggère qu’il le fera. Le plafond de quinze secondes est une contrainte réelle, mais un déploiement de modèle du monde de cinq secondes sans audio en est une aussi.

Si votre problème est « je dois savoir ce qui se passe ensuite », le compromis s'inverse. On ne peut pas poser de contrefactuel à Seedance 2 — vous obtenez un seul clip, et pour voir un autre résultat, vous relancez le prompt et en obtenez un sans rapport. Toute la prémisse d'Odyssey-3 est que l'état suivant dépend de l'action que vous venez d'effectuer, ce qui le rend exploitable pour une politique de conduite, un bras robotisé ou un environnement d'entraînement où la séquence compte plus que le plan.

Les preuves de précision physique favorisent Odyssey-3 sur le mécanisme, même là où la colonne des scores ne le fait pas : le modèle est évalué sur des continuations après une perturbation, soit exactement la capacité que met en avant l'aperçu interactif. Le +3,59 pp de Seedance 2.5 sur le même classement est un résultat solide pour un générateur de clips et, surtout, meilleur que celui d'Odyssey-3 sur l'ensemble de prompts appariés — c'est pourquoi le résumé honnête est que le modèle vidéo de B​yteDance est plus physiquement plausible qu'un modèle vidéo n'a le droit de l'être, et non qu'Odyssey-3 a été battu à son propre jeu.

OrcaRouter's own model page for minimax/minimax-h3, showing the model header “text + image + video + audio”, output video, a p50 time-to-first-token of 406 ms, performance and vision/audio badges, and a Python code sample on the left with the model list and playground navigation above.

Accéder à l'un ou l'autre

Aucun des deux modèles ne peut être appelé depuis ici aujourd’hui. OrcaRouter n’héberge ni Odyssey-3 ni B​yteDance Seedance 2 — Odyssey-3 n’a aucun prix publié permettant à quiconque de le router, et Seedance est vendu via les plateformes propres de B​yteDance.

Ce qu'une clé OrcaRouter unique permet effectivement d'atteindre, c'est le reste de la pile vidéo : MiniMax-H3 à 0,08 $ par seconde de sortie 768P, la gamme vidéo K​ling à 0,084 $ à 0,28 $ par requête, et plus de 200 modèles au total, le tout au prix catalogue du fournisseur avec 0 % de marge, de sorte qu'une variation de prix d'un fournisseur se répercute sur votre facture le jour même plutôt qu'au renouvellement. Le basculement automatique maintient une campagne d'évaluation active lorsqu'un service amont se dégrade, et le DSL de routage place plusieurs modèles vidéo derrière une seule interface, de sorte que tester un nouveau générateur relève d'un simple changement de configuration plutôt que d'une intégration. Lorsque l'un de ces deux services ouvre un point d'accès en libre-service, c'est sous cette forme qu'il faut l'intégrer.

Que regarder

Deux choses changeraient davantage cette comparaison que n’importe quelle mise à jour de benchmark. La première, c’est l’audio : si la prochaine génération d’Odyssey-3 génère du son conjointement, comme le fait Seedance, « l’environnement dans lequel on agit » cesse d’être une catégorie plus étroite. La seconde, c’est un harnais indépendant — un tiers exécutant Seedance 2.0 et Odyssey-3 côte à côte sur les mêmes clips, plutôt que de voir l’un apparaître sur un classement auquel l’autre n’a jamais été soumis. D’ici là, la bonne lecture d’Odyssey-3 face à B​yteDance Seedance 2 est que ce ne sont pas deux candidats pour le même poste. Ce sont deux réponses à des questions différentes, et la question que vous posez choisit le modèle pour vous.