Titelkarte für Odyssey-3 vs. ByteDance Seedance 2, mit einem linken Panel, überschrieben mit Odyssey-3, das „eine Welt, die du live steuerst“ anzeigt, 832x480 oder 1280x720 Pro, Physics-IQ +9,99 pp Rang 03; und einem rechten Panel, überschrieben mit ByteDance Seedance 2, das GA seit 12. Februar 2026 anzeigt, Plattform mit nutzungsabhängiger Abrechnung, ein fertiger Clip bis zu 15 s, Auflösung nicht veröffentlicht, Physics-IQ nicht eingereicht.
Guides & Insights

Odyssey-3 vs. ByteDance Seedance 2: Eine Umgebung, in der du agierst, gegen einen Clip, den du dir ansiehst

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Stellt man Odyssey-3 und B​yteDance Seedance 2 nebeneinander, fällt zuerst auf, dass sie nicht um dieselbe Anfrage konkurrieren. Odyssey-3, am 8. Oktober 2026 von Odyssey veröffentlicht, erzeugt aus einem Prompt eine Umgebung und sagt sie dann in Echtzeit weiter voraus, während man sich durch sie bewegt oder ein Ereignis auslöst – es ist ein Simulator mit einer Kamera, die man steuert. B​yteDance Seedance 2 ist ein Clip-Generator mit Regiestuhl: Text-, Bild-, Audio- und Video-Referenzen rein, ein fertiges Video raus, bis zu fünfzehn Sekunden davon, in einem Durchgang erzeugt und als festes Objekt geliefert. Eines von beiden hat einen Steuereingang; das andere hat eine Timeline. Der Vergleich lohnt sich trotzdem, weil die beiden auf denselben Käufer zulaufen und weil sie entgegengesetzte Wetten darauf abschließen, wo der Wert eines generativen Videomodells liegt.

Es gibt eine gemeinsame Rangliste, und sie ist dünner, als sie aussieht. Seedance 2 selbst erscheint nicht auf Physics-IQ Verified, dem Board von Anates Labs und DeepMind, das bewertet, wie gut ein Modell reale physikalische Experimente vorhersagt. Seedance 2.5, der Nachfolger vom 31. Juli 2026, taucht dort auf. Die einzige Drittanbieter-Zahl, die irgendetwas aus dieser Familie neben Odyssey-3 stellt, ist also ein Vergleich über zwei Modellgenerationen auf einer Seite, was man erwähnen sollte, bevor jemand ihn als fairen Kampf zitiert.

Die beiden Mechanismen

Odyssey-3 ist ein autoregressiver Diffusions-Transformer. Odysseys eigene Beschreibung: ein mehrstufiges Videodiffusionsmodell, autoregressiv erweitert mit Teacher Forcing und kausalem Masking, sodass es von vorhergehenden Beobachtungen aus fortfährt und zukünftige Zustände bedingt auf Aktionseingaben vorhersagt; anschließend erzeugt ein Post-Training-Durchlauf aus Distribution Matching und adversariale Destillation eine Few-Step-Variante, die schnell genug für Interaktion ist. Die Ausgabe ist keine Szene, die abspielt; sie ist eine Szene, die reagiert. Die Vorschau bietet First-Person-Navigation, Third-Person-Navigation und unabhängige Kamerabewegung — drei verschiedene Arten, auf dieselbe Vorhersage einzuwirken und zu beobachten, was sie tut.

B​yteDance Seedance 2ist ein einheitliches multimodales Modell zur gemeinsamen Generierung von Audio und Video. Es akzeptiert Text, Bild, Audio und Video als Referenzen und erzeugt den Clip in einem einzigen Durchgang, bis zu fünfzehn Sekunden lang, wobei das Audio gemeinsam generiert und nicht nachträglich hinzugefügt wird. B​yteDances Seite beschreibt, dass Bild-, Audio- und Videoreferenzen Kontrolle über Performance, Beleuchtung, Schatten und Kamerabewegung ermöglichen – das ist die Sprache der Produktion und nicht die der Simulation: Man legt eine Einstellung fest, statt eine Welt zu steuern. Am 12. Februar 2026 veröffentlicht, wurde es innerhalb weniger Tage mit Clips echter Schauspieler und bestehender Filme viral – und genau das löste auch den Urheberrechtssturm aus: Unterlassungsschreiben von Disney und Netflix, Verurteilungen seitens der Motion Picture Association und SAG-AFTRA sowie ein Brief zweier US-Senatoren vom März 2026, in dem B​yteDance aufgefordert wurde, das Modell abzuschalten. B​yteDance erklärte im Februar 2026, die Schutzmaßnahmen zu verstärken. Diese Geschichte ist Teil der Spezifikation des Modells, wenn man irgendetwas Kommerzielles auf den Markt bringt.

Dimension für Dimension

ByteDance's BytePlus ModelArk developer documentation in English, showing the Ark SDK quick-start with a Python client using model seed-2-0-lite-260228 against base_url https://ark.ap-southeast.bytepluses.com/api/v3, a sidebar covering Models, video generation, image generation and the Model list, and three endpoint cards for Dola Seed 2.0, Dreamina Seedance 2.5 (described as the mainline video generation model with 30s extended storytelling, multimodal references and improved generation quality) and Dola Seedream 5.0.

• Was es ausgibt — eine interaktive Umgebung, in der Sie agieren, vor dem Hintergrund eines festen Clips von bis zu fünfzehn Sekunden. Alles, was nach dieser Zeile kommt, ändert sich.

• Steueroberfläche — Live-Navigation und Ereignisse während der Generierung, auf Grundlage von Prompt sowie vorab festgelegten Bild-, Audio- und Videoreferenzen. Das eine wird während der Generierung gesteuert; das andere wird davor gelenkt.

• Audio — Seedance 2 erzeugt es gemeinsam mit dem Video, im selben Modell. Das Launch-Material von Odyssey-3 sagt überhaupt nichts über Audio.

• Auflösung — Odyssey-3 läuft mit 832×480, Odyssey-3 Pro mit 1280×720. B​yteDances Seite für Seedance 2 gibt keine Ausgabeauflösung an, und die kursierende 1080p-Angabe gehört zur früheren Seedance-1.0-Reihe.

• Kosten — Odyssey-3 wird in der normalisierten Kostenspalte von Physics-IQ mit 0,139 $ pro generiertem Video aufgeführt, Odyssey-3 Pro mit 0,267 $, beide ohne Berücksichtigung der Prompt-Verarbeitung. Seedance 2 veröffentlicht keinen Listenpreis pro Sekunde oder pro Clip, den wir verifizieren konnten; sein Nachfolger Seedance 2.5 wird auf derselben Übersicht mit 2,838 $ pro Video aufgeführt.

• Unabhängige Bewertung — für die eigene Generierung keines der beiden Modelle liegt ein Head-to-Head-Vergleich durch Dritte vor. Die veröffentlichten Ergebnisse von Seedance 2.0 stammen aus ByteDances internem SeedVideoBench-2.0; die von Odyssey-3 sind eine Benchmark-Einreichung plus eine vom Anbieter durchgeführte Bewertung auf dem Datensatz eines anderen.

• Gewichte — auf beiden Seiten geschlossen. Odyssey hat keine Checkpoints veröffentlicht, und Seedance war nie offen.

• Kommerzielle Positionierung — Odyssey-3 ist eine Forschungsvorschau mit einem Kontaktformular für den API-Zugang und ohne Preisliste. Seedance 2 wird über die eigenen Plattformen von B​yteDance verkauft und außerhalb Chinas über CapCut als Dreamina Seedance 2.0.

Die eine Zahl, die sie tatsächlich vergleicht

Physics-IQ Verified bewertet Modelle anhand der Nettoverbesserung der physikalischen Plausibilität gegenüber dem Track-Mittelwert in Prozentpunkten und hält fest, welches Prompt-Set verwendet wurde. Bei den eigenen Prompts des Benchmarks liegt Seedance 2.5 mit +3,59 pp auf Platz sieben, bei normalisierten Kosten von 2,838 $ pro Video. Odyssey-3 liegt beim selben Prompt-Set mit +2,15 pp auf Platz acht, bei 0,129 $ pro Video. Wenn man genau liest, ist das ein Vorsprung von 1,44 Punkten für Seedance und ein Kostenunterschied von rund dem Zweiundzwanzigfachen zu Ungunsten von Seedance.

Die Headline-Zeilen von Odyssey-3 verwenden eine andere Spalte. Mit benutzerdefinierten Prompts eingereicht, erzielt Odyssey-3 +9,99 pp und Odyssey-3 Pro +11,15 pp — Dritter und Zweiter auf dem Board, hinter FLUX 3 [large] mit +12,27 pp. Dieselbe Modellfamilie erscheint zweimal auf demselben Leaderboard unter zwei verschiedenen Prompt-Regimen mit sehr unterschiedlichen Werten, was das einzig Nützlichste ist, um zu verstehen, wie man dieses Board liest: Die Zahl ist zum Teil eine Eigenschaft des Modells und zum Teil eine Eigenschaft der Person, die den Prompt geschrieben hat.

Odyssey gibt außerdem 66,1 im Video-zu-Video-Track für Odyssey-3 Pro an, die höchste Punktzahl, die das Unternehmen beansprucht, und 54,7 für Odyssey-3 Pro bei Bild-zu-Video. Beides sind die eigenen Werte des Anbieters auf einem Board, bei dem er eingereicht hat, kein unabhängiger Durchlauf.

Two-column scoreboard headed “Odyssey-3 vs ByteDance Seedance 2 — the scoreboard” with six shared dimension labels. Odyssey-3: an environment you act inside; live navigation and mid-run events; no audio; 832x480, 1280x720 Pro; /bin/bash.139 a video, Pro /bin/bash.267; no independent scoring yet. ByteDance Seedance 2: a fixed clip up to 15 seconds; text, image, audio and video references upfront; audio generated jointly with the video; resolution not published; no per-second list price published; not on Physics-IQ. Footer: “Odyssey-3 figures vendor-reported and unreproduced; Seedance 2 has no third-party score; Seedance 2.5, a later model, is on Physics-IQ at +3.59 pp”.

Wo jedes einzelne tatsächlich gewinnt

Wenn das Problem „Ich brauche eine Aufnahme“ lautet, dann beantwortet das Design von Seedance 2 genau das: Multimodale Referenzen bedeuten, dass man das Aussehen des Schauspielers, das Audiobett und die Kamerabewegung als Eingaben übergeben kann und einen fertigen Clip mit Ton erhält. Nichts in der Vorschau von Odyssey-3 leistet das, und nichts in dessen Markteinführungsmaterial deutet darauf hin, dass es das tun wird. Die Obergrenze von fünfzehn Sekunden ist eine echte Einschränkung, aber das gilt auch für einen Fünf-Sekunden-Rollout eines Weltmodells ohne Audio.

Wenn Ihr Problem „Ich möchte wissen, was als Nächstes passiert“ ist, läuft der Kompromiss andersherum. Seed 2 kann nicht nach einem kontrafaktischen Szenario gefragt werden – Sie bekommen einen Clip, und um ein anderes Ergebnis zu sehen, geben Sie erneut einen Prompt ein und erhalten ein unzusammenhängendes Ergebnis. Operation-3s gesamte Prämisse ist, dass der nächste Zustand von der Aktion abhängt, die Sie gerade ausgeführt haben, was es für eine Fahrstrategie, einen Roboterarm oder eine Trainingsumgebung geeignet macht, in der die Reihenfolge wichtiger ist als der einzelne Shot.

Die Belege zur physikalischen Genauigkeit sprechen hinsichtlich des Mechanismus für Odyssey-3, selbst dort, wo die Score-Spalte dies nicht tut: Das Modell wird an Fortsetzungen nach einer Störung bewertet, also genau an der Fähigkeit, mit der die interaktive Vorschau wirbt. Die +3,59 Prozentpunkte von Seedance 2.5 auf demselben Board sind ein starkes Ergebnis für einen Clip-Generator und bemerkenswerterweise besser als die von Odyssey-3 auf dem gematchten Prompt-Set – weshalb die ehrliche Zusammenfassung lautet, dass das Videomodell von ByteDance physikalisch plausibler ist, als ein Videomodell überhaupt sein dürfte, und nicht, dass Odyssey-3 in seinem eigenen Spiel geschlagen wurde.

OrcaRouter's own model page for minimax/minimax-h3, showing the model header “text + image + video + audio”, output video, a p50 time-to-first-token of 406 ms, performance and vision/audio badges, and a Python code sample on the left with the model list and playground navigation above.

Zu einem von beiden gelangen

Heute ist keines der beiden Modelle von hier aus aufrufbar. OrcaRouter hostet weder Odyssey-3 noch B​yteDance Seedance 2 — für Odyssey-3 gibt es keinen veröffentlichten Preis, über den jemand routen könnte, und Seedance wird über B​yteDances eigene Plattformen verkauft.

Worauf ein einzelner OrcaRouter-Schlüssel tatsächlich Zugriff hat, ist der Rest des Video-Stacks: MiniMax-H3 zu $0,08 pro Sekunde für 768P-Ausgabe, die K​ling-Videolinie zu $0,084 bis $0,28 pro Anfrage, und insgesamt mehr als 200 Modelle, alle zum Listenpreis des Anbieters mit 0 % Aufschlag, sodass sich eine Preisänderung eines Anbieters noch am selben Tag auf Ihrer Rechnung niederschlägt und nicht erst bei der Verlängerung. Automatisches Failover hält einen Evaluierungsdurchlauf am Leben, wenn ein Upstream an Leistung verliert, und die Routing-DSL stellt mehrere Videomodelle hinter eine einzige Schnittstelle, sodass das Testen eines neuen Generators eine Konfigurationsänderung statt einer Integration ist. Wenn eine dieser beiden einen Self-Serve-Endpunkt öffnet, ist das die Form, in die man ihn einsetzen kann.

Was zu sehen

Zwei Dinge würden diesen Vergleich stärker verändern als jedes Benchmark-Update. Das erste ist Audio: Wenn die nächste Generation von Odyssey-3 Klang gemeinsam erzeugt, so wie Seedance es tut, hört die „Umgebung, in der Sie agieren“ auf, eine engere Kategorie zu sein. Das zweite ist ein unabhängiger Harness – ein Dritter, der Seedance 2.0 und Odyssey-3 auf denselben Clips Seite an Seite laufen lässt, statt dass eines auf einer Rangliste erscheint, für die das andere nie eingereicht wurde. Bis dahin ist die korrekte Lesart von Odyssey-3 gegenüber ByteDance Seedance 2, dass sie keine zwei Kandidaten für dieselbe Aufgabe sind. Sie sind zwei Antworten auf unterschiedliche Fragen, und die Frage, die Sie stellen, wählt das Modell für Sie aus.