Titelkarte für einen Artikel, der Odyssey-3 und Seedance 2.5 vergleicht, mit dem Untertitel „Sekunden an Filmmaterial vs. Stunden an Simulation“ und drei Statistik-Chips mit der Aufschrift „30 s Generierung in einem Durchgang“, „~1,16 $ pro 5-s-Clip bei 720p“ und „Odyssey-3: keine Verkaufseinheit“.
Guides & Insights

Odyssey-3 vs. Seedance 2.5: Sekunden Filmmaterial vs. Stunden Simulation

Autor

Gideon Frost

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Fragt man, was Seedance 2.5 kostet, bekommt man eine Antwort in Dollar pro Sekunde. Fragt man, was Odyssey-3 kostet, bekommt man überhaupt nichts – keine Preisliste, keinen Endpunkt, keine Lizenz, denn das am 15. September 2026 angekündigte Modell ist noch nicht veröffentlicht, und sein Hersteller hat es öffentlich nur „in den kommenden Wochen“ in Aussicht gestellt. Diese Lücke sieht wie ein Reifegradunterschied aus und ist größtenteils ein Kategorienunterschied. Seedance 2.5, am 31. Juli 2026 vom Seed-Team von ByteDance veröffentlicht, ist eine Produktions-Engine, die nach Sekunden fertigen Filmmaterials an Menschen verkauft wird, die Filmmaterial brauchen. Odyssey-3 ist ein Weltmodell mit einer Aktionsschnittstelle, und der Käufer, auf den es abzielt, will gar kein Filmmaterial – er will eine Umgebung, die korrekt reagiert, wenn etwas in ihr handelt. Beide werden auf einige derselben Probleme gerichtet, darunter Roboter- und Fahrdaten, weshalb es sich lohnt, die Unterscheidung sorgfältig zu treffen.

Seedance 2.5 ist eine Produktions-Engine, und die Launch-Partner zeigen es.

Die herausragende Fähigkeit ist die Dauer. Seedance 2.5 generiert dreißig Sekunden in einem einzigen Durchlauf, doppelt so viel wie die fünfzehn seines Vorgängers, mit mehrrundiger Erweiterung für längere Sequenzen und einem Berichten zufolge ultralangen Beta-Modus, der noch weiter reicht. Allein das verändert, wofür das Modell gedacht ist: Dreißig Sekunden sind eine Szene statt einer Einstellung, und ByteDances Marketing setzt genau deshalb auf die Wendung „One-Take".

Rund um die Dauer herum gruppieren sich die Funktionen, die eine Generierung in einem echten Schnitt nutzbar machen. Das Modell akzeptiert umfangreiche multimodale Referenzierung – Berichten zufolge bis zu dreißig Bilder, zehn Videoclips und zehn Audioclips pro Generierung, wobei Referenzvideo und -audio jeweils auf etwa dreißig Sekunden begrenzt sind, und reine Audioreferenzen sind in dieser Version neu. Es gibt neue Referenzmodi für Weißmodell- oder Clay-Renderings, Greenscreen-Aufnahmen, Bewegungs- und kreative Referenzierung. Die Steuerung erfolgt auf Zeitstempel-Ebene, sodass ein Prompt narrative Inhalte, Kamera oder Bewegung innerhalb eines bestimmten Zeitbereichs ansprechen kann, und Bearbeitungen auf Regionsebene nach der Generierung bewahren die Kontinuität, statt einen erneuten Durchlauf zu erzwingen. Audio und Video werden in einem Durchgang gemeinsam generiert, sodass Lip-Sync dem zitierten Dialog folgt, und mehr als zehn Sprachen werden nativ unterstützt.

Die Liste der Adopter ist das entscheidende Indiz. Am Launch-Tag bestätigten XCMG, XPeng, Lingchu Intelligence, Weifen Zhifei und Qiongche Intelligence Partnerschaften, und die genannten Anwendungsfälle reichen von Trainingsdaten für verkörperte KI und Corner Cases des autonomen Fahrens bis hin zu industriellen SOP-Schulungsvideos, Bildung und E-Commerce-Werbung. Einiges davon ist kreative Arbeit. Einiges davon ist Datengenerierung für Systeme, die später auf die Welt einwirken werden – und genau das ist der Teil, der sich mit Odyssey-3 überschneidet.

Was eine Sekunde von Seedance 2.5 kostet

Die Preise sind veröffentlicht, und die Abrechnung erfolgt in Tokens statt in Sekunden, was einen Umrechnungsschritt erfordert, den man vor der Entscheidung durchführen sollte. Die für den ModelArk-Endpunkt gemeldeten Werte sind 10,70 $ pro Million Tokens ohne Videoeingabe und 6,40 $ pro Million Tokens, wenn Videoeingabe enthalten ist. In der Praxis ergibt das ungefähr 0,51 $ für einen fünfsekündigen 16:9-Clip bei 480p und etwa 1,16 $ für denselben Clip bei 720p. Dabei handelt es sich um die veröffentlichten Preise des Anbieters zum Marktstart; betrachten Sie sie als aktuelle Preisliste und nicht als gemessene Kosten pro Ergebnis, da sowohl Auflösung als auch Dauer diese beeinflussen.

Verfügbarkeit hat echte Grenzen. Der Zugang für Endverbraucher läuft über ByteDances eigene Apps, während sich der API-Zugang zwischen Volcano Engine Ark in China und BytePlus ModelArk international aufteilt. Mindestens ein Distributor gibt an, dass das Modell in den Vereinigten Staaten nicht verfügbar ist, und die Quellen sind sich uneinig, ob die unterstützten Auflösungen bei 720p enden oder bis 1080p reichen — eine Diskrepanz, die man anhand der Dokumentation des Anbieters selbst klären sollte, bevor man eine Auflösung zur Planungsgrundlage macht.

Dies ist die Art von Modell, bei der eine Routing-Schicht aus einem konkreten Grund ihre Berechtigung hat: Die Preise bewegen sich. Ein Video-Preis pro Token, der sich zum Launch einmal geändert hat, wird sich erneut ändern, und der Unterschied zwischen einem Kostenmodell, das auf der heutigen Zahl basiert, und einem, das auf der vom letzten Quartal beruht, ist der Unterschied zwischen einer Marge und einer Überraschung. OrcaRouter gibt den Listenpreis des Anbieters mit 0 % Aufschlag weiter, sodass eine Preissenkung eines Anbieters bei uns noch am selben Tag live ist statt erst zur nächsten Vertragsverlängerung, und automatisches Failover hält eine Generierungswarteschlange in Bewegung, wenn ein Anbieter-Endpunkt beeinträchtigt ist — ein Planungsanliegen und kein theoretisches bei Video-Workloads. Seedance 2.5 selbst wird nicht von OrcaRouter geroutet; es wird über die eigenen Plattformen von ByteDance und deren ModelArk-Endpunkte bereitgestellt.

Two-column scoreboard for Odyssey-3 and Seedance 2.5 across six shared dimensions — unit of sale, what you get, inputs, editing control, availability and partners. Seedance 2.5 reads tokens at roughly $0.51 per 5s at 480p, finished footage up to 30s, shipping since 31 Jul 2026; Odyssey-3 reads not published, next world state plus actions, announced 15 Sep 2026, Flexion on humanoids.

Odyssey-3 wird nicht sekundenweise verkauft

Odyssey-3 hat noch keine Verkaufseinheit, und das ist durchaus beabsichtigt. Es wird als Foundation-Weltmodell beschrieben, das Roboter antreiben, Autos steuern, KIs trainieren, Drohnen fliegen und Videospiele spielen kann – ein autoregressiver Diffusions-Transformer, der auf einer großen Sammlung visueller Beobachtungen trainiert wurde und laut seinem Hersteller ein erlerntes Verständnis von Physik, Dynamik, Ursache-Wirkung und menschlichem Verhalten liefert. Die Anpassung an eine neue Aufgabe erfolgt, indem ein Aktionsdecoder auf Beobachtungs-Aktions-Paaren trainiert wird und das vortrainierte Weltmodell eingefroren bleibt, sodass eine kleine Policy die eingefrorene Repräsentation liest und Motorikbefehle ausgibt.

Die Demonstrationen, alle vom Anbieter gemeldet und keine davon unabhängig reproduziert, umfassen sechs Ausführungsformen: Roboterarme aus zig Stunden von Demonstrationen, einschließlich Wiederherstellungsverhaltens, das nicht in den Daten enthalten war; humanoide Policies, die mit Flexion aus zig Stunden Teleoperation erstellt wurden, die laut Odyssey besser generalisieren als die VLA-Baselines, gegen die Odyssey testete, ohne eine Zahl zu veröffentlichen; Closed-Loop-Fahren in Indien aus zwanzig Stunden simulierter Daten; Indoor-Drohnenflug aus simulierten Daten; Grand Theft Auto V-Policies, die ohne zusätzliches Training auf Red Dead Redemption 2 und Sleeping Dogs übertragen wurden, wobei etwa zwei Stunden GTA-Material eine Reitbewegung in RDR2 erzeugten; und Umgebungsgenerierung für das Training anderer KIs durch die PROWL-Arbeit.

Die einzige harte Zahl ist 77 % – simulationsgeschulte Fahrstrategien legten zwischen Eingriffen durch Sicherheitsfahrer etwa diesen Bruchteil der Strecke zurück wie Strategien, die mit echtem Filmmaterial trainiert wurden. Das ist eine Herstellerangabe, hinter der kein technischer Bericht und keine externe Überprüfung steht.

Screenshot of Odyssey's “Introducing Odyssey-3: A General-Purpose Physical Intelligence” page, dated September 15th, 2026, showing the model subtitle “Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games” and the authors Oliver Cameron and Jeff Hawke.

Die Verkaufseinheit entscheidet darüber, was optimiert wird.

Sobald man die beiden Modelle als Messinstrumente statt als Fähigkeiten betrachtet, wirken ihre Unterschiede nicht mehr so, als wäre das eine dem anderen voraus.

Ein Modell, das pro Sekunde Output abgerechnet wird, ist auf Output optimiert, der einen Zuschauer zufriedenstellt. Das ist kein geringerer Anspruch; es ist ein anderes Ziel mit eigenen schwierigen Problemen. Dass Seedance 2.5 dreißig zusammenhängende Sekunden mit synchronisiertem Dialog und Kontrolle auf Timestamp-Ebene produziert, ist ein wirklich schwieriges Ergebnis, und die Fehlermodi, an denen es gemessen wird — ein driftendes Gesicht einer Figur, ein Schnitt, der nicht sitzt, eine Dialogzeile außer Takt — sind die, die eine Person im Schnittraum bemerken würde.

Ein Modell, das vorhersagen soll, was als Nächstes geschieht, wenn ein Controller handelt, ist auf etwas optimiert, das ein Betrachter niemals überprüfen wird: ob die Dynamik einer Abfolge von Entscheidungen standhält – einschließlich Entscheidungen, die niemand demonstriert hat. Deshalb berichtet Odyssey über Erholungsverhalten, das aus Dutzenden Stunden Daten hervorgeht, statt über Wiedergabetreue, und deshalb wird sein einziger quantitativer Anspruch in Safety-Driver-Eingriffen statt in visueller Qualität gemessen. Ein Renderer kann auf Arten falsch sein, die ein Publikum verzeiht. Ein Simulator kann auf Arten falsch sein, auf die ein Controller reagiert, und die zweite Art von Fehler summiert sich über einen Rollout.

Die Überschneidung bei den angegebenen Anwendungsfällen – Trainingsdaten für Roboter, Randfälle des autonomen Fahrens – ist der Punkt, an dem diese beiden aufeinandertreffen, und es ist ein echter Wettbewerb um Budget statt um Benchmark-Position. Die Frage, vor der ein Robotikteam tatsächlich steht, ist, ob es gerenderte Sekunden einer plausiblen Welt kaufen soll oder ein Dynamikmodell mit einer Aktionsschnittstelle, und die Antwort hängt davon ab, ob der nachgelagerte Konsument ein menschlicher Prüfer oder eine Trainingsschleife ist.

Seite an Seite

Verkaufseinheit — Seedance 2.5: Token, umgerechnet etwa 0,51 $ pro 5-Sekunden-Clip bei 480p und 1,16 $ bei 720p. Odyssey-3: keine veröffentlicht.

Was Sie pro Einheit erhalten — Seedance 2.5: fertiges Filmmaterial, bis zu 30 s in einem Durchgang, mit synchronisiertem Audio und Dialog. Odyssey-3: ein vorhergesagter nächster Zustand der Welt plus Motoraktionen für angeschlossene Hardware.

Eingaben — Seedance 2.5: Text plus bis zu ~30 Bilder, 10 Videos und 10 Audioclips. Odyssey-3: ein auf Beobachtungs-Aktions-Paaren trainierter Aktionsdecoder über einem eingefrorenen Backbone.

Bearbeitungssteuerung — Seedance 2.5: Ansteuerung auf Zeitstempel-Ebene und Bearbeitungen auf Regionsebene nach der Generierung. Odyssey-3: nicht zutreffend; es gibt keine Bearbeitungsoberfläche.

Angegebene Partner — Seedance 2.5: XCMG, XPeng und drei weitere zum Start. Odyssey-3: Flexion zu Humanoid-Richtlinien; keine kommerziellen Kunden angekündigt.

Verfügbarkeit — Seedance 2.5: seit 31. Juli 2026 verfügbar, vorbehaltlich regionaler Beschränkungen. Odyssey-3: am 15. September 2026 angekündigt, öffentliche Veröffentlichung „in den kommenden Wochen“, kein Datum und kein Preis.

Welcher gehört in deinen Stack

Wenn das Endprodukt ein Video ist, das eine Person anschauen wird, ist Seedance 2.5 ein marktreifes Produkt mit veröffentlichtem Preis und einem breiten Funktionsumfang, und die Entscheidung ist eine normale Make-or-Buy-Entscheidung — mit zwei Vorbehalten, die zuerst geprüft werden sollten: ob die Auflösungen, die Sie benötigen, tatsächlich auf dem Endpunkt verfügbar sind, den Sie erreichen können, und ob Ihre Region überhaupt bedient wird. Seine längere Einzeldurchlaufdauer und die Zeitstempelsteuerung sind die Funktionen, die den Workflow am stärksten verändern, weil sie Stitching-Schritte entfernen, statt einen Frame zu verbessern.

Wenn das Deliverable eine trainierte Policy oder ein Controller ist, ist Seedance 2.5 kein Ersatz, egal wie gut das Filmmaterial aussieht, und Odyssey-3 zielt auf dein Problem, ohne dass es etwas zu kaufen gibt. Die Behauptung, die es zu verfolgen lohnt, ist das eingefrorene Backbone: Ein vorab trainiertes Modell, das über einen kleinen Decoder Roboterarme, humanoide Roboter, ein Auto, eine Drohne und drei Spiele ansteuert, ist eine Aussage darüber, wie viel physikalisches Verständnis sich zwischen Verkörperungen überträgt, und wenn sie standhält, ändert sie, was ein Robotikteam sammeln muss. Es wurde von niemandem außerhalb von Odyssey getestet, und es gibt keinen technischen Bericht, keine Lizenz und keinen Preis.

Worauf man achten muss, ist wenig glamourös: für Seedance 2.5 ein stabiler Preis und eine klare Aussage zur regionalen Verfügbarkeit; für Odyssey-3 ein Repository, eine Lizenz und eine dritte Partei, die die 77 % reproduziert. Solange die zweite Liste nicht existiert, ist der Unterschied zwischen diesen beiden Modellen nicht die Qualität. Er besteht darin, dass eines von ihnen ein Produkt ist und das andere ein Argument.

Infographic titled “What One Unit Buys” contrasting Seedance 2.5, billed per token, with a 5s clip costing about $0.51 at 480p and about $1.16 at 720p and up to 30s in a single pass, against Odyssey-3, which has no published price and reaches robot arms, humanoids, a car and a drone through a frozen backbone plus action decoder across six embodiments with no third-party runs.

OrcaRouter hält mehr als 200 Modelle hinter einem einzigen API-Schlüssel bereit, sodass das Videomodell, das Sie auswählen, nicht das einzige ist, das Sie aufrufen können.