Karta tytułowa dla Odyssey-3 kontra ByteDance Seedance 2, z lewym panelem zatytułowanym Odyssey-3 o treści „świat, którym sterujesz na żywo”, 832x480 lub 1280x720 Pro, Physics-IQ +9,99 pp, pozycja 03; oraz prawym panelem zatytułowanym ByteDance Seedance 2 o treści GA od 12 lutego 2026, platforma rozliczana według zużycia, gotowy klip do 15 s, rozdzielczość niepublikowana, Physics-IQ nie zgłoszono.
Guides & Insights

Odyssey-3 vs ByteDance Seedance 2: Środowisko, w którym działasz, kontra klip, który oglądasz

Autor

Magnus Corvin

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Postaw Odyssey-3 i B​yteDance Seedance 2 obok siebie, a pierwszą rzeczą, którą zauważysz, jest to, że nie konkurują o to samo zapytanie. Odyssey-3, wydany przez Odyssey 8 października 2026 r., generuje środowisko na podstawie promptu, a następnie nieustannie przewiduje je w czasie rzeczywistym, gdy poruszasz się po nim lub wyzwalasz zdarzenie — to symulator z kamerą, którą sterujesz. B​yteDance Seedance 2 to generator klipów z fotelem reżysera: na wejściu referencje tekstowe, graficzne, audio i wideo, na wyjściu gotowy film, do piętnastu sekund, wygenerowany w jednym przebiegu i dostarczony jako stały obiekt. Jedno z nich ma wejście sterujące; drugie ma os czasu. Porównanie i tak warto przeprowadzić, bo oba zmierzają ku temu samemu nabywcy i stawiają przeciwne zakłady co do tego, gdzie leży wartość generatywnego modelu wideo.

Jest jedna wspólna tablica wyników i jest uboższa, niż wygląda. Sam Seedance 2 nie pojawia się w Physics-IQ Verified, tablicy Anates Labs i DeepMind, która ocenia, jak dobrze model przewiduje rzeczywiste eksperymenty fizyczne. Seedance 2.5, następca z 31 lipca 2026 r., już się tam znajduje. Zatem jedyna liczba od strony trzeciej, która stawia cokolwiek z tej rodziny obok Odyssey-3, to porównanie obejmujące dwie generacje modeli po jednej stronie, co warto zaznaczyć, zanim ktokolwiek zacytuje je jako uczciwą rywalizację.

Te dwa mechanizmy

Odyssey-3 to autoregresyjny transformator dyfuzyjny. Jak opisuje go sam Odyssey: wieloetapowy model dyfuzji wideo rozszerzony autoregresyjnie za pomocą wymuszania nauczyciela i maskowania przyczynowego, dzięki czemu kontynuuje on od poprzedzających obserwacji i przewiduje przyszłe stany w oparciu o dane wejściowe dotyczące działań, a następnie etap dostrajania po treningu, obejmujący dopasowywanie rozkładów i destylację kontradyktoryjną, tworzy wariant o zaledwie kilku krokach, wystarczająco szybki, by można było z nim wchodzić w interakcję. Wynik nie jest sceną, która się odtwarza; to scena, która reaguje. Podgląd udostępnia nawigację z perspektywy pierwszej osoby, nawigację z perspektywy trzeciej osoby oraz niezależny ruch kamery — trzy różne sposoby, by oddziaływać na tę samą predykcję i obserwować, co ona robi.

B​yteDance Seedance 2 to zunifikowany multimodalny model wspólnego generowania dźwięku i wideo. Przyjmuje tekst, obraz, dźwięk i wideo jako referencje i generuje klip w jednym przebiegu, o długości do piętnastu sekund, przy czym dźwięk jest generowany wspólnie, a nie dogrywany później. Strona B​yteDance opisuje referencje obrazu, dźwięku i wideo jako dające kontrolę nad grą aktorską, oświetleniem, cieniem i ruchem kamery, co jest językiem produkcji, a nie symulacji: określasz ujęcie, a nie sterujesz światem. Wydany 12 lutego 2026 r., w ciągu kilku dni stał się viralem dzięki klipom z prawdziwymi aktorami i istniejącymi filmami — i to właśnie wywołało burzę wokół praw autorskich, z wezwaniami do zaprzestania wysłanymi przez Disneya i Netflixa, potępieniem ze strony Motion Picture Association i SAG-AFTRA oraz listem z marca 2026 r. od dwóch amerykańskich senatorów z prośbą do B​yteDance o jego wyłączenie. B​yteDance poinformował w lutym 2026 r., że wzmacnia zabezpieczenia. Ta historia jest częścią specyfikacji modelu, jeśli wprowadzasz na rynek cokolwiek komercyjnego.

Dimension by dimension

ByteDance's BytePlus ModelArk developer documentation in English, showing the Ark SDK quick-start with a Python client using model seed-2-0-lite-260228 against base_url https://ark.ap-southeast.bytepluses.com/api/v3, a sidebar covering Models, video generation, image generation and the Model list, and three endpoint cards for Dola Seed 2.0, Dreamina Seedance 2.5 (described as the mainline video generation model with 30s extended storytelling, multimodal references and improved generation quality) and Dola Seedream 5.0.

• Co zwraca na wyjściu — interaktywne środowisko, w którym działasz, w oparciu o stały klip o długości do piętnastu sekund. Wszystko poniżej tego wiersza ulega zmianie.

• Panel sterowania — nawigacja na żywo i zdarzenia w trakcie generowania, w przeciwieństwie do promptu oraz określonych z góry referencji obrazowych, audio i wideo. Jednym steruje się podczas generowania; drugim kieruje się przed nim.

• Audio — Seedance 2 generuje je łącznie z wideo, w tym samym modelu. Materiały premierowe Odyssey-3 w ogóle nie wspominają o audio.

• Rozdzielczość — Odyssey-3 działa w 832×480, a Odyssey-3 Pro w 1280×720. Strona B​yteDance dla Seedance 2 nie podaje rozdzielczości wyjściowej, a krążąca wartość 1080p należy do wcześniejszej linii Seedance 1.0.

• Koszt — Odyssey-3 jest wyceniony na 0,139 USD za wygenerowane wideo w znormalizowanej kolumnie kosztów Physics-IQ, a Odyssey-3 Pro na 0,267 USD; obie kwoty nie obejmują obsługi promptu. Seedance 2 nie publikuje żadnej możliwej do zweryfikowania ceny cennikowej za sekundę ani za klip; jego następca Seedance 2.5 jest wyceniony na tej samej tablicy na 2,838 USD za wideo.

• Niezależne ocenianie — żadna z generacji samych modeli nie doczekała się bezpośredniego porównania przeprowadzonego przez stronę trzecią. Opublikowane wyniki Seedance 2.0 to wewnętrzny SeedVideoBench-2.0 firmy B​yteDance; wyniki Odyssey-3 to zgłoszenie do benchmarku oraz ocena przeprowadzona przez dostawcę na cudzym zbiorze danych.

• Wagi — zamknięte po obu stronach. Odyssey nie udostępniło żadnych checkpointów, a Seedance nigdy nie był otwarty.

• Strategia komercyjna — Odyssey-3 to badawcza wersja zapoznawcza z formularzem kontaktowym w celu uzyskania dostępu do API i bez cennika. Seedance 2 jest sprzedawany za pośrednictwem własnych platform ByteDance, a poza Chinami przez CapCut jako Dreamina Seedance 2.0.

Jedyna liczba, która faktycznie je porównuje

Physics-IQ Verified ocenia modele na podstawie poprawy netto fizycznej wiarygodności względem średniej dla danego toru, w punktach procentowych, oraz rejestruje, którego zestawu promptów użyto. Na własnych promptach benchmarku Seedance 2.5 plasuje się na siódmym miejscu z wynikiem +3,59 pp, przy znormalizowanym koszcie 2,838 USD za wideo. Odyssey-3, na tym samym zestawie promptów, plasuje się na ósmym miejscu z wynikiem +2,15 pp, przy koszcie 0,129 USD za wideo. Przeczytaj uważnie: to różnica 1,44 punktu na korzyść Seedance'a i różnica kosztów wynosząca około dwudziestu dwóch razy na niekorzyść Seedance'a.

Wiersze nagłówkowe Odyssey-3 używają innej kolumny. Zgłoszone z niestandardowymi promptami, Odyssey-3 uzyskuje +9,99 pp, a Odyssey-3 Pro +11,15 pp — trzecie i drugie miejsce na liście, za FLUX 3 [large] z +12,27 pp. Ta sama rodzina modeli pojawia się dwa razy na tej samej liście rankingowej w dwóch różnych reżimach promptów, z bardzo różnymi wynikami, co jest najważniejszą rzeczą, którą warto zrozumieć, aby właściwie czytać tę listę: liczba jest częściowo właściwością modelu, a częściowo właściwością tego, kto napisał prompt.

Odyssey podaje również 66,1 w ścieżce wideo-do-wideo dla Odyssey-3 Pro, najwyższy wynik, jaki deklaruje, oraz 54,7 dla Odyssey-3 Pro w ścieżce obraz-do-wideo. Oba są własnym odczytem dostawcy z tablicy wyników, do której zgłosił swoje rozwiązanie, a nie niezależnie przeprowadzonym testem.

Two-column scoreboard headed “Odyssey-3 vs ByteDance Seedance 2 — the scoreboard” with six shared dimension labels. Odyssey-3: an environment you act inside; live navigation and mid-run events; no audio; 832x480, 1280x720 Pro; /bin/bash.139 a video, Pro /bin/bash.267; no independent scoring yet. ByteDance Seedance 2: a fixed clip up to 15 seconds; text, image, audio and video references upfront; audio generated jointly with the video; resolution not published; no per-second list price published; not on Physics-IQ. Footer: “Odyssey-3 figures vendor-reported and unreproduced; Seedance 2 has no third-party score; Seedance 2.5, a later model, is on Physics-IQ at +3.59 pp”.

Gdzie każdy z nich faktycznie wygrywa

Jeśli twój problem brzmi: „Potrzebuję ujęcia”, konstrukcja Seedance 2 odpowiada dokładnie na to: multimodalne referencje oznaczają, że możesz mu przekazać wizerunek aktora, podkład dźwiękowy i ruch kamery, a otrzymać gotowy klip z dźwiękiem. Nic w wersji zapoznawczej Odyssey-3 tego nie robi i nic w materiałach premierowych nie sugeruje, że będzie. Piętnastosekundowy limit to realne ograniczenie, ale pięciosekundowy rollout modelu świata bez dźwięku też nim jest.

Jeśli twoim problemem jest „Muszę wiedzieć, co stanie się dalej”, kompromis działa w drugą stronę. Seedance 2 nie można zadać pytania kontrfaktycznego — masz jeden klip, a żeby zobaczyć inny wynik, ponownie wpisujesz prompt i dostajesz niepowiązany. Cała przesłanka Odyssey-3 opiera się na tym, że następny stan zależy od działania, które właśnie podjęto, i to czyni go użytecznym w polityce jazdy, dla ramienia robota lub w środowisku treningowym, w którym sekwencja liczy się bardziej niż ujęcie.

Dowody dotyczące dokładności fizycznej przemawiają za Odyssey-3, jeśli chodzi o mechanizm, nawet tam, gdzie kolumna z wynikami tego nie potwierdza: model jest oceniany na podstawie kontynuacji po zakłóceniu, co jest tą samą umiejętnością, którą reklamuje interaktywny podgląd. Wynik Seedance 2.5 wynoszący +3,59 p.p. na tej samej tablicy to mocny rezultat jak na generator klipów i, co godne uwagi, lepszy niż wynik Odyssey-3 na dopasowanym zestawie promptów — dlatego uczciwe podsumowanie brzmi: model wideo B​yteDance jest bardziej fizycznie wiarygodny, niż jakikolwiek model wideo ma prawo być, a nie, że Odyssey-3 został pokonany we własnej grze.

OrcaRouter's own model page for minimax/minimax-h3, showing the model header “text + image + video + audio”, output video, a p50 time-to-first-token of 406 ms, performance and vision/audio badges, and a Python code sample on the left with the model list and playground navigation above.

Dostanie się do któregokolwiek z nich

Żaden z tych modeli nie jest dziś dostępny do wywołania stąd. OrcaRouter nie hostuje Odyssey-3 ani B​yteDance Seedance 2 — Odyssey-3 nie ma opublikowanej ceny, która pozwalałaby komukolwiek kierować do niego ruch, a Seedance jest sprzedawany za pośrednictwem własnych platform B​yteDance.

To, do czego dociera pojedynczy klucz OrcaRouter, to reszta stosu wideo: MiniMax-H3 po 0,08 USD za sekundę wyjścia 768P, linię wideo K​ling w cenie od 0,084 do 0,28 USD za żądanie, oraz ponad 200 modeli łącznie, wszystko w cenie katalogowej dostawcy z 0% marży, więc zmiana ceny dostawcy jest widoczna na Twojej fakturze tego samego dnia, a nie przy odnowieniu. Automatyczne przełączanie awaryjne utrzymuje przebieg ewaluacji przy życiu, gdy jeden z upstreamów ulegnie degradacji, a DSL routingu umieszcza kilka modeli wideo za jednym interfejsem, dzięki czemu testowanie nowego generatora to zmiana konfiguracji, a nie integracja. Gdy któryś z tych dwóch udostępni endpoint samoobsługowy, to jest kształt, do którego należy go wstawić.

Co obejrzeć

Dwie rzeczy zmieniłyby to porównanie bardziej niż jakakolwiek aktualizacja benchmarku. Pierwsza to dźwięk: jeśli następna generacja Odyssey-3 będzie generować dźwięk wspólnie tak, jak robi to Seedance, „środowisko, w którym działasz” przestanie być węższą kategorią. Druga to niezależny zestaw testowy — strona trzecia uruchamiająca Seedance 2.0 i Odyssey-3 obok siebie na tych samych klipach, zamiast sytuacji, w której jeden pojawia się na tablicy, do której drugiego nigdy nie zgłoszono. Do tego czasu właściwa interpretacja Odyssey-3 w zestawieniu z ByteDance Seedance 2 jest taka, że nie są to dwaj kandydaci do tego samego zadania. To dwie odpowiedzi na różne pytania, a pytanie, które zadajesz, wybiera model za ciebie.