Titelkaart voor Odyssey-3 vs Wan 3.0, met Odyssey-3 als een onderzoekspreview vanaf 8 oktober 2026 zonder gepubliceerde prijs of API en een Physics-IQ Verified netto-verbetering van +11,15 pp op rang 02, tegenover Wan 3.0 als een API met gebruiksfacturering die sinds 24 augustus 2026 algemeen beschikbaar is voor 0,6 yuan per seconde voor 720p.
Guides & Insights

Odyssey-3 vs Wan 3.0: Een wereldmodel ontmoet een videofabriek

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Odyssey-3 and Wan 3.0 both get filed under "video model," and that shared label is carrying more weight than it can bear. Odyssey-3 is a learned dynamical system — a simulator that builds an environment from a prompt and predicts how that environment changes as someone moves through it or triggers an event — released by Odyssey on 8 October 2026 as a research preview. Wan 3.0 is a production video generator from A​libaba Cloud, generally available since its 24 August 2026 launch, billed by the second, and already scored on two independent leaderboards. One of these wants to be a place you put a camera. The other wants to be the thing that renders the footage you publish.

Put the two launch pages side by side and the split is immediate. Odyssey leads with physical accuracy — how well its model understands what objects do when they meet. A​libaba leads with throughput, duration and reference control: 30-second takes, native audio, up to ten images and five videos supplied per generation. Neither is a worse version of the other. They are answers to different questions, and the answers change what a team should do this week.

Een kadernoot voorafgaand aan de cijfers. De meeste cijfers in dit artikel komen uit het eigen lanceringsmateriaal van de leveranciers en zijn door niemand buiten die labs gereproduceerd. Waar een cijfer van een onafhankelijke instantie komt in plaats van een perspagina, vermeldt de tekst dat. Dat onderscheid is hier belangrijker dan gewoonlijk, omdat de twee modellen enorm uiteenlopende hoeveelheden controleerbare informatie publiceren — de ene verkoopt per seconde via een open API, de andere heeft helemaal geen prijs gepubliceerd.

Wat elk ervan eigenlijk is

Odyssey's eigen beschrijving van Odyssey-3 is ongewoon specifiek voor een lanceringsbericht, en het is de moeite waard om die te citeren in plaats van af te ronden: het is "een geleerd dynamisch systeem, geïmplementeerd als een autoregressieve diffusietransformer, dat voorspelt hoe objecten zich door de ruimte bewegen en op elkaar inwerken en hoe situaties zich in de loop van de tijd ontwikkelen." Het resultaat dat het teruggeeft is geen clip in de gebruikelijke zin. Het is een toestand die blijft evolueren terwijl hij wordt aangestuurd. Het model is verkrijgbaar in twee maten — Odyssey-3 op 832×480 en Odyssey-3 Pro op 1280×720 — en Odyssey zegt dat de preview navigatie in de eerste persoon en de derde persoon ondersteunt, naast onafhankelijke camerabeweging. De build bevat ook een gedistilleerde variant met enkele stappen, geproduceerd door een combinatie van distributiematching en adversariële distillatie, die de leverancier omschrijft als realtime interactief.

Wan 3.0 is a generator on the established model: a prompt and one or more references go in, a finished piece of video comes out. A​libaba's headline capabilities are a 30-second single-run generation, native audio, and reference inputs spanning text, image, video and audio — plus documents in doc, xls, ppt, pdf, md, txt, key, pages and numbers formats, up to 100 MB and 50 pages. Editing is instruction-based, meaning a generation can be modified in visuals, plot or dialogue without regenerating from scratch. A​libaba also states plainly that audio quality and on-screen text accuracy still need work, which is a rarer admission in a launch post than it should be and a useful one to have on the record.

• Wat de output is — een gesimuleerde omgeving waarin je handelt (Odyssey-3) versus een gerenderde clip die je publiceert (Wan 3.0) • Geafficheerde formaten — 832×480, of 1280×720 op Odyssey-3 Pro, versus 480p, 720p en 1080p • Lengte van één run — zolang de omgeving blijft worden aangestuurd, versus 30 seconden per generatie • Audio — bij geen van beide formaten een hoofdcapaciteit, versus native audio met door de leverancier aangegeven kwaliteitsbeperkingen • Invoer — een prompt die de omgeving definieert, versus tekst, afbeelding, video, audio en documenten tot 100 MB en 50 pagina's • Bewerkingsmodel — de toestand wijzigen en opnieuw simuleren, versus op instructies gebaseerde bewerkingen op een voltooide generatie • Gedocumenteerde API — niets gepubliceerd, versus open en met verbruiksmeting sinds 24 augustus 2026 • Gepubliceerde prijs — geen, versus 0,3 / 0,6 / 1,2 yuan per seconde bij 480p / 720p / 1080p

Wat één seconde output kost, en waarom de eenheden niet overeenkomen

Wan 3.0 is priced in the most legible unit available to a buyer: time. A​libaba's rates are 0.3 yuan (about $0.05) per second of generated video at 480p, 0.6 yuan (about $0.10) at 720p, and 1.2 yuan (about $0.20) at 1080p. A full 30-second run therefore lands near 9 yuan ($1.50) at 480p, 18 yuan ($3.00) at 720p, or 36 yuan ($6.00) at 1080p. Those are the August launch rates; the launch promotion that cut them by 30% ran only through 23 September, so the numbers above are the ones a buyer meets today. Providers that resell Wan 3.0 typically quote per-minute figures instead, which is worth checking against the per-second arithmetic before any budget is signed off.

Odyssey-3 heeft geen vergelijkbaar cijfer, omdat Odyssey geen prijs, tariefkaart, licentie of API-documentatie heeft gepubliceerd. Wat in plaats daarvan bestaat, is een kostenpost in een benchmark van een derde partij, berekend op basis van een aanname die de leverancier openlijk vermeldt: $1 per MI355X GPU-uur. Op die basis vermeldt Physics-IQ Verified Odyssey-3 Pro tegen $0,267 per gegenereerde video en Odyssey-3 tegen $0,139, beide genormaliseerd naar 24 FPS en 1280 brede output. Dezelfde ranglijst merkt afzonderlijk op dat het herschrijven van prompts via de API van Odyssey wordt geschat op $0,01 per ingediende video. Lees dat zorgvuldig — het is een modelleringsbasis, geen prijs. Het vertelt je wat een simulatie zou kosten tegen het door de leverancier veronderstelde hardwaretarief, niet wat Odyssey zal factureren.

Die twee feiten vormen een knelpunt voor een koper. Odyssey is een regelpost waarvan het slechtste scenario kan worden geschat voordat er ook maar één render plaatsvindt, en de gemodelleerde kosten per video komen zonder factuur om naar te verwijzen. Wil een vergelijking standhouden, dan heb je zowel een werkelijk tarief nodig als een geschat tarief zonder factuur erachter.

Two-column scoreboard comparing Odyssey-3 and Wan 3.0 across six dimensions: what you get, advertised sizes, single-run length, published price, documented API, and Physics-IQ Verified. Odyssey-3 returns a simulated environment, ships at 832x480 or 1280x720 on Odyssey-3 Pro, runs as long as it is driven, has no published price or documented API, and scores +11.15 pp at rank 02 on Physics-IQ Verified; Wan 3.0 returns a rendered clip, ships at 480p, 720p and 1080p, renders 30 seconds per run, costs 0.3 / 0.6 / 1.2 yuan a second, has been open and metered since 24 August 2026, and is not listed on that board.

Het enige scorebord dat ze gemeen hebben, en de naam die erop ontbreekt.

Physics-IQ Verified, een dynamische ranglijst van Anates Labs en DeepMind van hoe goed videomodellen met natuurkundige principes omgaan, is het enige onafhankelijke scorebord dat dit tweetal gemeen heeft — en het is daar waar de vergelijking echt interessant wordt, want het is ook daar waar ze uiteenvalt.

De lanceringspost van Odyssey stelt dat Odyssey-3 Pro "een nieuwe standaard zet voor de benchmark van Physics-IQ Verified en op de 1e plaats staat in 3 van de 4 categorieën van WorldMark." De WorldMark-helft daarvan klopt met de cijfers die Odyssey publiceert: eerste plaats in First-Person Stylized (77,2), Third-Person Real (79,0) en Third-Person Stylized (76,3), met First-Person Real op de tweede plaats met 80,6 achter de 83,0 van AlayaWorld en de 84,4 van Lyra 2.0. Elk van die cijfers is een door de leverancier gerapporteerd cijfer uit Odyssey's eigen evaluatieronde.

Het state-of-the-art-gedeelte is waar een lezer langzamer zou moeten lezen. Op de nu beschikbare versie van het Physics-IQ Verified-board, gerangschikt naar netto verbetering in procentpunten boven het trackgemiddelde, staat FLUX 3 [large] van Black Forest Labs op rang 01 met +12,27 pp. Odyssey-3 Pro staat op rang 02 met +11,15 pp, en Odyssey-3 staat op rang 03 met +9,99 pp. Dus de "nieuwe state of the art" van de leverancier is, op het board dat de leverancier zelf aanhaalt, een tweede plaats — hetzij omdat de claim dateert van vóór een boardupdate, hetzij omdat die nauwer is afgebakend dan de zin suggereert. Hoe dan ook, de eerlijke lezing is dat Odyssey-3 Pro een top-drie-fysicamodel is, niet een absolute leider. FLUX 3 [large] heeft ook een veel hogere kostprijs van $0,868 per video, tegenover $0,267 voor Odyssey-3 Pro, wat de afweging is die de kostenweergave van het board beoogt bloot te leggen.

Odyssey neemt in de uitsplitsing per submetriek wel één absolute eerste plaats in: Spatiotemporal, met 44,70, vóór Odyssey-3 Pro met 42,97 en Physis-Lang (Cosmos3 Super) met 41,57. Op Spatial staat het op de vierde plaats (59,17), achter FLUX 3 (64,36), Odyssey-3 Pro (61,78) en Physis-Lang (59,87); op Weighted Spatial en MSE staat het respectievelijk op de vierde en derde plaats. Dat patroon — een absolute leiderspositie in hoe goed beweging over de tijd samenhangt, op een tweede niveau wat betreft de ruimtelijke getrouwheid van afzonderlijke frames — is een coherente signatuur van een model dat is gebouwd om evolutie te simuleren in plaats van een mooi stilstaand beeld te renderen.

Nu de ontbrekende naam. Wan 3.0 komt helemaal niet voor op Physics-IQ Verified. De enige Wan-vermeldingen zijn Wan 2.2 14B op rang 17, −6,64 pp, en Wan 2.2 5B op rang 22, −11,13 pp — beide onder het gemiddelde van de track, beide open-source, beide een generatie achter. De eigen scope-notitie van het leaderboard zegt dat de ranglijst "gebenchmarkte modellen en modellen die bekend zijn uit preprints of aankondigingen omvat, zelfs als openbare toegang niet beschikbaar is of er geen releasedatum is bevestigd", dus de afwezigheid van Wan 3.0 is geen bewijs dat het slecht scoort. Het is bewijs dat niemand het op deze as heeft gemeten. De praktische consequentie is onomwonden: elke bewering dat Odyssey-3 Wan 3.0 verslaat op fysieke plausibiliteit is in beide richtingen niet geverifieerd, en elke bewering dat dat niet zo is, is eveneens niet geverifieerd. De onafhankelijke resultaten van Wan 3.0 staan elders — het eindigde als #2 overall op OpenArt Arena en als #1 in Video Editing with Audio op Artificial Analysis — op leaderboards die ervaren kwaliteit en montagekwaliteit meten, niet natuurkunde.

Wat je vandaag kunt bellen, en waarover je alleen maar kunt vragen

Wan 3.0 has been callable since 24 August 2026, when A​libaba Cloud's launch turned the metered, application-gated beta into a fully open API. The model is reachable through the vendor's own API and several third-party platforms, all of them metered, with the per-second rates above. If a team needs generated video this afternoon, that is a real option and it comes with a bill.

Odyssey-3 biedt dat niet. De pagina van Odyssey zegt dat de onderzoekspreview "nu beschikbaar" is en nodigt ontwikkelaars van fysieke AI uit om contact op te nemen — wat een demo en een gesprek beschrijft, niet een endpoint achter een sleutel. Er is geen gepubliceerde prijs, geen licentie, geen API-documentatie en, zoals de bovenstaande sectie laat zien, geen onafhankelijke evaluatie. Een ontwikkelaar die het lanceringsbericht leest, kan vandaag niet berekenen wat een productiebuild op Odyssey-3 zou kosten, of controleren of de natuurkundige claims standhouden buiten de eigen testomgeving van de leverancier. Dat is normaal voor een wereldmodel op de dag van lancering, en het is ook het allerbelangrijkste feit in deze vergelijking.

Aangezien geen van beide modellen in onze catalogus staat — de modellenlijst van OrcaRouter bevat geen Odyssey-3 en geen Wan 3.0 — is het nuttige routeringspunt de laag die daarboven ligt. Waarschijnlijk roept een videoproject niet één model aan. Het roept een promptherschrijvend model aan, een videomodel, soms een audiomodel, en het roept ze allemaal opnieuw aan telkens wanneer een leverancier een prijs of een limiet wijzigt. Bij OrcaRouter zitten die achter één API die meer dan 200 modellen dekt tegen de lijstprijs van de provider met 0% opslag, dus een prijsverlaging per seconde van een videoleverancier is hier dezelfde dag live in plaats van te wachten op een configuratiewijziging, en automatische failover betekent dat een storing van één model geen renderwachtrij blokkeert. De videomodellen die we wel aanbieden — MiniMax H3, Kling 3.0, Kling Video O1 en andere — zitten op dezelfde sleutel, wat de vervanging goedkoop maakt wanneer een Wan 3.0-preview of een Odyssey-3-proefversie eindelijk beschikbaar komt.

Capture of Odyssey's own 'Meet Odyssey-3' launch page, dated October 8th 2026, describing Odyssey-3 as a learned dynamical system implemented as an autoregressive diffusion transformer and inviting physical-AI developers to get in touch about the research preview.

Welke hoort thuis in jouw stack?

De keuze is niet moeilijk, omdat er geen overlap is in wat de twee voortbrengen. De eerlijke beslisregel gaat over het artefact dat je aan het einde nodig hebt.

Kies Wan 3.0 als het eindproduct beeldmateriaal is dat iemand bekijkt: een advertentie, een insertopname, een social cut, een lesfragment. Dertig seconden per run met native audio, referentiecontrole over afbeeldingen, video en audio, bewerking op basis van instructies en documenten als invoer is een lijst met productiefuncties, en de metered API betekent dat de kosten van een test vooraf kenbaar zijn. Het is een generatie, geen simulatie — de taak van het model eindigt wanneer de clip eindigt. Begroot op basis van de tarieven per seconde van de leverancier, en behandel de eigen kanttekeningen van de leverancier over audio en tekst op het scherm als ontwerpbeperkingen in plaats van als voetnoten.

Kies Odyssey-3, wanneer je er toegang toe kunt krijgen, als het op te leveren resultaat een gedrag is in plaats van een bestand: een omgeving waarin een policy leert, een scène waarvan de respons op een actie consistent moet blijven gedurende een lange rollout, een navigatie- of manipulatietaak waarbij de camera deel uitmaakt van het probleem. Dat is waar de onbetwiste eerste plaats voor ruimtelijk-temporele plausibiliteit en de gemodelleerde kosten van $0,139–$0,267 per video er echt toe doen. Wat ontbreekt, is alles wat een productieteam nodig heeft om zich vast te leggen — een prijs, een licentie, een endpoint en een externe meting — en geen daarvan kan door een demo worden vervangen.

Het punt om in de gaten te houden is specifiek en dichtbij. Als Wan 3.0 op Physics-IQ Verified verschijnt, wordt de natuurkundevraag in één richting beantwoordbaar. Als Odyssey een tariefkaart of een API publiceert, wordt de kostenkwestie in de andere richting opgelost. Tot een van die dingen gebeurt, heeft deze vergelijking een vreemde vorm: een productiesysteem met een gepubliceerde prijs en geen natuurkundescore, naast een simulator met gepubliceerde natuurkundescores en geen prijs. Iedereen die je vandaag vertelt welke beter is, gokt op minstens een van die twee getallen.

Capture of the Physics-IQ Verified leaderboard from Anates Labs and DeepMind, ranked by net improvement in percentage points above the track mean, showing FLUX 3 [large] first at +12.27 pp, Odyssey-3 Pro second at +11.15 pp and Odyssey-3 third at +9.99 pp, with Wan 2.2 14B at rank 17 and Wan 2.2 5B at rank 22 and no entry for Wan 3.0.