การ์ดชื่อเรื่องสำหรับบทความที่เปรียบเทียบ Odyssey-3 กับ Seedance 2.5 คำโปรยว่า "วินาทีของฟุตเทจ vs ชั่วโมงของการจำลอง" พร้อมชิปสถิติสามอันที่ระบุว่า "สร้าง 30 วินาทีในครั้งเดียว", "~$1.16 ต่อคลิป 5 วินาทีที่ 720p" และ "Odyssey-3: ไม่มีหน่วยในการขาย"
Guides & Insights

Odyssey-3 กับ Seedance 2.5: วินาทีของฟุตเทจ เทียบกับ ชั่วโมงของการจำลอง

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ถามว่า Seedance 2.5มีราคาเท่าไร คุณจะได้คำตอบเป็นดอลลาร์ต่อวินาที แต่ถามว่า Odyssey-3มีราคาเท่าไร กลับไม่ได้อะไรเลย — ไม่มีตารางราคา ไม่มีเอนด์พอยต์ ไม่มีสัญญาอนุญาต เพราะโมเดลที่ประกาศเมื่อวันที่ 15 กันยายน 2026 ยังไม่เปิดตัว และผู้พัฒนาก็เพียงให้สัญญาต่อสาธารณะว่า "ในอีกไม่กี่สัปดาห์ข้างหน้า" ช่องว่างนั้นดูเหมือนเป็นความต่างด้านความสมบูรณ์ของผลิตภัณฑ์ แต่แท้จริงแล้วส่วนใหญ่เป็นความต่างด้านประเภท Seedance 2.5 ซึ่งเปิดตัวโดยทีม Seed ของ ByteDance เมื่อวันที่ 31 กรกฎาคม 2026 เป็นเอนจินสำหรับงานผลิตที่ขายเป็นรายวินาทีของฟุตเทจสำเร็จรูปให้กับคนที่ต้องการฟุตเทจ ส่วน Odyssey-3 เป็นเวิลด์โมเดลที่มีอินเทอร์เฟซแบบแอกชัน และผู้ซื้อที่มันมุ่งเป้าไปหาไม่ได้ต้องการฟุตเทจเลย — ต้องการสภาพแวดล้อมที่ตอบสนองอย่างถูกต้องเมื่อมีบางสิ่งลงมือกระทำภายในนั้น ทั้งสองกำลังถูกนำไปใช้กับปัญหาบางอย่างเดียวกัน รวมถึงข้อมูลสำหรับหุ่นยนต์และการขับขี่ ซึ่งเป็นเหตุผลพอดีว่าทำไมความแตกต่างนี้จึงคุ้มค่าที่จะแยกให้ชัดเจน

Seedance 2.5 คือเอนจินระดับโปรดักชัน และพันธมิตรผู้ร่วมเปิดตัวก็แสดงให้เห็นเช่นนั้น

ความสามารถที่เป็นจุดขายหลักคือความยาว Seedance 2.5 สร้างได้ 30 วินาทีในการสร้างครั้งเดียว เป็นสองเท่าของรุ่นก่อนที่ 15 วินาที พร้อมการขยายต่อเนื่องหลายรอบสำหรับลำดับที่ยาวขึ้น และมีโหมดเบต้าความยาวพิเศษตามที่มีรายงานว่ายาวไปได้ไกลกว่านั้นอีก แค่นั้นก็เปลี่ยนจุดประสงค์ของโมเดลนี้แล้ว: 30 วินาทีคือหนึ่งฉาก ไม่ใช่แค่ช็อตเดียว และการตลาดของ ByteDance ใช้วลี “one-take” ด้วยเหตุผลนั้นพอดี

รายรอบความยาวดังกล่าวคือฟีเจอร์ที่ทำให้การสร้างหนึ่งครั้งใช้งานได้จริงในงานตัดต่อจริง โมเดลรองรับการอ้างอิงแบบหลายโมดัลอย่างหนัก — รายงานระบุว่าสูงถึงสามสิบภาพ คลิปวิดีโอสิบคลิป และคลิปเสียงสิบคลิปต่อการสร้างหนึ่งครั้ง โดยวิดีโอและเสียงอ้างอิงมีเพดานประมาณสามสิบวินาทีต่อรายการ และการอ้างอิงเฉพาะเสียงเป็นของใหม่ในเวอร์ชันนี้ มีโหมดอ้างอิงใหม่สำหรับการเรนเดอร์โมเดลสีขาวหรือเคลย์ เพลตกรีนสกรีน และการอ้างอิงด้านการเคลื่อนไหวและเชิงสร้างสรรค์ การควบคุมอยู่ในระดับไทม์สแตมป์ ทำให้พรอมป์ต์กำหนดเป้าหมายได้ทั้งเนื้อเรื่อง กล้อง หรือการเคลื่อนไหวภายในช่วงเวลาที่เจาะจง และการแก้ไขระดับพื้นที่หลังการสร้างยังคงรักษาความต่อเนื่องไว้ แทนที่จะบังคับให้สร้างใหม่ เสียงและวิดีโอถูกสร้างร่วมกันในรอบเดียว ดังนั้นการซิงก์ปากจึงสอดคล้องกับบทสนทนาที่อ้างไว้ และรองรับมากกว่าสิบภาษาโดยกำเนิด

รายชื่อผู้รับไปใช้คือสิ่งบอกใบ้ ในวันเปิดตัว XCMG, XPeng, Lingchu Intelligence, Weifen Zhifei และ Qiongche Intelligence ยืนยันความร่วมมือ และกรณีการใช้งานที่ระบุไว้มีตั้งแต่ข้อมูลฝึกสำหรับ embodied AI และกรณีขอบของการขับขี่อัตโนมัติ ไปจนถึงวิดีโอฝึก SOP สำหรับอุตสาหกรรม การศึกษา และโฆษณาอีคอมเมิร์ซ บางส่วนเป็นงานสร้างสรรค์ บางส่วนเป็นการสร้างข้อมูลสำหรับระบบที่จะลงมือกระทำต่อโลกในภายหลัง — ซึ่งเป็นส่วนที่ทับซ้อนกับ Odyssey-3

Seedance 2.5 หนึ่งวินาทีมีค่าใช้จ่ายเท่าไหร่

ราคาได้รับการเผยแพร่ และคิดตามจำนวนโทเค็นแทนที่จะคิดตามวินาที ซึ่งทำให้มีขั้นตอนการแปลงที่ควรทำก่อนที่คุณจะตัดสินใจใช้จ่ายจริง ตัวเลขที่รายงานสำหรับ endpoint ของ ModelArk คือ $10.70 ต่อล้านโทเค็นเมื่อไม่มีอินพุตวิดีโอ และ $6.40 ต่อล้านโทเค็นเมื่อมีอินพุตวิดีโอรวมอยู่ด้วย ในทางปฏิบัติ คิดออกมาได้ประมาณ $0.51 สำหรับคลิป 16:9 ความยาวห้าวินาทีที่ 480p และประมาณ $1.16 สำหรับคลิปเดียวกันที่ 720p นี่คืออัตราที่ผู้ขายเผยแพร่ตามที่รายงานตอนเปิดตัว ให้ถือว่าเป็นราคาตามรายการปัจจุบัน ไม่ใช่ต้นทุนต่อผลงานที่ส่งมอบซึ่งวัดได้จริง เพราะทั้งความละเอียดและความยาวต่างก็มีผลทำให้ราคาเปลี่ยนแปลง

ความพร้อมใช้งานมีข้อจำกัดที่ชัดเจน การเข้าถึงของผู้บริโภคดำเนินไปผ่านแอปของ ByteDance เอง ขณะที่การเข้าถึงผ่าน API แยกออกเป็น Volcano Engine Ark ในจีน และ BytePlus ModelArk ในระดับนานาชาติ ผู้จัดจำหน่ายอย่างน้อยหนึ่งรายระบุว่าโมเดลนี้ไม่พร้อมให้บริการในสหรัฐอเมริกา และแหล่งข้อมูลต่างๆ ขัดแย้งกันว่าความละเอียดที่รองรับสูงสุดอยู่ที่ 720p หรือขยายไปถึง 1080p — ความคลาดเคลื่อนนี้ควรค่าแก่การตรวจสอบเทียบกับเอกสารของผู้ผลิตเองก่อนที่คุณจะออกแบบโดยอิงกับความละเอียดใดความละเอียดหนึ่ง

นี่คือโมเดลประเภทที่ทำให้เลเยอร์การจัดเส้นทางมีที่ยืนด้วยเหตุผลเฉพาะเจาะจง: อัตราค่าบริการเปลี่ยนแปลงได้ ราคาวิดีโอต่อโทเคนที่เปลี่ยนไปครั้งหนึ่งตอนเปิดตัวก็จะเปลี่ยนอีกครั้ง และความต่างระหว่างโมเดลต้นทุนที่สร้างจากตัวเลขของวันนี้กับที่สร้างจากตัวเลขของไตรมาสที่แล้ว ก็คือความต่างระหว่างกำไรกับความเซอร์ไพรส์ OrcaRouter ส่งผ่านราคาตามรายการของผู้ให้บริการโดยบวกเพิ่ม 0% ดังนั้นการลดราคาของผู้ขายจึงมีผลฝั่งเราในวันเดียวกัน แทนที่จะรอถึงการต่อสัญญาครั้งถัดไป และการสลับไปใช้ระบบสำรองอัตโนมัติช่วยให้คิวการสร้างยังคงเดินหน้าต่อเมื่อปลายทางของผู้ให้บริการรายใดรายหนึ่งมีประสิทธิภาพลดลง — ซึ่งเป็นเรื่องของการจัดตารางเวลา ไม่ใช่เรื่องสมมติสำหรับงานด้านวิดีโอ ตัว Seedance 2.5 เองไม่ได้ถูกจัดเส้นทางผ่าน OrcaRouter แต่ให้บริการผ่านแพลตฟอร์มของ ByteDance เองและปลายทาง ModelArk ของบริษัท

Two-column scoreboard for Odyssey-3 and Seedance 2.5 across six shared dimensions — unit of sale, what you get, inputs, editing control, availability and partners. Seedance 2.5 reads tokens at roughly $0.51 per 5s at 480p, finished footage up to 30s, shipping since 31 Jul 2026; Odyssey-3 reads not published, next world state plus actions, announced 15 Sep 2026, Flexion on humanoids.

Odyssey-3 ไม่ได้ขายเป็นวินาที

Odyssey-3 ยังไม่มีหน่วยขาย ซึ่งนั่นคือประเด็นสำคัญ มันถูกอธิบายว่าเป็นโมเดลโลกพื้นฐานที่สามารถขับเคลื่อนหุ่นยนต์ ขับรถ ฝึก AI บังคับโดรน และเล่นวิดีโอเกม — ทรานส์ฟอร์เมอร์แบบดิฟฟิวชันออโตรีเกรสซีฟที่ฝึกบนชุดข้อมูลการสังเกตเชิงภาพจำนวนมาก ซึ่งผู้สร้างกล่าวว่าทำให้เกิดความเข้าใจที่เรียนรู้ได้เกี่ยวกับฟิสิกส์ พลวัต เหตุและผล และพฤติกรรมมนุษย์ การปรับตัวสำหรับงานใหม่ทำได้โดยฝึกตัวถอดรหัสการกระทำบนคู่การสังเกต-การกระทำ และคงโมเดลโลกที่ฝึกไว้ล่วงหน้าให้หยุดนิ่ง ดังนั้นนโยบายขนาดเล็กจึงอ่านตัวแทนที่หยุดนิ่งและส่งคำสั่งมอเตอร์

การสาธิตเหล่านี้ ทั้งหมดเป็นรายงานจากผู้ขายและไม่มีรายใดถูกทำซ้ำโดยอิสระ ครอบคลุมหกรูปแบบทางกายภาพ: แขนหุ่นยนต์จากข้อมูลการสาธิตหลายสิบชั่วโมง รวมถึงพฤติกรรมการกู้คืนที่ไม่ได้อยู่ในข้อมูล; นโยบายฮิวแมนนอยด์ที่สร้างด้วย Flexion จากเทเลโอเปอเรชันหลายสิบชั่วโมง ซึ่ง Odyssey กล่าวว่าสามารถวางนัยทั่วไปได้ดีกว่าฐานเปรียบเทียบ VLA ที่ทดสอบด้วย โดยไม่เผยแพร่ตัวเลข; การขับขี่แบบวงปิดในอินเดียจากข้อมูลจำลองยี่สิบชั่วโมง; การบินโดรนในร่มจากข้อมูลจำลอง; นโยบาย Grand Theft Auto V ที่ถ่ายโอนไปยัง Red Dead Redemption 2 และ Sleeping Dogs โดยไม่ต้องฝึกเพิ่มเติม โดยฟุตเทจ GTA ประมาณสองชั่วโมงก่อให้เกิดการเคลื่อนไหวขี่ม้าใน RDR2; และการสร้างสภาพแวดล้อมสำหรับฝึก AI อื่น ๆ ผ่านงาน PROWL

ตัวเลขที่เป็นรูปธรรมเพียงตัวเดียวคือ 77% — นโยบายการขับขี่ที่ฝึกด้วยการจำลองวิ่งได้ระยะทางระหว่างการแทรกแซงของพนักงานขับรถเพื่อความปลอดภัยคิดเป็นประมาณสัดส่วนเท่านี้ เมื่อเทียบกับนโยบายที่ฝึกด้วยภาพถ่ายจริง นั่นเป็นตัวเลขจากผู้จำหน่ายที่ไม่มีรายงานทางเทคนิคและไม่มีการตรวจสอบจากภายนอกรองรับ

Screenshot of Odyssey's “Introducing Odyssey-3: A General-Purpose Physical Intelligence” page, dated September 15th, 2026, showing the model subtitle “Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games” and the authors Oliver Cameron and Jeff Hawke.

หน่วยการขายเป็นตัวกำหนดว่าอะไรจะได้รับการปรับให้เหมาะสม

เมื่อคุณมองแบบจำลองทั้งสองในฐานะมิเตอร์ ไม่ใช่ในฐานะขีดความสามารถ ความแตกต่างระหว่างทั้งสองก็จะไม่ดูเหมือนฝ่ายหนึ่งนำหน้าอีกฝ่ายหนึ่งอีกต่อไป

โมเดลที่คิดค่าบริการตามวินาทีของเอาต์พุตจะถูกปรับให้เหมาะกับเอาต์พุตที่ทำให้ผู้ชมพึงพอใจ นั่นไม่ใช่ความทะเยอทะยานที่ต่ำลง แต่เป็นเป้าหมายที่แตกต่างออกไปซึ่งมีความยากเฉพาะตัว การที่ Seedance 2.5 สร้างวิดีโอต่อเนื่องยาวสามสิบวินาทีพร้อมบทสนทนาที่ซิงโครไนซ์และการควบคุมในระดับตราเวลา ถือเป็นผลลัพธ์ที่ยากอย่างแท้จริง และโหมดความล้มเหลวที่ใช้ตัดสินมัน ได้แก่ ใบหน้าตัวละครที่เพี้ยนเลื่อนไหล การตัดต่อที่ไม่ลงตัว และบทสนทนาที่หลุดซิงก์ ล้วนเป็นสิ่งที่คนในห้องตัดต่อจะสังเกตเห็น

แบบจำลองที่ถูกขอให้ทำนายสิ่งที่จะเกิดขึ้นต่อไปเมื่อตัวควบคุมกระทำการ ถูกปรับให้เหมาะสมสำหรับสิ่งที่ผู้ชมจะไม่มีวันตรวจสอบ: ว่าพลวัตจะคงอยู่ภายใต้ลำดับของการตัดสินใจหรือไม่ รวมถึงการตัดสินใจที่ไม่มีใครสาธิต นั่นคือเหตุผลที่ Odyssey รายงานพฤติกรรมการฟื้นตัวที่เกิดขึ้นจากข้อมูลหลายสิบชั่วโมง แทนที่จะรายงานความเที่ยงตรง และเหตุผลที่ข้อเรียกร้องเชิงปริมาณเพียงอย่างเดียวของมันถูกวัดจากการแทรกแซงของพนักงานขับรถเพื่อความปลอดภัย แทนที่จะวัดจากคุณภาพของภาพ ตัวเรนเดอร์สามารถผิดพลาดในแบบที่ผู้ชมให้อภัยได้ ตัวจำลองสามารถผิดพลาดในแบบที่ตัวควบคุมนำไปใช้กระทำการ และข้อผิดพลาดประเภทที่สองนั้นทบต้นกันตลอดการโรลเอาต์

จุดทับซ้อนของการใช้งานที่ประกาศไว้ — ข้อมูลฝึกหุ่นยนต์, กรณีขอบของการขับขี่อัตโนมัติ — คือจุดที่ทั้งสองมาบรรจบกัน และมันคือการแข่งขันจริงเพื่องบประมาณ มากกว่าตำแหน่งบน benchmark คำถามที่ทีมหุ่นยนต์ต้องเผชิญจริงๆ คือจะซื้อวินาทีที่เรนเดอร์ของโลกที่เป็นไปได้ หรือจะซื้อโมเดลพลวัตที่มีอินเทอร์เฟซการกระทำ และคำตอบขึ้นอยู่กับว่าผู้บริโภคปลายทางเป็นมนุษย์ผู้ตรวจทานหรือลูปการฝึก

เคียงข้างกัน

หน่วยจำหน่าย — Seedance 2.5: โทเคน ซึ่งคิดเป็นประมาณ $0.51 ต่อคลิปความยาว 5 วินาทีที่ 480p และ $1.16 ที่ 720p Odyssey-3: ไม่มีการเผยแพร่

สิ่งที่คุณได้รับต่อหนึ่งหน่วย — Seedance 2.5: ฟุตเทจที่เสร็จสมบูรณ์ ยาวสูงสุด 30 วินาทีในครั้งเดียว พร้อมเสียงและบทสนทนาที่ซิงโครไนซ์กัน Odyssey-3: สถานะโลกถัดไปที่คาดการณ์ไว้ บวกกับการสั่งการมอเตอร์สำหรับฮาร์ดแวร์ที่เชื่อมต่ออยู่

อินพุต — Seedance 2.5: ข้อความพร้อมภาพสูงสุด ~30 ภาพ, วิดีโอ 10 รายการ และคลิปเสียง 10 รายการ Odyssey-3: ตัวถอดรหัสการกระทำที่ฝึกบนคู่การสังเกต–การกระทำ เหนือโครงข่ายหลักที่ถูกตรึงค่าไว้

การควบคุมการตัดต่อ — Seedance 2.5: การกำหนดเป้าหมายระดับการประทับเวลาและการแก้ไขหลังการสร้างในระดับภูมิภาค Odyssey-3: ไม่สามารถใช้ได้ เนื่องจากไม่มีพื้นที่สำหรับการแก้ไข

พันธมิตรที่ระบุไว้ — Seedance 2.5: XCMG, XPeng และอีกสามรายในตอนเปิดตัว Odyssey-3: Flexion เกี่ยวกับนโยบายหุ่นยนต์ฮิวแมนนอยด์ ยังไม่มีการประกาศลูกค้าเชิงพาณิชย์

ความพร้อมใช้งาน — Seedance 2.5: เปิดให้บริการตั้งแต่ 31 กรกฎาคม 2026 โดยมีข้อจำกัดตามภูมิภาค Odyssey-3: ประกาศเมื่อ 15 กันยายน 2026 เปิดตัวสู่สาธารณะ "ในอีกไม่กี่สัปดาห์ข้างหน้า" ยังไม่มีกำหนดวันที่และยังไม่มีราคา

อันไหนที่ควรอยู่ในสแต็กของคุณ

ถ้าสิ่งที่ต้องส่งมอบคือวิดีโอที่คนจะดู Seedance 2.5 เป็นผลิตภัณฑ์ที่เปิดให้บริการแล้ว มีราคาที่ประกาศไว้ และมีชุดฟีเจอร์ที่กว้างขวาง และการตัดสินใจก็เป็นเรื่องปกติระหว่างสร้างเองกับซื้อ โดยมีข้อควรระวังสองประการที่ควรตรวจสอบก่อน ได้แก่ ความละเอียดที่คุณต้องการมีให้ใช้จริงบนปลายทางที่คุณเข้าถึงได้หรือไม่ และภูมิภาคของคุณมีให้บริการเลยหรือไม่ ระยะเวลาต่อครั้งที่ยาวนานขึ้นและการควบคุมเวลาของมันคือฟีเจอร์ที่เปลี่ยนเวิร์กโฟลว์มากที่สุด เพราะมันขจัดขั้นตอนการต่อภาพแทนที่จะปรับปรุงทีละเฟรม

หากสิ่งที่ต้องส่งมอบคือนโยบาย (policy) ที่ผ่านการฝึกหรือตัวควบคุม Seedance 2.5 ก็ไม่ใช่สิ่งทดแทน ไม่ว่าภาพที่ได้จะดูดีเพียงใด และ Odyssey-3 ก็มุ่งเป้ามาที่ปัญหาของคุณโดยไม่มีอะไรให้ซื้อ ข้ออ้างที่น่าติดตามคือแบ็กโบนที่ถูกแช่แข็ง: โมเดลที่ผ่านการฝึกมาแล้วหนึ่งโมเดลซึ่งเข้าถึงแขนกล หุ่นยนต์ฮิวแมนนอยด์ รถยนต์ โดรน และเกมสามเกมผ่านตัวถอดรหัสขนาดเล็ก เป็นการบอกว่าความเข้าใจทางกายภาพถ่ายโอนระหว่าง embodiment ได้มากน้อยเพียงใด และถ้ามันยังยืนได้ มันจะเปลี่ยนสิ่งที่ทีมหุ่นยนต์ต้องเก็บรวบรวม ยังไม่มีการทดสอบโดยใครก็ตามนอก Odyssey และไม่มีรายงานทางเทคนิค ไม่มีสัญญาอนุญาต และไม่มีราคา

สิ่งที่ต้องจับตาดูนั้นไม่หวือหวา: สำหรับ Seedance 2.5 คือราคาที่มีเสถียรภาพและคำชี้แจงความพร้อมให้บริการตามภูมิภาคที่ชัดเจน; สำหรับ Odyssey-3 คือรีโพซิทอรี สัญญาอนุญาต และบุคคลที่สามที่สามารถทำซ้ำผลลัพธ์ 77% ได้ จนกว่าจะมีรายการที่สอง ความแตกต่างระหว่างสองโมเดลนี้ไม่ใช่คุณภาพ หากแต่คือโมเดลหนึ่งเป็นผลิตภัณฑ์ ส่วนอีกโมเดลหนึ่งเป็นข้อโต้แย้ง

Infographic titled “What One Unit Buys” contrasting Seedance 2.5, billed per token, with a 5s clip costing about $0.51 at 480p and about $1.16 at 720p and up to 30s in a single pass, against Odyssey-3, which has no published price and reaches robot arms, humanoids, a car and a drone through a frozen backbone plus action decoder across six embodiments with no third-party runs.

OrcaRouter เก็บโมเดลกว่า 200 รายการไว้เบื้องหลัง API key เดียว ดังนั้นโมเดลวิดีโอที่คุณเลือกจึงไม่ใช่โมเดลเดียวที่คุณเรียกใช้ได้

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube