อินโฟกราฟิกสองการ์ดที่สร้างขึ้น หัวข้อ "Simulator vs Renderer" การ์ดซ้าย หัวเรื่อง Odyssey-3 มีข้อความว่า "โลกที่คุณลงมือทำได้" พร้อมแถวสำหรับเอาต์พุต (สถานะโลก + การกระทำ) ผู้ใช้งาน (นโยบายสำหรับหุ่นยนต์และการขับขี่) และราคา (ไม่เผยแพร่) การ์ดขวา หัวเรื่อง FLUX 3 Video มีข้อความว่า "ไฟล์ที่คุณรับชมได้" พร้อมแถวสำหรับเอาต์พุต (1080p SDR MP4) ผู้ใช้งาน (ผู้ชมและนักตัดต่อ) และราคา ($0.06-$0.29 ต่อวินาที)
Guides & Insights

Odyssey-3 vs FLUX 3 Video: เครื่องมือจำลองและตัวเรนเดอร์ไม่ใช่เครื่องมือเดียวกัน

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Odyssey-3 กับ FLUX 3 Video มักถูกนำมาเปรียบเทียบกันเพราะทั้งคู่สร้างวิดีโอของโลกที่ไม่มีอยู่จริง และความคล้ายคลึงกันก็จบลงประมาณนั้น FLUX 3 Video เป็นโมเดลสร้างวิดีโอของ Black Forest Labs ที่เปิดให้ใช้ทั่วไปตั้งแต่ 4 สิงหาคม 2026 ซึ่งเปลี่ยนพรอมป์หรือเฟรมเริ่มต้นให้เป็นวิดีโอ MP4 1080p SDR ความยาวสูงสุดยี่สิบวินาทีพร้อมเสียงในตัว โดยคิดราคาตามความยาวเอาต์พุตเป็นวินาที ส่วน Odyssey-3 เป็นโมเดลโลกพื้นฐานของ Odyssey ที่เปิดให้ดูตัวอย่างเมื่อ 15 กันยายน 2026 และยังไม่เปิดให้ใช้ทั่วไป ซึ่งจำลองว่าฉากหนึ่ง ๆ วิวัฒน์ไปอย่างไรภายใต้การกระทำต่าง ๆ และต่อตัวถอดรหัสที่เรียนรู้มาเพื่อเปลี่ยนการจำลองนั้นให้เป็นคำสั่งการเคลื่อนไหวสำหรับแขนหุ่นยนต์ ฮิวแมนนอยด์ รถยนต์ หรือโดรน ตัวหนึ่งเป็นตัวเรนเดอร์ คือสร้างภาพสังเกตการณ์ให้คนดู อีกตัวเป็นตัวจำลอง คือสร้างสถานะที่โปรแกรมสามารถลงมือทำอะไรได้ การจับสองตัวนี้มาเทียบกันตรง ๆ ก็ยังมีประโยชน์อยู่ดี ไม่ใช่เพื่อหาผู้ชนะ แต่เพราะสิ่งที่ทั้งสองตัวส่งออกมาคือสองสิ่งที่แตกต่างกัน ซึ่งหลายทีมในตอนนี้กำลังพยายามซื้อด้วยงบประมาณเพียงบรรทัดเดียว

ความแตกต่างคือสิ่งที่ออกมาจากโมเดล

วิธีที่สะอาดที่สุดในการรักษาความแตกต่างนี้ไว้คืออนุกรมวิธานที่ World Labs เผยแพร่สำหรับเวิลด์โมเดล ซึ่งจัดเรียงระบบตามว่าพวกมันส่งออกส่วนใดของลูปการรับรู้–การกระทำ ตัวเรนเดอร์ส่งออกการสังเกต — พิกเซล สำหรับดวงตามนุษย์ ซึ่งตัดสินจากความเที่ยงตรงทางภาพ ตัวจำลองส่งออกสถานะ — การแทนค่าโลกที่ซื่อตรงทางเรขาคณิตและฟิสิกส์มากพอที่ทั้งมนุษย์และโปรแกรมจะใช้คำนวณต่อได้ ตัววางแผนส่งออกการกระทำ FLUX 3 Video เป็นเรนเดอร์อย่างเต็มตัว และเป็นเรนเดอร์ที่ยอดเยี่ยม Odyssey-3 กำลังมุ่งเป้าไปที่คอลัมน์ตัวจำลอง โดยมีเท้าข้างหนึ่งอยู่ในคอลัมน์ตัววางแผน เพราะตัวถอดรหัสการกระทำคือสิ่งที่ทำให้การจำลองขับเคลื่อนฮาร์ดแวร์ได้

นั่นไม่ใช่ความแตกต่างทางการตลาด และมันมีการทดสอบเชิงปฏิบัติอย่างหนึ่ง เรนเดอร์ห้องด้วยโมเดลวิดีโอ เดินมุมมองของคุณออกไปจากห้องนั้น แล้วหันกลับมา: เฟอร์นิเจอร์อาจไม่อยู่ในตำแหน่งที่คุณทิ้งไว้ เพราะโมเดลทำนายทีละเฟรมและไม่เคยยึดโลกที่คงอยู่ถาวรไว้เลย ถามซิมูเลเตอร์ด้วยคำถามเดียวกัน และคำตอบควรจะเสถียร เพราะจุดสำคัญของโมเดลคือสถานะที่อยู่ใต้เฟรมเหล่านั้น ประกาศของ Odyssey เองก็อาศัยสิ่งนี้ — เหตุผลในการสร้างโมเดลพลวัตแทนที่จะเป็นตัวสร้างวิดีโอคือ นโยบายที่ฝึกภายในนั้นสามารถประเมินและปรับปรุงได้ ไม่ใช่แค่ดู

A generated two-column scoreboard for Odyssey-3 vs FLUX 3 Video using the same six dimension labels on both sides: output, consumer, max length, audio, price and availability. Odyssey-3 reads world state + actions, robot and driving policies, continuous rollout, none, not published, preview only. FLUX 3 Video reads 1080p SDR MP4, viewers and editors, 20s single pass, native, $0.06-$0.29 per second, GA 2026-08-04. The footer reads "Odyssey-3 vendor-reported and unreleased; FLUX 3 Video specs per Black Forest Labs."

FLUX 3 Video โดยเฉพาะ

Black Forest Labs เปิดตัว FLUX 3 Video เมื่อวันที่ 4 สิงหาคม 2026 และเอกสารสเปกของมันมุ่งเป้าไปที่ผลลัพธ์ระดับงานโปรดักชันมากกว่าการจำลอง มันสร้างวิดีโอได้นานสูงสุด 20 วินาทีในการเรนเดอร์ครั้งเดียว ที่ความละเอียดสูงสุด 1080p ในรูปแบบ SDR เป็นไฟล์ MP4 พร้อมเสียงแบบเนทีฟที่สร้างขึ้นควบคู่ไปกับภาพ การคิดราคาคิดตามวินาทีของวิดีโอที่สร้างขึ้น: ระดับดราฟต์ 720p ราคา $0.06 ต่อวินาที ระดับมาตรฐาน 720p ราคา $0.17 และ 1080p ราคา $0.29 โดยงาน video-to-video มีราคาสูงกว่าระดับเหล่านั้น นี่เป็นตัวเลขจากผู้จำหน่าย

ตัวเลขเบนช์มาร์กเพียงตัวเดียวที่ Black Forest Labs แนบมากับมันคือ Elo ภายใน 1,135 สำหรับ text-to-video ซึ่งเป็นการประเมินที่ผู้ขายจัดทำเองและยังไม่เคยถูกทำซ้ำโดยอิสระ — ปัจจุบัน FLUX 3 Video ไม่ปรากฏอยู่บนตารางจัดอันดับวิดีโออิสระ ให้ถือว่าอันดับนั้นเป็นเพียงคำกล่าวอ้าง สิ่งที่ไม่อยู่ในข้อสงสัยคือการส่งมอบ: API ที่มีราคา มีเอกสารกำกับ คิดค่าบริการรายวินาที และส่งคืนไฟล์ ตั้งแต่วันนี้

Odyssey-3 โดยเฉพาะ

Odyssey-3 เป็นพรีวิวที่มีสถาปัตยกรรมให้เห็นแต่ยังไม่มีราคา มันเป็นทรานส์ฟอร์เมอร์แบบแพร่กระจายเชิง autoregressive ที่ฝึกบนการสังเกตทางภาพ และจุดเด่นที่ทำให้แตกต่างคือตัวถอดรหัสการกระทำ (action decoder) — "องค์ประกอบเอาต์พุตที่เรียนรู้ได้ซึ่งแนบอยู่กับโมเดลโลก" ตามคำของ Odyssey ซึ่งฝึกบนคู่การสังเกต-การกระทำ เพื่อแปลการแทนค่าภายในของโมเดลให้เป็นการกระทำที่ฮาร์ดแวร์ชิ้นหนึ่งต้องการ Odyssey รายงานว่ามันขับเคลื่อนแขนหุ่นยนต์จากข้อมูลสาธิตหลายสิบชั่วโมง, นโยบายหุ่นยนต์ฮิวแมนนอยด์ที่สร้างด้วย Flexion แบบเรียลไทม์, การขับขี่แบบปิดลูปจากข้อมูลจำลอง 20 ชั่วโมง, การบินโดรนหลบสิ่งกีดขวางในอาคาร, และการเล่นต่อเนื่องใน Grand Theft Auto V โดยถ่ายโอนไปยัง Red Dead Redemption 2 และ Sleeping Dogs ได้โดยไม่ต้องฝึกนโยบายเพิ่มในเกมเหล่านั้น บริษัทยังรายงานตัวเลขเปรียบเทียบหนึ่งค่า: นโยบายการขับขี่ที่ฝึกด้วยการจำลองเดินทางได้ประมาณ 77% ของระยะทางระหว่างการแทรกแซงของพนักงานขับเพื่อความปลอดภัย เมื่อเทียบกับนโยบายที่ฝึกด้วยฟุตเทจจริง ยังไม่มีการทดสอบมาตรฐานอิสระ ไม่มีรายงานทางเทคนิคสำหรับ Odyssey-3 และไม่มีวันเปิดตัวที่ชัดเจนนอกเหนือจาก "อีกไม่กี่สัปดาห์ข้างหน้า" ตัวเลขทุกตัวเป็นของ Odyssey เอง

ความแตกต่าง ทีละมิติ

เอาต์พุตของมัน — FLUX 3 Video: ไฟล์ MP4 ของพิกเซล Odyssey-3: สถานะโลกจำลอง พร้อมด้วยการกระทำเชิงมอเตอร์ผ่านตัวถอดรหัสการกระทำ

ใครเป็นผู้ใช้งานมัน — FLUX 3 Video: คนที่กำลังรับชม หรือคนตัดต่อที่กำลังตัดต่อชิ้นงานให้เสร็จ Odyssey-3: ตัวควบคุมหุ่นยนต์ นโยบายการขับขี่ หรือ RL agent ที่กำลังถูกฝึก

เอาต์พุตสูงสุด — FLUX 3 Video: สูงสุด 20 วินาทีต่อการรันหนึ่งครั้ง สูงสุด 1080p SDR พร้อมเสียงแบบเนทีฟ Odyssey-3: ปล่อยต่อเนื่องได้ตราบเท่าที่การจำลองยังคงทำงานอยู่ ที่อัตราเฟรมใดก็ตามที่การติดตั้งใช้งานต้องการ

ราคา — FLUX 3 Video: $0.06/วินาที ฉบับร่าง 720p, $0.17/วินาที 720p, $0.29/วินาที 1080p (ผู้จำหน่าย) Odyssey-3: ไม่มีการเผยแพร่

ความพร้อมใช้งาน — FLUX 3 Video: GA ตั้งแต่ 2026-08-04 Odyssey-3: พรีวิว เผยต่อสาธารณะว่า "ในอีกไม่กี่สัปดาห์ข้างหน้า"

เกณฑ์มาตรฐาน — FLUX 3 Video: ค่า Elo จากผู้ขาย 1,135 T2V ยังไม่มีผู้ใดทำซ้ำได้ และไม่ปรากฏอยู่ในบอร์ดจัดอันดับอิสระ Odyssey-3: ไม่มีตารางเกณฑ์มาตรฐาน มีเพียงตัวเลข sim-to-real จากผู้ขายเพียงค่าเดียว

ความไม่สมมาตรของราคาคือพาดหัวข่าวที่ตรงไปตรงมา

ในสองสิ่งนี้ สิ่งหนึ่งมีราคา แต่อีกสิ่งหนึ่งไม่มี และข้อเท็จจริงเพียงข้อเดียวนี้บอกคุณเกี่ยวกับการเลือกระหว่างทั้งสองได้มากกว่าคำกล่าวอ้างเรื่องความสามารถใด ๆ FLUX 3 Video มีค่าใช้จ่ายแบบคิดตามปริมาณต่อวินาทีของผลลัพธ์ ดังนั้นทีมจึงสามารถคำนวณค่าใช้จ่ายของคลิปหนึ่งร้อยคลิปก่อนที่จะสร้างคลิปแรกได้ Odyssey-3 ไม่มีราคาที่เผยแพร่ ไม่มี API และไม่มีวันที่ ดังนั้นค่าใช้จ่ายในการใช้งานจึงยังไม่อาจทราบได้ในขณะนี้ — และรูปแบบของบิลก็เช่นกัน โมเดลโลก (world models) ชนิดที่ Odyssey อธิบายไว้มักถูกคิดค่าบริการแตกต่างจากการสร้างวิดีโออย่างมาก ไม่ใช่ต่อวินาทีของพิกเซลที่สวยงาม แต่เป็นต่อชั่วโมงของการจำลอง เนื่องจากผู้ใช้คือลูปการฝึกที่อาจทำงานหลายล้านสเต็ป การเปรียบเทียบ $0.29 ต่อวินาทีกับความว่างเปล่าไม่ใช่การเปรียบเทียบ และหน้าเว็บใดที่นำเสนอเสมือนว่าเป็นการเปรียบเทียบก็กำลังเติมช่องว่างด้วยการคาดเดา

ที่ที่พวกเขาจะได้เจอกันจริง ๆ

ทั้งสองไม่ใช่สิ่งทดแทนกัน และคำถามที่น่าสนใจกว่าคือพวกมันประกอบเข้าด้วยกันได้หรือไม่ FLUX 3 Video เป็นเครื่องมือที่ดีกว่าสำหรับทุกอย่างที่ผลลัพธ์สุดท้ายเป็นไฟล์ที่มนุษย์ดู เช่น ช็อตผลิตภัณฑ์ ตัวแปรโฆษณา ฉบับตัดสั้นสำหรับโซเชียล หรือพรีวิชูอัลไลเซชัน Odyssey-3 หากทำได้จริง จะเป็นเครื่องมือที่ดีกว่าสำหรับทุกอย่างที่ผลลัพธ์สุดท้ายเป็นนโยบายที่ต้องทำงานในโลกกายภาพ หรือฉากที่โปรแกรมต้องใช้เหตุผลเกี่ยวกับมัน ในไปป์ไลน์ภาพยนตร์หรือเกม การจัดวางที่เป็นไปได้ไม่ใช่แบบเลือกอย่างใดอย่างหนึ่ง — โมเดลโลกสร้างสภาพแวดล้อมแบบอินเทอร์แอกทีฟ และตัวเรนเดอร์ผลิตเฟรมที่ขัดเกลาแล้วซึ่งออกจากอาคาร

ปัจจุบันมีข้อจำกัดจริง ๆ ต่อการคอมโพสิตนั้น และนั่นคือข้อจำกัดด้าน SDR FLUX 3 Video ส่งออกเป็น SDR MP4 Odyssey-3 ส่งออกเป็นสภาพแวดล้อมจำลอง ไม่ใช่ไฟล์ที่ผ่านการเกรดสี ทั้งสองไม่ใช่เครื่องมือ finishing สำหรับ HDR ดังนั้นไปป์ไลน์ที่จบลงด้วยงานส่งมอบสำหรับการออกอากาศหรือโรงภาพยนตร์จึงยังต้องมีขั้นตอน mastering หลังจากทั้งสองตัวนั้น

การกำหนดเส้นทาง และสิ่งที่ครอบคลุมและไม่ครอบคลุมในส่วนนี้

วันนี้ยังไม่มีโมเดลใดในสองตัวนี้ที่กำหนดเส้นทางผ่าน OrcaRouter ได้ FLUX 3 Video เปิดให้บริการผ่าน API ของ Black Forest Labs เองและแพลตฟอร์มของบุคคลที่สามอีกหลายแห่ง ส่วน Odyssey-3 ไม่มีให้บริการจาก任何人 เพราะยังไม่เปิดตัว จุดที่เลเยอร์การกำหนดเส้นทางพิสูจน์คุณค่าในไปป์ไลน์แบบนี้คือเลเยอร์ที่อยู่เหนือโมเดลวิดีโอขึ้นไป — โมเดลภาษาที่ร่างรายการช็อต โมเดลวิชันที่ตรวจสอบเฟรมที่สร้างขึ้นเทียบกับบรีฟ โมเดลถอดเสียงที่เปลี่ยนวอยซ์โอเวอร์ที่บันทึกไว้ให้เป็นคำบรรยาย งานเหล่านี้เป็นเวิร์กโหลดที่กำหนดเส้นทางได้ตามปกติ และอยู่บนAPI เดียวที่ครอบคลุมโมเดลกว่า 200 รายการ ในราคาตามที่ผู้ให้บริการประกาศ โดยบวกเพิ่ม 0% ดังนั้นเมื่อผู้ให้บริการลดราคา ค่าใช้จ่ายของคุณก็ลดลงในวันเดียวกัน ไม่ต้องรอถึงการต่อสัญญาครั้งถัดไป DSL สำหรับการกำหนดเส้นทางคือส่วนที่สำคัญสำหรับไปป์ไลน์หลายขั้นตอน: โมเดลหลายตัวประกอบเข้าด้วยกันเป็นการเรียกครั้งเดียว พร้อมด้วยการสลับไปใช้ระบบสำรองอัตโนมัติเมื่อผู้ให้บริการมีประสิทธิภาพลดลง ขั้นตอนการเรนเดอร์จึงไม่ล้มเหลวเพียงเพราะปลายทางของโมเดลพรอมป์ต์กำลังมีปัญหาช่วงบ่าย ทั้งหมดนี้ไม่ได้โฮสต์ FLUX 3 Video หรือ Odyssey-3 และบทความนี้ก็ไม่ได้อ้างเช่นนั้น

A screenshot of Odyssey's own announcement page for Odyssey-3, dated September 15th 2026, headed "Introducing Odyssey-3: A General-Purpose Physical Intelligence", with the summary line that Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games.

อันไหน สำหรับใคร

ถ้าสิ่งที่คุณต้องส่งมอบคือไฟล์ — ไม่ว่าจะเป็นคลิป งานตัดทอน หรือภาพพรีวิชวลไลเซชัน — FLUX 3 Video คือตัวเลือกที่คุณซื้อได้วันนี้ ในราคาต่อวินาทีที่ประกาศไว้ พร้อมเสียงในตัวและเอาต์พุต 20 วินาทีแบบรอบเดียว และคำกล่าวอ้างเรื่อง Elo ของผู้ขายก็เป็นโบนัสที่สมเหตุสมผล มากกว่าจะเป็นเหตุผลหลักในการเลือกใช้มัน ถ้าสิ่งที่คุณต้องส่งมอบคือคอนโทรลเลอร์ที่ต้องทำงานบนฮาร์ดแวร์จริง Odyssey-3 คือตัวที่มุ่งเป้ามาที่ปัญหาของคุณ และคำแนะนำที่ตรงไปตรงมาคือให้รอ: ยังไม่มีราคา ยังไม่มีกำหนดวัน และยังไม่มีตัวเลขอิสระใด ๆ และตัวเลข sim-to-real 77% นั้นเป็นของ Odyssey เองและยังไม่มีการทำซ้ำ

สิ่งที่ต้องจับตาไม่ใช่ว่าโมเดลใดชนะ เพราะพวกมันไม่ได้แข่งกัน แต่เป็นคำถามว่าตัวถอดรหัสการกระทำของ Odyssey-3 จะทำงานได้ทั่วไปกับ embodiment ทั้งหกแบบที่ประกาศระบุไว้หรือไม่ เมื่อกลุ่มภายนอกสามารถรันมันได้ นั่นคือข้อกล่าวอ้างที่มีอัปไซด์มากที่สุดหากเป็นจริง และหลักฐานปัจจุบันสำหรับเรื่องนี้คือรายการสาธิต ไม่ใช่การวัดผล

A screenshot of Artificial Analysis's Video Model Comparisons page, showing the Video Arena Quality Elo chart and the representative price-per-minute chart across 15 of 37 video models, including Kling 3.0 at 720p and 1080p, Wan 3.0, MiniMax H3 Max and Gemini Omni Flash.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube