อินโฟกราฟิกไทม์ไลน์ที่สร้างขึ้นชื่อ “งานวิจัยแนวหน้า vs โปรดักชัน” มีมาร์กเกอร์สำหรับ Google Veo 3.1 ที่ GA 2025-11-17 พร้อมคำบรรยายว่า “อยู่ในโปรดักชันมาแล้วสิบเดือน” และมาร์กเกอร์สำหรับ Odyssey-3 ที่พรีวิว 2026-09-15 พร้อมคำบรรยายว่า “ไม่มีราคา ไม่มีกำหนด” รวมถึงแถวสรุปสำหรับ Veo 3.1 (4K แบบเนทีฟ, เสียง 48kHz แบบเลือกได้, ประมาณ $0.20-$0.40 ต่อวินาที) และ Odyssey-3 (จำลองสถานะ, ขับเคลื่อนฮาร์ดแวร์, ยังไม่เปิดเผยราคา)
Guides & Insights

Odyssey-3 vs Google Veo 3.1: ฟิสิกส์สุดขอบแดนปะทะสิบเดือนแห่งการผลิต

ผู้เขียน

Magnus Corvin

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

การเปรียบเทียบระหว่าง Odyssey-3 กับ Veo 3.1 จริงๆ แล้วคือการเปรียบเทียบระหว่างสองวันที่ Veo 3.1 พร้อมใช้งานทั่วไปตั้งแต่วันที่ 17 พฤศจิกายน 2025 — มีการใช้งานจริงในงานผลิตมาแล้วสิบเดือน มีการเผยแพร่ราคาต่อวินาที รองรับ 4K แบบเนทีฟ และมีสแตกการให้บริการที่ผ่านการตรวจสอบระดับองค์กรมาอย่างน้อยหนึ่งครั้ง ส่วน Odyssey-3 นั้น Odyssey เปิดตัวอย่างก่อนกำหนดเมื่อวันที่ 15 กันยายน 2026 ยังไม่มีราคาที่เผยแพร่ ไม่มีเอกสาร API ไม่มีการวัดประสิทธิภาพอิสระ และมีกำหนดเปิดตัวใน "อีกไม่กี่สัปดาห์ข้างหน้า" การนำทั้งสองมาเทียบเคียงกันก็ยังคุ้มค่าที่จะทำ เพราะเหตุผลที่ทั้งคู่ถูกพูดถึงร่วมกันนั้นเป็นเรื่องจริง: Veo 3.1 เรนเดอร์วิดีโอที่สวยงาม และ Odyssey-3 กำลังพยายามจำลองโลกที่ตอบสนองอย่างถูกต้องภายใต้การควบคุม นั่นคือผลิตภัณฑ์สองแบบที่ทีมต่างๆ ยังคงหลอมรวมกันภายใต้คำว่า "วิดีโอ" และช่องว่างระหว่างทั้งสองก็คือจุดที่การตัดสินใจซื้อเกิดขึ้นจริง

สิบเดือนของการส่งมอบได้อะไรให้คุณบ้าง

ข้อได้เปรียบของ Veo 3.1 ไม่ใช่ฟีเจอร์ แต่คือเวลาที่ผ่านไป โมเดลนี้อยู่ในมือลูกค้าที่จ่ายเงินมาตั้งแต่เดือนตุลาคม 2025 ในฐานะพรีวิว และตั้งแต่ 17 พฤศจิกายนในฐานะผลิตภัณฑ์ GA โดยมีระดับ Lite เพิ่มเมื่อ 31 มีนาคม 2026 และระดับฟรีเมื่อ 2 เมษายน ประวัติเช่นนี้ก่อให้เกิดสิ่งที่พรีวิวทำไม่ได้: ชุด API ที่มีเอกสารประกอบ ชุดรูปแบบความล้มเหลวที่ผู้ใช้งานจริงได้ทำแผนที่ไว้แล้ว และเส้นโค้งต้นทุนที่ทีมการเงินสามารถสร้างแบบจำลองได้

สเปกชีตสะท้อนความสมบูรณ์แบบเดียวกันนี้ Veo 3.1 สร้างที่ 720p, 1080p และ 4K แบบเนทีฟ ที่ 24 เฟรมต่อวินาที ในระยะเวลาแบบเนทีฟ 4, 6 หรือ 8 วินาที โดยมีรายงานว่าเอาต์พุตที่ยาวขึ้นอยู่ที่ 1080p และมีการเชื่อมต่อแบบขยายฉากได้ไกลกว่านั้นอีก มันรับภาพอ้างอิงได้สูงสุดสามภาพเพื่อความสม่ำเสมอของตัวละครและฉาก พร้อมการควบคุม seed และ negative prompt เอาต์พุตมีข้อมูลเมตาเพื่อพิสูจน์ที่มาของ SynthID และ C2PA สำหรับงานแบรนด์ งาน broadcast หรืองานจอขนาดใหญ่ เส้นทาง 4K แบบเนทีฟคือความสามารถเดียวที่คู่แข่งส่วนใหญ่ในตลาดไม่มี — และนั่นคือเหตุผลที่ Veo 3.1 ยังคงชนะโปรเจกต์ที่มันไม่ได้ชนะด้วยราคา

A generated two-column scoreboard for Odyssey-3 vs Google Veo 3.1 sharing six dimension labels: output, max resolution, clip length, audio, price, availability. Odyssey-3 reads world state + actions, not a renderer, continuous rollout, none, not published, preview only. Google Veo 3.1 reads rendered clip, native 4K, 4/6/8s native, 48kHz stereo off by default, ~$0.20/s silent and ~$0.40/s with audio, GA 2025-11-17. Footer: "Odyssey-3 vendor-reported and unreleased; Veo 3.1 figures per Google's published rates."

ค่าเริ่มต้นด้านเสียงที่บิดเบือนทุกการเปรียบเทียบอย่างเงียบ ๆ

Veo 3.1 สร้างเสียงสเตอริโอ 48kHz แบบเนทีฟ — บทสนทนา เสียงบรรยากาศ เสียงประกอบ — ไปพร้อมกับภาพ ซึ่งเป็นหนึ่งในคุณสมบัติที่แข็งแกร่งที่สุดอย่างแท้จริง แต่บน API พารามิเตอร์เสียงมีค่าเริ่มต้นเป็นปิด และการสร้างแบบไม่มีเสียงมีราคาต่ำกว่าการสร้างแบบมีเสียง ในระดับ Standard ที่ Google เผยแพร่ คิดออกมาเป็นประมาณ $0.20 ต่อวินาทีสำหรับแบบไม่มีเสียง เทียบกับประมาณ $0.40 ต่อวินาทีสำหรับแบบมีเสียง ผลที่ตามมามีสองประการ ประการแรก ราคาที่แท้จริงของคลิป Veo ขึ้นอยู่กับแฟล็กที่คนส่วนใหญ่ไม่เคยเปลี่ยนโดยสิ้นเชิง ดังนั้นตัวเลข "$0.20 ต่อวินาที" และตัวเลข "$0.40 ต่อวินาที" จึงถูกต้องทั้งคู่สำหรับโมเดลเดียวกัน ประการที่สอง และที่ละเอียดอ่อนกว่านั้น หมายความว่าการทดสอบแบบตัวต่อตัวจำนวนมากที่คุณอ่านมา ได้นำ Veo 3.1 แบบไม่มีเสียงไปเปรียบเทียบกับคู่แข่งที่เปิดเสียงตลอดเวลา แล้วให้คะแนนบนลีดเดอร์บอร์ดที่คำนึงถึงเสียง หากผลลัพธ์ของคุณต้องการเสียง ตัวเลขที่ซื่อสัตย์ในการวางแผนคือตัวเลขแบบเปิดเสียง

สิ่งที่ Odyssey-3 กำลังกล่าวอ้างจริง ๆ

Odyssey-3 ไม่ใช่เครื่องสร้างวิดีโอที่ดีกว่า และไม่ได้อ้างว่าเป็นเช่นนั้น มันคือทรานส์ฟอร์เมอร์แบบดิฟฟิวชันออโตเรเกรสซีฟที่ฝึกบนการสังเกตเชิงภาพของโลก และความสามารถที่เป็นหัวใจของการประกาศครั้งนี้คือตัวถอดรหัสการกระทำ — "องค์ประกอบเอาต์พุตที่เรียนรู้ได้ซึ่งติดอยู่กับเวิลด์โมเดล" ที่เปลี่ยนการแทนค่าฉากภายในของโมเดลให้เป็นคำสั่งมอเตอร์สำหรับฮาร์ดแวร์เฉพาะ Odyssey รายงานว่ามันควบคุมแขนหุ่นยนต์จากข้อมูลสาธิตหลายสิบชั่วโมง ขับเคลื่อนนโยบายฮิวแมนนอยด์ที่สร้างด้วย Flexion แบบเรียลไทม์ สร้างเวย์พอยต์การขับขี่แบบวงปิดจากแบ็กโบนที่แช่แข็งซึ่งฝึกบนข้อมูลจำลอง 20 ชั่วโมง บินโดรนในอาคารโดยหลบหลีกสิ่งกีดขวาง และเล่น Grand Theft Auto V โดยถ่ายโอนไปยัง Red Dead Redemption 2 และ Sleeping Dogs ได้โดยไม่ต้องฝึกนโยบายเพิ่มเติมกับเกมเหล่านั้น ตัวเลขเปรียบเทียบเพียงตัวเดียวที่เปิดเผยคือ ระหว่างการแทรกแซงของผู้ขับเพื่อความปลอดภัยแต่ละครั้ง นโยบายการขับขี่ที่ฝึกด้วยการจำลองเดินทางได้ไกลประมาณ 77% ของนโยบายที่ฝึกจากฟุตเทจจริง

สังเกตว่าข้ออ้างเหล่านั้นเป็นข้ออ้างประเภทใด ไม่มีข้อใดเกี่ยวกับว่าผลลัพธ์ดูเป็นอย่างไร ทุกข้อล้วนเกี่ยวกับสิ่งที่โปรแกรมที่อยู่ปลายน้ำของโมเดลสามารถทำกับมันได้

มิติที่ไม่ทับซ้อนกัน

เอาต์พุต — Google Veo 3.1: คลิปที่เรนเดอร์แล้ว ความละเอียดสูงสุดถึง 4K แบบเนทีฟ พร้อมเสียงสเตอริโอ 48kHz แบบเลือกได้ Odyssey-3: สถานะโลกจำลอง พร้อมการเคลื่อนไหวของมอเตอร์ผ่านตัวถอดรหัสการกระทำ

ผู้บริโภค — Google Veo 3.1: โปรแกรมสำหรับดูหรือโปรแกรมสำหรับตัดต่อ Odyssey-3: ตัวควบคุมหุ่นยนต์ นโยบายการขับขี่ หรือลูปการฝึก

ความยาวคลิป — Google Veo 3.1: 4/6/8 วินาทีแบบเนทีฟ, ที่ 1080p ยาวขึ้นได้, ต่อความยาวเพิ่มได้ด้วยการเชื่อมคลิปแบบขยาย Odyssey-3: เรนเดอร์ต่อเนื่อง ไม่มีแนวคิดเรื่องคลิป

ราคา — Google Veo 3.1: ประมาณ $0.20/วินาที สำหรับแบบไม่มีเสียง และประมาณ $0.40/วินาที สำหรับแบบมีเสียงในระดับ Standard; ส่วนระดับ Fast และ Lite ต่ำกว่านั้น Odyssey-3: ยังไม่มีการเปิดเผย

ความพร้อมใช้งาน — Google Veo 3.1: เปิดให้ใช้งานทั่วไป (GA) ตั้งแต่ 2025-11-17 ส่วน Odyssey-3: เปิดให้ทดลองใช้ล่วงหน้าเมื่อ 2026-09-15 และจะเปิดให้บุคคลทั่วไปใช้งาน "ในอีกไม่กี่สัปดาห์ข้างหน้า"

หลักฐาน — Google Veo 3.1: การใช้งานจริงในสายงานผลิตเป็นเวลาสิบเดือนและตำแหน่งบนกระดานจัดอันดับอิสระ Odyssey-3: การสาธิตจากผู้จำหน่าย ไม่มีตารางเกณฑ์มาตรฐาน ไม่มีรายงานทางเทคนิค

จุดที่ข้ออ้างทางฟิสิกส์ให้ผลจริง — และจุดที่มันไม่ให้ผล

มันชวนให้คิดว่าโมเดลที่มีฟิสิกส์ดีกว่าจะสร้างวิดีโอได้ดีกว่า และนั่นไม่ใช่สิ่งที่ Odyssey กำลังขาย ปัญหาของทีมวิดีโอมักไม่ใช่เรื่องที่โลกในคลิปไม่สอดคล้องทางฟิสิกส์ แต่เป็นว่าช็อตต้องเป็น 4K หรือตัวละครต้องดูเหมือนเดิมในสามเซ็ตอัปที่ต่างกัน หรือชิ้นงานส่งมอบต้องมีเมทาดาทาแหล่งที่มาแนบมาก่อนที่ฝ่ายกฎหมายจะอนุมัติ Veo 3.1 ตอบคำถามเหล่านั้นได้แล้ววันนี้ ตัวจำลองที่แม่นยำทางฟิสิกส์ตอบคำถามอีกข้อหนึ่งว่า ฉันฝึกอะไรบางอย่างในนี้แล้วมันจะใช้ได้ผลข้างนอกได้ไหม ถ้าคุณไม่ได้ฝึกอะไรเลย ความแม่นยำทางฟิสิกส์ของ Odyssey-3 ก็เป็นฟีเจอร์ที่ไม่มีผู้ซื้อในเวิร์กโฟลว์ของคุณ

จุดที่ทั้งสองมาบรรจบกันจริง ๆ คือพรีวิชวลไลเซชัน ผู้กำกับที่ต้องการสำรวจพื้นที่แบบอินเทอร์แอกทีฟ — เคลื่อนกล้องผ่านฉาก เปลี่ยนตัวเลือกการจัดบล็อกกิง และเห็นผลที่ตามมา — ต้องการสิ่งที่เวิลด์โมเดลมอบให้พอดี และสิ่งที่คลิปที่เรนเดอร์แล้วทำไม่ได้ เพราะคลิปจะถูกตรึงไว้ทันทีที่มันถูกสร้างขึ้น นั่นคือกรณีใช้งานจริง และยังเป็นกรณีที่พรีวิวซึ่งยังไม่เปิดตัวยังไม่ใช่ตัวเลือกในตอนนี้

การรันสิ่งนี้ในโปรดักชันโดยไม่เดิมพันกับเอนด์พอยต์เพียงจุดเดียว

เหตุผลที่ทีมโปรดักชันให้ความสำคัญกับสถาปัตยกรรมรอบ ๆ โมเดล ก็เพราะไปป์ไลน์วิดีโอแทบไม่เคยเป็นการเรียกเพียงครั้งเดียว โมเดลพรอมป์ต์ร่างรายการช็อต โมเดลภาพสร้างเฟรมเริ่มต้น โมเดลวิชันตรวจสอบผลลัพธ์เทียบกับบรีฟ โมเดลถอดเสียงจัดการเสียงบรรยาย แต่ละส่วนล้วนเป็นดีเพนเดนซีที่อาจล้มเหลวตอนตีสอง และแต่ละส่วนก็เป็นการผสานรวมแยกกันหากคุณซื้อแยกกัน การวางเลเยอร์นั้นไว้บน API เดียวที่ครอบคลุมกว่า 200 โมเดล ในราคาตามที่ผู้ให้บริการประกาศ โดยบวกเพิ่ม 0%ช่วยยุบรวมการผสานรวมทั้งหมดเข้าด้วยกัน และ การสลับไปใช้ระบบสำรองอัตโนมัติหมายความว่าเมื่อโมเดลพรอมป์ต์ล่ม ระบบจะเปลี่ยนเส้นทางแทนที่จะทำให้คิวเรนเดอร์หยุดชะงัก DSL สำหรับการจัดเส้นทางมีความสำคัญตรงนี้มากกว่าในเวิร์กโฟลว์แบบโมเดลเดียว เพราะการประกอบหลายโมเดลเข้าเป็นการเรียกครั้งเดียวคือสิ่งที่ทำให้ไปป์ไลน์หลายขั้นตอนล้มเหลวอย่างราบรื่นทีละขั้น แทนที่จะล้มทั้งระบบ เพื่อความชัดเจนเรื่องขอบเขต: OrcaRouter ไม่ให้บริการ Google Veo 3.1 หรือ Odyssey-3 และทั้งสองโมเดลก็ไม่สามารถเข้าถึงผ่านระบบนี้ได้

A screenshot of Odyssey's own announcement page for Odyssey-3, dated September 15th 2026, headed "Introducing Odyssey-3: A General-Purpose Physical Intelligence", with the summary line that Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games.

ใครควรลงมือตอนนี้ และใครควรรอ

ถ้ากำหนดส่งของคุณคือไตรมาสนี้ และสิ่งที่ต้องส่งมอบคือไฟล์ Google Veo 3.1 คือตัวเลือกที่ปกป้องได้ และราคา — ประมาณ $0.40 ต่อวินาทีที่ 1080p พร้อมเสียง และถูกกว่าในระดับ Fast และ Lite — คือต้นทุนของโมเดลที่อยู่ในโปรดักชันนานพอจนน่าเบื่อ จงตั้งงบสำหรับแฟล็กเสียงไว้อย่างตั้งใจ แทนที่จะค่อยมาค้นพบทีหลัง

ถ้าปัญหาของคุณคือ นโยบาย ที่ต้องทำงานบนฮาร์ดแวร์ Odyssey-3 มุ่งเป้าไปที่คุณ และยังไม่มีอะไรให้ซื้อ รอสามสิ่ง: ราคาที่ประกาศแล้ว วันวางจำหน่ายที่เป็นวันจริงไม่ใช่ช่วงเวลา และตัวเลขอิสระหนึ่งตัว ตัวเลข sim-to-real 77% เป็นของ Odyssey เอง และจนกว่าจะมีคนนอกบริษัทนำมาทดสอบซ้ำ ท่าทีที่ถูกต้องคือความสนใจไม่ใช่การวางแผน ในระหว่างนี้ สแต็กโดยรอบคือส่วนที่คุณสามารถสร้างได้ และการสร้างมันเพื่อให้โมเดลใหม่สามารถใส่เข้าไปได้ในภายหลังเป็นจุดยืนที่ประหยัดที่สุด

A screenshot of Artificial Analysis's Video Model Comparisons page, showing the Video Arena Quality Elo chart and the representative price-per-minute chart across 15 of 37 video models, including Kling 3.0 at 720p and 1080p, Wan 3.0, MiniMax H3 Max and Gemini Omni Flash.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube