การ์ดชื่อเรื่องที่สร้างขึ้นสำหรับ Odyssey-3 พร้อมคำบรรยายย่อย "เวิลด์โมเดลที่ลงมือทำ ไม่ใช่แค่เรนเดอร์" และการ์ดที่มีป้ายกำกับหกใบ — แขนหุ่นยนต์, ฮิวแมนนอยด์, การขับขี่, โดรน, เกม, การฝึก — ซึ่งแต่ละใบเชื่อมโยงกับโหนดเดียวที่ระบุว่า "แบ็กโบนหนึ่งตัว" พร้อมเชิงอรรถที่อ่านว่า "ดูตัวอย่างเมื่อ 2026-09-15; ผู้ขายรายงานเอง ไม่ได้วัดประสิทธิภาพโดยอิสระ"
Engineering & Research

พรีวิว Odyssey-3: World Model ของ Odyssey ก้าวจากการเฝ้ามองโลก สู่การลงมือทำในโลก

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Odyssey-3 เป็นโมเดลโลกพื้นฐานรุ่นใหม่ล่าสุดจาก Odyssey ซึ่งบริษัทได้เปิดพรีวิวเมื่อวันที่ 15 กันยายน 2026 และอธิบายไว้ในประกาศของตัวเองว่าเป็นโมเดลที่ตั้งใจจะใช้ขับเคลื่อน "หุ่นยนต์ ขับรถ ฝึก AI บังคับโดรน และแม้แต่เล่นวิดีโอเกม" สิ่งที่ทำให้พรีวิวนี้ควรค่าแก่การอ่านอย่างละเอียดไม่ใช่รายการตัวเครื่อง — แต่เป็นกลไก Odyssey-3 เป็นทรานส์ฟอร์เมอร์แบบดิฟฟิวชันออโตเรเกรสซีฟที่ฝึกมาเพื่อจำลองสถานการณ์ที่หลากหลายจากการสังเกตด้วยภาพ และบริษัทติดตั้งตัวถอดรหัสการกระทำที่เรียนรู้แล้วเข้ากับมัน ซึ่งเป็นองค์ประกอบที่แปลการแทนค่าภายในของโมเดลสำหรับฉากหนึ่ง ๆ ให้เป็นคำสั่งมอเตอร์ที่ชิ้นส่วนฮาร์ดแวร์เฉพาะเจาะจงต้องการ นั่นคือความแตกต่างระหว่างโมเดลที่สร้างคลิปของแขนหุ่นยนต์ที่ดูสมจริง กับโมเดลที่ถูกสั่งให้ขยับแขนนั้น Odyssey เรียกกลุ่มระบบที่สิ่งนี้เปิดทางให้ว่า "physical agents" — โมเดลที่ตามถ้อยคำของบริษัท "พูดภาษาของโลก" หากกรอบความคิดนี้ฟังดูใกล้เคียงกับป้ายชื่อ "physics agent" ที่แพร่หลายในการรายงานข่าวเกี่ยวกับพรีวิว นั่นก็เป็นการตีความคำกล่าวอ้างเดียวกันได้อย่างสมเหตุสมผล แม้ว่ามันจะไม่ใช่ถ้อยคำของ Odyssey เอง และในขั้นนี้ มันเป็นคำอธิบายถึงเจตนามากกว่าผลลัพธ์ที่วัดได้

สิ่งที่ Odyssey ประกาศจริงๆ

โพสต์นี้เป็นการพรีวิว ไม่ใช่การเปิดตัว Odyssey กล่าวว่า "ตื่นเต้นที่จะเปิดตัวสู่สาธารณะในอีกไม่กี่สัปดาห์ข้างหน้า" และไม่ได้ระบุวันที่ ราคา หรือช่องทางการเข้าถึงใด ๆ ไม่มีรายงานทางเทคนิคของ Odyssey-3 ที่ลิงก์มาจากประกาศนี้ — เอกสารเดียวที่หน้าเว็บชี้ไปคือ PROWL-1 ซึ่งเป็นงานด้านการเรียนรู้แบบเสริมกำลังของบริษัท และไฟล์ PDF เดียวคือของ Starchild-1 การไม่ปรากฏนี้ควรกล่าวอย่างตรงไปตรงมา เพราะมันกำหนดทุกอย่างด้านล่าง: ทุกข้อกล่าวอ้างเกี่ยวกับความสามารถในบทความนี้เป็นของ Odyssey ทั้งสิ้น ยังไม่ถูกทำซ้ำ และยังไม่มีบุคคลที่สามรายใดที่ได้เผยแพร่ตัวเลขสำหรับ Odyssey-3 ที่ Odyssey ไม่ได้จัดหาให้

สิ่งที่โพสต์ระบุไว้ก็คือสถาปัตยกรรมและปรัชญาการฝึก ตัวแบบเป็น autoregressive diffusion transformer มันถูกฝึกจากข้อมูลการสังเกตโลกด้วยภาพ แทนที่จะเป็นป้ายกำกับเฉพาะงาน ซึ่ง Odyssey อ้างว่าทำให้มันมีความเข้าใจที่เรียนรู้มาเกี่ยวกับ "ฟิสิกส์ พลศาสตร์ เหตุและผล พฤติกรรมมนุษย์" — และตามคำกล่าวอ้างของ Odyssey ยังใช้ข้อมูลน้อยกว่าระบบที่ไม่ได้ถูก pretrain ในลักษณะนี้ เงินเดิมพันที่อยู่เบื้องหลังคือสิ่งที่วงการ world-model ทั้งหมดกำลังเดิมพันอยู่: การทำนายสถานะถัดไปของฉากในระดับสเกลบังคับให้ตัวแบบต้องซึมซับว่าวัตถุทางกายภาพมีพฤติกรรมจริงอย่างไร เพราะตัวแบบที่เข้าใจฟิสิกส์ผิดจะค่อยๆ กลายเป็นความไม่สอดคล้องกันระหว่างการ rollout ยาวๆ และกู้คืนกลับมาไม่ได้

A generated single-column scoreboard for Odyssey-3 listing: what it is, foundation world model; output, world state plus motor actions; embodiments, arms, humanoid, car, drone, games; price, not published; availability, preview in the coming weeks; independent benchmarks, none yet. The footer reads "All figures Odyssey-reported; no independent evaluation published."

หนึ่งแกนหลัก หกบอดี้

หลักฐานที่เป็นรูปธรรมที่สุดในประกาศคือการแพร่กระจายของ embodiements ที่ขับเคลื่อนโดยโมเดลพื้นฐานเดียวกัน Odyssey รายงานว่า:

แขนกลหุ่นยนต์ — เรียนรู้ที่จะควบคุมแขนแบบต่างๆ และทำงานที่ซับซ้อนให้สำเร็จจาก "ข้อมูลการสาธิตของหุ่นยนต์เพียงไม่กี่สิบชั่วโมง" รวมถึงพฤติกรรมการกู้คืนที่ไม่มีอยู่ในข้อมูลการสาธิตเลย เช่น การจัดทิศทางของกริปเปอร์ใหม่หลังจากที่จับพลาด

หุ่นยนต์ฮิวแมนนอยด์ — งานที่ทำร่วมกับ Flexion โดยมีนโยบายที่สร้างขึ้นจากข้อมูลการเทเลโอเปอเรชันของหุ่นยนต์ฮิวแมนนอยด์หลายสิบชั่วโมงซึ่งทำงานแบบเรียลไทม์ ซึ่ง Odyssey อ้างว่าสามารถปรับตัวเข้ากับการเปลี่ยนแปลงของแสงได้ดีกว่าโมเดลพื้นฐานแบบ vision-language-action ที่ใช้เปรียบเทียบด้วย

การขับขี่ — แบ็กโบนแบบแช่แข็งที่สร้างเวย์พอยต์แบบเรียลไทม์สำหรับการขับขี่แบบวงปิด ฝึกด้วย "ข้อมูลการขับขี่จำลองเพียง 20 ชั่วโมง"

โดรน — การบินในอาคารแบบหลบหลีกสิ่งกีดขวางจากข้อมูลการบินจำลองหลายสิบชั่วโมง พร้อมการทดลองแบบคุณภาพโดยตรึงแบ็กโบนไว้

วิดีโอเกม — เซสชัน Grand Theft Auto V ที่ขยายยาวออกไป โดยมีการถ่ายโอนไปยัง Red Dead Redemption 2 และ Sleeping Dogs โดยไม่ต้องมีการฝึกนโยบายเพิ่มเติมใด ๆ ในชื่อเกมเหล่านั้น

สภาพแวดล้อมการฝึก AI — โลกที่ถูกสร้างขึ้นเพื่อใช้เป็นสนามฝึกสำหรับเอเจนต์อื่น ๆ ซึ่งเชื่อมโยงกับงาน PROWL-1

รูปแบบที่พาดผ่านแถวเหล่านั้นคือข้อกล่าวอ้างที่แท้จริง: ไม่ใช่ว่า Odyssey-3 ยอดเยี่ยมในงานใดงานหนึ่ง แต่เป็นว่าชุดน้ำหนักชุดเดียว ร่วมกับอะแดปเตอร์เอาต์พุตที่เรียนรู้ได้ขนาดเล็ก สามารถเข้าถึงงานทั้งหมดได้ โมเดลเอนกประสงค์ว่าด้วยการเคลื่อนไหวของโลกเป็นสินทรัพย์ที่แตกต่างอย่างมากจากนโยบายเฉพาะหุ่นยนต์แต่ละตัว และนั่นคือเหตุผลที่พรีวิวลงเอยในจุดที่มันเป็น

ตัวเลขเพียงหนึ่งเดียว และสิ่งที่มันไม่ได้พิสูจน์

Odyssey เผยแพร่ตัวเลขเปรียบเทียบเพียงตัวเดียวสำหรับ Odyssey-3 นั่นคือ นโยบายการขับขี่ที่ฝึกในสภาพจำลองล้วนเดินทางได้ไกลประมาณ 77% ของระยะทางระหว่างการแทรกแซงของผู้ดูแลความปลอดภัย เมื่อเทียบกับนโยบายที่ฝึกด้วยฟุตเทจจริง โดยใช้ข้อมูลจำลอง 20 ชั่วโมงชุดเดียวกัน นั่นคือตัวเลข sim-to-real และเป็นตัวเลขที่น่าสนใจจริง ๆ การปิดช่องว่างระหว่างนโยบายที่ฝึกจากสภาพจำลองกับนโยบายที่ฝึกจากข้อมูลจริงให้แคบลง แม้เพียงบางส่วน ก็เป็นส่วนที่ยากของปัญหา ทั้งยังเป็นตัวเลขเพียงตัวเดียวในโพสต์นั้นด้วย

ไม่มีตารางความแม่นยำ ไม่มีอัตราความสำเร็จ ไม่มีเกณฑ์มาตรฐานข้ามร่างกาย และไม่มีการเปรียบเทียบกับโมเดลโลกที่ระบุชื่ออื่นในการประเมินร่วมกัน การ์ดส่วนท้ายของหน้ายืนยันว่า Odyssey-3 พัฒนาความล้ำสมัยในความแม่นยำทางกายภาพของโมเดลโลก แต่ไม่มีสิ่งใดบนหน้าที่มีตัวเลขรองรับข้อกล่าวอ้างนั้น Odyssey ยังระบุชื่อพันธมิตรด้านการประเมินกับ Poke & Wiggle ซึ่งครอบคลุม "ร่างกาย มุมมอง และการควบคุมที่แตกต่างกัน" — และยังไม่เผยแพร่ผลลัพธ์ใดๆ จากความร่วมมือนี้ ทุกสิ่งที่นี่เป็นข้อกล่าวอ้างของผู้ขาย และตัวเลข 77% ควรถูกตีความว่าเป็นเช่นนั้นจนกว่าบุคคลภายนอกจะนำไปทดสอบซ้ำ

ตาราง benchmark ที่หายไปหมายความว่าอย่างไร

มันเป็นเรื่องง่ายที่จะมองว่าการไม่มีเบนช์มาร์กเป็นสัญญาณเตือน แต่ควรอ่านมันในฐานะสภาพของวงการมากกว่า โมเดลโลก (world models) ยังไม่มีสิ่งที่เทียบเท่า MMLU หรือ GPQA — การประเมินที่ใช้ร่วมกัน ราคาถูก และได้รับความเชื่อถืออย่างกว้างขวาง ซึ่งทุกคนรายงานเทียบกับมัน กรอบของ Odyssey เองก็ยอมรับปัญหาด้านขนาดจากอีกทิศทางหนึ่ง: โพสต์กล่าวว่าโมเดลโลกระดับแนวหน้ายัง "ตามหลังโมเดลภาษาอยู่ราวสองอันดับขนาด" เมื่อมาตรฐานการประเมินเองยังไม่นิ่ง โพสต์พรีวิวที่ขึ้นต้นด้วยสถาปัตยกรรมและการกระจายข้ามร่าง แทนที่จะเป็นกระดานคะแนน กำลังอธิบายพรมแดนนี้อย่างซื่อตรง และผู้อ่านควรถือว่าข้ออ้างเชิงคุณภาพเป็นเพียงการบอกทิศทาง ไม่ใช่ข้อสรุปที่ยุติแล้ว ความร่วมมือ Poke & Wiggle คือสิ่งที่ต้องจับตามอง: การประเมินข้ามร่าง ข้ามมุมมอง ที่มีตัวเลขเผยแพร่ จะเป็นข้อมูลอ่านอิสระครั้งแรกต่อเรื่องใด ๆ เหล่านี้

A screenshot of Odyssey's own announcement page for Odyssey-3, dated September 15th 2026, headed "Introducing Odyssey-3: A General-Purpose Physical Intelligence", with the summary line that Odyssey-3 is a foundation world model that can power robots, drive cars, train AIs, pilot drones, and even play video games.

"ในอีกไม่กี่สัปดาห์ข้างหน้า" คือพาดหัวข่าวตัวจริง

สำหรับใครก็ตามที่ต้องตัดสินใจในไตรมาสนี้ ประโยคสำคัญในประกาศคือประโยคเกี่ยวกับความพร้อมใช้งาน Odyssey-3 ยังไม่พร้อมใช้งานทั่วไป ไม่มีราคาที่ประกาศไว้ ไม่มีเอกสาร API และไม่มีวันที่ระบุไว้ มีเพียง "อีกไม่กี่สัปดาห์ข้างหน้า" เท่านั้น สิ่งนี้ทำให้มันอยู่คนละประเภทกับโมเดลที่คุณประเมินได้วันนี้ และยังหมายความว่าหน้าเปรียบเทียบซึ่งจะถูกเขียนขึ้นมาเทียบกับมันอย่างหลีกเลี่ยงไม่ได้นั้น ในตอนนี้เป็นการเปรียบเทียบระหว่างผลิตภัณฑ์ที่วางจำหน่ายจริงแล้วกับพรีวิวงานวิจัย ซึ่งเป็นความแตกต่างที่มีนัยสำคัญจริง ไม่ใช่เพียงข้อปลีกย่อยทางเทคนิค เพราะพรีวิวอาจยอดเยี่ยมได้ และก็ยังไม่ใช่สิ่งที่คุณจะนำไปใส่ในไปป์ไลน์วันจันทร์ได้

ยังมีเหตุผลข้อที่สองที่ทำให้จังหวะเวลานี้สำคัญ Odyssey ระดมทุนรอบ Series B ได้ $310M ที่การประเมินมูลค่า $1.45B โดยมี AWS กลายเป็นผู้ให้บริการคลาวด์ที่บริษัทเลือกใช้เป็นหลัก — บริษัทมีพลังประมวลผลที่จะผลักดันเวิร์ลโมเดลระดับแนวหน้า และการเปิดพรีวิวที่ออกมาก่อนการเปิดตัวสู่สาธารณะหลายเดือน คือวิธีที่ผลงานนั้นถูกนำเสนอให้เห็น ให้อ่านประกาศนี้เป็นคำแถลงถึงทิศทาง มากกว่าถึงขีดความสามารถ

จะทำอย่างไรกับสิ่งนี้ถ้าคุณสร้างวันนี้

Odyssey-3 เองไม่ใช่สิ่งที่คุณจะเรียกใช้ได้ และ OrcaRouter ก็ไม่ได้ให้บริการมัน — ไม่มีเลเยอร์การจัดเส้นทางใดที่ทำได้ เพราะยังไม่มีอะไรให้จัดเส้นทางไปถึง สิ่งที่คุ้มค่าที่จะทำตอนนี้คือการแยกการตัดสินใจออกเป็นสองส่วน ส่วนแรกคือแบบจำลองโลก (world model) และสำหรับส่วนนี้ คำตอบที่ตรงไปตรงมาคือรอการเปิดตัวสู่สาธารณะและการประเมินโดยอิสระครั้งแรก ส่วนที่สองคือทุกสิ่งรอบตัวมัน ได้แก่ โมเดลภาษาที่แปลงงานให้เป็นสิ่งที่ policy นำไปใช้ได้ โมเดลวิทัศน์ที่อ่านฉาก และโมเดลถอดเสียงที่ติดป้ายการสาธิตที่บันทึกไว้ สแตกที่อยู่รอบๆ นั้นเป็นงานจัดเส้นทางทั่วไป และมีให้ใช้ได้แล้ววันนี้ผ่านAPI เดียวครอบคลุมโมเดลกว่า 200 ตัว ในราคาตามที่ผู้ให้บริการประกาศ โดยบวกเพิ่ม 0% พร้อมด้วยการสลับไปใช้ระบบสำรองอัตโนมัติเมื่อผู้ให้บริการมีประสิทธิภาพลดลง เหตุผลที่ควรจัดเส้นทางเลเยอร์นั้นตอนนี้แทนที่จะรอไว้ทีหลัง คือมันเป็นเลเยอร์ที่คุณจะยังคงใช้งานอยู่เมื่อ Odyssey-3 เปิดตัว และการเปลี่ยนโมเดลพรอมป์ตเป็นเพียงการแก้ไขคอนฟิก ขณะที่การเขียนอินทิเกรชันใหม่ไม่ใช่เช่นนั้น

ยังคุ้มค่าที่จะคงคำถามเรื่อง world-model ไว้แบบเปิด ด้วยวิธีที่ประหยัดที่สุดเท่าที่เป็นไปได้ เมื่อโมเดลอย่าง Odyssey-3 ไปถึงผู้ให้บริการแบบ routed ได้จริง มันจะปรากฏในราคาตามรายการของผู้ให้บริการภายในวันเดียวกัน ดังนั้นการลองใช้จึงมีค่าใช้จ่ายเท่ากับการเรียก API หนึ่งครั้ง ไม่ใช่การทำสัญญา การสร้างไปป์ไลน์โดยรอบเพื่อให้สามารถสลับโมเดลใหม่เข้ามาได้ คือการเตรียมพร้อมในทางปฏิบัติสำหรับพรมแดนที่ยังเคลื่อนที่อยู่

อะไรจะเปลี่ยนการตีความ

สามสิ่งจะเปลี่ยนพรีวิวนี้ให้กลายเป็นข้อเท็จจริงที่ยุติแล้ว รายงานทางเทคนิคที่ตีพิมพ์ซึ่งมีรายละเอียดสถาปัตยกรรมและการฝึก จะทำให้กลุ่มภายนอกสามารถทำซ้ำทุกสิ่งได้ เบนช์มาร์กอิสระชิ้นแรก — ที่เหมาะที่สุดคืองาน cross-body ของ Poke & Wiggle — จะแทนที่คำกล่าวอ้างของผู้ขายด้วยตัวเลขที่คนอื่นวัดไว้ และการเปิดตัวสู่สาธารณะที่ระบุวันที่และราคา จะทำให้ทุกการเปรียบเทียบกับ Odyssey-3 เป็นการเปรียบเทียบระหว่างสองสิ่งที่ผู้อ่านสามารถรันได้จริง

จนถึงตอนนั้น สรุปที่ยืนหยัดได้คืออย่างนี้: Odyssey-3 เป็นข้ออ้างที่น่าเชื่อถือเกี่ยวกับสิ่งที่ยากจริง ๆ — โมเดลโลกหนึ่งเดียว ร่างหลายแบบ การควบคุมแทนการเรนเดอร์ — จากแล็บที่ทุนหนาและมีผลงานในสาขานี้ นำเสนอโดยแทบไม่มีตัวเลขและไม่มีกำหนดวางจำหน่าย นั่นคือหน้าตาของการพรีวิวระดับแนวหน้า ให้ถือว่าข้ออ้างเรื่องขีดความสามารถเป็นเพียงทิศทาง สถาปัตยกรรมเป็นส่วนที่น่าสนใจ และวันวางจำหน่ายเป็นบรรทัดเดียวที่เปลี่ยนแผนของคุณ

A screenshot of Artificial Analysis's Video Model Comparisons page, showing the Video Arena Quality Elo chart and the representative price-per-minute chart across 15 of 37 video models, including Kling 3.0 at 720p and 1080p, Wan 3.0, MiniMax H3 Max and Gemini Omni Flash.
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube