
พรีวิว Odyssey-3: World Model ของ Odyssey ก้าวจากการเฝ้ามองโลก สู่การลงมือทำในโลก
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
Odyssey-3 เป็นโมเดลโลกพื้นฐานรุ่นใหม่ล่าสุดจาก Odyssey ซึ่งบริษัทได้เปิดพรีวิวเมื่อวันที่ 15 กันยายน 2026 และอธิบายไว้ในประกาศของตัวเองว่าเป็นโมเดลที่ตั้งใจจะใช้ขับเคลื่อน "หุ่นยนต์ ขับรถ ฝึก AI บังคับโดรน และแม้แต่เล่นวิดีโอเกม" สิ่งที่ทำให้พรีวิวนี้ควรค่าแก่การอ่านอย่างละเอียดไม่ใช่รายการตัวเครื่อง — แต่เป็นกลไก Odyssey-3 เป็นทรานส์ฟอร์เมอร์แบบดิฟฟิวชันออโตเรเกรสซีฟที่ฝึกมาเพื่อจำลองสถานการณ์ที่หลากหลายจากการสังเกตด้วยภาพ และบริษัทติดตั้งตัวถอดรหัสการกระทำที่เรียนรู้แล้วเข้ากับมัน ซึ่งเป็นองค์ประกอบที่แปลการแทนค่าภายในของโมเดลสำหรับฉากหนึ่ง ๆ ให้เป็นคำสั่งมอเตอร์ที่ชิ้นส่วนฮาร์ดแวร์เฉพาะเจาะจงต้องการ นั่นคือความแตกต่างระหว่างโมเดลที่สร้างคลิปของแขนหุ่นยนต์ที่ดูสมจริง กับโมเดลที่ถูกสั่งให้ขยับแขนนั้น Odyssey เรียกกลุ่มระบบที่สิ่งนี้เปิดทางให้ว่า "physical agents" — โมเดลที่ตามถ้อยคำของบริษัท "พูดภาษาของโลก" หากกรอบความคิดนี้ฟังดูใกล้เคียงกับป้ายชื่อ "physics agent" ที่แพร่หลายในการรายงานข่าวเกี่ยวกับพรีวิว นั่นก็เป็นการตีความคำกล่าวอ้างเดียวกันได้อย่างสมเหตุสมผล แม้ว่ามันจะไม่ใช่ถ้อยคำของ Odyssey เอง และในขั้นนี้ มันเป็นคำอธิบายถึงเจตนามากกว่าผลลัพธ์ที่วัดได้
สิ่งที่ Odyssey ประกาศจริงๆ
โพสต์นี้เป็นการพรีวิว ไม่ใช่การเปิดตัว Odyssey กล่าวว่า "ตื่นเต้นที่จะเปิดตัวสู่สาธารณะในอีกไม่กี่สัปดาห์ข้างหน้า" และไม่ได้ระบุวันที่ ราคา หรือช่องทางการเข้าถึงใด ๆ ไม่มีรายงานทางเทคนิคของ Odyssey-3 ที่ลิงก์มาจากประกาศนี้ — เอกสารเดียวที่หน้าเว็บชี้ไปคือ PROWL-1 ซึ่งเป็นงานด้านการเรียนรู้แบบเสริมกำลังของบริษัท และไฟล์ PDF เดียวคือของ Starchild-1 การไม่ปรากฏนี้ควรกล่าวอย่างตรงไปตรงมา เพราะมันกำหนดทุกอย่างด้านล่าง: ทุกข้อกล่าวอ้างเกี่ยวกับความสามารถในบทความนี้เป็นของ Odyssey ทั้งสิ้น ยังไม่ถูกทำซ้ำ และยังไม่มีบุคคลที่สามรายใดที่ได้เผยแพร่ตัวเลขสำหรับ Odyssey-3 ที่ Odyssey ไม่ได้จัดหาให้
สิ่งที่โพสต์ระบุไว้ก็คือสถาปัตยกรรมและปรัชญาการฝึก ตัวแบบเป็น autoregressive diffusion transformer มันถูกฝึกจากข้อมูลการสังเกตโลกด้วยภาพ แทนที่จะเป็นป้ายกำกับเฉพาะงาน ซึ่ง Odyssey อ้างว่าทำให้มันมีความเข้าใจที่เรียนรู้มาเกี่ยวกับ "ฟิสิกส์ พลศาสตร์ เหตุและผล พฤติกรรมมนุษย์" — และตามคำกล่าวอ้างของ Odyssey ยังใช้ข้อมูลน้อยกว่าระบบที่ไม่ได้ถูก pretrain ในลักษณะนี้ เงินเดิมพันที่อยู่เบื้องหลังคือสิ่งที่วงการ world-model ทั้งหมดกำลังเดิมพันอยู่: การทำนายสถานะถัดไปของฉากในระดับสเกลบังคับให้ตัวแบบต้องซึมซับว่าวัตถุทางกายภาพมีพฤติกรรมจริงอย่างไร เพราะตัวแบบที่เข้าใจฟิสิกส์ผิดจะค่อยๆ กลายเป็นความไม่สอดคล้องกันระหว่างการ rollout ยาวๆ และกู้คืนกลับมาไม่ได้

หนึ่งแกนหลัก หกบอดี้
หลักฐานที่เป็นรูปธรรมที่สุดในประกาศคือการแพร่กระจายของ embodiements ที่ขับเคลื่อนโดยโมเดลพื้นฐานเดียวกัน Odyssey รายงานว่า:
• แขนกลหุ่นยนต์ — เรียนรู้ที่จะควบคุมแขนแบบต่างๆ และทำงานที่ซับซ้อนให้สำเร็จจาก "ข้อมูลการสาธิตของหุ่นยนต์เพียงไม่กี่สิบชั่วโมง" รวมถึงพฤติกรรมการกู้คืนที่ไม่มีอยู่ในข้อมูลการสาธิตเลย เช่น การจัดทิศทางของกริปเปอร์ใหม่หลังจากที่จับพลาด
• หุ่นยนต์ฮิวแมนนอยด์ — งานที่ทำร่วมกับ Flexion โดยมีนโยบายที่สร้างขึ้นจากข้อมูลการเทเลโอเปอเรชันของหุ่นยนต์ฮิวแมนนอยด์หลายสิบชั่วโมงซึ่งทำงานแบบเรียลไทม์ ซึ่ง Odyssey อ้างว่าสามารถปรับตัวเข้ากับการเปลี่ยนแปลงของแสงได้ดีกว่าโมเดลพื้นฐานแบบ vision-language-action ที่ใช้เปรียบเทียบด้วย
• การขับขี่ — แบ็กโบนแบบแช่แข็งที่สร้างเวย์พอยต์แบบเรียลไทม์สำหรับการขับขี่แบบวงปิด ฝึกด้วย "ข้อมูลการขับขี่จำลองเพียง 20 ชั่วโมง"
• โดรน — การบินในอาคารแบบหลบหลีกสิ่งกีดขวางจากข้อมูลการบินจำลองหลายสิบชั่วโมง พร้อมการทดลองแบบคุณภาพโดยตรึงแบ็กโบนไว้
• วิดีโอเกม — เซสชัน Grand Theft Auto V ที่ขยายยาวออกไป โดยมีการถ่ายโอนไปยัง Red Dead Redemption 2 และ Sleeping Dogs โดยไม่ต้องมีการฝึกนโยบายเพิ่มเติมใด ๆ ในชื่อเกมเหล่านั้น
• สภาพแวดล้อมการฝึก AI — โลกที่ถูกสร้างขึ้นเพื่อใช้เป็นสนามฝึกสำหรับเอเจนต์อื่น ๆ ซึ่งเชื่อมโยงกับงาน PROWL-1
รูปแบบที่พาดผ่านแถวเหล่านั้นคือข้อกล่าวอ้างที่แท้จริง: ไม่ใช่ว่า Odyssey-3 ยอดเยี่ยมในงานใดงานหนึ่ง แต่เป็นว่าชุดน้ำหนักชุดเดียว ร่วมกับอะแดปเตอร์เอาต์พุตที่เรียนรู้ได้ขนาดเล็ก สามารถเข้าถึงงานทั้งหมดได้ โมเดลเอนกประสงค์ว่าด้วยการเคลื่อนไหวของโลกเป็นสินทรัพย์ที่แตกต่างอย่างมากจากนโยบายเฉพาะหุ่นยนต์แต่ละตัว และนั่นคือเหตุผลที่พรีวิวลงเอยในจุดที่มันเป็น
ตัวเลขเพียงหนึ่งเดียว และสิ่งที่มันไม่ได้พิสูจน์
Odyssey เผยแพร่ตัวเลขเปรียบเทียบเพียงตัวเดียวสำหรับ Odyssey-3 นั่นคือ นโยบายการขับขี่ที่ฝึกในสภาพจำลองล้วนเดินทางได้ไกลประมาณ 77% ของระยะทางระหว่างการแทรกแซงของผู้ดูแลความปลอดภัย เมื่อเทียบกับนโยบายที่ฝึกด้วยฟุตเทจจริง โดยใช้ข้อมูลจำลอง 20 ชั่วโมงชุดเดียวกัน นั่นคือตัวเลข sim-to-real และเป็นตัวเลขที่น่าสนใจจริง ๆ การปิดช่องว่างระหว่างนโยบายที่ฝึกจากสภาพจำลองกับนโยบายที่ฝึกจากข้อมูลจริงให้แคบลง แม้เพียงบางส่วน ก็เป็นส่วนที่ยากของปัญหา ทั้งยังเป็นตัวเลขเพียงตัวเดียวในโพสต์นั้นด้วย
ไม่มีตารางความแม่นยำ ไม่มีอัตราความสำเร็จ ไม่มีเกณฑ์มาตรฐานข้ามร่างกาย และไม่มีการเปรียบเทียบกับโมเดลโลกที่ระบุชื่ออื่นในการประเมินร่วมกัน การ์ดส่วนท้ายของหน้ายืนยันว่า Odyssey-3 พัฒนาความล้ำสมัยในความแม่นยำทางกายภาพของโมเดลโลก แต่ไม่มีสิ่งใดบนหน้าที่มีตัวเลขรองรับข้อกล่าวอ้างนั้น Odyssey ยังระบุชื่อพันธมิตรด้านการประเมินกับ Poke & Wiggle ซึ่งครอบคลุม "ร่างกาย มุมมอง และการควบคุมที่แตกต่างกัน" — และยังไม่เผยแพร่ผลลัพธ์ใดๆ จากความร่วมมือนี้ ทุกสิ่งที่นี่เป็นข้อกล่าวอ้างของผู้ขาย และตัวเลข 77% ควรถูกตีความว่าเป็นเช่นนั้นจนกว่าบุคคลภายนอกจะนำไปทดสอบซ้ำ
ตาราง benchmark ที่หายไปหมายความว่าอย่างไร
มันเป็นเรื่องง่ายที่จะมองว่าการไม่มีเบนช์มาร์กเป็นสัญญาณเตือน แต่ควรอ่านมันในฐานะสภาพของวงการมากกว่า โมเดลโลก (world models) ยังไม่มีสิ่งที่เทียบเท่า MMLU หรือ GPQA — การประเมินที่ใช้ร่วมกัน ราคาถูก และได้รับความเชื่อถืออย่างกว้างขวาง ซึ่งทุกคนรายงานเทียบกับมัน กรอบของ Odyssey เองก็ยอมรับปัญหาด้านขนาดจากอีกทิศทางหนึ่ง: โพสต์กล่าวว่าโมเดลโลกระดับแนวหน้ายัง "ตามหลังโมเดลภาษาอยู่ราวสองอันดับขนาด" เมื่อมาตรฐานการประเมินเองยังไม่นิ่ง โพสต์พรีวิวที่ขึ้นต้นด้วยสถาปัตยกรรมและการกระจายข้ามร่าง แทนที่จะเป็นกระดานคะแนน กำลังอธิบายพรมแดนนี้อย่างซื่อตรง และผู้อ่านควรถือว่าข้ออ้างเชิงคุณภาพเป็นเพียงการบอกทิศทาง ไม่ใช่ข้อสรุปที่ยุติแล้ว ความร่วมมือ Poke & Wiggle คือสิ่งที่ต้องจับตามอง: การประเมินข้ามร่าง ข้ามมุมมอง ที่มีตัวเลขเผยแพร่ จะเป็นข้อมูลอ่านอิสระครั้งแรกต่อเรื่องใด ๆ เหล่านี้

"ในอีกไม่กี่สัปดาห์ข้างหน้า" คือพาดหัวข่าวตัวจริง
สำหรับใครก็ตามที่ต้องตัดสินใจในไตรมาสนี้ ประโยคสำคัญในประกาศคือประโยคเกี่ยวกับความพร้อมใช้งาน Odyssey-3 ยังไม่พร้อมใช้งานทั่วไป ไม่มีราคาที่ประกาศไว้ ไม่มีเอกสาร API และไม่มีวันที่ระบุไว้ มีเพียง "อีกไม่กี่สัปดาห์ข้างหน้า" เท่านั้น สิ่งนี้ทำให้มันอยู่คนละประเภทกับโมเดลที่คุณประเมินได้วันนี้ และยังหมายความว่าหน้าเปรียบเทียบซึ่งจะถูกเขียนขึ้นมาเทียบกับมันอย่างหลีกเลี่ยงไม่ได้นั้น ในตอนนี้เป็นการเปรียบเทียบระหว่างผลิตภัณฑ์ที่วางจำหน่ายจริงแล้วกับพรีวิวงานวิจัย ซึ่งเป็นความแตกต่างที่มีนัยสำคัญจริง ไม่ใช่เพียงข้อปลีกย่อยทางเทคนิค เพราะพรีวิวอาจยอดเยี่ยมได้ และก็ยังไม่ใช่สิ่งที่คุณจะนำไปใส่ในไปป์ไลน์วันจันทร์ได้
ยังมีเหตุผลข้อที่สองที่ทำให้จังหวะเวลานี้สำคัญ Odyssey ระดมทุนรอบ Series B ได้ $310M ที่การประเมินมูลค่า $1.45B โดยมี AWS กลายเป็นผู้ให้บริการคลาวด์ที่บริษัทเลือกใช้เป็นหลัก — บริษัทมีพลังประมวลผลที่จะผลักดันเวิร์ลโมเดลระดับแนวหน้า และการเปิดพรีวิวที่ออกมาก่อนการเปิดตัวสู่สาธารณะหลายเดือน คือวิธีที่ผลงานนั้นถูกนำเสนอให้เห็น ให้อ่านประกาศนี้เป็นคำแถลงถึงทิศทาง มากกว่าถึงขีดความสามารถ
จะทำอย่างไรกับสิ่งนี้ถ้าคุณสร้างวันนี้
Odyssey-3 เองไม่ใช่สิ่งที่คุณจะเรียกใช้ได้ และ OrcaRouter ก็ไม่ได้ให้บริการมัน — ไม่มีเลเยอร์การจัดเส้นทางใดที่ทำได้ เพราะยังไม่มีอะไรให้จัดเส้นทางไปถึง สิ่งที่คุ้มค่าที่จะทำตอนนี้คือการแยกการตัดสินใจออกเป็นสองส่วน ส่วนแรกคือแบบจำลองโลก (world model) และสำหรับส่วนนี้ คำตอบที่ตรงไปตรงมาคือรอการเปิดตัวสู่สาธารณะและการประเมินโดยอิสระครั้งแรก ส่วนที่สองคือทุกสิ่งรอบตัวมัน ได้แก่ โมเดลภาษาที่แปลงงานให้เป็นสิ่งที่ policy นำไปใช้ได้ โมเดลวิทัศน์ที่อ่านฉาก และโมเดลถอดเสียงที่ติดป้ายการสาธิตที่บันทึกไว้ สแตกที่อยู่รอบๆ นั้นเป็นงานจัดเส้นทางทั่วไป และมีให้ใช้ได้แล้ววันนี้ผ่านAPI เดียวครอบคลุมโมเดลกว่า 200 ตัว ในราคาตามที่ผู้ให้บริการประกาศ โดยบวกเพิ่ม 0% พร้อมด้วยการสลับไปใช้ระบบสำรองอัตโนมัติเมื่อผู้ให้บริการมีประสิทธิภาพลดลง เหตุผลที่ควรจัดเส้นทางเลเยอร์นั้นตอนนี้แทนที่จะรอไว้ทีหลัง คือมันเป็นเลเยอร์ที่คุณจะยังคงใช้งานอยู่เมื่อ Odyssey-3 เปิดตัว และการเปลี่ยนโมเดลพรอมป์ตเป็นเพียงการแก้ไขคอนฟิก ขณะที่การเขียนอินทิเกรชันใหม่ไม่ใช่เช่นนั้น
ยังคุ้มค่าที่จะคงคำถามเรื่อง world-model ไว้แบบเปิด ด้วยวิธีที่ประหยัดที่สุดเท่าที่เป็นไปได้ เมื่อโมเดลอย่าง Odyssey-3 ไปถึงผู้ให้บริการแบบ routed ได้จริง มันจะปรากฏในราคาตามรายการของผู้ให้บริการภายในวันเดียวกัน ดังนั้นการลองใช้จึงมีค่าใช้จ่ายเท่ากับการเรียก API หนึ่งครั้ง ไม่ใช่การทำสัญญา การสร้างไปป์ไลน์โดยรอบเพื่อให้สามารถสลับโมเดลใหม่เข้ามาได้ คือการเตรียมพร้อมในทางปฏิบัติสำหรับพรมแดนที่ยังเคลื่อนที่อยู่
อะไรจะเปลี่ยนการตีความ
สามสิ่งจะเปลี่ยนพรีวิวนี้ให้กลายเป็นข้อเท็จจริงที่ยุติแล้ว รายงานทางเทคนิคที่ตีพิมพ์ซึ่งมีรายละเอียดสถาปัตยกรรมและการฝึก จะทำให้กลุ่มภายนอกสามารถทำซ้ำทุกสิ่งได้ เบนช์มาร์กอิสระชิ้นแรก — ที่เหมาะที่สุดคืองาน cross-body ของ Poke & Wiggle — จะแทนที่คำกล่าวอ้างของผู้ขายด้วยตัวเลขที่คนอื่นวัดไว้ และการเปิดตัวสู่สาธารณะที่ระบุวันที่และราคา จะทำให้ทุกการเปรียบเทียบกับ Odyssey-3 เป็นการเปรียบเทียบระหว่างสองสิ่งที่ผู้อ่านสามารถรันได้จริง
จนถึงตอนนั้น สรุปที่ยืนหยัดได้คืออย่างนี้: Odyssey-3 เป็นข้ออ้างที่น่าเชื่อถือเกี่ยวกับสิ่งที่ยากจริง ๆ — โมเดลโลกหนึ่งเดียว ร่างหลายแบบ การควบคุมแทนการเรนเดอร์ — จากแล็บที่ทุนหนาและมีผลงานในสาขานี้ นำเสนอโดยแทบไม่มีตัวเลขและไม่มีกำหนดวางจำหน่าย นั่นคือหน้าตาของการพรีวิวระดับแนวหน้า ให้ถือว่าข้ออ้างเรื่องขีดความสามารถเป็นเพียงทิศทาง สถาปัตยกรรมเป็นส่วนที่น่าสนใจ และวันวางจำหน่ายเป็นบรรทัดเดียวที่เปลี่ยนแผนของคุณ

