
Vidu Q4 Preview ปะทะ Alibaba Wan 2.7: สองโหมดปะทะสี่โหมด และหนึ่งบอร์ดที่สำคัญจริง ๆ
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
การเปรียบเทียบทั้งหมดสรุปได้ในบรรทัดเดียว: Vidu Q4 Preview เอาชนะ Alibaba Wan 2.7 ไป 102 Elo บนบอร์ด image-to-video ของ Artificial Analysis และไม่สามารถส่งเข้าเทียบกับมันในหมวด text-to-video หรือ video editing ได้ เนื่องจาก Vidu Q4 Preview ไม่รองรับทั้งสองอย่าง
ทั้งสองโมเดลเปิดตัวในปี 2026 และทั้งคู่สร้างวิดีโอพร้อมเสียง Vidu Q4 Preview มาถึงเมื่อวันที่ 7 ตุลาคม 2026 จาก Shengshu Technology ในฐานะตัวอย่างสาธารณะครั้งแรกก่อนโมเดล Q4 ฉบับเต็ม โดยมีสองโหมด — Image-to-Video และ Reference-to-Video Alibaba Wan 2.7 วางจำหน่ายในเดือนเมษายน 2026 เป็นชุดสี่รูปแบบ ได้แก่ text-to-video, image-to-video, reference-to-video และ video edit โดยคิดค่าบริการตามวินาทีของวิดีโอที่สร้างขึ้น ดังนั้นตัวชี้ขาดในหน้าเปรียบเทียบแบบตัวต่อตัวส่วนใหญ่ — a — จึงมีอยู่เฉพาะบนแกนเหล่านั้น และวิธีที่ดีที่สุดในการตัดสินสองตัวนี้คือเริ่มจากการถามว่าจริง ๆ แล้วคุณต้องการแกนใด
กระดานคะแนน โดยเว้นช่องว่างไว้ให้มองเห็นได้
Artificial Analysis ดูแลลีดเดอร์บอร์ดวิดีโอสามรายการแยกกัน แต่ละรายการมีสเกล Elo ของตัวเองและกลุ่มผู้โหวตของตัวเอง ดังนั้นคะแนนจากรายการหนึ่งจึงไม่สามารถโอนไปยังอีกรายการได้ อ่านเมื่อวันที่ 8 ตุลาคม 2026 อีกครั้งโดยยังคงเปิดเสียงไว้:
• รูปภาพเป็นวิดีโอ (AA-Video-I2V v1.0) — Vidu Q4 Preview อันดับ 3, 1,179 ±10, 5,543 ตัวอย่าง, ต.ค. 2026, $7.20/นาที; Alibaba Wan 2.7 อันดับ 13, 1,077 ±8, 4,571 ตัวอย่าง, เม.ย. 2026, $9.00/นาที
• การแปลงข้อความเป็นวิดีโอ (AA-Video-T2V v2.0) — ไม่มี Vidu Q4 Preview; Wan2.7-260612 วันที่ 13-14, 1,030 ±9, 5,571 ตัวอย่าง, มิ.ย. 2026, $9.00/นาที
• การตัดต่อวิดีโอ (AA-Video-Editing v1.1) — Vidu Q4 Preview ไม่มี; Wan 2.7 ที่ 7, 1,074, 20,021 ตัวอย่าง, เมษายน 2026, $16.90/นาที
สองสิ่งตามมาจากตารางนั้น Wan 2.7 มีความสามารถรอบด้านกว่าอีกตัวในสองตัวนี้อย่างมาก — มันเป็นตัวเดียวในสองตัวที่ได้คะแนนในบอร์ดทั้งสาม และรายการ editing ของมันมีจำนวนโหวตมากที่สุดในบรรดาคะแนน Wan 2.7 ทั้งหมดทุกที่ โดยมีตัวอย่างลึกถึงสองหมื่นตัวอย่าง และบนแกนเดียวที่ทั้งสองมาบรรจบกัน Vidu Q4 Preview ชนะด้วย 102 Elo ซึ่งคิดเป็นประมาณห้าเท่าของความกว้างของช่วงความเชื่อมั่นของโมเดลใดโมเดลหนึ่ง
ช่องว่าง 102 จุดไม่ใช่ผลลัพธ์เล็กน้อย เพื่อให้เห็นขนาด: ช่วงห่างทั้งหมดในหกอันดับแรกบนกระดาน image-to-video รวมกันมีเพียง 21 Elo Vidu Q4 Preview ไม่ได้นำ Wan 2.7 อยู่เพียงเล็กน้อยในด้าน image-to-video; มันอยู่คนละระดับ และมีค่าใช้จ่ายถูกกว่า $1.80 ต่อนาที ขณะเดียวกันก็เป็นรุ่นที่ใหม่กว่า ถ้า image-to-video คือภาระงานของคุณ การตัดสินใจไม่ใช่เรื่องที่สูสี และกระดานอิสระคือเหตุผลที่มันไม่สูสี

ในกรณีที่ Wan 2.7 เป็นเพียงหนึ่งเดียวจากทั้งสองที่ปรากฏขึ้น
เอกสารของ Wan 2.7 เองระบุถึงสองด้านที่ยังต้องพัฒนา ได้แก่ คุณภาพเสียง และความแม่นยำของข้อความบนหน้าจอ นั่นคือการประเมินจากฝั่งผู้ขาย ไม่ใช่จากนักวิจารณ์ และควรนำไปพิจารณาในการเปรียบเทียบใด ๆ เพราะทั้งสองโมเดลต่างอ้างจุดขายเดียวกัน นั่นคือเสียงที่สร้างขึ้นมาพร้อมกับภาพโดยกำเนิด แทนที่จะมาต่อเติมภายหลัง
ความแตกต่างอยู่ที่สิ่งที่เกิดขึ้นโดยค่าเริ่มต้น ปลายทาง image-to-video ของ Vidu Q4 Preview มีพารามิเตอร์ audio ที่มีค่าเริ่มต้นเป็น true: คุณจะได้เสียงเว้นแต่คุณจะปิดมัน และการปิดมันคือวิธีที่คุณจะได้คลิปที่ไม่มีเสียง Wan 2.7 ไม่ได้ระบุสวิตช์เดียวกันในตำแหน่งเดียวกัน หากเอาต์พุตแบบไม่มีเสียงสำคัญต่อไปป์ไลน์ของคุณ — และสำหรับสิ่งใดก็ตามที่คุณวางแผนจะใส่ดนตรีประกอบแยกต่างหาก หรือพากย์เป็นภาษาอื่น มันสำคัญ — ความไม่สมมาตรนั้นเปลี่ยนลักษณะของการผสานรวมรอบแรกของคุณ
บนบอร์ดการตัดต่อ อันดับที่เจ็ดของ Wan 2.7 ด้วย 1,074 จาก 20,021 ตัวอย่าง ถือเป็นผลลัพธ์เดี่ยวที่แข็งแกร่งที่สุดเมื่อวัดจากจำนวนโหวต ที่โมเดลใดโมเดลหนึ่งในสองนี้ทำได้บนบอร์ดใด ๆ เสียงโหวตสองหมื่นเสียงคือการวัดที่มีน้ำหนักจริงอยู่เบื้องหลัง และไม่มีโมเดล Vidu ปรากฏอยู่บนบอร์ดนั้นให้เปรียบเทียบด้วย หากงานของคุณคือการปรับจังหวะเวลาหรือปรับสไตล์ฟุตเทจที่มีอยู่ แทนที่จะสร้างช็อตใหม่ Wan 2.7 เป็นตัวเดียวในสองตัวที่ใช้กับงานนี้ได้

ช่องว่างของข้อกำหนดในฝั่งการสร้าง
ในจุดที่ทั้งสองทับซ้อนกัน ทั้งคู่แตกต่างกันในแทบทุกมิติ และความแตกต่างเหล่านั้นไม่ได้เอียงไปในทางที่เป็นประโยชน์ต่อ Wan อย่างสมมาตร
• ความละเอียดสูงสุด — Vidu Q4 Preview 4K (2K และ 4K ที่สี 10-bit) เทียบกับ Wan 2.7 สูงสุด 1080p
• ความยาวคลิปสูงสุด — Vidu Q4 Preview 16 วินาที (Image-to-Video 3-16 วินาที, Reference-to-Video 1-16 วินาที) เทียบกับ Wan 2.7 สูงสุด 15 วินาที
• ภาพอ้างอิง — Vidu Q4 Preview สูงสุด 15 ในชุดเดียว เทียบกับ Wan 2.7 สูงสุดสิบแอสเซ็ต
• เสียงอ้างอิง — Vidu Q4 Preview สูงสุด 3 คลิปเพื่อความสม่ำเสมอของเสียง เทียบกับที่ Alibaba ไม่ได้เผยแพร่ในรายละเอียดระดับเดียวกัน
• ความครอบคลุมของงาน — Vidu Q4 Preview สองโหมด (ภาพเป็นวิดีโอ, อ้างอิงเป็นวิดีโอ) เทียบกับ Wan 2.7 สี่รูปแบบ (โดยเพิ่มข้อความเป็นวิดีโอและการแก้ไขวิดีโอ)
• อัตราตามรายการที่ประกาศ — Vidu Q4 Preview เริ่มต้นที่ $0.014/วินาที (ราคาโปรโมชัน); วัดได้ $7.20/นาที บนบอร์ดจัดอันดับอิสระ เทียบกับ Wan 2.7 ที่ $0.10-$0.15/วินาที ตามแต่ละรุ่นย่อย, วัดได้ $9.00/นาที
ประเด็นเรื่องความละเอียดเป็นสิ่งที่ต้องชั่งน้ำหนักอย่างรอบคอบ เอาต์พุต 4K ที่ 10-bit เป็นความแตกต่างของสิ่งที่ส่งมอบได้จริงสำหรับใครก็ตามที่ทำงานขั้นสุดท้ายเพื่อส่งออกสำหรับหน้าจอหรือจอแสดงผลขนาดใหญ่ และไม่มีเวอร์ชันใดของ Wan 2.7 ที่มีสิ่งนี้ แต่ 4K คือจุดที่ราคาต่อวินาทีมักไม่ดูเหมือนเป็นราคาต่ำสุดที่โฆษณาไว้อีกต่อไป และการเปิดตัวของ Vidu เองก็มีข้อกำหนดว่า ราคาสุดท้าย ความละเอียดที่รองรับ ฟีเจอร์ และเงื่อนไขการใช้งานนั้นแตกต่างกันไปตามแพ็กเกจและภูมิภาค

อันไหน โดยพิจารณาจากภาระงาน
หากคุณกำลังทำแอนิเมชันจากภาพนิ่ง — ภาพสินค้า เฟรมอ้างอิงตัวละคร สตอรีบอร์ด — Vidu Q4 Preview เป็นโมเดลที่ดีกว่าโดยอิงจากหลักฐานอิสระเพียงชิ้นเดียวที่มีอยู่ ในอัตราที่วัดได้ต่ำกว่า นั่นคือกรณีที่ตรงไปตรงมา
หากคุณต้องการสัญญาเดียวที่ครอบคลุม text-to-video, image-to-video และการตัดต่อ Wan 2.7 เป็นเพียงหนึ่งเดียวจากทั้งสองตัวที่ตอบโจทย์ และทำได้ด้วยผลลัพธ์การตัดต่ออันดับที่เจ็ดซึ่งอิงจากจำนวนโหวตมากที่สุดที่โมเดลใดในสองตัวนี้มี การรวมไปกับผู้ให้บริการรายเดียวถือเป็นประโยชน์จริง และการเปรียบเทียบนี้ไม่ได้แสร้งทำเป็นอย่างอื่น
หากคุณต้องการทั้งสองอย่าง ต้นทุนในการใช้งานผู้ให้บริการสองรายมักไม่ใช่ค่าลิขสิทธิ์ — แต่คือการผสานรวมชุดที่สอง คีย์ชุดที่สอง ชุดพฤติกรรมการลองใหม่ชุดที่สอง และสคีมาชุดที่สองที่ต้องคอยอัปเดตให้เป็นปัจจุบัน OrcaRouter รวมสิ่งเหล่านั้นให้เหลือ: เอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI ครอบคลุมโมเดลมากกว่า 200 รายการ ราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยไม่มีการบวกมาร์กอัปเพิ่ม และมีการสลับผู้ให้บริการอัตโนมัติเมื่อเกิดข้อขัดข้อง ในส่วนของวิดีโอโดยเฉพาะ เราให้บริการ MiniMax H3 ซึ่งเป็นโมเดลที่ติดอันดับหนึ่งและสองบนลีดเดอร์บอร์ด image-to-video — สามารถเรียกใช้ได้บนเอนด์พอยต์เดียวกันและคีย์เดียวกันกับโมเดลข้อความ ไม่ว่า Vidu Q4 Preview หรือ Alibaba Wan 2.7 ต่างก็ไม่ใช่เส้นทางของ OrcaRouter ในปัจจุบัน และหน้านี้ไม่ควรถูกตีความว่าบ่งชี้เป็นอย่างอื่น สิ่งที่เราทำได้คือทำให้ส่วนที่เหลือของภาระงานอยู่บนการผสานรวมเดียว เพื่อให้งานวิดีโอเป็นเพียงรายการเดียว ไม่ใช่โปรเจกต์
อะไรจะเปลี่ยนสิ่งนี้
Vidu Q4 Preview เป็นเพียงพรีวิว ราคาที่ตั้งเป็นราคาโปรโมชัน ตัวบิลด์ล้ำหน้าการเปิดตัว Q4 ฉบับเต็มตามที่ผู้ขายเองระบุ และเอกสาร API ยังมีชื่อเรียกแทนโมเดลที่พิมพ์ผิดปนอยู่กับชื่อที่ถูกต้อง มีสองผลลัพธ์ที่สำคัญ คือ หากการเปิดตัว Q4 ฉบับเต็มเพิ่มความสามารถเท�סטทูวิดีโอเข้ามา แกนเหล่านี้ก็จะยุบรวมกัน และกลายเป็นการเปรียบเทียบโดยตรงบนสามบอร์ดแทนที่จะเป็นหนึ่งบอร์ด แต่หากไม่เพิ่ม การแยกส่วนก็จะคงอยู่เช่นเดิม และการเลือกก็ขึ้นอยู่กับลักษณะของภาระงานเพียงอย่างเดียว
ในอีกด้านหนึ่ง ตัวอย่างของ Wan 2.7 บนบอร์ด image-to-video นั้นเก่ากว่าของ Vidu ประมาณห้าเดือน และมีจำนวนน้อยกว่าประมาณหนึ่งพัน ช่วงทั้งสองจะแคบลง อันดับของทั้งสองโมเดลไม่ควรถือว่าคงที่เกินกว่าวันที่พิมพ์ไว้ข้าง ๆ
คำตอบแบบแคบ: ทั้งสองมีแกนการแข่งขันร่วมกันเพียงแกนเดียว โดย Vidu Q4 Preview นำอยู่บนแกนนั้นอย่างชัดเจนด้วยอัตราที่วัดได้ต่ำกว่า และ Wan 2.7 ชนะโดยปริยายในทุกจุดที่ Vidu ไม่ได้แข่งขัน คำตอบแบบกว้างก็คือ โมเดลพรีวิวแบบสองโหมดกับชุดแบบสี่ตัวแปรนั้นแท้จริงแล้วไม่ใช่ทางเลือกแทนกัน — พวกมันเป็นทางเลือกสำหรับงานที่แตกต่างกัน และส่วนที่มีประโยชน์ของการเปรียบเทียบนี้คือการรู้ว่าคุณมีงานแบบไหน
