
Vidu Q4 Preview เปิดตัวอันดับที่สามบนกระดานจัดอันดับภาพเป็นวิดีโอ — และไม่ปรากฏอยู่ในอีกกระดานหนึ่ง
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 62 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 358 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
Vidu Q4 Preview เข้าสู่ลีดเดอร์บอร์ด Artificial Analysis AA-Video-I2V v1.0 ที่อันดับสามด้วยคะแนน Elo 1,179 และโมเดลที่มันเข้าแทนในฐานะรายการที่จัดอันดับดีที่สุดของ Vidu คือ Vidu Q3 Pro อยู่อันดับที่สิบเก้าด้วย 1,056 นั่นคือการขยับ 123 จุดในหนึ่งการเปิดตัว บนบอร์ดที่ช่วงความเชื่อมั่นกว้างประมาณยี่สิบจุด และเกิดขึ้นในราคา $7.20 ต่อนาทีของวิดีโอที่สร้างขึ้น แทนที่จะเป็น $9.60 ที่โมเดลรุ่นเก่ากว่าคิดอยู่ Shengshu Technology เปิดตัว Vidu Q4 Preview เมื่อวันที่ 7 ตุลาคม 2026 ในฐานะพรีวิวสาธารณะครั้งแรกของเรือธงรุ่นถัดไป โดยตั้งใจให้มาก่อนโมเดล Q4 ฉบับเต็มอย่างชัดเจน และกำลังขอให้ครีเอเตอร์นำไปใช้ในโปรเจกต์จริงในขณะที่เวอร์ชันสุดท้ายยังอยู่ระหว่างการปรับแต่ง
ตัวเลขเปิดตัวคือพาดหัวข่าว การไม่มีอยู่ต่างหากคือข้อเท็จจริงที่น่าสนใจกว่า และนั่นคือเหตุผลที่สิ่งนี้เป็นบทความ ไม่ใช่แผนภูมิ
สิ่งที่จัดส่งจริงเมื่อวันที่ 7 ตุลาคม
Vidu Q4 Preview เป็นโมเดลสร้างวิดีโอที่มีเสียงในตัว จำหน่ายผ่านผลิตภัณฑ์เว็บและแพลตฟอร์ม API ของ Vidu เอง เอกสารเปิดตัวของ Shengshu อธิบายงานสามด้าน ได้แก่ การแสดงของตัวละคร (สีหน้า อารมณ์ การเคลื่อนไหวร่างกายและเสียงที่ประสานสอดคล้องกัน ไม่ใช่แค่ซ้อนทับกันเป็นชั้น ๆ) ความต่อเนื่องของกล้องและการตัดต่อในฉากแอ็กชันที่รวดเร็ว และวิชวลเอฟเฟกต์ — การระเบิด อนุภาค ดอกไม้ไฟ — ที่อยู่ภายในฉากแทนที่จะวางทับอยู่ด้านบน
ข้อกำหนด ตามที่ผู้ขายระบุไว้:
• ความละเอียดสูงสุด — 4K โดย 2K และ 4K มีความลึกสี 10 บิต; ระดับทั้งหมดคือ 540p, 720p, 1080p, 2K, 4K
• ความยาวคลิปสูงสุด — 16 วินาที แบ่งไม่เท่ากัน: Image-to-Video มีความยาว 3 ถึง 16 วินาที, Reference-to-Video มีความยาว 1 ถึง 16 วินาที
• งบอ้างอิง — รูปอ้างอิงไม่เกิน 15 รูป (ตัวละคร เครื่องแต่งกาย พร็อพ สินค้า สภาพแวดล้อมในเซ็ตอัปเดียว) และคลิปเสียงอ้างอิงไม่เกิน 3 คลิป
• ราคาเปิดตัว — เริ่มต้นที่ $0.014 ต่อวินาที ซึ่งเป็นตัวเลขของผู้ขายและระบุชัดว่าเป็นโปรโมชัน
ผู้ขายยังอ้างสิทธิ์เชิงเปรียบเทียบที่ยากจะยึดถือได้ว่า ภายใต้ข้อกำหนดผลลัพธ์และเงื่อนไขการเรียกเก็บเงินที่เทียบเคียงกันได้ Vidu Q4 Preview ให้ผลลัพธ์ "มากถึงห้าเท่าสำหรับงบประมาณเดียวกัน" นั่นเป็นการอ้างเรื่องประสิทธิภาพ ไม่ใช่การอ้างเรื่องคุณภาพ และเนื่องจากวลี "ข้อกำหนดผลลัพธ์และเงื่อนไขการเรียกเก็บเงินที่เทียบเคียงกันได้" ทำหน้าที่ทั้งหมดในประโยคนั้น จึงควรถือเป็นถ้อยคำทางการตลาดจนกว่าจะมีใครทำซ้ำให้เห็นได้จริง ข้อกังวลของ Shengshu เองที่เผยแพร่ควบคู่กันมาระบุว่า ราคาสุดท้าย ความละเอียดที่รองรับ ความพร้อมใช้งานของคุณสมบัติ และเงื่อนไขการใช้งานอาจแตกต่างกันไปตามแพ็กเกจและภูมิภาค

คณะกรรมการทั้งสองไม่เห็นด้วยเกี่ยวกับว่าโมเดลนี้มีไว้เพื่ออะไร
Artificial Analysis จัดทำลีดเดอร์บอร์ดวิดีโอที่แยกจากกัน โดยมีสเกล Elo แยกกันและพูลโหวตแยกกัน และความแตกต่างระหว่างสิ่งเหล่านี้คือประเด็นสำคัญทั้งหมดในที่นี้
On AA-Video-I2V v1.0 — image-to-video, ranked from pairwise human preference votes with audio kept in — Vidu Q4 Preview is third at 1,179 ±10 over 5,543 samples, dated October 2026, priced at $7.20 per minute. Only two models are above it: MiniMax H3 Max at 1,195 ±9 over 5,894 samples ($4.80/min, August 2026) and MiniMax H3 at 1,181 ±8 over 7,284 samples ($7.80/min, July 2026). Gemini Omni Flash is fourth at 1,178 ±7 over 12,327 samples. The board's own notice says two models were added in the last 30 days: Vidu Q4 Preview and HiDream-O1-Video-1.0, which is sixth at 1,175 ±10.
บน AA-Video-T2V v2.0 — ข้อความเป็นวิดีโอ ซึ่งเป็นบอร์ดอีกแห่งที่สร้างขึ้นบนการจำแนกประเภทกรณีการใช้งานที่แตกต่างออกไป — Vidu Q4 Preview ไม่ปรากฏเลย รายการ Vidu ที่ดีที่สุดในบอร์ดนั้นคือ Vidu Q3 Pro อยู่อันดับที่ 25 ด้วยคะแนน 941 ±10 จาก 4,088 ตัวอย่าง Wan 3.0 นำเป็นอันดับหนึ่งของบอร์ดนั้นด้วยคะแนน 1,156 ±9
อ่านสองประโยคนั้นคู่กัน แล้วรูปทรงของการเปิดตัวก็จะชัดเจนขึ้น นี่คือโมเดลแบบอิมเมจและเรเฟอเรนซ์ หน้าสินค้าของ Vidu เองระบุโหมดไว้เพียงสองโหมดเท่านั้น คือ Image-to-Video และ Reference-to-Video โดยไม่มีแท็บ text-to-video และเอกสาร API ก็สอดคล้องกัน การเปิดตัวที่ดูเหมือนเรือธงอเนกประสงค์ในสื่อการตลาดของผู้ขาย บนกระดานอิสระกลับเป็นการเปิดตัวที่เจาะจงเฉพาะทาง
ข้อแม้เพิ่มเติมอีกข้อเกี่ยวกับตัวอันดับเอง ช่วงห่างสิบคะแนนของกระดาน I2V ทับซ้อนกันมากตั้งแต่อันดับที่ 3 ถึง 6 — 1,179, 1,178, 1,176, 1,175 — ดังนั้น “อันดับที่ 3” จึงเป็นตำแหน่งที่อยู่ในความคลาดเคลื่อน ไม่ใช่การแยกจากอันดับที่ 4 อย่างชัดเจน สิ่งที่ไม่อยู่ในความคลาดเคลื่อนคือช่องว่างไปยังโมเดลที่มันเข้ามาแทนที่ 123 Elo ระหว่าง Vidu Q3 Pro กับ Vidu Q4 Preview มากกว่าช่วงการกระจายทั้งหมดในหกอันดับแรกของกระดาน

สิ่งที่คุณเรียกจริง ๆ และสิ่งที่มันต้องแลก
API นี้ไม่หวือหวาและเฉพาะเจาะจง Image-to-Video ส่งคำขอไปที่ /ent/v2/img2video โดยใช้ชื่อโมเดล viduq4-preview รับภาพเฟรมเริ่มต้นเพียงภาพเดียว (png, jpeg, jpg หรือ webp ขนาดไม่เกิน 50MB) พรอมป์ต์ไม่เกิน 20,000 ตัวอักษร ระยะเวลาตั้งแต่ 3 ถึง 16 วินาที ค่าเริ่มต้น 5 และความละเอียดตั้งแต่ 540p ถึง 4K ค่าเริ่มต้น 720p Reference-to-Video ส่งคำขอไปที่ /ent/v2/reference2video รับภาพหนึ่งถึงสิบห้าภาพพร้อมเสียงอ้างอิง mp3 ศูนย์ถึงสามรายการ ความยาวรายการละสามถึงสิบสองวินาที และมีอัตราส่วนภาพ 1:1, 9:16, 16:9, 3:4 และ 4:3 ค่าเริ่มต้น 16:9
พารามิเตอร์ที่น่าสังเกตคือ audio ซึ่งมีค่าเริ่มต้นเป็น true Vidu Q4 Preview สร้างเสียงพร้อมภาพโดยค่าเริ่มต้น — รวมบทสนทนาและเอฟเฟกต์เสียงไว้ด้วย — และคุณต้องตั้งใจปิดมันเอง URL ของงานสร้างที่ส่งคืนจะยังใช้ได้ 24 ชั่วโมง ซึ่งสั้นพอที่จะมีผลหากคุณกำลังสร้างเป็นชุดและจะเรนเดอร์ในภายหลัง
ในเรื่องราคา การคำนวณที่ตรงไปตรงมาคือ ตัวเลขสองตัวที่ถูกหยิบมาพูดถึง — "$0.014 ต่อวินาที" และ $7.20 ต่อนาทีที่ Artificial Analysis บันทึกไว้ — ไม่ใช่ผลิตภัณฑ์เดียวกัน $0.014 ต่อวินาทีเท่ากับ $0.84 ต่อนาที ซึ่งประมาณหนึ่งในเก้าของตัวเลขบนบอร์ด และนั่นคือหน้าตาของราคาพื้นโปรโมชันที่ความละเอียดต่ำสุดเมื่อเทียบกับอัตราที่วัดได้ในระดับที่ใช้งานจริง การตั้งงบใด ๆ จากตัวเลขเปิดตัวควรคำนวณใหม่จากความละเอียดและระยะเวลาของคุณเอง ไม่ใช่จากพาดหัว

ปัญหาในทางปฏิบัติกับ SKU พรีวิว
Vidu Q4 Preview นั้น ตามกรอบที่ผู้ขายเองกำหนด ยังไม่เสร็จสมบูรณ์ มันเปิดตัวก่อน Q4 เพื่อให้ข้อเสนอแนะเกี่ยวกับประสิทธิภาพ การควบคุมเชิงสร้างสรรค์ และความจำเป็นในการผลิตในชีวิตประจำวัน มีส่วนกำหนดการเปิดตัวฉบับสมบูรณ์ ราคาเป็นแบบโปรโมชัน ความพร้อมใช้งานของคุณสมบัติแตกต่างกันไปตามแพ็กเกจและภูมิภาค เอกสาร API ยังมี alias ที่พิมพ์ผิด — viduq4-previerw ปรากฏอยู่ในคำอธิบายพารามิเตอร์ของโมเดลควบคู่กับคำว่า viduq4-preview ที่ถูกต้อง — ซึ่งเป็นเรื่องเล็ก ๆ ที่บอกความจริงบางอย่างเกี่ยวกับตำแหน่งของบิลด์นี้ในไปป์ไลน์
นั่นไม่ใช่ข้อโต้แย้งต่อการใช้งานมัน แต่เป็นข้อโต้แย้งต่อการนำมันไปไว้บนเส้นทางวิกฤตโดยไม่มีแผนรองรับว่าอะไรจะเกิดขึ้นเมื่อราคาโปรโมชันสิ้นสุดลง หรือเมื่อบิลด์พรีวิวถูกแทนที่ด้วยเวอร์ชันใหม่ ซึ่งสำหรับโมเดลที่เปิดตัวในลักษณะนี้เป็นเรื่องของสัปดาห์ ไม่ใช่ไตรมาส
ถ้าคุณอยากลองใช้โดยไม่ต้องเดิมพันกับไปป์ไลน์โปรดักชันของคุณ OrcaRouter ถูกสร้างมาเพื่อกรณีนี้โดยเฉพาะ: ปลายทางเดียวที่เข้ากันได้กับ OpenAI ครอบคลุมโมเดลกว่า 200 รายการ พร้อมการสลับไปใช้ผู้ให้บริการรายอื่นอัตโนมัติเมื่อเกิดปัญหา และราคาตามรายการของผู้ให้บริการที่ส่งต่อมาโดยไม่บวกเพิ่ม ส่วนการสลับสำรองนั้นสำคัญกว่าปกติเมื่อใช้บิลด์พรีวิว เพราะมันคือสิ่งที่ช่วยให้คุณส่งคำขอไปยังโมเดลที่เสถียรด้วยคีย์เดิมได้เมื่อเส้นทางพรีวิวใช้งานไม่ได้ พูดให้ชัดเรื่องการจัดเส้นทาง: Vidu Q4 Preview ไม่ใช่เส้นทางของ OrcaRouter ในตอนนี้ โมเดลวิดีโอที่เราให้บริการ — รวมถึง MiniMax H3 โมเดลอันดับหนึ่งบนบอร์ดนี้เอง — เรียกใช้ได้จากปลายทางเดียวกับโมเดลข้อความ และอัตราค่าวิดีโอต่อวินาทีก็เป็นรายการในบิล ไม่ใช่สัญญาแยกต่างหาก
ดูอะไรดี
สามสิ่งที่จะทำให้เรื่องราวนี้เดินหน้าไปได้
อย่างแรก บอร์ด text-to-video Artificial Analysis กล่าวว่า AA-Video-I2V v2.0 กำลังจะมา โดยสอดคล้องกับอนุกรมวิธานของ T2V v2.0 และครอบคลุมวิดีโอ 1080p ตลอดทั้งชุด หาก Vidu Q4 Preview เป็นโมเดลแบบ image-and-reference มันก็จะไม่ปรากฏที่นั่นเช่นกัน — และหากมันปรากฏขึ้นมา นั่นบอกคุณว่า Shengshu ได้ปล่อยโมเดลที่ครอบคลุมกว้างกว่าที่พรีวิวบ่งชี้ไว้
ประการที่สอง การเปิดตัว Q4 ฉบับเต็ม ช่วงจากพรีวิวถึงฉบับสมบูรณ์คือจุดที่ราคาโปรโมชันมักสิ้นสุดลง และเป็นจุดที่ชุดฟีเจอร์จะคงเดิมหรือค่อย ๆ ลดลงอย่างเงียบ ๆ งบอ้างอิง 15 ภาพและ 3 เสียงเป็นส่วนของข้อกำหนดที่มีแนวโน้มจะคงอยู่มากที่สุด เพราะมันคือจุดสร้างความแตกต่างที่การเปิดตัวทั้งหมดนี้ตั้งอยู่บนพื้นฐาน
ประการที่สาม จำนวนตัวอย่าง 5,543 เสียงเป็นการวัดที่จริงจังแต่อายุยังน้อย ช่วงความเชื่อมั่นจะแคบลงและอันดับจะขยับ ไม่ว่าจะไปในทิศทางใด เมื่อกระดานมีข้อมูลเพิ่มขึ้น ใครก็ตามที่อ้างว่า "ที่สาม" เป็นข้อเท็จจริงที่ลงตัวแล้ว ควรระบุวันที่ที่ตนอ่านด้วย
คำถามที่ควรค่าแก่การยึดไว้ให้แน่นนั้นแคบกว่าที่การตลาดบอกเป็นนัย Vidu Q4 Preview เป็นโมเดลแปลงภาพเป็นวิดีโอที่ดีที่สุดเท่าที่ Vidu เคยสร้างขึ้นอย่างวัดผลได้ ด้วยส่วนต่างที่มากกว่าช่วงห่างของหกอันดับแรกบนลีดเดอร์บอร์ดเอง ในอัตราต่อนาทีที่ต่ำกว่ารุ่นก่อน การที่สิ่งนั้นจะกลายเป็นตำแหน่งที่ยั่งยืนหรือเป็นเพียงการพุ่งขึ้นชั่วคราวของรุ่นพรีวิว ไม่ใช่สิ่งที่ตัวเลขปัจจุบันใด ๆ จะตอบได้
