
Tavus Griffin vs Runway Gen-4.5: การสนทนาและการเรนเดอร์เป็นบิลคนละใบกัน
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 223 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 129 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
วาง Tavus Griffin กับ Runway Gen-4.5 ไว้ข้างกัน แล้วสิ่งแรกที่คุณสังเกตคือทั้งสองไม่ได้ใช้หน่วยวัดเดียวกัน Griffin ซึ่งเปิดตัวโดย Tavus ในเดือนตุลาคม 2026 ในฐานะตัวอย่างเพื่อการวิจัย เป็น Human Interaction Model — ระบบแปลงวิดีโอเป็นวิดีโอที่สนทนาแบบเห็นหน้าสด ๆ และสร้างใบหน้าและเสียงของอีกฝ่ายขณะการสนทนาดำเนินไป Runway Gen-4.5 ซึ่งประกาศเมื่อวันที่ 1 ธันวาคม 2025 และเปิดให้สมาชิกที่จ่ายเงินใช้ตั้งแต่ 12 ธันวาคม เป็นตัวสร้างวิดีโอจากข้อความและจากภาพที่คิดค่าบริการตามวินาทีของฟุตเทจที่เรนเดอร์ ตัวหนึ่งขายเป็นเทิร์น ส่วนอีกตัวขายเป็นวินาที และวิธีเดียวที่ซื่อตรงในการเปรียบเทียบคือการสังเกตว่าหนึ่งนาทีของ Griffin กับหนึ่งนาทีของ Gen-4.5 ไม่ใช่นาทีเดียวกัน
นาฬิกาสองเรือนที่เดินในทิศทางตรงกันข้าม
Gen-4.5 อยู่ในมือของลูกค้าที่จ่ายเงินมาเกือบปีแล้ว มันสร้างคลิปความยาวสองถึงสิบวินาทีจากข้อความพร้อมต์หรือภาพนิ่ง ที่ความละเอียด 720p และ 24 หรือ 25 เฟรมต่อวินาที ในอัตราส่วนภาพหกแบบ ไม่มีแทร็กเสียง ไม่มีสตอรีบอร์ดแบบหลายช็อต และไม่มีบทสนทนา — มันคือเรนเดอริงเอนจิน และเป็นเอนจินที่มีวินัย API ของมันเป็นแบบอะซิงโครนัส ซึ่งเป็นรูปแบบที่เหมาะสมสำหรับงานที่ใช้เวลานานกว่าที่คำขอควรจะเป็น API ของ Runway เองก็ให้บริการโมเดลวิดีโอของบุคคลที่สามควบคู่ไปกับของตัวเอง และบริษัทส่งมอบเวิลด์โมเดล GWM-1 ซึ่งบอกคุณว่า Runway คิดว่าปัญหาที่น่าสนใจอยู่ที่ไหน: ไม่ใช่การสนทนา แต่คือการสร้างโมเดลฉาก
Griffin ชี้ไปในทิศทางตรงกันข้าม ทุกการตัดสินใจด้านการออกแบบในสถาปัตยกรรมที่ Tavus เผยแพร่ให้ความสำคัญกับความหน่วงมากกว่าความเที่ยงตรง โคเดก Tavec ทำงานที่ 48 kHz โดยมี 40 ค่าต่อเฟรมที่ 100 เฟรมต่อวินาที ไม่มี codebook มีตัวถอดรหัสแบบ causal อย่างสมบูรณ์ และแพ็กเก็ตที่มีขนาดเล็กถึง 10 มิลลิวินาที เส้นทางวิดีโอส่งออกที่ 720p เป็นช่วงละ 320 มิลลิวินาที โดยที่ latent หนึ่งตัวครอบคลุมแปดเฟรมที่ 25 fps และ latent แต่ละตัวต้องใช้ diffusion สามขั้นตอน ความหน่วงจากเสียงเป็นวิดีโอเฉลี่ย 0.43 วินาทีบน H100s ซึ่ง Tavus กล่าวว่าเป็นประมาณครึ่งหนึ่งของวิธีที่เร็วเป็นอันดับถัดไปที่วัดได้ ไม่มีอะไรในสแต็กนั้นพยายามเรนเดอร์สิบวินาทีที่สวยงาม ทุกอย่างในนั้นกำลังพยายามเรนเดอร์ 320 มิลลิวินาทีถัดไปให้ทันเวลา
ดังนั้น การเปรียบเทียบสเปกจึงเป็นเรื่องจริง แต่ไม่ใช่กระดานคะแนน:
• หน่วยการคิดค่าบริการ — Runway Gen-4.5 คิดค่าบริการเป็นวินาทีของผลลัพธ์ คุณจึงรู้ค่าใช้จ่ายของตนเองก่อนกดสร้าง ส่วน Griffin ไม่มีราคาที่เผยแพร่เลย เพราะยังไม่มีผลิตภัณฑ์ที่เปิดให้สาธารณะใช้
• ความยาวคลิป — Gen-4.5 สร้างได้สองถึงสิบวินาที ส่วน Griffin จะทำงานตลอดระยะเวลาที่การสนทนาดำเนินอยู่
• ความละเอียดและอัตราเฟรม — Gen-4.5 เรนเดอร์ที่ 720p ที่ 24 หรือ 25 fps; Griffin สตรีมที่ 720p ที่ 25 fps เป็นชิ้นส่วนละ 320 มิลลิวินาที
• เสียง — Gen-4.5 ไม่สร้างแทร็กเสียง ส่วน Griffin สร้างทั้งเสียงพูดและวิดีโอพร้อมกัน และโคลนเสียงจากตัวอย่างความยาวประมาณ 10 วินาที
• การโต้ตอบ — Gen-4.5 เป็นการร้องขอแบบอะซิงโครนัสทางเดียว; Griffin เป็นฟูลดูเพล็กซ์และสามารถถูกขัดจังหวะได้ระหว่างการพูด
• ส่วนเสริมด้านโมชันและการเกรดสี — Gen-4.5 มีการส่งออก ProRes และ PNG โดยคิดค่าธรรมเนียมเพิ่ม 5 เครดิตต่อวินาที และ HDR ที่ 20 เครดิตต่อวินาที ซึ่งจะเพิ่มเป็น 40 เมื่อเกินประมาณสี่เมกะพิกเซล ส่วน Griffin ไม่มีสิ่งที่เทียบเท่าได้ เนื่องจากไม่ได้ส่งออกไฟล์
• ความพร้อมใช้งาน — Gen-4.5 เปิดให้บริการสำหรับผู้สมัครสมาชิกแบบเสียค่าใช้จ่ายมาตั้งแต่วันที่ 12 ธันวาคม 2025; Griffin อยู่ในช่วงทดลองวิจัยสำหรับผู้ทดสอบบางราย และ Tavus ระบุว่ายังไม่พร้อมให้ลูกค้าใช้งาน

ร่างกฎหมาย Gen-4.5 ในตัวเลขที่เข้าใจง่าย
Runway ตั้งราคา Gen-4.5 ไว้ที่ 12 เครดิตต่อวินาทีของวิดีโอที่สร้างขึ้น ที่อัตรามาตรฐานหนึ่งเซนต์ต่อเครดิต คิดออกมาได้เป็น $0.12 ต่อวินาที หรือประมาณ $7.20 สำหรับฟุตเทจหนึ่งนาทีเต็ม หากคุณสามารถสร้างต่อเนื่องได้ในครั้งเดียว — ซึ่งคุณทำไม่ได้ เพราะโมเดลจำกัดไว้ที่สิบวินาที ดังนั้นหนึ่งนาทีจึงหมายถึงการสร้างแยกกันหกครั้งขึ้นไปที่นำมาต่อรวมกัน พร้อมกับข้อผิดพลาดด้านความต่อเนื่องใด ๆ ที่อาจตามมา การเอาต์พุตเป็น ProRes และ PNG จะเพิ่ม 5 เครดิตต่อวินาที และ HDR จะเพิ่ม 20 เครดิตต่อวินาที และเพิ่มเป็น 40 เมื่อเกินประมาณสี่เมกะพิกเซล เครดิต API จะถูกเรียกเก็บแยกจากเครดิตการสมัครสมาชิกแอป ซึ่งเป็นรายละเอียดที่ทำให้ทีมงานพลาดได้เมื่อพวกเขาสร้างต้นแบบในเว็บแอปแล้วย้ายไปใช้ API

ช่องทางที่เข้าถึง Gen-4.5 ได้ก็สำคัญเช่นกัน คุณสามารถเข้าถึงได้ผ่าน API ของ Runway เอง และผ่านแพลตฟอร์มของบุคคลที่สามหลายแห่ง มันไม่ใช่เส้นทางของ OrcaRouter — เราไม่ได้โฮสต์มัน และเราจะไม่บอกเป็นนัยว่าคุณสามารถรับมันได้ที่นี่
Griffin ราคาเท่าไร และทำไมนั่นจึงเป็นคำถามที่ผิด
Tavus Griffin ยังไม่มีราคา เอกสารการเปิดตัวของ Tavus ระบุว่า Griffin-Lite ซึ่งเป็นรุ่นตัวอย่างสำหรับการวิจัย เปิดให้ใช้งานวันนี้กับกลุ่มผู้ทดสอบรายแรก ๆ ที่ได้รับการคัดเลือก ว่าจะมีการเปิดตัวโมเดลที่ทรงพลังกว่าในวงกว้างตามมา ในขณะนี้ Griffin-Lite จะยังไม่เปิดให้ลูกค้าใช้งาน และ Griffin ยังไม่มีบนแพลตฟอร์ม Tavus — จะพร้อมใช้งานเมื่อบริษัทหาวิธีเปิดตัวได้อย่างปลอดภัยแล้ว
ย่อหน้านั้นทำหน้าที่หลายอย่างมาก มันหมายความว่าการเปรียบเทียบในบทความนี้ไม่ใช่การตัดสินใจจัดซื้อ และไม่อาจกลายเป็นการตัดสินใจเช่นนั้นได้จนกว่า Tavus จะระบุราคา มันยังหมายความว่า Tavus ตรงไปตรงมาอย่างผิดปกติเกี่ยวกับผลลัพธ์ที่ผู้ขายส่วนใหญ่คงเปิดตัวออกมาเป็นหน้าสินค้าพร้อมปุ่ม "ติดต่อฝ่ายขาย"
สิ่งที่ Griffin เผยแพร่จริง ๆ คือหลักฐานเกี่ยวกับพฤติกรรม ในการศึกษาที่ดำเนินการร่วมกับ Queen Mary University of London ผู้เข้าร่วม 26 จาก 54 คน — 48% — เชื่อว่า Griffin เป็นบุคคลจริงหลังจากวิดีโอคอลหนึ่งนาที เทียบกับ 1 จาก 41 (2.4%) สำหรับชุด Phoenix-4.5, Sparrow-2 และ Raven-1 ก่อนหน้าของ Tavus บนเบนช์มาร์ก VideoFDB ของ NVIDIA ซึ่งให้คะแนนในเดือนกันยายน 2026 Tavus รายงานว่าครองอันดับหนึ่งใน AI แบบเผชิญหน้า: การสร้าง 3.83 เทียบกับค่าฐานที่รายงานว่าสูงสุด 2.80 และค่าอ้างอิงจากมนุษย์ 3.92, การรับรู้ 3.73 เทียบกับ 3.44 สำหรับค่าฐานที่ดีที่สุดที่รายงานไว้ และ 4.20 สำหรับมนุษย์ โดยมีอัตราบรรลุวัตถุประสงค์ของงาน 73.8% ในด้านการรับรู้ จากทั้งหมด 15 โมเดลที่ประเมิน ตัวเลขเหล่านั้นเป็นตัวเลขที่ผู้ขายรายงานเอง โดยอิงกับเบนช์มาร์กที่ NVIDIA สร้างขึ้น และเป็นเรื่องเกี่ยวกับการสนทนา ไม่ใช่การถ่ายภาพยนตร์

งานต่าง ๆ ที่กล่าวไว้อย่างตรงไปตรงมา
ถ้าคุณต้องการภาพเมืองยามพลบค่ำพร้อมการเคลื่อนกล้องที่ตรงกับเฟรมอ้างอิง Gen-4.5 คือเครื่องมือที่มีอยู่จริงและทำสิ่งนั้นได้แล้ววันนี้ในราคาประมาณสิบสองเซนต์ต่อวินาที ไม่มีสถานการณ์ใดที่ Griffin จะช่วยคุณได้ เพราะ Griffin ไม่รับพรอมต์และไม่ส่งไฟล์กลับมา
หากคุณต้องการใบหน้าที่คอยฟัง ถูกขัดจังหวะ และทำให้บทสนทนายังคง连贯กันเป็นเวลาหลายนาที Gen-4.5 ช่วยคุณไม่ได้ เพราะมันไม่รับอินพุตหลังจากที่ส่งคำขอไปแล้ว คลิปความยาวสิบวินาทีที่มีภาพคนกำลังพูดอยู่ไม่ใช่บทสนทนา แต่เป็นวิดีโอของบทสนทนา และความแตกต่างนี้ก็คือสิ่งที่ Tavus กำลังขายอยู่พอดี
ความทับซ้อนนั้นแคบกว่าที่ป้าย "AI video" บอกเป็นนัยไว้: ทั้งคู่ให้เอาต์พุตเป็นพิกเซลของคน และทั้งคู่ทำงานที่ 720p และ 25 fps ทุกอย่างที่เหนือกว่านั้นแตกต่างกัน รวมถึงหน่วยบนใบแจ้งหนี้
ทำไมเราเตอร์จึงมีประโยชน์ตรงจุดนี้
ทีมที่ลงเอยต้องใช้ทั้งสองอย่างมักค้นพบเรื่องนี้ด้วยวิธีที่ยากลำบาก — ผลิตภัณฑ์หนึ่งต้องการภาพ establishing shot ที่สร้างขึ้น และ อวตารที่พูดได้ และทั้งสองอย่างมาจากผู้ให้บริการรายอื่นกัน โดยมีการยืนยันตัวตนคนละแบบ ระบบเครดิตคนละระบบ และรูปแบบความล้มเหลวคนละแบบ นี่คือกรณีที่ endpoint เดียวคุ้มค่ากับการลงทุน OrcaRouter มีโมเดลมากกว่าสองร้อยโมเดลอยู่เบื้องหลังคีย์เดียว ส่งผ่านราคาตามรายการของผู้ให้บริการในอัตรา มาร์กอัป 0% ดังนั้นเมื่อผู้ให้บริการเปลี่ยนราคา การ์ดจะอัปเดตให้เห็นในวันเดียวกัน และ ลองใหม่กับผู้ให้บริการที่ยังทำงานปกติ เมื่อเส้นทางหนึ่งล้มเหลว แทนที่จะปล่อยให้คุณเจอ timeout เท่านั้น DSL สำหรับกำหนดเส้นทางช่วยให้คุณส่งฉบับร่างที่ไม่สำคัญมากไปยังที่ที่ความจุถูกที่สุด และปักหมุดทุกอย่างที่ลูกค้าเห็นไว้กับผู้ให้บริการรายใดรายหนึ่งได้ ส่วน model fusion ช่วยให้คุณวางโมเดลข้อความราคาถูกไว้หน้าโมเดลสร้างภาพราคาแพงเพื่อเขียนพรอมป์ต์ใหม่ก่อนที่คุณจะต้องเสียเวลาหลายวินาทีนั้นไป
เพื่อให้ชัดเจนว่าสิ่งนั้นครอบคลุมและไม่ครอบคลุมอะไรบ้างในการจับคู่นี้: Gen-4.5 ไม่ใช่หนึ่งในเส้นทางของเรา และ Griffin ก็ไม่ใช่เช่นกัน ฝั่งวิดีโอของแคตตาล็อกมี minimax/minimax-h3 ซึ่งเป็นเครื่องสร้างแบบ omni-modal ของ MiniMax ในราคา $0.08 ต่อวินาทีของเอาต์พุตที่ 768P และ $0.13 ต่อวินาทีที่ 2K — ราคาต่อวินาทีบนแกนเดียวกับของ Runway จากโมเดลที่เราให้บริการคุณได้จริงในวันนี้ นั่นคือคำแนะนำที่ตรงไปตรงมา หากสิ่งที่คุณต้องการคือวินาทีที่สร้างขึ้นและคุณต้องการให้คิดรวมไว้ในบิลเดียวกับอย่างอื่นทั้งหมด
จะวางแผนโดยยึดอันไหนดี
Gen-4.5 เป็นตัวเลือกที่พึ่งพาได้ปลอดภัยกว่าอย่างมาก: มันอยู่ในมือของลูกค้าที่จ่ายเงินมาตั้งแต่เดือนธันวาคม 2025 API ของมันมีเอกสารประกอบ เครดิตของมันมีราคากำหนดไว้ และขีดจำกัดของมัน — สิบวินาที ไม่มีเสียง ไม่มีสตอรีบอร์ดดิ้ง — ถูกประกาศให้ทราบ แทนที่จะต้องไปค้นพบเอง ทีมที่ต้องการฟุตเทจที่สร้างขึ้นสามารถเริ่มได้ในสัปดาห์นี้
Griffin เป็นเดิมพันที่ศักยภาพขาขึ้นสูงกว่า แต่ความเสี่ยงขาลงต่ำกว่า ตัวเลข 48% และความหน่วงเฉลี่ย 0.43 วินาทีของมันบ่งบอกถึงสิ่งใหม่จริง ๆ และการที่ Tavus ยังปฏิเสธที่จะขายมันในตอนนี้ก็เป็นสัญญาณเกี่ยวกับความพร้อมของสิ่งนั้น มากกว่าจะเป็นการตัดสินใจด้านการตลาด อย่าใส่ไว้ในโรดแมปในฐานะสิ่งที่ต้องพึ่งพา; ให้ใส่ไว้ในรายการเฝ้าดู แล้วกลับมาตรวจสอบอีกครั้งเมื่อหมายเหตุด้านความปลอดภัยหายไป
