OrcaDub 1.0 เป็นโมเดลการพากย์เสียงและการแปลวิดีโอแบบ end-to-end ที่คำนึงถึงฉันทลักษณ์ (prosody) เมื่อได้รับวิดีโอต้นฉบับ โมเดลจะสร้างวิดีโอพากย์เสียงในภาษาเป้าหมายด้วยเสียงที่โคลนจากผู้พูดต้นฉบับ โดยคงไว้ซึ่งการส่งมอบ — การเน้นเสียง การหยุด การใช้น้ำเสียง — และจังหวะในระดับคำ รองรับ 28 ภาษาในทุกทิศทาง โคลนเสียงแยกตามผู้พูดแต่ละคนในฟุตเทจที่มีหลายผู้พูด คงไว้ซึ่งดนตรีประกอบและบรรยากาศ และจัดแนวการพากย์ให้ตรงกับต้นฉบับในระดับคำ สามารถเข้าถึงได้จาก Studio บนเว็บฟรีและจาก API ที่เข้ากันได้กับ OpenAI
OrcaDub 1.0 เป็นโมเดลแบบครบวงจรสำหรับการพากย์เสียงและแปลวิดีโอที่คำนึงถึงวรรณยุกต์และจังหวะการพูด เปิดตัวในเดือนกรกฎาคม 2026 โดยเมื่อรับวิดีโอต้นฉบับเข้ามา จะสร้างวิดีโอที่พากย์เสียงในภาษาเป้าหมาย…
28 ภาษา, ทิศทางใดก็ได้ วิดีโอผู้พูดหลายคนพร้อมการโคลนเสียงเฉพาะผู้พูด การคงไว้ซึ่งดนตรีประกอบและบรรยากาศ การแปลเพลงแบบเลือกได้ การจัดแนวระดับคำตามเวลาต้นฉบับ เอาต์พุตที่ปรับระดับความดังให้เป็นมาตรฐาน (EBU R128)
ภาษา: 28 ภาษา, ทิศทางใดก็ได้ อินพุต: อัปโหลดวิดีโอหรือ URL (YouTube, TikTok, หรือลิงก์โดยตรง) เอาต์พุต: mp4 ที่พากย์เสียงแล้ว, ปรับระดับความดังให้เป็นมาตรฐาน การเข้าถึง: Studio บนเว็บและ API ที่เข้ากันได้กับ OpenAI, รหัสโมเดล orca/dub ลายน้ำ: เปิดสำหรับการพากย์ฟรี, สามารถควบคุมได้ต่อจ็อบผ่านสวิตช์ลายน้ำของ API การลบลายน้ำหรือคำบรรยายที่ฝังอยู่ในวิดีโอต้นฉบับแล้วเป็นบริการเสริมที่ต้องชำระเงินแยกต่างหาก
ผู้พูดที่ซ้อนทับกันมากอาจลดคุณภาพการแยกและการโคลนเสียง การร้องเพลงรองรับได้ภายใต้สวิตช์ที่เปิดอย่างชัดเจนและยังคงยากกว่าการพูด บทสนทนาที่หนาแน่นมากอาจถูกบีบอัดเพื่อรักษาการซิงค์ แต่ละบรรทัดสามารถแก้ไขได้ในสตูดิโอ การเล่นคำเฉพาะวัฒนธรรมอาจถูกปรับให้เหมาะกับความหมายแทนที่จะแปลตามตัวอักษร
OrcaDub คิดค่าบริการต่อนาทีของวิดีโอที่พากย์เสียง ไม่ใช่ต่อการเรียก API: $0.60 ต่อนาที คิดตามนาทีที่เริ่มใช้ โดยเศษนาทีปัดขึ้น ทุกเวิร์กสเปซเริ่มต้นด้วย 10 นาทีฟรี การพากย์เสียงฟรีจะมีลายน้ำขนาดเล็ก และการพากย์เสียงฟรีแต่ละครั้งจำกัดสูงสุดที่ 2 นาทีต่อคลิป การลบลายน้ำและการลบคำบรรยายเป็นส่วนเสริมเสริมเพิ่มเติมจากราคาต่อนาที คิดตามนาทีที่เริ่มใช้ และคิดราคาตามด้านสั้นของวิดีโอต้นทาง อัตราความละเอียดปัจจุบันอยู่ที่หน้าเว็บราคาของ OrcaDub
OrcaDub สามารถเข้าถึงได้สองทาง Studio เว็บฟรีรับการอัปโหลดวิดีโอหรือ URL ดำเนินการพากย์ และให้คุณแปลใหม่ ปรับเวลา และเปลี่ยนเสียงบรรทัดใด ๆ ก่อนส่งออก ส่วน API ที่เข้ากันได้กับ OpenAI จะเปิดเผยโมเดลเดียวกันภายใต้ ID orca/dub ผ่าน OrcaRouter โดยมีสวิตช์ลายน้ำแบบต่อจ็อบบนเอาต์พุต
โดยค่าเริ่มต้น การโคลนเสียงจะดำเนินการกับเสียงที่มีอยู่ในวิดีโอที่อัปโหลด เวิร์กโฟลว์ของโปรเจกต์สามารถใช้เสียงตัวละครที่คุณบันทึกไว้ซ้ำได้อีกด้วย การพากย์ฟรีจะมีลายน้ำ ผลลัพธ์จาก API รองรับการใส่ลายน้ำผ่านสวิตช์ลายน้ำ การพากย์เนื้อหาที่คุณไม่มีสิทธิ์ หรือการโคลนเสียงโดยไม่ได้รับความยินยอมจากเจ้าของเสียง ถือเป็นการละเมิดข้อกำหนดการใช้งานและนำไปสู่การยกเลิกบัญชี
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="orca/dub",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)| ต่อนาที | $0.6000 |
| สกุลเงิน | USD |
| คิดค่าบริการต่อนาทีที่เริ่มต้นของเอาต์พุต ไม่ใช่ต่อการเรียก API | |
สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้
@misc{orcarouter_dub,
title = {OrcaDub 1.0 API},
author = {OrcaDub},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/orca/dub}
}OrcaDub. (2026). OrcaDub 1.0 API. OrcaRouter. https://www.orcarouter.ai/models/orca/dub