
HeyGen Voice ปะทะ ElevenLabs: อันดับ 1 คนใหม่ด้านเสียงโคลน และผู้ให้บริการที่ยังครองบอร์ดอยู่
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 51 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 404 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
HeyGen Voice คว้าอันดับหนึ่งบน Controlled Voice arena ของ Artificial Analysis เมื่อวันที่ 9 ตุลาคม 2026 ด้วยคะแนน Elo 1,202 และโมเดลที่ถูกแทนที่จากตำแหน่งนั้นคือรุ่นระดับ ElevenLabs: Eleven v4 Turbo ซึ่งตอนนี้อยู่อันดับสามที่ 1,167 นั่นคือพาดหัวข่าว และมันถูกต้อง แม้ว่ามันจะเป็นข้อความที่เล็กกว่าที่ฟังดูมาก เพราะโมเดลของผู้ขายรายเดียวกันอยู่ในอันดับสอง สาม สี่ สิบเอ็ด และสิบห้าบนกระดานควบคุมเดียวกันนั้น และ Eleven v4 Turbo ยังคงเป็นที่หนึ่งบน Provider Voices arena ที่ใหญ่กว่ามากด้วย 1,328 Elo — ห่างจาก HeyGen Voice 126 คะแนน ซึ่งไม่ถูกจัดอันดับบนนั้นเลย หนึ่งเอนจินชนะหนึ่งกระดาน ผู้ขายยังคงครองหมวดหมู่นี้
ผู้ขายรายเดียวกันตอนนี้ครอง 5 ใน 15 อันดับแรก
กระดานจัดอันดับแบบควบคุมจะตรึงเสียงให้คงที่ — เสียงอ้างอิงที่โคลนมา 8 เสียง เป็นสหรัฐ 4 และสหราชอาณาจักร 4 — ดังนั้นทุกรายการจะถูกตัดสินจากวิธีที่เอ็นจิ้นจัดการกับเสียงที่มันไม่ได้เลือกเอง ตอนนี้กระดานนั้นแสดงคะแนน: HeyGen Voice 1,202, Qwen-Audio-3.1-TTS-Plus 1,186, Eleven v4 Turbo 1,167, Eleven v4 1,160, Sonic 3.6 1,143, Realtime TTS-2 1,143 ถัดลงไป Eleven v3 อยู่ที่ 1,072 และ v3 Conversational ที่ 1,056
ในสิบห้ารายการแรกของสาขานั้น มีห้ารายการที่ใช้ชื่อผู้ขายเดียวกัน คู่แข่งที่มีโมเดลดีที่สุดเพียงหนึ่งเดียวบนกระดานนั้นมีโมเดลที่ดีถึงห้าตัว ครอบคลุมสองรุ่น ณ สองระดับราคา บวกกับเวอร์ชันสำหรับการสนทนาซึ่งเป็นผลิตภัณฑ์อีกชนิดที่แตกต่างไปโดยสิ้นเชิง นั่นคือสิ่งที่เจ้าตลาดดูเหมือนเมื่อมองจากภายในตำแหน่งผู้นำบนลีดเดอร์บอร์ด และนั่นคือเหตุผลที่การเปิดตัวในอันดับ 1 คุ้มค่าที่จะเป็นพาดหัวข่าว มากกว่าจะเป็นแผนย้ายระบบ
ElevenLabs models จริงๆ แล้วคืออะไร
Eleven v4 Turbo ได้รับการอธิบายไว้ในเอกสารของผู้ให้บริการเองว่าเป็นโมเดลระดับสูงสุดสำหรับการสังเคราะห์เสียงพูดแบบเรียลไทม์ แนะนำสำหรับตัวแทนฝ่ายสนับสนุน ผู้ช่วย AI และตัวละครแบบโต้ตอบ โดยเข้าถึงได้ผ่าน Text to Dialogue websocket ภายใต้ตัวระบุโมเดล eleven_v4_turbo ElevenLabs ระบุว่าค่าความหน่วงในการประมวลผลมัธยฐานอยู่ที่ประมาณ 100ms — เป็นข้อมูลที่ผู้ให้บริการรายงานเอง และเชิงอรรถในหน้าเดียวกันนั้นได้ตัดความหน่วงของแอปพลิเคชันและเครือข่ายออกจากตัวเลขดังกล่าว ดังนั้นจึงเป็นตัวเลขของโมเดลเอนจิน ไม่ใช่คำสัญญาเรื่องเวลาตอบสนองไปกลับ
ความครอบคลุมภาษาของตระกูล v4 นั้นกว้างที่สุดในการเปรียบเทียบนี้อย่างทิ้งห่าง: 90+ ภาษา ตั้งแต่แอฟริกานส์และอาหรับ ไปจนถึงกวางตุ้ง ฮินดี ญี่ปุ่น แมนดาริน และซูลู เอกสารของ HeyGen เองระบุว่ามีเสียงสำเร็จรูป 300+ เสียงใน "หลายสิบภาษา" โดยไม่เปิดเผยจำนวน ซึ่งเป็นวิธีอธิบายแค็ตตาล็อกที่แตกต่างออกไป และไม่สามารถนำมาเปรียบเทียบกับตัวเลขจำนวนภาษาได้โดยตรง
แล้วยังมีส่วนที่ไม่ได้ปรากฏบนลีดเดอร์บอร์ดเลย: คลังเสียง การควบคุมความเสถียรและความคล้ายคลึง การปรับแต่งต่อคำขอ และขอบเขตการผสานรวมที่สั่งสมมาถึงทศวรรษ การเปรียบเทียบโมเดลไม่ใช่การเปรียบเทียบแพลตฟอร์ม และรายการของ ElevenLabs แข่งขันในทั้งสองด้าน

กระดานคะแนน
• คะแนน Elo ของเสียงแบบควบคุม — HeyGen Voice: 1,202 (#1) Eleven v4 Turbo: 1,167 (#3) Eleven v4: 1,160 (#4)
• Elo เสียงผู้ให้บริการ — Eleven v4 Turbo: 1,328 (อันดับ 1 จาก 96) HeyGen Voice: ไม่ติดอันดับ
• ราคาที่ประกาศต่อ 1 ล้านตัวอักษร — Eleven v4 Turbo: $40.00 Eleven v4: $80.00 HeyGen Voice: $30.00 โดยอิงจากการแปลงราคาเครดิตของ HeyGen ตามที่อารีนาคำนวณเอง; HeyGen ไม่ได้ประกาศอัตราค่าเสียงของตนเอง
• ความหน่วงที่ระบุไว้ — Eleven v4 Turbo: การประมวลผลค่ามัธยฐานประมาณ 100ms โดยไม่รวมความหน่วงของแอปพลิเคชันและเครือข่าย (ตามข้อมูลจากผู้ขาย) HeyGen Voice: ไม่มีการเปิดเผยตัวเลข
• ความครอบคลุมของภาษา — ตระกูล ElevenLabs v4: มากกว่า 90 ภาษา (เอกสารของผู้ให้บริการ) HeyGen Voice: "หลายสิบภาษา" ไม่ได้เปิดเผยจำนวน
• โมเดลในสิบห้าอันดับแรกที่ถูกควบคุม — ElevenLabs: ห้าระดับ HeyGen: หนึ่งระดับ

ช่องว่างระหว่างบอร์ดทั้งสองคือตัวเลขที่น่าสนใจ
Eleven v4 Turbo มีคะแนนนำ HeyGen Voice อยู่ 161 คะแนนบนบอร์ด Provider Voices และตามหลังอยู่ 35 คะแนนบนบอร์ดแบบควบคุม ตัวเลขทั้งสองมาจากเว็บไซต์เดียวกัน วิธีทดสอบแบบผู้ฟังไม่ทราบข้อมูลเดียวกัน และช่วงเวลาเดียวกัน สิ่งที่แยกทั้งสองออกจากกันคือเสียง
บนบอร์ดผู้ให้บริการ ผู้ขายแต่ละรายมีเสียงในตัวของตัวเอง ดังนั้นบริษัทที่ใช้เวลาหลายปีในการสร้างและดูแลคลังเสียงจึงได้ส่งเสียงที่ดีที่สุดของตนลงสนาม ในบอร์ดแบบควบคุม ข้อได้เปรียบนั้นหายไป — เอนจินต้องสังเคราะห์เสียงโคลนที่มันไม่ได้เลือก ความแตกต่าง 196 จุดระหว่างผลลัพธ์ทั้งสองนั้นแท้จริงคือการวัดว่าชื่อเสียงของ ElevenLabs มาจากเสียงมากน้อยเพียงใด เมื่อเทียบกับเอนจิน นับเป็นสัดส่วนที่มาก แต่มันก็ไม่ใช่ศูนย์: 1,167 ยังคงเป็นอันดับสามจากสี่สิบสอง
สำหรับผู้ซื้อ สิ่งนี้เชื่อมโยงกับคำถามที่เป็นรูปธรรมข้อหนึ่ง หากคุณกำลังเลือกเสียงจากไลบรารีของผู้ให้บริการ บอร์ดผู้ให้บริการคือบอร์ดของคุณ และตำแหน่งของ ElevenLabs บนบอร์ดนั้นไม่มีใครท้าทายได้ หากคุณกำลังโคลนเสียงของผู้พูดเฉพาะเจาะจง บอร์ดแบบควบคุมคือบอร์ดของคุณ และสัปดาห์นี้มีชื่อใหม่ขึ้นครองอันดับหนึ่ง
ต้นทุนของผู้ให้บริการรายเดิมไม่เปลี่ยนแปลง
Eleven v4 Turbo ราคา $40 ต่อล้านตัวอักษรบน API ของผู้ให้บริการ และ Eleven v4 รุ่นเก่าราคา $80 — เป็นสองเท่า สำหรับโมเดลที่ได้คะแนน Elo ต่ำกว่าอยู่เจ็ดจุดบนบอร์ดจัดอันดับแบบควบคุม ส่วนต่างภายในค่ายเดียวนี้น่าหยุดคิด: สองโมเดลจากบริษัทเดียว ราคาต่างกัน 2× และอันดับต่างกันสามอันดับ
ฝั่งของ HeyGen ในการเปรียบเทียบราคานั้นมีอยู่ แต่ไม่ได้อยู่ในรูปแบบที่ HeyGen เผยแพร่เอง สนามเปรียบเทียบระบุไว้ที่ $30.00 ต่อล้านตัวอักษร — ต่ำกว่าระดับราคาของ ElevenLabs ที่มันเข้ามาแทนที่อยู่สิบดอลลาร์ และคิดเป็น 62% ของ $80 ของ Eleven v4 รุ่นเก่า — แต่ตัวเลขนั้นเป็นการแปลงของ Artificial Analysis ไม่ใช่ราคาที่ผู้ขายประกาศเอง: หน้าเพจราคาสาธารณะของ HeyGen ขายเครดิต (600 เครดิตในราคา $49/เดือน, 1,000 เครดิตในราคา $49, 1,500 เครดิตในราคา $149) และระบุว่าปริมาณการใช้แตกต่างกันไปตามโมเดล ระยะเวลา และความซับซ้อน โดยไม่ระบุอัตราต่อเสียง ดังนั้นผู้ท้าชิงที่มีคะแนนเสียงโคลนดีกว่าจึงตั้งราคาต่ำกว่าผู้ครองตลาดอยู่หนึ่งในสี่ ด้วยตัวเลขที่ผู้ครองตลาดไม่จำเป็นต้องคำนวณเอง

จุดที่แต่ละฝ่ายชนะจริง ๆ
เลือก ElevenLabs เมื่อความครอบคลุมเป็นข้อจำกัด ภาษามากกว่าเก้าสิบภาษา ห้าอันดับชั้นบนกระดานจัดอันดับแบบควบคุม คลังเสียงที่สมบูรณ์ และเวอร์ชันสำหรับการสนทนาที่ตั้งราคาไว้ที่ 50 ดอลลาร์ต่อล้านตัวอักษร ซึ่งกระดานจัดอันดับแบบควบคุมจัดให้อยู่อันดับที่สิบห้า การผสมผสานเช่นนั้นเป็นเรื่องยากที่จะประกอบขึ้นจากที่อื่น และนั่นคือเหตุผลว่าทำไมความเป็นผู้นำของผู้ขายรายนี้จึงยังคงอยู่แม้จะสูญเสียตำแหน่งอันดับที่ 1 ไป
ทดสอบ HeyGen Voice เมื่อข้อจำกัดคือความเหมือนเดิม ผู้พูดคนเดียว หลายพันบรรทัด โคลนที่ต้องฟังดูเหมือนผู้พูดคนนั้นทุกครั้ง — นั่นคือภาระงานแบบเดียวกับที่สนามทดสอบแบบควบคุมจำลองขึ้นมา และ HeyGen Voice ปัจจุบันเป็นเอนจินที่ทำคะแนนได้ดีที่สุดในเรื่องนี้ เส้นทางโคลนระดับมืออาชีพที่ฝึกด้วยเสียงตั้งแต่ยี่สิบนาทีขึ้นไปคือผลิตภัณฑ์ที่เหมาะกับงานนั้น ไม่ใช่โคลนทันทีจากการอัดเสียงครั้งเดียว
อย่าตีความ 1,202 ว่าเป็นหลักฐานว่า HeyGen Voice เอาชนะ ElevenLabs โดยทั่วไป มันเอาชนะ ElevenLabs หนึ่งระดับบนบอร์ดเดียว อีกสามระดับอยู่ห่างจากมันไม่เกิน 42 คะแนน และผู้นำของอีกบอร์ดนำหน้ามันอยู่ 126 คะแนน
การทดสอบคู่แข่งโดยไม่ต้องทำ Migration
ความไม่สมมาตรของต้นทุนตรงนี้คือส่วนที่มีประโยชน์: การสลับเสียงนั้นสร้างได้ถูกและถ้าผิดพลาดก็ได้ยินทันที และการปล่อยให้ผู้ครองตลาดที่ราคา $40 ต่อล้านตัวอักษรทำงานอยู่กับทราฟฟิกที่ผู้ท้าชิงจัดการได้ดีกว่านั้นเป็นเรื่องแพง วิธีจัดการคือรันทั้งคู่หลังการผสานรวมเดียวแล้วให้เสียงของคุณเองเป็นตัวตัดสิน — OrcaRouter วางทั้งสองไว้บน API key เดียวในราคาตามรายการของผู้ให้บริการโดยไม่บวกเพิ่ม ดังนั้นการเปลี่ยนแปลงอัตราค่าบริการของผู้ขายจะสะท้อนที่ต้นทางแทนที่จะรอถึงตอนต่อสัญญา และ failover อัตโนมัติหมายความว่าคำขอเสียงที่ล้มเหลวจะส่งต่อไปยังเอนจินอีกตัวแทนที่จะเงียบไป สำหรับรอบแรก คุณสามารถถ่วงน้ำหนักทราฟฟิกไปยังเอนจินใดก็ตามที่หูของคุณชอบบนชุดทดสอบเล็ก ๆ และ routing DSL ช่วยให้คุณใช้เอนจินหนึ่งสำหรับเสียงบรรยายที่เรนเดอร์ล่วงหน้า และอีกเอนจินสำหรับบทสนทนาแบบโต้ตอบ โดยไม่ต้องมีไลบรารีไคลเอนต์ตัวที่สอง
อะไรจะเปลี่ยนเรื่องราวนี้
การที่ HeyGen Voice เข้าสู่สนามแข่งขัน Provider Voices จะบอกเราว่าความเป็นผู้นำด้านเสียงโคลนจะแปลงเป็นเสียงเจ้าของภาษาที่แข่งขันได้หรือไม่ — การทดสอบที่ ElevenLabs ผ่านที่ 1,328 อัตราค่าเสียงบนหน้า pricing ของ HeyGen เองจะเปลี่ยน $30.00 ที่อารีนาคำนวณได้ให้กลายเป็นเลขคณิตที่คุณตรวจสอบได้ และคะแนนโหวตอีกหนึ่งเดือนจะแสดงว่า 16 Elo เหนือ Qwen-Audio-3.1-TTS-Plus เป็นลำดับที่มั่นคงหรือเป็นแค่ภาพชั่วขณะ หนึ่งในสามอย่างนี้อาจเปลี่ยนคำแนะนำได้ ยังไม่มีสักอย่างเกิดขึ้น และสรุปที่ซื่อสัตย์จนกว่าสิ่งเหล่านั้นจะเกิดขึ้นคือ HeyGen Voice ชนะบอร์ดแบบควบคุม และ ElevenLabs ยังครองหมวดหมู่นี้
