Kartu hero untuk 'Eleven v4 Memuncaki Voice Arena': papan peringkat dengan ElevenLabs Eleven v4 di peringkat 1 dan Elo 1.319, Cartesia Sonic 3.6 di peringkat 2 dan Elo 1.276, Google Gemini 3.8 Flash TTS di peringkat 3 dan Elo 1.267, ElevenLabs Eleven v3 di peringkat 18 dan Elo 1.169, dan pita bertuliskan 'Diskon 72% hingga 12 Okt'. Footer: 'Penyedia Voice Arena, menurut Artificial Analysis, Sep 2026.' Logo OrcaRouter berada di sudut kanan bawah.
Guides & Insights

Eleven v4 Memuncaki Voice Arena: Apa yang Sebenarnya Dimenangkan Flagship Baru ElevenLabs

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

ElevenLabs Eleven v4 tiba pada 28 September dan langsung menuju puncak Provider Voice Arena milik Artificial Analysis dengan Elo 1.319 — unggul 43 poin dari Cartesia Sonic 3.6 pada 1.276 dan unggul 52 poin dari Google Gemini 3.8 Flash TTS pada 1.267. Model ini juga, dengan harga $80.00 per juta karakter di papan yang sama, menjadi model termahal di sepuluh besar. Dan di arena kedua — yang dibangun dari suara hasil kloning, bukan dari kumpulan suara milik tiap vendor — model ini sama sekali tidak menang: ia finis di posisi kedua, di belakang model yang harganya seperempatnya. Keduanya benar, dan bagian yang berguna dari peluncuran ini adalah menentukan mana yang berlaku untuk kasus penggunaan Anda.

Apa yang sebenarnya dirilis pada 28 September

ElevenLabs merilis dua model ke ketersediaan umum, bukan satu. ElevenLabs Eleven v4 adalah model sintesis unggulan — perusahaan menyebutnya yang paling ekspresif secara emosi, dan dokumentasinya menetapkan batas input 10.000 karakter per permintaan serta cakupan bahasa lebih dari 90. ElevenLabs Eleven v4 Turbo adalah saudaranya dengan latensi rendah: bahasa lebih dari 90 yang sama, batas 10.000 karakter, dan dukungan untuk tag audio inline yang memungkinkan Anda menuliskan arahan penyampaian langsung ke dalam skrip — tawa, bisikan, dengung di saluran. Keduanya aktif di seluruh permukaan agen, kreatif, dan API perusahaan pada hari pertama, peluncuran yang lebih cepat daripada yang didapat generasi v3.

Halaman pengumuman adalah tempat daftar fitur berada dan, yang patut dicatat, bukan tempat daftar harganya. ElevenLabs menjelaskan arsitektur baru, penanganan nada, tempo, dan karakter yang lebih baik, dialog multi-pembicara yang lebih andal dengan identitas pembicara yang stabil, input fonem IPA yang ditingkatkan, serta klon suara instan yang dibuat dari sepuluh detik audio bersama tier klon profesional yang sudah ada. Satu-satunya angka di halaman itu adalah klaim tentang pendengar: vendor menyebut perbandingan buta lebih memilih v4 pada sekitar tiga perempat kasus. Itu angka dari vendor, tidak direproduksi, dan harus dibaca berdampingan dengan angka papan di bawah ini, bukan sebagai penggantinya.

Di mana harga sebenarnya berada — halaman harga API — adalah dokumen yang lebih penting, dan dibahas lebih jauh di bawah. Versi singkatnya: peluncuran ini bukan kenaikan harga.

Dua papan, dua jawaban berbeda

Artificial Analysis menjalankan dua arena suara dan keduanya bukan variasi satu sama lain. Provider Voice meminta pendengar membandingkan suara milik tiap vendor itu sendiri. Controlled Voice mengkloning delapan suara yang sama — empat AS, empat Inggris — untuk setiap peserta, sehingga pembicaranya dijaga tetap konstan dan hanya modelnya yang bervariasi. Model dengan susunan suara bawaan yang hebat bisa menang di arena pertama dan kalah di arena kedua. Eleven v4 melakukan tepat itu.

Provider Voice, Eleven v4 — peringkat 1, Elo 1.319, $80,00 per juta karakter, 1.674 sampel, delapan suara arena, September 2026

• Penyedia Suara, Cartesia Sonic 3.6 — peringkat 2, Elo 1.276, $49,00

• Suara Penyedia, Google Gemini 3.8 Flash TTS — peringkat 3, Elo 1.267, $16,50

• Suara Penyedia, unggulan sebelumnya ElevenLabs Eleven v3 — peringkat 18, Elo 1,169, $100.00

• Suara Terkendali, Alibaba Qwen-Audio-3.1-TTS-Plus — peringkat 1, Elo 1.178

• Controlled Voice, Eleven v4 — peringkat 2, Elo 1.157, $80,00

• Suara Terkendali, Cartesia Sonic 3.6 — peringkat 4, Elo 1.138

• Suara Terkendali, ElevenLabs Eleven v3 — peringkat 7, Elo 1.073

• Suara Terkendali, Google Gemini 3.8 Flash TTS — peringkat 13, Elo 1.048

• Entri open-weights terbaik di Provider Voice — Breeze TTS 2, Elo 1.206, $34,00

A single-column scoreboard card for ElevenLabs Eleven v4 with six rows: 'Provider Voice rank: 1 (Elo 1,319)', 'Controlled Voice rank: 2 (Elo 1,157)', 'Board price: $80.00 per 1M characters', 'Rate card: $0.022 per 1K characters until Oct 12', 'Languages and cap: 90-plus, 10,000 characters', 'Latency: not stated for v4 itself'. Footer: 'Elo and board prices per Artificial Analysis; rate card and specs vendor-documented.'

Lompatan garis keturunan adalah berita utamanya bagi siapa pun yang sudah menggunakan ElevenLabs: dibandingkan pendahulunya sendiri di papan yang sama, Eleven v4 memperoleh 150 poin Elo pada Provider Voice dan 84 pada Controlled Voice. Itu adalah lompatan generasional, bukan sekadar penyetelan, dan peningkatannya lebih besar pada papan tempat vendor dapat memilih suara — yang merupakan cara jujur untuk mengatakan bahwa susunan default barunya adalah bagian nyata dari peningkatan tersebut.

A screenshot of the Artificial Analysis Provider Voice Arena leaderboard, captured in English, showing ElevenLabs Eleven v4 first at Elo 1,319 with $80.0 per 1M chars, 1,674 samples and a -19/19 confidence interval, Cartesia Sonic 3.6 second at Elo 1,276 and $49.0, Google Gemini 3.8 Flash TTS third at Elo 1,267 and $16.5, and ElevenLabs Eleven v3 eighteenth at Elo 1,169 and $100.0, under columns for samples, arena voices, release month and API pricing.

Papan pelafalan yang tidak bisa kita beri angka

Artificial Analysis memang menjalankan bagian Pronunciation Robustness, dan bagian itu layak dijelaskan dengan benar karena ringkasan peringkat yang beredar menggambarkan Eleven v4 sebagai yang memuncakinya. Papan ini mengukur proporsi rentang yang disorot yang menurut penilai diucapkan dengan benar, dengan hingga tiga penilai per klip, dan prompt dikirim persis seperti yang tertulis — tanpa perluasan angka, tanpa normalisasi teks. Bagian ini dipecah menjadi sub-kategori, dan inti desainnya adalah bahwa model yang diam-diam menulis ulang "Dr." atau "$4.50" sebelum berbicara sengaja mendapat skor buruk.

Apa yang tidak dipublikasikan oleh papan peringkat tersebut, dalam render yang dapat kami baca, adalah skor numerik per model yang dapat dikutip. Jadi tidak ada angka untuk dikutip bagi Eleven v4 di sana, dan Elo 1.319 adalah milik preferensi arena — seberapa suka pendengar terhadap suara itu — bukan akurasi pelafalan. Jika Anda melihat keduanya dicampuradukkan, itulah konflasinya. Klaim yang dapat dipertahankan dari peluncuran ini adalah klaim yang disertai angka: pertama pada Provider Voice di 1.319, kedua pada Controlled Voice di 1.157.

Diskon peluncuran adalah berita sebenarnya untuk tagihan Anda.

ElevenLabs menetapkan harga ulang untuk model baru tepat saat merilisnya, dan diskonnya cukup besar untuk mengubah keputusan pembelian dengan sendirinya. Di halaman harga API, Eleven v4 terdaftar pada $0.022 per seribu karakter dibandingkan harga daftar yang dinyatakan $0.08 — pengurangan 72% — dan Eleven v4 Turbo terdaftar pada $0.011 dibandingkan $0.04. Keduanya memiliki jendela waktu yang sama: promosi berlaku hingga 12 Oktober. Setelah itu, angkanya kembali seperti semula, dan harga v4 yang telah kembali itu dua kali lipat biaya v3 milik ElevenLabs sendiri saat ini di $0.08. Rencanakan berdasarkan angka pascapromosi, bukan angka promosinya.

Penetapan harga ulang juga menggeser posisi v4 terhadap para pesaing dalam basis per karakter, yang telah ditunjukkan oleh normalisasi arena pada $80,00 per juta. Sonic 3.6 berada pada $49,00 di sana, Breeze TTS 2 $34,00, Qwen-Audio-3.0-TTS-Plus $19,30, dan Gemini 3.8 Flash TTS $16,50. Pada tarif promosi, Eleven v4 dengan $22 per juta memangkas harga Sonic 3.6 secara telak. Pada tarif daftar, ini adalah suara termahal di daftar ini dengan selisih yang lebar. Siapa pun yang menyusun anggaran untuk Q1 harus melihat angka kedua.

A screenshot of ElevenLabs' API pricing page, captured in English, showing the Eleven v4 row at $0.022 per 1K characters with a struck-through $0.08 and a '72% off until Oct 12' badge, and the Eleven v4 Turbo row at $0.011 with a struck-through $0.04, alongside the v3 row at $0.08 and the Eleven v3 Conversational row at $0.04.

Satu bulan yang dihitung secara rinci membuat selisihnya menjadi konkret. Dengan lima juta karakter — produk berukuran menengah yang membacakan sekitar seratus jam ucapan — Eleven v4 selama jendela waktu itu memakan biaya $110. Pada tarif $0.08 yang dikembalikan, biayanya $400. Sonic 3.6 memakan biaya $245. Gemini 3.8 Flash TTS memakan biaya $82.50. Bulan yang sama pada v3 milik ElevenLabs sendiri juga memakan biaya $400, yang merupakan fakta ganjil di balik peluncuran ini: selama dua minggu ke depan, produk unggulan baru ini lebih murah daripada model yang digantikannya, dan pada hari jendela itu ditutup, ia tidak lagi lebih murah dan hanya menjadi lebih baik.

Klaim latensi tersebut berasal dari vendor dan bergantung pada tier.

ElevenLabs menerbitkan angka latensi per tier, bukan per keluarga model, dan itu adalah pengukuran yang dilakukan perusahaan sendiri, bukan hasil independen. Eleven v4 Turbo disebutkan sekitar 100 ms untuk inferensi median dan sekitar 150 ms untuk waktu median hingga ucapan pertama, diukur pada September 2026. Eleven v3 Conversational disebutkan sekitar 280 ms, dan tier Flash serta Turbo yang lebih lama sekitar 75 ms. Dokumentasi tidak menerbitkan angka yang setara untuk Eleven v4 sendiri, yaitu tier yang Anda inginkan jika Anda membangun agen real-time dan membaca lembar spesifikasi alih-alih menguji.

Cartesia mengklaim latensi di bawah 90 ms untuk Sonic dan menggambarkannya sebagai peringkat pertama untuk kealamian, dengan kloning suara dari sepuluh detik audio, kamus pengucapan khusus, dan seperangkat kepatuhan yang mencakup HIPAA, SOC 2 Type 2, GDPR, dan PCI. Itu adalah klaim vendor sendiri di halaman produknya sendiri — kategori bukti yang sama dengan angka tingkat latensi ElevenLabs, dan tidak dapat dipertukarkan dengan Elo arena. Di mana kedua vendor dapat langsung dibandingkan hanya pada papan peringkat.

Apa implikasinya bagi Anda, dan cara mencobanya

Jika Anda sedang memilih suara untuk produk yang susunan default-nya adalah yang didengar pengguna Anda, hasil Provider Voice adalah yang penting dan Eleven v4 baru saja merebutnya, dengan diskon yang berlaku selama dua minggu. Jika Anda mengkloning suara orang tertentu dan setiap model kandidat diminta mereproduksi delapan pembicara yang sama, papan Controlled Voice adalah yang penting dan Eleven v4 berada di posisi kedua — tertinggal 21 Elo dari pemimpin dan, pada harga daftar, biaya per karakternya lebih dari empat kali lipat. Tidak ada hasil yang salah; keduanya adalah jawaban atas pertanyaan yang berbeda, dan yang kedua adalah pertanyaan yang sebenarnya diajukan oleh sebagian besar pekerjaan pengkloningan suara produksi.

OrcaRouter tidak menghosting ElevenLabs, Cartesia, atau vendor lain mana pun di daftar ini, jadi tidak ada yang perlu dipanggil melalui kami dan kami tidak akan menyiratkan sebaliknya. Yang kami tawarkan adalah infrastruktur pendukung jika stack suara Anda pada akhirnya mencakup beberapa penyedia: satu kunci API untuk lebih dari 200 model dengan harga daftar penyedia diteruskan pada markup 0%, sehingga pemotongan harga vendor — termasuk jendela promosi seperti ini — aktif di sisi kami pada hari yang sama, bukan pada siklus tagihan berikutnya. Jika jalur suara sangat kritis untuk produksi, failover otomatis beralih ke upstream yang sehat saat salah satunya mengalami degradasi, yang merupakan cara praktis untuk menguji endpoint yang benar-benar baru tanpa mempertaruhkan rilis padanya.

Tanggal yang perlu dicatat adalah 12 Oktober. Saat itulah Eleven v4 tidak lagi menjadi suara bagus termurah di daftar dan menjadi yang paling mahal, dan perbandingan apa pun yang ditulis minggu ini yang menyebut $22 per juta tanpa menyebutkannya adalah perbandingan yang sebaiknya Anda jalankan ulang dalam tiga minggu.