Kartu hero untuk 'ElevenLabs Eleven v4 vs ElevenLabs Eleven v3' dengan dua kartu bertumpuk: ElevenLabs Eleven v4 pada Elo 1.319, peringkat 1 dan $80,00 per 1 juta karakter; ElevenLabs Eleven v3 pada Elo 1.169, peringkat 18 dan $100,00 per 1 juta karakter; dengan keterangan 'kartu tarif yang sama, selisih 150 Elo'. Footer: 'Provider Voice Arena, menurut Artificial Analysis, September 2026.' Logo OrcaRouter berada di sudut kanan bawah.
Guides & Insights

Eleven v4 vs Sisa ElevenLabs: Haruskah Anda Beralih dari Eleven v3?

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Jika Anda sudah menggunakan ElevenLabs Eleven v3, jawabannya adalah ya untuk apa pun yang didengar pendengar dan tidak untuk dua hal yang tetap tidak diubah oleh ElevenLabs. ElevenLabs Eleven v4 memperoleh 150 poin Elo lebih banyak daripada pendahulunya sendiri di Provider Voice Arena milik Artificial Analysis — 1.319 berbanding 1.169 — dan 84 poin di papan Controlled Voice, tempat delapan klon suara yang sama digunakan untuk semua orang. Model ini juga memiliki batas karakter dua kali lipat dari v3 dan cakupan bahasa yang kira-kira dua kali lipat. Yang tidak diubahnya adalah kontrak Anda, klon suara Anda, atau struktur tier yang menjadi dasar penagihan Anda, itulah sebabnya migrasi ini lebih murah daripada kebanyakan dan tetap layak dilakukan secara bertahap daripada sekaligus.

A two-column scoreboard for ElevenLabs Eleven v4 and ElevenLabs Eleven v3. Eleven v4: Provider Voice rank 1 Elo 1,319; Controlled Voice rank 2 Elo 1,157; $80.00 per 1M chars; $0.022 per 1K until Oct 12; 10,000-character cap; 90-plus languages. Eleven v3: Provider Voice rank 18 Elo 1,169; Controlled Voice rank 7 Elo 1,073; $100.00 per 1M chars; $0.08 per 1K; 5,000-character cap; 70-plus languages. Footer: 'Elo and board prices per Artificial Analysis; rate card and caps vendor-documented.'

Papan skor intra-keluarga

Ini bukan perbandingan antar vendor, jadi normalisasi harga di papan arena berperilaku berbeda dari biasanya: kedua model menagih per karakter, dengan daftar tarif yang sama, dari akun yang sama. Kekuatan dan kelemahan di bawah ini diukur terhadap model sekeluarga, bukan terhadap para pesaing.

• Provider Voice Arena — ElevenLabs Eleven v4 peringkat 1, Elo 1.319 vs ElevenLabs Eleven v3 peringkat 18, Elo 1.169. Selisih 150 poin.

• Arena Suara Terkendali, suara kloning yang dipasangkan — Eleven v4 peringkat 2, Elo 1.157 vs Eleven v3 peringkat 7, Elo 1.073. Selisih 84 poin.

• Normalisasi harga Arena — Eleven v4 $80,00 per juta karakter vs Eleven v3 $100,00. Unggulan baru ini adalah yang lebih murah di antara keduanya di papan.

• Kartu tarif vendor — Eleven v4 $0.022 per seribu karakter untuk promosi, $0.08 setelah 12 Oktober; Eleven v3 $0.08. Identik pada harga daftar, setengah harga selama periode tersebut.

• Batas input per permintaan — Eleven v4 10.000 karakter vs Eleven v3 5.000. Tepat dua kali lipat.

• Cakupan bahasa — Eleven v4 90+ vs Eleven v3 70+

• Direktif penyampaian — Eleven v4 mendokumentasikan tag audio inline dan input fonem IPA; Eleven v3 tidak mendokumentasikan keduanya di halaman modelnya.

• Latensi, menurut vendor — Eleven v3 Conversational sekitar 280 ms; Eleven v4 Turbo sekitar 150 ms median hingga ucapan pertama. Tingkat berbeda, pengujian berbeda.

• Clone suara — tidak berubah. Clone instan dan profesional yang sudah ada tetap terbawa.

• Tingkatan paket — tidak berubah. Gratis 10.000 karakter, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.

• Jalur migrasi — Eleven v4 dan Eleven v4 Turbo keduanya sudah tersedia di API, serta di surface agen dan kreatif; pengenal Turbo yang lebih lama sudah tidak digunakan lagi.

Baca baris harga dua kali. Fakta tak biasa tentang peluncuran ini adalah bahwa model baru lebih murah daripada model yang digantikannya, pada papan yang sama, pada harga daftar, tanpa promosi yang diterapkan — $80 per juta versus $100. Tarif promosi memperlebar hal itu, bukan menciptakannya. Migrasi yang menaikkan kualitas sebesar 150 Elo dan menurunkan biaya per karakter bukanlah pertukaran yang dibayangkan sebagian besar tim akan dilakukan.

Daftar periksa migrasi, dalam urutan yang penting

Pindahkan jalur kualitas audio terlebih dahulu, karena di situlah letak keuntungannya dan di situlah regresi akan tampak jelas bagi pengguna Anda sebelum tampak jelas bagi Anda.

• Audisi suara yang benar-benar Anda rilis. Provider Voice adalah rata-rata dari kumpulan suara arena; suara merek Anda tidak ada di dalamnya. Selisih 150 poin adalah alasan untuk melakukan audisi, bukan penggantinya, dan selisih 84 poin pada papan suara kloning adalah perkiraan yang lebih mendekati tentang bagaimana rasanya produk berbasis kloning.

• Periksa ulang anggaran karakter Anda. Batas 10.000 karakter menggandakan batas v3, jadi skrip yang sebelumnya Anda pisah kini mungkin muat dalam satu permintaan. Itu mengubah jumlah permintaan, logika percobaan ulang, dan kualitas sambungan dari keluaran yang disatukan — dan itulah perubahan yang paling mungkin merusak kode yang mengasumsikan batas 5.000.

• Uji sambungannya. ElevenLabs secara khusus mendokumentasikan penyambungan permintaan yang lebih andal di v4. Jika Anda memecah konten panjang pada v3, jalankan ulang konten yang sama melalui v4 dalam satu panggilan dan bandingkan, daripada mengasumsikan pemecahan tersebut masih diperlukan.

• Uji ulang kasus pelafalan Anda dengan dukungan fonem baru. Leksikon yang dibuat untuk v3 sebaiknya divalidasi ulang, bukan langsung dipercaya; penanganan IPA yang lebih baik dapat berarti override yang sebelumnya benar sekarang berinteraksi secara berbeda dengan tebakan model itu sendiri.

• Biarkan pustaka klon Anda apa adanya. Klon tetap tersimpan; tidak perlu mengunggah ulang dan kloning ulang berisiko menghilangkan suara yang dikenali pengguna Anda.

• Untuk saat ini, pertahankan v3 Conversational di tempat Anda menggunakannya. Ini adalah tier percakapan, bukan model sintesis, masih didokumentasikan pada sekitar 280 ms, dan tidak memiliki padanan v4 yang dipublikasikan. Jika agen Anda bergantung padanya, v4 bukan pengganti yang setara untuk slot tersebut — v4 Turbo adalah label v4 dengan latensi lebih rendah, dan tier latensinya dinyatakan berbeda.

A screenshot of ElevenLabs' model documentation, captured in English, listing the text-to-speech cards: Eleven v4 with exceptional voice cloning, 90+ languages supported, a 10,000 character limit and support for natural multi-speaker dialogue; Eleven v4 Turbo with ultra-low latency near 100 ms median inference and audio tags for fine-grained control; Eleven v3 with 70+ languages and a 5,000 character limit; and Eleven v3 Conversational, Eleven Multilingual v2 and Eleven Flash v2.5 below them.

Apa yang sebenarnya menjadi lebih baik, dan apa yang tidak

Peningkatan-peningkatan itu terkonsentrasi di tiga tempat. Rentang emosional dan tempo adalah yang pertama — itulah yang diukur oleh papan Provider Voice, dan itu pula yang ditekankan dalam pengumuman vendor sendiri, bersama klaim bahwa perbandingan buta lebih menyukai v4 pada sekitar tiga perempat kasus. Perlakukan angka itu sebagai pernyataan vendor dan belum direproduksi; papan-papan arena adalah bagian independen dari cerita yang sama, dan semuanya sepakat soal arah.

A screenshot of the Artificial Analysis Controlled Voice Arena leaderboard, captured in English, showing Alibaba Qwen-Audio-3.1-TTS-Plus first at Elo 1,178, ElevenLabs Eleven v4 second at Elo 1,157, Cartesia Sonic 3.6 fourth at Elo 1,138 and ElevenLabs Eleven v3 seventh at Elo 1,073 on the board where the same eight cloned voices are used for every entrant.

Dialog multi-pembicara dengan identitas pembicara yang stabil adalah yang kedua. Jika Anda telah merilis konten dua pembicara di v3 dan mengerahkan upaya untuk memperbaiki kebocoran atau pergeseran pembicara di sepanjang naskah panjang, itu adalah beban kerja yang peningkatannya bersifat struktural, bukan kosmetik, dan itu adalah salah satu yang hanya sebagian tertangkap oleh angka Elo.

Direktif penyampaian inline adalah yang ketiga — menuliskan desahan atau bisikan langsung ke dalam naskah. Pada v3, itu berarti take kedua, prompt di hulu, atau pascapemrosesan. Pada v4 Turbo, itu adalah satu baris dalam teks yang sudah Anda miliki.

Yang tidak ikut membaik adalah bagian yang sering dianggap tim akan meningkat seiring hadirnya produk unggulan baru: latensi. ElevenLabs tidak menerbitkan angka latensi untuk Eleven v4 sendiri, hanya untuk v4 Turbo pada sekitar 100 ms inferensi median dan sekitar 150 ms waktu median ke ucapan pertama, yang diukur pada September 2026. Tier percakapan Eleven v3 dikutip sekitar 280 ms tetapi merupakan tier berbeda yang mengerjakan pekerjaan berbeda. Jika arsitektur Anda dibangun dengan anggaran latensi yang ketat, posisi yang jujur adalah bahwa v4 Turbo adalah kandidatnya dan Anda harus mengukurnya sendiri, karena nama tier tidak terpetakan dengan rapi dan angka vendor tidak sebanding.

Jendela dua minggu, dan apa yang terjadi setelahnya

Harga promosi berlaku hingga 12 Oktober. Hingga saat itu, Eleven v4 adalah $0.022 per seribu karakter dan Eleven v4 Turbo adalah $0.011, dibandingkan tarif daftar resmi sebesar $0.08 dan $0.04. Setelah periode itu, v4 kembali ke harga yang persis sama dengan biaya v3 saat ini — $0.08 — dan v4 Turbo kembali ke setengah dari tarif v3.

Sebulan dengan pemakaian lima juta karakter: v3 berbiaya $400. v4 selama masa promo berbiaya $110 dan setelahnya kembali berbiaya $400. v4 Turbo berbiaya $55 selama masa promo dan $200 setelahnya. Jadi migrasi yang menarik bisa dibilang adalah ke Turbo, karena ini satu-satunya opsi pada daftar harga ini yang tetap lebih murah daripada v3 setelah promosi berakhir, dan dukungan audio-tag yang tidak dimiliki v3 ada di sana.

Langkah praktisnya adalah mengerjakan pekerjaan kualitas sekarang selagi harganya menjadi bonus, dan membuat keputusan harga berdasarkan angka setelah 12 Oktober. Perbandingan apa pun yang menyebutkan $22 per juta untuk Eleven v4 tanpa mencantumkan tenggat waktu sedang menggambarkan tarif yang berakhir dalam dua minggu.

Menyiapkan peralihan tanpa mempertaruhkan rilis padanya

OrcaRouter tidak menghosting ElevenLabs, jadi tidak ada apa pun dalam migrasi ini yang bisa kami pindahkan untuk Anda — perubahannya terjadi di akun ElevenLabs Anda. Yang kami tangani adalah lapisan di sekitar stack yang tidak bergantung pada satu vendor. Jika jalur suara Anda adalah salah satu dari beberapa model di balik satu endpoint, kami menyediakan 200+ model melalui satu API key dengan harga daftar penyedia yang diteruskan apa adanya tanpa markup 0%, yang berarti penetapan harga ulang oleh vendor — seperti yang ini — berlaku di sisi kami pada hari yang sama saat berlaku di sisi mereka, tanpa kontrak kedua atau perubahan integrasi.

Ketika jalur suara berhadapan langsung dengan pelanggan dan tidak boleh terputus, failover otomatis mengalihkan rute melewati upstream yang terdegradasi alih-alih menggagalkan panggilan. Itulah bentuk yang seharusnya diambil oleh migrasi seperti ini: jalankan v4 di belakang endpoint yang sama dengan solusi yang ada saat ini, alihkan sebagian trafik, dan biarkan lapisan routing menahan fallback sementara Anda mencari tahu apakah 150 poin Elo muncul di audio Anda sendiri.

Keputusan tersebut, dalam satu paragraf.

Migrasikan jika pendengar mendengar output Anda dan Anda masih menggunakan v3 — kesenjangan kualitas adalah lompatan satu generasi terbesar yang pernah dipublikasikan ElevenLabs di papan-papan ini, batas karakter menjadi dua kali lipat, daftar bahasa menjadi dua kali lipat, dan harga daftar lebih rendah. Lakukan migrasi secara bertahap, mulai dari suara dengan trafik tertinggi Anda, bukan skrip Anda yang paling kompleks, dan rencanakan anggaran Anda berdasarkan angka 12 Oktober, bukan angka minggu ini. Tetap di v3 hanya jika integrasi Anda tidak dapat menyerap batas input yang berbeda, atau jika v3 Conversational menjadi komponen penting dalam sebuah agen dan Anda belum mengukur v4 Turbo terhadap anggaran latensi Anda sendiri. Itulah dua kasus di mana kesabaran lebih murah daripada peralihan yang terburu-buru.