
Eleven v4 vs ElevenLabs의 나머지: Eleven v3에서 마이그레이션해야 할까?
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 982 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 195 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1189 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
이미 ElevenLabs Eleven v3를 사용 중이라면, 답은 청취자가 듣는 모든 것에는 '예'이고, ElevenLabs가 그대로 둔 두 가지에는 '아니요'입니다. ElevenLabs Eleven v4는 Artificial Analysis의 Provider Voice Arena에서 자체 전작 대비 150 Elo 포인트(1,319 대 1,169)를, 모두에게 동일한 8개의 복제 음성이 사용되는 Controlled Voice 보드에서 84포인트를 얻습니다. 또한 v3의 두 배에 달하는 문자 제한과 대략 두 배의 언어 지원 범위를 갖춥니다. 바뀌지 않는 것은 계약, 음성 복제본, 그리고 청구 기준이 되는 등급 구조이며, 그래서 이번 마이그레이션은 대부분보다 비용이 적게 들면서도 한꺼번에가 아니라 단계적으로 진행할 가치가 있습니다.

가족 간 점수판
이것은 벤더 대 벤더 비교가 아니므로, 아레나 보드에서의 가격 정규화는 평소와 다르게 작동합니다. 두 모델 모두 동일한 계정에서, 동일한 요율표를 기준으로 문자당 과금됩니다. 아래의 강점과 약점은 경쟁사가 아닌 형제 모델을 기준으로 측정한 것입니다.
• Provider Voice Arena — ElevenLabs Eleven v4 1위, Elo 1,169 대 ElevenLabs Eleven v3 18위, Elo 1,169. 150포인트 차이.
• Controlled Voice Arena, 클론 부문에서 Eleven v4 2위, Elo 1,157 대 Eleven v3 7위, Elo 1,073. 84점 차이.
• Arena 가격 정규화 — Eleven v4는 100만 문자당 $80.00, Eleven v3는 $100.00입니다. 새 플래그십은 리더보드에서 둘 중 더 저렴한 쪽입니다.
• 공급업체 요율표 — Eleven v4: 1,000자당 $0.022 프로모션, 10월 12일 이후 $0.08; Eleven v3: $0.08. 정가에서는 동일하며, 해당 기간에는 반값.
• 요청당 입력 상한 — Eleven v4 10,000자 vs Eleven v3 5,000자. 정확히 두 배.
• 언어 지원 범위 — Eleven v4 90개 이상 vs Eleven v3 70개 이상.
• 전달 지침 — Eleven v4는 인라인 오디오 태그와 IPA 음소 입력을 문서화합니다; Eleven v3는 모델 페이지에서 둘 다 문서화하지 않습니다.
• 지연 시간, 공급업체 발표 기준 — Eleven v3 Conversational 약 280ms; Eleven v4 Turbo 첫 음성까지 중앙값 약 150ms. 서로 다른 등급, 서로 다른 테스트.
• 음성 클론 — 변경 없음. 기존 인스턴트 및 프로페셔널 클론이 그대로 유지됩니다.
• 요금제 등급 — 변경 없음. Free 10,000자, Starter $6, Creator $22, Pro $99, Scale $299, Business $990.
• 마이그레이션 경로 — Eleven v4와 Eleven v4 Turbo는 모두 API, 에이전트, 크리에이티브 서피스에서 라이브 상태이며, 이전 Turbo 식별자는 사용 중단(deprecated)되었습니다.
가격 행을 두 번 읽어 보세요. 이번 출시에서 이례적인 사실은 새 모델이 대체하는 모델보다 더 저렴하다는 점입니다. 같은 보드에서, 정가로, 프로모션 적용 없이 백만당 $80 대 $100입니다. 프로모션 요율은 그 차이를 만들어 내는 것이 아니라 오히려 더 벌립니다. 품질을 150 Elo 높이면서 문자당 비용을 낮추는 마이그레이션은 대부분의 팀이 기대하는 맞바꿈이 아닙니다.
마이그레이션 체크리스트, 중요한 순서대로
오디오 품질 경로를 먼저 옮기세요. 그곳이 이득이 있는 곳이고, 회귀가 당신에게 명백해지기 전에 사용자에게 먼저 명백해질 곳이기 때문입니다.
• 실제로 출시하는 음성을 오디션하라. Provider Voice는 아레나 음성 세트 전체에 대한 평균값이며, 당신의 브랜드 음성은 거기에 포함되어 있지 않다. 150포인트 격차는 오디션을 해야 하는 이유이지 그것을 대체하는 수단이 아니며, 클론 음성 보드의 84포인트 격차가 클론 기반 제품이 어떤 느낌일지에 대한 더 근접한 추정치다.
• 문자 예산을 다시 확인하세요. 10,000자 상한은 v3의 두 배이므로, 이전에 분할했던 스크립트가 이제 한 요청에 들어갈 수 있습니다. 이는 요청 수, 재시도 로직, 이어 붙인 출력의 이음새 품질을 바꾸며, 5,000자 상한을 가정한 코드를 깨뜨릴 가능성이 가장 큰 변경입니다.
• 이음매를 테스트하세요. ElevenLabs는 v4에서 더 안정적인 요청 이어 붙이기를 구체적으로 문서화하고 있습니다. v3에서 장문 콘텐츠를 분할하고 있었다면, 분할이 여전히 필요하다고 가정하지 말고 동일한 콘텐츠를 v4에서 한 번의 호출로 다시 실행해 비교하세요.
• 새로운 음소 지원으로 발음 사례를 다시 테스트하세요. v3용으로 구축된 렉시콘은 신뢰하기보다 다시 검증해야 합니다. 개선된 IPA 처리는 이전에 올바르던 오버라이드가 이제 모델 자체의 추측과 다르게 상호작용할 수 있음을 의미할 수 있습니다.
• 클론 라이브러리는 그대로 두세요. 클론은 그대로 유지되므로 다시 업로드할 필요가 없으며, 다시 클론하면 사용자들이 알아보는 목소리를 잃을 위험이 있습니다.
• 당분간은 v3 Conversational을 사용 중인 곳에서 계속 사용하세요. 이는 합성 모델이라기보다 대화형 티어이며, 여전히 약 280ms로 문서화되어 있고, 공개된 v4 대응 모델이 없습니다. 에이전트가 이에 의존한다면, v4는 해당 슬롯을 그대로 대체하는 동등한 대체품이 아닙니다 — v4 Turbo가 지연 시간이 더 낮은 v4 레이블이고, 그 지연 시간 등급은 다르게 표기됩니다.

실제로 나아지는 것과 그렇지 않은 것
향상은 세 곳에 집중되어 있다. 감정적 범위와 페이싱이 첫 번째다. 그것이 Provider Voice 보드가 측정하는 것이며, 벤더 자체 발표가 강조하는 것이기도 하다. 여기에는 블라인드 비교에서 약 4분의 3의 사례가 v4를 선호했다는 주장도 함께 포함된다. 그 수치는 벤더가 제시한 것이며 재현되지 않은 것으로 취급하라. 아레나 보드는 같은 이야기의 독립적인 절반이며, 방향성에는 동의한다.

두 번째는 안정적인 화자 정체성을 갖춘 다중 화자 대화입니다. v3에서 두 화자 콘텐츠를 출시하고 긴 대본 전반에서 화자 누출이나 드리프트를 수정하는 데 공을 들였다면, 그것은 개선이 겉치레가 아니라 구조적인 작업이며, Elo 수치가 부분적으로만 담아내는 작업이기도 합니다.
인라인 전달 지시문이 세 번째입니다 — 대본에 한숨이나 속삭임을 직접 적는 것이죠. v3에서는 그것이 두 번째 테이크, 업스트림 프롬프트, 또는 후처리를 뜻했습니다. v4 Turbo에서는 이미 가지고 있는 텍스트의 한 줄입니다.
개선되지 않는 부분은 팀들이 흔히 새 플래그십과 함께 좋아질 것이라고 가정하는 바로 그 부분, 즉 지연 시간이다. ElevenLabs는 Eleven v4 자체에 대해서는 지연 시간 수치를 공개하지 않으며, 2026년 9월에 측정된 v4 Turbo의 대략 중앙값 추론 100ms와 대략 중앙값 첫 음성까지의 시간 약 150ms에 대해서만 공개한다. Eleven v3의 대화형 티어는 약 280ms로 인용되지만, 이는 다른 역할을 수행하는 다른 티어다. 아키텍처가 엄격한 지연 시간 예산을 중심으로 구축되어 있다면, 솔직한 입장은 v4 Turbo가 후보이며 직접 측정해야 한다는 것이다. 티어 이름이 깔끔하게 대응되지 않고 벤더 수치가 동일 기준이 아니기 때문이다.
2주라는 기간, 그리고 그 이후에 일어나는 일
프로모션 가격은 10월 12일까지 진행됩니다. 그때까지 Eleven v4는 1,000자당 $0.022이고 Eleven v4 Turbo는 $0.011이며, 이는 각각 명시된 정가 $0.08과 $0.04에 대비됩니다. 프로모션 기간이 끝나면 v4는 오늘 v3의 가격과 정확히 동일한 $0.08로 돌아가고, v4 Turbo는 v3 요금의 절반으로 돌아갑니다.
월 500만 자를 처리하는 경우를 계산해 보면: v3는 400달러가 듭니다. v4는 프로모션 기간 동안 110달러, 이후에는 다시 400달러가 듭니다. v4 Turbo는 프로모션 기간에 55달러, 이후에는 200달러가 듭니다. 따라서 흥미로운 마이그레이션은 아마도 Turbo로의 이전일 것입니다. 왜냐하면 이 요금표에서 프로모션이 끝난 뒤에도 v3보다 저렴하게 유지되는 유일한 옵션이며, v3에 없는 오디오 태그 지원이 바로 거기에 있기 때문입니다.
실질적인 행보는 지금 품질 작업을 해두고 가격은 덤으로 여기며, 가격 결정은 10월 12일 이후 수치를 기준으로 내리는 것입니다. Eleven v4의 백만당 22달러를 마감 기한 없이 인용하는 모든 비교는 2주 안에 만료되는 요율을 설명하는 셈입니다.
릴리스를 그것에 걸지 않고 전환을 단계적으로 준비하기
OrcaRouter는 ElevenLabs를 호스팅하지 않으므로, 이 마이그레이션에서 저희가 대신 옮겨드릴 것은 없습니다 — 변경은 귀하의 ElevenLabs 계정에서 일어납니다. 저희가 처리하는 것은 단일 벤더가 아닌 스택을 둘러싼 계층입니다. 귀하의 음성 경로가 하나의 엔드포인트 뒤에 있는 여러 모델 중 하나라면, 저희는 200개 이상의 모델을 단일 API 키로 제공하며, 공급자 정가를 0% 마크업으로 그대로 전달합니다. 즉, 이번과 같은 벤더의 가격 재책정은 별도의 계약이나 통합 변경 없이, 상대방에게 적용되는 같은 날 저희 쪽에도 적용됩니다.
음성 경로가 고객 대면이고 끊겨서는 안 되는 경우, 자동 페일오버는 통화를 실패시키는 대신 성능이 저하된 업스트림을 우회합니다. 이런 마이그레이션은 다음과 같은 형태를 취해야 합니다: 기존 서비스와 동일한 엔드포인트 뒤에서 v4를 실행하고, 트래픽의 일부를 전환한 뒤, 150 Elo 포인트가 여러분의 실제 오디오에서 나타나는지 확인하는 동안 라우팅 계층이 폴백을 유지하도록 하세요.
결정, 한 문단으로
청취자가 당신의 출력을 듣는데 당신이 아직 v3를 쓰고 있다면 마이그레이션하세요 — 품질 격차는 ElevenLabs가 이 게시판들에서 공개한 단일 세대 도약 중 가장 큰 폭이고, 문자 수 상한은 두 배가 되며, 언어 목록은 두 배가 되고, 정가는 더 낮습니다. 마이그레이션은 단계적으로 진행하고, 가장 복잡한 스크립트가 아니라 트래픽이 가장 많은 음성부터 시작하며, 이번 주 수치가 아니라 10월 12일 수치를 기준으로 예산을 계획하세요. 통합이 다른 입력 상한을 수용할 수 없거나, v3 Conversational이 에이전트에서 핵심을 지탱하고 있는데 아직 자체 지연 시간 예산에 맞춰 v4 Turbo를 측정하지 않았다면 v3에 남으세요. 서두른 전환보다 기다리는 편이 비용이 덜 드는 경우는 바로 이 두 가지입니다.
