![ElevenLabs Eleven v4용으로 생성된 히어로 카드로, 두 개의 패널이 있습니다. 왼쪽에는 [laughs], [whispers], [said angrily in French accent]와 같은 인라인 오디오 태그를 보여주는 스크립트 블록이 있고, 오른쪽에는 순위 1, Elo 1,319, 100만 자당 $80.00, Artificial Analysis의 Provider Voice Arena에서 1,674회 등장을 표시하는 패널이 있으며, 푸터에는 'Provider Voice 순위, Elo 및 가격은 Artificial Analysis 기준, 2026년 9월; 태그 구문 및 지연 시간은 공급업체 문서 기반.'이라고 적혀 있습니다. OrcaRouter 로고는 오른쪽 아래 모서리에 있습니다.](https://cms.orcarouter.ai/api/media/file/1-1462.png)
Eleven v4의 오디오 태그와 10초 클론: 파이프라인에서 무엇이 바뀌는가
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 982 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 197 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
가장 중요한 것은ElevenLabs Eleven v4 그 Elo가 아니다. 그것은 이 모델이 대본에 적힌 연출을 읽는다는 점이며 — [웃음], [속삭임], [한숨], [프랑스 억양으로 화내며 말함], 심지어 [가벼운 비] — 그리고 ElevenLabs Eleven v4 Turbo는, 같은 날 출시된 저지연 형제 모델로서, 공급업체가 약 150ms라고 제시하는 첫 음성까지의 중앙값 시간에 동일한 태그를 따른다는 점이다. 둘 다 2026년 9월 28일 정식 출시되었다. Artificial Analysis의 Provider Voice Arena는 이미 Eleven v4를 1,674회 등장에 걸쳐 Elo 1,319로 1위에 올려놓았으며, 리더보드 가격은 100만 문자당 $80.00이다. 순위는 헤드라인이다. 연출 구문과 10초 클론이 바로 여러분이 구축해야 할 것을 바꾸는 부분이다.
![A generated four-card summary of what ElevenLabs Eleven v4 changed in the pipeline: a Script direction card listing [laughs], [whispers], [sighs], [said angrily in French accent] and natural-language delivery prompts; a Sound and scene card listing [light rain], [phone buzzing], multi-speaker dialogue with turn-level context and IPA phonemes for custom pronunciations; a Voice creation card listing Instant Voice Cloning from 10 s of audio, a Professional Voice Cloning tier above it, and 90-plus languages with a 10,000-character cap; and a Two endpoints card describing Eleven v4 as the most emotive, highest-quality model against Eleven v4 Turbo at about 100 ms median inference and about 150 ms to first speech. Footer: 'Tag syntax, cloning bar, language count, character cap and Turbo latency are vendor-documented; no independent score is quoted on this card.' The OrcaRouter logo sits in the bottom-right corner.](https://cms.orcarouter.ai/api/media/file/2-1397.png)
두 모델, 하나의 출시, 서로 다른 역할
ElevenLabs는 2026년 9월 28일에 두 개의 엔드포인트를 출시했으며, 그것들은 속도 전환 스위치가 달린 같은 제품이 아니다. ElevenLabs Eleven v4는 표현력이 뛰어난 모델이다: 90개 이상의 언어, 요청당 10,000자 제한, 사용자 지정 발음을 위한 향상된 국제 음성 기호 지원, 그리고 회사가 한 장면 전반에 걸쳐 화자 정체성을 보존한다고 말하는 다중 화자 대화. ElevenLabs Eleven v4 Turbo는 90개 이상의 언어와 10,000자 제한을 유지하지만 에이전트에 맞게 조정되었다 — 발표문에서는 ElevenLabs가 2026년 9월에 측정한 약 100ms의 중앙값 추론 지연 시간과 약 150ms의 첫 음성까지의 중앙값 시간을 인용한다.

반응적으로 제기되는 질문 — 플래그십이 전화 에이전트에 충분히 빠른가 — 에는 공개된 답이 없다. ElevenLabs는 Turbo에 대한 지연 시간 수치를 제공할 뿐, Eleven v4 자체에 대해서는 제공하지 않으며, 둘은 하나의 모델을 두 이름으로 부른 것이 아니라 서로 다른 엔드포인트다. 에이전트의 예산이 첫 오디오까지 200 ms라면, 문서상 엔드포인트는 Turbo이고 플래그십은 아니다.
태그는 실제 인터페이스이고, 실제 의존성입니다
인라인 오디오 태그는 음성 합성에서 새로운 것이 아니지만, 여기서 유용한 변화는 지시 준수의 정확도입니다. 이 발표에 따르면 Eleven v4는 이전 모델보다 오디오 태그와 자연어 지시 프롬프트를 더 정밀하게 따르며, 이렇게 하면 나중에 오디오를 편집하지 않고도 웃음, 속삭임, 또는 특정 억양의 발성을 연출할 수 있습니다.
세 가지 실질적인 결과가 뒤따르며, 이는 데모 릴보다 더 중요합니다:
• 당신의 스크립트는 문자열이 아니라 템플릿화된 아티팩트가 됩니다. 태그는 콘텐츠 파이프라인에서 하나의 토큰입니다: 신뢰할 수 없는 텍스트가 전달될 때는 이스케이프해야 하고, CMS, 번역 계층, diff 검토를 견뎌야 합니다. 번역자가 [whispers]를 빠뜨리면 공연을 조용히 바꿔 놓은 것입니다.
태그 준수는 버전이 명시된 벤더의 주장입니다. 이 세대가 이전 세대보다 태그를 더 잘 따른다는 주장은 ElevenLabs 자체의 주장이며 ElevenLabs가 테스트한 것으로, 언어 전반에서 동일하게 성립하지는 않을 것입니다. 그것을 바탕으로 스타일 가이드를 만들기 전에 자신의 스크립트와 자신의 로케일에서 검증하세요.
• 다음과 같은 음향 효과 태그,[light rain] 또는 [phone buzzing]은 오디오 포스트 프로덕션 작업의 일부를 텍스트 프롬프트로 조금 옮깁니다. 이는 측정해 볼 가치가 있는 비용 이동입니다. 태그가 폴리 패스를 대체한다면 저렴하지만, 아무것도 대체하지 않고 분산만 더한다면 QA에서 새로운 실패 모드가 됩니다.
10초는 온보딩을 바꾸는 숫자입니다
이번 릴리스의 Instant Voice Cloning은 10초 분량의 오디오에서 높은 충실도로 음성을 캡처하며, 그보다 상위에는 여전히 프로페셔널 클로닝 티어가 제공됩니다. 10초는 워크플로 단계 하나를 없앨 만큼 짧아서, 동의 확보, 샘플 업로드, 첫 합성이 스튜디오 없이 휴대폰에서 한 자리에서 이루어질 수 있습니다.
동의 문제는 샘플이 짧아져도 줄어들지 않는다. 오히려 커진다. 누구나 녹음할 수 있는 짧은 클립만으로도 설득력 있는 복제본을 만들 수 있을 만큼 기준이 낮아졌기 때문이다. 소유하지 않은 목소리를 복제하고 있다면, 규정 준수 문제는 이제 API 호출 이전 단계에서 전적으로 당신이 답해야 할 몫이다 — 모델은 당신이 요청한 대로 할 뿐이다. 10초라는 수치를 허가증이 아니라 운영상의 임계값으로 취급하라.
창이 열려 있는 동안 드는 비용
ElevenLabs는 출시와 함께 가격을 재조정했으며, 오늘 페이지에 표시된 요금이 바로 그 프로모션 요금입니다. API 가격표에서 Eleven v4는 1,000자당 $0.022로 명시된 정가 $0.08과 대비되며, Eleven v4 Turbo는 $0.011로 $0.04와 대비됩니다. 두 제품 모두 동일한 라벨이 붙어 있습니다: 10월 12일까지 72% 할인. 같은 페이지에서는 이전 플래그십인 Eleven v3를 1,000자당 $0.08로 책정하고 있습니다.
• 아레나의 보드 가격, 백만 자당 — Eleven v4 $80.00, 해당 보드 상위 10위 중 최고.
• 벤더 요율표, 1,000자당 — 10월 12일까지 $0.022, 이후 $0.08.
• 실제로 이것이 의미하는 바 — 스크립트가 많은 500만 자의 한 달은 동일한 엔드포인트에서 동일한 코드로 해당 기간 동안 $110, 그 이후에는 $400이 든다.

오늘 페이지에 표시된 숫자를 기준으로 1분기 예산을 편성하는 사람은 누구든, 2주 뒤면 만료되는 숫자를 기준으로 예산을 편성하는 셈입니다. $0.08을 사용하세요.
이런 런칭에서 라우터가 제 몫을 하는 순간
OrcaRouter는 ElevenLabs를 호스팅하지 않으므로, 이번 출시에서 우리를 통해 호출할 수 있는 것은 아무것도 없으며, 그렇지 않은 듯이 암시하지도 않을 것입니다. Eleven v4를 호출할 곳은 ElevenLabs 자체 API입니다. 출시 후 2주 동안 단일 키가 진정으로 유용하게 쓰이는 지점은 비교입니다. 새로운 플래그십이 이미 사용 중인 것보다 나은지 판단하려는 경우, 리더보드가 아니라 자신의 스크립트에서 두 가지를 A/B 비교하고 싶을 것입니다. 그리고 두 벤더에 걸쳐 그렇게 하려면 답을 얻기도 전에 계정 두 개, 청구 관계 두 개, 통합 경로 두 개가 필요합니다.
저희가 처리하는 경우가 바로 이것입니다: 하나의 API 키로 200개 이상의 모델에 걸쳐 제공업체 정가가 0% 마크업으로 그대로 적용되므로, 만료일이 있는 프로모션 기간을 포함한 공급업체 가격 변경이 다음 청구 주기가 아니라 같은 날 저희 쪽에서 바로 반영됩니다. 음성 경로가 고객에게 노출되는 경우, 자동 장애 조치가 하나의 엔드포인트가 성능 저하될 때 트래픽을 정상 업스트림으로 이동시켜 주므로, 릴리스에 모든 것을 걸지 않고도 완전히 새로운 모델을 시험해 볼 수 있습니다.
무엇을 먼저 테스트할지, 그리고 무엇을 무시할지
세 가지 점검은 어떤 순위보다 더 많은 것을 알려줄 것입니다. 첫째, 가장 현실적인 최장 스크립트를 10,000자 한도에 넣어 실행해 보고 이음새가 어디에 생기는지 확인하세요 — 이 한도는 요청당 적용되며, 다중 화자 대화는 이 한도로 인해 분할될 가능성이 가장 큰 기능입니다. 둘째, 태그가 포함된 자신만의 문장 다섯 개를 v4와 v4 Turbo 모두에 넣고, 표현형 엔드포인트와 저지연 엔드포인트 사이에서 준수 편차가 있는지 들어 보세요. 이들은 별개 모델이며, 한쪽에서 제대로 적용되는 태그가 다른 쪽에서도 똑같이 적용된다고 보장할 수 없습니다. 셋째, 실제 월간 문자 사용량의 단가를 $0.022가 아니라 $0.08로 산정하세요. 다음 분기는 바로 그 숫자를 기준으로 운영되기 때문입니다.
발표 자료의 약 75% 블라인드 선호도 수치는 공급업체 측정치이며, 우리는 이것을 다른 무엇으로 세탁할 생각이 없습니다. 이번 출시에서 독립적인 수치는 리더보드에 있는 것입니다: 1,674회 등장 기준 1,319 Elo로 1위, 그리고 그 주변의 약 ±19점 구간입니다. 이는 실제 리더보드에서 나온 강력한 결과입니다. 그러나 이는 사양이 아니며, 여러분의 태그 구문이 번역 과정을 거쳐도 살아남는지는 알려주지 않습니다.
