
Eleven v4 vs Sesame Preview: Det här är inte jämförelsen du tror att det är
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 982 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 197 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
En sökning efter ElevenLabs Eleven v4 mot Sesame Preview ger massor av sidor som glatt placerar dem i en tabell. Nästan alla jämför en produkt med ett benchmark mot en demo, och tabellen är det minst användbara inslaget på sidan. Eleven v4 är en allmänt tillgänglig talsyntesmodell med ett API, en prislista och en publicerad arena-rankning. Sesame Preview är en gratis röstassistent för konsumenter som svarar när du trycker på en länk. De är inte två alternativ för samma köp, och den ärliga versionen av den här artikeln handlar om vilken du faktiskt vill ha — eftersom svaret beror på en fråga som ingen av leverantörernas marknadsföringssidor ställer.

Vad Eleven v4 egentligen är
ElevenLabs släppte Eleven v4 och Eleven v4 Turbo den 28 september som produktionsslutpunkter. Eleven v4 har över 90 språk, ett tak på 10 000 tecken per begäran, dialog med flera talare med stabil talaridentitet, infogade framförandedirektiv, förbättrat stöd för IPA-fonem och omedelbar röstkloning från tio sekunders ljud. Den rankas etta på Artificial Analysis' Provider Voice Arena med Elo 1 319 och 1 674 prover bakom uppskattningen, och tvåa på Controlled Voice-tavlan med 1 157. På API-prislistan listas den till $0.022 per tusen tecken under en kampanj som slutar den 12 oktober, och återgår till $0.08 – samma pris som den tidigare ElevenLabs Eleven v3 har haft.
Varje del av det stycket går att kontrollera. Det finns en modellidentifierare, en dokumenterad indatagräns, ett publicerat pris per tecken, en avvecklingsnotis för de äldre Turbo-nivåerna och en oberoende post i en resultattavla med ett konfidensintervall. Så ser en modell ut när man kan köpa den.

Vad Sesame Preview egentligen är
Sesame Preview är en konsumentdemo. Det är en röstassistent som du når via företagets egen webbplats, med en liten uppsättning namngivna personas – Maya, Miles, Simone och Charlie – konversationsminne som följer med mellan sessioner, webbsökning, anteckningar och påminnelser samt en sammanfattning efter samtalet. Det är gratis. Inloggade sessioner varar ungefär en halvtimme; gästsessioner ungefär fem minuter. Den hanterar endast engelska. Och Sesame säger klart och tydligt att den inte utför uppgifter: poängen med demon är samtalskänslan, inte en agent som bokar ditt möte.
Det som spelar roll för den här jämförelsen är vad som saknas. Det finns ingen modellidentifierare, ingen endpoint, ingen prislista, ingen indatagräns som du kan designa mot, och inget annonserat datum för produktionsmodellen. Sesames publicerade forskningslinje är en separat sak — en talspråksmodell med öppna vikter och 4K-kontext — och det är inte samma system som du pratar med i Preview. Så det som heter "Sesame Preview" i varje jämförelsetabell är en produkt som du inte kan integrera med, och det du kan ladda ner är inte produkten.
Varför de inte kan dela en resultattavla
Den kontrollerade röstarenan på Artificial Analysis är det närmaste detta område har till en neutral mätning, och Sesame Preview finns inte med på den. Den finns inte heller med på tavlan för leverantörsröster. Det finns ingen Elo, inget antal röster, ingen prisnormalisering – och inget sätt att ta fram någon, eftersom en resultattavla kräver en anropbar slutpunkt och ett pris per enhet, och Sesame Preview har varken det ena eller det andra.
Så varje tabell som ställer dessa två sida vid sida fyller Sesame-kolumnen från en produktrundtur. Att jämföra en endpoint för 80 dollar per miljon tecken med en kostnadsfri webbdemo utifrån "naturlighet" är inte en jämförelse; det är ett kategorimisstag med ett Elo-format hål i sig. Om en sida hävdar en vinnare i den duellen har den hittat på grunden för påståendet.
Det som kan sägas ärligt är vad var och en försöker vara. Eleven v4 är optimerad för att förvandla ett manus till ett framförande, i stor skala, via ett API, med samma röst varje gång. Sesame Preview är optimerad för att få en främling att känna att den pratar med någon, en gång, i en webbläsarflik.
Det enda stället där jämförelsen är verklig
Det finns en genuin fråga under sökningen, och den handlar om öppna vikter. Om det du faktiskt vill ha är en talmodell som du kan ladda ner och köra själv, är ingen av leverantörernas flaggskepp svaret — ElevenLabs stack är stängd, och det Sesame-system du kan köra är forskningsmodellen med 4K-kontext, inte assistenten.
För den uppgiften är den användbara referenspunkten på arenans resultattavlor: Breeze TTS 2 är det högst rankade open-weights-alternativet på Provider Voice, med Elo 1 206 och 34,00 USD per miljon tecken, med 16 open-weights-modeller i den resultattavlans fält på 92. Det är 113 poäng bakom Eleven v4 och väl före Qwen3 TTS-serien på 944 och 930. Om ditt projekt behöver köras på din egen hårdvara är jämförelsen som är värd att göra Eleven v4 mot Breeze TTS 2 – inte mot en webbläsardemo – och avvägningen där är verklig: du ger upp ungefär hundra Elo-poäng och arbetsflödet med ljudtaggar, och du får kontroll över hela stacken.

Att välja utifrån vad var och en är till för
• Om du bygger en produkt som talar — Eleven v4, via ett API, enligt en prislista. Inget i Sesame Preview går att integrera, så det ingår inte i det här beslutet.
• Om du vill ha en konversationsdemo för att visa någon hur röst-AI känns — Sesame Preview, och det är gratis, vilket är hela argumentet för det.
• Om du utvärderar emotionellt omfång innan du bestämmer dig för en leverantör — Eleven v4:s Elo 1 319 på tavlan för leverantörsröster och 1 157 på tavlan för klonade röster är siffrorna du bör titta på, med förbehållet att den andra är den som beskriver en produkt med klonad varumärkesröst.
• Om du behöver tal på andra språk än engelska – Eleven v4 dokumenterar över 90; Sesame Preview är endast engelska och säger det självt.
• Om du behöver att modellen faktiskt ska göra något – ingen av dem, i den här jämförelsen. Sesame Preview utför medvetet inte uppgifter, och Eleven v4 är en syntesmotor som behöver din egen stack runt sig.
• Om du behöver köra det lokalt – ingetdera. Breeze TTS 2 är referenspunkten för öppna vikter.
• Om kostnaden är den avgörande faktorn — Eleven v4 kostar $0,022 per tusen tecken fram till den 12 oktober och $0,08 därefter, och Sesame Preview är gratis eftersom det inte är en produkt man kan köpa. En gratis demo är inte ett billigare alternativ; det är en annan kategori.
Det enda de båda har gemensamt är ett datumproblem. Eleven v4:s kampanjpris upphör den 12 oktober, vilket ändrar kostnaden med en faktor på nästan fyra. Sesame har inte angett något datum alls för produktionsmodellen, vilket är en annan sorts osäkerhet — Preview kan ersättas redan nästa månad eller förbli oförändrad i ett år, och det går inte att planera kring en lansering som ingen har schemalagt.
Om din stack till slut omfattar mer än en röstleverantör
OrcaRouter är inte värd för varken ElevenLabs eller Sesame, så det finns inget i den här artikeln att anropa via oss och vi kommer inte att antyda något annat. Det vi däremot tar upp är lagret ovanför en stack som redan är flerleverantörsbaserad. En API-nyckel når över 200 modeller med leverantörernas listpriser vidarebefordrade med 0 % påslag, så en prisändring uppströms – den här lanseringens kampanjfönster är ett levande exempel – slår igenom på vår sida samma dag i stället för vid nästa faktura. Där talvägen är kundvänd, flyttar automatisk redundansväxling trafik till en frisk uppström när en försämras, vilket är hur du kan provköra en ny slutpunkt på verklig trafik utan att satsa en release på den.
Vad du bör ta med dig
Eleven v4 är en modell du kan köpa, mäta och lita på, och den ligger för närvarande i topp på leverantörsröstlistan med en två veckor lång prissänkning. Sesame Preview är ett gratis experiment i samtalskänsla, endast engelska, begränsat till trettio minuter och inget man kan bygga på. Anledningen till att de dyker upp i samma sökresultat är att båda är röst-AI och båda är nya – inte att någon av dem är ett alternativ till den andra.
Om du kom hit för att välja mellan dem är den användbara omformuleringen denna: du väljer inte en röstmodell. Du avgör om du lanserar en produkt eller testar en demo, och bara ett av dessa beslut har en prislista kopplad till sig. Om det är produkten, läs siffrorna för Eleven v4 och läs dem igen den 13 oktober, när kampanjpriset löper ut och jämförelsen mot alla andra leverantörer på tavlan förändras.
