Hero-titelkaart met de kop 'Claude Voice: een verborgen Preview-tabblad' en de ondertitel 'Wat bevestigd is, wat gerapporteerd is, wat nog steeds inferentie is', en drie kaarten met de tekst 'Gespot: een apart Voice-item in de webnavigatie van Claude, gelabeld Preview, gerapporteerd op 4 oktober 2026', 'Niet uitgebracht: geen spraakmodel, geen modelkaart, geen API-vermelding, geen prijs' en 'Dateerbaar: opt-in van consumenten om spraakgegevens te delen voor modeltraining, gerapporteerd op 5 oktober 2026', met een voettekst die verwijst naar berichtgeving over het zichtbare navigatie-item en de helpdocumentatie van Anthropic die op 11 oktober 2026 is gelezen, en het OrcaRouter-logo in de rechteronderhoek.
Guides & Insights

Claude-stemlek: Een verborgen "Preview"-tabblad in de Claude-app, en de opt-in voor stemgegevens die daarnaast verscheen

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Op een bepaald moment vóór 4 oktober 2026 verscheen er in de Claude-webinterface een navigatie-item dat nog niet zichtbaar had mogen zijn: een aparte Spraak-tab met een interne Voorbeeld-label. Er is geen aankondiging van, geen modelkaart, geen prijzenrij, geen API-vermelding en geen datum. In dezelfde periode — gemeld op 5 oktober — voegde de leverancier stilletjes iets anders toe dat het nog niet had: een opt-in voor consumenten waarmee spraakopnamen en spraakchatgegevens "om onze AI-modellen te verbeteren," mogen worden gebruikt, los van de toestemming die het al vraagt voor tekstgesprekken. De productlijn bestaat nog steeds uit vier modellen met tekstuitvoer — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 en Claude Haiku 5.5 — het bedrijf heeft nog nooit een eigen spraakmodel uitgebracht. De nuttige vraag die deze lek oproept is dus niet "lanceert het bedrijf een spraakmodel?" De vraag is specifieker: het tabblad bewijst dat er een interface wordt gebouwd, en de opt-in is het eerste harde bewijs dat iemand heeft dat het bedrijf spraaktrainingsgegevens wil. Dat zijn twee verschillende beweringen, en alleen de tweede is dateerbaar.

Alles hieronder is ingedeeld in wat bevestigd is, wat gerapporteerd en niet-geverifieerd is, en wat inferentie is. Anthropic heeft helemaal niets gezegd over de tab, wat betekent dat de bron voor het centrale feit een screenshot is en geen persbericht.

Wat er nu eigenlijk gespot is, en wat het ons niet vertelt

De bevinding komt van @testingcatalog op X, geplaatst op 4 oktober 2026, en op 10 oktober op dezelfde publicatie beschreven. In de bewoordingen van het stuk: "er is een apart Voice-item verschenen in de webnavigatie van Claude met een interne Preview-label," en "de mogelijkheden en de openbare beschikbaarheid ervan blijven onbekend." Dat is al het directe bewijs. Het bericht kadert het label expliciet als verwijzend naar een interne preview-omgeving in plaats van een uitrol.

Drie dingen volgen uit het artefact, en geen ervan is een spec:

• De reikwijdte — een intern previewlabel zegt dat er ergens binnen Anthropic een build bestaat. Het zegt niet dat de build een nieuw model bevat. Een navigatietab is UI.

• De aanbieder — het rapport merkt op dat Anthropic "de onderliggende spraakaanbieder niet heeft bevestigd", geen specifieke tekst-naar-spraakmodellen via zijn API heeft uitgebracht en geen native end-to-end realtime-audiomodel heeft gelanceerd. De laatste twee zijn verifieerbaar en waar. Anthropic's openbare modeldocumentatie somt vier huidige modellen op en beschrijft alle vier op dezelfde manier: tekst- en afbeeldingsinvoer, tekstuitvoer.

• De timing — er is geen datum gemeld of gesuggereerd. "Geen woord over de timing voor publieke beschikbaarheid," aldus het artikel.

Er is een precedent dat de moeite waard is om te kennen, want het snijdt aan twee kanten. Anthropic heeft al eerder dingen uitgebracht onder een preview-banner — de Mythos-lijn werd als preview uitgebracht vóór de algemene toegang — dus een intern Preview-label is niet automatisch een misleidende aanwijzing. Maar Anthropic heeft ook maandenlang niet-uitgebrachte stemmodus-flags in productiecode laten zitten: een lek in april 2026 van het bronpakket van Claude Code bracht een reeks niet-uitgebrachte feature-flags aan het licht, waaronder een stemmodus, naast bridge- en background-agent-werk. Voice is bij Anthropic al flink meer dan een jaar zichtbaar in ontwikkeling, zonder dat er een stemmodel is verschenen. Het tabblad past bij die geschiedenis en brengt die niet verder.

De opt-in is het signaal met een datum erop

De tweede helft van het lek is betrouwbaarder, omdat het om een privacywijziging gaat en niet om een schermafbeelding. Op 5 oktober 2026 meldden verschillende media dat Anthropic een optionele instelling toevoegde waarmee gebruikers spraakopnamen en spraakchatgegevens kunnen bijdragen voor modelverbetering. De prompttekst zoals gemeld luidt: ‘Sta ons toe uw spraakgegevens te gebruiken om onze AI-modellen te verbeteren,’ met begeleidende tekst die zegt dat audio- en spraakchatgegevens helpen verbeteren hoe de modellen spraak verwerken. Gemelde details, allemaal uit hetzelfde cluster van berichtgeving:

• Waar het te vinden is — in Claude's Instellingen, onder Privacy, weergegeven als een expliciete toestemmingsschakelaar.

• De standaardinstelling — uit. Gebruikers wordt het gevraagd; ze worden niet ingeschreven.

• De reikwijdte ervan — los van het bestaande toestemmingsmechanisme voor tekstgesprekken, wat het detail is dat er het meest toe doet.

• Omkeerbaarheid — het kan achteraf worden uitgeschakeld en de spraakgegevens kunnen via de instellingen worden verwijderd, overeenkomstig de dekking.

Waarom afzonderlijke toestemming ertoe doet: als de hele spraakpijplijn een leveranciersintegratie zou zijn zonder dat er een Anthropic-model bij betrokken is, zou de natuurlijke plek om toestemming te consolideren al bestaan. Een afzonderlijk spraakdatakanaal afbakenen is wat je doet wanneer je van plan bent op spraak te trainen — voor een nieuw model, of voor een gespecialiseerde spraaklaag binnen een bestaand model. Dat is een argument op basis van prikkels, niet op basis van bewijs, en zo moet het ook worden gelezen. De eerlijke tegenlezing is dat een bedrijf dat een spraakfunctie op schaal draait, zijn eigen evaluatiecorpus en zijn eigen foutanalyse nodig heeft, ongeacht wie de audio levert, en een opt-in die ontworpen is om later te worden uitgeschakeld, is ook de goedkoopste manier om compliant te zijn terwijl je beslist.

Nog een stukje context, want het laat de verandering scherper lijken dan ze is. Anthropics eigen privacydocumentatie voor commerciële producten stelt ronduit, in een artikel van 16 maart 2026, dat "we uw stem niet gebruiken voor het trainen van onze modellen," en dat nadat spraak is getranscribeerd, de audio-opname wordt verwijderd. Dat artikel heeft betrekking op Claude for Work, de Anthropic API en vergelijkbare commerciële oppervlakken. De nieuwe opt-in is een instelling aan consumentenzijde. Beide uitspraken kunnen tegelijkertijd waar zijn — en dat is precies de vorm van een bedrijf dat aan de ene kant van de business een pipeline voor trainingsdata opzet, terwijl het aan de andere kant de contractuele belofte nakomt.

A single-column scoreboard titled 'Claude Voice - what is actually established' with six rows reading 'First-party speech model: none shipped', 'Underlying voice provider: not disclosed', 'Voice mode status: beta, all plans', 'Models in voice mode: same as text chat, Claude Fable excluded', 'Voice data for training: new consumer opt-in, off by default' and 'Speech-to-speech leaderboards: Anthropic absent', with a footer noting the provider is unconfirmed.

Anthropic heeft al een jaar een spraakproduct, maar al die tijd geen spraakmodel.

Dit is het deel dat de berichtgeving over lekken meestal overslaat, en het is de context die je nodig hebt om het tabblad correct te lezen.

De spraakmodus van Claude werd in mei 2025 gelanceerd als een functie voor gesproken gesprekken in de mobiele apps. Vanaf het begin was het een wrapper: de taalmodellen van Anthropic verzorgden de redenering, en de spraak zelf kwam ergens anders vandaan. De stack is nooit onthuld. Toen TechCrunch de upgrade van de spraakmodus van 23 juli 2026 behandelde, merkte het zowel op dat "Anthropic geen wijzigingen aan het spraakmodel heeft aangebracht met deze release" als dat het bedrijf "niet heeft gespecificeerd wat voor spraakstack het gebruikt." Berichtgeving sinds 2025 wijst op ElevenLabs als de spraakleverancier, grotendeels afgeleid uit de openbaarmakingen van Anthropic over subprocessors, in plaats van uit iets wat Anthropic heeft bevestigd. Beschouw de leverancier als niet-geverifieerd.

De upgrade van juli 2026 is leerzaam vanwege wat er niet in zat. Er kwam modelkeuze bij — je kon kiezen tussen Claude Opus, Claude Sonnet en Claude Haiku in plaats van alleen Haiku — plus connectors naar Gmail, Calendar, Slack, Canva en Notion, langere gesprekken en meertalige ondersteuning die als bèta werd uitgebracht. Al die wijzigingen bevinden zich stroomopwaarts van de audio. De audio is niet veranderd.

Wat spraakmodus tegenwoordig is, in Anthropics eigen helpdocumentatie:

• De modellen — "Spraakmodus kan dezelfde Claude-modellen gebruiken als die je in tekstchat gebruikt," en "begint met het model dat je het laatst in tekstchat hebt gebruikt." Eén uitzondering wordt genoemd: Claude Fable is niet beschikbaar in spraakmodus.

• De beschikbaarheid — een bètafunctie op alle abonnementen, van Free tot en met Enterprise, op Claude Mobile, Desktop en web, hoewel deze is ontworpen om het beste te werken vanaf een telefoon.

• De stemmen — "een vooraf ingestelde, beperkte selectie", expliciet om stemklonen of impersonatie te voorkomen.

• De facturatie — spraakgesprekken tellen mee voor de limieten van je normale abonnement. Er is geen aparte spraakmeter.

• De beperkingen — dicteren bestaat in Claude Cowork en Claude Code, maar spraakmodus niet.

• De talen — Engels plus andere talen, waarbij de niet-Engelse set nog steeds als bèta wordt aangeduid.

Elk van die regels is een product rond de spraak van iemand anders. Geen ervan beschrijft een model.

Drie dingen die een tabblad Voice zou kunnen zijn, en slechts één daarvan is een model

De reden dat dit lek gemakkelijk te overinterpreteren is, is dat alle drie de plausibele toekomsten er in een navigatiebalk identiek uitzien.

• Een interfacewijziging — een apart stemscherm, een stemknop in de promptbalk, een stemkiezer in de instellingen. Er werd al gemeld dat Anthropic zoiets in februari 2026 aan het voorbereiden was. Als dit alles is, is het tabblad een herontwerp en blijft de onderliggende audiostack onaangeroerd.

• Een providerwissel — dezelfde cascadearchitectuur, een andere spraakleverancier erachter. Van buitenaf onzichtbaar. Dit zou op zichzelf al een opt-in voor trainingsgegevens verklaren, want je kunt een leverancierswissel niet evalueren zonder audio die je mag bewaren.

• Een native spraak-naar-spraakmodel — Anthropic traint zijn eigen audiomodel en laat de cascade vallen. Dit is de dure interpretatie, degene die van belang zou zijn voor iedereen die op Claude bouwt, en de enige die een corpus van met toestemming verkregen spraak nodig heeft. Het is ook de interpretatie die het bewijs vooralsnog niet ondersteunt.

Het tabblad kan geen onderscheid tussen beide maken. De volgende twee controleerbare zaken zullen dat wel doen: een audio-model-ID die opduikt in de modellenlijst van Anthropic, of een nieuwe spraakvermelding op zijn subprocessorpagina. Geen van beide is gebeurd.

Waar Anthropic niet is

De duidelijkste manier om te zien hoe ver Anthropic ervan verwijderd is deze laag te bezitten, is te kijken waar het niet voorkomt, en vervolgens naar wat het wél publiceert. Onafhankelijke spraak-naar-spraakvergelijkingen — Artificial Analysis onderhoudt er een die ongeveer veertig modellen beslaat op het gebied van redeneren, gespreksdynamiek en agentische prestaties — worden gevuld met native audiomodellen van Gemini 3.8 Live, GPT-Realtime-2 en GPT-Live-1, Qwen Audio 3.0 Realtime, Grok Voice Think Fast 2.0, StepAudio 3 Realtime, Nova 2.0 Sonic, NVIDIA, Kyutai en een handvol open initiatieven. Anthropic komt op dat soort lijsten nergens voor. Een aparte reeks vermeldingen betreft getrapte spraakagent-pipelines — een spraak-naar-tekstmodel, een LLM en een tekst-naar-spraakmodel die aan elkaar zijn gekoppeld — de architectuur waarop Anthropics eigen spraakmodus het meest lijkt. Daartegenover staat dat de eigen modeldocumentatie van Anthropic ondubbelzinnig is: vier actuele modellen, allemaal op dezelfde manier beschreven — tekst- en afbeeldingsinvoer, tekstuitvoer, zonder ergens op de pagina een audio-model-ID.

Screenshot of the OrcaRouter model catalogue, showing the Models listing with 208 models across 16 providers on one API key, the Text / Image / Embeddings / Video / TTS modality filters, an OpenAI-compatible code sample for calling a model, and model cards including Anthropic Claude Sonnet 5.5.

Dat is geen kritiek op het product. Het is een uitspraak over waar de waarde vandaag wordt geïncasseerd, en het verklaart waarom een Voice-tab überhaupt interessant is: spraak is de enige modaliteit waarop elk ander frontier-lab een eigen model heeft en Anthropic niet.

Wat je er deze maand aan moet doen, is niets anders.

De praktische vertaling van dit alles is dat er op 4 oktober niets veranderde voor iemand die bouwt. Spraakmodus is hetzelfde product als in juli. Er is geen model-ID toegevoegd of uitgefaseerd. Geen prijs is veranderd. Als je vandaag spraak op Claude uitbrengt, breng je een cascade uit: een Claude-model voor het denkwerk, een apart model voor het spreken, en de lijm ertussen. Het lek verandert daar niets aan, en bouwen rond een tabblad waarop Preview staat, is hoe teams uiteindelijk een roadmapafhankelijkheid van iemands interne branch oplopen.

Waar het wél voor pleit, is om de spraakhelft van de stack verwisselbaar te houden, want in de cascade zit nu juist de lock-in — niet in het Claude-model, dat je overal vandaan kunt aanroepen, maar in de lijm die je naar de spraakleverancier hebt geschreven. Concreet: de Claude-kant is al routeerbaar: Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1 en Claude Haiku 4.5 staan in de OrcaRouter-catalogus tegen de lijstprijs van Anthropic met 0% opslag — de lijstprijs van de provider wordt doorgegeven, dus als Anthropic een prijs verlaagt, staat die dezelfde dag nog live aan onze kant — en de tekst-naar-spraakmodellen die je eraan zou koppelen (Gemini's TTS-previews, tts-1-hd, en andere) zitten achter dezelfde sleutel. Eén endpoint voor beide helften van een spraakpijplijn betekent dat een leverancierswissel een kwestie van een modelstring is in plaats van een tweede contract, en automatische failover betekent dat de onbewezen helft van je pijplijn terugvalt op een werkende fallback in plaats van de oproep te laten mislukken.

Wat zou het daadwerkelijk bevestigen?

Sla de speculatie over en let op vier specifieke, controleerbare plekken. Elk daarvan is een dateerbare gebeurtenis, en elk ervan verandert dit van een lek in nieuws:

• Een nieuwe vermelding in de modellendocumentatie van Anthropic of in de Models API-lijst met audio-invoer of audio-uitvoer. Dat is het enige artefact dat bewijst dat een first-party spraakmodel bestaat.

• Een spraakgerelateerde toevoeging aan de subprocessorpagina van Anthropic. Dat bewijst het tegendeel — een nieuwe externe leverancier in plaats van een intern model.

• Het tabblad Voice dat zijn Preview-label in de consumenten-apps verliest. Dat is de uitrol, en het is het moment waarop de functie beoordeelbaar wordt in plaats van alleen observeerbaar.

• Een prijsconflict. Anthropic prijst wat het verkoopt; een spraakprijs per minuut zou de architectuurvraag sneller beslechten dan welke benchmark dan ook.

Totdat een van die dingen werkelijkheid wordt, luidt de nauwkeurige samenvatting van oktober 2026 als volgt: Anthropic bouwt aan een spraakinterface, verzamelt voor het eerst spraakdata met toestemming, en heeft nog steeds nooit een spraakmodel uitgebracht. De tab is het minst informatief van die drie feiten en degene die het verst is gekomen.

Screenshot of Anthropic's Claude Platform models overview page listing Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 with their model IDs and pricing, alongside the line 'All current models support text and image input, text output, multilingual capabilities, vision, and tool use.'

De open vraag is niet of Anthropic een betere spraakervaring wil — dat beantwoordt de opt-in. De vraag is of 'betere spraak' bij Anthropic een model betekent dat het zelf bezit of een leverancier die het zorgvuldiger beheert. Die twee paden zien er van buitenaf een tijdje hetzelfde uit, en dan lijken ze in niets meer op elkaar.