
Gemini 3.8 TTS vs Gemini 3.1 Flash TTS: het enige gat in deze familie dat echt is
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
Upgraden binnen een modelfamilie is meestal de makkelijke beslissing, en deze heeft een complicatie die het minder makkelijk maakt dan het lijkt. Gemini 3.1 Flash TTS — staat nog steeds als preview vermeld in de API van de leverancier — bezet plaats 10 in de Artificial Analysis Provider Voice Arena met een Elo van 1.199 en een interval van 12 punten. Gemini 3.8 Flash TTS, uitgebracht op 23 september 2026, staat op plaats 2 met een Elo van 1.260 en een interval van 17 punten. Dat is een winst van 61 punten, en anders dan de meeste verschillen op dat bord overleeft die de foutmarges: de range van 3.1 loopt van 1.187 tot 1.211, die van 3.8 van 1.243 tot 1.277, en er zit een dode zone van tweeëndertig punten tussen. De kwaliteitsverbetering is reëel. Het prijsverhaal is waar het vreemd wordt.

Google's eigen tariefkaart zegt dat het audio-uitvoertarief daalde van $20,00 per miljoen tokens op 3.1 naar $9,00 op 3.8 — een verlaging van 55 procent. Artificial Analysis normaliseert dezelfde twee modellen naar respectievelijk $18,30 en $33,00 per miljoen tekens, wat het tegenovergestelde zegt. Beide cijfers zijn gepubliceerd; geen van beide is fout; ze meten verschillende dingen, en de reconciliatie is het nuttigste deel van deze vergelijking voor iedereen die een migratie plant.
Wat de upgrade daadwerkelijk heeft veranderd
De 3.8-generatie is geen herstemming. Drie oppervlakken zijn wezenlijk veranderd.
• Aantal stemmen en stemcreatie — 3.1 Flash TTS werd geleverd met een vooraf samengestelde stemmenset. 3.8 Flash TTS wordt geleverd met 30 vooraf samengestelde studiostemmen, waaronder Kore en Puck, plus stemontwerp op basis van een beschrijving in natuurlijke taal en stemreplicatie op basis van een sample van 30 seconden met toestemmingsverificatie, een SynthID-watermerk en C2PA-referenties op de uitvoer. Stemremixing staat vermeld als binnenkort beschikbaar in plaats van als al uitgebracht.
• Regie over de voordracht — aanwijzingen regel voor regel, het ensceneren van scènes met twee sprekers binnen één enkele call, en non-verbale signalen die direct in het script worden geschreven als <laughs>, <sigh>, <gasp>, |mhm| en |yeah|. Het lanceermateriaal van Google beweert verbeterde consistentie bij lange vormen en regie over scenario's met twee sprekers, specifiek ten opzichte van 3.1. Dat is een claim van de leverancier waar geen publieke run achter zit.
• Taaldekking — 130 talen op Flash TTS en 101 op Flash-Lite TTS, automatisch gedetecteerd op basis van de tekst. De gepubliceerde dekking van 3.1 Flash TTS is lager.
De structurele verandering is de splitsing. Er is geen enkele opvolger van 3.1 Flash TTS; er zijn er twee, en in de documentatie van Google wordt Flash-Lite TTS gepositioneerd als de "werkpaardvervanging". Dat is belangrijk, want het betekent dat een migratie een keuze tussen niveaus is, geen versieverhoging. Het goedkopere niveau is niet de nieuwere versie van wat je hebt — het is een ander punt op de curve.
Waarom de prijs daalde en de ranglijst zegt dat hij steeg
Begin met wat Google publiceert, want dat is wat je daadwerkelijk in rekening zal worden gebracht.
• Gemini 3.1 Flash TTS Preview — $1,00 per miljoen teksttokens in, $20,00 per miljoen audiotokens uit. Batch is $0,50 en $10,00.
• Gemini 3.8 Flash TTS Standard — $0,50 en $9,00 tot en met 31 december 2026, daarna $1,00 en $18,00. Batch en Flex $0,25 en $4,50. Priority $0,90 en $16,20.
• Gemini 3.8 Flash-Lite TTS Standaard — $0,50 en $6,00 tot en met 31 december 2026, daarna $1,00 en $12,00. Batch en Flex $0,25 en $3,00. Priority $0,90 en $10,80.

Alleen al op de audio-outputlijn is 3.8 Flash TTS voor $9,00 tegenover 3.1 voor $20,00 een verlaging van 55 procent, en 3.8 Flash-Lite TTS voor $6,00 een verlaging van 70 procent. Zelfs bij de prijs van $18,00 na de promotie ligt Flash TTS nog onder het model dat het vervangt. Dat is het getal dat op een factuur komt te staan, en het is ondubbelzinnig.
Nu de ranglijst. Artificial Analysis publiceert een prijs per miljoen tekens, zodat modellen die in verschillende eenheden factureren naast elkaar gerangschikt kunnen worden, en voor dit tweetal geeft het $18,30 voor 3.1 Flash TTS en $33,00 voor 3.8 Flash TTS. Alleen gelezen zegt dat dat de upgrade bijna twee keer zo duur is geworden.
De verzoening is dat een tarief per teken een omrekening is, geen prijs, en dat de omrekeningsfactor niet hetzelfde is voor de twee modellen. Het omrekenen van audiotokens naar tekens vereist dat men zowel een spreeksnelheid als een audiotokenratio aanneemt — Google rekent audio af op 25 tokens per seconde output — en het vereist dat men kiest tegen welk serviceniveau men normaliseert. Als het bestuur 3,8 normaliseert tegen het post-promotietarief van $18,00, terwijl het 3,1 normaliseert tegen zijn eigen $20,00, liggen de twee dicht genoeg bij elkaar dat elk verschil in de aangenomen seconden-per-teken de uitkomst domineert. Een tarief per teken dat is gebaseerd op een ruime aanname van de spreeksnelheid, vleit het model waarop het wordt toegepast.
De praktische instructie is daarom: gebruik de tokentarieven van Google voor budgettering, en gebruik de tekentarieven van het leaderboard alleen voor de verhouding tussen modellen die het leaderboard op dezelfde manier heeft gemeten. Meng ze niet, en voer de beweging van $18,30 naar $33,00 niet op als een prijsverhoging — het is een artefact van een normalisatie die de twee modellen niet gemeenschappelijk hebben.
De echte migratiekosten zijn anders, namelijk het promotievenster. Beide nieuwe tiers zitten tot 31 december 2026 op half tarief en verdubbelen op 1 januari. Een migratie die op basis van de cijfers van september is gepland en in november wordt uitgevoerd, krijgt in het eerste kwartaal een nieuwe prijs. Het tarief van januari 2027 voor Flash TTS, $18,00 per miljoen audiotokens, ligt nog steeds onder de $20,00 van 3.1 — dus de verlaging is ook na de promo reëel, alleen veel kleiner dan het vandaag lijkt.
De kwaliteitswinst, en wat daar niet achter zit
De arena-Elo is het enige getal hier dat door iemand anders dan de leverancier is verzameld, en het is het getal dat zijn foutmarges ontstijgt. Eenenzestig punten, van 1.199 tot 1.260, met 3.430 samples op 3.1 en 1.999 op 3.8, en 7 arena-stemmen tegenover 8. Het aantal samples op het nieuwere model is lager, wat het interval verbreedt, en zelfs dan raken de bereiken elkaar niet.

Wat er niet achter zit: geen enkele onafhankelijke benchmark anders dan de arena. De lanceringscijfers van Google — eerste op de Hume AI Voice Design Benchmark met 71,4, eerste op accentmodellering met 60,8, eerste en tweede op de Hume Overall Quality Index voor Flash en Flash-Lite, en topposities in blinde voorkeur die worden geclaimd voor Japans, Braziliaans-Portugees, Vietnamees, Modern Standaardarabisch, Mexicaans-Spaans en Hindi — komen neer op de leverancier die een benchmark van een derde partij citeert. De onderliggende runs zijn niet openbaar. Lees ze als beweringen, in dezelfde richting als het arenaresultaat, maar zonder er onafhankelijk gewicht aan toe te voegen.
De vraag over deprecatie, en een migratiechecklist
Google heeft geen stopdatum aangekondigd voor Gemini 3.1 Flash TTS Preview. Het bedrijf heeft gezegd dat Flash-Lite TTS wordt gepositioneerd als de vervanger die als werkpaard moet dienen, en dat is het soort taal dat voorafgaat aan een deprecatiebericht in plaats van erop volgt. Als je nog op het preview-model zit, is de juiste interpretatie dat je een migratie moet plannen, niet dat je een deadline moet halen — en dat wachten op de deadline de verkeerde strategie is voor een model waarvan de vervanger al 61 Elo-punten voorloopt.
• Controleer welk niveau je workload nodig heeft. Flash TTS voor 130 talen en het volledige leveringsaanbod; Flash-Lite TTS voor 101 talen tegen $6,00 per miljoen audiotokens. De talenlijst is de scheidslijn, niet de kwaliteit.
• Prijs opnieuw berekenen op basis van het tarief van januari 2027, niet het promotietarief. $18,00 per miljoen audiotokens voor Flash TTS, $12,00 voor Flash-Lite.
• Bepaal of de taak in batch kan worden verwerkt. Batch en Flex halveren het audiotarief op beide niveaus — $4,50 en $3,00 per miljoen tokens. Alles wat niet interactief is, hoort niet op het Standard-niveau.
• Controleer alles opnieuw wat afhankelijk was van de voiceset. De standaardcatalogus bestaat uit 30 vooraf gebouwde stemmen; de stem die je in 3.1 gebruikte, moet mogelijk opnieuw worden gemaakt, hetzij via stemontwerp, hetzij via een replicatiesample van 30 seconden.
• Controleer de vormgeving van verzoeken opnieuw. Er is geen gepubliceerde tekenlimiet per verzoek voor de 3.8-modellen, en audio wordt per seconde afgerekend in plaats van per teken, dus een lange uiting kost meer dan een prijsopgave per teken zou doen vermoeden.
• Plan de levenscyclus van aangepaste stemmen. 200 stateful stemmen per project met een time-to-live van één jaar, of stateless voicekey_... handles die na zeven dagen verlopen.
Beide laten draaien terwijl u beslist
Een upgrade binnen dezelfde familie met een aflopende promotie en een meningsverschil over normalisatie is precies het geval waarin je niet in één stap overstapt. OrcaRouter routeert het oudere model vandaag — models/google/gemini-3.1-flash-tts-preview staat op onze modellenlijst — dus je kunt het nieuwe model ernaast opzetten en vergelijken op je eigen verkeer voordat je het productiepad verlegt. Wij hosten de Gemini 3.8 TTS-endpoints niet; die komen van Google's eigen API. Wat wij bieden is de één sleutel voor meer dan 200 modellen tegen de lijstprijs van de provider, zonder opslag, zodat een tariefwijziging van een leverancier dezelfde dag op je factuur doorwerkt in plaats van bij de verlenging, en automatische failover, zodat een gloednieuw model iets is dat je kunt uitproberen zonder er een klantgericht pad op te verwedden.
Wat je in de gaten moet houden, is of Google een datum koppelt aan de 3.1 Flash TTS-preview. Die ene regel documentatie is voor een migratieplan meer waard dan welke van de benchmarks in dit artikel dan ook, en die is nog niet geschreven.
