Google Gemini 2.5 Pro preview met TTS, toegankelijk via OrcaRouter tegen nul opslag.
google/gemini-2.5-pro-preview-tts is een preview-tekst-naar-spraakmodel van Google, gebouwd op de Gemini 2.5 Pro-basis. Het zet tekstinvoer om in gesproken audio-uitvoer. Het model is toegankelijk…
De primaire capaciteit van google/gemini-2.5-pro-preview-tts is het omzetten van geschreven tekst naar gesproken audio. Het is gebouwd op Google's Gemini 2.5 Pro, wat wijst op een sterk taalbegrip, wat zou moeten leiden tot natuurlijke formulering, passende intonatie en duidelijke uitspraak. Het model accepteert alleen tekstinvoer, dus het is niet multimodaal aan de invoerkant. Het verwerkt geen audio-invoer, afbeeldingen of video. De uitvoer is waarschijnlijk audio in een standaard digitaal formaat. Als een TTS-model kan het meerdere talen aan, maar specifieke taalondersteuning is niet bekendgemaakt voor deze preview. Het is geoptimaliseerd voor het genereren van spraak, niet voor andere Gemini 2.5 Pro-mogelijkheden zoals redeneren of code genereren.
Het model blinkt uit in toepassingen waarbij geschreven tekst wordt omgezet in natuurlijk klinkende spraak. De beste gebruiksscenario's zijn onder meer spraakassistenten waarbij de assistent antwoorden voorleest, geautomatiseerde vertelling van audioboeken en podcasts, toegankelijkheidsfuncties die tekst op het scherm voorlezen voor slechtziende gebruikers, en klantenservicesystemen die gesproken antwoorden leveren. Het kan ook worden gebruikt voor taal leerapplicaties waarbij de juiste uitspraak wordt gemodelleerd, of voor het genereren van spraakinhoud uit RSS-feeds of artikelen. Vanwege de previewstatus is het raadzaam om grondig te testen voor uw specifieke taal, domein of stijlvereisten voordat u overgaat tot grootschalige implementatie.
Hoewel google/gemini-2.5-pro-preview-tts premium TTS-kwaliteit biedt, kan het overdreven zijn voor eenvoudige piepjes of meldingsgeluiden, of voor toepassingen waar lage latentie cruciaal is, maar de verwerkingstijd van het model langer is dan die van speciale TTS-chips. Als u alleen basis-, monotone spraak nodig hebt of een zeer hoog volume met strikte budgetbeperkingen, dan is een lichter TTS-model (bijv. van andere aanbieders op OrcaRouter) met lagere kosten per token wellicht geschikter. Als uw gebruiksgeval daarnaast real-time streaming met extreem lage latentie vereist, beoordeel dan of het preview-model van Gemini aan uw snelheidseisen voldoet, aangezien grotere modellen een hogere eerste-tokenlatentie kunnen introduceren.
Vanaf de preview release van het model heeft Google geen specifieke benchmarkscores voor de gemini-2.5-pro-preview-tts variant gepubliceerd. Het onderliggende Gemini 2.5 Pro basismodel heeft sterke prestaties laten zien op het gebied van taalbegrip en redeneertaken, maar de spraakkwaliteitsmetrics van de TTS variant (bijv. Mean Opinion Score, Word Error Rate) zijn niet openbaar gedeeld. Zonder officiële benchmarks adviseert OrcaRouter om het model te evalueren op je eigen testset van tekstinvoer, waarbij subjectieve audiokwaliteit, latentie en betrouwbaarheid onder belasting worden gemeten. Voor productiebeslissingen voer je je eigen A/B-vergelijkingen uit met andere TTS-diensten.
Specifieke latentiecijfers voor google/gemini-2.5-pro-preview-tts zijn niet openbaar gemaakt. Als TTS-model gebaseerd op een grote taalmodelarchitectuur kan het een hogere latentie vertonen in vergelijking met gespecialiseerde neurale TTS-modellen die zijn geoptimaliseerd voor real-time streaming. Factoren die de snelheid beïnvloeden zijn onder andere de lengte van de invoertekst, de interne verwerkingstijd van het model en de netwerkroundtrip naar de eindpunten van OrcaRouter. Voor toepassingen waar lage latentie cruciaal is (bijv. conversationele AI), test dit model met typische invoerlengtes om de geschiktheid te beoordelen. Overweeg het gebruik van streaming of chunked tekstgeneratie als de API dit ondersteunt.
Sterke punten: Gebouwd op Google's geavanceerde Gemini 2.5 Pro-architectuur, produceert het waarschijnlijk zeer natuurlijke, expressieve spraak met goede prosodie en uitspraak. Toegang via OrcaRouter's OpenAI-compatibele API vereenvoudigt integratie. Geen opslag op de prijzen van de provider maakt de kosten voorspelbaar. Beperkingen: Invoermodaliteit is alleen tekst; het kan geen audio of andere modaliteiten verwerken. Omdat het een preview is, kunnen er onontdekte randgevallen of inconsistente kwaliteit zijn. De contextvenstergrootte is onbekend, waardoor de lengte van tekst die in één verzoek kan worden geconverteerd, wordt beperkt. Details over uitvoerformaat worden niet verstrekt. Het is niet ontworpen voor taken zoals spraakherkenning of stemklonen.
De prijs voor google/gemini-2.5-pro-preview-tts is gebaseerd op tokenverbruik, berekend tegen $1,00 per 1 miljoen invoertokens en $20,00 per 1 miljoen uitvoertokens. Invoertokens omvatten de tekstprompt en eventuele instructies. Uitvoertokens vertegenwoordigen de gegenereerde audio. OrcaRouter factureert tegen het exacte provider-tarief zonder opslag, wat betekent dat u alleen betaalt wat Google in rekening brengt, plus eventuele toepasselijke belastingen. Er zijn geen minimale verplichtingen of maandelijkse kosten. Het verbruik wordt per aanvraag gemeten en samengevoegd op uw OrcaRouter-factuur. Omdat het aantal TTS-uitvoertokens hoog kan zijn (audio is token-denser dan tekst), zijn de uitvoerkosten de belangrijkste uitgave.
De output token prijs ($20 per 1M) is aanzienlijk hoger dan input tokens ($1 per 1M). Dit is typisch voor generatieve modellen omdat output tokens meer rekenkracht vereisen. Voor text-to-speech wordt de audio-uitvoer weergegeven als een reeks tokens, en het omzetten van tekst naar spraak omvat het genereren van een lange reeks audiotokens. De totale kosten voor een specifieke taak hangen af van de lengte van de uitvoeraudio ten opzichte van de invoertekst. Als u lange stukken spraak moet genereren (bijv. een volledig audioboek), kunnen de kosten oplopen. Voor korte prompts (bijv. een enkele zin) zijn de kosten minimaal. Houd uw tokenverbruik in de gaten om de kosten te projecteren.
Nee, OrcaRouter voegt geen markup toe aan het provider-tarief voor google/gemini-2.5-pro-preview-tts. De vermelde prijzen van $1.00 per 1M invoertokens en $20.00 per 1M uitvoertokens zijn precies wat Google in rekening brengt. OrcaRouter geeft deze rechtstreeks aan u door. Dit is consistent met het prijsmodel van OrcaRouter voor veel modellen waarbij het platform als een transparante proxy fungeert. U betaalt alleen voor de tokens die u verbruikt. Optionele functies zoals caching of premium ondersteuning kunnen aparte kosten met zich meebrengen, maar de basiskosten per token hebben geen markup.
Om google/gemini-2.5-pro-preview-tts te gebruiken, dien je verzoeken in te dienen bij de OpenAI-compatibele API van OrcaRouter op de basis-URL https://api.orcarouter.ai/v1. Gebruik de model-ID 'google/gemini-2.5-pro-preview-tts' in je API-aanroepen. De verzoekopmaak volgt de standaard structuur van OpenAI-chatcompletions met een 'model'-veld, een 'messages'-array die je tekstprompt bevat (met een systeem- en/of gebruikersrol), en standaardparameters zoals temperature en max_tokens. Het antwoord bevat de gegenereerde audiotokens, die je client kan decoderen om als spraak af te spelen. Authenticatie gebeurt via een API-sleutel die door OrcaRouter wordt verstrekt.
De API ondersteunt standaard OpenAI-compatibele parameters, waaronder 'model', 'messages' (array van objecten met rol en inhoud), 'temperature' (voor het regelen van variabiliteit van audio-uitvoer), 'max_tokens' (om de lengte van gegenereerde audio te beperken) en 'top_p'. Als een TTS-model kunnen er extra parameters zijn voor stemstijl of snelheid, maar deze zijn niet gedocumenteerd in de beschikbare feiten. Raadpleeg de API-documentatie van OrcaRouter voor de nieuwste ondersteunde velden. De parameter 'response_format' kan het mogelijk maken om audio-encodering (bijv. wav of mp3) op te geven. Als dit niet standaard wordt ondersteund, moet u mogelijk de geretourneerde tokenstroom decoderen.
Als u momenteel een andere TTS-service gebruikt (bijv. Google Cloud Text-to-Speech, Amazon Polly), dan houdt migreren naar google/gemini-2.5-pro-preview-tts via OrcaRouter in dat u uw API-endpoint en verzoekformaat bijwerkt. OrcaRouter gebruikt OpenAI-compatibele endpoints, dus u schakelt over van een providerspecifieke SDK naar een OpenAI-compatibele. Vervang uw bestaande basis-URL door https://api.orcarouter.ai/v1, gebruik de model-ID 'google/gemini-2.5-pro-preview-tts' en pas uw verzoeklichamen aan zodat ze overeenkomen met het chat completions-schema. Mogelijk moet u de manier waarop u het antwoord verwerkt aanpassen: in plaats van rechtstreeks audiobestanden te ontvangen, krijgt u getokeniseerde uitvoer die u moet decoderen. Test met voorbeeldingangen.
Authenticatie gebeurt door het opnemen van een API-sleutel in de Authorization-header (formaat: Bearer YOUR_API_KEY). U verkrijgt de API-sleutel van uw OrcaRouter-account. Limieten worden ingesteld door OrcaRouter op basis van uw abonnement; deze zijn niet hetzelfde als de limieten van Google. Neem voor gebruik met hoge volumes contact op met OrcaRouter om de limieten aan te passen. Het previewmodel kan extra beperkingen van Google hebben – als u fouten tegenkomt zoals 'model niet beschikbaar', controleer dan of uw OrcaRouter-abonnement dit model omvat. Er zijn geen specifieke limieten bekendgemaakt voor dit model, maar standaard best practices (opnieuw proberen met exponentiële backoff) worden aanbevolen.
google/gemini-2.5-pro-preview-tts is een gespecialiseerde variant van de Gemini 2.5 Pro-familie, ontworpen voor text-to-speech. Andere Gemini 2.5 Pro-modellen zijn algemeen toepasbaar en verwerken tekst, afbeeldingen, audio en video; ze genereren standaard geen spraakuitvoer. Deze TTS-variant laat multimodale invoer weg en richt zich op het genereren van audio op basis van tekst. Waarschijnlijk gebruikt hij dezelfde onderliggende taalbegrip voor prosodie en tempo, maar hij is niet geschikt voor redeneren, programmeren of multimodale analyse. Als je TTS-mogelijkheden nodig hebt zonder multimodale invoer op te geven, combineer je een standaard Gemini-model met een aparte TTS-pijplijn. De preview TTS biedt een meer gestroomlijnde pijplijn.
OrcaRouter biedt toegang tot TTS-modellen van verschillende aanbieders. Dit model van Google is gebaseerd op een grote-taalmodelarchitectuur, die mogelijk natuurlijkere en contextbewustere spraak produceert dan oudere concatenatieve of parametrische TTS-systemen. Het kan echter langzamer en duurder per token zijn in vergelijking met gespecialiseerde neurale TTS-modellen die zijn ontworpen voor lage latentie en hoge doorvoer. Veel populaire TTS-diensten rekenen per teken of per seconde audio, niet per token, waardoor directe kostprijsvergelijking lastig is. Voor productie-implementaties die extreem lage kosten vereisen, kunnen speciale TTS-modellen de voorkeur hebben. Het model van Google is het beste voor gebruikssituaties waar de hoogste uitvoerkwaliteit de hogere tokenkosten rechtvaardigt.
Kies dit model als u state-of-the-art spraakkwaliteit nodig heeft van Google’s nieuwste Gemini-architectuur en u deze wilt benaderen via een standaard OpenAI-compatibele API zonder Google Cloud-referenties te beheren. De prijsstelling zonder opslag zorgt voor transparantie. Het is ideaal voor toepassingen waar natuurlijkheid cruciaal is, zoals conversationele AI of verhalende inhoud. De preview-status maakt vroege experimentatie mogelijk om de kwaliteit voor uw domein te evalueren. Als u echter realtime streaming met een latentie van minder dan 100 ms nodig heeft, is een dedicated streaming TTS-model wellicht beter. Ook als uw budget gevoelig is, test dan het verbruik van uitvoertokens voor typische use cases om ervoor te zorgen dat de kosten acceptabel zijn.
OpenAI-compatibel — behoud je huidige SDK
https://api.orcarouter.ai/v1voice| Invoer / 1M tokens | $1.00 |
| Uitvoer / 1M tokens | $20.00 |
| Valuta | USD |
Schatting op basis van catalogusprijs
Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.
Waar ontwikkelaars het deze week over hebben
GET /api/public/models/google/gemini-2.5-pro-preview-ttsOpenen @misc{orcarouter_gemini_2_5_pro_preview_tts,
title = {google/gemini-2.5-pro-preview-tts API},
author = {google},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/google/gemini-2.5-pro-preview-tts}
}google. (n.d.). google/gemini-2.5-pro-preview-tts API. OrcaRouter. https://www.orcarouter.ai/models/google/gemini-2.5-pro-preview-tts