Google's Nieuwe AI-stemmen: Wat Gemini 3.8 Flash TTS Verandert Sophie Jansen · 2026-09-24
Luister naar dit artikel ~3 min Afspelen Stop 0.8x 1x 1.2x 1.5x
Google lanceert Gemini 3.8 Flash TTS: twee AI-stemmodellen voor creatieve projecten en efficiënte productie. Met 2.000+ stemmen in 100+ talen en indrukwekkende benchmarks.
Stel je voor: je werkt aan een game en je wilt dat een personage lacht, zucht of iets mompelt. Vroeger betekende dat uren in een opnamestudio. Nu typ je gewoon `
` in je script en de AI doet de rest. Dat is precies wat Google's nieuwe Gemini 3.8 Flash TTS modellen mogelijk maken.
### Twee modellen, twee doelen
Google heeft niet één maar twee stemmodellen uitgebracht. Het grotere **Gemini 3.8 Flash TTS** is gericht op creatieve projecten: games, interactieve entertainment en lange narraties. Het kleinere **Flash-Lite TTS** is juist bedoeld voor efficiëntie: automatische dubbing, klantgesprekken en bulkvertalingen.
Beide modellen vervangen de oude vaste catalogus van 30 stemmen. In plaats daarvan krijg je toegang tot meer dan 2.000 vooraf gemaakte stemprofielen in ruim 100 talen. Denk aan Quebecs Frans, Schots Engels of Mexicaans Spaans. En er komt een functie waarmee je via tekst commando's de toonhoogte, het tempo en het accent kunt aanpassen.
### Hoe goed klinkt het echt?
Google heeft de modellen niet zelf geprezen, maar onafhankelijke benchmarks laten zien dat het grotere model bovenaan de ranglijsten staat. Op de Hume AI Voice Design Benchmark scoorde Gemini 3.8 Flash TTS een 71.4 overall, met een indrukwekkende 60.8 voor accentmodellering. In de Overall Quality Index pakte het de eerste plaats, gevolgd door Flash-Lite op de tweede plek.
> In dubbelblinde luistertests van Voice Arena gaven luisteraars de voorkeur aan de nieuwe stemmen in talen als Japans, Braziliaans Portugees, Vietnamees, Arabisch, Mexicaans Spaans en Hindi.
### Wat betekent dit voor jou als maker?
Als je podcasts, audioboeken of trainingsmateriaal maakt, zijn er een paar dingen die eruit springen:
- **Meerdere sprekers in één script**: je kunt natuurlijke gesprekken laten genereren zonder dat de stemmen door elkaar lopen.
- **Stabiele kwaliteit over lange opnames**: geen degradeerde stem na een uur, wat ideaal is voor audioboeken.
- **Non-verbale geluiden**: voeg ``, `` of `|mhm|` toe voor een natuurlijker gespreksritme.
### Veiligheid en integratie
Google heeft ook aan veiligheid gedacht. Om een stem te klonen, heb je een referentie-opname van 30 seconden nodig plus een expliciete verbale toestemming van de stem-eigenaar. Alle gegenereerde audio krijgt een onhoorbare SynthID-watermerk en C2PA-metadata, zodat herkomst traceerbaar blijft.
Wat betreft beschikbaarheid: ontwikkelaars kunnen via Google AI Studio en de Gemini API aan de slag. Vroege integraties zijn er al met Figma, HeyGen, Wondercraft en anderen. Eindgebruikers vinden Flash TTS in Gemini Notebook, terwijl Google Vids Flash-Lite gebruikt.
Kortom, als je met audio werkt, is dit het moment om deze tools eens uit te proberen. De drempel om professionele stemmen te maken is nooit zo laag geweest.