Google lanserar Gemini text-till-tal med röstreplikering
Google har introducerat nya Gemini 3.8 Flash TTS- och Gemini 3.8 Flash-Lite TTS-modeller som gör det möjligt för utvecklare att skapa egna röster och replikera befintliga.

Google har lanserat två nya Gemini text-till-tal (TTS) modeller: Gemini 3.8 Flash TTS och Gemini 3.8 Flash-Lite TTS. Dessa modeller är utformade för att ge utvecklare möjlighet att generera egna röster, styra dialogleverans och replikera en talares röst.
Tekniken är tillgänglig via Google AI Studio och genom Gemini Application Programming Interface (API). Den integreras även i Googles egna produkter, inklusive Gemini Notebook och Google Vids. De nya modellerna stöder över 100 språk och är lämpliga för en rad olika applikationer, såsom produktion av ljudböcker, spel och podcaster, samt skapande av dialogscener.
Enligt Google kräver användning av röstreplikering skriftligt samtycke från röstägaren. Företaget betonar att allt material som genereras av Gemini Audio-modellerna kommer att ha en SynthID-vattenstämpel, vilket hjälper till att identifiera AI-genererat innehåll.
Lanseringen utökar Googles befintliga utbud av talteknologi, som redan inkluderar Cloud Text-to-Speech och Chirp 3 HD-röster. Företagets dokumentation specificerar dock inte hur de nya Gemini-modellerna förhåller sig till tidigare produkter.