📣 Envoyez-nous votre communiqué de presse
Site mis à jour toutes les 15 minutes
Technologie

Google lance des modèles Gemini texte-parole avec réplication vocale

Google a introduit les nouveaux modèles Gemini 3.8 Flash TTS et Gemini 3.8 Flash-Lite TTS, permettant aux développeurs de créer des voix personnalisées et de répliquer celles existantes.

24 septembre 2026
Google lance des modèles Gemini texte-parole avec réplication vocale

Google a lancé deux nouveaux modèles Gemini de synthèse vocale (TTS) : Gemini 3.8 Flash TTS et Gemini 3.8 Flash-Lite TTS. Ces modèles sont conçus pour permettre aux développeurs de générer des voix personnalisées, de diriger la diffusion de dialogues et de répliquer la voix d'un locuteur.

La technologie est disponible via Google AI Studio et l'interface de programmation d'applications (API) Gemini. Elle est également intégrée dans les propres produits de Google, notamment Gemini Notebook et Google Vids. Les nouveaux modèles prennent en charge plus de 100 langues et conviennent à diverses applications, telles que la production de livres audio, de jeux et de podcasts, ainsi que la création de scènes de dialogue.

Selon Google, l'utilisation de la réplication vocale nécessite le consentement écrit du propriétaire de la voix. L'entreprise souligne que tout contenu généré par les modèles Gemini Audio portera un filigrane SynthID, qui aide à identifier le matériel généré par l'IA.

Cette annonce étend l'offre existante de Google en matière de technologie vocale, qui comprend déjà Cloud Text-to-Speech et les voix Chirp 3 HD. Cependant, la documentation de l'entreprise ne précise pas comment les nouveaux modèles Gemini se positionnent par rapport aux produits précédents.

Source originale: techinasia.com