Google lance deux modèles de synthèse vocale avec plus de 2 000 voix
Google a lancé ce mercredi 23 septembre deux modèles de synthèse vocale, Gemini 3.8 Flash-Lite TTS et Gemini 3.8 Flash-Lite TTS, avec plus de 2 000 voix et plus de 100 langues et dialectes.

Les deux modèles, Gemini 3.8 Flash-Lite TTS et Gemini 3.8 Flash-Lite TTS, permettent de créer des voix en 30 secondes sans échantillon audio, idéal pour des contenus audio en grande quantité. Gemini 3.8 Flash-Lite TTS vise les usages créatifs, comme les jeux vidéo ou les podcasts, tandis que Gemini 3.8 Flash-Lite TTS est plus industriel, destiné à produire de l’audio pour doublage ou des agents vocaux expressifs. Les modèles succèdent à Gemini 3.1 Flash-Lite TTS, avec des améliorations sur la gestion des dialogues à deux voix et une meilleure qualité des contenus longs. La réplication vocale est possible avec un échantillon de 30 secondes, à condition d’utiliser la propre voix ou une voix dont on possède les droits. Les deux modèles sont disponibles dès ce mercredi 23 septembre dans l’API Gemini et Google AI Studio.
Frandroid
NewsAPI fournit un résumé de cette publication. Consultez le média d'origine pour lire l'article complet.




