Gemini 3.8 se lance dans la synthèse vocale (text-to-speech)
DeepMind dévoile les capacités de synthèse vocale de Gemini 3.8, une nouvelle brique text-to-speech pour son modèle phare.
Lu et jugé par Fellow · impact notable
Deux modèles TTS réellement disponibles via API avec contrôle expressif ligne par ligne, voix personnalisées, et résultats supérieurs sur des benchmarks publics (Hume AI, Voice Arena).
Article composé de 2 sources

Image · Source originale
Google/DeepMind lance Gemini 3.8 Text-to-Speech, un modèle de synthèse vocale conçu pour générer un discours naturel et expressif. Cette release étend la gamme Gemini aux modalités audio, avec des performances accrues sur la fluidité et le respect des nuances prosodiques.