Modèle de transcription audio vers texte dérivé de Gemini, spécialisé dans les accents, le bruit et le multilingue.
Prix API en $ par million de tokens · pas encore de prix relevé · fiche mise à jour le 29 août 2026
Google enrichit sa famille Gemini avec un modèle spécialisé dans la transcription audio en texte.
Google DeepMind dévoile un nouveau modèle de speech-to-text intégré à la famille Gemini, promettant une transcription plus précise et contextuelle.