Preview de la synthèse vocale Gemini 3.1 Flash

Le modèle Gemini 3.1 Flash TTS Preview offre une génération de voix puissante et à faible latence avec des sorties naturelles, des requêtes orientables et de nouvelles balises audio expressives pour un contrôle précis de la narration.

Documentation

Le modèle Gemini 3.1 Flash TTS (preview) introduit des tags audio expressifs pour contrôler la narration, ainsi que des améliorations générales en termes de naturel, de contrôlabilité et de multilinguisme.

Consultez le guide Text-to-Speech pour obtenir une couverture complète des fonctionnalités et des capacités.

gemini-3.1-flash-tts-preview

Propriété Description
Code du modèle gemini-3.1-flash-tts-preview
Types de données acceptés pour

Entrées

Texte

Résultat

Audio

Limites de jetons[*]

Limite de jetons d'entrée

8 192

Limite de jetons de sortie

16 384

 Fonctionnalités

Génération d'audio

Compatible

Mise en cache

Not supported

Exécution de code

Not supported

Recherche de fichiers

Non compatible

Appel de fonction

Not supported

Ancrage avec Google Maps

Not supported

Génération d'images

Not supported

API Live

Not supported

Ancrage de recherche

Not supported

Sorties structurées

Not supported

Réflexion

Not supported

Contexte de l'URL

Not supported

 Options de consommation

API Batch

Compatible

Inférence Flex

Not supported

Inférence prioritaire

Not supported

Versions
Pour en savoir plus, consultez les schémas de version de modèle.
  • gemini-3.1-flash-tts-preview
Dernière mise à jour Avril 2026
Fiche de modèle fiche de modèle