Gemini 3.8 Live est l'option par défaut pour la plupart des expériences d'agent vocal à faible latence et des dialogues en temps réel sans délai induit par le raisonnement. Il est compatible avec le raisonnement entrelacé, l'appel de fonction asynchrone, les mises à jour complètes du contenu du client de session et le streaming audio intégré.
Documentation
Consultez le guide de l'API Live pour obtenir une couverture complète des fonctionnalités.
gemini-3.8-live
| Propriété | Description |
|---|---|
| Code du modèle |
gemini-3.8-live
|
| Types de données acceptés pour |
Entrées Texte, images, audio, vidéo Résultat Texte et audio |
| Limites de jetons[*] |
Limite de jetons d'entrée 131 072 Limite de jetons de sortie 65 536 |
| Fonctionnalités |
Compatible Not supported Not supported Not supported Compatible Not supported Not supported Compatible Compatible Not supported Compatible (raisonnement entrelacé) Not supported |
| Options de consommation |
Not supported |
| Versions |
|
| Dernière mise à jour | Septembre 2026 |
| Fiche de modèle | fiche de modèle |
Migrer depuis Gemini 3.1 Flash Live
Gemini 3.8 Live permet des interactions audio à audio à latence ultra-faible et étend la compatibilité avec les workflows asynchrones. Lorsque vous migrez depuis gemini-3.1-flash-live-preview, examinez les mises à jour suivantes :
- Chaîne de modèle : remplacez la chaîne de modèle
gemini-3.1-flash-live-previewpargemini-3.8-live. - Niveau de réflexion :
thinking_leveln'est pas compatible avecgemini-3.8-live. Omettezthinking_level(outhinking_config) lors de la configuration de votre session. - Appel de fonction asynchrone : l'exécution asynchrone (
behavior: NON_BLOCKING) est désormais le mode d'appel de fonction par défaut. Pour assurer la rétrocompatibilité, vous pouvez toujours utiliser le mode de blocage synchrone en définissantbehavior: BLOCKINGsur vos déclarations d'outils. La planification des fonctions (SILENT,WHEN_IDLE,INTERRUPTED) est acceptée. - Mises à jour du contenu client :
send_client_contentest compatible tout au long du cycle de vie de la session avec des rôles explicites (useroumodel). La définition deturn_complete=trueinterrompt inconditionnellement la génération de modèle actif. Si vous envoyez du contenu sansturn_complete, le serveur attend les messages suivants avant de répondre. - Audio proactif : l'audio proactif est désormais activé de manière permanente. La définition de
proactive_audio: falserenvoie une erreur. - Dialogue affectif : le dialogue affectif est supprimé de l'API. Supprimez toutes les configurations
enable_affective_dialogde votre code. - Couverture du tournant : la valeur par défaut est
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Les frames vidéo sont envoyés au modèle par défaut. N'envoyez donc des frames que lorsque cela est nécessaire pour gérer le contexte et les coûts. - Modalités de réponse : la modalité de réponse audio est acceptée. Activez la transcription audio de la sortie si votre application nécessite une transcription textuelle.
Pour comparer les fonctionnalités de tous les modèles de l'API Live, consultez le tableau Comparaison des modèles.