Gemini 3.8 Live

Gemini 3.8 Live est l'option par défaut pour la plupart des expériences d'agent vocal à faible latence et des dialogues en temps réel sans délai induit par le raisonnement. Il est compatible avec le raisonnement entrelacé, l'appel de fonction asynchrone, les mises à jour complètes du contenu du client de session et le streaming audio intégré.

Documentation

Consultez le guide de l'API Live pour obtenir une couverture complète des fonctionnalités.

gemini-3.8-live

Propriété Description
Code du modèle gemini-3.8-live
Types de données acceptés pour

Entrées

Texte, images, audio, vidéo

Résultat

Texte et audio

Limites de jetons[*]

Limite de jetons d'entrée

131 072

Limite de jetons de sortie

65 536

 Fonctionnalités

Génération d'audio

Compatible

Mise en cache

Not supported

Exécution de code

Not supported

Recherche de fichiers

Not supported

Appel de fonction

Compatible

Ancrage avec Google Maps

Not supported

Génération d'images

Not supported

API Live

Compatible

Ancrage de recherche

Compatible

Sorties structurées

Not supported

Réflexion

Compatible (raisonnement entrelacé)

Contexte de l'URL

Not supported

 Options de consommation

API Batch

Not supported

Versions
Pour en savoir plus, consultez les schémas de version de modèle.
  • Stable : gemini-3.8-live
Dernière mise à jour Septembre 2026
Fiche de modèle fiche de modèle

Migrer depuis Gemini 3.1 Flash Live

Gemini 3.8 Live permet des interactions audio à audio à latence ultra-faible et étend la compatibilité avec les workflows asynchrones. Lorsque vous migrez depuis gemini-3.1-flash-live-preview, examinez les mises à jour suivantes :

  • Chaîne de modèle : remplacez la chaîne de modèle gemini-3.1-flash-live-preview par gemini-3.8-live.
  • Niveau de réflexion : thinking_level n'est pas compatible avec gemini-3.8-live. Omettez thinking_level (ou thinking_config) lors de la configuration de votre session.
  • Appel de fonction asynchrone : l'exécution asynchrone (behavior: NON_BLOCKING) est désormais le mode d'appel de fonction par défaut. Pour assurer la rétrocompatibilité, vous pouvez toujours utiliser le mode de blocage synchrone en définissant behavior: BLOCKING sur vos déclarations d'outils. La planification des fonctions (SILENT, WHEN_IDLE, INTERRUPTED) est acceptée.
  • Mises à jour du contenu client : send_client_content est compatible tout au long du cycle de vie de la session avec des rôles explicites (user ou model). La définition de turn_complete=true interrompt inconditionnellement la génération de modèle actif. Si vous envoyez du contenu sans turn_complete, le serveur attend les messages suivants avant de répondre.
  • Audio proactif : l'audio proactif est désormais activé de manière permanente. La définition de proactive_audio: false renvoie une erreur.
  • Dialogue affectif : le dialogue affectif est supprimé de l'API. Supprimez toutes les configurations enable_affective_dialog de votre code.
  • Couverture du tournant : la valeur par défaut est TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Les frames vidéo sont envoyés au modèle par défaut. N'envoyez donc des frames que lorsque cela est nécessaire pour gérer le contexte et les coûts.
  • Modalités de réponse : la modalité de réponse audio est acceptée. Activez la transcription audio de la sortie si votre application nécessite une transcription textuelle.

Pour comparer les fonctionnalités de tous les modèles de l'API Live, consultez le tableau Comparaison des modèles.