Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking est notre modèle audio-vers-audio à haut niveau de raisonnement. Il est recommandé lorsqu'un raisonnement en arrière-plan plus élevé est nécessaire pour résoudre des problèmes complexes en plusieurs étapes lors d'interactions vocales en temps réel. Il traite le raisonnement en arrière-plan et les appels d'outils asynchrones tout en diffusant des réponses audio continues.

Documentation

Consultez le guide de l'API Live pour obtenir une couverture complète des fonctionnalités.

gemini-3.8-live-extended-thinking

Propriété Description
Code du modèle gemini-3.8-live-extended-thinking
Types de données acceptés pour

Entrées

Texte, images, audio, vidéo

Résultat

Texte et audio

Limites de jetons[*]

Limite de jetons d'entrée

131 072

Limite de jetons de sortie

65 536

 Fonctionnalités

Génération d'audio

Compatible

Mise en cache

Not supported

Exécution de code

Not supported

Recherche de fichiers

Not supported

Appel de fonction

Compatible (asynchrone uniquement)

Ancrage avec Google Maps

Not supported

Génération d'images

Not supported

API Live

Compatible

Ancrage de recherche

Compatible

Sorties structurées

Not supported

Réflexion

Compatible

Contexte de l'URL

Not supported

 Options de consommation

API Batch

Not supported

Versions
Pour en savoir plus, consultez les schémas de version de modèle.
  • Stable : gemini-3.8-live-extended-thinking
Dernière mise à jour Septembre 2026
Fiche de modèle fiche de modèle

Passer à Gemini 3.8 Live Extended Thinking

La fonctionnalité Gemini 3.8 Live Extended Thinking introduit le raisonnement en arrière-plan lors des sessions audio en direct. Lorsque vous intégrez ce modèle, mettez à jour la gestion de l'état du client pour gérer les signaux de raisonnement asynchrones :

  • Protocole de raisonnement asynchrone : lorsque vous interagissez avec des modèles qui utilisent le raisonnement asynchrone, turnComplete: true n'indique plus que le modèle est inactif. Le serveur peut continuer à traiter le raisonnement en arrière-plan ou les appels d'outils. Votre client doit continuer à écouter les messages serveur suivants (tels que les appels d'outils ou les trames audio) après l'arrivée de turnComplete: true.
  • Surveillance interaction_status : utilisez le champ interaction_status dans les messages serveur entrants pour déterminer l'état actuel du serveur :
    • IN_PROGRESS : le serveur traite activement l'entrée utilisateur, exécute un raisonnement en arrière-plan ou attend des réponses pour les appels d'outils asynchrones. D'autres sorties de modèle ou appels d'outils peuvent suivre.
    • IDLE : le serveur a terminé tous les traitements, raisonnements et appels d'outils. La session est inactive et attend une entrée utilisateur.
  • Appel de fonction asynchrone : seule l'exécution asynchrone non bloquante (behavior: NON_BLOCKING) est acceptée. Le mode de blocage synchrone n'est pas pris en charge et renvoie une erreur fatale. Les configurations de planification des fonctions ne sont pas acceptées.
  • Configuration de la réflexion : configurez le raisonnement en arrière-plan à l'aide de thinking_config dans votre configuration (thinking_level : low, medium ou high). Notez que MINIMAL n'est pas pris en charge.
  • Mises à jour du contenu client : send_client_content est compatible tout au long du cycle de vie de la session avec des rôles explicites (user ou model). Définir turn_complete=true interrompt immédiatement la génération active.
  • Audio proactif : activé en permanence. La définition de proactive_audio: false renvoie une erreur.

Pour comparer les fonctionnalités de tous les modèles de l'API Live, consultez le tableau Comparaison des modèles.