Gemini 3.8 Live

Gemini 3.8 Live è l'opzione predefinita per la maggior parte delle esperienze di agenti vocali a bassa latenza e per i dialoghi in tempo reale senza ritardi indotti dal ragionamento. Supporta il ragionamento intercalato, la chiamata di funzione asincrona, gli aggiornamenti dei contenuti completi della sessione del client e lo streaming audio integrato.

Documentazione

Visita la guida all'API Live per una copertura completa di funzionalità e capacità.

gemini-3.8-live

Proprietà Descrizione
Codice modello gemini-3.8-live
Tipi di dati supportati

Input

Testo, immagini, audio, video

Output

Testo e audio

Limiti dei token[*]

Limite di token di input

131.072

Limite di token di output

65.536

Funzionalità

Generazione di audio

Supportato

Memorizzazione nella cache

Non supportato

Esecuzione di codice

Non supportato

Ricerca file

Non supportato

Chiamata di funzione

Supportato

Grounding con Google Maps

Non supportato

Generazione di immagini

Non supportato

API Live

Supportato

Fondatezza della Ricerca

Supportato

Output strutturati

Non supportato

Pensiero

Supportato (ragionamento intercalato)

Contesto URL

Non supportato

Opzioni di consumo

API batch

Non supportato

Versioni
Leggi i pattern delle versioni del modello per ulteriori dettagli.
  • Stabile: gemini-3.8-live
Ultimo aggiornamento Settembre 2026
Scheda del modello Scheda del modello

Migrazione da Gemini 3.1 Flash Live

Gemini 3.8 Live offre interazioni audio-audio a latenza molto bassa ed estende il supporto per i workflow asincroni. Quando esegui la migrazione da gemini-3.1-flash-live-preview, rivedi i seguenti aggiornamenti:

  • Stringa del modello: aggiorna la stringa del modello da gemini-3.1-flash-live-preview a gemini-3.8-live.
  • Livello di ragionamento: thinking_level non è supportato per gemini-3.8-live. Ometti thinking_level (o thinking_config) dalla configurazione della sessione.
  • Chiamata di funzione asincrona: l'esecuzione asincrona (behavior: NON_BLOCKING) è ora la modalità di chiamata di funzione predefinita. Puoi comunque utilizzare la modalità di blocco sincrono per la compatibilità con le versioni precedenti impostando behavior: BLOCKING nelle dichiarazioni degli strumenti. È supportata la pianificazione delle funzioni (SILENT, WHEN_IDLE, INTERRUPTED).
  • Aggiornamenti dei contenuti del client: send_client_content è supportato durante l'intero ciclo di vita della sessione con ruoli espliciti (user o model). L'impostazione di turn_complete=true interrompe in modo incondizionato la generazione attiva del modello. Se invii contenuti senza turn_complete, il server attende i messaggi successivi prima di rispondere.
  • Audio proattivo: l'audio proattivo è ora attivato in modo permanente. L'impostazione proactive_audio: false restituisce un errore.
  • Dialogo empatico: il dialogo empatico viene rimosso dall'API. Rimuovi qualsiasi configurazione enable_affective_dialog dal codice.
  • Copertura svolta: impostazione predefinita TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. I frame video vengono inviati al modello per impostazione predefinita, quindi invia i frame solo quando necessario per gestire il contesto e i costi.
  • Modalità di risposta: l'audio è la modalità di risposta supportata. Attiva la trascrizione audio di output se la tua applicazione richiede una trascrizione di testo.

Per un confronto delle funzionalità tra tutti i modelli dell'API Live, consulta la tabella Confronto modelli.