Gemini 3.8 Live è l'opzione predefinita per la maggior parte delle esperienze di agenti vocali a bassa latenza e per i dialoghi in tempo reale senza ritardi indotti dal ragionamento. Supporta il ragionamento intercalato, la chiamata di funzione asincrona, gli aggiornamenti dei contenuti completi della sessione del client e lo streaming audio integrato.
Documentazione
Visita la guida all'API Live per una copertura completa di funzionalità e capacità.
gemini-3.8-live
| Proprietà | Descrizione |
|---|---|
| Codice modello |
gemini-3.8-live
|
| Tipi di dati supportati |
Input Testo, immagini, audio, video Output Testo e audio |
| Limiti dei token[*] |
Limite di token di input 131.072 Limite di token di output 65.536 |
| Funzionalità |
Supportato Non supportato Non supportato Non supportato Supportato Non supportato Non supportato Supportato Supportato Non supportato Supportato (ragionamento intercalato) Non supportato |
| Opzioni di consumo |
Non supportato |
| Versioni |
|
| Ultimo aggiornamento | Settembre 2026 |
| Scheda del modello | Scheda del modello |
Migrazione da Gemini 3.1 Flash Live
Gemini 3.8 Live offre interazioni audio-audio a latenza molto bassa
ed estende il supporto per i workflow asincroni. Quando esegui la migrazione da
gemini-3.1-flash-live-preview, rivedi i seguenti aggiornamenti:
- Stringa del modello: aggiorna la stringa del modello da
gemini-3.1-flash-live-previewagemini-3.8-live. - Livello di ragionamento:
thinking_levelnon è supportato pergemini-3.8-live. Omettithinking_level(othinking_config) dalla configurazione della sessione. - Chiamata di funzione asincrona: l'esecuzione asincrona (
behavior: NON_BLOCKING) è ora la modalità di chiamata di funzione predefinita. Puoi comunque utilizzare la modalità di blocco sincrono per la compatibilità con le versioni precedenti impostandobehavior: BLOCKINGnelle dichiarazioni degli strumenti. È supportata la pianificazione delle funzioni (SILENT,WHEN_IDLE,INTERRUPTED). - Aggiornamenti dei contenuti del client:
send_client_contentè supportato durante l'intero ciclo di vita della sessione con ruoli espliciti (useromodel). L'impostazione diturn_complete=trueinterrompe in modo incondizionato la generazione attiva del modello. Se invii contenuti senzaturn_complete, il server attende i messaggi successivi prima di rispondere. - Audio proattivo: l'audio proattivo è ora attivato in modo permanente. L'impostazione
proactive_audio: falserestituisce un errore. - Dialogo empatico: il dialogo empatico viene rimosso dall'API. Rimuovi
qualsiasi configurazione
enable_affective_dialogdal codice. - Copertura svolta: impostazione predefinita
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. I frame video vengono inviati al modello per impostazione predefinita, quindi invia i frame solo quando necessario per gestire il contesto e i costi. - Modalità di risposta: l'audio è la modalità di risposta supportata. Attiva la trascrizione audio di output se la tua applicazione richiede una trascrizione di testo.
Per un confronto delle funzionalità tra tutti i modelli dell'API Live, consulta la tabella Confronto modelli.