Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking è il nostro modello audio-audio di ragionamento avanzato consigliato quando è necessario un ragionamento di background più elevato per la risoluzione di problemi complessi e in più passaggi durante le interazioni vocali in tempo reale. Elabora il ragionamento in background e le chiamate asincrone agli strumenti durante lo streaming di risposte audio continue.

Documentazione

Visita la guida all'API Live per una copertura completa di funzionalità e capacità.

gemini-3.8-live-extended-thinking

Proprietà Descrizione
Codice modello gemini-3.8-live-extended-thinking
Tipi di dati supportati

Input

Testo, immagini, audio, video

Output

Testo e audio

Limiti dei token[*]

Limite di token di input

131.072

Limite di token di output

65.536

Funzionalità

Generazione di audio

Supportato

Memorizzazione nella cache

Non supportato

Esecuzione di codice

Non supportato

Ricerca file

Non supportato

Chiamata di funzione

Supportato (solo asincrono)

Grounding con Google Maps

Non supportato

Generazione di immagini

Non supportato

API Live

Supportato

Fondatezza della Ricerca

Supportato

Output strutturati

Non supportato

Pensiero

Supportato

Contesto URL

Non supportato

Opzioni di consumo

API batch

Non supportato

Versioni
Leggi i pattern delle versioni del modello per ulteriori dettagli.
  • Stabile: gemini-3.8-live-extended-thinking
Ultimo aggiornamento Settembre 2026
Scheda del modello Scheda del modello

Eseguire l'upgrade a Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking introduce il ragionamento in background durante le sessioni audio live. Quando integri questo modello, aggiorna la gestione dello stato del client per gestire gli indicatori di ragionamento asincroni:

  • Protocollo di ragionamento asincrono: quando interagisci con modelli che utilizzano il ragionamento asincrono, turnComplete: true non indica più che il modello è inattivo. Il server potrebbe continuare a elaborare il ragionamento in background o le chiamate di strumenti. Il client deve continuare ad ascoltare i messaggi del server successivi (ad esempio chiamate di strumenti o frame audio) dopo l'arrivo di turnComplete: true.
  • Monitoraggio interaction_status: utilizza il campo interaction_status nei messaggi del server in entrata per determinare lo stato attuale del server:
    • IN_PROGRESS: Il server sta elaborando attivamente l'input dell'utente, eseguendo ragionamenti in background o attendendo risposte per chiamate di strumenti asincrone. Potrebbero seguire output del modello o chiamate di strumenti aggiuntivi.
    • IDLE: il server ha completato tutte le operazioni di elaborazione, ragionamento e chiamate di strumenti. La sessione è inattiva e in attesa dell'input utente.
  • Chiamata di funzione asincrona: è supportata solo l'esecuzione asincrona non bloccante (behavior: NON_BLOCKING). La modalità di blocco sincrono non è supportata e restituisce un errore irreversibile. Le configurazioni di pianificazione delle funzioni non sono supportate.
  • Configurazione del pensiero: configura il ragionamento in background utilizzando thinking_config nella configurazione (thinking_level: low, medium o high). Tieni presente che MINIMAL non è supportato.
  • Aggiornamenti dei contenuti del client: send_client_content è supportato durante l'intero ciclo di vita della sessione con ruoli espliciti (user o model). L'impostazione turn_complete=true interrompe immediatamente la generazione attiva.
  • Audio proattivo: attivato in modo permanente. L'impostazione proactive_audio: false restituisce un errore.

Per un confronto delle funzionalità tra tutti i modelli dell'API Live, consulta la tabella Confronto modelli.