Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking ist unser Audio-zu-Audio-Modell für logisches Denken, das empfohlen wird, wenn für die komplexe, mehrstufige Problemlösung während der Sprachinteraktion in Echtzeit ein höheres Maß an Hintergrundwissen erforderlich ist. Die Funktion verarbeitet Hintergrundüberlegungen und asynchrone Tool-Aufrufe, während kontinuierliche Audioantworten gestreamt werden.

Dokumentation

Im Live API-Leitfaden finden Sie eine vollständige Beschreibung der Funktionen und Möglichkeiten.

gemini-3.8-live-extended-thinking

Attribut Beschreibung
Modellcode gemini-3.8-live-extended-thinking
Unterstützte Datentypen

Eingaben

Text, Bilder, Audio, Video

Ausgabe

Text und Audio

Token-Limits[*]

Eingabetokenlimit

131.072

Tokenausgabelimit

65.536

Funktionen

Audiogenerierung

Unterstützt

Caching

Nicht unterstützt

Code-Ausführung

Nicht unterstützt

Dateisuche

Nicht unterstützt

Funktionsaufrufe

Unterstützt (nur asynchron)

Fundierung mit Google Maps

Nicht unterstützt

Bildgenerierung

Nicht unterstützt

Live API

Unterstützt

Suchfundierung

Unterstützt

Strukturierte Ausgaben

Nicht unterstützt

Antwort wird generiert

Unterstützt

URL-Kontext

Nicht unterstützt

Nutzungsoptionen

Batch API

Nicht unterstützt

-Versionen
Weitere Informationen finden Sie unter Muster für Modellversionen.
  • Stabil: gemini-3.8-live-extended-thinking
Letzte Aktualisierung September 2026
Modellkarte Modellkarte

Upgrade auf Gemini 3.8 Live Extended Thinking

Mit Gemini 3.8 Live Extended Thinking wird die Hintergrundanalyse während Live-Audiositzungen eingeführt. Wenn Sie dieses Modell einbinden, müssen Sie die Verwaltung des Clientstatus aktualisieren, um asynchrone Begründungssignale zu verarbeiten:

  • Asynchrones Reasoning-Protokoll: Bei der Interaktion mit Modellen, die asynchrones Reasoning verwenden, gibt turnComplete: true nicht mehr an, dass das Modell im Leerlauf ist. Der Server kann die Verarbeitung von Hintergrundüberlegungen oder Tool-Aufrufen fortsetzen. Ihr Client muss nach dem Empfang von turnComplete: true weiterhin auf nachfolgende Servernachrichten (z. B. Tool-Aufrufe oder Audio-Frames) warten.
  • Überwachung interaction_status: Verwenden Sie das Feld interaction_status in eingehenden Servernachrichten, um den aktuellen Serverstatus zu ermitteln:
    • IN_PROGRESS: Der Server verarbeitet aktiv Nutzereingaben, führt Hintergrundanalysen durch oder wartet auf Antworten für asynchrone Tool-Aufrufe. Möglicherweise folgen weitere Modellausgaben oder Tool-Aufrufe.
    • IDLE: Der Server hat alle Verarbeitungsvorgänge, Schlussfolgerungen und Tool-Aufrufe abgeschlossen. Die Sitzung ist inaktiv und wartet auf eine Nutzereingabe.
  • Asynchrone Funktionsaufrufe: Es wird nur die asynchrone, nicht blockierende Ausführung (behavior: NON_BLOCKING) unterstützt. Der synchrone Blockierungsmodus wird nicht unterstützt und gibt einen schwerwiegenden Fehler zurück. Konfigurationen für die Funktionsplanung werden nicht unterstützt.
  • Konfiguration für das Denken: Konfigurieren Sie die Hintergrundanalyse mit thinking_config in Ihrer Einrichtungskonfiguration (thinking_level: low, medium oder high). MINIMAL wird nicht unterstützt.
  • Aktualisierungen von Clientinhalten: send_client_content wird während des gesamten Sitzungslebenszyklus mit expliziten Rollen (user oder model) unterstützt. Wenn turn_complete=true festgelegt wird, wird die aktive Generierung sofort unterbrochen.
  • Proaktive Audioeingabe: Dauerhaft aktiviert. Wenn Sie proactive_audio: false festlegen, wird ein Fehler zurückgegeben.

Einen Funktionsvergleich aller Live-API-Modelle finden Sie in der Tabelle Modellvergleich.