Gemini 3.8 Live

Gemini 3.8 Live ist die Standardoption für die meisten Sprachagenten mit geringer Latenz und für Echtzeitdialoge ohne durch Reasoning verursachte Verzögerungen. Es unterstützt verschachtelte Argumentation, asynchrone Funktionsaufrufe, vollständige Aktualisierungen des Clientinhalts der Sitzung und integriertes Audiostreaming.

Dokumentation

Im Live API-Leitfaden finden Sie eine vollständige Beschreibung der Funktionen und Möglichkeiten.

gemini-3.8-live

Attribut Beschreibung
Modellcode gemini-3.8-live
Unterstützte Datentypen

Eingaben

Text, Bilder, Audio, Video

Ausgabe

Text und Audio

Token-Limits[*]

Eingabetokenlimit

131.072

Tokenausgabelimit

65.536

Funktionen

Audiogenerierung

Unterstützt

Caching

Nicht unterstützt

Code-Ausführung

Nicht unterstützt

Dateisuche

Nicht unterstützt

Funktionsaufrufe

Unterstützt

Fundierung mit Google Maps

Nicht unterstützt

Bildgenerierung

Nicht unterstützt

Live API

Unterstützt

Suchfundierung

Unterstützt

Strukturierte Ausgaben

Nicht unterstützt

Antwort wird generiert

Unterstützt (verschachtelte Argumentation)

URL-Kontext

Nicht unterstützt

Nutzungsoptionen

Batch API

Nicht unterstützt

-Versionen
Weitere Informationen finden Sie unter Muster für Modellversionen.
  • Stabil: gemini-3.8-live
Letzte Aktualisierung September 2026
Modellkarte Modellkarte

Migration von Gemini 3.1 Flash Live

Gemini 3.8 Live bietet Audio-zu-Audio-Interaktionen mit extrem niedriger Latenz und unterstützt jetzt auch asynchrone Workflows. Wenn Sie von gemini-3.1-flash-live-preview migrieren, sollten Sie sich die folgenden Updates ansehen:

  • Modellstring: Aktualisieren Sie Ihren Modellstring von gemini-3.1-flash-live-preview zu gemini-3.8-live.
  • Denkaufwand: thinking_level wird für gemini-3.8-live nicht unterstützt. Lassen Sie thinking_level (oder thinking_config) bei der Einrichtung der Sitzung weg.
  • Asynchrone Funktionsaufrufe: Die asynchrone Ausführung (behavior: NON_BLOCKING) ist jetzt der Standardmodus für Funktionsaufrufe. Aus Gründen der Abwärtskompatibilität können Sie weiterhin den synchronen blockierenden Modus verwenden, indem Sie behavior: BLOCKING in Ihren Tool-Deklarationen festlegen. Die Planung von Funktionen (SILENT, WHEN_IDLE, INTERRUPTED) wird unterstützt.
  • Aktualisierungen von Clientinhalten: send_client_content wird während des gesamten Sitzungslebenszyklus mit expliziten Rollen (user oder model) unterstützt. Durch das Festlegen von turn_complete=true wird die aktive Modellgenerierung bedingungslos unterbrochen. Wenn Sie Inhalte ohne turn_complete senden, wartet der Server auf nachfolgende Nachrichten, bevor er antwortet.
  • Proaktive Audioeingabe: Die proaktive Audioeingabe ist jetzt dauerhaft aktiviert. Wenn Sie proactive_audio: false festlegen, wird ein Fehler zurückgegeben.
  • Empathischer Dialog: Der empathische Dialog wurde aus der API entfernt. Entfernen Sie alle enable_affective_dialog-Konfigurationen aus Ihrem Code.
  • Turn coverage (Abdeckung für Abbiegungen): Standardmäßig TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Videoframes werden standardmäßig an das Modell gesendet. Senden Sie daher nur Frames, wenn dies zur Verwaltung von Kontext und Kosten erforderlich ist.
  • Antwortmodalitäten: Audio ist die unterstützte Antwortmodalität. Aktivieren Sie die Audiotranskription für die Ausgabe, wenn Ihre Anwendung ein Texttranskript erfordert.

Einen Funktionsvergleich aller Live-API-Modelle finden Sie in der Tabelle Modellvergleich.