Gemini 3.8 Live

Gemini 3.8 Live to domyślna opcja w przypadku większości usług głosowych z krótkim czasem oczekiwania i dialogów w czasie rzeczywistym bez opóźnień wynikających z procesu wnioskowania. Obsługuje przeplatanie rozumowania, asynchroniczne wywoływanie funkcji, pełne aktualizacje treści klienta sesji i wbudowane przesyłanie strumieniowe dźwięku.

Dokumentacja

Więcej informacji o funkcjach i możliwościach znajdziesz w przewodniku po interfejsie Live API.

gemini-3.8-live

Właściwość Opis
Kod modelu gemini-3.8-live
Obsługiwane typy danych

Dane wejściowe

tekst, obrazy, dźwięk, wideo;

Dane wyjściowe

Tekst i dźwięk

Limity tokenów[*]

Limit tokenów wejściowych

131 072

Limit tokenów wyjściowych

65 536

Uprawnienia

Generowanie dźwięku

Obsługiwane

Zapisywanie w pamięci podręcznej

Nieobsługiwane

Wykonanie kodu

Nieobsługiwane

Wyszukiwanie plików

Nieobsługiwane

Wywoływanie funkcji

Obsługiwane

Powiązanie ze źródłami informacji przy użyciu Map Google

Nieobsługiwane

Generowanie obrazów

Nieobsługiwane

Live API

Obsługiwane

Szukaj groundingu

Obsługiwane

Ustrukturyzowane dane wyjściowe

Nieobsługiwane

Myślenie

Obsługiwane (przeplatane uzasadnienie)

Kontekst adresu URL

Nieobsługiwane

 Opcje wykorzystania

Batch API

Nieobsługiwane

Wersje
Więcej informacji znajdziesz w wzorcach wersji modelu.
  • Stabilny: gemini-3.8-live
Ostatnia aktualizacja Wrzesień 2026 r.
Karta modelu Karta modelu

Przenoszenie danych z Gemini 3.1 Flash Live

Gemini 3.8 Live zapewnia interakcje głosowe z bardzo małym opóźnieniem i rozszerza obsługę przepływów pracy asynchronicznej. Jeśli migrujesz z gemini-3.1-flash-live-preview, zapoznaj się z tymi zmianami:

  • Ciąg znaków modelu: zaktualizuj ciąg znaków modelu z gemini-3.1-flash-live-preview na gemini-3.8-live.
  • Poziom myślenia: thinking_level nie jest obsługiwany w przypadku języka gemini-3.8-live. Pomiń thinking_level (lub thinking_config) w konfiguracji sesji.
  • Asynchroniczne wywoływanie funkcji: asynchroniczne wykonywanie (behavior: NON_BLOCKING) jest teraz domyślnym trybem wywoływania funkcji. Aby zapewnić zgodność wsteczną, możesz nadal używać synchronicznego trybu blokowania, ustawiając w deklaracjach narzędzi wartość behavior: BLOCKING on. Obsługiwane jest planowanie funkcji (SILENT, WHEN_IDLE, INTERRUPTED).
  • Aktualizacje treści klienta: send_client_content jest obsługiwane przez cały cykl życia sesji z określonymi rolami (user lub model). Ustawienie turn_complete=true bezwarunkowo przerywa aktywne generowanie modelu. Jeśli wyślesz treść bez turn_complete, serwer będzie czekać na kolejne wiadomości przed wysłaniem odpowiedzi.
  • Proaktywny dźwięk: proaktywny dźwięk jest teraz włączony na stałe. Ustawienie proactive_audio: false zwraca błąd.
  • Afektywny dialog: afektywny dialog został usunięty z interfejsu API. Usuń z kodu wszystkie konfiguracje enable_affective_dialog.
  • Turn coverage (Ochrona przed uszkodzeniem): domyślnie ustawiona na TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Klatki wideo są domyślnie wysyłane do modelu, więc wysyłaj je tylko wtedy, gdy jest to konieczne do zarządzania kontekstem i kosztami.
  • Rodzaje odpowiedzi: obsługiwany jest tylko dźwięk. Włącz transkrypcję dźwięku wyjściowego, jeśli aplikacja wymaga transkrypcji tekstowej.

Porównanie funkcji wszystkich modeli interfejsu Live API znajdziesz w tabeli Porównanie modeli.