Gemini 3.8 Live to domyślna opcja w przypadku większości usług głosowych z krótkim czasem oczekiwania i dialogów w czasie rzeczywistym bez opóźnień wynikających z procesu wnioskowania. Obsługuje przeplatanie rozumowania, asynchroniczne wywoływanie funkcji, pełne aktualizacje treści klienta sesji i wbudowane przesyłanie strumieniowe dźwięku.
Dokumentacja
Więcej informacji o funkcjach i możliwościach znajdziesz w przewodniku po interfejsie Live API.
gemini-3.8-live
| Właściwość | Opis |
|---|---|
| Kod modelu |
gemini-3.8-live
|
| Obsługiwane typy danych |
Dane wejściowe tekst, obrazy, dźwięk, wideo; Dane wyjściowe Tekst i dźwięk |
| Limity tokenów[*] |
Limit tokenów wejściowych 131 072 Limit tokenów wyjściowych 65 536 |
| Uprawnienia |
Obsługiwane Zapisywanie w pamięci podręcznej Nieobsługiwane Nieobsługiwane Nieobsługiwane Obsługiwane Powiązanie ze źródłami informacji przy użyciu Map Google Nieobsługiwane Nieobsługiwane Obsługiwane Obsługiwane Ustrukturyzowane dane wyjściowe Nieobsługiwane Obsługiwane (przeplatane uzasadnienie) Nieobsługiwane |
| Opcje wykorzystania |
Nieobsługiwane |
| Wersje |
|
| Ostatnia aktualizacja | Wrzesień 2026 r. |
| Karta modelu | Karta modelu |
Przenoszenie danych z Gemini 3.1 Flash Live
Gemini 3.8 Live zapewnia interakcje głosowe z bardzo małym opóźnieniem i rozszerza obsługę przepływów pracy asynchronicznej. Jeśli migrujesz z
gemini-3.1-flash-live-preview, zapoznaj się z tymi zmianami:
- Ciąg znaków modelu: zaktualizuj ciąg znaków modelu z
gemini-3.1-flash-live-previewnagemini-3.8-live. - Poziom myślenia:
thinking_levelnie jest obsługiwany w przypadku językagemini-3.8-live. Pomińthinking_level(lubthinking_config) w konfiguracji sesji. - Asynchroniczne wywoływanie funkcji: asynchroniczne wykonywanie (
behavior: NON_BLOCKING) jest teraz domyślnym trybem wywoływania funkcji. Aby zapewnić zgodność wsteczną, możesz nadal używać synchronicznego trybu blokowania, ustawiając w deklaracjach narzędzi wartośćbehavior: BLOCKINGon. Obsługiwane jest planowanie funkcji (SILENT,WHEN_IDLE,INTERRUPTED). - Aktualizacje treści klienta:
send_client_contentjest obsługiwane przez cały cykl życia sesji z określonymi rolami (userlubmodel). Ustawienieturn_complete=truebezwarunkowo przerywa aktywne generowanie modelu. Jeśli wyślesz treść bezturn_complete, serwer będzie czekać na kolejne wiadomości przed wysłaniem odpowiedzi. - Proaktywny dźwięk: proaktywny dźwięk jest teraz włączony na stałe. Ustawienie
proactive_audio: falsezwraca błąd. - Afektywny dialog: afektywny dialog został usunięty z interfejsu API. Usuń z kodu wszystkie konfiguracje
enable_affective_dialog. - Turn coverage (Ochrona przed uszkodzeniem): domyślnie ustawiona na
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Klatki wideo są domyślnie wysyłane do modelu, więc wysyłaj je tylko wtedy, gdy jest to konieczne do zarządzania kontekstem i kosztami. - Rodzaje odpowiedzi: obsługiwany jest tylko dźwięk. Włącz transkrypcję dźwięku wyjściowego, jeśli aplikacja wymaga transkrypcji tekstowej.
Porównanie funkcji wszystkich modeli interfejsu Live API znajdziesz w tabeli Porównanie modeli.