Gemini 3.1 Flash Live Preview to starszy model w wersji testowej do dialogów w czasie rzeczywistym i aplikacji AI opartych na głosie.
Dokumentacja
Więcej informacji o funkcjach i możliwościach znajdziesz w przewodniku po interfejsie Live API.
gemini-3.1-flash-live-preview
| Właściwość | Opis |
|---|---|
| Kod modelu |
gemini-3.1-flash-live-preview
|
| Obsługiwane typy danych |
Dane wejściowe tekst, obrazy, dźwięk, wideo; Dane wyjściowe Tekst i dźwięk |
| Limity tokenów[*] |
Limit tokenów wejściowych 131 072 Limit tokenów wyjściowych 65 536 |
| Uprawnienia |
Obsługiwane Zapisywanie w pamięci podręcznej Nieobsługiwane Nieobsługiwane Nieobsługiwane Obsługiwane Powiązanie ze źródłami informacji przy użyciu Map Google Nieobsługiwane Nieobsługiwane Obsługiwane Obsługiwane Ustrukturyzowane dane wyjściowe Nieobsługiwane Obsługiwane Nieobsługiwane |
| Opcje wykorzystania |
Nieobsługiwane |
| Wersje |
|
| Ostatnia aktualizacja | Marzec 2026 r. |
| Karta modelu | Karta modelu |
Przechodzenie z Gemini 2.5 Flash Live
Gemini 3.1 Flash Live Preview jest zoptymalizowany pod kątem dialogów w czasie rzeczywistym z krótkim czasem oczekiwania.
Jeśli przenosisz dane z gemini-2.5-flash-native-audio-preview-12-2025, weź pod uwagę te kwestie:
- Ciąg znaków modelu: zaktualizuj ciąg znaków modelu z
gemini-2.5-flash-native-audio-preview-12-2025nagemini-3.1-flash-live-preview. - Konfiguracja myślenia: Gemini 3.1 używa
thinkingLevel(z ustawieniami takimi jakminimal,low,mediumihigh) zamiastthinkingBudget. Domyślnie jest tominimal, aby zoptymalizować opóźnienie. Zobacz Poziomy i budżety. - Zdarzenia serwera: jedno zdarzenie
BidiGenerateContentServerContentmoże teraz zawierać jednocześnie wiele części treści (np. fragmenty audio i transkrypcję). Aby uniknąć pominięcia treści, zaktualizuj kod, tak aby w każdym zdarzeniu przetwarzał wszystkie części. - Treści klienta:
send_client_contentsą obsługiwane przez cały cykl życia sesji z wyraźnymi rolami (userlubmodel). Ustawienieturn_complete=truebezwarunkowo przerywa aktywne generowanie modelu. Zobacz przyrostowe aktualizacje treści. - Turn coverage: domyślnie ma wartość
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEOzamiastTURN_INCLUDES_ONLY_ACTIVITY. Odpowiedź modelu obejmuje teraz wykrytą aktywność audio i wszystkie klatki wideo. Jeśli Twoja aplikacja przesyła obecnie stały strumień klatek wideo, możesz ją zaktualizować, aby wysyłała klatki wideo tylko wtedy, gdy występuje aktywność audio. Pozwoli to uniknąć dodatkowych kosztów. - Asynchroniczne wywoływanie funkcji: nie jest jeszcze obsługiwane. Wywoływanie funkcji jest tylko synchroniczne. Model nie zacznie odpowiadać, dopóki nie wyślesz odpowiedzi narzędzia. Zobacz Wywoływanie funkcji asynchronicznych.
- Aktywny dźwięk i dialog afektywny: te funkcje nie są jeszcze obsługiwane w Gemini 3.1 Flash Live. Usuń z kodu wszystkie konfiguracje tych funkcji. Zobacz Proaktywny dźwięk i Afektywny dialog.
Szczegółowe porównanie funkcji znajdziesz w tabeli Porównanie modeli w przewodniku po możliwościach.