Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking to nasz model audio-to-audio o wysokim poziomie rozumowania, który zalecamy, gdy podczas interakcji głosowych w czasie rzeczywistym wymagane jest bardziej zaawansowane rozumowanie w tle w przypadku złożonych problemów wieloetapowych. Przetwarza rozumowanie w tle i asynchroniczne wywołania narzędzi, przesyłając strumieniowo ciągłe odpowiedzi audio.

Dokumentacja

Więcej informacji o funkcjach i możliwościach znajdziesz w przewodniku po interfejsie Live API.

gemini-3.8-live-extended-thinking

Właściwość Opis
Kod modelu gemini-3.8-live-extended-thinking
Obsługiwane typy danych

Dane wejściowe

tekst, obrazy, dźwięk, wideo;

Dane wyjściowe

Tekst i dźwięk

Limity tokenów[*]

Limit tokenów wejściowych

131 072

Limit tokenów wyjściowych

65 536

Uprawnienia

Generowanie dźwięku

Obsługiwane

Zapisywanie w pamięci podręcznej

Nieobsługiwane

Wykonanie kodu

Nieobsługiwane

Wyszukiwanie plików

Nieobsługiwane

Wywoływanie funkcji

Obsługiwane (tylko asynchronicznie)

Powiązanie ze źródłami informacji przy użyciu Map Google

Nieobsługiwane

Generowanie obrazów

Nieobsługiwane

Live API

Obsługiwane

Szukaj groundingu

Obsługiwane

Ustrukturyzowane dane wyjściowe

Nieobsługiwane

Myślenie

Obsługiwane

Kontekst adresu URL

Nieobsługiwane

 Opcje wykorzystania

Batch API

Nieobsługiwane

Wersje
Więcej informacji znajdziesz w wzorcach wersji modelu.
  • Stabilny: gemini-3.8-live-extended-thinking
Ostatnia aktualizacja Wrzesień 2026 r.
Karta modelu Karta modelu

Uaktualnianie do Gemini 3.8 Live z myśleniem rozszerzonym

Gemini 3.8 Live Extended Thinking wprowadza rozumowanie w tle podczas sesji audio na żywo. Podczas integrowania tego modelu zaktualizuj zarządzanie stanem klienta, aby obsługiwać asynchroniczne sygnały rozumowania:

  • Protokół asynchronicznego rozumowania: podczas interakcji z modelami, które korzystają z asynchronicznego rozumowania, ikonaturnComplete: true nie będzie już wskazywać, że model jest nieaktywny. Serwer może kontynuować przetwarzanie wnioskowania w tle lub wywołań narzędzi. Klient musi nadal nasłuchiwać kolejnych wiadomości z serwera (takich jak wywołania narzędzi lub ramki audio) po otrzymaniu komunikatu turnComplete: true.
  • Monitorowanieinteraction_status: użyj pola interaction_status w przychodzących wiadomościach z serwera, aby określić bieżący stan serwera:
    • IN_PROGRESS: serwer aktywnie przetwarza dane wejściowe użytkownika, wykonuje rozumowanie w tle lub oczekuje na odpowiedzi na asynchroniczne wywołania narzędzi. Może po nich nastąpić dodatkowe wyjście modelu lub wywołania narzędzi.
    • IDLE: serwer zakończył przetwarzanie, wnioskowanie i wywoływanie narzędzi. Sesja jest nieaktywna i czeka na dane wejściowe użytkownika.
  • Asynchroniczne wywoływanie funkcji: obsługiwane jest tylko asynchroniczne wykonywanie nieblokujące (behavior: NON_BLOCKING). Synchroniczny tryb blokowania nie jest obsługiwany i zwraca błąd krytyczny. Konfiguracje planowania funkcji nie są obsługiwane.
  • Konfiguracja myślenia: skonfiguruj rozumowanie w tle za pomocą parametru thinking_config w konfiguracji (thinking_level: low, medium lub high). Pamiętaj, że parametr MINIMAL nie jest obsługiwany.
  • Aktualizacje treści klienta: send_client_content jest obsługiwane przez cały cykl życia sesji z określonymi rolami (user lub model). Ustawienie turn_complete=true natychmiast przerywa aktywne generowanie.
  • Proaktywny dźwięk: włączony na stałe. Ustawienie proactive_audio: false zwraca błąd.

Porównanie funkcji wszystkich modeli interfejsu Live API znajdziesz w tabeli Porównanie modeli.