Gemini 3.1 Flash TTS (zamiana tekstu na mowę) – wersja testowa

Model Gemini 3.1 Flash TTS Preview umożliwia generowanie mowy z krótkim czasem oczekiwania i naturalnymi wynikami, sterowanymi promptami oraz nowymi ekspresyjnymi tagami audio, które zapewniają precyzyjną kontrolę nad narracją.

Dokumentacja

Model Gemini 3.1 Flash TTS Preview wprowadza ekspresyjne tagi audio do sterowania narracją, a także ogólne ulepszenia w zakresie naturalności, możliwości sterowania i wielojęzyczności.

Więcej informacji o funkcjach i możliwościach znajdziesz w przewodniku po funkcji zamiany tekstu na mowę.

gemini-3.1-flash-tts-preview

Właściwość Opis
Kod modelu gemini-3.1-flash-tts-preview
Obsługiwane typy danych

Dane wejściowe

Tekst

Dane wyjściowe

Audio

Limity tokenów[*]

Limit tokenów wejściowych

8192

Limit tokenów wyjściowych

16384

Możliwości

Generowanie dźwięku

Obsługiwane

Zapisywanie w pamięci podręcznej

Nieobsługiwane

Wykonywanie kodu

Nieobsługiwane

Wyszukiwanie plików

Nieobsługiwane

Wywoływanie funkcji

Nieobsługiwane

Powiązanie ze źródłami informacji przy użyciu Map Google

Nieobsługiwane

Generowanie obrazów

Nieobsługiwane

Interfejs API na żywo

Nieobsługiwane

Szukaj groundingu

Nieobsługiwane

Ustrukturyzowane dane wyjściowe

Nieobsługiwane

Myślę

Nieobsługiwane

Kontekst adresu URL

Nieobsługiwane

Opcje zużycia

Interfejs API wsadowy

Obsługiwane

Wnioskowanie Flex

Nieobsługiwane

Wnioskowanie priorytetowe

Nieobsługiwane

Wersje
Więcej informacji znajdziesz w artykule Wzorce wersji modelu.
  • gemini-3.1-flash-tts-preview
Najnowsza aktualizacja Kwiecień 2026 r.
Karta modelu Karta modelu