Model Gemini 3.1 Flash TTS Preview umożliwia generowanie mowy z krótkim czasem oczekiwania i naturalnymi wynikami, sterowanymi promptami oraz nowymi ekspresyjnymi tagami audio, które zapewniają precyzyjną kontrolę nad narracją.
Dokumentacja
Model Gemini 3.1 Flash TTS Preview wprowadza ekspresyjne tagi audio do sterowania narracją, a także ogólne ulepszenia w zakresie naturalności, możliwości sterowania i wielojęzyczności.
Więcej informacji o funkcjach i możliwościach znajdziesz w przewodniku po funkcji zamiany tekstu na mowę.
gemini-3.1-flash-tts-preview
| Właściwość | Opis |
|---|---|
| Kod modelu | gemini-3.1-flash-tts-preview |
| Obsługiwane typy danych |
Dane wejściowe Tekst Dane wyjściowe Audio |
| Limity tokenów[*] |
Limit tokenów wejściowych 8192 Limit tokenów wyjściowych 16384 |
| Możliwości | Obsługiwane Zapisywanie w pamięci podręcznej Nieobsługiwane Nieobsługiwane Nieobsługiwane Nieobsługiwane Powiązanie ze źródłami informacji przy użyciu Map Google Nieobsługiwane Nieobsługiwane Nieobsługiwane Nieobsługiwane Ustrukturyzowane dane wyjściowe Nieobsługiwane Nieobsługiwane Nieobsługiwane |
| Opcje zużycia |
Obsługiwane Nieobsługiwane Nieobsługiwane |
| Wersje |
|
| Najnowsza aktualizacja | Kwiecień 2026 r. |
| Karta modelu | Karta modelu |