Gemini 3.8 Flash-Lite TTS

Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) adalah model text-to-speech andalan Google yang cepat dan hemat biaya, yang dibuat untuk menggantikan gemini-3.1-flash-tts-preview untuk beban kerja produksi dengan throughput tinggi.

Ringkasan dan kemampuan

Gemini 3.8 Flash-Lite TTS menggabungkan latensi rendah dengan ucapan yang ekspresif dan alami:

  • Efisiensi throughput tinggi: Dioptimalkan untuk produksi massal, kaskade agen suara percakapan, fitur baca lisan, dan pembuatan ucapan satu penutur sehari-hari dalam bahasa utama.
  • Kompatibilitas skema langsung: Memiliki skema API dan format perintah terstruktur yang sama persis dengan gemini-3.8-flash-tts, sehingga Anda dapat mengganti model hanya dengan mengubah satu parameter.
  • Dukungan ekosistem suara penuh: Mendukung suara bawaan, Extended Voice Library (GET /v1beta/voices), persona Desain suara kustom, dan Replikasi suara (suara yang disimpan secara persisten secara default, ditambah kunci stateless opsional). Anda juga dapat mendesain dan mereplikasi suara secara interaktif di Google AI Studio.

Buka panduan Text-to-speech untuk mengetahui cakupan lengkap fitur, praktik terbaik perintah, dan contoh kode.

Kapan harus menggunakan model TTS yang mana

Kedua model TTS Gemini 3.8 memiliki skema API dan struktur perintah yang sama. Pilih model yang sesuai dengan beban kerja Anda:

Fitur / workload Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) Gemini 3.8 Flash TTS (gemini-3.8-flash-tts)
Kekuatan utama Throughput tinggi, latensi rendah, dan efisiensi biaya Fidelitas suara maksimum, nuansa akting, dan cakupan dialek
Kasus penggunaan terbaik Produksi volume tinggi, rangkaian agen suara real-time, fitur baca lisan, replikasi suara, pembuatan suara satu pembicara sehari-hari Buku audio, narasi studio, dialog multi-pembicara yang kompleks, akting dengan ledakan vokal yang berat, pengucapan yang sulit, dialek regional
Bahasa yang didukung 101 bahasa 130 bahasa
Pengganti yang direkomendasikan untuk gemini-3.1-flash-tts-preview Tingkatan materi iklan unggulan baru

Panduan migrasi

Jika Anda melakukan upgrade dari gemini-3.1-flash-tts-preview ke gemini-3.8-flash-lite-tts, perbarui permintaan Anda untuk skema Gemini 3.8 TTS:

  1. Memindahkan petunjuk tingkat belokan ke speech_metadata: Gemini 3.8 TTS memperlakukan teks input secara ketat sebagai transkrip kata demi kata. Petunjuk teks inline seperti "Say cheerfully: Hello!" atau "Speaker 1: Hello!" dapat diucapkan. Memindahkan petunjuk pengiriman berkelanjutan (style) dan label pembicara (speaker) ke dalam metadata terstruktur:
    • Interactions API: Lampirkan anotasi dengan "type": "speech_metadata", "speaker", dan "style" ke setiap blok konten teks.
    • GenerateContent API: Lampirkan "speech_metadata": {"speaker": "...", "style": "..."} ke setiap part.
  2. Gunakan tag inline tanda kurung sudut hanya untuk peristiwa vokal pada satu titik waktu: Pertahankan vokalisasi non-ucapan dan jeda sesaat dalam transkrip menggunakan tanda kurung sudut (seperti <laugh>, <sigh>, <cough>, <breath>, atau <short pause>). Masukkan gaya penyampaian seperti berbisik dalam speech_metadata.style.
  3. Tentukan speaker di setiap giliran dalam permintaan multi-pembicara: Setiap giliran dalam permintaan multi-pembicara harus secara eksplisit menyertakan speaker di dalam speech_metadata yang cocok dengan salah satu pembicara yang dikonfigurasi.
  4. Desain persona di awal dengan Desain suara: Ganti blok Audio Profile / Director's Notes lama yang panjang dengan suara kustom yang dibuat di Desain suara, lalu bawa ID voice_... tersebut melalui permintaan TTS Anda dengan string style yang minimal atau kosong.
  5. Memperhitungkan output WAV default (audio/wav) pada permintaan unary: Tidak seperti model TTS gemini-3.1-flash-tts-preview dan yang lebih lama (yang menampilkan audio/l16 PCM mentah tanpa header secara default), Gemini 3.8 TTS menampilkan audio WAV (audio/wav / AUDIO_WAV) dengan header RIFF standar secara default untuk permintaan unary.
    • Jika kode Anda sebelumnya membungkus byte PCM mentah dalam header WAV (misalnya, menggunakan modul wave Python atau ffmpeg), hapus pembungkus header manual dan tulis byte yang ditampilkan langsung ke file .wav.
    • Jika pipeline Anda memerlukan audio PCM mentah tanpa header, mu-law, atau A-law, tetapkan response_format secara eksplisit ke "audio/l16" ("AUDIO_L16"), "audio/mulaw" ("AUDIO_MULAW"), atau "audio/alaw" ("AUDIO_ALAW"). Lihat Format output audio.

gemini-3.8-flash-lite-tts

Properti Deskripsi
Kode model gemini-3.8-flash-lite-tts
Jenis data yang didukung

Input

Teks

Output

Audio

Batas token[*]

Batas token input

8.192

Batas token output

16.384 (batas penayangan Gemini API)

Kemampuan

Pembuatan audio

Didukung

Caching

Didukung

Eksekusi kode

Tidak didukung

Penelusuran file

Tidak didukung

Pemanggilan fungsi

Tidak didukung

Grounding dengan Google Maps

Tidak didukung

Pembuatan gambar

Tidak didukung

Live API

Tidak didukung

Grounding penelusuran

Tidak didukung

Output terstruktur

Tidak didukung

Penalaran

Tidak didukung

Konteks URL

Tidak didukung

Opsi pemakaian

Batch API

Didukung

Inferensi fleksibel

Didukung

Inferensi prioritas

Didukung

Versi
Baca pola versi model untuk mengetahui detail selengkapnya.
  • gemini-3.8-flash-lite-tts
Pembaruan terbaru September 2026

Bahasa yang didukung

gemini-3.8-flash-lite-tts mendeteksi bahasa input secara otomatis dan mendukung lebih dari 100 bahasa:

Language Language Language
Aceh (skrip Arab) Jerman Manipuri
Afrika Yunani Marathi
Akan Gujarat Minangkabau (skrip Arab)
Amharik Kreol Haiti Mizo
Armenia Halh Mongolia Nepali (bahasa individu)
Assam Hausa Fulfulde Nigeria
Awadhi Ibrani Azerbaijan Utara
Bali Hindi Sotho Utara
Bangla Hungaria Uzbek Utara
Banjar (skrip Latn) Islandia Bokmål Norwegia
Basque Iloko Nynorsk Norwegia
Belarusia Indonesia Nyanja
Bhojpuri Persia Iran Odia (bahasa individu)
Bosnia Italia Persia (Afganistan)
Bugis Jepang Polandia
Bulgaria Jawa Portugis
Kanton Kamba Punjabi
Katalan Kannada Rumania
Cebuano Kashmir (skrip Arab) Rusia
Kurdi Tengah Kashmir (skrip Deva) Santali
Chhattisgarhi Kazak Serbia
China (skrip Hans) Khmer Sinhala
China (skrip Hant) Kikuyu Slovakia
Kroasia Kinyarwanda Azerbaijan Selatan
Ceko Kongo Pashto Selatan
Denmark Korea Spanyol
Belanda Kirgiz Arab Standar (skrip Arab)
Arab Mesir Laos Arab Standar (skrip Latn)
Inggris Lingala Latvia Standar
Estonia Makedonia Melayu Standar
Filipino Magahi Tamil
Prancis Maithili Telugu
Galisia Malayalam Turki
Ganda Malta Vietnam
Georgia — —