Gemini 3.8 Flash-Lite TTS

Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) adalah model text-to-speech andalan Google yang cepat dan hemat biaya, yang dibuat untuk menggantikan gemini-3.1-flash-tts-preview untuk beban kerja produksi dengan throughput tinggi.

Ringkasan dan kemampuan

Gemini 3.8 Flash-Lite TTS menggabungkan latensi rendah dengan ucapan yang ekspresif dan alami:

  • Efisiensi throughput tinggi: Dioptimalkan untuk produksi massal, kaskade agen suara percakapan, fitur baca lisan, dan pembuatan ucapan satu penutur sehari-hari dalam bahasa utama.
  • Kompatibilitas skema langsung: Memiliki skema API dan format perintah terstruktur yang sama persis dengan gemini-3.8-flash-tts, sehingga Anda dapat mengganti model hanya dengan mengubah satu parameter.
  • Dukungan ekosistem suara penuh: Mendukung suara bawaan, Extended Voice Library (GET /v1beta/voices), persona Desain suara kustom, dan Replikasi suara (suara yang disimpan secara persisten secara default, ditambah kunci stateless opsional). Anda juga dapat mendesain dan mereplikasi suara secara interaktif di Google AI Studio.

Buka panduan Text-to-speech untuk mengetahui cakupan lengkap fitur, praktik terbaik perintah, dan contoh kode.

Kapan harus menggunakan model TTS yang mana

Kedua model TTS Gemini 3.8 memiliki skema API dan struktur perintah yang sama. Pilih model yang sesuai dengan beban kerja Anda:

Fitur / workload Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) Gemini 3.8 Flash TTS (gemini-3.8-flash-tts)
Kekuatan utama Throughput tinggi, latensi rendah, dan efisiensi biaya Fidelitas suara maksimum, nuansa akting, dan cakupan dialek
Kasus penggunaan terbaik Produksi volume tinggi, rangkaian agen suara real-time, fitur baca lisan, replikasi suara, pembuatan suara satu pembicara sehari-hari Buku audio, narasi studio, dialog multi-pembicara yang kompleks, akting dengan ledakan vokal yang berat, pengucapan yang sulit, dialek regional
Bahasa yang didukung 101 bahasa 130 bahasa
Pengganti yang direkomendasikan untuk gemini-3.1-flash-tts-preview Tingkatan materi iklan unggulan baru

Panduan migrasi

Jika Anda melakukan upgrade dari gemini-3.1-flash-tts-preview ke gemini-3.8-flash-lite-tts, perbarui permintaan Anda untuk skema Gemini 3.8 TTS:

  1. Memindahkan petunjuk tingkat belokan ke speech_metadata: Gemini 3.8 TTS memperlakukan teks input secara ketat sebagai transkrip kata demi kata. Petunjuk teks inline seperti "Say cheerfully: Hello!" atau "Speaker 1: Hello!" dapat diucapkan. Memindahkan petunjuk pengiriman berkelanjutan (style) dan label pembicara (speaker) ke dalam metadata terstruktur:
    • Interactions API: Lampirkan anotasi dengan "type": "speech_metadata", "speaker", dan "style" ke setiap blok konten teks.
    • GenerateContent API: Lampirkan "speech_metadata": {"speaker": "...", "style": "..."} ke setiap part.
  2. Gunakan tag inline tanda kurung sudut hanya untuk peristiwa vokal pada satu titik waktu: Pertahankan vokalisasi non-ucapan dan jeda sesaat dalam transkrip menggunakan tanda kurung sudut (seperti <laugh>, <sigh>, <cough>, <breath>, atau <short pause>). Masukkan gaya penyampaian seperti berbisik dalam speech_metadata.style.
  3. Tentukan speaker di setiap giliran dalam permintaan multi-pembicara: Setiap giliran dalam permintaan multi-pembicara harus secara eksplisit menyertakan speaker di dalam speech_metadata yang cocok dengan salah satu pembicara yang dikonfigurasi.
  4. Desain persona di awal dengan Desain suara: Ganti blok Audio Profile / Director's Notes lama yang panjang dengan suara kustom yang dibuat di Desain suara, lalu bawa ID voice_... tersebut melalui permintaan TTS Anda dengan string style yang minimal atau kosong.
  5. Memperhitungkan output WAV default (audio/wav) pada permintaan unary: Tidak seperti model TTS gemini-3.1-flash-tts-preview dan yang lebih lama (yang menampilkan audio/l16 PCM mentah tanpa header secara default), Gemini 3.8 TTS menampilkan audio WAV (audio/wav / AUDIO_WAV) dengan header RIFF standar secara default untuk permintaan unary.
    • Jika kode Anda sebelumnya membungkus byte PCM mentah dalam header WAV (misalnya, menggunakan modul wave Python atau ffmpeg), hapus pembungkus header manual dan tulis byte yang ditampilkan langsung ke file .wav.
    • Jika pipeline Anda memerlukan audio PCM mentah tanpa header, mu-law, atau A-law, tetapkan response_format secara eksplisit ke "audio/l16" ("AUDIO_L16"), "audio/mulaw" ("AUDIO_MULAW"), atau "audio/alaw" ("AUDIO_ALAW"). Lihat Format output audio.

gemini-3.8-flash-lite-tts

Properti Deskripsi
Kode model gemini-3.8-flash-lite-tts
Jenis data yang didukung

Input

Teks

Output

Audio

Batas token[*]

Batas token input

8.192

Batas token output

16.384

Kemampuan

Pembuatan audio

Didukung

Caching

Didukung

Eksekusi kode

Tidak didukung

Penelusuran file

Tidak didukung

Pemanggilan fungsi

Tidak didukung

Grounding dengan Google Maps

Tidak didukung

Pembuatan gambar

Tidak didukung

Live API

Tidak didukung

Grounding penelusuran

Tidak didukung

Output terstruktur

Tidak didukung

Penalaran

Tidak didukung

Konteks URL

Tidak didukung

Opsi pemakaian

Batch API

Didukung

Inferensi fleksibel

Didukung

Inferensi prioritas

Didukung

Versi
Baca pola versi model untuk mengetahui detail selengkapnya.
  • gemini-3.8-flash-lite-tts
Pembaruan terbaru Juli 2026

Bahasa yang didukung

gemini-3.8-flash-lite-tts mendeteksi bahasa input secara otomatis dan mendukung 101 bahasa:

Language Language Language
Aceh (skrip Arab) Georgia Malta
Afrika Jerman Manipuri
Akan Yunani Marathi
Amharik Gujarat Minangkabau (skrip Arab)
Armenia Kreol Haiti Mizo
Assam Halh Mongolia Nepali (bahasa individu)
Awadhi Hausa Fulfulde Nigeria
Bali Ibrani Azerbaijan Utara
Bangla Hindi Sotho Utara
Banjar (skrip Latn) Hungaria Uzbek Utara
Basque Islandia Bokmål Norwegia
Belarusia Iloko Nynorsk Norwegia
Bhojpuri Indonesia Nyanja
Bosnia Persia Iran Odia (bahasa individu)
Bugis Italia Persia (Afganistan)
Bulgaria Jepang Polandia
Kanton Jawa Portugis
Katalan Kamba Punjabi
Cebuano Kannada Rumania
Kurdi Tengah Kashmir (skrip Arab) Rusia
Chhattisgarhi Kashmir (skrip Deva) Santali
China (skrip Hans) Kazak Serbia
China (skrip Hant) Khmer Sinhala
Kroasia Kikuyu Slovakia
Ceko Kinyarwanda Azerbaijan Selatan
Denmark Kongo Pashto Selatan
Belanda Korea Spanyol
Arab Mesir Kirgiz Arab Standar (skrip Arab)
Inggris Laos Arab Standar (skrip Latn)
Estonia Lingala Latvia Standar
Filipino Makedonia Melayu Standar
Prancis Magahi Tamil
Galisia Maithili Telugu
Ganda Malayalam