Gemini 3.5 Transcribe è un modello di sintesi vocale basato sulle funzionalità di comprensione audio di Gemini. Fornisce una trascrizione accurata e a bassa latenza con rilevamento della lingua basato sulle espressioni, diarizzazione degli interlocutori, timestamp a livello di parola, trascrizione intelligente e differenziazione del parlato del vocabolario personalizzato.
Documentazione
Gemini 3.5 Transcribe converte la voce in testo dai file audio. Rileva automaticamente più di 85 lingue, gestisce il cambio di codice multilingue, identifica i singoli oratori, genera timestamp a livello di parola e si adatta a termini specifici del dominio tramite la ponderazione del vocabolario personalizzato.
Consulta la guida alla trascrizione audio per una copertura completa delle funzionalità non di streaming. Per la trascrizione in tempo reale e a bassa latenza dello streaming tramite WebSockets, consulta la guida alla trascrizione in tempo reale utilizzando gemini-3.5-transcribe-live. Per informazioni dettagliate sui prezzi, consulta la pagina dei prezzi.
gemini-3.5-transcribe
| Proprietà | Descrizione |
|---|---|
| Codice modello | gemini-3.5-transcribe |
| Tipi di dati supportati |
Input Audio (fino a 1 ora) Output Testo, annotazioni di parole |
| Limiti audio |
Limite audio unario Fino a 1 ora per richiesta (fino a 30 minuti quando sono attivi la diarizzazione dello speaker o i timestamp a livello di parola) |
| Funzionalità | Supportato Supportato Supportato Supportato Supportato Non supportato Non supportato Non supportato Non supportato Non supportato Non supportato |
| Opzioni di consumo |
Non supportato Non supportato Non supportato |
| Versioni |
|
| Ultimo aggiornamento | Agosto 2026 |
Supporto e limitazioni delle funzionalità
Gemini 3.5 Transcribe supporta le seguenti funzionalità nei suoi due endpoint:
| Funzionalità | Live streaming (gemini-3.5-transcribe-live) |
Elaborazione dei file audio (gemini-3.5-transcribe) |
Note / limitazioni |
|---|---|---|---|
| Rilevamento automatico della lingua | Supportate (oltre 85 lingue) | Supportate (oltre 85 lingue) | Include il code-mixing a metà sessione. |
| Timestamp a livello di parola | Non supportata | Supportato | Riduce l'accuratezza della trascrizione. |
| Bias del vocabolario personalizzato | Supportato (fino a 1000 termini) | Supportato (fino a 1000 termini) | In genere, i clienti ottengono risultati migliori con un massimo di 100 termini. |
| Dettatura e formattazione intelligenti | Supportato | Supportato | Include la rimozione degli intercalari e la formattazione alfanumerica in base all'intent. |
| Speaker Diarization | Non supportata | Supportato (fino a 8 speaker) | L'attribuzione per 3 o più speaker è sperimentale. |
| Durata audio massima | 10 minuti per sessione. | Massimo 1 ora | L'elaborazione dei file è limitata a 30 minuti quando sono attivate funzionalità come la diarizzazione o i timestamp. |
Lingue supportate
Le seguenti lingue e i seguenti codici lingua BCP-47 sono supportati per Gemini 3.5 Transcribe:
| Lingua | Codice BCP-47 | Lingua | Codice BCP-47 |
|---|---|---|---|
| Afrikaans | af-ZA |
Giapponese | ja-JP |
| Amarico | am-ET |
Giavanese | jv-ID |
| Arabo (Egitto) | ar-EG |
Kabuverdianu | kea-CV |
| Armeno | hy-AM |
Kannada | kn-IN |
| Assamese | as-IN |
Kazako | kk-KZ |
| Azero | az-AZ |
Coreano | ko-KR |
| Bielorusso | be-BY |
Kirgizo | ky-KG |
| Bengalese (Bangladesh) | bn-BD |
Lettone | lv-LV |
| Bengalese (India) | bn-IN |
Lingala | ln-CD |
| Bosniaco | bs-BA |
Lituano | lt-LT |
| Bulgaro | bg-BG |
Macedone | mk-MK |
| Bulgaro (aromeno) | rup-BG |
Malese | ms-MY |
| Birmano | my-MM |
Malayalam | ml-IN |
| Cantonese (tradizionale) | yue-Hant-HK |
Maltese | mt-MT |
| Catalano | ca-ES |
Cinese mandarino (semplificato) | cmn-Hans-CN |
| Cebuano | ceb |
Marathi | mr-IN |
| Khmer centrale | km-KH |
Mongolo | mn-MN |
| Croato | hr-HR |
Nepalese | ne-NP |
| Ceco | cs-CZ |
Norvegese | nb-NO |
| Danese | da-DK |
Oriya | or-IN |
| Olandese | nl-NL |
Polacco | pl-PL |
| Inglese (Gran Bretagna) | en-GB |
Portoghese (Brasile) | pt-BR |
| Inglese (India) | en-IN |
Portoghese (Portogallo) | pt-PT |
| Inglese (Stati Uniti) | en-US |
Punjabi | pa-IN |
| Estone | et-EE |
Punjabi (Gurmukhi script) | pa-Guru-IN |
| Farsi | fa-IR |
Rumeno | ro-RO |
| Filippino | fil-PH |
Russo | ru-RU |
| Finlandese | fi-FI |
Serbo | sr-RS |
| Francese | fr-FR |
Sindhi (alfabeto arabo) | sd-Arab-IN |
| Galiziano | gl-ES |
Slovacco | sk-SK |
| Georgiano | ka-GE |
Sloveno | sl-SI |
| Tedesco | de-DE |
Spagnolo (America Latina) | es-419 |
| Greek | el-GR |
Spagnolo (Stati Uniti) | es-US |
| Gujarati | gu-IN |
Swahili (Kenya) | sw-KE |
| Hausa | ha-NG |
Svedese | sv-SE |
| Ebraico | he-IL |
Tagico | tg-TJ |
| Hindi | hi-IN |
Telugu | te-IN |
| Ungherese | hu-HU |
Thailandese | th-TH |
| Islandese | is-IS |
Turco | tr-TR |
| Inglese indiano | en-IN |
Ucraino | uk-UA |
| Indonesiano | id-ID |
Uzbeco | uz-UZ |
| Italiano | it-IT |
Vietnamita | vi-VN |