Gemini 3.5 Transcribe est un modèle de reconnaissance vocale basé sur les capacités de compréhension audio de Gemini. Il fournit une transcription précise et à faible latence avec détection de la langue basée sur les énoncés, identification du locuteur, codes temporels au niveau du mot, transcription intelligente et pondération vocale avec vocabulaire personnalisé.
Documentation
Gemini 3.5 Transcribe convertit la parole en texte à partir de fichiers audio. Il détecte automatiquement plus de 85 langues, gère le changement de code multilingue, identifie les locuteurs individuels, génère des codes temporels au niveau des mots et s'adapte aux termes spécifiques à un domaine grâce au biais de vocabulaire personnalisé.
Consultez le guide Transcription audio pour en savoir plus sur les fonctionnalités non liées au streaming. Pour la transcription en temps réel à faible latence via WebSockets, consultez le guide Transcription instantanée à l'aide de gemini-3.5-transcribe-live. Pour en savoir plus sur les tarifs, consultez la page des tarifs.
gemini-3.5-transcribe
| Propriété | Description |
|---|---|
| Code du modèle | gemini-3.5-transcribe |
| Types de données acceptés pour |
Entrées Audio (jusqu'à une heure) Résultat Annotations de texte et de mots |
| Limites audio |
Limite audio unaire Jusqu'à 1 heure par requête (jusqu'à 30 minutes lorsque l'identification du locuteur ou les codes temporels au niveau du mot sont activés) |
| Fonctionnalités | Compatible Compatible Codes temporels au niveau du mot Compatible Compatible Compatible Not supported Not supported Not supported Not supported Not supported Not supported |
| Options de consommation |
Not supported Not supported Not supported |
| Versions |
|
| Dernière mise à jour | Août 2026 |
Compatibilité des fonctionnalités et limites
Gemini 3.5 Transcribe est compatible avec les fonctionnalités suivantes sur ses deux points de terminaison :
| Fonctionnalité | Streaming en direct (gemini-3.5-transcribe-live) |
Traitement des fichiers audio (gemini-3.5-transcribe) |
Remarques / Limites |
|---|---|---|---|
| Détection automatique de la langue | Prise en charge (plus de 85 langues) | Prise en charge (plus de 85 langues) | Inclut le mélange de codes en cours de session. |
| Codes temporels au niveau du mot | Non compatible | Compatible | Dégrade la précision de la transcription. |
| Pondération personnalisée du vocabulaire | Accepté (jusqu'à 1 000 termes) | Accepté (jusqu'à 1 000 termes) | Les clients obtiennent généralement les meilleurs résultats avec un maximum de 100 termes. |
| Dictée et mise en forme intelligentes | Compatible | Compatible | Inclut la suppression des mots de remplissage et la mise en forme alphanumérique en fonction de l'intention. |
| Identification du locuteur | Non compatible | Pris en charge (jusqu'à huit enceintes) | L'attribution pour trois enceintes ou plus est expérimentale. |
| Durée audio max. | 10 minutes par session. | Jusqu'à une heure | Le traitement des fichiers est limité à 30 minutes lorsque des fonctionnalités telles que la diarisation ou les codes temporels sont activées. |
Langues disponibles
Les langues et les codes de langue BCP-47 suivants sont compatibles avec Gemini 3.5 Transcribe :
| Langue | Code BCP-47 | Langue | Code BCP-47 |
|---|---|---|---|
| Afrikaans | af-ZA |
Japonais | ja-JP |
| Amharique | am-ET |
Javanais | jv-ID |
| Arabe (Égypte) | ar-EG |
Kabuverdianu | kea-CV |
| Arménien | hy-AM |
Kannada | kn-IN |
| Assamais | as-IN |
Kazakh | kk-KZ |
| Azéri | az-AZ |
Coréen | ko-KR |
| Biélorusse | be-BY |
Kirghiz | ky-KG |
| Bengali (Bangladesh) | bn-BD |
Letton | lv-LV |
| Bengali (Inde) | bn-IN |
Lingala | ln-CD |
| Bosniaque | bs-BA |
Lituanien | lt-LT |
| Bulgare | bg-BG |
Macédonien | mk-MK |
| Bulgare (aroumain) | rup-BG |
Malaisien | ms-MY |
| Birman | my-MM |
Malayalam | ml-IN |
| Cantonais (traditionnel) | yue-Hant-HK |
Maltais | mt-MT |
| Catalan | ca-ES |
Chinois mandarin (simplifié) | cmn-Hans-CN |
| Cebuano | ceb |
Marathi | mr-IN |
| Khmer central | km-KH |
Mongol | mn-MN |
| Croate | hr-HR |
Népalais | ne-NP |
| Tchèque | cs-CZ |
Norvégien | nb-NO |
| Danois | da-DK |
Oriya | or-IN |
| Néerlandais | nl-NL |
Polonais | pl-PL |
| Anglais (Grande-Bretagne) | en-GB |
Portugais (Brésil) | pt-BR |
| Anglais (Inde) | en-IN |
Portugais (Portugal) | pt-PT |
| Anglais (États-Unis) | en-US |
Panjabi | pa-IN |
| Estonien | et-EE |
Panjabi (écriture gurmukhī) | pa-Guru-IN |
| Farsi | fa-IR |
Roumain | ro-RO |
| Tagalog | fil-PH |
Russe | ru-RU |
| Finnois | fi-FI |
Serbe | sr-RS |
| Français | fr-FR |
Sindhi (écriture arabe) | sd-Arab-IN |
| Galicien | gl-ES |
Slovaque | sk-SK |
| Géorgien | ka-GE |
Slovène | sl-SI |
| Allemand | de-DE |
Espagnol (Amérique latine) | es-419 |
| Grec | el-GR |
Espagnol (États-Unis) | es-US |
| Gujarati | gu-IN |
Swahili (Kenya) | sw-KE |
| Haoussa | ha-NG |
Suédois | sv-SE |
| Hébreu | he-IL |
Tadjik | tg-TJ |
| Hindi | hi-IN |
Telugu | te-IN |
| Hongrois | hu-HU |
Thaï | th-TH |
| Islandais | is-IS |
Turc | tr-TR |
| Anglais (Inde) | en-IN |
Ukrainien | uk-UA |
| Indonésien | id-ID |
Ouzbek | uz-UZ |
| Italien | it-IT |
Vietnamien | vi-VN |