Gemini 3.5 Transcribe ist ein Speech-to-Text-Modell, das auf den Audioverständnisfunktionen von Gemini basiert. Sie bietet eine genaue Transkription mit niedriger Latenz, Äußerungsbasierte Spracherkennung, Sprecherbestimmung, Zeitstempel auf Wortebene, Smart Transcription und Sprachgewichtung mit benutzerdefiniertem Vokabular.
Dokumentation
Mit Gemini 3.5 Transcribe wird Sprache aus Audiodateien in Text umgewandelt. Sie erkennt automatisch über 85 Sprachen, kann mit Sprachwechseln umgehen, einzelne Sprecher identifizieren, Zeitstempel auf Wortebene ausgeben und sich durch benutzerdefiniertes Vokabular an domänenspezifische Begriffe anpassen.
Eine vollständige Beschreibung der Funktionen, die nicht für Streaming verfügbar sind, finden Sie im Leitfaden zur Audiotranskription. Informationen zur Echtzeit-Transkription von Streams mit niedriger Latenz über WebSockets finden Sie im Leitfaden Automatische Transkription mit gemini-3.5-transcribe-live. Ausführliche Informationen zu den Preisen finden Sie auf der Preisseite.
gemini-3.5-transcribe
| Attribut | Beschreibung |
|---|---|
| Modellcode | gemini-3.5-transcribe |
| Unterstützte Datentypen |
Eingaben Audio (bis zu 1 Stunde) Ausgabe Text-, Wortanmerkungen |
| Audio-Limits |
Unäres Audio-Limit Bis zu 1 Stunde pro Anfrage (bis zu 30 Minuten, wenn Sprecherbestimmung oder Zeitstempel auf Wortebene aktiviert sind) |
| Funktionen | Unterstützt Unterstützt Unterstützt Unterstützt Unterstützt Nicht unterstützt Nicht unterstützt Nicht unterstützt Nicht unterstützt Nicht unterstützt Nicht unterstützt |
| Nutzungsoptionen |
Nicht unterstützt Nicht unterstützt Nicht unterstützt |
| -Versionen |
|
| Letzte Aktualisierung | August 2026 |
Funktionsunterstützung und Einschränkungen
Gemini 3.5 Transcribe unterstützt die folgenden Funktionen für die beiden Endpunkte:
| Funktion | Livestreaming (gemini-3.5-transcribe-live) |
Verarbeitung von Audiodateien (gemini-3.5-transcribe) |
Hinweise / Einschränkungen |
|---|---|---|---|
| Automatische Spracherkennung | Unterstützt (über 85 Sprachen) | Unterstützt (über 85 Sprachen) | Umfasst das Mischen von Code während der Sitzung. |
| Zeitstempel auf Wortebene | Nicht unterstützt | Unterstützt | Die Transkriptionsgenauigkeit wird beeinträchtigt. |
| Custom Vocabulary Biasing | Unterstützt (bis zu 1.000 Begriffe) | Unterstützt (bis zu 1.000 Begriffe) | In der Regel erzielen Kunden mit bis zu 100 Begriffen die besten Ergebnisse. |
| Intelligente Spracheingabe und Formatierung | Unterstützt | Unterstützt | Umfasst das Entfernen von Füllwörtern und die absichtsbezogene alphanumerische Formatierung. |
| Sprecherbestimmung | Nicht unterstützt | Unterstützt (bis zu 8 Lautsprecher) | Die Zuordnung für mindestens drei Lautsprecher befindet sich in der Testphase. |
| Maximale Audiodauer | 10 Minuten pro Sitzung. | Bis zu 1 Stunde | Die Dateiverarbeitung ist auf 30 Minuten begrenzt, wenn Funktionen wie die Sprecherzuordnung oder Zeitstempel aktiviert sind. |
Unterstützte Sprachen
Die folgenden Sprachen und BCP-47-Sprachcodes werden für Gemini 3.5 Transcribe unterstützt:
| Sprache | BCP-47-Code | Sprache | BCP-47-Code |
|---|---|---|---|
| Afrikaans | af-ZA |
Japanisch | ja-JP |
| Amharisch | am-ET |
Javanisch | jv-ID |
| Arabisch (Ägypten) | ar-EG |
Kabuverdianu | kea-CV |
| Armenisch | hy-AM |
Kannada | kn-IN |
| Assamesisch | as-IN |
Kasachisch | kk-KZ |
| Aserbaidschanisch | az-AZ |
Koreanisch | ko-KR |
| Belarussisch | be-BY |
Kirgisisch | ky-KG |
| Bengalisch (Bangladesch) | bn-BD |
Lettisch | lv-LV |
| Bengalisch (Indien) | bn-IN |
Lingala | ln-CD |
| Bosnisch | bs-BA |
Litauisch | lt-LT |
| Bulgarisch | bg-BG |
Mazedonisch | mk-MK |
| Bulgarisch (Aromanisch) | rup-BG |
Malaiisch | ms-MY |
| Burmesisch | my-MM |
Malayalam | ml-IN |
| Kantonesisch (traditionell) | yue-Hant-HK |
Maltesisch | mt-MT |
| Katalanisch | ca-ES |
Chinesisch (Mandarin, vereinfacht) | cmn-Hans-CN |
| Cebuano | ceb |
Marathi | mr-IN |
| Standard-Khmer | km-KH |
Mongolisch | mn-MN |
| Kroatisch | hr-HR |
Nepalesisch | ne-NP |
| Tschechien | cs-CZ |
Norwegisch | nb-NO |
| Dänisch | da-DK |
Oriya | or-IN |
| Niederländisch | nl-NL |
Polnisch | pl-PL |
| Englisch (Vereinigtes Königreich) | en-GB |
Portugiesisch (Brasilien) | pt-BR |
| Englisch (Indien) | en-IN |
Portugiesisch (Portugal) | pt-PT |
| Englisch (USA) | en-US |
Punjabi | pa-IN |
| Estnisch | et-EE |
Panjabi (Gurmukhi-Schrift) | pa-Guru-IN |
| Farsi | fa-IR |
Rumänisch | ro-RO |
| Filipino | fil-PH |
Russisch | ru-RU |
| Finnisch | fi-FI |
Serbisch | sr-RS |
| Französisch | fr-FR |
Sindhi (arabische Schrift) | sd-Arab-IN |
| Galizisch | gl-ES |
Slowakisch | sk-SK |
| Georgisch | ka-GE |
Slowenisch | sl-SI |
| Deutsch | de-DE |
Spanisch (Lateinamerika) | es-419 |
| Griechisch | el-GR |
Spanisch (USA) | es-US |
| Gujarati | gu-IN |
Swahili (Kenia) | sw-KE |
| Hausa | ha-NG |
Schwedisch | sv-SE |
| Hebräisch | he-IL |
Tadschikisch | tg-TJ |
| Hindi | hi-IN |
Telugu | te-IN |
| Ungarisch | hu-HU |
Thailändisch | th-TH |
| Isländisch | is-IS |
Türkisch | tr-TR |
| Indisches Englisch | en-IN |
Ukrainisch | uk-UA |
| Indonesisch | id-ID |
Usbekisch | uz-UZ |
| Italienisch | it-IT |
Vietnamesisch | vi-VN |