Gemini 3.5 Transcribe는 Gemini의 오디오 이해 기능을 기반으로 하는 음성 텍스트 변환 모델입니다. 발화 기반 언어 감지, 화자 분할, 단어 수준 타임스탬프, 스마트 스크립트, 맞춤 어휘 음성 편향을 통해 지연 시간이 짧고 정확한 스크립트를 제공합니다.
문서
Gemini 3.5 Transcribe는 오디오 파일의 음성을 텍스트로 변환합니다. 85개 이상의 언어를 자동으로 감지하고, 다국어 코드 전환을 처리하며, 개별 화자를 식별하고, 단어 수준 타임스탬프를 출력하며, 맞춤 어휘 바이어스를 통해 도메인별 용어에 적응합니다.
스트리밍되지 않는 기능에 관한 전체 내용은 오디오 텍스트 변환 가이드를 참고하세요. gemini-3.5-transcribe-live를 사용하여 WebSocket을 통해 지연 시간이 짧은 실시간 스트리밍 음성 자막 변환을 보려면 실시간 음성 자막 변환 가이드를 참고하세요. 자세한 가격은 가격 페이지를 참고하세요.
gemini-3.5-transcribe
| 속성 | 설명 |
|---|---|
| 모델 코드 | gemini-3.5-transcribe |
| 지원되는 데이터 유형 |
입력 오디오 (최대 1시간) 출력 텍스트, 단어 주석 |
| 오디오 한도 |
단항 오디오 한도 요청당 최대 1시간 (화자 분할 또는 단어 수준 타임스탬프가 사용 설정된 경우 최대 30분) |
| 기능 | 지원됨 지원됨 지원됨 지원됨 지원됨 지원되지 않음 지원되지 않음 지원되지 않음 지원되지 않음 지원되지 않음 지원되지 않음 |
| 소비 옵션 |
지원되지 않음 지원되지 않음 지원되지 않음 |
| 버전 |
|
| 최신 업데이트 | 2026년 8월 |
기능 지원 및 제한사항
Gemini 3.5 Transcribe는 두 엔드포인트에서 다음 기능을 지원합니다.
| 기능 | 라이브 스트리밍 (gemini-3.5-transcribe-live) |
오디오 파일 처리 (gemini-3.5-transcribe) |
참고 / 제한사항 |
|---|---|---|---|
| 언어 자동 감지 | 지원됨 (85개 이상의 언어) | 지원됨 (85개 이상의 언어) | 세션 중 코드 혼합이 포함됩니다. |
| 단어 수준 타임스탬프 | 지원되지 않음 | 지원됨 | 스크립트 작성 정확도가 저하됩니다. |
| 맞춤 어휘 바이어스 | 지원됨 (최대 1,000개 용어) | 지원됨 (최대 1,000개 용어) | 일반적으로 최대 100개의 검색어로 최상의 결과를 얻을 수 있습니다. |
| 스마트 받아쓰기 및 서식 지정 | 지원됨 | 지원됨 | 추임새 삭제 및 의도 인식 영숫자 서식 지정이 포함됩니다. |
| 화자 분할 | 지원되지 않음 | 지원됨 (최대 8개 스피커) | 3개 이상의 스피커에 대한 저작자 표시는 실험 단계에 있습니다. |
| 최대 오디오 길이 | 세션당 10분 | 최대 1시간 | 화자 분리 또는 타임스탬프와 같은 기능을 사용 설정하면 파일 처리가 30분으로 제한됩니다. |
지원 언어
Gemini 3.5 Transcribe에서 지원되는 언어와 BCP-47 언어 코드는 다음과 같습니다.
| 언어 | BCP-47 코드 | 언어 | BCP-47 코드 |
|---|---|---|---|
| 아프리칸스어 | af-ZA |
일본어 | ja-JP |
| 암하라어 | am-ET |
자바어 | jv-ID |
| 아랍어(이집트) | ar-EG |
Kabuverdianu | kea-CV |
| 아르메니아어 | hy-AM |
칸나다어 | kn-IN |
| 아삼어 | as-IN |
카자흐어 | kk-KZ |
| 아제르바이잔어 | az-AZ |
한국어 | ko-KR |
| 벨라루스어 | be-BY |
키르기스어 | ky-KG |
| 벵골어(방글라데시) | bn-BD |
라트비아어 | lv-LV |
| 벵골어(인도) | bn-IN |
링갈라어 | ln-CD |
| 보스니아어 | bs-BA |
리투아니아어 | lt-LT |
| 불가리아어 | bg-BG |
마케도니아어 | mk-MK |
| 불가리아어 (아로마어) | rup-BG |
말레이어 | ms-MY |
| 버마어 | my-MM |
말라얄람어 | ml-IN |
| 광둥어 (번체) | yue-Hant-HK |
몰타어 | mt-MT |
| 카탈로니아어 | ca-ES |
중국어 (간체) | cmn-Hans-CN |
| 세부아노어 | ceb |
마라타어 | mr-IN |
| 표준 크메르어 | km-KH |
몽골어 | mn-MN |
| 크로아티아어 | hr-HR |
네팔어 | ne-NP |
| 체코어 | cs-CZ |
노르웨이어 | nb-NO |
| 덴마크어 | da-DK |
오리야어 | or-IN |
| 네덜란드어 | nl-NL |
폴란드어 | pl-PL |
| 영어(영국) | en-GB |
포르투갈어(브라질) | pt-BR |
| 영어(인도) | en-IN |
포르투갈어(포르투갈) | pt-PT |
| 영어(미국) | en-US |
펀자브어 | pa-IN |
| 에스토니아어 | et-EE |
펀자브어 (구르무키 문자) | pa-Guru-IN |
| 페르시아어 | fa-IR |
루마니아어 | ro-RO |
| 필리핀어 | fil-PH |
러시아어 | ru-RU |
| 핀란드어 | fi-FI |
세르비아어 | sr-RS |
| 프랑스어 | fr-FR |
신디어 (아랍 문자) | sd-Arab-IN |
| 갈리시아어 | gl-ES |
슬로바키아어 | sk-SK |
| 조지아어 | ka-GE |
슬로베니아어 | sl-SI |
| 독일어 | de-DE |
스페인어(라틴 아메리카) | es-419 |
| 그리스어 | el-GR |
스페인어(미국) | es-US |
| 구자라트어 | gu-IN |
스와힐리어(케냐) | sw-KE |
| 하우사어 | ha-NG |
스웨덴어 | sv-SE |
| 히브리어 | he-IL |
타지크어 | tg-TJ |
| 힌디어 | hi-IN |
텔루구어 | te-IN |
| 헝가리어 | hu-HU |
태국어 | th-TH |
| 아이슬란드어 | is-IS |
튀르키예어 | tr-TR |
| 인도 영어 | en-IN |
우크라이나어 | uk-UA |
| 인도네시아어 | id-ID |
우즈베크어 | uz-UZ |
| 이탈리아어 | it-IT |
베트남어 | vi-VN |