Gemini 3.5 Transcribe

Gemini 3.5 Transcribe

Gemini 3.5 Transcribe는 Gemini의 오디오 이해 능력을 기반으로 한 음성-텍스트(speech-to-text) 모델이에요. 발화 기반 언어 감지, 화자 분리(diarization), 단어 수준 타임스탬프, Smart transcription, 커스텀 어휘 음성 바이어싱을 갖춘 저지연·정확한 전사를 제공해요. Google AI Studio에서 사용해 볼 수 있어요.

출처: 원문

본문

문서(Documentation)

Gemini 3.5 Transcribe는 오디오 파일의 음성을 텍스트로 변환해요. 85개 이상의 언어를 자동 감지하고, 다중 언어 코드 스위칭을 처리하며, 개별 화자를 식별하고, 단어 수준 타임스탬프를 출력하며, 커스텀 어휘 바이어싱을 통해 도메인 특화 용어에 적응해요.

비스트리밍 기능의 전체 내용은 오디오 전사 가이드를 참고하세요. WebSocket을 통한 실시간 저지연 스트리밍 전사는 gemini-3.5-transcribe-live를 사용하는 라이브 전사 가이드를 참고하세요. 상세 요금은 Pricing 페이지를 참고하세요.

gemini-3.5-transcribe

속성 설명
모델 코드 gemini-3.5-transcribe
지원 데이터 유형 입력 — 오디오(최대 1시간) / 출력 — 텍스트, 단어 주석
오디오 한도 Unary 오디오 한도 — 요청당 최대 1시간(화자 분리 또는 단어 수준 타임스탬프 활성화 시 최대 30분)
기능 오디오 전사 지원 / 화자 분리 지원 / 단어 수준 타임스탬프 지원 / 커스텀 어휘 지원 / Smart transcription 지원 / Caching 미지원 / 코드 실행 미지원 / 파일 검색 미지원 / 함수 호출 미지원 / 이미지 생성 미지원 / Thinking 미지원
소비 옵션 Batch API 미지원 / Flex inference 미지원 / Priority inference 미지원
버전 자세한 내용은 모델 버전 패턴을 참고하세요. gemini-3.5-transcribe(Unary), gemini-3.5-transcribe-live(Live API)
최신 업데이트 2026년 8월

기능 지원 및 제한 사항

Gemini 3.5 Transcribe는 두 엔드포인트에서 다음 기능을 지원해요:

기능 라이브 스트리밍 (gemini-3.5-transcribe-live) 오디오 파일 처리 (gemini-3.5-transcribe) 참고 / 제한 사항
언어 자동 감지 지원 (85개 이상 언어) 지원 (85개 이상 언어) 세션 중 코드 혼합 포함.
단어 수준 타임스탬프 미지원 지원 전사 정확도를 낮춤. 커스텀 어휘와 호환되지 않음.
커스텀 어휘 바이어싱 지원 (최대 1,000개 용어) 지원 (최대 1,000개 용어) 고객은 보통 최대 100개 용어에서 최상의 결과를 봄. 분리 및 타임스탬프와 호환되지 않음.
Smart 받아쓰기 및 서식 지원 지원 필러 단어 제거와 의도 인식 영숫자 서식 포함.
화자 분리 미지원 지원 (최대 8명 화자) 3명 이상 화자 귀속은 실험적. 커스텀 어휘와 호환되지 않음.
최대 오디오 길이 세션당 10분. 최대 1시간 분리 또는 타임스탬프 같은 기능 활성화 시 파일 처리는 30분으로 제한됨.

지원 언어

Gemini 3.5 Transcribe에서 지원되는 언어와 BCP-47 언어 코드는 다음과 같아요:

언어 BCP-47 코드 언어 BCP-47 코드
Afrikaans af-ZA Japanese ja-JP
Amharic am-ET Javanese jv-ID
Arabic (Egypt) ar-EG Kabuverdianu kea-CV
Armenian hy-AM Kannada kn-IN
Assamese as-IN Kazakh kk-KZ
Azerbaijani az-AZ Korean ko-KR
Belarusian be-BY Kyrgyz ky-KG
Bengali (Bangladesh) bn-BD Latvian lv-LV
Bengali (India) bn-IN Lingala ln-CD
Bosnian bs-BA Lithuanian lt-LT
Bulgarian bg-BG Macedonian mk-MK
Bulgarian (Aromanian) rup-BG Malay ms-MY
Burmese my-MM Malayalam ml-IN
Cantonese (Traditional) yue-Hant-HK Maltese mt-MT
Catalan ca-ES Mandarin Chinese (Simplified) cmn-Hans-CN
Cebuano ceb Marathi mr-IN
Central Khmer km-KH Mongolian mn-MN
Croatian hr-HR Nepali ne-NP
Czech cs-CZ Norwegian nb-NO
Danish da-DK Oriya or-IN
Dutch nl-NL Polish pl-PL
English (Great Britain) en-GB Portuguese (Brazil) pt-BR
English (India) en-IN Portuguese (Portugal) pt-PT
English (United States) en-US Punjabi pa-IN
Estonian et-EE Punjabi (Gurmukhi script) pa-Guru-IN
Farsi fa-IR Romanian ro-RO
Filipino fil-PH Russian ru-RU
Finnish fi-FI Serbian sr-RS
French fr-FR Sindhi (Arabic script) sd-Arab-IN
Galician gl-ES Slovak sk-SK
Georgian ka-GE Slovenian sl-SI
German de-DE Spanish (Latin America) es-419
Greek el-GR Spanish (United States) es-US
Gujarati gu-IN Swahili (Kenya) sw-KE
Hausa ha-NG Swedish sv-SE
Hebrew he-IL Tajik tg-TJ
Hindi hi-IN Telugu te-IN
Hungarian hu-HU Thai th-TH
Icelandic is-IS Turkish tr-TR
Indian English en-IN Ukrainian uk-UA
Indonesian id-ID Uzbek uz-UZ
Italian it-IT Vietnamese vi-VN

더 알아보기 (Learn more)