Transcription — 파일·실시간 전사 워크플로
Transcription — 파일·실시간 전사 워크플로
전사(Transcription)는 음성을 텍스트로 바꾸는 작업이에요. 오디오가 이미 녹음됐는지 실시간으로 오는지에 따라 워크플로를 고르면 돼요.
워크플로 선택
- 파일 전사(file transcription): 완료된 녹음·한정된 오디오 요청
- 실시간 전사(realtime transcription): 오디오가 실시간으로 도착
모델 선택
| 용도 | 권장 모델 |
|---|---|
| 화자 라벨 | gpt-4o-transcribe-diarize + 파일 전사 |
| 단어 타임스탬프·SRT/VTT 자막 | whisper-1 + 파일 전사 |
| 완료 녹음 영어 번역 | whisper-1 + translations |
| 입력 언어 감지 | gpt-transcribe + 파일 전사 |
| WebSocket 커밋 전사 | gpt-transcribe + 실시간 전사 |
컨텍스트 입력
prompt, keywords, languages를 넣어 오디오에 대한 문맥 힌트를 줄 수 있어요. 키워드는 필수가 아니라 힌트일 뿐이고, 오디오에 실제로 들릴 때만 결과에 포함돼요.