Transcription — 파일·실시간 전사 워크플로

Transcription — 파일·실시간 전사 워크플로

전사(Transcription)는 음성을 텍스트로 바꾸는 작업이에요. 오디오가 이미 녹음됐는지 실시간으로 오는지에 따라 워크플로를 고르면 돼요.

워크플로 선택

  • 파일 전사(file transcription): 완료된 녹음·한정된 오디오 요청
  • 실시간 전사(realtime transcription): 오디오가 실시간으로 도착

모델 선택

용도 권장 모델
화자 라벨 gpt-4o-transcribe-diarize + 파일 전사
단어 타임스탬프·SRT/VTT 자막 whisper-1 + 파일 전사
완료 녹음 영어 번역 whisper-1 + translations
입력 언어 감지 gpt-transcribe + 파일 전사
WebSocket 커밋 전사 gpt-transcribe + 실시간 전사

컨텍스트 입력

prompt, keywords, languages를 넣어 오디오에 대한 문맥 힌트를 줄 수 있어요. 키워드는 필수가 아니라 힌트일 뿐이고, 오디오에 실제로 들릴 때만 결과에 포함돼요.

더 알아보기