OpenAiTranscribeAudio
OpenAiTranscribeAudio
오디오 데이터를 영어 텍스트로 변환(전사)하는 프로세서예요. OpenAI의 음성-텍스트 기능을 활용해요.
본문
번들 (Bundle)
com.snowflake.openflow.runtime | runtime-openai-nar
설명
오디오를 영어 텍스트로 전사해요. 오디오 데이터는 다음 형식 중 하나여야 해요: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm
태그
audio, flac, m4a, mp3, mp4, mpeg, mpga, ogg, openai, openflow, speech-to-text, text, transcribe, translate, wav, webm
입력 요구 사항 (Input Requirement)
REQUIRED — 입력 FlowFile이 필요해요.
민감한 동적 속성 지원 (Supports Sensitive Dynamic Properties)
false — 지원하지 않아요.
속성 (Properties)
| 속성 | 설명 |
|---|---|
| Model Name | 사용할 OpenAI 모델의 이름이에요. |
| OpenAI API Key | OpenAI와 상호작용하기 위한 API Key예요. |
| Prompt | 모델의 스타일을 안내하거나 이전 오디오 구간을 이어가도록 하는 텍스트예요. 텍스트는 영어여야 해요. |
| Response Format | 출력에 원하는 형식을 지정해요. |
| Temperature | 사용할 샘플링 온도예요. 0.0과 1.0 사이의 부동소수점 값이어야 해요. 0.8 같은 높은 값은 해석적 번역에 가깝고, 0.0 값은 더 직역에 가까워요. |
관계 (Relationships)
| 이름 | 설명 |
|---|---|
failure |
전사에 실패한 FlowFile이 이 관계로 라우팅돼요. |
success |
성공적으로 전사된 FlowFile이 이 관계로 전달돼요. |
다른 구성 요소와 함께 쓰는 사용 사례
오디오 데이터에 대한 임베딩을 만들어 Pinecone에 삽입하면, OpenAI의 GPT 모델 같은 대규모 언어 모델(LLM)이 해당 오디오를 활용할 수 있어요.