OpenAiTranscribeAudio

OpenAiTranscribeAudio

오디오 데이터를 영어 텍스트로 변환(전사)하는 프로세서예요. OpenAI의 음성-텍스트 기능을 활용해요.

출처: Snowflake 문서 — OpenAiTranscribeAudio

본문

번들 (Bundle)

com.snowflake.openflow.runtime | runtime-openai-nar

설명

오디오를 영어 텍스트로 전사해요. 오디오 데이터는 다음 형식 중 하나여야 해요: flac, mp3, mp4, mpeg, mpga, m4a, ogg, wav, webm

태그

audio, flac, m4a, mp3, mp4, mpeg, mpga, ogg, openai, openflow, speech-to-text, text, transcribe, translate, wav, webm

입력 요구 사항 (Input Requirement)

REQUIRED — 입력 FlowFile이 필요해요.

민감한 동적 속성 지원 (Supports Sensitive Dynamic Properties)

false — 지원하지 않아요.

속성 (Properties)

속성 설명
Model Name 사용할 OpenAI 모델의 이름이에요.
OpenAI API Key OpenAI와 상호작용하기 위한 API Key예요.
Prompt 모델의 스타일을 안내하거나 이전 오디오 구간을 이어가도록 하는 텍스트예요. 텍스트는 영어여야 해요.
Response Format 출력에 원하는 형식을 지정해요.
Temperature 사용할 샘플링 온도예요. 0.0과 1.0 사이의 부동소수점 값이어야 해요. 0.8 같은 높은 값은 해석적 번역에 가깝고, 0.0 값은 더 직역에 가까워요.

관계 (Relationships)

이름 설명
failure 전사에 실패한 FlowFile이 이 관계로 라우팅돼요.
success 성공적으로 전사된 FlowFile이 이 관계로 전달돼요.

다른 구성 요소와 함께 쓰는 사용 사례

오디오 데이터에 대한 임베딩을 만들어 Pinecone에 삽입하면, OpenAI의 GPT 모델 같은 대규모 언어 모델(LLM)이 해당 오디오를 활용할 수 있어요.

더 알아보기 (Learn more)