Deepgram 라이브 스트리밍 전사
Deepgram 라이브 스트리밍 전사
실시간으로 흐르는 오디오를 음성 인식으로 바로 전사하고 싶을 때, Deepgram의 SDK를 쓰면 편하게 시작할 수 있어요. 여기서는 라이브 스트리밍 오디오를 SDK로 전사하는 기본 흐름을 볼게요.
이 가이드에서는 Deepgram SDK를 사용해 실시간으로 스트리밍 오디오를 전사하는 법을 배워요. 시작 전에 'Make Your First API Request' 가이드를 따라 Deepgram API 키를 얻고, SDK를 쓸 거라면 환경을 구성해야 해요.
먼저 SDK를 설치해요. 언어별로 설치 명령이 달라요.
# Install the Deepgram Python SDK
# https://github.com/deepgram/deepgram-python-sdk
# pip install deepgram-sdk
// Install the Deepgram JS SDK
// https://github.com/deepgram/deepgram-js-sdk
// npm install @deepgram/sdk
// Install the Deepgram Go SDK
// https://github.com/deepgram/deepgram-go-sdk
// go get github.com/deepgram/deepgram-go-sdk
좀 더 구체적으로 파이썬 쪽을 볼게요. HTTP 요청을 위해 httpx도 설치하고, 원격 오디오 스트림을 전사하는 코드를 짜 봐요.
# pip install httpx
원격 스트림 전사 예시(자바스크립트 기준)를 살펴보면, DeepgramClient를 만들고 실시간 오디오 스트림 URL을 대상으로 전사를 시작하는 구조예요. 전사 결과는 스트림이 진행되는 동안 실시간으로 도착해요.
스트리밍 전사는 회의, 콜센터, 방송 캡션처럼 '오디오가 흐르는 동안' 결과를 내야 하는 상황에 어울려요. SDK가 전사를 추상화해 주므로, 직접 WebSocket을 열어 바이너리 오디오를 관리할 필요가 없어요.