TTS API — 엔드포인트와 파라미터

TTS API — 엔드포인트와 파라미터

ElevenLabs TTS API는 텍스트를 음성으로 변환하는 엔드포인트를 제공해요. 핵심은 음성 ID, 텍스트, 모델 ID, 출력 포맷을 지정하는 거예요.

핵심 파라미터

  • voice_id: 사용할 보이스(프리메이드 또는 커스텀)
  • text: 합성할 텍스트
  • model_id: 품질·지연 트레이드오프를 정하는 모델
  • output_format: mp3_22050_32, pcm_16000, opus_48000_64
  • voice_settings: 안정성(stability)·유사도(similarity)·스타일·속도·스피커 부스트

스트리밍 엔드포인트

/v1/text-to-speech/{voice_id}/stream-input은 실시간 앱에 적합한 입력 스트리밍용이에요. 클라이언트가 텍스트 청크를 보내면 서버가 음성 청크를 되돌려줘요.

요점

  • 신뢰할 수 있는 실시간 경험을 만들려면 스트리밍과 적절한 코덱(pcm_16000, opus)을 고르세요.
  • 다양한 언어·코덱·지연 요구를 지원하니 용도에 맞는 모델·포맷을 선택하는 게 중요해요.

더 알아보기