TTS API — 엔드포인트와 파라미터
TTS API — 엔드포인트와 파라미터
ElevenLabs TTS API는 텍스트를 음성으로 변환하는 엔드포인트를 제공해요. 핵심은 음성 ID, 텍스트, 모델 ID, 출력 포맷을 지정하는 거예요.
핵심 파라미터
voice_id: 사용할 보이스(프리메이드 또는 커스텀)text: 합성할 텍스트model_id: 품질·지연 트레이드오프를 정하는 모델output_format:mp3_22050_32,pcm_16000,opus_48000_64등voice_settings: 안정성(stability)·유사도(similarity)·스타일·속도·스피커 부스트
스트리밍 엔드포인트
/v1/text-to-speech/{voice_id}/stream-input은 실시간 앱에 적합한 입력 스트리밍용이에요. 클라이언트가 텍스트 청크를 보내면 서버가 음성 청크를 되돌려줘요.
요점
- 신뢰할 수 있는 실시간 경험을 만들려면 스트리밍과 적절한 코덱(
pcm_16000,opus)을 고르세요. - 다양한 언어·코덱·지연 요구를 지원하니 용도에 맞는 모델·포맷을 선택하는 게 중요해요.