Azure Text to Speech

Azure Text to Speech (tts)

Azure OpenAI의 Text to Speech 모델로 텍스트를 자연스러운 음성으로 변환해요. LiteLLM의 azure/ 라우트로 /audio/speech 작업을 제공해요.

출처: 문서

본문

개요 (Overview)

속성 설명
설명 Azure OpenAI의 Text to Speech 모델로 텍스트를 자연스러운 음성으로 변환
LiteLLM 라우트 azure/
지원 작업 /audio/speech
공급자 문서 Azure OpenAI TTS

빠른 시작 (Quick Start)

LiteLLM SDK:

from litellm import speech
from pathlib import Path
import os

## set ENV variables
os.environ["AZURE_API_KEY"] = ""
os.environ["AZURE_API_BASE"] = ""
os.environ["AZURE_API_VERSION"] = ""

# azure call
speech_file_path = Path(__file__).parent / "speech.mp3"

response = speech(
    model="azure/<your-deployment-name>",
    voice="alloy",
    input="the quick brown fox jumped over the lazy dogs",
)

response.stream_to_file(speech_file_path)

LiteLLM Proxy (proxy_config.yaml):

model_list:
  - model_name: azure/tts-1
    litellm_params:
      model: azure/tts-1
      api_base: "os.environ/AZURE_API_BASE_TTS"
      api_key: "os.environ/AZURE_API_KEY_TTS"
      api_version: "os.environ/AZURE_API_VERSION"

사용 가능한 음성 (Available Voices)

Azure OpenAI는 다음 음성을 지원해요:

  • alloy - 중립적이고 균형 잡힘
  • echo - 따뜻하고 활기참
  • fable - 표현력 있고 극적임
  • onyx - 깊고 권위 있음
  • nova - 친근하고 대화적
  • shimmer - 밝고 쾌활함

지원 파라미터 (Supported Parameters)

response = speech(
    model="azure/<your-deployment-name>",
    voice="alloy",             # Required: Voice selection
    input="text to convert",   # Required: Input text
    speed=1.0,                 # Optional: 0.25 to 4.0 (default: 1.0)
    response_format="mp3"      # Optional: mp3, opus, aac, flac, wav, pcm
)

더 알아보기 (Learn more)