텍스트-음성(TTS) — 파일·스트리밍 생성
텍스트-음성(TTS) — 파일·스트리밍 생성
ElevenLabs TTS로 텍스트를 음성으로 만들 수 있어요. 결과를 파일로 저장하거나, 지연 시간이 짧은 스트리밍 방식으로 바로 재생할 수도 있어요.
파일로 생성
import elevenlabs
from elevenlabs import VoiceSettings
response = elevenlabs.text_to_speech.convert(
voice_id="pNInz6obpgDQGcFmaJgB", # Adam 프리메이드 보이스
output_format="mp3_22050_32",
text=text,
model_id="eleven_flash_v2_5",
voice_settings=VoiceSettings(
stability=0.0, similarity_boost=1.0,
style=0.0, use_speaker_boost=True, speed=1.0,
),
)
스트리밍
text_to_speech.stream(...)으로 오디오 청크를 즉시 받아 실시간 재생에 쓸 수 있어요. 보이스·모델·설정을 조합해 품질 대비 지연 시간을 맞추는 게 핵심이에요.
언어 강제
language_code 파라미터로 특정 언어의 발음을 강제할 수 있어요(예: fr). 텍스트 정규화(숫자·날짜 처리) 옵션도 제공해요.