Piper 커맨드라인 사용법 — 빠르게 오디오 얻기
Piper 커맨드라인 사용법
Piper CLI는 텍스트에서 오디오를 빠르게 얻고 여러 음성을 시험해보기 좋아요. 다만 매 실행마다 음성 모델을 로드하기 때문에 느릴 수 있고, 반복 사용에는 웹 서버(API_HTTP.md)가 더 낫다는 점을 기억하면 돼요.
출처: https://raw.githubusercontent.com/OHF-Voice/piper1-gpl/main/docs/CLI.md
설치
pip install piper-tts
음성 내려받기
python3 -m piper.download_voices
원하는 음성을 골라 받아요(샘플은 여기서 듣기).
python3 -m piper.download_voices en_US-lessac-medium
기본은 현재 디렉터리로 받아지고, --data-dir <DIR>로 위치를 바꿀 수 있어요.
실행
python3 -m piper -m en_US-lessac-medium -f test.wav -- 'This is a test.'
ffplay가 있으면 -f를 빼고 바로 소리를 들을 수 있어요.
python3 -m piper -m en_US-lessac-medium -- 'This will play on your speakers.'
유용한 옵션
--cuda— GPU 가속(onnxruntime-gpu패키지 필요)--input-file— 한 개 이상의 파일에서 입력 텍스트 읽기--sentence-silence— 마지막 문장을 제외한 모든 문장 뒤에 초 단위 침묵 추가--volume— 볼륨 배율 조정(기본: 1.0)--no-normalize— 자동 볼륨 정규화 비활성화
원시 음소 주입
[[ <phonemes> ]] 블록으로 espeak-ng 음소를 직접 넣을 수 있어요.
I am the [[ bˈætmæn ]] not [[bɹˈuːs wˈeɪn]]
espeak-ng로 음소를 얻으려면:
espeak-ng -v en-us --ipa=3 -q batman
bˈætmæn
바이너리 릴리즈
로컬 배포를 원하면 amd64(데스크톱 Linux), arm64(Raspberry Pi 4), armv7(Raspberry Pi 3/4)용 바이너리를 받을 수 있어요.