Piper 커맨드라인 사용법 — 빠르게 오디오 얻기

Piper 커맨드라인 사용법

Piper CLI는 텍스트에서 오디오를 빠르게 얻고 여러 음성을 시험해보기 좋아요. 다만 매 실행마다 음성 모델을 로드하기 때문에 느릴 수 있고, 반복 사용에는 웹 서버(API_HTTP.md)가 더 낫다는 점을 기억하면 돼요.

출처: https://raw.githubusercontent.com/OHF-Voice/piper1-gpl/main/docs/CLI.md

설치

pip install piper-tts

음성 내려받기

python3 -m piper.download_voices

원하는 음성을 골라 받아요(샘플은 여기서 듣기).

python3 -m piper.download_voices en_US-lessac-medium

기본은 현재 디렉터리로 받아지고, --data-dir <DIR>로 위치를 바꿀 수 있어요.

실행

python3 -m piper -m en_US-lessac-medium -f test.wav -- 'This is a test.'

ffplay가 있으면 -f를 빼고 바로 소리를 들을 수 있어요.

python3 -m piper -m en_US-lessac-medium -- 'This will play on your speakers.'

유용한 옵션

  • --cuda — GPU 가속(onnxruntime-gpu 패키지 필요)
  • --input-file — 한 개 이상의 파일에서 입력 텍스트 읽기
  • --sentence-silence — 마지막 문장을 제외한 모든 문장 뒤에 초 단위 침묵 추가
  • --volume — 볼륨 배율 조정(기본: 1.0)
  • --no-normalize — 자동 볼륨 정규화 비활성화

원시 음소 주입

[[ <phonemes> ]] 블록으로 espeak-ng 음소를 직접 넣을 수 있어요.

I am the [[ bˈætmæn ]] not [[bɹˈuːs wˈeɪn]]

espeak-ng로 음소를 얻으려면:

espeak-ng -v en-us --ipa=3 -q batman
bˈætmæn

바이너리 릴리즈

로컬 배포를 원하면 amd64(데스크톱 Linux), arm64(Raspberry Pi 4), armv7(Raspberry Pi 3/4)용 바이너리를 받을 수 있어요.

더 알아보기