배우기

Piper Plus 음성

일부 음성은 Piper Plus 구조를 사용해요. 다국어 합성, 운율, MB-iSTFT 디코딩을 지원해요. 카탈로그에서 Piper+ 배지가 표시되며 표준 piper 바이너리가 아닌 piper-plus 런타임이 필요해요.

01PIPER PLUS · MULTILINGUE

piper-plus 설치

런타임은 PyPI에서 배포돼요. 발음 처리용 NLTK 데이터는 첫 합성 시 가져와요.

pip install piper-plus
02

음성 다운로드

런타임은 모델 이름을 해석해 파일을 다운로드해요. 카탈로그의 Piper Plus 음성은 각 Hugging Face 저장소에서도 받을 수 있어요.

piper --download-model tsukuyomi
03

WAV 파일 생성하기

piper와 같은 방식이에요. 텍스트 입력, WAV 출력이에요. 다국어 음성은 6개 언어를 단일 명령으로 처리해요.

piper --model tsukuyomi --text "Konnichiwa, kyou wa ii tenki desu ne." --output_file output.wav
04

카탈로그 모델

모델 페이지에는 Piper+ 배지와 라이선스가 표시돼요. 이 음성들은 브라우저 내 합성이 비활성화돼요. 사이트 런타임은 표준 Piper만 지원해요.

Piper Plus 질문은 Discord 서버에서 답변해요.