सीखें

Piper Plus आवाज़ें

कुछ आवाज़ें Piper Plus आर्किटेक्चर उपयोग करती हैं: बहुभाषी संश्लेषण, छंदशास्त्र व MB-iSTFT डिकोडिंग। कैटलॉग में उन पर Piper+ बैज है और उन्हें मानक piper बाइनरी नहीं, piper-plus रनटाइम चाहिए।

01PIPER PLUS · MULTILINGUE

piper-plus स्थापित करें

रनटाइम PyPI पर वितरित है। फ़ोनेमाइज़र का NLTK डेटा प्रथम संश्लेषण पर प्राप्त होता है।

pip install piper-plus
02

आवाज़ डाउनलोड करें

रनटाइम मॉडल नाम सुलझाकर उसकी फ़ाइलें डाउनलोड करता है। कैटलॉग की Piper Plus आवाज़ें उनके Hugging Face रिपॉज़िटरी पर भी उपलब्ध रहती हैं।

piper --download-model tsukuyomi
03

WAV फ़ाइल बनाएँ

piper जैसा ही इंटरफ़ेस: टेक्स्ट अंदर, WAV फ़ाइल बाहर। बहुभाषी आवाज़ें 1 ही कमांड में अपनी 6 भाषाएँ कवर करती हैं।

piper --model tsukuyomi --text "Konnichiwa, kyou wa ii tenki desu ne." --output_file output.wav
04

कैटलॉग मॉडल

मॉडल पृष्ठों पर Piper+ बैज है और लाइसेंस दिखता है। इन आवाज़ों हेतु ब्राउज़र में संश्लेषण अक्षम रहता है: साइट रनटाइम केवल मानक Piper संभालता है।

Piper Plus पर प्रश्न है? Discord सर्वर उत्तर देता है।