सीखें
Piper Plus आवाज़ें
कुछ आवाज़ें Piper Plus आर्किटेक्चर उपयोग करती हैं: बहुभाषी संश्लेषण, छंदशास्त्र व MB-iSTFT डिकोडिंग। कैटलॉग में उन पर Piper+ बैज है और उन्हें मानक piper बाइनरी नहीं, piper-plus रनटाइम चाहिए।
01PIPER PLUS · MULTILINGUE
piper-plus स्थापित करें
रनटाइम PyPI पर वितरित है। फ़ोनेमाइज़र का NLTK डेटा प्रथम संश्लेषण पर प्राप्त होता है।
pip install piper-plus02
आवाज़ डाउनलोड करें
रनटाइम मॉडल नाम सुलझाकर उसकी फ़ाइलें डाउनलोड करता है। कैटलॉग की Piper Plus आवाज़ें उनके Hugging Face रिपॉज़िटरी पर भी उपलब्ध रहती हैं।
piper --download-model tsukuyomi03
WAV फ़ाइल बनाएँ
piper जैसा ही इंटरफ़ेस: टेक्स्ट अंदर, WAV फ़ाइल बाहर। बहुभाषी आवाज़ें 1 ही कमांड में अपनी 6 भाषाएँ कवर करती हैं।
piper --model tsukuyomi --text "Konnichiwa, kyou wa ii tenki desu ne." --output_file output.wav04
कैटलॉग मॉडल
मॉडल पृष्ठों पर Piper+ बैज है और लाइसेंस दिखता है। इन आवाज़ों हेतु ब्राउज़र में संश्लेषण अक्षम रहता है: साइट रनटाइम केवल मानक Piper संभालता है।
Piper Plus पर प्रश्न है? Discord सर्वर उत्तर देता है।
