เรียนรู้

เสียง Piper Plus

เสียงบางส่วนใช้สถาปัตยกรรม Piper Plus: การสังเคราะห์หลายภาษา ทำนองเสียง และการถอดรหัส MB-iSTFT เสียงเหล่านี้มีป้าย Piper+ ในแคตตาล็อกและต้องใช้รันไทม์ piper-plus ไม่ใช่ไบนารี piper มาตรฐาน

01PIPER PLUS · MULTILINGUE

ติดตั้ง piper-plus

รันไทม์เผยแพร่บน PyPI ข้อมูล NLTK ของตัวแยกเสียงจะถูกดึงในการสังเคราะห์ครั้งแรก

pip install piper-plus
02

ดาวน์โหลดเสียง

รันไทม์จะแก้ชื่อโมเดลและดาวน์โหลดไฟล์ เสียง Piper Plus ในแคตตาล็อกยังมีในที่เก็บข้อมูล Hugging Face ของเสียงนั้นด้วย

piper --download-model tsukuyomi
03

สร้างไฟล์ WAV

อินเทอร์เฟซเดียวกับ piper: ข้อความเข้า ไฟล์ WAV ออก เสียงหลายภาษาครอบคลุมทั้ง 6 ภาษาในคำสั่งเดียว

piper --model tsukuyomi --text "Konnichiwa, kyou wa ii tenki desu ne." --output_file output.wav
04

โมเดลในแคตตาล็อก

หน้าโมเดลมีป้าย Piper+ และระบุสัญญาอนุญาต การสังเคราะห์ในเบราว์เซอร์ยังปิดอยู่สำหรับเสียงเหล่านี้: รันไทม์ของไซต์รองรับเฉพาะ Piper มาตรฐาน

มีคำถามเกี่ยวกับ Piper Plus หรือไม่ เซิร์ฟเวอร์ Discord พร้อมตอบ