เรียนรู้
เสียง Piper Plus
เสียงบางส่วนใช้สถาปัตยกรรม Piper Plus: การสังเคราะห์หลายภาษา ทำนองเสียง และการถอดรหัส MB-iSTFT เสียงเหล่านี้มีป้าย Piper+ ในแคตตาล็อกและต้องใช้รันไทม์ piper-plus ไม่ใช่ไบนารี piper มาตรฐาน
01PIPER PLUS · MULTILINGUE
ติดตั้ง piper-plus
รันไทม์เผยแพร่บน PyPI ข้อมูล NLTK ของตัวแยกเสียงจะถูกดึงในการสังเคราะห์ครั้งแรก
pip install piper-plus02
ดาวน์โหลดเสียง
รันไทม์จะแก้ชื่อโมเดลและดาวน์โหลดไฟล์ เสียง Piper Plus ในแคตตาล็อกยังมีในที่เก็บข้อมูล Hugging Face ของเสียงนั้นด้วย
piper --download-model tsukuyomi03
สร้างไฟล์ WAV
อินเทอร์เฟซเดียวกับ piper: ข้อความเข้า ไฟล์ WAV ออก เสียงหลายภาษาครอบคลุมทั้ง 6 ภาษาในคำสั่งเดียว
piper --model tsukuyomi --text "Konnichiwa, kyou wa ii tenki desu ne." --output_file output.wav04
โมเดลในแคตตาล็อก
หน้าโมเดลมีป้าย Piper+ และระบุสัญญาอนุญาต การสังเคราะห์ในเบราว์เซอร์ยังปิดอยู่สำหรับเสียงเหล่านี้: รันไทม์ของไซต์รองรับเฉพาะ Piper มาตรฐาน
ที่เก็บข้อมูล GitHub ของ piper-plus ↗โมเดล piper-plus ที่ฝึกไว้ล่วงหน้า ↗เข้าร่วมเซิร์ฟเวอร์ Discord ↗
มีคำถามเกี่ยวกับ Piper Plus หรือไม่ เซิร์ฟเวอร์ Discord พร้อมตอบ
