1 paper
Han Zhu, Wei Kang, Zengwei Yao +6
Existing large-scale zero-shot text-to-speech (TTS) models deliver high speech quality but suffer from slow inference speeds due to massive parameters. To address this issue, this…