1 paper · 1 filter
Ze Li, Yao Shi, Yunfei Xu +1
Speaker embedding based zero-shot Text-to-Speech (TTS) systems enable high-quality speech synthesis for unseen speakers using minimal data. However, these systems are vulnerable to…