1 paper · 1 filter
Changjin Han, Seokgi Lee, Gyuhyeon Nam +1
Diffusion models have achieved remarkable success in text-to-speech (TTS), even in zero-shot scenarios. Recent efforts aim to address the trade-off between inference speed and soun…