1 paper · 1 filter
Sandipan Dhar, Nirmesh J. Shah, Ashishkumar P. Gudmalwar +1
Diffusion-based text-to-speech (TTS) models have achieved significant improvements in speech quality. However, modeling sharp prosodic transitions and rapid pitch variations in exp…