1 paper · 1 filter
José Giraldo, Martà Llopart-Font, Alex Peiró-Lilja +3
High-quality audio data is a critical prerequisite for training robust text-to-speech models, which often limits the use of opportunistic or crowdsourced datasets. This paper prese…