1 paper · 1 filter
Yanru Huo, Ziyue Jiang, Zuoli Tang +2
While Diffusion Transformers (DiT) have advanced non-autoregressive (NAR) speech synthesis, their high computational demands remain an limitation. Existing DiT-based text-to-speech…