1 paper · 1 filter
Ge Zhu, Yutong Wen, Marc-André Carbonneau +1
Audio diffusion models can synthesize a wide variety of sounds. Existing models often operate on the latent domain with cascaded phase recovery modules to reconstruct waveform. Thi…