1 paper
Beijia Lu, Ziyi Chen, Jing Xiao +1
Diffusion models can synthesize realistic co-speech video from audio for various applications, such as video creation and virtual agents. However, existing diffusion-based methods…