1 paper
Jiayu Chen, Xiaoyu Wu, Rongshan Gao +6
Audio-driven video generation (A2V) has achieved promising progress in synthesizing temporally coherent and audio-visually aligned videos, yet its inference remains expensive due t…