1 paper
Jianxuan Yang, Xinyue Guo, Zhi Cheng +10
Recent advances in video-to-audio (V2A) generation enable high-quality audio synthesis from visual content, yet achieving robust and fine-grained controllability remains challengin…