1 paper
Yinming Huang, Shuyuan Tu, Xi Yan +5
Using reinforcement learning to post-train joint video-audio generation models requires a reward signal. Existing methods construct this reward by combining metrics for individual…