1 paper
Songchun Zhang, Zeyue Xue, Siming Fu +6
Distilled autoregressive (AR) video models enable efficient streaming generation but frequently misalign with human visual preferences. Existing reinforcement learning (RL) framewo…