1 paper · 1 filter
Jinmei Liu, Haoru Li, Zhenhong Sun +6
Reinforcement learning (RL) has emerged as a powerful paradigm for fine-tuning large-scale generative models, such as diffusion and flow models, to align with complex human prefere…