1 paper
David McAllister, Miika Aittala, Tero Karras +4
Reinforcement learning (RL) has become a standard technique for post-training diffusion-based image synthesis models, as it enables learning from reward signals to explicitly impro…