1 paper
Jeongjae Lee, Jinho Chang, Jeongsol Kim +1
Reward-based fine-tuning steers a pretrained diffusion or flow-based generative model toward higher-reward samples while remaining close to the pretrained model. Although existing…