1 paper
Sunil Madhow, Yuchen Liang, Ness Shroff +2
We study inference-time reward-guided alignment for generative models. Existing methods often rely on either architecture-specific adaptations or computationally costly inference p…