1 paper · 2 filters
Haozhe Wang, Cong Wei, Weiming Ren +3
Most reward models for visual generation reduce rich human judgments to a single unexplained score, discarding the reasoning that underlies preference. We show that teaching reward…