1 paper
Qiyuan Chen, Hongsen Huang, Jiahe Chen +6
Vision-language reward modeling faces a dilemma: generative approaches are interpretable but slow, while discriminative ones are efficient but act as opaque "black boxes." To bridg…