1 paper
Chenglin Yang, Siyuan Qiao, Yuan Cao +4
Generative training has been demonstrated to be powerful for building visual-language models. However, on zero-shot discriminative benchmarks, there is still a performance gap betw…