1 paper
Zehua Hao, Fang Liu, Qinliang Wang +3
Zero-shot classification needs efficient label retrieval and fine-grained visual reasoning, yet discriminative and generative vision-language models fail in complementary ways.When…