1 paper
Li-Zhong Szu-Tu, Ting-Lin Wu, Chia-Jui Chang +2
We expose a significant popularity bias in state-of-the-art vision-language models (VLMs), which achieve up to 34% higher accuracy on famous buildings compared to ordinary ones, in…