1 paper
Hongyi Miao, Jun Jia, Xincheng Wang +7
Recent advances in visual-language alignment have endowed vision-language models (VLMs) with fine-grained image understanding capabilities. However, this progress also introduces n…