1 paper
Hao Guo, Fei Wang, Junjie Chen +4
While Vision-Language Models (VLMs) have achieved state-of-the-art performance in general visual tasks, their perceptual robustness remains remarkably brittle when confronted with…