1 paper · 1 filter
Muhammad Usama, Syeda Aishah Asim, Syed Bilal Ali +2
Vision-language models (VLMs) have demonstrated impressive capabilities in understanding and reasoning about visual and textual content. However, their robustness to common image c…