2 papers
cs.CV2025
Vision-LLMs Can Fool Themselves with Self-Generated Typographic Attacks
Maan Qraitem, Nazia Tasnim, Piotr Teterwak +2
Typographic attacks, adding misleading text to images, can deceive vision-language models (LVLMs). The susceptibility of recent large LVLMs like GPT4-V to such attacks is understud…
cs.CV2024
From Fake to Real: Pretraining on Balanced Synthetic Images to Prevent Spurious Correlations in Image Recognition
Maan Qraitem, Kate Saenko, Bryan A. Plummer
Visual recognition models are prone to learning spurious correlations induced by a biased training set where certain conditions (\eg, Indoors) are over-represented in certain c…