1 paper · 1 filter
Het Patel, Muzammil Allie, Qian Zhang +2
Vision language models (VLMs) excel in multimodal understanding but are prone to adversarial attacks. Existing defenses often demand costly retraining or significant architecture c…