1 paper
Jingru Li, Wei Ren, Tianqing Zhu
Large Vision-Language Models (LVLMs) rely on attention-based retrieval of safety instructions to maintain alignment during generation. Existing attacks typically optimize image per…