1 paper
Sejoon Oh, Yiqiao Jin, Megha Sharma +4
Multimodal large language models (MLLMs) have revolutionized vision-language understanding but remain vulnerable to multimodal jailbreak attacks, where adversarial inputs are metic…