1 paper
Qishun Yang, Shu Yang, Lijie Hu +1
Multimodal large language models (MLLMs) face safety misalignment, where visual inputs enable harmful outputs. To address this, existing methods require explicit safety labels or c…