1 paper
Tianqi Xiao, Shiyao Cui, Minghao Zhang +2
Visual modality enhances the capabilities of multimodal large language models (MLLMs) but also introduces a safety concern: a benign textual query may convey harmful intent when gr…