1 paper
Ling Zhou, Yihao Huang, Jingling Sun +4
Large vision-language models (LVLMs) have achieved remarkable progress in video understanding and reasoning. Despite extensive studies on text- and image-based jailbreaks, video ja…