1 paper · 1 filter
Jiaxi Yang, Shicheng Liu, Yuchen Yang +1
With the rapid advancement of Vision Language Models (VLMs), refusal mechanisms have become a critical component for ensuring responsible and safe model behavior. However, existing…