1 paper
Philip Wootaek Shin, Ajay Narayanan Sridhar, Sivani Devarapalli +3
Vision-language models (VLMs) achieve strong multimodal performance but remain prone to relation hallucination, which requires accurate reasoning over inter-object interactions. We…