1 paper
Hong-Han Wang, Yuntao Wang, Hu Ding
Multimodal Large Language Models (MLLMs) inherit rich relational priors from their language backbones, yet often fail when asked to apply these relationships in visual contexts. We…