1 paper
Md. Sadman Sakib, Zisan Mahmud, Md. Fahim Arefin +1
Vision Language Models have achieved strong performance on multimodal benchmarks, yet their ability to reason about culturally grounded and metaphor-rich content remains insufficie…