1 paper · 1 filter
Badhan Chandra Das, Md Tasnim Jawad, Md Jueal Mia +2
Large Vision Language Models (LVLMs) demonstrate strong capabilities in multimodal reasoning and many real-world applications, such as visual question answering. However, LVLMs are…