1 paper
Kazi Hasan Ibn Arif, Sajib Acharjee Dip, Khizar Hussain +2
Large Vision Language Models (LVLMs) have demonstrated remarkable capabilities in understanding and describing visual content, achieving state-of-the-art performance across various…