1 paper · 1 filter
Yue Yang, Shuibai Zhang, Wenqi Shao +4
Large Vision-Language Models (LVLMs) have demonstrated remarkable capabilities across multimodal tasks such as visual perception and reasoning, leading to good performance on vario…