1 paper · 1 filter
Yanbin Wei, Jiangyue Yan, Chun Kang +4
Vision-Language Models (VLMs) have emerged as versatile solutions for zero-shot question answering (QA) across various domains. However, enabling VLMs to effectively comprehend str…