1 paper · 1 filter
Jingjing Jiang, Nanning Zheng
Recently, finetuning pretrained Vision-Language Models (VLMs) has been a prevailing paradigm for achieving state-of-the-art performance in Visual Question Answering (VQA). However,…