1 paper · 1 filter
Gang Liu, Hongyang Li, Zerui He +1
Leveraging pre-trained visual language models has become a widely adopted approach for improving performance in downstream visual question answering (VQA) applications. However, in…