1 paper · 1 filter
Jiayan Yang, Zhuoyu Wu, Wenqi Fang
Vision-Language Models (VLMs) facilitate medical visual question answering (MedVQA) by jointly interpreting images and text. However, existing models typically depend on large arch…