1 paper
Suyang Xi, Songtao Hu, Yuxiang Lai +4
Medical vision--language models (VLMs) have shown strong potential for medical visual question answering (VQA), yet their reasoning remains largely text-centric: images are encoded…