1 paper · 1 filter
Li Wang, Xi Chen, XiangWen Deng +4
Multimodal large language models (MLLMs) show promising performance on medical visual question answering (VQA) and report generation, but these generation and explanation abilities…