1 paper
Shangkun Li, Jie Xu, Yi Guo +2
Medical vision-language models typically generate diagnoses through single-pass inference without indicating which image regions support their conclusions. This lack of spatial gro…