2 papers
cs.CV2026
Detecting Clinical Hallucinations in LVLMs via Counterfactual Visual Grounding Uncertainty
Xiao Song, Haonan Qin, Zhaoxu Zhang +3
Large vision-language models (LVLMs) are increasingly used for clinical image understanding, yet they remain vulnerable to \emph{hallucinations}--producing textual findings or attr…
cs.CV2024
Rethinking Radiology Report Generation via Causal Inspired Counterfactual Augmentation
Xiao Song, Jiafan Liu, Yun Li +3
Radiology Report Generation (RRG) draws attention as a vision-and-language interaction of biomedical fields. Previous works inherited the ideology of traditional language generatio…