1 paper
Xiao Liang, Yuxuan An, Di Wang +4
Medical Vision-Language Models (VLMs) are prone to hallucinations, compromising clinical reliability. While reinforcement learning methods like Group Relative Policy Optimization (…