collaborators

5 papers

cs.CL2026

Beyond Scalar Scores: Exploring LLM-based Metrics for Clinical Significance Evaluation in Radiology Reports

Qingyu Lu, Ruochen Li, Liang Ding +3

Reliable evaluation of generated radiology reports requires strict clinical accuracy, as omitted critical findings or mischaracterized radiographic observations can directly affect…

eess.IV2026

TimeFlow: Temporal Conditioning for Longitudinal Brain MRI Registration and Aging Analysis

Bailiang Jian, Jiazhen Pan, Yitong Li +5

Longitudinal brain analysis is essential for understanding healthy aging and identifying pathological deviations. Longitudinal registration of sequential brain MRI underpins such a…

cs.CL2026

SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability

Ruochen Li, Kun Yuan, Yufei Xia +5

Surgical planning integrates visual perception, long-horizon reasoning, and procedural knowledge, yet it remains unclear whether current evaluation protocols reliably assess vision…

cs.CL2025

ReEvalMed: Rethinking Medical Report Evaluation by Aligning Metrics with Real-World Clinical Judgment

Ruochen Li, Jun Li, Bailiang Jian +2

Automatically generated radiology reports often receive high scores from existing evaluation metrics but fail to earn clinicians' trust. This gap reveals fundamental flaws in how c…

cs.CL2025

Focus Directions Make Your Language Models Pay More Attention to Relevant Contexts

Youxiang Zhu, Ruochen Li, Danqing Wang +2

Long-context large language models (LLMs) are prone to be distracted by irrelevant contexts. The reason for distraction remains poorly understood. In this paper, we first identify…