2 papers
cs.LG2026
Making medical vision-language models think causally across modalities with retrieval-augmented cross-modal reasoning
Weiqin Yang, Haowen Xue, Qingyi Peng +3
Medical vision-language models (VLMs) achieve strong performance in diagnostic reporting and image-text alignment, yet their underlying reasoning mechanisms remain fundamentally co…
cs.CV2025
MambaControl: Anatomy Graph-Enhanced Mamba ControlNet with Fourier Refinement for Diffusion-Based Disease Trajectory Prediction
Hao Yang, Tao Tan, Shuai Tan +4
Modelling disease progression in precision medicine requires capturing complex spatio-temporal dynamics while preserving anatomical integrity. Existing methods often struggle with…