3 papers
eess.IV2026
Attention Consistent Longitudinal Medical Visual Question Answering Guided by Vision Foundation Models
Jialin Wu, Qianru Zhang, Georges El Fakhri +1
Longitudinal medical visual question answering (VQA) requires reasoning about anatomical differences between an image of a current time point and an image of a referred time point.…
eess.IV2026
An Open Multi-Center Whole-Body FDG PET/CT Foundation Model for Tumor Segmentation
Xiaofeng Liu, Qianru Zhang, Thibault Marin +4
The synergistic interpretation of anatomical information from computed tomography (CT) and metabolic information from positron emission tomography (PET) is important to oncologic i…
cs.CV2026
TARDis: Time Attenuated Representation Disentanglement for Incomplete Multi-Modal Tumor Segmentation and Classification
Zishuo Wan, Qinqin Kang, Na Li +6
The accurate diagnosis and segmentation of tumors in contrast-enhanced Computed Tomography (CT) are fundamentally driven by the distinctive hemodynamic profiles of contrast agents…