4 papers
Med3D-R1: Incentivizing Clinical Reasoning in 3D Medical Vision-Language Models for Abnormality Diagnosis
Haoran Lai, Zihang Jiang, Kun Zhang +6
Developing 3D vision-language models with robust clinical reasoning remains a challenge due to the inherent complexity of volumetric medical imaging, the tendency of models to over…
Bridged Semantic Alignment for Zero-shot 3D Medical Image Diagnosis
Haoran Lai, Zihang Jiang, Qingsong Yao +6
3D medical images such as computed tomography are widely used in clinical practice, offering a great potential for automatic diagnosis. Supervised learning-based approaches have ac…
SimCroP: Radiograph Representation Learning with Similarity-driven Cross-granularity Pre-training
Rongsheng Wang, Fenghe Tang, Qingsong Yao +8
Medical vision-language pre-training shows great potential in learning representative features from massive paired radiographs and reports. However, in computed tomography (CT) sca…
E3D-GPT: Enhanced 3D Visual Foundation for Medical Vision-Language Model
Haoran Lai, Zihang Jiang, Qingsong Yao +6
The development of 3D medical vision-language models holds significant potential for disease diagnosis and patient treatment. However, compared to 2D medical images, 3D medical ima…