3 papers
cs.CV2026
Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation
Huu Tien Nguyen, Dac Thai Nguyen, The Minh Duc Nguyen +11
Vision-Language Foundation Models (VLMs), trained on large-scale multimodal datasets, have driven significant advances in Artificial Intelligence (AI) by enabling rich cross-modal…
cs.CV2025
PADM: A Physics-aware Diffusion Model for Attenuation Correction
Trung Kien Pham, Hoang Minh Vu, Anh Duc Chu +6
Attenuation artifacts remain a significant challenge in cardiac Myocardial Perfusion Imaging (MPI) using Single-Photon Emission Computed Tomography (SPECT), often compromising diag…
eess.IV2025
TotalRegistrator: Towards a Lightweight Foundation Model for CT Image Registration
Xuan Loc Pham, Gwendolyn Vuurberg, Marjan Doppen +12
Image registration is a fundamental technique in the analysis of longitudinal and multi-phase CT images within clinical practice. However, most existing methods are tailored for si…