3 papers
cs.CV2026
MedVL-SAM2: A unified 3D medical vision-language model for multimodal reasoning and prompt-driven segmentation
Yang Xing, Jiong Wu, Savas Ozdemir +4
Recent progress in medical vision-language models (VLMs) has achieved strong performance on image-level text-centric tasks such as report generation and visual question answering (…
eess.IV2025
Patlak Parametric Image Estimation from Dynamic PET Using Diffusion Model Prior
Ziqian Huang, Boxiao Yu, Siqi Li +5
Dynamic PET enables the quantitative estimation of physiology-related parameters and is widely utilized in research and increasingly adopted in clinical settings. Parametric imagin…
eess.IV2025
PET Image Denoising via Text-Guided Diffusion: Integrating Anatomical Priors through Text Prompts
Boxiao Yu, Savas Ozdemir, Jiong Wu +4
Low-dose Positron Emission Tomography (PET) imaging presents a significant challenge due to increased noise and reduced image quality, which can compromise its diagnostic accuracy…