2 papers
cs.CV2026
Structure-Adaptive Sparse Diffusion in Voxel Space for 3D Medical Image Enhancement
Hongxu Jiang, Fei Li, Boxiao Yu +4
Three-dimensional (3D) medical image enhancement, including denoising and super-resolution, is critical for clinical diagnosis in CT, PET, and MRI. Although diffusion models have s…
cs.CV2026
MedVL-SAM2: A unified 3D medical vision-language model for multimodal reasoning and prompt-driven segmentation
Yang Xing, Jiong Wu, Savas Ozdemir +4
Recent progress in medical vision-language models (VLMs) has achieved strong performance on image-level text-centric tasks such as report generation and visual question answering (…