6 papers
DepthPilot: From Controllability to Interpretability in Colonoscopy Video Generation
Junhu Fu, Ke Chen, Weidong Guo +9
Controllable medical video generation has achieved remarkable progress, but it still lacks interpretability, which requires the alignment of generated contents with physical priors…
Unified Ultrasound Intelligence Toward an End-to-End Agentic System
Chen Ma, Yunshu Li, Junhu Fu +3
Clinical ultrasound analysis demands models that generalize across heterogeneous organs, views, and devices, while supporting interpretable workflow-level analysis. Existing method…
TinyUSFM: Towards Compact and Efficient Ultrasound Foundation Models
Chen Ma, Jing Jiao, Shuyu Liang +5
Foundation models for medical imaging demonstrate superior generalization capabilities across diverse anatomical structures and clinical applications. Their outstanding performance…
ColoDiff: Integrating Dynamic Consistency With Content Awareness for Colonoscopy Video Generation
Junhu Fu, Shuyu Liang, Wutong Li +9
Colonoscopy video generation delivers dynamic, information-rich data critical for diagnosing intestinal diseases, particularly in data-scarce scenarios. High-quality video generati…
VAP-Diffusion: Enriching Descriptions with MLLMs for Enhanced Medical Image Generation
Peng Huang, Junhu Fu, Bowen Guo +3
As the appearance of medical images is influenced by multiple underlying factors, generative models require rich attribute information beyond labels to produce realistic and divers…
Diff-CXR: Report-to-CXR generation through a disease-knowledge enhanced diffusion model
Peng Huang, Bowen Guo, Shuyu Liang +3
Text-To-Image (TTI) generation is significant for controlled and diverse image generation with broad potential applications. Although current medical TTI methods have made some pro…