9 papers
US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina
Cheng Zhang, Xingzheng Wu, Guihao Yan +4
Artificial intelligence-assisted ultrasound scanning enhances diagnostic reliability and efficiency by providing real-time guidance for standardized image acquisition and reducing…
ForceU-VLA: A Force-Aware Vision-Language-Action Model for Embodied Ultrasound Scanning
Xingzheng Wu, Cheng Zhang, Guihao Yan +3
Embodied intelligent ultrasound scanning enables the automation and standardization of the ultrasound examination process by integrating perception, decision-making, and execution…
GeoDiffMM: Geometry-Guided Conditional Diffusion for Motion Magnification
Xuedeng Liu, Jiabao Guo, Zheng Zhang +3
Video Motion Magnification (VMM) amplifies subtle macroscopic motions to a perceptible level. Recently, existing mainstream Eulerian approaches address amplification-induced noise…
SEMC: Structure-Enhanced Mixture-of-Experts Contrastive Learning for Ultrasound Standard Plane Recognition
Qing Cai, Guihao Yan, Fan Zhang +2
Ultrasound standard plane recognition is essential for clinical tasks such as disease screening, organ evaluation, and biometric measurement. However, existing methods fail to effe…
MESC-3D:Mining Effective Semantic Cues for 3D Reconstruction from a Single Image
Shaoming Li, Qing Cai, Songqi Kong +5
Reconstructing 3D shapes from a single image plays an important role in computer vision. Many methods have been proposed and achieve impressive performance. However, existing metho…
C2PD: Continuity-Constrained Pixelwise Deformation for Guided Depth Super-Resolution
Jiahui Kang, Qing Cai, Runqing Tan +2
Guided depth super-resolution (GDSR) has demonstrated impressive performance across a wide range of domains, with numerous methods being proposed. However, existing methods often t…