activity
20242026
collaborators

9 papers

cs.RO2026

US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina

Cheng Zhang, Xingzheng Wu, Guihao Yan +4

Artificial intelligence-assisted ultrasound scanning enhances diagnostic reliability and efficiency by providing real-time guidance for standardized image acquisition and reducing…

cs.RO2026

ForceU-VLA: A Force-Aware Vision-Language-Action Model for Embodied Ultrasound Scanning

Xingzheng Wu, Cheng Zhang, Guihao Yan +3

Embodied intelligent ultrasound scanning enables the automation and standardization of the ultrasound examination process by integrating perception, decision-making, and execution…

cs.CV2025

GeoDiffMM: Geometry-Guided Conditional Diffusion for Motion Magnification

Xuedeng Liu, Jiabao Guo, Zheng Zhang +3

Video Motion Magnification (VMM) amplifies subtle macroscopic motions to a perceptible level. Recently, existing mainstream Eulerian approaches address amplification-induced noise…

cs.CV2025

SEMC: Structure-Enhanced Mixture-of-Experts Contrastive Learning for Ultrasound Standard Plane Recognition

Qing Cai, Guihao Yan, Fan Zhang +2

Ultrasound standard plane recognition is essential for clinical tasks such as disease screening, organ evaluation, and biometric measurement. However, existing methods fail to effe…

cs.CV2025

MESC-3D:Mining Effective Semantic Cues for 3D Reconstruction from a Single Image

Shaoming Li, Qing Cai, Songqi Kong +5

Reconstructing 3D shapes from a single image plays an important role in computer vision. Many methods have been proposed and achieve impressive performance. However, existing metho…

cs.CV2025

C2PD: Continuity-Constrained Pixelwise Deformation for Guided Depth Super-Resolution

Jiahui Kang, Qing Cai, Runqing Tan +2

Guided depth super-resolution (GDSR) has demonstrated impressive performance across a wide range of domains, with numerous methods being proposed. However, existing methods often t…