1 paper
Beining Xu, Siting Zhu, Zhao Jin +2
3D Visual Grounding (3DVG) focuses on locating objects in 3D scenes based on natural language descriptions, serving as a fundamental task for embodied AI and robotics. Recent advan…