1 paper
Cuong Huynh, Maxim Popov, Denis Gridusov +1
3D Visual Grounding (3DVG) is an essential capability for embodied AI, requiring agents to localize objects in 3D scenes based on natural language descriptions. Recent zero-shot me…