1 paper
Runwei Guan, Di Tian, Ningwei Ouyang +9
As a key capability for embodied intelligence, 3D visual grounding (3DVG) has been predominantly studied in indoor scenes with RGB-D or point-cloud inputs, while existing outdoor e…