1 paper
Wenyuan Huang, Zhenyu Zhang, Zhao Wang +4
3D visual grounding aims to locate objects based on natural language descriptions in 3D scenes. Existing supervised methods are limited by generalization and recent zero-shot metho…