1 paper · 1 filter
Yuang Jia, Jinlong Wang, Junhong Lin +2
Open-vocabulary 3D scene understanding is commonly achieved by embedding 2D vision-language features such as CLIP into a 3D Gaussian Splatting scene, turning it into a text-queryab…