2 papers
cs.CV2025
Unleashing the Multi-View Fusion Potential: Noise Correction in VLM for Open-Vocabulary 3D Scene Understanding
Xingyilang Yin, Jiale Wang, Xi Yang +3
Recent open-vocabulary 3D scene understanding approaches mainly focus on training 3D networks through contrastive learning with point-text pairs or by distilling 2D features into 3…
cs.CV2024
SA3DIP: Segment Any 3D Instance with Potential 3D Priors
Xi Yang, Xu Gu, Xingyilang Yin +1
The proliferation of 2D foundation models has sparked research into adapting them for open-world 3D instance segmentation. Recent methods introduce a paradigm that leverages superp…