1 paper
Shuqing Luo, Bowen Qu, Wei Gao
In this paper, we explore a critical yet under-investigated issue: how to learn robust and well-generalized 3D representation from pre-trained vision language models such as CLIP.…