1 paper
Jintang Xue, Xinyu Wang, Yixing Wu +2
3D multimodal large language models (3D MLLMs) describe a 3D object as a whole but cannot address, name, or reason about its parts. Prior part-aware attempts add segmentation decod…