1 paper
Anqi Zhang, Xiaokang Ji, Guangyu Gao +3
Recent segmentation methods leveraging Multi-modal Large Language Models (MLLMs) have shown reliable object-level segmentation and enhanced spatial perception. However, almost all…