1 paper
Xiuyuan Zhu, Ke Lu, Zijie Yang +3
Efficiently retrieving specific 3D instances from large-scale scenes via natural language prompts remains a formidable challenge in multimedia analysis. Existing approaches predomi…