1 paper
Ming Dai, Jian Li, Jiedong Zhuang +2
Multi-task visual grounding involves the simultaneous execution of localization and segmentation in images based on textual expressions. The majority of advanced methods predominan…