1 paper
Wenhao Xu, Changwei Wang, Xuxiang Feng +5
Vision-language models (VLMs) have demonstrated remarkable open-vocabulary object recognition capabilities, motivating their adaptation for dense prediction tasks like segmentation…