1 paper
Xinzhuo Li, Adheesh Juvekar, Jiaxun Zhang +6
Segmentation Vision-Language Models (VLMs) have significantly advanced grounded visual understanding, yet they remain prone to pixel-grounding hallucinations, producing masks for i…