2 papers
cs.CV2024
P4Q: Learning to Prompt for Quantization in Visual-language Models
Huixin Sun, Runqi Wang, Yanjing Li +4
Large-scale pre-trained Vision-Language Models (VLMs) have gained prominence in various visual and multimodal tasks, yet the deployment of VLMs on downstream application platforms…
cs.CV2024
PiClick: Picking the desired mask from multiple candidates in click-based interactive segmentation
Cilin Yan, Haochen Wang, Jie Liu +5
Click-based interactive segmentation aims to generate target masks via human clicking, which facilitates efficient pixel-level annotation and image editing. In such a task, target…