Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
ZOO-Prune: Training-Free Token Pruning via Zeroth-Order Gradient Estimation in Vision-Language Models
Youngeun Kim, Youjia Zhang, Huiling Liu +3
Large Vision-Language Models (VLMs) enable strong multimodal reasoning but incur heavy inference costs from redundant visual tokens. Token pruning alleviates this issue, yet existi…
cs.CV2025
IAM: Enhancing RGB-D Instance Segmentation with New Benchmarks
Aecheon Jung, Soyun Choi, Junhong Min +1
Image segmentation is a vital task for providing human assistance and enhancing autonomy in our daily lives. In particular, RGB-D segmentation-leveraging both visual and depth cues…