Showing cs.CVShow all
2 papers · 1 filter
cs.CV2026
Not All Redundant Tokens Are Alike: Analyzing Visual Token Pruning through Token Roles
Hyeonyu Kim, Sehwan Lim, Youngwon Choi +2
Vision-language models (VLMs) process an image as a sequence of visual tokens, which creates a substantial computational bottleneck during inference. Recent visual token pruning me…
cs.CV2026
Mine-JEPA: In-Domain Self-Supervised Learning for Mine-Like Object Classification in Side-Scan Sonar
Taeyoun Kwon, Youngwon Choi, Hyeonyu Kim +3
Side-scan sonar (SSS) mine classification is a challenging maritime vision problem characterized by extreme data scarcity and a large domain gap from natural images. While self-sup…