2 papers
cs.CL2026
CONDUIT: A Unified Residual-Stream Restoration Framework for KV Cache Reuse in Vision-Language Models
Pengan Chen, Kaisheng Zheng, Liang Hong +10
Vision-language models (VLMs) often answer new questions about recurring visual content, where reusing the key-value (KV) cache can avoid re-encoding expensive visual prefixes. Exa…
cs.CV2026
REDI-Match: Rotation-Equivariant Distillation for Efficient and Robust Dense Matching
Yinji Ge, Guixu Zheng, Wulong Guo +5
Vision Foundation Models (VFMs) have significantly advanced dense feature matching, yet severe in-plane rotation remains a critical challenge. Existing solutions face a fundamental…