2 papers
cs.CV2026
HiSC: Hierarchical Spatial Clustering Token Compression for Efficient 3D Scene Understanding
Jiuhe Qu, Yingping Liang, Ying Fu
3D vision-language models (3D VLMs) enable spatial reasoning over multi-view scenes but suffer from substantial token redundancy due to duplicated observations and large uninformat…
cs.CV2026
Learning Semantic-Robust Change Detection via Semantic-Invariant Self-Distillation
Jiuhe Qu, Yingping Liang, Ying Fu
Change detection aims to identify semantic changes between remote sensing images. However, features from models are easily disturbed by non-semantic variations, such as illuminatio…