3 papers
cs.CV2026
Flexible and Efficient Spatio-Temporal Transformer for Sequential Visual Place Recognition
Yu Kiu, Lau, Chao Chen +2
Sequential Visual Place Recognition (Seq-VPR) leverages transformers to capture spatio-temporal features effectively. In practice, a transformer-based Seq-VPR model should be flexi…
cs.CV2025
End-to-End Visual Autonomous Parking via Control-Aided Attention
Chao Chen, Shunyu Yao, Yuanwu He +7
Precise parking requires an end-to-end system where perception adaptively provides policy-relevant details - especially in critical areas where fine control decisions are essential…
cs.CV2025
Scene Summarization: Clustering Scene Videos into Spatially Diverse Frames
Chao Chen, Mingzhi Zhu, Ankush Pratap Singh +3
Humans are remarkably efficient at forming spatial understanding from just a few visual observations. When browsing real estate or navigating unfamiliar spaces, they intuitively se…