Showing cs.CVShow all
2 papers · 1 filter
cs.CV2025
MambaVSR: Content-Aware Scanning State Space Model for Video Super-Resolution
Linfeng He, Meiqin Liu, Qi Tang +2
Video super-resolution (VSR) faces critical challenges in effectively modeling non-local dependencies across misaligned frames while preserving computational efficiency. Existing V…
cs.CV2024
Integrating Object Detection Modality into Visual Language Model for Enhanced Autonomous Driving Agent
Linfeng He, Yiming Sun, Sihao Wu +2
In this paper, we propose a novel framework for enhancing visual comprehension in autonomous driving systems by integrating visual language models (VLMs) with additional visual per…