3 papers
cs.CV2025
Select Less, Reason More: Prioritizing Evidence Purity for Video Reasoning
Xuchen Li, Xuzhao Li, Shiyu Hu +1
Long-form video reasoning remains a major challenge for Video Large Language Models (Video LLMs), as static uniform frame sampling leads to information dilution and obscures critic…
cs.CV2025
DARTer: Dynamic Adaptive Representation Tracker for Nighttime UAV Tracking
Xuzhao Li, Xuchen Li, Shiyu Hu
Nighttime UAV tracking presents significant challenges due to extreme illumination variations and viewpoint changes, which severely degrade tracking performance. Existing approache…
cs.CV2024
How Texts Help? A Fine-grained Evaluation to Reveal the Role of Language in Vision-Language Tracking
Xuchen Li, Shiyu Hu, Xiaokun Feng +4
Vision-language tracking (VLT) extends traditional single object tracking by incorporating textual information, providing semantic guidance to enhance tracking performance under ch…