3 papers
cs.CV2026
Instance-level Visual Active Tracking with Occlusion-Aware Planning
Haowei Sun, Kai Zhou, Hao Gao +5
Visual Active Tracking (VAT) aims to control cameras to follow a target in 3D space, which is critical for applications like drone navigation and security surveillance. However, it…
cs.AI2025
Efficient Dynamic Ensembling for Multiple LLM Experts
Jinwu Hu, Yufeng Wang, Shuhai Zhang +5
LLMs have demonstrated impressive performance across various language tasks. However, the strengths of LLMs can vary due to different architectures, model sizes, areas of training…
cs.CV2025
Zero-Shot Skeleton-Based Action Recognition With Prototype-Guided Feature Alignment
Kai Zhou, Shuhai Zhang, Zeng You +3
Zero-shot skeleton-based action recognition aims to classify unseen skeleton-based human actions without prior exposure to such categories during training. This task is extremely c…