1 paper
Yaozong Zheng, Bineng Zhong, Qihua Liang +4
We propose a universal video-level modality-awareness tracking model with online dense temporal token learning (called {\modaltracker}). It is designed to support various tracking…