2 papers
cs.CV2025
A 2D Semantic-Aware Position Encoding for Vision Transformers
Xi Chen, Shiyang Zhou, Muqi Huang +9
Vision transformers have demonstrated significant advantages in computer vision tasks due to their ability to capture long-range dependencies and contextual relationships through s…
cs.LG2025
Rethinking Time Encoding via Learnable Transformation Functions
Xi Chen, Yateng Tang, Jiarong Xu +5
Effectively modeling time information and incorporating it into applications or models involving chronologically occurring events is crucial. Real-world scenarios often involve div…