Publications (67)
Skating-Mixer: Long-Term Sport Audio-Visual Modeling with MLPs
Jingfei Xia, Mingchen Zhuge, Tiantian Geng +4
Agents' Last Exam
Yiyou Sun, Xinyang Han, Weichen Zhang +306
FusionFM: All-in-One Multi-Modal Image Fusion with Flow Matching
Huayi Zhu, Xiu Shu, Youqiang Xiong +5
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
Deshui Miao, Xin Li, Zhenyu He +2
Spatial-Temporal Multi-level Association for Video Object Segmentation
Deshui Miao, Xin Li, Zhenyu He +2
Data Generation Scheme for Thermal Modality with Edge-Guided Adversarial Conditional Diffusion Model
Guoqing Zhu, Honghu Pan, Qiang Wang +3
Multi-Task Driven Feature Models for Thermal Infrared Tracking
Qiao Liu, Xin Li, Zhenyu He +4
Audio2Gestures: Generating Diverse Gestures from Audio
Jing Li, Di Kang, Wenjie Pei +4
GuidedMix-Net: Semi-supervised Semantic Segmentation by Using Labeled Images as Reference
Peng Tu, Yawen Huang, Feng Zheng +3
Self-Supervised Tracking via Target-Aware Data Synthesis
Xin Li, Wenjie Pei, Yaowei Wang +3
Multi-Granularity Graph Pooling for Video-based Person Re-Identification
Honghu Pan, Yongyong Chen, Zhenyu He
PTB-TIR: A Thermal Infrared Pedestrian Tracking Benchmark
Qiao Liu, Zhenyu He, Xin Li +1
SSORN: Self-Supervised Outlier Removal Network for Robust Homography Estimation
Yi Li, Wenjie Pei, Zhenyu He
Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation
Chao Yang, Deshui Miao, Chao Tian +3
Two Stones Hit One Bird: Bilevel Positional Encoding for Better Length Extrapolation
Zhenyu He, Guhao Feng, Shengjie Luo +6
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
Qifan Yu, Zhenyu He, Sijie Li +4
Deep learning for nuclear masses in deformed relativistic Hartree-Bogoliubov theory in continuum
Soonchul Choi, Kyungil Kim, Zhenyu He +2
LSOTB-TIR:A Large-Scale High-Diversity Thermal Infrared Object Tracking Benchmark
Qiao Liu, Xin Li, Zhenyu He +8
Hierarchical Spatial-aware Siamese Network for Thermal Infrared Object Tracking
Xin Li, Qiao Liu, Nana Fan +2
ZeroPose: CAD-Prompted Zero-shot Object 6D Pose Estimation in Cluttered Scenes
Jianqiu Chen, Zikun Zhou, Mingshan Sun +4
PRSI: Privacy-Preserving Recommendation Model Based on Vector Splitting and Interactive Protocols
Xiaokai Cao, Wenjin Mo, Zhenyu He +1
New Determination of the $^{14}$C(n, $γ$)$^{15}$C Reaction Rate and Its Astrophysical Implications
Yuchen Jiang, Zhenyu He, Yudong Luo +11
ZeroBP: Learning Position-Aware Correspondence for Zero-shot 6D Pose Estimation in Bin-Picking
Jianqiu Chen, Zikun Zhou, Xin Li +3
TCDesc: Learning Topology Consistent Descriptors
Honghu Pan, Fanyang Meng, Zhenyu He +2
How Image Generation Helps Visible-to-Infrared Person Re-Identification?
Honghu Pan, Yongyong Chen, Yunqi He +2
Geo6D: Geometric Constraints Learning for 6D Pose Estimation
Jianqiu Chen, Mingshan Sun, Ye Zheng +7
Channel and Spatial Relation-Propagation Network for RGB-Thermal Semantic Segmentation
Zikun Zhou, Shukun Wu, Guoqing Zhu +2
Do Efficient Transformers Really Save Computation?
Kai Yang, Jan Ackermann, Zhenyu He +6
CiteTracker: Correlating Image and Text for Visual Tracking
Xin Li, Yuqing Huang, Zhenyu He +3
Active Learning for Deep Visual Tracking
Di Yuan, Xiaojun Chang, Yi Yang +3
Computer-Aided Design Generation by Cascaded Discrete Diffusion Model
Honghu Pan, Xiaoling Luo, Yongyong Chen +2
Reliability-Hierarchical Memory Network for Scribble-Supervised Video Object Segmentation
Zikun Zhou, Kaige Mao, Wenjie Pei +3
Joint Visual Grounding and Tracking with Natural Language Specification
Li Zhou, Zikun Zhou, Kaige Mao +1
An Actinide-boost Star Discovered in the Gaia-Sausage-Enceladus
Yangming Lin, Haining Li, Ruizheng Jiang +6
Global Tracking via Ensemble of Local Trackers
Zikun Zhou, Jianqiu Chen, Wenjie Pei +3
Transferable Decoding with Visual Entities for Zero-Shot Image Captioning
Junjie Fei, Teng Wang, Jinrui Zhang +3
Saliency-Associated Object Tracking
Zikun Zhou, Wenjie Pei, Xin Li +3
Accurate Bounding-box Regression with Distance-IoU Loss for Visual Tracking
Di Yuan, Xiu Shu, Nana Fan +3
Cross-Modality Proposal-guided Feature Mining for Unregistered RGB-Thermal Pedestrian Detection
Chao Tian, Zikun Zhou, Yuqing Huang +2
Pose-Aided Video-based Person Re-Identification via Recurrent Graph Convolutional Network
Honghu Pan, Qiao Liu, Yongyong Chen +4
Interactive Tracking: A Human-in-the-Loop Paradigm with Memory-Augmented Adaptation
Yuqing Huang, Guotian Zeng, Zhenqiao Yuan +4
REST: Retrieval-Based Speculative Decoding
Zhenyu He, Zexuan Zhong, Tianle Cai +2
Learning Spatial-Semantic Features for Robust Video Object Segmentation
Xin Li, Deshui Miao, Zhenyu He +3
SiamCorners: Siamese Corner Networks for Visual Tracking
Kai Yang, Zhenyu He, Wenjie Pei +4
Drift-Resilient Temporal Priors for Visual Tracking
Yuqing Huang, Liting Lin, Weijun Zhuang +2
Multi-Channel Amplitude-Phase Asymmetric-Encrypted Janus Acoustic Meta-Holograms
Haohan Zeng, Zhenyu He, Tianxiang Zhang +12
Target-Aware Deep Tracking
Xin Li, Chao Ma, Baoyuan Wu +2
Exploiting Pre-trained Models for Drug Target Affinity Prediction with Nearest Neighbors
Qizhi Pei, Lijun Wu, Zhenyu He +4
Two-Stage Neural Contextual Bandits for Personalised News Recommendation
Mengyan Zhang, Thanh Nguyen-Tang, Fangzhao Wu +3
Learning A Robust RGB-Thermal Detector for Extreme Modality Imbalance
Chao Tian, Chao Yang, Guoqing Zhu +2
Modality-Decoupled RGB-Thermal Object Detector via Query Fusion
Chao Tian, Zikun Zhou, Chao Yang +3
RTracker: Recoverable Tracking via PN Tree Structured Memory
Yuqing Huang, Xin Li, Zikun Zhou +3
Region-filtering Correlation Tracking
Nana Fan, Zhenyu He
MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking
Xinqi Liu, Li Zhou, Zikun Zhou +2
Lossless Anti-Distillation Sampling
Zibo Diao, Jingchu Gai, Xinyue Ai +3
LSVOS Challenge Report: Large-scale Complex and Long Video Object Segmentation
Henghui Ding, Lingyi Hong, Chang Liu +30
GRAPE: Generalizable and Robust Multi-view Facial Capture
Jing Li, Di Kang, Zhenyu He
Let the Code LLM Edit Itself When You Edit the Code
Zhenyu He, Jun Zhang, Shengjie Luo +3
Towards Complete-View and High-Level Pose-based Gait Recognition
Honghu Pan, Yongyong Chen, Tingyang Xu +2
Discriminative Spatial-Semantic VOS Solution: 1st Place Solution for 6th LSVOS
Deshui Miao, Yameng Gu, Xin Li +3
TCDesc: Learning Topology Consistent Descriptors for Image Matching
Honghu Pan, Fanyang Meng, Nana Fan +1
Harnessing Vision-Language Pretrained Models with Temporal-Aware Adaptation for Referring Video Object Segmentation
Zikun Zhou, Wentao Xiong, Li Zhou +3
Examining User-Friendly and Open-Sourced Large GPT Models: A Survey on Language, Multimodal, and Scientific GPT Models
Kaiyuan Gao, Sunan He, Zhenyu He +4
PVUW 2024 Challenge on Complex Video Understanding: Methods and Results
Henghui Ding, Chang Liu, Yunchao Wei +34
Learning Deep Multi-Level Similarity for Thermal Infrared Object Tracking
Qiao Liu, Xin Li, Zhenyu He +3
Efficient RGB-T Object Detection via Sparse Cross-Modality Fusion
Chao Tian, Zikun Zhou, Chao Yang +2
Audio2Gestures: Generating Diverse Gestures from Speech Audio with Conditional Variational Autoencoders
Jing Li, Di Kang, Wenjie Pei +4