NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (67)

cs.CV2022

Skating-Mixer: Long-Term Sport Audio-Visual Modeling with MLPs

Jingfei Xia, Mingchen Zhuge, Tiantian Geng +4

cs.AI2026

Agents' Last Exam

Yiyou Sun, Xinyang Han, Weichen Zhang +306

cs.CV2025

FusionFM: All-in-One Multi-Modal Image Fusion with Flow Matching

Huayi Zhu, Xiu Shu, Youqiang Xiong +5

cs.CV2024

1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation

Deshui Miao, Xin Li, Zhenyu He +2

cs.CV2024

Spatial-Temporal Multi-level Association for Video Object Segmentation

Deshui Miao, Xin Li, Zhenyu He +2

cs.CV2024

Data Generation Scheme for Thermal Modality with Edge-Guided Adversarial Conditional Diffusion Model

Guoqing Zhu, Honghu Pan, Qiang Wang +3

cs.CV2019

Multi-Task Driven Feature Models for Thermal Infrared Tracking

Qiao Liu, Xin Li, Zhenyu He +4

cs.CV2023

Audio2Gestures: Generating Diverse Gestures from Audio

Jing Li, Di Kang, Wenjie Pei +4

cs.CV2021

GuidedMix-Net: Semi-supervised Semantic Segmentation by Using Labeled Images as Reference

Peng Tu, Yawen Huang, Feng Zheng +3

cs.CV2022

Self-Supervised Tracking via Target-Aware Data Synthesis

Xin Li, Wenjie Pei, Yaowei Wang +3

cs.CV2022

Multi-Granularity Graph Pooling for Video-based Person Re-Identification

Honghu Pan, Yongyong Chen, Zhenyu He

cs.CV2019

PTB-TIR: A Thermal Infrared Pedestrian Tracking Benchmark

Qiao Liu, Zhenyu He, Xin Li +1

cs.CV2022

SSORN: Self-Supervised Outlier Removal Network for Robust Homography Estimation

Yi Li, Wenjie Pei, Zhenyu He

cs.CV2026

Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation

Chao Yang, Deshui Miao, Chao Tian +3

cs.LG2024

Two Stones Hit One Bird: Bilevel Positional Encoding for Better Length Extrapolation

Zhenyu He, Guhao Feng, Shengjie Luo +6

cs.CL2025

Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning

Qifan Yu, Zhenyu He, Sijie Li +4

nucl-th2024

Deep learning for nuclear masses in deformed relativistic Hartree-Bogoliubov theory in continuum

Soonchul Choi, Kyungil Kim, Zhenyu He +2

cs.CV2020

LSOTB-TIR:A Large-Scale High-Diversity Thermal Infrared Object Tracking Benchmark

Qiao Liu, Xin Li, Zhenyu He +8

cs.CV2018

Hierarchical Spatial-aware Siamese Network for Thermal Infrared Object Tracking

Xin Li, Qiao Liu, Nana Fan +2

cs.CV2024

ZeroPose: CAD-Prompted Zero-shot Object 6D Pose Estimation in Cluttered Scenes

Jianqiu Chen, Zikun Zhou, Mingshan Sun +4

cs.CR2024

PRSI: Privacy-Preserving Recommendation Model Based on Vector Splitting and Interactive Protocols

Xiaokai Cao, Wenjin Mo, Zhenyu He +1

nucl-ex2025

New Determination of the $^{14}$C(n, $γ$)$^{15}$C Reaction Rate and Its Astrophysical Implications

Yuchen Jiang, Zhenyu He, Yudong Luo +11

cs.CV2025

ZeroBP: Learning Position-Aware Correspondence for Zero-shot 6D Pose Estimation in Bin-Picking

Jianqiu Chen, Zikun Zhou, Xin Li +3

cs.CV2020

TCDesc: Learning Topology Consistent Descriptors

Honghu Pan, Fanyang Meng, Zhenyu He +2

cs.CV2022

How Image Generation Helps Visible-to-Infrared Person Re-Identification?

Honghu Pan, Yongyong Chen, Yunqi He +2

cs.CV2023

Geo6D: Geometric Constraints Learning for 6D Pose Estimation

Jianqiu Chen, Mingshan Sun, Ye Zheng +7

cs.CV2023

Channel and Spatial Relation-Propagation Network for RGB-Thermal Semantic Segmentation

Zikun Zhou, Shukun Wu, Guoqing Zhu +2

cs.LG2024

Do Efficient Transformers Really Save Computation?

Kai Yang, Jan Ackermann, Zhenyu He +6

cs.CV2023

CiteTracker: Correlating Image and Text for Visual Tracking

Xin Li, Yuqing Huang, Zhenyu He +3

cs.CV2022

Active Learning for Deep Visual Tracking

Di Yuan, Xiaojun Chang, Yi Yang +3

cs.CV2026

Computer-Aided Design Generation by Cascaded Discrete Diffusion Model

Honghu Pan, Xiaoling Luo, Yongyong Chen +2

cs.CV2023

Reliability-Hierarchical Memory Network for Scribble-Supervised Video Object Segmentation

Zikun Zhou, Kaige Mao, Wenjie Pei +3

cs.CV2023

Joint Visual Grounding and Tracking with Natural Language Specification

Li Zhou, Zikun Zhou, Kaige Mao +1

astro-ph.SR2025

An Actinide-boost Star Discovered in the Gaia-Sausage-Enceladus

Yangming Lin, Haining Li, Ruizheng Jiang +6

cs.CV2022

Global Tracking via Ensemble of Local Trackers

Zikun Zhou, Jianqiu Chen, Wenjie Pei +3

cs.CV2023

Transferable Decoding with Visual Entities for Zero-Shot Image Captioning

Junjie Fei, Teng Wang, Jinrui Zhang +3

cs.CV2021

Saliency-Associated Object Tracking

Zikun Zhou, Wenjie Pei, Xin Li +3

cs.CV2022

Accurate Bounding-box Regression with Distance-IoU Loss for Visual Tracking

Di Yuan, Xiu Shu, Nana Fan +3

cs.CV2023

Cross-Modality Proposal-guided Feature Mining for Unregistered RGB-Thermal Pedestrian Detection

Chao Tian, Zikun Zhou, Yuqing Huang +2

cs.CV2022

Pose-Aided Video-based Person Re-Identification via Recurrent Graph Convolutional Network

Honghu Pan, Qiao Liu, Yongyong Chen +4

cs.CV2026

Interactive Tracking: A Human-in-the-Loop Paradigm with Memory-Augmented Adaptation

Yuqing Huang, Guotian Zeng, Zhenqiao Yuan +4

cs.CL2024

REST: Retrieval-Based Speculative Decoding

Zhenyu He, Zexuan Zhong, Tianle Cai +2

cs.CV2025

Learning Spatial-Semantic Features for Robust Video Object Segmentation

Xin Li, Deshui Miao, Zhenyu He +3

cs.CV2021

SiamCorners: Siamese Corner Networks for Visual Tracking

Kai Yang, Zhenyu He, Wenjie Pei +4

cs.CV2026

Drift-Resilient Temporal Priors for Visual Tracking

Yuqing Huang, Liting Lin, Weijun Zhuang +2

physics.app-ph2025

Multi-Channel Amplitude-Phase Asymmetric-Encrypted Janus Acoustic Meta-Holograms

Haohan Zeng, Zhenyu He, Tianxiang Zhang +12

cs.CV2019

Target-Aware Deep Tracking

Xin Li, Chao Ma, Baoyuan Wu +2

q-bio.BM2024

Exploiting Pre-trained Models for Drug Target Affinity Prediction with Nearest Neighbors

Qizhi Pei, Lijun Wu, Zhenyu He +4

cs.IR2022

Two-Stage Neural Contextual Bandits for Personalised News Recommendation

Mengyan Zhang, Thanh Nguyen-Tang, Fangzhao Wu +3

cs.CV2025

Learning A Robust RGB-Thermal Detector for Extreme Modality Imbalance

Chao Tian, Chao Yang, Guoqing Zhu +2

cs.CV2026

Modality-Decoupled RGB-Thermal Object Detector via Query Fusion

Chao Tian, Zikun Zhou, Chao Yang +3

cs.CV2024

RTracker: Recoverable Tracking via PN Tree Structured Memory

Yuqing Huang, Xin Li, Zikun Zhou +3

cs.CV2018

Region-filtering Correlation Tracking

Nana Fan, Zhenyu He

cs.CV2024

MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking

Xinqi Liu, Li Zhou, Zikun Zhou +2

cs.LG2026

Lossless Anti-Distillation Sampling

Zibo Diao, Jingchu Gai, Xinyue Ai +3

cs.CV2024

LSVOS Challenge Report: Large-scale Complex and Long Video Object Segmentation

Henghui Ding, Lingyi Hong, Chang Liu +30

cs.CV2024

GRAPE: Generalizable and Robust Multi-view Facial Capture

Jing Li, Di Kang, Zhenyu He

cs.CL2025

Let the Code LLM Edit Itself When You Edit the Code

Zhenyu He, Jun Zhang, Shengjie Luo +3

cs.CV2022

Towards Complete-View and High-Level Pose-based Gait Recognition

Honghu Pan, Yongyong Chen, Tingyang Xu +2

cs.CV2024

Discriminative Spatial-Semantic VOS Solution: 1st Place Solution for 6th LSVOS

Deshui Miao, Yameng Gu, Xin Li +3

cs.CV2020

TCDesc: Learning Topology Consistent Descriptors for Image Matching

Honghu Pan, Fanyang Meng, Nana Fan +1

cs.CV2024

Harnessing Vision-Language Pretrained Models with Temporal-Aware Adaptation for Referring Video Object Segmentation

Zikun Zhou, Wentao Xiong, Li Zhou +3

cs.CL2023

Examining User-Friendly and Open-Sourced Large GPT Models: A Survey on Language, Multimodal, and Scientific GPT Models

Kaiyuan Gao, Sunan He, Zhenyu He +4

cs.CV2024

PVUW 2024 Challenge on Complex Video Understanding: Methods and Results

Henghui Ding, Chang Liu, Yunchao Wei +34

cs.CV2019

Learning Deep Multi-Level Similarity for Thermal Infrared Object Tracking

Qiao Liu, Xin Li, Zhenyu He +3

cs.CV2026

Efficient RGB-T Object Detection via Sparse Cross-Modality Fusion

Chao Tian, Zikun Zhou, Chao Yang +2

cs.CV2021

Audio2Gestures: Generating Diverse Gestures from Speech Audio with Conditional Variational Autoencoders

Jing Li, Di Kang, Wenjie Pei +4