NewEvery arXiv paper, its researchers & institutions — mapped.
papers

Publications (93)

cs.CV2022

MatchFormer: Interleaving Attention in Transformers for Feature Matching

Qing Wang, Jiaming Zhang, Kailun Yang +2

cs.CV2026

IMPACT-Scribe: Interactive Temporal Action Segmentation with Boundary Scribbles and Query Planning

Qian Yin, Di Wen, Kunyu Peng +11

cs.CV2022

Indoor Navigation Assistance for Visually Impaired People via Dynamic SLAM and Panoptic Segmentation with an RGB-D Sensor

Wenyan Ou, Jiaming Zhang, Kunyu Peng +4

cs.CV2026

VisNec: Measuring and Leveraging Visual Necessity for Multimodal Instruction Tuning

Mingkang Dong, Hongyi Cai, Jie Li +4

cs.CV2023

Navigating Open Set Scenarios for Skeleton-based Action Recognition

Kunyu Peng, Cheng Yin, Junwei Zheng +7

cs.CV2022

Trans4Map: Revisiting Holistic Bird's-Eye-View Mapping from Egocentric Images to Allocentric Semantics with Vision Transformers

Chang Chen, Jiaming Zhang, Kailun Yang +2

cs.CV2024

Exploring Few-Shot Adaptation for Activity Recognition on Diverse Domains

Kunyu Peng, Di Wen, David Schneider +5

cs.CV2026

Seeing Together: Multi-Robot Cooperative Egocentric Spatial Reasoning with Multimodal Large Language Models

Kunyu Peng, Zhikun Zhou, Kailun Yang +9

cs.CV2026

RHO: Robust Holistic OSM-Based Metric Cross-View Geo-Localization

Junwei Zheng, Ruize Dai, Ruiping Liu +7

cs.CV2025

Graph-based Document Structure Analysis

Yufan Chen, Ruiping Liu, Junwei Zheng +4

cs.CV2026

What if? Emulative Simulation with World Models for Situated Reasoning

Ruiping Liu, Yufan Chen, Yuheng Zhang +8

cs.CV2026

Hallucinating 360°: Panoramic Street-View Generation via Local Scenes Diffusion and Probabilistic Prompting

Fei Teng, Kai Luo, Sheng Wu +6

cs.CV2022

Is my Driver Observation Model Overconfident? Input-guided Calibration Networks for Reliable and Interpretable Confidence Estimates

Alina Roitberg, Kunyu Peng, David Schneider +4

cs.CV2022

TransDARC: Transformer-based Driver Activity Recognition with Latent Space Feature Calibration

Kunyu Peng, Alina Roitberg, Kailun Yang +2

cs.HC2025

CSBrain: A Cross-scale Spatiotemporal Brain Foundation Model for EEG Decoding

Yuchen Zhou, Jiamin Wu, Zichen Ren +7

cs.CV2023

360BEV: Panoramic Semantic Mapping for Indoor Bird's-Eye View

Zhifeng Teng, Jiaming Zhang, Kailun Yang +5

cs.CV2023

Open Scene Understanding: Grounded Situation Recognition Meets Segment Anything for Helping People with Visual Impairments

Ruiping Liu, Jiaming Zhang, Kunyu Peng +5

cs.CV2026

IMPACT-HOI: Supervisory Control for Onset-Anchored Partial HOI Event Construction

Haoshen Zhang, Di Wen, Kunyu Peng +12

cs.CV2021

Trans4Trans: Efficient Transformer for Transparent Object Segmentation to Help Visually Impaired People Navigate in the Real World

Jiaming Zhang, Kailun Yang, Angela Constantinescu +3

cs.CV2026

LFX: Towards Unified Light Field Dense Semantic Segmentation and Salient Object Detection

Fei Teng, Lingxin Huang, Buyin Deng +8

cs.CV2024

Open Panoramic Segmentation

Junwei Zheng, Ruiping Liu, Yufan Chen +5

cs.CV2023

Quantized Distillation: Optimizing Driver Activity Recognition Models for Resource-Constrained Environments

Calvin Tanama, Kunyu Peng, Zdravko Marinov +2

cs.CV2025

RoHOI: Robustness Benchmark for Human-Object Interaction Detection

Di Wen, Kunyu Peng, Kailun Yang +7

cs.CV2023

Delving Deep into One-Shot Skeleton-based Action Recognition with Diverse Occlusions

Kunyu Peng, Alina Roitberg, Kailun Yang +2

cs.RO2026

Not an Obstacle for Dog, but a Hazard for Human: A Co-Ego Navigation System for Guide Dog Robots

Ruiping Liu, Jingqi Zhang, Junwei Zheng +8

cs.CV2023

Towards Privacy-Supporting Fall Detection via Deep Unsupervised RGB2Depth Adaptation

Hejun Xiao, Kunyu Peng, Xiangsheng Huang +4

cs.CV2026

Seeing Beyond: Extrapolative Domain Adaptive Panoramic Segmentation

Yuanfan Zheng, Kunyu Peng, Xu Zheng +1

cs.CV2022

A Comparative Analysis of Decision-Level Fusion for Multimodal Driver Behaviour Understanding

Alina Roitberg, Kunyu Peng, Zdravko Marinov +3

cs.CV2026

$M^2$-Occ: Resilient 3D Semantic Occupancy Prediction for Autonomous Driving with Incomplete Camera Inputs

Kaixin Lin, Kunyu Peng, Di Wen +3

cs.IR2026

TME-PSR: Time-aware, Multi-interest, and Explanation Personalization for Sequential Recommendation

Qingzhuo Wang, Leilei Wen, Juntao Chen +4

cs.CV2025

HybriDLA: Hybrid Generation for Document Layout Analysis

Yufan Chen, Omar Moured, Ruiping Liu +4

cs.CV2022

MASS: Multi-Attentional Semantic Segmentation of LiDAR Data for Dense Top-View Understanding

Kunyu Peng, Juncong Fei, Kailun Yang +6

cs.CV2021

Affect-DML: Context-Aware One-Shot Recognition of Human Affect using Deep Metric Learning

Kunyu Peng, Alina Roitberg, David Schneider +3

cs.CV2023

FishDreamer: Towards Fisheye Semantic Completion via Unified Image Outpainting and Segmentation

Hao Shi, Yu Li, Kailun Yang +7

cs.CV2026

IMPACT-CYCLE: A Contract-Based Multi-Agent System for Claim-Level Supervisory Correction of Long-Video Semantic Memory

Weitong Kong, Di Wen, Kunyu Peng +10

cs.CV2024

Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision

Yiping Wei, Kunyu Peng, Alina Roitberg +6

cs.CV2021

HIDA: Towards Holistic Indoor Understanding for the Visually Impaired via Semantic Instance Segmentation with a Wearable Solid-State LiDAR Sensor

Huayao Liu, Ruiping Liu, Kailun Yang +3

cs.CV2024

LF Tracy: A Unified Single-Pipeline Approach for Salient Object Detection in Light Field Cameras

Fei Teng, Jiaming Zhang, Jiawei Liu +4

cs.RO2023

Tightly-Coupled LiDAR-Visual SLAM Based on Geometric Features for Mobile Agents

Ke Cao, Ruiping Liu, Ze Wang +6

cs.CV2024

Muscles in Time: Learning to Understand Human Motion by Simulating Muscle Activations

David Schneider, Simon Reiß, Marco Kugler +6

cs.CV2024

Towards Activated Muscle Group Estimation in the Wild

Kunyu Peng, David Schneider, Alina Roitberg +6

cs.CV2023

Delivering Arbitrary-Modal Semantic Segmentation

Jiaming Zhang, Ruiping Liu, Hao Shi +6

cs.CV2026

Mitigating Label Noise using Prompt-Based Hyperbolic Meta-Learning in Open-Set Domain Generalization

Kunyu Peng, Di Wen, M. Saquib Sarfraz +7

cs.CV2025

HopaDIFF: Holistic-Partial Aware Fourier Conditioned Diffusion for Referring Human Action Segmentation in Multi-Person Scenarios

Kunyu Peng, Junchao Huang, Xiangsheng Huang +7

cs.CV2024

Probing Fine-Grained Action Understanding and Cross-View Generalization of Foundation Models

Thinesh Thiyakesan Ponbagavathi, Kunyu Peng, Alina Roitberg

cs.CV2024

OAFuser: Towards Omni-Aperture Fusion for Light Field Semantic Segmentation

Fei Teng, Jiaming Zhang, Kunyu Peng +3

cs.CV2025

EReLiFM: Evidential Reliability-Aware Residual Flow Meta-Learning for Open-Set Domain Generalization under Noisy Labels

Kunyu Peng, Di Wen, Kailun Yang +9

cs.CV2022

Bending Reality: Distortion-aware Transformers for Adapting to Panoramic Semantic Segmentation

Jiaming Zhang, Kailun Yang, Chaoxiang Ma +3

cs.LG2024

Advancing Open-Set Domain Generalization Using Evidential Bi-Level Hardest Domain Scheduler

Kunyu Peng, Di Wen, Kailun Yang +6

cs.CV2026

Segment-to-Act: Label-Noise-Robust Action-Prompted Video Segmentation Towards Embodied Intelligence

Wenxin Li, Kunyu Peng, Di Wen +4

cs.CV2026

ProOOD: Prototype-Guided Out-of-Distribution 3D Occupancy Prediction

Yuheng Zhang, Mengfei Duan, Kunyu Peng +5

cs.CV2021

PillarSegNet: Pillar-based Semantic Grid Map Estimation using Sparse LiDAR Data

Juncong Fei, Kunyu Peng, Philipp Heidenreich +2

cs.CV2025

Exploring Self-supervised Skeleton-based Action Recognition in Occluded Environments

Yifei Chen, Kunyu Peng, Alina Roitberg +7

cs.CV2024

TransKD: Transformer Knowledge Distillation for Efficient Semantic Segmentation

Ruiping Liu, Kailun Yang, Alina Roitberg +5

cs.CV2026

Out-of-Distribution Semantic Occupancy Prediction

Yuheng Zhang, Mengfei Duan, Kunyu Peng +6

cs.CV2026

Exploring Single Domain Generalization of LiDAR-based Semantic Segmentation under Imperfect Labels

Weitong Kong, Zichao Zeng, Di Wen +5

cs.CV2024

Behind Every Domain There is a Shift: Adapting Distortion-aware Vision Transformers for Panoramic Semantic Segmentation

Jiaming Zhang, Kailun Yang, Hao Shi +7

cs.CV2022

Should I take a walk? Estimating Energy Expenditure from Video Data

Kunyu Peng, Alina Roitberg, Kailun Yang +2

cs.CV2026

HGeo-TopoMap: Boosting Topological Mapping with Hierarchical Geometric Priors

Siyu Li, Kunyu Peng, Di Wen +3

cs.CV2024

RoDLA: Benchmarking the Robustness of Document Layout Analysis Models

Yufan Chen, Jiaming Zhang, Kunyu Peng +4

cs.CV2026

IMPACT: A Dataset for Multi-Granularity Human Procedural Action Understanding in Industrial Assembly

Di Wen, Zeyun Zhong, David Schneider +18

cs.CV2026

Go Beyond Earth: Understanding Human Actions and Scenes in Microgravity Environments

Di Wen, Lei Qi, Kunyu Peng +9

cs.CV2025

RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba

Kunyu Peng, Di Wen, Jia Fu +9

cs.RO2024

MateRobot: Material Recognition in Wearable Robotics for People with Visual Impairments

Junwei Zheng, Jiaming Zhang, Kailun Yang +2

cs.RO2025

VISO-Grasp: Vision-Language Informed Spatial Object-centric 6-DoF Active View Planning and Grasping in Clutter and Invisibility

Yitian Shi, Di Wen, Guanqi Chen +5

cs.CV2021

Transfer beyond the Field of View: Dense Panoramic Semantic Segmentation via Unsupervised Domain Adaptation

Jiaming Zhang, Chaoxiang Ma, Kailun Yang +3

cs.CV2026

Diffusion-based Cumulative Adversarial Purification for Vision Language Models

Jia Fu, Yongtao Wu, Yihang Chen +5

cs.CV2026

OmniTrack++: Omnidirectional Multi-Object Tracking by Learning Large-FoV Trajectory Feedback

Kai Luo, Hao Shi, Kunyu Peng +4

cs.CV2022

Multi-modal Depression Estimation based on Sub-attentional Fusion

Ping-Cheng Wei, Kunyu Peng, Alina Roitberg +3

cs.CV2026

Rethinking Video Human-Object Interaction: Set Prediction over Time for Unified Detection and Anticipation

Yuanhao Luo, Di Wen, Kunyu Peng +5

cs.CV2026

SGR3 Model: Scene Graph Retrieval-Reasoning Model in 3D

Zirui Wang, Ruiping Liu, Yufan Chen +7

cs.HC2025

Snap, Segment, Deploy: A Visual Data and Detection Pipeline for Wearable Industrial Assistants

Di Wen, Junwei Zheng, Ruiping Liu +3

cs.CV2024

Occlusion-Aware Seamless Segmentation

Yihong Cao, Jiaming Zhang, Hao Shi +5

cs.AI2026

MICA: Multi-Agent Industrial Coordination Assistant

Di Wen, Kunyu Peng, Junwei Zheng +6

cs.CV2025

Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model

Ruiping Liu, Junwei Zheng, Yufan Chen +6

cs.CV2026

PS-MOT: Cultivating Instance Awareness from Point Seeds for Multi-Object Tracking

Kai Luo, Fei Teng, Mengfei Duan +6

cs.LG2024

Position: Quo Vadis, Unsupervised Time Series Anomaly Detection?

M. Saquib Sarfraz, Mei-Yen Chen, Lukas Layer +2

cs.RO2026

Hand-centric Human-to-Robot Trajectory Transfer from Video Demonstrations via Open-World Contact Localization

Yitian Shi, Di Wen, Zhengqi Han +6

cs.CV2025

Unlocking Constraints: Source-Free Occlusion-Aware Seamless Segmentation

Yihong Cao, Jiaming Zhang, Xu Zheng +5

cs.CV2024

Skeleton-Based Human Action Recognition with Noisy Labels

Yi Xu, Kunyu Peng, Di Wen +7

cs.CV2022

Towards Robust Semantic Segmentation of Accident Scenes via Multi-Source Mixed Sampling and Meta-Learning

Xinyu Luo, Jiaming Zhang, Kailun Yang +3

cs.CV2024

Fourier Prompt Tuning for Modality-Incomplete Scene Segmentation

Ruiping Liu, Jiaming Zhang, Kunyu Peng +6

cs.CV2026

InterEdit: Navigating Text-Guided 3D Dyadic Human Motion Editing

Yebin Yang, Di Wen, Lei Qi +10

cs.CV2025

Exploring Video-Based Driver Activity Recognition under Noisy Labels

Linjuan Fan, Di Wen, Kunyu Peng +8

cs.CV2025

MindAligner: Explicit Brain Functional Alignment for Cross-Subject Visual Decoding from Limited fMRI Data

Yuqin Dai, Zhouheng Yao, Chunfeng Song +7

cs.LG2026

I\textsuperscript{2}RiMA: Spectral Riemannian Representation with Temporal Attention for Mental Stress Detection based on EEG Signals

Cheng He, Kunyu Peng, Shangen Han +3

cs.CV2025

T-MASK: Temporal Masking for Probing Foundation Models across Camera Views in Driver Monitoring

Thinesh Thiyakesan Ponbagavathi, Kunyu Peng, Alina Roitberg

cs.CV2024

Referring Atomic Video Action Recognition

Kunyu Peng, Jia Fu, Kailun Yang +8

cs.CV2026

EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos

Ruiping Liu, Junwei Zheng, Yufan Chen +7

cs.LG2026

Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels

Kening Wang, Di Wen, Yufan Chen +6

cs.CV2026

Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise

Wenxin Li, Kunyu Peng, Di Wen +6

cs.CV2021

Trans4Trans: Efficient Transformer for Transparent Object and Semantic Scene Segmentation in Real-World Navigation Assistance

Jiaming Zhang, Kailun Yang, Angela Constantinescu +3

cs.CV2024

EchoTrack: Auditory Referring Multi-Object Tracking for Autonomous Driving

Jiacheng Lin, Jiajun Chen, Kunyu Peng +4