Publications (93)
MatchFormer: Interleaving Attention in Transformers for Feature Matching
Qing Wang, Jiaming Zhang, Kailun Yang +2
IMPACT-Scribe: Interactive Temporal Action Segmentation with Boundary Scribbles and Query Planning
Qian Yin, Di Wen, Kunyu Peng +11
Indoor Navigation Assistance for Visually Impaired People via Dynamic SLAM and Panoptic Segmentation with an RGB-D Sensor
Wenyan Ou, Jiaming Zhang, Kunyu Peng +4
VisNec: Measuring and Leveraging Visual Necessity for Multimodal Instruction Tuning
Mingkang Dong, Hongyi Cai, Jie Li +4
Navigating Open Set Scenarios for Skeleton-based Action Recognition
Kunyu Peng, Cheng Yin, Junwei Zheng +7
Trans4Map: Revisiting Holistic Bird's-Eye-View Mapping from Egocentric Images to Allocentric Semantics with Vision Transformers
Chang Chen, Jiaming Zhang, Kailun Yang +2
Exploring Few-Shot Adaptation for Activity Recognition on Diverse Domains
Kunyu Peng, Di Wen, David Schneider +5
Seeing Together: Multi-Robot Cooperative Egocentric Spatial Reasoning with Multimodal Large Language Models
Kunyu Peng, Zhikun Zhou, Kailun Yang +9
RHO: Robust Holistic OSM-Based Metric Cross-View Geo-Localization
Junwei Zheng, Ruize Dai, Ruiping Liu +7
Graph-based Document Structure Analysis
Yufan Chen, Ruiping Liu, Junwei Zheng +4
What if? Emulative Simulation with World Models for Situated Reasoning
Ruiping Liu, Yufan Chen, Yuheng Zhang +8
Hallucinating 360°: Panoramic Street-View Generation via Local Scenes Diffusion and Probabilistic Prompting
Fei Teng, Kai Luo, Sheng Wu +6
Is my Driver Observation Model Overconfident? Input-guided Calibration Networks for Reliable and Interpretable Confidence Estimates
Alina Roitberg, Kunyu Peng, David Schneider +4
TransDARC: Transformer-based Driver Activity Recognition with Latent Space Feature Calibration
Kunyu Peng, Alina Roitberg, Kailun Yang +2
CSBrain: A Cross-scale Spatiotemporal Brain Foundation Model for EEG Decoding
Yuchen Zhou, Jiamin Wu, Zichen Ren +7
360BEV: Panoramic Semantic Mapping for Indoor Bird's-Eye View
Zhifeng Teng, Jiaming Zhang, Kailun Yang +5
Open Scene Understanding: Grounded Situation Recognition Meets Segment Anything for Helping People with Visual Impairments
Ruiping Liu, Jiaming Zhang, Kunyu Peng +5
IMPACT-HOI: Supervisory Control for Onset-Anchored Partial HOI Event Construction
Haoshen Zhang, Di Wen, Kunyu Peng +12
Trans4Trans: Efficient Transformer for Transparent Object Segmentation to Help Visually Impaired People Navigate in the Real World
Jiaming Zhang, Kailun Yang, Angela Constantinescu +3
LFX: Towards Unified Light Field Dense Semantic Segmentation and Salient Object Detection
Fei Teng, Lingxin Huang, Buyin Deng +8
Open Panoramic Segmentation
Junwei Zheng, Ruiping Liu, Yufan Chen +5
Quantized Distillation: Optimizing Driver Activity Recognition Models for Resource-Constrained Environments
Calvin Tanama, Kunyu Peng, Zdravko Marinov +2
RoHOI: Robustness Benchmark for Human-Object Interaction Detection
Di Wen, Kunyu Peng, Kailun Yang +7
Delving Deep into One-Shot Skeleton-based Action Recognition with Diverse Occlusions
Kunyu Peng, Alina Roitberg, Kailun Yang +2
Not an Obstacle for Dog, but a Hazard for Human: A Co-Ego Navigation System for Guide Dog Robots
Ruiping Liu, Jingqi Zhang, Junwei Zheng +8
Towards Privacy-Supporting Fall Detection via Deep Unsupervised RGB2Depth Adaptation
Hejun Xiao, Kunyu Peng, Xiangsheng Huang +4
Seeing Beyond: Extrapolative Domain Adaptive Panoramic Segmentation
Yuanfan Zheng, Kunyu Peng, Xu Zheng +1
A Comparative Analysis of Decision-Level Fusion for Multimodal Driver Behaviour Understanding
Alina Roitberg, Kunyu Peng, Zdravko Marinov +3
$M^2$-Occ: Resilient 3D Semantic Occupancy Prediction for Autonomous Driving with Incomplete Camera Inputs
Kaixin Lin, Kunyu Peng, Di Wen +3
TME-PSR: Time-aware, Multi-interest, and Explanation Personalization for Sequential Recommendation
Qingzhuo Wang, Leilei Wen, Juntao Chen +4
HybriDLA: Hybrid Generation for Document Layout Analysis
Yufan Chen, Omar Moured, Ruiping Liu +4
MASS: Multi-Attentional Semantic Segmentation of LiDAR Data for Dense Top-View Understanding
Kunyu Peng, Juncong Fei, Kailun Yang +6
Affect-DML: Context-Aware One-Shot Recognition of Human Affect using Deep Metric Learning
Kunyu Peng, Alina Roitberg, David Schneider +3
FishDreamer: Towards Fisheye Semantic Completion via Unified Image Outpainting and Segmentation
Hao Shi, Yu Li, Kailun Yang +7
IMPACT-CYCLE: A Contract-Based Multi-Agent System for Claim-Level Supervisory Correction of Long-Video Semantic Memory
Weitong Kong, Di Wen, Kunyu Peng +10
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
Yiping Wei, Kunyu Peng, Alina Roitberg +6
HIDA: Towards Holistic Indoor Understanding for the Visually Impaired via Semantic Instance Segmentation with a Wearable Solid-State LiDAR Sensor
Huayao Liu, Ruiping Liu, Kailun Yang +3
LF Tracy: A Unified Single-Pipeline Approach for Salient Object Detection in Light Field Cameras
Fei Teng, Jiaming Zhang, Jiawei Liu +4
Tightly-Coupled LiDAR-Visual SLAM Based on Geometric Features for Mobile Agents
Ke Cao, Ruiping Liu, Ze Wang +6
Muscles in Time: Learning to Understand Human Motion by Simulating Muscle Activations
David Schneider, Simon ReiÃ, Marco Kugler +6
Towards Activated Muscle Group Estimation in the Wild
Kunyu Peng, David Schneider, Alina Roitberg +6
Delivering Arbitrary-Modal Semantic Segmentation
Jiaming Zhang, Ruiping Liu, Hao Shi +6
Mitigating Label Noise using Prompt-Based Hyperbolic Meta-Learning in Open-Set Domain Generalization
Kunyu Peng, Di Wen, M. Saquib Sarfraz +7
HopaDIFF: Holistic-Partial Aware Fourier Conditioned Diffusion for Referring Human Action Segmentation in Multi-Person Scenarios
Kunyu Peng, Junchao Huang, Xiangsheng Huang +7
Probing Fine-Grained Action Understanding and Cross-View Generalization of Foundation Models
Thinesh Thiyakesan Ponbagavathi, Kunyu Peng, Alina Roitberg
OAFuser: Towards Omni-Aperture Fusion for Light Field Semantic Segmentation
Fei Teng, Jiaming Zhang, Kunyu Peng +3
EReLiFM: Evidential Reliability-Aware Residual Flow Meta-Learning for Open-Set Domain Generalization under Noisy Labels
Kunyu Peng, Di Wen, Kailun Yang +9
Bending Reality: Distortion-aware Transformers for Adapting to Panoramic Semantic Segmentation
Jiaming Zhang, Kailun Yang, Chaoxiang Ma +3
Advancing Open-Set Domain Generalization Using Evidential Bi-Level Hardest Domain Scheduler
Kunyu Peng, Di Wen, Kailun Yang +6
Segment-to-Act: Label-Noise-Robust Action-Prompted Video Segmentation Towards Embodied Intelligence
Wenxin Li, Kunyu Peng, Di Wen +4
ProOOD: Prototype-Guided Out-of-Distribution 3D Occupancy Prediction
Yuheng Zhang, Mengfei Duan, Kunyu Peng +5
PillarSegNet: Pillar-based Semantic Grid Map Estimation using Sparse LiDAR Data
Juncong Fei, Kunyu Peng, Philipp Heidenreich +2
Exploring Self-supervised Skeleton-based Action Recognition in Occluded Environments
Yifei Chen, Kunyu Peng, Alina Roitberg +7
TransKD: Transformer Knowledge Distillation for Efficient Semantic Segmentation
Ruiping Liu, Kailun Yang, Alina Roitberg +5
Out-of-Distribution Semantic Occupancy Prediction
Yuheng Zhang, Mengfei Duan, Kunyu Peng +6
Exploring Single Domain Generalization of LiDAR-based Semantic Segmentation under Imperfect Labels
Weitong Kong, Zichao Zeng, Di Wen +5
Behind Every Domain There is a Shift: Adapting Distortion-aware Vision Transformers for Panoramic Semantic Segmentation
Jiaming Zhang, Kailun Yang, Hao Shi +7
Should I take a walk? Estimating Energy Expenditure from Video Data
Kunyu Peng, Alina Roitberg, Kailun Yang +2
HGeo-TopoMap: Boosting Topological Mapping with Hierarchical Geometric Priors
Siyu Li, Kunyu Peng, Di Wen +3
RoDLA: Benchmarking the Robustness of Document Layout Analysis Models
Yufan Chen, Jiaming Zhang, Kunyu Peng +4
IMPACT: A Dataset for Multi-Granularity Human Procedural Action Understanding in Industrial Assembly
Di Wen, Zeyun Zhong, David Schneider +18
Go Beyond Earth: Understanding Human Actions and Scenes in Microgravity Environments
Di Wen, Lei Qi, Kunyu Peng +9
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
Kunyu Peng, Di Wen, Jia Fu +9
MateRobot: Material Recognition in Wearable Robotics for People with Visual Impairments
Junwei Zheng, Jiaming Zhang, Kailun Yang +2
VISO-Grasp: Vision-Language Informed Spatial Object-centric 6-DoF Active View Planning and Grasping in Clutter and Invisibility
Yitian Shi, Di Wen, Guanqi Chen +5
Transfer beyond the Field of View: Dense Panoramic Semantic Segmentation via Unsupervised Domain Adaptation
Jiaming Zhang, Chaoxiang Ma, Kailun Yang +3
Diffusion-based Cumulative Adversarial Purification for Vision Language Models
Jia Fu, Yongtao Wu, Yihang Chen +5
OmniTrack++: Omnidirectional Multi-Object Tracking by Learning Large-FoV Trajectory Feedback
Kai Luo, Hao Shi, Kunyu Peng +4
Multi-modal Depression Estimation based on Sub-attentional Fusion
Ping-Cheng Wei, Kunyu Peng, Alina Roitberg +3
Rethinking Video Human-Object Interaction: Set Prediction over Time for Unified Detection and Anticipation
Yuanhao Luo, Di Wen, Kunyu Peng +5
SGR3 Model: Scene Graph Retrieval-Reasoning Model in 3D
Zirui Wang, Ruiping Liu, Yufan Chen +7
Snap, Segment, Deploy: A Visual Data and Detection Pipeline for Wearable Industrial Assistants
Di Wen, Junwei Zheng, Ruiping Liu +3
Occlusion-Aware Seamless Segmentation
Yihong Cao, Jiaming Zhang, Hao Shi +5
MICA: Multi-Agent Industrial Coordination Assistant
Di Wen, Kunyu Peng, Junwei Zheng +6
Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model
Ruiping Liu, Junwei Zheng, Yufan Chen +6
PS-MOT: Cultivating Instance Awareness from Point Seeds for Multi-Object Tracking
Kai Luo, Fei Teng, Mengfei Duan +6
Position: Quo Vadis, Unsupervised Time Series Anomaly Detection?
M. Saquib Sarfraz, Mei-Yen Chen, Lukas Layer +2
Hand-centric Human-to-Robot Trajectory Transfer from Video Demonstrations via Open-World Contact Localization
Yitian Shi, Di Wen, Zhengqi Han +6
Unlocking Constraints: Source-Free Occlusion-Aware Seamless Segmentation
Yihong Cao, Jiaming Zhang, Xu Zheng +5
Skeleton-Based Human Action Recognition with Noisy Labels
Yi Xu, Kunyu Peng, Di Wen +7
Towards Robust Semantic Segmentation of Accident Scenes via Multi-Source Mixed Sampling and Meta-Learning
Xinyu Luo, Jiaming Zhang, Kailun Yang +3
Fourier Prompt Tuning for Modality-Incomplete Scene Segmentation
Ruiping Liu, Jiaming Zhang, Kunyu Peng +6
InterEdit: Navigating Text-Guided 3D Dyadic Human Motion Editing
Yebin Yang, Di Wen, Lei Qi +10
Exploring Video-Based Driver Activity Recognition under Noisy Labels
Linjuan Fan, Di Wen, Kunyu Peng +8
MindAligner: Explicit Brain Functional Alignment for Cross-Subject Visual Decoding from Limited fMRI Data
Yuqin Dai, Zhouheng Yao, Chunfeng Song +7
I\textsuperscript{2}RiMA: Spectral Riemannian Representation with Temporal Attention for Mental Stress Detection based on EEG Signals
Cheng He, Kunyu Peng, Shangen Han +3
T-MASK: Temporal Masking for Probing Foundation Models across Camera Views in Driver Monitoring
Thinesh Thiyakesan Ponbagavathi, Kunyu Peng, Alina Roitberg
Referring Atomic Video Action Recognition
Kunyu Peng, Jia Fu, Kailun Yang +8
EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos
Ruiping Liu, Junwei Zheng, Yufan Chen +7
Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels
Kening Wang, Di Wen, Yufan Chen +6
Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise
Wenxin Li, Kunyu Peng, Di Wen +6
Trans4Trans: Efficient Transformer for Transparent Object and Semantic Scene Segmentation in Real-World Navigation Assistance
Jiaming Zhang, Kailun Yang, Angela Constantinescu +3
EchoTrack: Auditory Referring Multi-Object Tracking for Autonomous Driving
Jiacheng Lin, Jiajun Chen, Kunyu Peng +4