7 papers · 1 filter
Learning Adaptive Semantic Gaussian Allocation for 3D Occupancy
Kanglin Ning, Yiran Zhao, Wenrui Li +4
Semantic 3D Gaussians provide a compact representation for 3D semantic occupancy prediction by rendering semantic primitives into a voxel volume under voxel-wise supervision. Recen…
Hierarchical Semantic-Constrained Heterogeneous Graph for Audio-Visual Event Localization
Zhe Yang, Ruyi Zhang, Hongtao Chen +4
Open-vocabulary audio-visual event localization (OV-AVEL) jointly models audio-visual cues to recognize and temporally localize events, including categories unseen during training.…
Towards Accurate Single Panoramic 3D Detection: A Semantic Gaussian Centric Approach
Kanglin Ning, Yiran Zhao, Wenrui Li +3
Three-dimensional object detection in panoramic imagery is crucial for comprehensive scene understanding, yet accurately mapping 2D features to 3D remains a significant challenge.…
PairDropGS: Paired Dropout-Induced Consistency Regularization for Sparse-View Gaussian Splatting
Hantang Li, Qiang Zhu, Xiandong Meng +3
Dropout-based sparse-view 3D Gaussian Splatting (3DGS) methods alleviate overfitting by randomly suppressing Gaussian primitives during training. Existing methods mainly focus on d…
Hyperbolic Distillation: Geometry-Guided Cross-Modal Transfer for Robust 3D Object Detection
Kanglin Ning, Wenrui Li, Houde Quan +3
Cross-modal knowledge distillation has emerged as an effective strategy for integrating point cloud and image features in 3D perception tasks. However, the modality heterogeneity,…
All-in-One Video Restoration under Smoothly Evolving Unknown Weather Degradations
Wenrui Li, Hongtao Chen, Yao Xiao +4
All-in-one image restoration aims to recover clean images from diverse unknown degradations using a single model. But extending this task to videos faces unique challenges. Existin…