3 papers
eess.IV2026
Generalizable 3D Gaussian Splatting enabled Semantic Coding for Real-Time Immersive Video Communications
Dingxi Yang, Wenqi Guo, Yue Liu +2
Real-time immersive video communications, particularly high-fidelity 3D telepresence, necessitates a synergistic balance between instantaneous dynamic scene reconstruction and high…
cs.CV2024
Seamless Detection: Unifying Salient Object Detection and Camouflaged Object Detection
Yi Liu, Chengxin Li, Xiaohui Dong +4
Achieving joint learning of Salient Object Detection (SOD) and Camouflaged Object Detection (COD) is extremely challenging due to their distinct object characteristics, i.e., salie…
cs.CV2024
Part-Whole Relational Fusion Towards Multi-Modal Scene Understanding
Yi Liu, Chengxin Li, Shoukun Xu +1
Multi-modal fusion has played a vital role in multi-modal scene understanding. Most existing methods focus on cross-modal fusion involving two modalities, often overlooking more co…