3 papers
cs.CV2026
StreamAgent: Towards Anticipatory Agents for Streaming Video Understanding
Haolin Yang, Feilong Tang, Lingxiao Zhao +10
Real-time streaming video understanding in domains such as autonomous driving and intelligent surveillance poses challenges beyond conventional offline video processing, requiring…
cs.CV2025
DAGLFNet: Deep Feature Attention Guided Global and Local Feature Fusion for Pseudo-Image Point Cloud Segmentation
Chuang Chen, Yi Lin, Bo Wang +3
Environmental perception systems are crucial for high-precision mapping and autonomous navigation, with LiDAR serving as a core sensor providing accurate 3D point cloud data. Effic…
cs.CV2025
Project-and-Fuse: Improving RGB-D Semantic Segmentation via Graph Convolution Networks
Xiaoyan Jiang, Bohan Wang, Xinlong Wan +3
Most existing RGB-D semantic segmentation methods focus on the feature level fusion, including complex cross-modality and cross-scale fusion modules. However, these methods may cau…