3 papers
cs.CV2026
MagicFuse: Single Image Fusion for Visual and Semantic Reinforcement
Hao Zhang, Yanping Zha, Zizhuo Li +2
This paper focuses on a highly practical scenario: how to continue benefiting from the advantages of multi-modal image fusion under harsh conditions when only visible imaging senso…
cs.CV2026
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
Linfeng Tang, Yeda Wang, Meiqi Gong +7
Compared to images, videos better reflect real-world acquisition and possess valuable temporal cues. However, existing multi-sensor fusion research predominantly integrates complem…
cs.CV2025
TemCoCo: Temporally Consistent Multi-modal Video Fusion with Visual-Semantic Collaboration
Meiqi Gong, Hao Zhang, Xunpeng Yi +2
Existing multi-modal fusion methods typically apply static frame-based image fusion techniques directly to video fusion tasks, neglecting inherent temporal dependencies and leading…