3 papers
cs.CV2025
MSR-Align: Policy-Grounded Multimodal Alignment for Safety-Aware Reasoning in Vision-Language Models
Yinan Xia, Yilei Jiang, Yingshui Tan +3
Vision-Language Models (VLMs) have achieved remarkable progress in multimodal reasoning tasks through enhanced chain-of-thought capabilities. However, this advancement also introdu…
cs.CV2025
Dream-IF: Dynamic Relative EnhAnceMent for Image Fusion
Xingxin Xu, Bing Cao, Dongdong Li +2
Image fusion aims to integrate comprehensive information from images acquired through multiple sources. However, images captured by diverse sensors often encounter various degradat…
cs.CV2024
Test-Time Dynamic Image Fusion
Bing Cao, Yinan Xia, Yi Ding +2
The inherent challenge of image fusion lies in capturing the correlation of multi-source images and comprehensively integrating effective information from different sources. Most e…