3 papers
cs.CV2025
SkyLink: Unifying Street-Satellite Geo-Localization via UAV-Mediated 3D Scene Alignment
Hongyang Zhang, Yinhao Liu, Zhenyu Kuang
Cross-view geo-localization aims at establishing location correspondences between different viewpoints. Existing approaches typically learn cross-view correlations through direct f…
cs.CV2025
AWM-Fuse: Multi-Modality Image Fusion for Adverse Weather via Global and Local Text Perception
Xilai Li, Huichun Liu, Xiaosong Li +3
Multi-modality image fusion (MMIF) in adverse weather aims to address the loss of visual information caused by weather-related degradations, providing clearer scene representations…
cs.CV2025
MambaTrans: Multimodal Fusion Image Translation via Large Language Model Priors for Downstream Visual Tasks
Yushen Xu, Xiaosong Li, Zhenyu Kuang +3
The goal of multimodal image fusion is to integrate complementary information from infrared and visible images, generating multimodal fused images for downstream tasks. Existing do…