4 papers
RingMo-Agent: A Unified Remote Sensing Foundation Model for Multi-Platform and Multi-Modal Reasoning
Huiyang Hu, Peijin Wang, Yingchao Feng +9
Remote sensing (RS) images from multiple modalities and platforms exhibit diverse details due to differences in sensor characteristics and imaging perspectives. Existing vision-lan…
RingMoE: Mixture-of-Modality-Experts Multi-Modal Foundation Models for Universal Remote Sensing Image Interpretation
Hanbo Bi, Yingchao Feng, Boyuan Tong +11
The rapid advancement of foundation models has revolutionized visual representation learning in a self-supervised manner. However, their application in remote sensing (RS) remains…
Task-Generalized Adaptive Cross-Domain Learning for Multimodal Image Fusion
Mengyu Wang, Zhenyu Liu, Kun Li +4
Multimodal Image Fusion (MMIF) aims to integrate complementary information from different imaging modalities to overcome the limitations of individual sensors. It enhances image qu…
A Complex-valued SAR Foundation Model Based on Physically Inspired Representation Learning
Mengyu Wang, Hanbo Bi, Yingchao Feng +7
Vision foundation models in remote sensing have been extensively studied due to their superior generalization on various downstream tasks. Synthetic Aperture Radar (SAR) offers all…