2 papers
cs.CV2026
UG-UMRE: Uncertainty-Guided Modality Augmentation and Distributional Calibration for Unified Multimodal Relation Extraction
Bo Kong, Liruiz Jia, Yi Liang +5
Unified Multimodal Relation Extraction (UMRE) aims to identify intra-modal and cross-modal relations between textual entities and visual objects. However, existing UMRE studies sti…
cs.CV2026
FTibSuite: A Comprehensive Resource Suite for Tibetan Vision-Language Modeling
Guixian Xu, Yide Liang, Zeli Su +5
Vision-language models have progressed rapidly, but Tibetan remains a severely underserved low-resource language due to the lack of reproducible training and evaluation infrastruct…