From the 1 of 8 linked papers with an AI index.
8 papers
What to Remove, What to Preserve: Dual-Ambiguity Rectification for All-in-One Image Restoration
Cencen Liu, Wen Yin, Dongyang Zhang +6
The paper introduces DAR-Net, a deep network that tackles the dual ambiguity problem in all‑in‑one image restoration by modeling degradation states with a simplex‑constrained arche…
LangPrecip: Language-Aware Multimodal Precipitation Nowcasting
Xudong Ling, Chaorong Li, Tianxi Huang +2
Short-term precipitation nowcasting is an inherently uncertain and under-constrained spatiotemporal forecasting problem, especially for rapidly evolving and extreme weather events.…
One Model, Two Minds: Task-Conditioned Reasoning for Unified Image Quality and Aesthetic Assessment
Wen Yin, Cencen Liu, Dingrui Liu +3
Unifying Image Quality Assessment (IQA) and Image Aesthetic Assessment (IAA) in a single multimodal large language model is appealing, yet existing methods adopt a task-agnostic re…
Unbiased Dynamic Multimodal Fusion
Shicai Wei, Kaijie Zhang, Luyi Chen +2
Traditional multimodal methods often assume static modality quality, which limits their adaptability in dynamic real-world scenarios. Thus, dynamical multimodal methods are propose…
TiCAL:Typicality-Based Consistency-Aware Learning for Multimodal Emotion Recognition
Wen Yin, Siyu Zhan, Cencen Liu +5
Multimodal Emotion Recognition (MER) aims to accurately identify human emotional states by integrating heterogeneous modalities such as visual, auditory, and textual data. Existing…
SPADE: Spatial-Aware Denoising Network for Open-vocabulary Panoptic Scene Graph Generation with Long- and Local-range Context Reasoning
Xin Hu, Ke Qin, Guiduo Duan +3
Panoptic Scene Graph Generation (PSG) integrates instance segmentation with relation understanding to capture pixel-level structural relationships in complex scenes. Although recen…