2 papers
cs.CV2026
SAMA: Semantic Anchor-aligned Augmentation for Unified Low-Resource Multimodal Information Extraction
Quanjiang Guo, Chong Mu, Jiazhou Pan +4
Multimodal Information Extraction (MIE)-covering tasks such as Multimodal Named Entity Recognition (MNER), Relation Extraction (MRE), and Event Extraction (MEE)-is essential for un…
cs.CV2025
Face-MakeUp: Multimodal Facial Prompts for Text-to-Image Generation
Dawei Dai, Mingming Jia, Yinxiu Zhou +2
Facial images have extensive practical applications. Although the current large-scale text-image diffusion models exhibit strong generation capabilities, it is challenging to gener…