2 papers
cs.CL2025
DyFuLM: An Advanced Multimodal Framework for Sentiment Analysis
Ruohan Zhou, Jiachen Yuan, Churui Yang +6
Understanding sentiment in complex textual expressions remains a fundamental challenge in affective computing. To address this, we propose a Dynamic Fusion Learning Model (DyFuLM),…
cs.CV2024
Visual Hallucinations of Multi-modal Large Language Models
Wen Huang, Hongbin Liu, Minxin Guo +1
Visual hallucination (VH) means that a multi-modal LLM (MLLM) imagines incorrect details about an image in visual question answering. Existing studies find VH instances only in exi…