4 papers
HulluEdit: Single-Pass Evidence-Consistent Subspace Editing for Mitigating Hallucinations in Large Vision-Language Models
Yangguang Lin, Quan Fang, Yufei Li +3
Object hallucination in Large Vision-Language Models (LVLMs) significantly hinders their reliable deployment. Existing methods struggle to balance efficiency and accuracy: they oft…
Modality-Guided Mixture of Graph Experts with Entropy-Triggered Routing for Multimodal Recommendation
Ji Dai, Quan Fang, Dengsheng Cai
Multimodal recommendation enhances ranking by integrating user-item interactions with item content, which is particularly effective under sparse feedback and long-tail distribution…
Stance-Driven Multimodal Controlled Statement Generation: New Dataset and Task
Bingqian Wang, Quan Fang, Jiachen Sun +1
Formulating statements that support diverse or controversial stances on specific topics is vital for platforms that enable user expression, reshape political discourse, and drive s…
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
Ruoyu Wang, Jiachen Sun, Shaowei Hua +1
Direct Preference Optimization (DPO) is a method for enhancing model performance by directly optimizing for the preferences or rankings of outcomes, instead of traditional loss fun…