2 papers
cs.IR2026
MLLMRec-R1: Incentivizing Reasoning Capability in Large Language Models for Multimodal Sequential Recommendation
Yu Wang, Yonghui Yang, Le Wu +3
Group relative policy optimization (GRPO) has become a standard post-training paradigm for improving reasoning and preference alignment in large language models (LLMs), and has rec…
cs.IR2026
CLEAR: Null-Space Projection for Cross-Modal De-Redundancy in Multimodal Recommendation
Hao Zhan, Yihui Wang, Yonghui Yang +6
Multimodal recommendation has emerged as an effective paradigm for enhancing collaborative filtering by incorporating heterogeneous content modalities. Existing multimodal recommen…