Showing cs.IRShow all
2 papers · 1 filter
cs.IR2026
MLLMRec-R1: Incentivizing Reasoning Capability in Large Language Models for Multimodal Sequential Recommendation
Yu Wang, Yonghui Yang, Le Wu +3
Group relative policy optimization (GRPO) has become a standard post-training paradigm for improving reasoning and preference alignment in large language models (LLMs), and has rec…
cs.IR2025
Customizing Language Models with Instance-wise LoRA for Sequential Recommendation
Xiaoyu Kong, Jiancan Wu, An Zhang +4
Sequential recommendation systems predict the next interaction item based on users' past interactions, aligning recommendations with individual preferences. Leveraging the strength…