2 papers
cs.LG2026
LearnAlign: Data Selection for LLM Reinforcement Learning with Improved Gradient Alignment
Shipeng Li, Zhiqin Yang, Shikun Li +7
Reinforcement learning with verifiable rewards (RLVR) has become a key technique for enhancing LLMs' reasoning abilities, yet its data inefficiency remains a major bottleneck. To a…
cs.IR2025
Towards Comprehensible Recommendation with Large Language Model Fine-tuning
Yunze Luo, Yinjie Jiang, Gaode Chen +4
Recommender systems have become increasingly ubiquitous in daily life. While traditional recommendation approaches primarily rely on ID-based representations or item-side content f…