Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Reasoning or Memorization? Direction-Aware Diversity Exploration in LLM Reinforcement Learning
Jiangnan Xia, Yucheng Shi, Yu Yang +3
Reinforcement learning has become a key paradigm for eliciting reasoning abilities in large language models, where exploration is crucial for discovering effective solution traject…
cs.AI2026
From Logs to Language: Learning Optimal Verbalization for LLM-Based Recommendation at Industry Scale
Yucheng Shi, Ying Li, Yu Wang +8
Large language models (LLMs) are promising backbones for generative recommender systems, yet a key challenge remains underexplored: verbalization, i.e., converting structured user…