1 paper · 1 filter
Xinjie He, Zhiyuan Lin, Su Liu +4
Reinforcement learning (RL) has emerged as a viable recipe for training LLM agents to reason over external memory banks in multi-session dialogue. Existing work trains exclusively…