1 paper · 1 filter
Chunji Lv, Yangguang Wei, Junlin Liu +6
Large language model agents have shown strong potential in complex interactive tasks, yet their reinforcement learning (RL) is often hindered by sparse rewards, as a long multi-tur…