1 paper
Hui-Ze Tan, Xiao-Wen Yang, Hao Chen +7
Large Language Model (LLM) agents often face significant credit assignment challenges in long-horizon, multi-step tasks due to sparse rewards. Existing value-free methods, such as…