1 paper · 1 filter
Shinji Mai, Yunpeng Zhai, Ziqian Chen +5
Large language model based agents are increasingly deployed in complex, tool augmented environments. While reinforcement learning provides a principled mechanism for such agents to…