1 paper · 1 filter
Yinuo Xu, Shuo Lu, Jianjie Cheng +5
Deep Research agents tackle knowledge-intensive tasks through multi-round retrieval and decision-oriented generation. While reinforcement learning (RL) has been shown to improve pe…