1 paper
Jing-Cheng Pang, Kaiyuan Li, Yidi Wang +3
A central challenge in reinforcement learning (RL) is its dependence on extensive real-world interaction data to learn task-specific policies. While recent work demonstrates that l…