1 paper
Sanghyeob Song, Donghyeok Lee, Jinsik Kim +1
For reinforcement learning in data-scarce domains like real-world robotics, intensive data reuse enhances efficiency but induces overfitting. While prior works focus on critic bias…