1 paper
Yanan Xiao, Yixiang Tang, Zechen Feng +3
While experience replay is essential for data efficiency in reinforcement learning (RL), standard methods treat the replay buffer as a passive memory system, prioritizing samples b…