1 paper
Sitong Zhang, Tuo Shi, Mario Di Francesco +2
Distributed reinforcement learning (RL) scales training by parallelizing actors and learners around an Experience Buffer. As RL workloads grow, however, the buffer becomes more tha…