1 paper · 1 filter
Mai Pham, Vikrant Vaze, Peter Chin
Deep reinforcement learning agents frequently suffer from premature convergence, where early entropy collapse causes the policy to discard exploratory behaviors before discovering…