1 paper
Junhao Cao, Hongyi Xia, Jianian Wu +3
Policy Gradient for Parallel State Entropy maximization (PGPSE) expands state-space coverage by training independently parameterized policies in replicated copies of the same envir…