1 paper
Zhanhong Jiang, Xian Yeow Lee, Sin Yong Tan +5
We propose a novel policy gradient method for multi-agent reinforcement learning, which leverages two different variance-reduction techniques and does not require large batches ove…