1 paper
Bozhidar Vasilev, Tarun Gupta, Bei Peng +1
Policy gradient methods are an attractive approach to multi-agent reinforcement learning problems due to their convergence properties and robustness in partially observable scenari…