1 paper
Tuo Zhang, Leonardo Stella, Julian Barreiro-Gomez
Despite its groundbreaking success, multi-agent reinforcement learning (MARL) still suffers from instability and nonstationarity. Replicator dynamics, the most well-known model fro…