1 paper
Ting Zhu, Yue Jin, Jeremie Houssineau +1
In decentralized multi-agent reinforcement learning, agents learning in isolation can lead to relative over-generalization (RO), where optimal joint actions are undervalued in favo…