1 paper · 1 filter
Alakh Sharma, Gaurish Trivedi, Kartikey Singh Bhandari +4
Scalable multi-agent reinforcement learning (MARL) remains a central challenge for AI. Existing population-based methods, like Policy-Space Response Oracles, PSRO, require storing…