5 citations · 5 across the 1 of their papers we have counts for
1 paper · 1 filter
Junyu Zhang, Amrit Singh Bedi, Mengdi Wang +1
We posit a new mechanism for cooperation in multi-agent reinforcement learning (MARL) based upon any nonlinear function of the team's long-term state-action occupancy measure, i.e.…