1 paper
Andrea Baisero, Rupali Bhati, Shuo Liu +2
Value function decomposition methods for cooperative multi-agent reinforcement learning compose joint values from individual per-agent utilities, and train them using a joint objec…