1 paper
Simin Li, Zihao Mao, Hanxiao Li +13
In cooperative Multi-Agent Reinforcement Learning (MARL), it is a common practice to tune hyperparameters in ideal simulated environments to maximize cooperative performance. Howev…