1 paper · 1 filter
Keqin Wang, Tao Zhong, David Chang +1
Multi-agent reinforcement learning (MARL) policies for swarm control often learn inefficiently and generalize poorly across coordinate frames, team sizes, and agent roles. We intro…