1 paper
Shahil Shaik, Jonathon M. Smereka, Yue Wang
Centralized training with decentralized execution (CTDE) has been the dominant paradigm in multi-agent reinforcement learning (MARL), but its reliance on global state information d…