1 paper · 1 filter
Chak Lam Shek, Guangyao Shi, Pratap Tokekar
Multi-agent reinforcement learning (MARL) requires coordinated and stable policy updates among interacting agents. Heterogeneous-Agent Trust Region Policy Optimization (HATRPO) enf…