Showing cs.AIShow all
2 papers · 1 filter
cs.AI2023
Multi-agent Policy Reciprocity with Theoretical Guarantee
Haozhi Wang, Yinchuan Li, Qing Wang +2
Modern multi-agent reinforcement learning (RL) algorithms hold great potential for solving a variety of real-world problems. However, they do not fully exploit cross-agent knowledg…
cs.AI2022
On the Convergence Theory of Meta Reinforcement Learning with Personalized Policies
Haozhi Wang, Qing Wang, Yunfeng Shao +3
Modern meta-reinforcement learning (Meta-RL) methods are mainly developed based on model-agnostic meta-learning, which performs policy gradient steps across tasks to maximize polic…