1 paper
Haozhi Wang, Qing Wang, Yunfeng Shao +3
Modern meta-reinforcement learning (Meta-RL) methods are mainly developed based on model-agnostic meta-learning, which performs policy gradient steps across tasks to maximize polic…