1 paper
Jianhao Wang, Jin Zhang, Haozhe Jiang +3
Recent offline meta-reinforcement learning (meta-RL) methods typically utilize task-dependent behavior policies (e.g., training RL agents on each individual task) to collect a mult…