1 paper · 1 filter
Jiajun Hu, Nuria Armengol Urpi, Jin Cheng +1
Zero-shot reinforcement learning (RL) algorithms aim to learn a family of policies from a reward-free dataset, and recover optimal policies for any reward function directly at test…