1 paper
Scott Jeen, Tom Bewley, Jonathan M. Cullen
Recent work has shown that, under certain assumptions, zero-shot reinforcement learning (RL) methods can generalise to any unseen task in an environment after reward-free pre-train…