1 paper · 1 filter
Nazim Bendib, Nicolas Perrin-Gilbert, Olivier Sigaud
Offline zero-shot reinforcement learning (RL) aims to learn agents that optimize unseen reward functions without additional environment interaction. The standard approach to this p…