1 paper · 1 filter
Joseph Ortiz, Antoine Dedieu, Wolfgang Lehrach +7
Learning from previously collected data via behavioral cloning or offline reinforcement learning (RL) is a powerful recipe for scaling generalist agents by avoiding the need for ex…