1 paper
Brian Zhu, Momen Khalil, E Harrison +17
While reinforcement learning (RL) allows generalist robot policies to continually improve during deployment, the large model size of modern generalist policies, such as VLAs, poses…