1 paper
Andrew Choi, Xinjie Wang, Zhizhong Su +1
The strong performance of large vision-language models (VLMs) trained with reinforcement learning (RL) has motivated similar approaches for fine-tuning vision-language-action (VLA)…